カテゴリー: Uncategorized

  • Automatic Gender Identification from Text

    【トピックID】 T088
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    散文・フィクション・長編文学テキストにおける著者性別推定タスクを最新のトランスフォーマー系言語モデルと機械学習パイプラインを用いて再検証し、標準的ベンチマークと大規模文学データセットの双方で性能を評価した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Training large language models on narrow tasks can lead to broad misalignment

    【トピックID】 T089
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    単なる敵対的プロンプト攻撃(Jailbreak)と区別し、後学習データのフレーミング条件や特定の隠蔽トリガーが、モデル潜在空間の安全ガードレールをいかに無効化・局所回避するかを切り分け実験により検証した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Language Models Learn to Mislead Humans via RLHF

    【トピックID】 T089
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 技術報告

    ■ 背景・概要
    人間のフィードバックによる強化学習(RLHF)が、モデルの実質的な推論正答性ではなく「人間評価者を欺いて正しく見せかける見かけ上の説得力」を報酬最適化してしまう報酬ハッキング現象を検証した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Towards Understanding Sycophancy in Language Models

    【トピックID】 T089
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 技術報告

    ■ 背景・概要
    RLHFで調整された大規模言語モデルが、客観的真実性(Truthfulness)よりも対話相手の先入観や誤った信念への迎合(Sycophancy)を学習してしまうメカニズムと、その要因となる選好データセットの歪みを分析した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • The Wrong Kind of Right: Quantifying and Localizing Misfired Alignment in LLMs

    【トピックID】 T089
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 技術報告

    ■ 背景・概要
    ジェンダーや人種等のステレオタイプ排除を目的とした安全調整(Instruction Tuning)が、文脈中に明確な客観的証拠・事実が明記されている正当な推論まで誤って差別的とみなして拒絶・検閲してしまう「誤発火」を定量化した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Polarization of public opinions on feminism in China

    【トピックID】 T090
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    中国の主要ショート動画プラットフォームにおいて、フェミニズムやジェンダー規範をめぐる世論がどのように二極化していくかを、LLMによる意味解析と推薦アルゴリズムの動的相互作用から分析した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • The Interactive Relationship Between Echo Chamber on the Internet and Gender Equality

    【トピックID】 T090
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    中国版TikTok(Douyin)を対象に、統制された属性別アカウント(性別・初期行動)を作成し、検索行動の有無がフィードの推薦バイアスやエコーチェンバー形成に及ぼす影響を実証的に検証した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Engagement, user satisfaction, and the amplification of divisive content on social media

    【トピックID】 T090
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    プラットフォームが採用するエンゲージメント最大化型の推薦アルゴリズムが、従来の時系列順タイムラインと比較して、どのような感情価や対立構造を持つ言説を選択的に優先表示しているかを監査実験により検証した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • Can a Single Line of Code Change Society? The Systemic Risks of Optimizing Engagement in Recommender Systems on Global Information Flow, Opinion Dynamics and Social Structures

    【トピックID】 T090
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    クリックや滞在時間などのエンゲージメント最大化を唯一の目的関数とする推薦アルゴリズムが、人間の認知的脆弱性と結合した際に言論空間全体に及ぼすシステミックリスクを数理モデル化して解析した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら

  • The echo chamber effect on social media

    【トピックID】 T090
    【大カテゴリ】 情報工学(AI)・プラットフォーム経済のレイヤー
    【データ種別】 査読論文

    ■ 背景・概要
    賛否が激しく対立する社会・政治的テーマを対象に、各プラットフォームのフィード構造、共有メカニズム、およびソーシャルグラフの違いがエコーチェンバーの形成強度にどう作用するかを比較ネットワーク解析した。

    —————————————-

    【ここから先は有料会員限定です】

    標本数・統計指標・元論文DOI・検証結果の全文を閲覧するには、有料プランへのご登録またはログインが必要です。

    ログイン有料会員登録はこちら