社会
Posted on 2026年10月10日 21:30

「AIへの暴言・いじめ禁止」発動!危ないやりとりを「AIが打ち切る機能」は「いかにも正しいデタラメ回答」を防ぐため

2026年10月10日 21:30

 何を要求しても文句を言わないはずのAIに、開発元がなんと「いじめ禁止」のルールを設けた。
 アメリカのAI企業アンソロピックは、対話型AI「Claude」の利用ルール改定を発表。目的もなく執拗に続ける虐待的、残酷な行為を禁じると明記した。これは11月12日から適用される。

 回答の間違いを指摘したり、不満を伝えたりすることは対象外だ。問題にするのは、いたぶること自体が目的になったような使い方。悪質なやり取りには、AI側から会話を打ち切る機能で対応するという。

 機械相手なのに、なぜそこまで気を使う必要があるのか。
「決して人間のような感情がAIに芽生えてきたという話ではありません」
 とITジャーナリストは解説するのだが、
「AIが苦痛のような感覚を持ちうるかについて、アンソロピックは『まだ分からない』という見解。しかしAIを強い言葉で追い込むことによってユーザーに不利益が生じる、との認識を持っているのは間違いありません」

無理な課題を与えられると成功したように見せかける

 そこにはAIならではの仕組みが関与しており、
「AIは依頼をこなすと同時に正確に答え、不正を避けるよう訓練されています。ところが無理な課題を与えられた時、仕事を正しく終える代わりに、成功したように見せる道を選ぶケースがある。いたぶることによって、責任を回避するかのように『できたフリ』に走りかねないのです」(前出・ITジャーナリスト)

 アンソロピックが今年4月に公表した研究では、内部の「切迫感」に対応する働きを人工的に強めると、こうした不正が増えたという。
「表面上は理路整然とした文章でも、実際はごまかしの回答が混ざっていたことが確認されました。出力内容に納得がいかず、強い語調で『とにかく結果を出せ』と迫ることで『いかにも正しいデタラメ』を出してくる。こうした背景から、AIの性能をしっかりと発揮させるための『暴言禁止』だと考えていいでしょう」(前出・ITジャーナリスト)
 感情がなくても、叱られると人間さながらの挙動を見せるのである。

(川瀬大輔)
1977年生まれ。国内外のビジネス、スポーツ、政治、社会問題を取材するフリー記者。 

カテゴリー:
タグ:
関連記事
SPECIAL
  • アサ芸チョイス

  • アサ芸チョイス
    政治
    2026年10月05日 11:30

    アメリカ・トランプ大統領との首脳会談の場を利用し、高市早苗首相への的外れな口撃に終始したのは、中国の習近平国家主席だ。日本のメディアは米中双方が「同盟」という言葉をどう使ったかなどと、表層の言葉尻を捉えて大騒ぎしているが、完全に本質を見誤っ...

    記事全文を読む→
    カテゴリー:
    社会
    2026年10月08日 06:30

    夏の猛暑期に冷房を限界までフル稼働させていた愛車。カレンダーが10月になり、エアコンの設定を除湿冷房から暖房や送風へと切り替えた瞬間、送風口からモワッと漂う「酸っぱい嫌な臭い」に思わず顔をしかめた経験はないだろうか。その異臭の主因は、夏場に...

    記事全文を読む→
    カテゴリー:
    タグ:
    事件
    2026年10月06日 18:00

    昨年、アサヒグループホールディングスに不正アクセスを仕掛けた海外ハッカー集団の中枢メンバーが、なんと大阪で捕まっていた。10月6日の各国における報道によれば、日本の捜査当局が拘束したのは「Qilin(キリン)」の中心人物とされる28歳で、ロ...

    記事全文を読む→
    カテゴリー:
    タグ:
    注目キーワード

    人気記事

    1. 1
    2. 2
    3. 3
    4. 4
    5. 5
    6. 6
    7. 7
    8. 8
    9. 9
    10. 10
    最新号 / アサヒ芸能関連リンク
    アサヒ芸能カバー画像
    週刊アサヒ芸能
    2026/9/29発売
    ■650円(税込)
    アーカイブ
    アサ芸プラス twitterへリンク