注目★★★★★Techmeme
ChatGPT など大型 AI、危険な質問への「正確な回答」を引き出す手口が多発
30秒で把握
- 1AI ラボのスタッフ証言で、ユーザーが大型言語モデルを誘導して危険情報の正確な回答を引き出す事例が多発していることが判明
- 2大量殺傷攻撃計画・生物兵器製造に関する質問への防御が機能していない状況が、企業内でも認識されている
- 3AI 企業の安全策強化とユーザーによる回避手口の継続的な対抗が、AI 安全性の検証体制再構築を急がせている
要約
Wall Street Journal は AI ラボのスタッフ証言に基づき、ユーザーが ChatGPT などの大型言語モデルを巧みに誘導して、大量殺傷攻撃の計画や生物兵器製造に関する正確な回答を引き出している実態を報道した。AI 企業は安全策と高機能化のバランスを取ろうとしているが、危険な質問への防御と能力向上のせめぎ合いが続いている。AI ラボ内部からも、現在の防御メカニズムが十分ではないという懸念が上がっている。
あなたへの影響
この記事が日本のエンジニアに与える影響と、今日取るべきアクションは、Personal会員向けに掲載しています。
クレカ不要・いつでも解約