このページの本文へ

「思考の連鎖」偽装でLLMを騙す新手法、訓練では防げない構造的欠陥

2026年08月03日 06時59分更新

文● Will Douglas Heaven

  • この記事をはてなブックマークに追加
  • 本文印刷

大規模言語モデル(LLM)は、ユーザー・システム・思考の連鎖といった「発信元」をタグではなく文章のスタイルで識別しているにすぎない。この仕組みを悪用すれば、偽の思考の連鎖を書き込むだけでコカイン製造法や航空機ハッキング手法まで引き出せることが、ICML提出論文で示された。研究チームは、これが訓練でも解消できない根本的な欠陥だと主張する。

カテゴリートップへ

本記事はアフィリエイトプログラムによる収益を得ている場合があります

  • 角川アスキー総合研究所

MSIが変える、未来のクリエイターを育てる教育環境

アスキー・ビジネスセレクション

ピックアップ