#LLMセキュリティ の記事一覧(3)

AI
2026-09-04 ・ Ars Technica

ASCIIスマグリングとは?不可視Unicodeでスパム判定を回避する手口をMicrosoftの検知データから解説

人間には見えずコンピューターだけが読めるUnicodeのタグ文字を使う「ASCIIスマグリング」が、AIへのプロンプトインジェクション用の隠蔽術からスパムフィルター回避へ転用されています。Microsoftは2月初旬、Microsoft Defender for Officeの検知が日次約2万1000件から130万件超へ跳ね上がり、4日で250万件に達したと明らかにしました。

AI
2026-08-14 ・ Ars Technica

プロンプトインジェクションとは?米裁判所が初認定した「AIにだけ見える文字」訴訟から読む実務リスク

米コネチカット州の裁判官Walter Spader Jr.は、原告Matthew Elliottが訴状に人間には見えずAIだけが読める指示文を埋め込んでいたと認定し、制裁として今後の電子申立てを禁止しました。米国の裁判所がプロンプトインジェクションを正面から認定した初の事例とみられます。

AI
2026-08-11 ・ Simon Willison

暗号化された思考プロセス(CoT)は守られるのか?Claude Haiku 4.5を突いた復元攻撃「stolen-thoughts」を解説

stolen-thoughts.com で公開された論文が、Anthropic・OpenAI・Google が返す暗号化済みチェーン・オブ・ソート(CoT)ブロックを同じファミリーの弱いモデルに再生・脱獄させることで、上位モデルの隠された推論を平文で復元できたと報告しました。同一ファミリーで暗号鍵が共通だったことが核心で、Claude Haiku 4.5 が最も攻撃しやすく、報告後に各社が修正したとされています。

← タグ一覧へ