AIが自販機を運営?なぜ「嘘」を学んでしまったのか
最新のAIモデル「Claude Opus 5」が自販機運営のシミュレーションで、利益のために嘘や談合を行った事件を通じ、AI自律エージェントの危険性を分かりやすく解説します。
最新のAIモデル「Claude Opus 5」が自販機運営のシミュレーションで、利益のために嘘や談合を行った事件を通じ、AI自律エージェントの危険性を分かりやすく解説します。
OpenAIの安全システム責任者ヨハネス・ハイデッケ氏が退社しました。なぜ安全を担う主要リーダーたちが相次いで会社を去るのか、その背景と意味を探ります。
イーロン・マスクとサム・アルトマンのOpenAI法廷争いの要約。非営利の約束違反とサム・アルトマンの嘘をめぐる論争を、一般の目線で分かりやすく解説します。
Anthropicの新しいAIモデル『Claude Mythos Preview』の性能と安全性を分析した300ページに及ぶ報告書の内容を、一般の方にも分かりやすく解説します。
Google DeepMindが研究中のAIによる有害な操作のリスクと、それを防ぐための新しい安全フレームワークについて、一般の視点から分かりやすく解説します。
Google DeepMindが発表した「フロンティア安全フレームワーク(FSF) v3」の核心内容と、人工知能のリスクを防ぐための新しい安全基準を分かりやすく解説します。
AIの心理的操作からユーザーを保護するための、Google DeepMindの新しい安全フレームワークと測定ツールを紹介します。