AIの安全性の記事
「AIの安全性」に関連するAIニュースと解説を、出典付きで12本まとめています。
AIの安全性 の記事:12件
プロダクト08.08読了11分
Claude Code、8月14日からautoモードがデフォルトに──「人間の承認は危険コマンドの13.6%しか止めていなかった」
出典 ─ Anthropic公式ブログ: Auto m
業界08.08読了10分
OpenAI、次世代モデル「Astra」の開発を一時停止──サイバー能力が自社基準の最上位「Critical」級の可能性、"排除できない"と発表
出典 ─ OpenAI公式ブログ: Respondin
業界07.22読了20分
OpenAI、自社モデルによるHugging Face侵入を自ら公表──主犯は未公開モデル、5ヶ月の予言書と迫るオープンウェイト
出典 ─ OpenAI公式ブログ: OpenAI an
モデル07.22読了10分
Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回る
出典 ─ Sakana AI公式ブログ: Introd
研究07.16読了7分
OpenAI「GPT-Red」発表──AIが自分自身を攻撃して安全になる時代
出典 ─ OpenAI
業界06.25読了4分
米42州の司法長官がOpenAIに召喚状──広告・未成年保護・モデルの迎合性を調査
出典 ─ OpenAI faces investiga
業界06.19読了11分
Anthropicとは?Claude開発企業の戦略と安全性への取り組み【2026年版】
出典 ─ Anthropic Series H Ann
活用06.19読了14分
オープンソースAI vs クローズドAI──メリット・デメリット比較【2026年】
出典 ─ Let's Data Science
業界06.18読了7分
ホワイトハウス「ジェイルブレイクを全部防げ」──専門家は「技術的に不可能」と指摘
出典 ─ WIRED
業界06.16読了11分
Fable 5復旧交渉は平行線──Anthropic幹部がDCで直接協議も輸出管理は解除されず
出典 ─ Anthropic Is Still at
業界06.13読了7分
【速報】米政府がFable 5へのアクセス停止を指示──停止される本人(Fable 5)とニュースを読む
出典 ─ Anthropic公式X投稿(2026年6月
研究05.19読了4分
Anthropic「SLEIGHT-Bench」、AI監視システムの死角を突く回避テキストのベンチマークを公開
出典 ─ SLEIGHT-Bench: Finding
新しい記事をメールで受け取る
AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。