2026年8月14日 金曜日
AI時短ラボ

AIの安全性の記事

「AIの安全性」に関連するAIニュースと解説を、出典付きで12本まとめています。

解除

AIの安全性 の記事:12

Claude Code、8月14日からautoモードがデフォルトに──「人間の承認は危険コマンドの13.6%しか止めていなかった」の記事画像
プロダクト08.08読了11

Claude Code、8月14日からautoモードがデフォルトに──「人間の承認は危険コマンドの13.6%しか止めていなかった」

出典 ─ Anthropic公式ブログ: Auto m
OpenAI、次世代モデル「Astra」の開発を一時停止──サイバー能力が自社基準の最上位「Critical」級の可能性、"排除できない"と発表の記事画像
業界08.08読了10

OpenAI、次世代モデル「Astra」の開発を一時停止──サイバー能力が自社基準の最上位「Critical」級の可能性、"排除できない"と発表

出典 ─ OpenAI公式ブログ: Respondin
OpenAI、自社モデルによるHugging Face侵入を自ら公表──主犯は未公開モデル、5ヶ月の予言書と迫るオープンウェイトの記事画像
業界07.22読了20

OpenAI、自社モデルによるHugging Face侵入を自ら公表──主犯は未公開モデル、5ヶ月の予言書と迫るオープンウェイト

出典 ─ OpenAI公式ブログ: OpenAI an
Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回るの記事画像
モデル07.22読了10

Sakana AI、サイバー特化『Fugu-Cyber』発表──CyberGymで86.9・GPT-5.5-CyberとMythos Previewを上回る

出典 ─ Sakana AI公式ブログ: Introd
OpenAI「GPT-Red」発表──AIが自分自身を攻撃して安全になる時代の記事画像
研究07.16読了7

OpenAI「GPT-Red」発表──AIが自分自身を攻撃して安全になる時代

出典 ─ OpenAI
米42州の司法長官がOpenAIに召喚状──広告・未成年保護・モデルの迎合性を調査の記事画像
業界06.25読了4

米42州の司法長官がOpenAIに召喚状──広告・未成年保護・モデルの迎合性を調査

出典 ─ OpenAI faces investiga
Anthropicとは?Claude開発企業の戦略と安全性への取り組み【2026年版】の記事画像
業界06.19読了11

Anthropicとは?Claude開発企業の戦略と安全性への取り組み【2026年版】

出典 ─ Anthropic Series H Ann
オープンソースAI vs クローズドAI──メリット・デメリット比較【2026年】の記事画像
活用06.19読了14

オープンソースAI vs クローズドAI──メリット・デメリット比較【2026年】

出典 ─ Let's Data Science
ホワイトハウス「ジェイルブレイクを全部防げ」──専門家は「技術的に不可能」と指摘の記事画像
業界06.18読了7

ホワイトハウス「ジェイルブレイクを全部防げ」──専門家は「技術的に不可能」と指摘

出典 ─ WIRED
Fable 5復旧交渉は平行線──Anthropic幹部がDCで直接協議も輸出管理は解除されずの記事画像
業界06.16読了11

Fable 5復旧交渉は平行線──Anthropic幹部がDCで直接協議も輸出管理は解除されず

出典 ─ Anthropic Is Still at
【速報】米政府がFable 5へのアクセス停止を指示──停止される本人(Fable 5)とニュースを読むの記事画像
業界06.13読了7

【速報】米政府がFable 5へのアクセス停止を指示──停止される本人(Fable 5)とニュースを読む

出典 ─ Anthropic公式X投稿(2026年6月
Anthropic「SLEIGHT-Bench」、AI監視システムの死角を突く回避テキストのベンチマークを公開の記事画像
研究05.19読了4

Anthropic「SLEIGHT-Bench」、AI監視システムの死角を突く回避テキストのベンチマークを公開

出典 ─ SLEIGHT-Bench: Finding

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。