Blog ~ f-mignon代表による、できれば役立って欲しい情報ブログ

OpenAI・Anthropic・GoogleのAIが相次いで実システムへ侵入、3事件の違いを比較

[TOC] Geminiが3社をハッキングした。ただ、この話はGoogleだけ見ても分かりにくい GoogleのGeminiが、サイバーセキュリティのテスト中に実在する3社のシステムへアクセスしていたことが明らかになった […]

続きを読む

2026年9月21日 10:22 PM  カテゴリー: AI, AI安全性/危険性, ChatGPT, Claude, Gemini

GPT-6 Astraの安全性とは?OpenAI初の「Critical」サイバー能力と監視問題

[TOC] GPT-6 Astraは「安全になったのに、監視しにくくなった」 OpenAIが2026年9月3日に公開したGPT-6 Astraの安全性資料を読んでいると、単純に「またAIの性能が上がった」という話では済ま […]

続きを読む

2026年9月5日 1:13 AM  カテゴリー: AI, ChatGPT, OpenAI

OpenAIの1200 AIエージェント事件とは?700体がHugging Face攻撃に参加したMETR調査

[TOC] 1200体のAIが、勝手に「掲示板」を使い始めた 本来は互いに隔離され、会話できないはずだった約1200のAIエージェントが、偶然通信する方法を見つけ、7万件以上のメッセージやファイルをやり取りした。その中か […]

続きを読む

2026年9月4日 2:28 AM  カテゴリー: AI, AI安全性/危険性, OpenAI

Google DeepMindが示すAIエージェント安全対策「AI Control Roadmap」とは

AIエージェントが、単なるチャット相手ではなく、実際に仕事を進める存在になったとき、私たちは何を心配すべきなのでしょうか。 Google DeepMindは、AIエージェントを社内システムで安全に運用するための考え方とし […]

続きを読む

2026年7月5日 1:27 AM  カテゴリー: AI, AI安全性/危険性, エージェントAI

AnthropicのFable 5 / Mythos 5停止とは何か:日本の銀行と金融庁を含む各所への影響

[TOC] AnthropicがFable 5 / Mythos 5の一時停止を発表 生成AIは、誰でも使える便利なツールから、国家安全保障や金融インフラの安定性に関わる技術へと変わりつつあります。今回、Anthropi […]

続きを読む

2026年6月13日 1:22 PM  カテゴリー: AI, AI安全性/危険性, Anthropic, Claude

再帰的自己改善とは何か:AnthropicのAI安全性提案を深掘り

AIは、便利なチャットツールから、AIそのものを開発する道具へと変わり始めています。では、もしAIの進化が人間の制度や安全対策の速度を超えそうになったとき、誰がブレーキを踏めるのでしょうか。 Anthropicが提案した […]

続きを読む

2026年6月6日 6:12 PM  カテゴリー: AI, AI安全性/危険性, Anthropic, OpenAI

Claude Opus 4.8とは?MythosとProject Glasswingから見るAnthropicのAI戦略

Claude Mythosは社会問題にまでなっています。そんな中Anthropicは、ClaudeOpusのバージョンを上げてきました。 先日も書きましたが、Mythosがセキュリティで現状一番強いAIであることは色々言 […]

続きを読む

2026年6月3日 9:43 PM  カテゴリー: AI, Anthropic, Claude

トランプ政権のAI大統領令とは何だったのか 公開前モデル確認と署名延期の背景

[TOC] AI大統領令の署名式は、何のために行われる予定だったのか AI企業は、新しい高性能モデルを公開する前に、政府へ見せるべきなのでしょうか。 今回のニュースを理解するうえで、まず押さえるべきなのはここです。米ホワ […]

続きを読む

2026年5月28日 1:49 AM  カテゴリー: AI, AI安全性/危険性, AI規制, 政治

Claude Mythosだけが危ないのか?AIセキュリティ時代に見落とされがちな本当の論点

最近、チームみらいが煽っているせいか、Claude Mythosの脅威が何となく一人歩きしているようなのを感じる。こういう表現をするとチームみらいをディスっているように見えるがそこはそうではない。煽った方がいい。政府もき […]

続きを読む

2026年5月27日 12:32 AM  カテゴリー: AI, AI安全性/危険性, Anthropic, ChatGPT, Claude

AnthropicとNECが戦略協業、Claude Codeを活用した企業AI導入の狙い

NECはAnthropicと協業し、ClaudeをグローバルのNECグループ従業員約3万人に展開する。 Claude CodeやClaude Coworkを活用し、AIネイティブなエンジニア組織と社内業務変革を進める。 […]

続きを読む

2026年4月30日 3:08 AM  カテゴリー: AI, Claude, ビジネス