[TOC] GPT-6 Astraは「安全になったのに、監視しにくくなった」 OpenAIが2026年9月3日に公開したGPT-6 Astraの安全性資料を読んでいると、単純に「またAIの性能が上がった」という話では済ま […]
続きを読むBlog ~ f-mignon代表による、できれば役立って欲しい情報ブログ
GPT-6 Astraの安全性とは?OpenAI初の「Critical」サイバー能力と監視問題
OpenAIの1200 AIエージェント事件とは?700体がHugging Face攻撃に参加したMETR調査
[TOC] 1200体のAIが、勝手に「掲示板」を使い始めた 本来は互いに隔離され、会話できないはずだった約1200のAIエージェントが、偶然通信する方法を見つけ、7万件以上のメッセージやファイルをやり取りした。その中か […]
続きを読むOpenAI「AI Futures」とは何か 新チームが考えるAI時代の権力集中と人間の自由
[TOC] OpenAIが「AIの未来」ではなく「権力の未来」を考え始めた OpenAIが2026年8月20日、「AI Futures」という新しいブログを始めた。 名前だけを見ると、次世代モデルはどこまで賢くなるのか、 […]
続きを読む「Pacing the Frontier」とは?AI研究の自動化に備え有力研究者らが声明
[TOC] AIを開発するAIが登場したら、進歩の速度を誰が管理するのか AIの進歩は、これまで人間の研究者やエンジニアが中心となって進めてきました。 では、AI自身が次のAIを設計し、実験し、改善するようになったら、そ […]
続きを読む2026年7月31日 1:54 AM カテゴリー: AI, AI安全性/危険性, Anthropic, Google, OpenAI
OpenAI「GPT-5.6」と「GPT Live」を解説:性能・音声機能・両者の違い
[TOC] AIは「チャット画面」から外へ出ようとしている AIに仕事を頼むとき、私たちはいつまでキーボードで細かな指示を書き続けるのでしょうか。 OpenAIは2026年7月8日に新しい音声モデル「GPT Live」を […]
続きを読むOpenAI、GPT-5.6 Solを限定プレビュー Sol・Terra・Lunaの違いと注目点
[TOC] OpenAIがGPT-5.6 Solを限定プレビュー。新モデル発表の本当の注目点 なぜAIモデルの新発表は、単なる「性能向上」だけでは語れなくなっているのでしょうか。 OpenAIは2026年6月26日、次世 […]
続きを読む再帰的自己改善とは何か:AnthropicのAI安全性提案を深掘り
AIは、便利なチャットツールから、AIそのものを開発する道具へと変わり始めています。では、もしAIの進化が人間の制度や安全対策の速度を超えそうになったとき、誰がブレーキを踏めるのでしょうか。 Anthropicが提案した […]
続きを読むMETRがAIエージェントの内部利用リスクを評価、Anthropic・Google・Meta・OpenAIが参加
[TOC] AIエージェントは、どこまで自律的に動けるようになったのか AIエージェントは、もはや質問に答えるだけのチャットツールではありません。コードを書き、実験環境を整え、ログを読み、社内システムを操作する存在になり […]
続きを読む2026年5月26日 12:22 AM カテゴリー: AI, AI安全性/危険性, Anthropic, META, OpenAI
OpenAI、ChatGPTにTrusted Contactを導入:自傷リスク時に信頼できる相手へ通知
OpenAIは、ChatGPTで成人向けの任意安全機能「Trusted Contact」を段階的に提供開始しました。 深刻な自殺リスクが疑われる会話では、自動検知と訓練を受けた人間のレビューを経て、登録済みの信頼できる相 […]
続きを読む