OpenAIは未公開モデルAstraの内部評価でPreparedness FrameworkのCriticalサイバー閾値を否定できないと判断し、隔離環境や重み保護などの強化と一部内部活動の停止を発表した。AnthropicはFable 5で生物学クエリの過剰ブロックを削減、OpenAIは国別ChatGPT利用データの公開とAPAとの提携も発表している。
公式アップデート
OpenAI Astra が Critical サイバー能力の可能性
8/7、OpenAI は未公開モデル Astra の内部評価において、Preparedness Framework が定める Critical サイバー能力の閾値に達している可能性を否定できないと判断したことを公表した。これを受け、隔離環境での実行、モデル重みの保護強化、CoT(思考連鎖)監視の導入といった対策を実施し、一部の内部活動を停止している。
Anthropic Fable 5 の生物学セーフガード改善
8/7、Anthropic は Fable 5 における生物学関連クエリの取り扱いを改善したと発表した。生物学関連の問い合わせで低性能モデルへフォールバックする挙動を約 85% 削減し、健康・医療に関する日常的な質問が過剰にブロックされる問題を大幅に低減している。
OpenAI Signals で国別ChatGPT利用データ公開
8/6、OpenAI は Signals として初となる国別の ChatGPT 利用データを公開した。職場での利用は「実行(doing)」用途が非職場の 2 倍超を占め、マルチメディア用途は全体の 7.8%。35 歳以上のシェア拡大と、ラテンアメリカなどの地域による追い上げも報告された。
OpenAI と米国心理学会(APA)の提携
8/6、OpenAI は米国心理学会(APA)との提携を発表した。若年層の AI 利用に関する保護者・臨床家向けリソースの開発や当事者へのヒアリングを通じ、青少年のメンタルヘルス面での安全策を科学的知見に基づいて強化する。
コミュニティの反応
OpenAI Astra が Critical サイバー能力の可能性
該当なし(直近1週間の日本語投稿を検索したが、Astra は未公開モデルであるため個人ユーザーの利用体験に該当する投稿は確認できなかった。発表直後のニュースまとめ・解説投稿が中心)
Anthropic Fable 5 の生物学セーフガード改善
該当なし(直近1週間の日本語投稿を検索したが、個人ユーザーによる実体験・感想は確認できなかった。ニュース速報・公式発表の共有が中心)
OpenAI Signals で国別ChatGPT利用データ公開
該当なし(直近7日間の日本語投稿を検索したが、個人ユーザーによる実体験・感想に該当する投稿は確認できなかった。企業・メディアアカウントによるニュース共有が大半)
OpenAI と米国心理学会(APA)の提携
該当なし(直近7日間の日本語投稿を検索したが、個人ユーザーの実体験・感想に該当する投稿は確認できなかった)