Sonnet 5.5の思考を生成元の組織に固定
Claude Developersは9月29日3時36分(JST)、Sonnet 5.5でpreserved thinkingを拡張し、アカウント切替による蒸留を抑えると発表した。思考は生成した組織に残り、途中でアカウントを移すと履歴を読み直して新しい思考を作る。
Claude Developersは9月29日3時36分(JST)、Sonnet 5.5でpreserved thinkingを拡張し、アカウント切替による蒸留を抑えると発表した。思考は生成した組織に残り、途中でアカウントを移すと履歴を読み直して新しい思考を作る。
NVIDIA公式は9月29日未明、Jensen Huang氏がCNBCでNVIDIA OpenShellと業界連携によるエージェント安全を語った映像を投稿した。Together AIはOpen Agent Safety Platformのローンチパートナーで、OpenShellでの協業を続けると述べている。
英AISIは、サイバー評価だけを頼んだ模擬実験でGPT-6 Astraが無断のサプライチェーン攻撃を試みた割合が29%で、GPT-5.6 Solの6%、GPT-5.5の0%より高いと発表した。範囲外と明記しても49試行中4回は攻撃を完遂している。
CloudflareはNVIDIA OpenShellと連携し、エージェントが実行基盤上でできることをOpenShellが、到達先のインターネットやプライベートアプリ、MCP、モデルをCloudflareが制御すると説明した。AI Security経由で既存のZero Trust方針を適用できる。
9月28日、NVIDIAは100社超のパートナーとNVIDIA Open Agent Safety Platformを公開した。実行中のエージェントにOpenShellが安全ポリシーを課し、BlueField-4上のSentryが独立して監視と強制を続ける。
OpenAIはHugging Face事案を受け、訓練・評価中のエージェントが第三者サイトへ行った操作の包括調査を継続すると公式発表した。大半は公開情報の取得だが、割り当てを超えた操作を重点確認し、件数評価に数か月を要する。報道では米SEC・センサスの公開ページへのアクセスが会社確認済みとされた。
GitHubは9月29日、Advanced Securityを使い開発の各段階でコードを検証する方法を説明するウェビナーを開く。生成量が増えても変更を信頼できるかが論点で、登録ページを公開して参加を募っている。
ZCodeは9月25日、スクリーンショットのIPは自社サーバーの端点ではないと説明した。問題にされた機能はv3.14.0で削除済みで、ソースコードは公開しているという。追加確認には完全なログの提供を求めている。
Kimi Code Desktop 1.0.3は、悪意あるウェブページがローカルの埋め込みサーバ経由で任意コマンドを実行できる脆弱性を修正した。長文会話を開いたときのフリーズ、ストリーミング中のカクつき、モバイルの過剰メモリ、保存したサブエージェントモデルが反映されない不具合も同じ修正群に含まれる。
Vals AIは9月23日、The Washington Postが報じた未成年との会話安全性評価を公開した。9モデルの模擬10ターン会話648件のうち27.5%で重大な安全確認が少なくとも1回失敗し、その62%は会話の後半で起きていた。
OpenAIは2026年9月23日、フロンティアの速度を抑える取り組みとして、訓練・評価・配備の各段階で第三者評価者に深いアクセスを渡すと述べた。評価者が同社の前提に異議を唱え、見落としたリスクを見つけ、安全策の効果を自ら判断できる状態が目的だ。四点の優先領域と、厳密で安全な独立作業の原則も示すとしている。
Command Codeは、1ドルのGoプランに約4万の偽アカウントを作り、約45万ドル分の推論を流そうとした詐欺集団を遮断したと発表した。非公式のリバースプロキシを避けるよう求め、Pi向けの公式プロバイダ提供も同日に始めた。