モデル系(ベンダー・関連ツール)

Latest News

109 件

GMI CloudがSonnet 5.5とOpus 5.5の3Dデモを比較

GMI Cloudは9月29日、Opus 5.5とSonnet 5.5にペリカン主役の3Dエクストリームスポーツのゲームデモを作らせ、Sonnet 5.5の方が出来が良く費用は2倍安いと投稿した。勝敗のスコアやプロンプト、計測条件の数値は示していない。

Alibaba Cloudが10月29日アムステルダムでApsara開催

Alibaba Cloudは9月29日、Apsara Conference 2026を10月29日にアムステルダムのBeurs van Berlageで開くと告知した。公式ページでも同日同会場が確認でき、基調講演はQwen、エージェント向け基盤、顧客の本番導入を扱う。

BytePlusがIMAIのSeedance 2.5活用を公開

9月29日14時23分(JST)、BytePlusはIMAI Groupの事例を公開した。商用のAI動画制作はDreamina Seedance 2.5で組み、動画の外ではDola Seed 2.1とBytePlus Cloudを業務とメディア運用の土台にすると説明している。

HyperFramesがOpus 5.5は学習済みだと公式投稿

HyperFramesは9月29日、Opus 5.5がHyperFramesを学習時に身につけた証拠がある、と公式投稿した。引用元はHeyGenのBin Liuによる同日朝の記事紹介で、Opus 5.5がHyperFramesの動画を正確に書く、という観察を根拠にしている。

Together AIがQwen3.8-Flashを月末まで40%引き

Together AIは9月29日、Alibaba QwenのQwen3.8-Flashを当月末まで40%引きにすると投稿した。コーディングや共同作業の助手のような大量呼び出し向けで、品質を保ったまま費用を下げるモデルだと説明し、APIのモデルページへ誘導している。

Vals AIがSonnet 5.5の文体変化を6ベンチで比較

Vals AIは9月29日、Claude Sonnet 5.5とSonnet 5を同じ課題の6ベンチで比べ、文の単語数がおおよそ半分になり、エムダッシュはSNAPで1回答あたり28回から0.2回へ減ったと公表した。法務回答では未確認を示す表現が6%から31%へ増え、応答あたりの可視トークンも全ペアで減少した。

ClineがMuse Spark 1.3のcontributor版を無料化

9月29日12時03分(JST)、ClineはMeta Connectで紹介されたと投稿し、Muse Spark 1.3のcontributor版をClineプロバイダ経由で完全無料にすると述べた。同時刻の公式スレッドはデスクトップ版のURLも示している。

Vals AI、ClaudeでThomson N=7をLean証明

Vals AIは2026年9月29日、Claude Sonnet 5.5のエージェント10体が約15時間・1270メッセージで、球面上の電子7個の最低エネルギー配置が五角双錐であるという17895行のLean証明をカーネル受理まで到達させたと発表した。

Command Codeが全プランでSonnet 5.5を提供

Command CodeはClaude Sonnet 5.5をGOAT、Pro、Max、APIの各プランで提供開始した。同社の説明では従来より30%速く、費用は30%減り、Terminal-Bench 4.0ではOpus 5.5を上回る。同日にCursor、Devin、Clineも同モデルの搭載を告知している。

Atomic FusionがSonnet計画とローカルQwen実装を併用

Atomic AgentはSonnet 5.5がローカルQwen 3.8 27Bへ実装を渡すFusionを公開した。同じビルドの費用はSonnet単独1.83ドル、Fusionは0.67ドルで約2.7倍減。ローカルQwenだけでは0ドルだが、正しくできた場面は一つだった。端末コマンドは/runmode fusion。

Grok 4.7がAmazon Bedrockで利用可能に

SpaceXAIは9月29日8時10分(JST)、Grok 4.7をAmazon Bedrockで提供開始したと約19秒の動画付きで投稿した。本文にモデルID、対応リージョン、料金、API名はない。公式アカウントがクラウド上での利用開始を告知した事実が中心である。

atomic.chatがOpusとSonnetとGPT 6 Solを比較

atomic.chatはOpus 5.5、Sonnet 5.5、GPT 6 Solに、Blenderでスチームパンク調の3Dクジラを作らせ、続けてアニメーションとテクスチャまで行う比較を投稿した。点数は示していない。クラウドモデルはAPIとサブスクリプション経由でatomic.chatから実行できると案内している。

GPT-6 LunaがAgent Arenaの費用前線に載る

Arena.aiはGPT-6 Luna(Max)がAgent Arenaのパレート前線に載り、純改善+1.59%、中央費用は1件0.05ドルだと更新した。GPT-6 Sol(Max)の0.82ドルより94%、Astra(Max)の2.59ドルより98%安い。同日朝の投稿では前線外の23位だった。

Claude CodeとCodexとPi、費用を分けるのはハーネス

Arena.aiはコーディングエージェントのClaude Code、Codex、Piを比べた動画を公開した。モデルを包むハーネスの選択は精度より費用に効く、という結果をBerkeleyのMelissa Pan氏が報告し、残り二つの知見は動画側にある。

Sonnet 5.5の移行とeffort調整ガイドを公開

Claude Developersは9月29日6時40分(JST)、Sonnet 5.5で開発するためのガイドを公開した。Opus 5.5との選び方、Sonnet 5からの移行、effortの調整、Claude Codeでの利用を扱い、範囲の決まったバグ修正や機能の反復に向くと説明する。

Opus 5.5がOpenRouterのAnthropic支出で首位

OpenRouterは公開から約1週間のClaude Opus 5.5が、同社上のAnthropicモデルのなかで支出シェアとトークンシェアの両方で1位だと発表した。Opus 5からの切り替えが特に速いと、利用グラフ付きで説明している。

Claude Codeで評価設計と改善ループを自動化

Claude Developersは9月29日5時54分(JST)、評価の作成とヒルクライムをClaudeが手伝えるようになったと記事で発表した。評価設計の指針と、Claude Codeがアプリケーション改善に使うスキルを示し、人手中心の評価作業を開発ループに入れる。

Claude公式がSonnet 5.5の初期実験を公開

Claude公式は9月29日5時49分(JST)、Sonnet 5.5の初期実験を一本のスレッドで公開した。同一プロンプトの紅葉シミュレータと恐竜史アニメ、60×46ピクセルの絵文字から数時間で3D印刷した例、手描き風フローチャートが並ぶ。新しい仕様値の発表ではない。

MysteryMechanismでAstra 53%、Opus 50%

Vals AIは新ベンチMysteryMechanismでGPT-6 Astraが53%、Claude Opus 5.5が50%となり、17モデル中の1位と2位だと発表した。隠れた数式を限られた実験回数で当てる課題で、Astraはxhighを超えると費用が47%増えて点数は動かなかった。

Devin DesktopとCLIでClaude Sonnet 5.5を提供

CognitionはDevin DesktopとCLIでClaude Sonnet 5.5を提供開始した。FrontierCode 1.1 Mainは64.4%で、前モデルSonnet 5の56.2%を上回る。トークン単価は据え置きのまま、出力生成は30%超速く、タスク費用は最大30%下がると説明している。