Tripo3D P2がfal上でテクスチャ付きメッシュ生成
falはTripo3D P2の提供を開始した。テキストか画像からテクスチャ付きメッシュを作り、テクスチャ品質は4段階、形状とテクスチャのシードは別々に指定できる。v3.5テクスチャモデルで焼き込み照明の除去にも対応する。
falはTripo3D P2の提供を開始した。テキストか画像からテクスチャ付きメッシュを作り、テクスチャ品質は4段階、形状とテクスチャのシードは別々に指定できる。v3.5テクスチャモデルで焼き込み照明の除去にも対応する。
Google Geminiは9月22日、買い物にGeminiを使うライブデモを告知した。米国太平洋時間9月22日午前11時、日本時間では9月23日午前3時からで、視聴は公式Discordである。賢い購入、選択肢の比較、カメラで撮って商品を探す手順を見せる内容で、新モデル名や料金の発表ではない。
Together AIはAI Conferenceで、Ollamaの@parthsareenとTogether AIのHasanが、オープンモデルのコーディングエージェントを本番規模で動かすインフラを扱うブレイクアウトに出ると告知した。新しい製品仕様や日付の時刻は本文にない。
GitHubは、エンジニア1人とエージェント群がGitHub Copilotのエージェント実行系をRustへ移植し、品質を保ったまま本番コード80万行を出荷したと発表した。手順は公式ブログにまとめており、生成AIで大規模移植した事例として出している。
falはH3 Max Stylesを公開した。16ビット風画素画、手描き、ローポリ、70年代カートゥーン、VHSをモデル内の見た目として指定でき、テキストか参照画像から生成する。スタイルごとに質感、色、動きが分かれるとしている。
Design ArenaはSpaceXAIのGrok 4.7を掲載した。コーディングと知識作業向けで、難しい長時間タスクに向け推論、自己検証、文脈管理を強めたと紹介している。引用元はGrok 4.6より良く、価格と速度は同じだとしている。
HyperFramesはCode2Video Benchを、Google DeepMindおよびKaggleと組んで作ったと発表した。コード生成のSWE-benchと、生きて見えるコード発動画は別問題だとし、フロンティア研究室がエージェント動画を測れるようにすると述べている。
kyutaiは音声のまま数学を解くVoice of Reasonを公開した。文字起こしとテキストLLMを挟まず、GLM-4-VoiceのGSM8K 27.3%から、追加トークンなしの即答で70.3%、発話中に黙って考えるSTITCH版で77.1%まで上げ、重みとCOLM 2026論文を出した。
ElevenLabsはElevenCreativeのAI動画エディタStudio 4.0を発表した。プロジェクト内で動画、画像、声、音楽、効果音を生成し、同じ場所で編集、字幕、書き出しができる。ElevenCreativeはショットのその場修正と、Studio Agentによる初稿作成にも触れている。
LMSYSはSGLangにNVFP4のKVキャッシュを入れ、GPUメモリに約1.78倍の文脈を載せ、長いデコードを最大78%速くしたと発表した。FP8比でトークンあたり約56%。32K、160K、100万で+37%、+58%、+78%。Qwen3.5-397B-A17BではGPQA-DiamondとAIME 2025がFP8と同等。フラグは--kv-cache-dtype nvfp4。Blackwell向けで、AlibabaのQwenとNVIDIAと組んでいる。
vLLMはQwen3.8-2.4Tについて、NVIDIA GB300 NVL72で調整したプリフィルとデコードの構成を公開した。高スループット側はGPUあたり総トークン毎秒5000、低遅延側はユーザーあたり出力毎秒180。負荷は入力8000、出力1000トークン。
Alibabaは2026年9月22日のApsara Conferenceで、パートナー向けの端末ソリューションQwen Intelligenceを提供開始した。スマホが複雑な作業を推論して実行するためのエンドツーエンド製品で、機種別の料金は基調では示されていない。