HuaweiがAIエージェントのトークン基盤を解説
HuaweiはHUAWEI CONNECT 2026で、AIエージェントを待たせない基盤として超高速ネットワーク、AI Memory Storage、50G PON、屋外PowerPODを一連の流れとして紹介した。トークンが通信から電源まで通る構成を強調している。
HuaweiはHUAWEI CONNECT 2026で、AIエージェントを待たせない基盤として超高速ネットワーク、AI Memory Storage、50G PON、屋外PowerPODを一連の流れとして紹介した。トークンが通信から電源まで通る構成を強調している。
vLLMは9月23日にv0.30.0を公開し、762コミット、315人の貢献、104人の初参加を掲げた。Kimi K3、DeepSeek-V4.1-Flash、Qwen3.8-Flash-Nextの推論を更新し、GLM-5.3-FlashやK2-Horizonなどの新モデルも加えた。
GitHubは9月23日、公式ポッドキャストで、AI生成コードを読むべきか、RAGは終わったか、SkillsがMCPを置き換えたかの三つの論点に答えた。開発現場の定番手法を見直す回で、ブログに案内がある。
Google Gemmaは9月23日、DiffusionGemma-Jev(djev)をCloud Runへ単一コマンドで配備できると発表した。1ステップ遅延は約35–60ミリ秒、32並列で毎秒約100–123リクエスト、稼働時は約3ドル毎時でアイドル時は0ドルだ。
Alibabaのチップ部門T-HeadはApsara 2026で、学習と推論の両方に使うZhenwu V900を発表した。高精度の学習と超低精度の推論を担い、性能は前世代の3倍とする。Zhenwu系列は自動車、LLM、身体性知能など650超の顧客で稼働中である。
Qwenは、Qwen-Image-2.1がIntel OpenVINOへDay-0対応したと告知した。生成と編集を一つのオープンウェイトで扱い、Intel製ハードウェア向けに最適化して実行できる。画像モデルを既存のIntel環境へ載せやすくする更新である。