Infrastructure

Latest News

26 件

HuaweiがAIエージェントのトークン基盤を解説

HuaweiはHUAWEI CONNECT 2026で、AIエージェントを待たせない基盤として超高速ネットワーク、AI Memory Storage、50G PON、屋外PowerPODを一連の流れとして紹介した。トークンが通信から電源まで通る構成を強調している。

vLLM v0.30.0が公開、新モデルと高速化を追加

vLLMは9月23日にv0.30.0を公開し、762コミット、315人の貢献、104人の初参加を掲げた。Kimi K3、DeepSeek-V4.1-Flash、Qwen3.8-Flash-Nextの推論を更新し、GLM-5.3-FlashやK2-Horizonなどの新モデルも加えた。

GitHubが生成コードとRAG、Skills対MCPを議論

GitHubは9月23日、公式ポッドキャストで、AI生成コードを読むべきか、RAGは終わったか、SkillsがMCPを置き換えたかの三つの論点に答えた。開発現場の定番手法を見直す回で、ブログに案内がある。

DiffusionGemma-JevをCloud Runへ単一コマンド配備

Google Gemmaは9月23日、DiffusionGemma-Jev(djev)をCloud Runへ単一コマンドで配備できると発表した。1ステップ遅延は約35–60ミリ秒、32並列で毎秒約100–123リクエスト、稼働時は約3ドル毎時でアイドル時は0ドルだ。

AlibabaのT-HeadがZhenwu V900を発表

Alibabaのチップ部門T-HeadはApsara 2026で、学習と推論の両方に使うZhenwu V900を発表した。高精度の学習と超低精度の推論を担い、性能は前世代の3倍とする。Zhenwu系列は自動車、LLM、身体性知能など650超の顧客で稼働中である。

Qwen-Image-2.1がOpenVINOにDay-0対応

Qwenは、Qwen-Image-2.1がIntel OpenVINOへDay-0対応したと告知した。生成と編集を一つのオープンウェイトで扱い、Intel製ハードウェア向けに最適化して実行できる。画像モデルを既存のIntel環境へ載せやすくする更新である。