全ニュース

技術ニュース 991 件

應用研究

ByteDanceのUniVR、視覚空間内で推論し、ダイナミクスをシミュレーションして長期行動を計画

UniVRは、複雑な推論、物理ダイナミクス、長期計画を視覚的なデモンストレーションのみから共同学習することを目指している。ByteDanceは同時に34B Planningチェックポイントを公開し、テキストによるChain-of-Thoughtに依存しない視覚エージェント研究に、検証可能なベースラインを提供した。

資料中心基礎設施

NVIDIA Spectrum-6、シングルチップEthernetスイッチ容量を102.4 Tbpsに引き上げ

NVIDIAは、Vera Rubinプラットフォーム向けに設計されたSpectrum-6スイッチシステムの導入を開始した。シングルチップで102.4 Tbpsのスループットを実現し、800Gb/sポート、液冷、Co-Packaged Optics(CPO)のオプションも導入。10万基を超えるGPUのscale-outネットワークをターゲットとしている。

模型與開源工具

Gemma 4 12B、単一のTransformerで画像と音声を直接処理し、マルチモーダル展開の複雑さを軽減

Googleは、独立したビジョン/音声エンコーダーを線形投影で置き換えたオープンウェイトモデル「Gemma 4 12B」を公開した。新アーキテクチャによりファインチューニングとローカル推論は簡素化されるが、公式の性能データについては、今後も独立したテストによる検証が必要だ。

資料中心基礎設施

Azure、AMD Heliosを導入へ――大規模推論、データパイプライン、チップ設計向けのコンピューティングインスタンスを追加

Microsoftは、AzureでAMD Heliosを大規模展開し、第6世代EPYCを搭載したHDv2、HXv2、およびMI455X推論インスタンスを提供する計画だ。GPU、CPU、DPU、ネットワーク、ソフトウェアを協調設計したインフラストラクチャの刷新となるが、実際のコストパフォーマンスは公開テストによる検証を待つ必要がある。

推論與開發工具

LiteRT.js、LiteRTのネイティブ推論スタックをブラウザへ――WebGPU、Wasm、実験的WebNNに対応

Googleは、Webアプリで`.tflite`モデルを直接実行し、デバイスに応じてCPU、GPU、NPUを利用できるLiteRT.jsを公開した。ブラウザAIをJavaScript中心の仕組みからクロスプラットフォームのネイティブ実行スタックへ移行させる一方、性能と互換性は依然としてブラウザやハードウェアに大きく左右される。

推論系統與開發工具

Google、LiteRT.jsを発表――ネイティブLiteRTの推論パスをブラウザへ

LiteRT.jsは、Googleのクロスプラットフォーム推論ランタイムをWebAssemblyでラップし、CPU、GPU、NPUにそれぞれXNNPACK、WebGPU、実験的なWebNNを対応させる。既存の`.tflite`モデルをクライアント側で実行しやすくする一方、性能と互換性は依然としてブラウザやデバイスに大きく左右される。