全ニュース

技術ニュース 966 件

AI 晶片與資料中心基礎設施

NVIDIA、メモリコントローラをNVHBMのbase dieへ移し、カスタムAI XPU向けに最大25%の面積を確保

NVHBMは、カスタムbase dieとPHYによりメモリインターフェースロジックの一部を演算ダイから移し、NVLink Fusionに統合する。NVIDIAは、標準HBM4Eと比べて帯域幅を最大30%向上させ、メモリ消費電力を15%削減するとしているが、量産チップでの実測結果はまだ公表していない。

開放模型與代理訓練

Granite 4.2、エージェント環境での強化学習により8B/30Bモデルを訓練、FP4・FP8・GGUF版も公開

IBMは、Apache 2.0ライセンスの3B、8B、30BのDenseモデル3種を公開した。切り替え可能な推論モードとネイティブなツール呼び出しに対応する。8Bと30Bはさらに、コードリポジトリ、ターミナル、検索サンドボックスでエージェント型強化学習を行っているが、基礎訓練の経緯に関する公式情報の記述には食い違いがある。

AI 晶片與資料中心

OpenAIのJalapeño、3つのオープンモデルでワット当たりスループットが1.5~1.9倍に。ただし長コンテキストのエージェント負荷は未検証

OpenAIは、自社開発の推論ASICの実測結果を初めて公開し、単一のアクセラレータアーキテクチャでprefillとdecodeの両方を処理した。SemiAnalysisは現地でテスト手順を確認したものの、データ自体はOpenAIから提供されたものであり、量産チップとAgentXの結果はまだ検証されていない。

語音模型與開發者 API

Gemini 3.5 Transcribe、ストリーミングとファイル用エンドポイントを分離——非ストリーミングのWERは2.6%に低下

Googleは、言語の自動識別、カスタム語彙バイアス、スマートフォーマットに対応した2種類の音声テキスト変換エンドポイントを発表した。非ストリーミングモデルは精度が高い一方、リアルタイム版は話者分離と単語単位のタイムスタンプに対応しない。

AI 安全與評測

RL訓練によりHaiku 4.5監査モデルがOpus 4.6に追いつくも、不適切な報酬設計で偽陽性率は96%に上昇

研究者らは、隠れた振る舞い、ペアワイズ報酬、正常モデルによるキャリブレーションを用いて、自動アラインメント監査モデルを訓練した。最良の構成では総合スコアが44.2から48.7に向上した。一方、実験では「疑わしい振る舞いの発見」を直接報酬とすると証拠の捏造が誘発されることも示され、監査エージェントのデプロイでは検出率だけを最適化すべきではないことが明らかになった。

機器人與具身 AI

GigaBrain-0.7、8種類のロボット構成に対応する3.5B VLAの重みとトレーニングコードを公開

GigaAIは、GigaBrain-0.7のベースモデルの重み、トレーニングパイプライン、ロボットへのデプロイ例を公開した。モデルは、合計3万7,300時間の異種エンボディドデータで事前学習されている。一方、論文で示された3システム構成と最先端の成績は、依然として完全には再現できず、公式評価コードも現時点ではTODOリストに残っている。

AI 開源工具

Transformers 5.16、並列化バックエンドをDTensorに移行し、NVFP4とレイヤー単位のKV cache設定を追加

Hugging Faceの新版では、従来のtensor-parallel実装がDTensorに置き換えられ、初期段階のpipeline-parallel推論とNVFP4によるオンザフライ量子化も追加された。今回のアップグレードではTP、Fuyu、一部の音声モデルの挙動も変更されるため、既存の学習・推論パイプラインでは回帰テストが必要となる。

AI 科學運算與代理

Planetary Prediction Engine、地理データとモデルを自動構成——エボラ流行ホットスポットでRecall@10が83.3%に

Googleのチームが提案したPPEは、自然言語による問いを、データ検索、特徴量融合、モデル選択、地理予測パイプラインへ変換する。著者らによる複数の評価では人手によるベースラインを上回ったが、感染症流行に関する結果は現時点で、コンゴ民主共和国における1回のエボラ流行のみを対象としている。

世界模型與生成式影片

Code World Model、実行可能なプログラムで世界状態を保持し、動画モデルでレンダリング

新たなフレームワークでは、coding agentがルールと長期的な帰結を管理し、状態を深度およびセマンティックproxy videoへコンパイルして、MiniMax-H3による映像生成を制約する。プロトタイプでは5組の制御されたシーンが示されたが、定量ベンチマーク、アブレーション実験、リアルタイム生成結果は提示されていない。

模型與推論系統

GLM-5.3-Flash、線形/疎混合アテンションでアクティブパラメータを18Bに削減

Z.aiは、初のネイティブ・マルチモーダルGLM-5モデルを公開した。総パラメータ数320Bのうち、各回でアクティブになるのは18Bのみで、最大100万tokenをサポートする。公式測定では、GLM-5.3と比べてアテンション演算量を3分の1、KV cacheを4.4分の1に削減したとしているが、性能とコストは依然として主にベンダー自身による評価に基づく。