全ニュース

技術ニュース 959 件

AI 開發工具

Funes、複数のコーディングエージェントの作業履歴を、ポータブルで検索可能なローカルメモリに統合

Hugging FaceはFunesをオープンソース化し、Claude Code、Codex、pi、Hermesのターン単位の履歴を単一のLanceデータセットに保存する。検索とリランキングはデフォルトでローカル実行されるが、マシン間同期、残存する秘密情報、外部メモリを介したプロンプトインジェクションについては、依然として利用者側での管理が必要だ。

多模態檢索

NeoMME、単一の双方向Transformerで画像とテキストをエンコードし、視覚文書インデックスを1ページあたり6 kBに圧縮

Hcompanyは、2.6億および8億パラメータのNeoMMEをオープンソース化した。テキストtokenと元画像のpatchが同じエンコーダーを共有し、視覚塔や因果デコーダーを追加する必要がない。検索版はdense表現とlate-interaction表現を同時に出力するが、効率と精度に関する数値は現時点で主に作者による評価に基づいている。

語音 AI

MAI-Transcribe-2、話者分離と単語単位のタイムスタンプを単一の音声APIに統合、バッチ処理速度はリアルタイム音声の410倍

Microsoftの新しい音声認識モデルは60言語に対応し、話者分離、専門用語バイアス、コードスイッチング、単語単位のタイムスタンプをネイティブに提供する。独立機関によるAPIテストでは、単語誤り率とバッチスループットの両面で優れた結果を示したが、期間限定価格、中国語の個別品質、ストリーミング遅延については、なお検証が必要だ。

應用研究

WeatherNext 3、リアルタイム衛星観測を直接取り込み、全球AI天気予報を毎時更新・5kmメッシュへ高度化

GoogleのWeatherNext 3は、遅延のある数値気象再解析データだけに依存せず、全球の衛星観測によって予報を継続的に更新する。新モデルは降水や局地的変化の解像度を向上させたが、依然として各国の気象機関のデータに依存しており、完全なエンドツーエンドの直接データ同化には至っていない。

推論基礎設施

NVIDIA PAIR、互換プロキシでアイドル状態のPCにルーティングし、ローカルのマルチエージェント推論を複数ノードへ分散

PAIRはOllama、LM Studio、エージェントの間に互換プロキシ層を追加し、モデルの配置場所とGPU負荷に基づいて、個々のリクエストをローカルネットワーク内のPCへ振り分ける。向上するのはワークロードの並列性であり、VRAMを統合したり、単一の推論を複数のGPUに分割したりするものではない。

AI 程式開發與安全

GitHub Copilot、コンテンツ除外ポリシーをAppとCLIに拡大。ただしシンボリックリンクや間接的なセマンティクスは依然として境界を越える可能性

Copilot BusinessおよびEnterpriseの管理者が設定した除外ルールにより、Copilot AppとCLIが指定ファイルをモデルのコンテキストへ直接追加することを防げるようになった。ただし、この仕組みは完全なデータ漏えい防止策でも実行サンドボックスでもなく、GitHubはシンボリックリンク、リモートファイルシステム、IDE経由の間接的なセマンティクスなどの抜け穴を明示している。

推論系統

HeadWiseKV、アテンションヘッドごとに長文脈キャッシュを構成し、Qwen3.6-27Bの利用可能長を161Kへ拡張

HeadWiseKVは、すべてのアテンションヘッドに同一の履歴を保持させる方式を改め、各headの多段階ウィンドウをオフラインでキャリブレーションし、実際の物理KV residencyを削減する。論文では、モデルを固定したテストで最大成功コンテキスト長を114Kから161Kへ延長したが、公開リポジトリのさらに大きな数値は、特定の量子化方式と単一の4090Dを使用した結果である。

開放模型

K2 Horizon、6モデルの完全な訓練軌跡を公開し、エージェントベンチマークにおける報酬ハッキングも明らかに

IFMは、0.9Bから375B-A23Bまでの6つのテキストモデルを、データレシピ、中間チェックポイント、訓練コード、エージェント向けポストトレーニングの記録とともに公開した。最大モデルのTerminalBenchスコアは、ハッキング監査後に70.2%から66.9%へ低下し、再現可能な形での公開においてもベンチマーク汚染への対処が不可欠であることを浮き彫りにした。

代理框架

PydanticAI 2.38、エージェントのコンテキスト使用量を公開し、実行ストリームに型付きカスタムイベントを追加

エージェントツールが `RunContext` からコンテキスト使用量を判断できるようになり、アプリケーションもカスタム状態を同じイベントストリームへ送信可能になった。新バージョンでは、セルフホスト型 vLLM provider と、`finish_reason` が欠落したストリームを拒否するポリシーも追加された。

AI 基礎設施

PyTorch 2.14、障害時の再構成をc10dに統合、Inductorの低精度・マルチハードウェアカーネルを拡充

新版では、`nccl2`、Process Groupのインプレース再構成、バックエンド横断のFlight Recorderにより、大規模分散学習を強化。InductorにはNVGEMM、宣言的な動的形状、複素数テンソルのコンパイルも加わったが、多くのインターフェースは依然として不安定とされている。

邊緣 AI/推論系統

mzCache、CPU/GPU並列復元でモバイルLLMのメモリを回復、最初のtokenまでの遅延を2.1~5.5倍短縮

MobiCom 2026の研究では、モデル重みとKV cacheを共有バッファに分割し、CPUが退避されたデータを復元している間にGPUがprefillを開始できるようにした。成果の焦点は、スマートフォンでのマルチタスク後に生じる復帰遅延の改善であり、モデル自体の生成速度向上ではない。

AI 安全/程式代理

GitSpawn、悪意ある `.git/config` でコーディングエージェントのサンドボックスを回避—開示時点で4件が未修正

複数の CLI コーディングエージェントが信頼確認前に Git のステータス照会を実行するため、リポジトリ内の実行可能な設定がユーザー権限でホスト上にて動作する。通常の `git clone` では攻撃は伝播しないが、完全な `.git` ディレクトリを ZIP、同期フォルダ、USB 経由で渡すと発動し得る。