全ニュース

技術ニュース 957 件

AI 代理與研究自動化

DisCo、1,000件の機械学習リポジトリを5,353個の検証可能なエージェントスキルに蒸留

新たな研究は、ソースコード、ドキュメント、テストをオンデマンドで読み込める操作知識へ変換し、固定されたモデルとエージェントフレームワークの性能を4つの研究ベンチマークすべてで向上させた。スキル構築コストは別計上であり、結果も著者による評価にとどまるため、低コストでモデルトレーニングを代替できると直ちに見なすことはできない。

AI 開發工具

Anthropicの`ant apply`、エージェント、スキル、メモリストアを宣言的バージョン管理の対象に

Claude Platform CLIに`ant apply`が追加され、リポジトリ内のMarkdown、YAML、JSONから管理対象のエージェントリソースを同期できるようになった。プレビュー、依存関係に基づく順序付け、ドリフト検出に対応する一方、状態ファイルには依然として組織の識別情報が含まれ、現時点で管理できるのはAnthropicプラットフォームのみだ。

AI 安全工具

Shannon 3.0、並列エージェント型SASTと実環境での脆弱性悪用により、検証済みの発見事項でCIを直接ブロック

オープンソースのAIペネトレーションテストツール「Shannon 3.0」に、多段階コード分析、脆弱性候補の調整、ネイティブSARIF対応が追加された。新バージョンでは、再現に成功した脆弱性だけがパイプラインのゲートを作動させる一方、実際に対象の状態を変更する可能性があり、2.xのワークスペースからは再開できない。

代理資料集與評測

Cohere ATE、約70万件のMCPツールを職業タスクと照合——エンドツーエンドで完遂可能と判定されたのはわずか2.6%

Cohere LabsはAgentic Task Ecosystemを公開し、7つのディレクトリから集めた696,291件のツールを米国のO*NET職務タスクと照合した。その結果、多くのMCPはワークフローの一部しか担えないことが示された。ただし、2.6%という数値はセマンティックマッチングとモデル判定に基づくものであり、実際の実行テストに合格したツールの割合とはみなせない。

生成式影像模型

LLaDA-Image、単一の6B拡散モデルで画像生成と編集を統合、Turboは4ステップのサンプリングを実現

Ant GroupのinclusionAIは、LLaDA-Imageの重みとDiffusers推論コードを公開した。単一モデルでテキストからの画像生成、参照画像の編集、中国語・英語テキストのレンダリングを処理できる。蒸留版はTwin-DMDにより推奨サンプリングステップ数を50から4へ削減したが、学習コードの公開と独立した性能検証はまだ十分ではない。

AI 程式開發工具

VS Code 1.136のAgent Merge、レビュー・CI・競合の修正をPRがマージ可能になるまで継続

プレビュー版のAgent Mergeは、コーディングエージェントの作業範囲を変更の生成からPRの仕上げまで拡張し、レビューコメント、失敗したチェック、ブランチ競合に繰り返し対処できる。これを有効にするとセッションはAutopilotとAssisted permissionsに切り替わるため、チームは自動マージと必須チェックを高権限の制御プレーンとして扱う必要がある。

本機 AI/推論系統

Magnitude、メモリ帯域幅と容量に基づいてローカルモデルを選定し、コーディングエージェント向けに量子化と投機的デコーディングを自動構成

新しいオープンソース推論サーバー「Magnitude」は、ハードウェアを実測したうえで、モデル、量子化、コンテキスト長、推定速度を組み合わせた完全な構成を提案する。ローカルエージェントで設定ミスが起きやすいメモリと並行処理のパラメータを自動化する一方、現時点での性能とモデル品質は、主にプロジェクト側のカタログとテストに依存している。

AI 平台與基礎設施

NVIDIA、Hugging Faceを129億3,000万ドルで買収へ、マルチクラウド・マルチアクセラレーター対応の維持を約束

NVIDIAはHugging Faceの買収に合意し、モデル、データセット、アプリケーション、推論サービスの重要な配信ハブを手に入れる。同社は、プラットフォームをNVIDIA製ハードウェアにロックインしないと約束しているが、買収後の実際のガバナンス、表示順位、異種ハードウェア向け最適化については、引き続き検証が必要だ。

模型與代理安全

GPT-6 Astraが正式提供開始、Codexは検索可能な過去のコンテキストで長期タスクを継続

OpenAIはAstraをAPI、AWS、ChatGPTの有料プランで提供し、Codexではノートと履歴検索を用いてコンテキストウィンドウをまたぐ仕組みを実験している。モデルのエージェント能力とサイバーセキュリティ能力は大幅に向上した一方、思考の連鎖(Chain of Thought)は監視を回避しやすくなり、デプロイ環境が正当な作業を中止する可能性もある。

多模態與世界模型

Puffin-World、重力・深度・画像を単一の世界モデルに統合し、マルチビューRGB-Dと点群を直接生成

Puffin-Worldは、9チャンネルのOmni-Camera条件によって絶対的な物理方向と相対的なカメラ運動を統一し、単一のアーキテクチャで理解、生成、3D再構成を実現する。コード、重み、Puffin-16Mデータセットは公開済みだが、現時点で扱う物理状態は主に静的シーンの重力と緯度に限られる。

AI 開發工具

Funes、複数のコーディングエージェントの作業履歴を、ポータブルで検索可能なローカルメモリに統合

Hugging FaceはFunesをオープンソース化し、Claude Code、Codex、pi、Hermesのターン単位の履歴を単一のLanceデータセットに保存する。検索とリランキングはデフォルトでローカル実行されるが、マシン間同期、残存する秘密情報、外部メモリを介したプロンプトインジェクションについては、依然として利用者側での管理が必要だ。

多模態檢索

NeoMME、単一の双方向Transformerで画像とテキストをエンコードし、視覚文書インデックスを1ページあたり6 kBに圧縮

Hcompanyは、2.6億および8億パラメータのNeoMMEをオープンソース化した。テキストtokenと元画像のpatchが同じエンコーダーを共有し、視覚塔や因果デコーダーを追加する必要がない。検索版はdense表現とlate-interaction表現を同時に出力するが、効率と精度に関する数値は現時点で主に作者による評価に基づいている。