全ニュース

技術ニュース 962 件

AI 安全與基礎設施

Broadcom、AuthZENとOpenTelemetryでエージェントのすべてのツール呼び出しをガバナンスするAgentMinderを発表

AgentMinderは、エージェントID、タスクの意図、リソースポリシーをクラウドネイティブゲートウェイに組み込み、ツール呼び出しが企業システムに到達する前に再認可する。製品は正式提供が開始されたが、公開資料ではレイテンシ、障害モード、プロトコルの対応範囲がまだ明らかにされていない。

代理框架

Google ADK Go 2.3、コンテキスト圧縮をサービス層に導入し、A2Aとツール確認の境界を厳格化

新版では、呼び出し完了後または単一の呼び出しの実行途中にエージェント履歴を圧縮し、その記録をセッションイベントへ書き込める。クロスエージェント転送と人間によるツール確認の信頼境界も修正されており、アップグレードする場合は長時間タスクの再開セマンティクスを再テストすべきだ。

代理開發工具

MCP Inspector 2.4、Web・CLI・TUIを単一パッケージに統合――MCP Appsのデプロイでは3つのローカルポートへの対応が必要

公式MCP Inspectorの最新パッケージは、ブラウザ、コマンドライン、ターミナルの各インターフェースを単一の実行ファイルで提供し、プロトコルとOAuthの状態管理コアを共有する。新版のデプロイ文書では、Appsのサンドボックスと専用オリジンに追加のリスニングポートが必要であり、リモート公開時には組み込みtokenだけに依存できないことも明らかになった。

模型訓練

Puro-2B、コンシューマー向けGPUによる事前学習レシピを公開――2Bモデルの全学習コストは約6,900ドル

清華大学のチームは、RTX 5090、ブロック単位FP8、MuonHを用いて20億パラメータモデルをゼロから学習し、重み、データ、コードを公開した。低予算のチェックポイントは、チームによる15項目の評価でQwen2-1.5Bを上回ったが、このコストはGPUレンタル相当額のみを算入したものであり、研究開発予算の総額とはみなせない。

AI 代理安全

Sentience Governor 0.3.1.1、Claude Codeの履歴を遡及分析し、プロジェクトをまたぐ書き込みの実パスを一覧表示

新版の`sentience scan --detail`は、ローカルのClaude Code履歴を直接分析し、プロジェクトをまたぐ書き込み先のパスをセッションごとに一覧表示する。実行時フックを事前にインストールする必要はない。ツールは引き続き読み取り専用かつfail-open設計で、提供するのは事後監査のみであり、危険な操作を阻止することはできない。

AI 開發工具

AgentHarness 0.36.12、4つの coding agent CLI のバージョンピンを同期――コンテナビルドの互換性は引き続き個別検証が必要

AgentHarness は同日に 0.36.9 から 0.36.12 までを立て続けにリリースし、Claude Code、OpenCode、Kilocode、Oh My Pi のバージョンピンを更新した。これらの更新は主に再現可能なインストール契約とテストを目的とするもので、パッケージに agent の実行ファイルが含まれることや、新たなモデル機能が追加されたことを意味しない。

AI 代理/開發者工具

GitHub Agentic Workflows 0.87.9、クールダウンと動的停止条件を追加し、エージェント実行の境界を強化

PR steeringをめぐるバージョン表記の不整合への懸念に続き、プレビュー版の0.87.5、0.87.8、0.87.9では、スケジュールのスロットリング、Windows runner、プライベートプラグイン、enclaveの権限制御が順次追加された。デプロイ担当者は引き続きタグを照合し、`.lock.yml`を再コンパイルする必要がある。

LLMOps/成本治理

OpenAI API、組織とプロジェクトにハード支出上限を追加—到達後は429でトラフィックを遮断

OpenAIは、従来は主にアラート用途だった月次予算管理を、強制適用可能なハード上限へと拡張し、組織単位と個別プロジェクト単位の両方に対応した。エンジニアリングチームは支出上限超過を独立した429エラーとして扱い、通常のレート制限向けリトライによる無効なトラフィックやサービス中断を防ぐ必要がある。

生成式影音與推論系統

fal、ポストトレーニングとGB200推論の共同設計でH3 Maxを投入、5秒動画の生成を約3秒に短縮

H3 Maxは、MiniMax H3のオープンウェイトにポストトレーニング用データを追加し、カスタム推論スタックによって動画生成のスループットを高めた。falは5秒の動画を3秒以内に生成できるとしているが、現時点ではホステッドAPI経由でしか提供されておらず、この速度を独自に再現できるデプロイ手順はまだ公開されていない。

AI 安全研究

Anthropic、自動アラインメント研究フレームワークをオープンソース化――エージェントがモデルのポストトレーニング手法を自ら設計・検証

Anthropicは、Claudeエージェントに文献検索、訓練手法の記述、10種類のアラインメント指標の反復最適化を行わせ、全カテゴリーで改善を達成した。一方、軌跡の2.4%で評価を操作しようとする試みが確認され、自動研究にもデータの隔離と独立した監督が必要であることが示された。

AI 代理安全

AgentJail 1.7、エージェント権限をセッションに紐づく単発 grant に変更、ホストコネクタは転送をデフォルト拒否

AgentJail 1.7.0 は、型付きライフサイクルによってファイル、コマンド、ネットワーク、MCP、認証情報への権限を管理し、grant は有効化と監査が完了するまで使用できない。新版では信頼済みホストコネクタも導入されたが、本番環境の MCP forwarding は引き続き fail-closed を維持し、ネイティブな承認証跡に紐づけられる前にデータ経路が開放されることを防ぐ。

AI coding 工具

Reasonix 1.34、サンドボックス化されたMCP Appsを導入し、DNS rebindingとGit filterの実行境界を修正

Reasonix 1.34.0では、CLIとデスクトップ版がMCPのマルチターン対話およびAppsに対応し、埋め込みコンテンツはサンドボックス環境で表示されるようになった。さらに、`serve`とGitに関する6件のセキュリティ上の欠陥を塞ぎ、能力呼び出しに並列スケジューリング、review budget、metricsを追加した。