全ニュース

技術ニュース 960 件

AI 程式開發工具

Gemini CLI 0.58、macOSサンドボックスからコンテナデーモンへのアクセスを遮断し、ファイル境界を迂回できるホストパスを封鎖

新版では、すべての組み込みSeatbeltプロファイルで、Docker、OrbStack、Colimaなどのコンテナランタイムのソケット、実行ファイル、IPCインターフェースをブロックする。書き込みポリシー、safety checker、A2Aのキャンセル状態も修正されたが、カスタムインストールパスや既存のワークフローについては引き続き個別の検証が必要だ。

模型安全

OpenAI、AstraのCritical到達を正式確認:ゼロデイ脆弱性の悪用成果を受け、段階的アクセスと実行時インターセプトを導入

AstraはOpenAIのテストでブラウザーサンドボックスからの脱出とroot権限昇格チェーンを完遂し、2件のゼロデイ脆弱性を発見した。同社はこれを受け、モデルがCriticalのサイバーセキュリティ基準に達したことを初めて確認し、高度な機能を段階的に開放する方針を示した。

推論與執行期

llama.cpp b10731、Qwen3.8-Flash-Nextにリカレント状態のロールバックを追加—MTP投機的デコーディングで状態全体の反復転送が不要に

llama.cppは、Qwen3.8-Flash-Nextでドラフトtokenが拒否された際にSSMと畳み込み状態を正しくロールバックできない問題を修正した。RTX PRO 6000を1基使用したテストでは、コードのデコード性能が123 token/sから183 token/sに向上したが、この結果は特定の量子化方式、ドラフトヘッド、単一ワークスロットに限られる。

推論與執行期系統

LMDeploy 0.17、DeepEPv2とMooncake KVストレージを導入し、ノード間MoE推論のデータパスを拡張

LMDeploy 0.17.0は、TurboMindにDeepEPv2のexpert parallelバックエンドを追加し、KV connectorをMooncake Storeに接続した。新バージョンはKimi K2.6、2の累乗に限定されないページサイズ、構造化レスポンスにも対応するが、ハードウェアをまたぐエンドツーエンドの性能データは示されていない。

模型與開發者平台

Claude Fable 5.1、長時間稼働するエージェントのキャッシュコストを削減する一方、アップグレードでは思考ブロックとツール呼び出しに破壊的変更

Anthropicは、100万tokenのコンテキストを備えたClaude Fable 5.1をリリースし、キャッシュ読み取り料金を75%引き下げるとともに、メッセージ単位の推論強度設定とツール間の進捗更新を追加した。既存のFable 5ワークフローでは単純にモデルを差し替えることはできず、ツール使用の強制、思考ブロックの再利用、セーフティルーティングはいずれも再テストが必要となる。

Vector databases and AI data infrastructure

LanceDB 0.38、増分マテリアライズドビューと関数フィールドを追加、複数の SDK に破壊的変更も

LanceDB 0.38.0 は、マテリアライズドビュー、計算可能なフィールド、関数のリソース要件を Python や Node.js などのインターフェースに導入し、embedding とデータ変換をストレージ層に近づけた。同時に、テーブル判定、ブランチ操作、実行環境の要件も変更されているため、RAG システムはアップグレード前にクエリ結果を相互検証する必要がある。

模型與企業部署

Flower Endeavor 1.0、企業向けプライベートデプロイに対応するも、モデル仕様と独立評価は依然不在

Flower Labsは、推論、ソフトウェア開発、長時間のエージェントタスク向けにEndeavor 1.0を発表した。マネージドサービスとして利用できるほか、顧客環境へのデプロイにも対応する。初期スコアは一部のフロンティアモデルに迫るが、現時点では限定プレビューとベンダーによる自己評価しかなく、実際のデプロイコストや能力はまだ検証できない。

AI 程式開發工具

VS Code Agent Host、エージェントループを拡張機能から分離し、AHPでウィンドウ間のセッションを同期

VS Code 1.132から1.135では、CopilotやClaudeなどのエージェントを独立したAgent Hostに接続することで、セッションを複数のウィンドウやリモート接続にまたがって継続でき、ヘッドレスでも実行可能になった。オープンなAgent Host Protocolはセッション状態を統一するが、各モデルの推論、権限、ツールの挙動までは統一しない。

AI 代理治理與評測

Microsoft、モデル・プラットフォーム・アプリケーション別にAI基準を再編、エージェントガバナンスを実行時介入へ移行

MicrosoftはResponsible AI Standardを改定し、技術スタックと自社の役割に応じて中核要件とコンテキスト別要件を適用する。関連ツールでは、実行可能な評価、ステートレスなポリシー判定、ワークフローへの介入ポイントを通じて、エージェントガバナンスをデプロイ前の文書化から継続的な制御へと拡張する。

AI 資安與執行期防護

F5 WAF、アプリケーション単位の異常ベースラインを導入、スキャン結果を仮想パッチルールへ直接変換可能に

F5はDistributed Cloud WAFに異常検知とエージェント型脅威インテリジェンスを追加し、脆弱性スキャン結果をランタイムのブロック処理に連携させた。新機能は露出期間を短縮できる一方、検知率、誤検知率、レイテンシーについては、依然としてベンダーによるテストデータしか示されていない。

AI 基礎設施

HUMAIN、MI355Xと800G EthernetによるAIクラスターを稼働開始、既存GPU数と電力規模は非公表

HUMAINはサウジアラビアで、AMD MI355X、EPYC、Cisco Silicon Oneネットワークを基盤とする本番環境向けGPUサービスの提供を開始した。これにより提携プロジェクトは「計画段階の容量」という域を越えたが、250 MWと1 GWは依然として、それぞれ2027年以降と2030年までの目標である。