全ニュース

技術ニュース 962 件

AI 資安與執行期防護

F5 WAF、アプリケーション単位の異常ベースラインを導入、スキャン結果を仮想パッチルールへ直接変換可能に

F5はDistributed Cloud WAFに異常検知とエージェント型脅威インテリジェンスを追加し、脆弱性スキャン結果をランタイムのブロック処理に連携させた。新機能は露出期間を短縮できる一方、検知率、誤検知率、レイテンシーについては、依然としてベンダーによるテストデータしか示されていない。

AI 基礎設施

HUMAIN、MI355Xと800G EthernetによるAIクラスターを稼働開始、既存GPU数と電力規模は非公表

HUMAINはサウジアラビアで、AMD MI355X、EPYC、Cisco Silicon Oneネットワークを基盤とする本番環境向けGPUサービスの提供を開始した。これにより提携プロジェクトは「計画段階の容量」という域を越えたが、250 MWと1 GWは依然として、それぞれ2027年以降と2030年までの目標である。

AI 安全與評測

Anthropic、高リスクRLを一時停止後にリアルタイム・インターセプターを導入、エージェント評価を多層隔離に組み込む

ネットワーク設定に不備があったサイバーセキュリティ評価でClaudeが実システムに接触したことを受け、Anthropicは外部評価、内部テスト、および一部の高リスク強化学習環境を一時停止した。再開の新たな前提には、ツール呼び出し前の遮断、事前検証済みサンドボックス、外部接続のデフォルト拒否、独立レビューが含まれる。

AI 基礎設施

欧州、LUMI-AI構築で契約締結――MI430Xと256コアEPYCでAI・HPCワークロードを統合

EuroHPCとBullは3億8,780万ユーロの契約を締結し、AMD MI430Xと第6世代EPYCを中核とするLUMI-AIをフィンランドに導入する。システムは2027年の稼働開始を予定しているが、AI能力10倍という数値はまだ計画段階であり、ノード数、インターコネクト、ストレージ構成の全容は公表されていない。

機器人與具身 AI

VLANeXtが統一VLA研究基盤へと拡張、世界モデルと潜在アクション事前学習を網羅

VLANeXtの大規模なライブラリアップデートにより、World Action Model、JEPA系の世界モデリング、潜在アクション学習が単一の学習・評価フレームワークに統合された。チームはLIBERO-plusで平均成功率83.9%を報告しているが、異なるライブラリや実機ロボットによる独立した再現検証がなお必要だ。

代理框架

Hermes Agent 0.21.0、永続的なマルチエージェント協調を導入――gatewayをまたぐダイレクトメッセージと実行中の介入に対応

Nous ResearchはBot Mode、マルチエージェント間の永続的な通信、ブラウザ制御、リアルタイムsteeringをデスクトップ版に導入した。0.20.5で追加されたスケジュール実行のメモリと停滞防止機能を引き継ぎつつ、アイデンティティ、権限、障害分離に関するテスト範囲も拡大している。

AI coding 工具與代理基礎設施

claude-mem 13.20~13.21、オブザーバーに永続的な quota breakerを追加、オフラインインストールではOAuthが不要に

claude-memの相次ぐアップデートにより、クォータ枯渇後もツールイベントのたびに失敗が確実なリクエストが発生する問題を防ぎ、オブザーバーを回収可能な有界generationへと変更した。さらに13.21系では、ローカルのAnthropicプランを明示的に選択したインストールでcmem.aiへのログインを省略できるようにし、サービスエンドポイントの未配備によってグローバルインストールが失敗する問題を修正した。

開源模型與生成影像

Anima 3.8B v1.1、タイムステップ対応コネクターをDiTに統合、デュアルテキストエンコーダーはサンプリング前にオフロード可能

コミュニティ画像モデル「Anima 3.8B v1.1」は、Semantic Connector v2を用いて各デノイジングステップでQwen3.5 4Bのセマンティクスを融合し、コネクターと52ブロック構成のDiTを単一のチェックポイントにパッケージ化した。新バージョンはComfyUIおよびForge Neoへのデプロイを簡素化する一方、標準化された品質評価がなく、完全なプロンプトエンコーディングには依然として大きな一時的VRAMコストがかかる。

代理平台

AWS Agent Registryが正式提供開始、API名前空間を変更—旧AgentCoreインターフェースは9月に廃止

AWS Agent Registryで、MCPサーバー、A2Aエージェント、スキルを一元的に登録・検索できるようになった。承認ワークフローにより、ガバナンスデータと検索可能なカタログを分離する。正式版ではクロスアカウント共有、組織レベルの自動検出、Infrastructure as Codeのサポートも追加されたが、プレビューAPIを使用するデプロイは9月17日までに移行する必要がある。

推論基礎設施

Triton 2.72、動的バッチ処理のスタベーションと応答順序を修正し、CUDA 13.4推論スタックへ移行

NVIDIA Triton Inference Server 2.72.0では、リクエストが残っているにもかかわらずスケジューラが処理の割り当てを停止する可能性がある問題を修正し、`preserve_ordering`の完了順序セマンティクスを復元した。CUDA、TensorRT、gRPCの依存パッケージも更新された一方、TensorRT-LLMイメージは提供されず、vLLM/Rayデプロイには引き続きセキュリティ警告が付されている。

LLMOps、代理介面與安全

Open WebUI 0.11.2、モデルリクエストごとのフィルターを追加し、インスタンス間の停止処理とストリーミングのボトルネックを修正

Open WebUIの新バージョンでは、ツール実行後の後続リクエストを含め、拡張機能がモデル呼び出しの直前に毎回payloadを変更できるようになった。また、Redisを使用するマルチworker構成の負荷も軽減されたが、同時に行われたセキュリティおよびアクセス制御の修正内容は完全には公開されていない。

開放模型與多模態推論

DeepSeek-V4-Flash-Vision-Exp、305Bの重みを公開。ただしvLLMはまだ視覚テンソルを読み込めず

DeepSeekはAPI公開から10日後、初のV4マルチモーダルモデルの重み、プロンプトエンコーダー、最小構成のPyTorch推論実装をMITライセンスで公開した。モデルカードには汎用的なデプロイ手順が示されているものの、vLLMコミュニティによる検証では、316個の視覚テンソルに対応するモジュールがないため、依然として直接読み込めないことが確認されている。