全ニュース

技術ニュース 973 件

AI 代理/科學研究

OmniScientist、科学の生データを直接読み取り、36件の学際的タスクすべてで追跡可能な論文を生成

OmniScientistは、画像、波形、軌跡を先にテキスト要約へ圧縮するのではなく、知覚能力を仮説、実験、執筆の全工程に行き渡らせる。完全版システムは、予算化された特徴量のみを受け取るバージョンとのブラインドテストで85%の勝率を記録したが、評価は依然として主にモデル審査員によるものだ。

推論系統/自動駕駛

FlashDriveがVLAの4段階推論を統合的に枝刈り、Alpamayo 1.5のシングルGPU遅延を151ミリ秒に短縮

FlashDriveは、動画のKVを再利用し、推論tokenのドラフト生成を並列化するとともに、フローマッチングで変化の小さいステップをキャッシュする。論文ではRTX PRO 6000上で4.7倍の高速化と、軌跡誤差がほぼ変わらないことを報告しているが、現時点ではシミュレーション環境と単一のモデルスタックで得られた結果にとどまる。

LLMOps

LiteLLM 1.98 RC、Auto Routerで先にシャドー評価を実行し、system promptによるコスト誤判定を修正

新バージョンでは、少量の実トラフィックを候補ルーターに複製し、オンラインの結果に影響を与えることなく、ブラインド方式のLLM judgeで応答を比較できる。複雑度分類でも、固定されたエージェントのsystem promptを各リクエストの技術的難易度を示すシグナルとして扱わなくなった。

本機推論/模型完整性

llama.cpp b10451、LoRAテンソルにファイル境界チェックを追加——切り詰められた重みの暗黙的なゼロ埋めを防止

従来のLoRA読み込みパスでは、テンソルのオフセットとサイズの合計がGGUFファイルの範囲を超えていないか検証しておらず、破損またはダウンロード未完了のadapterでも正常に読み込まれたと見なされる可能性があった。b10451では即座にエラーを返し、テンソルのインデックスが実際に存在することも確認する。

代理框架/開發工具

OpenAI Agents SDK 0.21、API不要のテストレイヤーを追加——エージェント、サンドボックス、音声フローをリプレイ検証可能に

新バージョンでは、スクリプト化可能なモデルおよびサンドボックスのテストツールを提供し、モデルプロバイダーを呼び出すことなく、マルチターンのエージェントフローをCIで再現できるようになった。また、OpenAI Python 3とHTTPX 2への対応を進め、中断状態、ツール承認、機密性の高いエラー情報の漏えいに関する問題も修正している。

開源推論

NInfer-3090、ReplaySSMで投機的デコーディングの状態コストを削減――RTX 3090でQwen3.8-27Bの並行実行が可能に

NInferのAmpereブランチは、Qwen3.8-27B、MTP3、paged KV、互換プレフィックス再利用を1枚の24GB RTX 3090に収めた。作者の測定では、8並列デコードの合計は165.33 token/秒に達したが、結果は短いプロンプトと長い出力を組み合わせた固定ワークロードに限られている。

多代理系統

StateBridge、閉形式の回転アライメントでエージェントの隠れ状態を整合し、訓練なしでテキスト通信のボトルネックを回避

StateBridgeは、送信側エージェントの最終層のhidden stateを受信側のembedding空間に整合させ、連続的なprefixとして直接注入する。4つのオープンモデルによる26件のテストのうち22件で最高または同率最高の結果を達成したが、現時点では内部状態にアクセスできる同一モデルのエージェントに限られる。

推論系統

Apple SiliconでハイブリッドQwenを動かすための最適化チェーンは依然として不完全:MLX変換ではMTPが完全に保持されない

コミュニティによる実機検証では、Apple Silicon向け推論フレームワークは、組み込みMTPによる投機的デコーディング、ハイブリッド状態のプレフィックスキャッシュ、バッチ処理を同時かつ安定して提供できていない。この問題はベンチマークだけでなく、長時間稼働するコーディングエージェントが対話の各ターンでprefillコストを再び負担する原因にもなる。

代理安全與標準

1F916、Merkleログでエージェントの記憶をアーカイブ――オフライン検証で証明できるのは「改ざんされていないこと」のみ

新たなオープンソースプロトコルにより、エージェントは記憶、アイデンティティ、行動についてEd25519署名付きの監査可能な追記専用記録を作成でき、依存関係ゼロのオフライン検証ツールも提供される。永続記憶へのポイズニングを検出可能な完全性問題へと変える一方、記憶が当初から真実だったことは証明できず、IETF標準にもなっていない。

模型與開發者平台

Gemini 3.7 Flashはコーディングエージェントに注力、LiteLLMは`minimal`推論レベルでHTTP 400が直接返されると注意喚起

GoogleはGemini 3.7 FlashをAPI、Antigravity、Android Studio、企業向けエージェントプラットフォームへ展開し、期間限定の半額料金で高トラフィックなエージェントワークロードへの浸透を図る。初期の統合ではマルチモーダル、ツール呼び出し、複数のAPI形式が利用可能になっている一方、推論パラメータとコストデータには依然として移行上の落とし穴がある。

模型與開發者 API

Mistral OCR 4.1、bounding boxのずれと引用符の書き換えを修正、`latest`エイリアスはすでに直接切り替え

Mistral OCR 4.1は、bounding boxのずれ、ブロックの欠落、参考文献の結合、右から左に記述する言語の表など、6種類の文書解析エラーを重点的に修正した。`mistral-ocr-latest`はすでに新版を指しており、浮動エイリアスに依存する本番パイプラインでは、コード変更やバージョン固定を行わなくても出力が変化する可能性がある。