AI 代理/科學研究
OmniScientist、科学の生データを直接読み取り、36件の学際的タスクすべてで追跡可能な論文を生成
OmniScientistは、画像、波形、軌跡を先にテキスト要約へ圧縮するのではなく、知覚能力を仮説、実験、執筆の全工程に行き渡らせる。完全版システムは、予算化された特徴量のみを受け取るバージョンとのブラインドテストで85%の勝率を記録したが、評価は依然として主にモデル審査員によるものだ。
Archive
技術ニュース 973 件
AI 代理/科學研究
OmniScientistは、画像、波形、軌跡を先にテキスト要約へ圧縮するのではなく、知覚能力を仮説、実験、執筆の全工程に行き渡らせる。完全版システムは、予算化された特徴量のみを受け取るバージョンとのブラインドテストで85%の勝率を記録したが、評価は依然として主にモデル審査員によるものだ。
推論系統/自動駕駛
FlashDriveは、動画のKVを再利用し、推論tokenのドラフト生成を並列化するとともに、フローマッチングで変化の小さいステップをキャッシュする。論文ではRTX PRO 6000上で4.7倍の高速化と、軌跡誤差がほぼ変わらないことを報告しているが、現時点ではシミュレーション環境と単一のモデルスタックで得られた結果にとどまる。
LLMOps
新バージョンでは、少量の実トラフィックを候補ルーターに複製し、オンラインの結果に影響を与えることなく、ブラインド方式のLLM judgeで応答を比較できる。複雑度分類でも、固定されたエージェントのsystem promptを各リクエストの技術的難易度を示すシグナルとして扱わなくなった。
推論系統
新版では、Kimi K3のテキストモデル、KDA/MLAハイブリッドAttention、latent MoE、ツール呼び出し解析に対応。コンバーターがMXFP4のビット配置を直接並べ替えるため、2.8Tモデル全体をいったんBF16へ展開する必要がない。
本機推論/模型完整性
従来のLoRA読み込みパスでは、テンソルのオフセットとサイズの合計がGGUFファイルの範囲を超えていないか検証しておらず、破損またはダウンロード未完了のadapterでも正常に読み込まれたと見なされる可能性があった。b10451では即座にエラーを返し、テンソルのインデックスが実際に存在することも確認する。
代理框架/開發工具
新バージョンでは、スクリプト化可能なモデルおよびサンドボックスのテストツールを提供し、モデルプロバイダーを呼び出すことなく、マルチターンのエージェントフローをCIで再現できるようになった。また、OpenAI Python 3とHTTPX 2への対応を進め、中断状態、ツール承認、機密性の高いエラー情報の漏えいに関する問題も修正している。
開源推論
NInferのAmpereブランチは、Qwen3.8-27B、MTP3、paged KV、互換プレフィックス再利用を1枚の24GB RTX 3090に収めた。作者の測定では、8並列デコードの合計は165.33 token/秒に達したが、結果は短いプロンプトと長い出力を組み合わせた固定ワークロードに限られている。
多代理系統
StateBridgeは、送信側エージェントの最終層のhidden stateを受信側のembedding空間に整合させ、連続的なprefixとして直接注入する。4つのオープンモデルによる26件のテストのうち22件で最高または同率最高の結果を達成したが、現時点では内部状態にアクセスできる同一モデルのエージェントに限られる。
推論系統
コミュニティによる実機検証では、Apple Silicon向け推論フレームワークは、組み込みMTPによる投機的デコーディング、ハイブリッド状態のプレフィックスキャッシュ、バッチ処理を同時かつ安定して提供できていない。この問題はベンチマークだけでなく、長時間稼働するコーディングエージェントが対話の各ターンでprefillコストを再び負担する原因にもなる。
代理安全與標準
新たなオープンソースプロトコルにより、エージェントは記憶、アイデンティティ、行動についてEd25519署名付きの監査可能な追記専用記録を作成でき、依存関係ゼロのオフライン検証ツールも提供される。永続記憶へのポイズニングを検出可能な完全性問題へと変える一方、記憶が当初から真実だったことは証明できず、IETF標準にもなっていない。
模型與開發者平台
GoogleはGemini 3.7 FlashをAPI、Antigravity、Android Studio、企業向けエージェントプラットフォームへ展開し、期間限定の半額料金で高トラフィックなエージェントワークロードへの浸透を図る。初期の統合ではマルチモーダル、ツール呼び出し、複数のAPI形式が利用可能になっている一方、推論パラメータとコストデータには依然として移行上の落とし穴がある。
模型與開發者 API
Mistral OCR 4.1は、bounding boxのずれ、ブロックの欠落、参考文献の結合、右から左に記述する言語の表など、6種類の文書解析エラーを重点的に修正した。`mistral-ocr-latest`はすでに新版を指しており、浮動エイリアスに依存する本番パイプラインでは、コード変更やバージョン固定を行わなくても出力が変化する可能性がある。