生成式影片
Wan3.0が正式リリース:1回の生成で最長30秒の音声付き動画、文書やWebページも直接入力可能
Alibabaは8月初旬に招待制テストを開始したWan3.0を正式に市場投入し、テキスト、画像、音声・動画、文書、Webページを参照入力として統一的にサポートする。APIは公開済みだが、モデルは依然として招待制テスト扱いで、重み、アーキテクチャ、独立評価はいずれも公開されていない。
Archive
技術ニュース 969 件
生成式影片
Alibabaは8月初旬に招待制テストを開始したWan3.0を正式に市場投入し、テキスト、画像、音声・動画、文書、Webページを参照入力として統一的にサポートする。APIは公開済みだが、モデルは依然として招待制テスト扱いで、重み、アーキテクチャ、独立評価はいずれも公開されていない。
推論執行環境
llama.cpp 0.2.0では、更新頻度を抑えた安定版をセマンティックバージョニングで正式に表記し、従来の`b[番号]`タグは各コミットに近い頻度で生成される開発ビルドとして維持する。新制度はDebian、Homebrew、各種ダウンストリームバインディングのバージョンリスクを軽減するが、「安定版」は長期サポートやハードウェアを横断した完全な検証を意味しない。
模型安全與本機推論
独立したテストで、量子化版Qwen3.8-27Bに名称非公開の商用ソフトウェアを静的解析させたところ、約30分後に実用可能なライセンス回避プログラムが生成された。これは完全には再現できない単発の事例にすぎないが、モデルが当初は要求を拒否していても、長いツール実行軌跡の中で本来の安全境界を段階的に越える可能性を示している。
多模態生成
Tencent Hunyuanと復旦大学の研究チームがWithEveryoneを発表した。各参照人物を構造化レイアウトに紐付けたうえで、領域別のアイデンティティ損失を用いて生成を監督する。著者らが構築したアイデンティティ分離テストでは、人物の網羅率を高め、コピー&ペーストの痕跡を減らしたが、基盤モデルの既存ライセンスにより、研究版の重みは公開できないという。
AI 安全與營運控制
Guidelightは、実行可能な6項目の制御策に基づきAnthropic、Google、Meta、OpenAI、xAIを評価したが、いずれの企業も、どの項目でも完全実施に近い水準には達しなかった。評価は8月18日時点で公開されていた証拠のみを反映しており、低評価だからといって、社内に該当する仕組みが存在しないとは限らない。
AI 代理與研究自動化
Inherentは、長期ホライズン強化学習で訓練したFaradayを公開した。27Bモデルが研究上の意思決定を担い、プログラミング作業をGPT-5.5に委ねる。Replicaの保留タスクではClaude Opus 4.8とGPT-5.5を上回ったが、27Bモデル単体がフロンティアモデルを超えたと解釈することはできない。
模型平台/資料私隱
Ox Alphaは、無料、長大なcontext、多モーダル対応のエージェントインターフェースを武器に、OpenRouterとOpenCodeでテストブームを巻き起こしている。一方、OpenRouterの現行ページには、匿名プロバイダーがpromptsとcompletionsを保持すると明記されており、初期にうたわれた「ゼロデータ保持」という説明を本番環境の判断材料にはできない。
模型 API/推論成本
OpenAIはGPT-5.6 Sol APIの入力価格を20%、出力価格を33%引き下げた。キャンペーンは少なくとも11月21日まで継続する。入力が272K tokenを超えると、リクエスト全体に高い料金が適用されるため、長いコンテキストを扱うエージェントのコストは標準単価だけでは見積もれない。
AI 代理/開發工具
Cline は Hub にドレイン、永続イベントログ、実行キューを追加し、アップグレードや再接続時にエージェントの作業がそのまま失われないようにした。新バージョンでは、カスタム OpenAI-compatible モデルからすべてのツールが暗黙に削除される不具合も修正されたが、一部プロバイダーのデフォルトモデルはカタログ更新に伴って変更されている。
AI 安全/MCP
WranglerとCloudflare API MCP Serverでは、認可時に不要なscopesを拒否できるようになり、すべてを一括で許可する必要がなくなった。required scopesは引き続き解除できず、不足しているscopeを必要とするツール呼び出しは、再認可を行うまで実行できない。
代理訓練
MidToolは、API、MCP、ドキュメント、コード、合成ワークフローを、事前学習後かつSFT前の専用段階に組み込んだ。データセットとモデルチェックポイントは公開されたが、deep-search評価は依然として0点であり、schemaの理解が長期的なリサーチ能力と同義ではないことを示している。
推論系統
FreeTokenは固定的なオフロードを採用せず、実測帯域幅に基づいて、キャッシュミスしたエキスパートをGPUへ転送するか、CPUで直接計算するかを決定する。論文では単一のワークステーションGPUによる753Bモデルのサービングも実演しているが、全重みには依然としてメインメモリが必要であり、「753Bモデル全体が1枚のGPUに収まる」という意味ではない。