AI 基礎設施
Hetzner、OpenAI互換の推論APIを試験提供――単一のFP8 MoEモデルで欧州ホスティング需要を検証
Hetznerは実験的なLLM推論サービスをひっそりと公開した。現在利用できるのはQwen3.6-35B-A3B-FP8のみで、既存のOpenAI SDKからbase URLを差し替えるだけで接続できる。コミュニティによる低負荷テストでは、最初のtokenが返るまでの時間の中央値は153ミリ秒、生成速度は約224 token/sだった。ただし、SLA、課金、プロダクション利用の保証はない。