Qwen3.8-Omni-Flash undercuts Google's Gemini Flash pricing while matching its multimodal benchmarks

Qwen3.8-Omni-Flash undercuts Google's Gemini Flash pricing while matching its multimodal benchmarks

AI News Bot
2026-09-20
預計閱讀 1 分鐘原文來源

核心重點:Qwen3.8‑Omni‑Flash 以更低價格挑戰 Google Gemini Flash,且在多模態基準測試上表現相當

Qwen3.8‑Omni‑Flash 是 Qwen 系列首款針對 AI 代理人設計的 多模態模型,能同時處理音訊與視訊,自行完成剪輯部落格、短影片翻譯或電影摘要等任務。其上下文視窗長達 一百萬個 token,在音訊‑視訊任務上與 Google 的 Gemini 3.8 Flash 逼近相同水準。


背景與影響

定價策略的顛覆

  • API 定價:輸入 token 每百萬 0.15 美元,輸出 token 每百萬 0.47 美元。
  • 以音訊輸入計算,成本低於每小時 0.01 美元;720p 視訊(每秒一幀)約 0.20 美元,未計入回應成本。
  • 相較之下,Gemini 3.8 Flash 的試用價格為輸入每百萬 0.75 美元、輸出每百萬 3.75 美元,且於 2027 年 1 月 1 日將翻倍。

如此差距讓開發者在 雲端 或本地部署時,可大幅降低運營成本,特別是需要大量視訊分析的內容平台與教育科技公司,將更傾向採用 Qwen 的方案。

生態系統與工具鏈

  • Qwen Studio、Qwen Cloud 以及 API 均已提供模型存取。
  • 開源的 Qwen‑MM‑Plugins 為代理人(如 Claude Code、Gemini CLI、Qwen Code)加入影片剪輯、說話者辨識、PDF 影片筆記與可重用工作流程等功能。
  • Qwen‑Live Harness 讓使用者可即時以相機與麥克風與模型互動,提升即時創作與客服應用的可行性。

這些配套工具不僅降低了開發門檻,也促進了 AI 代理人 在多媒體內容生成與分析領域的落地。


未來展望與讀者啟示

隨著 多模態 AI 越來越成為內容產業的核心動能,Qwen3.8‑Omni‑Flash 以「低成本+高效能」的組合,可能改寫市場競爭格局。對於想要在影片平台、線上教育或企業內部培訓中導入 AI 剪輯與翻譯功能的企業而言,現在是評估 Qwen 生態系統的關鍵時機。

未來若 Qwen 持續優化模型精度與工具整合,並保持價格競爭力,將有望在 2027 年前奪得更多企業客戶,進一步推動 AI 代理人 從實驗室走向日常商務應用。讀者若關注成本效益與技術前沿,建議關注 Qwen 官方的更新公告,並可透過 Qwen‑Live Harness 體驗即時互動,親自感受多模態 AI 的實際效能。

分享