會員
財金新聞Finance

阿里巴巴正式發布Qwen3.8-Flash 主模型有1250億參數

阿里巴巴(09988)正式發布Qwen3.8-Flash,採用多模態的混合專家(MoE)架構,並在Hugging Face和ModelScope平台上開源。 模型也是即將推出的Qwen4系列核心架構的早期預覽版本。

Qwen3.8-Flash主模型擁有1250億參數,輔以額外510億N-gram嵌入參數,每個Token僅激活60億參數,在能力、延遲和成本之間取得極佳平衡,適合高吞吐量應用、工具驅動的工作流程、以及編碼或協作助手場景。 模型在智能體編碼、長週期辦公任務、真實世界工具使用、視覺數學問題求解、代理移動端使用,以及具身智能等多個基準測試中,表現媲美DeepSeek-V4-Flash和Claude-Opus-4.6等頂尖模型。

模型原生支持26萬2千Token的上下文長度,並可擴展至100萬Token。 阿里巴巴旗下辦公平台QwenWork,已納入Qwen3.8-Flash,將每個任務Token消耗量降低七成半,並將生成速度提升約一倍。

開發者可透過阿里巴巴Model Studio和AI原生雲平台Qwen Cloud,通過API訪問該模型,每百萬Token的定價為輸入1元人民幣,輸出3元人民幣。