Alibaba Cloud 官方账号先把 Qwen3.8-Max 定位为持续在线的工作搭档,列出编码、推理、研究、写作和 AI Agent 五类任务,并确认用户可从产品与 API 试用。这解决了模型是否公开亮相的问题,却没有交代规模、基准、价格、开放权重时间和地区边界。
完整发布资料随后补上技术与工作流信息:模型为 2.4T 总参数、95B 激活参数,兼容 OpenAI Responses 与 Anthropic 协议,可调 reasoning effort。官方案例包括约 16 天构建 oh-my-cli,产生 265 次提交、127 个 PR 和 151 个 issue;另一项科研复现持续约 125 小时。官方还承诺下一周开放权重,并给出 Terminal Bench 2.1 为 86.6、PaperBench 为 93.0 的自测结果,但依然没有公布 API 定价。
这个空白很快被社区说法填上:Bindu Reddy 称输入每百万 token 2 美元、输出 6 美元、隐式缓存 0.25 美元,并称模型将在本周开源。2.4T 规模与完整资料相符,开放时间也大体接近官方承诺,但价格和缓存数字没有官方页面支撑;“开放模型第一”和达到 Sonnet 级别同样是作者判断,而非独立评测。模型已经可以进入兼容性试跑,预算和迁移决定则仍缺关键一块。
编辑判断:这次发布把采用决策拆成了三个信息层:官方短帖确认产品存在与用途,完整资料证明接入方式和厂商自测能力,社区则替官方填补经济性空白。三层合起来说明它已经足够开始技术验证,却还不足以进入成本承诺;团队应把冒烟测试与预算迁移分开,直到定价、缓存计费和实际可用范围获得官方确认。
证据状态:模型发布、规格、协议与案例来自官方材料;基准均为厂商自测,社区给出的价格、缓存费用和领先判断尚无官方价格页或独立评测确认。
来源
- Qwen3.8-Max: A New Bar for Coding and CoworkHacker News完整发布资料给出模型规模、协议兼容、长任务案例、厂商基准与下一周开放权重的承诺。
- @alibaba_cloud: Meet Qwen3.8-Max. Your always-on workmate for • Coding • Reasoning • Research • ...X10 · @alibaba_cloudAlibaba Cloud 官方账号确认模型已公开发布,列出五类目标任务,并说明可通过产品与 API 试用。(全文见 X 热点)
- @bindureddy: Wow!! Qwen3.8-Max Replaces Kimi As The Open Source Leader 🚀 A 2.4T model that...X09 · @bindureddy社区作者给出输入、输出和缓存报价及开放时间说法,同时暴露这些数字尚缺官方页面确认。(全文见 X 热点)