阿里千问新模型,又卷出了新水平。
他们发布并开源的Qwen 3.8 Flash-Next,不仅价格直接秒杀了DeepSeek-V4-Flash,而且刚发布便摘得了Huggingface榜首!

推上网友们也沸腾了,甚至还有工程师甩出实测视频直呼牛逼:
Qwen 3.8 Flash踏平了VRAM的门槛,数据中心级的长文本大模型,在消费级4090显卡上也能跑了!


还有人已经兴冲冲地把它用到了工作中。
不到8分钟,它就跑完了涵盖Python编程、多表分析和研究报告生成的一整套工作流:


宝塔特效也不在话下:


哇奥,真有这么炫?我们当然也得上手试试。

Qwen3.8-Flash采用了125B MoE架构,每Token仅激活约6B参数,原生可支持262144token上下文,并可通过YaRN扩展至1M token。
同时,它也是Qwen4新架构的提前预演。
相比于Qwen 3.7 Plus,Qwen 3.8 Flash不光把激活参数砍到了1/3,训练成本也仅为其1/9,且通用、数学推理、编程等能力都更加强悍了。
更狠的是价格,Qwen 3.8 Flash每百万Tokens输入仅0.8元,输出2.7元,缓存命中0.1元,价格最低至DeepSeek-V4-Flash的1/3。
真是比拼多多砍一刀力度大多了(bushi

好吧好吧,既然价格已经卷到了这个份上,那咱也不客气了,直接上强度,用两个实测来探探Qwen 3.8 Flash在办公场景实际的干活能力吧。
我们设计了一场“赛博文案挑战赛”,让Qwen 3.8 Flash在1元的额度内,将一份近万字的相机产品资料改写成小红书、微博、抖音和朋友圈文案,看看它究竟能完成多少项任务。
提示词如下:

发完提示词之后,我就去公司茶水间打了个水,全程不到2分钟。
回来一看,四份不同平台的文案都已经全部写好了,并且@对了品牌、风格、话题词条拿捏得准准的(除了我不会那么发那么长的朋友圈之外hhh):




不到2分钟肝完四份文案,“赛博打工人”的手速算是过关了。
但职场里真正让人头疼的,往往不是写文案,而是开完会之后谁来把一地鸡毛整理清楚。
于是,我们给它安排了第二份工作,考验它的实战办公能力。
我们以“智能客服Agent V2.0 需求与技术评审会”为主题,原汁原味复刻了一份大家刚开完周会后可能会拿到的、同音错字多且穿插着琐碎闲聊的万字原始会议实录材料,并让Qwen3.8-Flash一次性完成了提取总结、整理表格和会后通知邮件三项工作。
△图片由AI生成,“token”听成“偷啃”真是太有生活了
提示词如下:

默认模式下,不到4分钟,Qwen3.8-Flash就圆满完成了所有任务,且五条核心结论总结、表格分工内容均准确无误,邮件格式规范,收件人也与会议内容一一对应。




甚至没有要求它,它也会自行贴心地给我们梳理出了会议中尚未讨论出结果的事项、方便我们下次开会继续讨论,be like:

而且到这一步,我的额度还没烧完哦!
啊哈哈这种不受限的感觉真是太爽了。
现在,Qwen 3.8 Flash已经在“千问办公”平台首发上线,API接口也已同步开放,大家可以去试试啦!

国产大模型价格战打得更猛了。
就在Qwen 3.8 Flash开源的几乎同一时间,智谱也开源了GLM-5系列首个原生多模态模型GLM-5.3-Flash,也就是之前在网上爆火的“牛来”大模型Ox Alpha。
测评中,该模型的性能比肩Claude Opus 4.8,价格却砍到了GLM-5.3的1/10。

而且GLM-5.3-Flash还慷慨地开放了为期两周的半价活动,这意味着,活动期内的GLM-5.3-Flash的价格仅为GLM-5.3的1/20,为Opus4.8的1/40。

此外,Qwen 3.8 Flash和GLM-5.3-Flash还有一个共同点,那就是他们这次都以超低的价格杀了DeepSeek-V4-Flash个措手不及(DeepSeek骂骂咧咧地走开了):
△DeepSeek-V4-Flash、Qwen 3.8 Flash、GLM-5.3-Flash价格对比图
没得说,太卷了。
参考链接:
[1]https://qwen.ai/blog?id=qwen3.8-flash-next
[2]https://huggingface.co/models?inference_provider=all&sort=trending
[3]https://www.qianwenai.com/?source_channel=hy_qwen&utm_content=g_1000415132
[4]https://x.com/Alibaba_Qwen/status/2092591393424515114
[5]https://mp.weixin.qq.com/s/O7RCVME1Kut-Z2oFYhgrkw
文章来自于"量子位",作者 "文婷"。
【开源免费】字节工作流产品扣子两大核心业务:Coze Studio(扣子开发平台)和 Coze Loop(扣子罗盘)全面开源,而且采用的是 Apache 2.0 许可证,支持商用!
项目地址:https://github.com/coze-dev/coze-studio
【开源免费】n8n是一个可以自定义工作流的AI项目,它提供了200个工作节点来帮助用户实现工作流的编排。
项目地址:https://github.com/n8n-io/n8n
在线使用:https://n8n.io/(付费)
【开源免费】DB-GPT是一个AI原生数据应用开发框架,它提供开发多模型管理(SMMF)、Text2SQL效果优化、RAG框架以及优化、Multi-Agents框架协作、AWEL(智能体工作流编排)等多种技术能力,让围绕数据库构建大模型应用更简单、更方便。
项目地址:https://github.com/eosphoros-ai/DB-GPT?tab=readme-ov-file
【开源免费】VectorVein是一个不需要任何编程基础,任何人都能用的AI工作流编辑工具。你可以将复杂的工作分解成多个步骤,并通过VectorVein固定并让AI依次完成。VectorVein是字节coze的平替产品。
项目地址:https://github.com/AndersonBY/vector-vein?tab=readme-ov-file
在线使用:https://vectorvein.ai/(付费)
【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。
项目地址:https://github.com/Significant-Gravitas/AutoGPT
【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。
项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md
【开源免费】LangGPT 是一个通过结构化和模板化的方法,编写高质量的AI提示词的开源项目。它可以让任何非专业的用户轻松创建高水平的提示词,进而高质量的帮助用户通过AI解决问题。
项目地址:https://github.com/langgptai/LangGPT/blob/main/README_zh.md
在线使用:https://kimi.moonshot.cn/kimiplus/conpg00t7lagbbsfqkq0