资讯
实测比DeepSeek便宜的Qwen 3.8 Flash,卷飞了
📌 概要
<p style="text-align: left;">阿里千问新模型,又卷出了新水平。</p> <p style="text-align: left;">他们发布并开源的Qwen 3.8 Flash-Next,不仅<strong>价格直接秒杀了DeepSeek-V4-Flash</strong>,而且<strong>刚发布便摘得了Huggingface榜首!</strong></p> <p s
<p style="text-align: left;">阿里千问新模型,又卷出了新水平。</p>
<p style="text-align: left;">他们发布并开源的Qwen 3.8 Flash-Next,不仅<strong>价格直接秒杀了DeepSeek-V4-Flash</strong>,而且<strong>刚发布便摘得了Huggingface榜首!</strong></p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/14c74db1-93dd-48d0-b057-41812091f759.jpeg" title="" /></p>
<p style="text-align: left;">推上网友们也沸腾了,甚至还有工程师甩出实测视频直呼牛逼:</p>
<blockquote>
<p style="text-align: left;"><strong>Qwen 3.8 Flash踏平了VRAM的门槛,</strong>数据中心级的长文本大模型,在消费级4090显卡上也能跑了!</p>
</blockquote>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/36280ac8-720a-496f-9502-7b4d4e886689.jpeg" title="" /></p>
<p style="text-align: left;">还有人已经兴冲冲地把它用到了工作中。</p>
<p style="text-align: left;"><strong>不到8分钟,它就跑完了涵盖Python编程、多表分析和研究报告生成的一整套工作流</strong>:</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/dd812a9b-c4d0-40b4-ab21-31812ae59a4b.jpeg" title="" /></p>
<p style="text-align: left;"><strong>宝塔特效也不在话下:</strong></p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/58bf5728-f8e0-43fe-9341-6ebfcc14b948.jpeg" title="" /></p>
<p style="text-align: left;">哇奥,真有这么炫?我们当然也得上手试试。</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/ce24f333-c891-451e-ad57-ebc17458d71f.jpeg" title="" /></p>
<h2 style="text-align: left;"><strong>每百万Tokens输入仅0.8元</strong></h2>
<p style="text-align: left;">Qwen3.8-Flash采用了<strong>125B MoE架构</strong>,每Token仅激活约<strong>6B参数</strong>,原生可支持<strong>262144token上下文</strong>,并<strong>可通过YaRN扩展至1M token</strong>。</p>
<p style="text-align: left;">同时,它也<strong>是Qwen4新架构的提前预演</strong>。</p>
<p style="text-align: left;">相比于Qwen 3.7 Plus,Qwen 3.8 Flash不光<strong>把激活参数砍到了1/3</strong>,<strong>训练成本也仅为其1/9</strong>,且通用、数学推理、编程等能力都更加强悍了。</p>
<p style="text-align: left;">更狠的是价格,Qwen 3.8 Flash<strong>每百万Tokens输入仅0.8元</strong>,<strong>输出2.7元</strong>,<strong>缓存命中0.1元</strong>,价格最低至DeepSeek-V4-Flash的<strong>1/3</strong>。</p>
<p style="text-align: left;">真是比拼多多砍一刀力度大多了(bushi</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/17bf3165-d648-4659-a0bb-9e0199ead52f.jpeg" title="" /></p>
<p style="text-align: left;">好吧好吧,既然价格已经卷到了这个份上,那咱也不客气了,直接上强度,用两个实测来探探Qwen 3.8 Flash在办公场景实际的干活能力吧。</p>
<h2 style="text-align: left;"><strong>实测一:为相机产品设计四种适配不同风格平台的文案</strong></h2>
<p style="text-align: left;">我们设计了一场“赛博文案挑战赛”,让Qwen 3.8 Flash在1元的额度内,将一份近万字的相机产品资料改写成小红书、微博、抖音和朋友圈文案,看看它究竟能完成多少项任务。</p>
<p style="text-align: left;">提示词如下:</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/7c4b867a-99de-4a3d-85cb-6d976f9b0185.jpeg" title="" /><br />发完提示词之后,我就去公司茶水间打了个水,<strong>全程不到2分钟</strong>。</p>
<p style="text-align: left;">回来一看,四份不同平台的文案都已经全部写好了,并且@对了品牌、风格、话题词条拿捏得准准的(除了我不会那么发那么长的朋友圈之外hhh):</p>
<p style="text-align: center;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/3bbdd8d3-79a9-4fb8-9407-3afcf74dedf5.jpeg" title="" /><br /><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/91f3f4e9-d2c7-40bf-bbbc-a0117a44a857.jpeg" title="" /><br /><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/8dfe5852-5c86-43e2-a2fc-9fe6c779606b.jpeg" title="" /><br /><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/0a7a5a9d-4235-4de6-8bab-eb6a5f32a77c.jpeg" title="" /></p>
<p style="text-align: left;">不到2分钟肝完四份文案,“赛博打工人”的手速算是过关了。</p>
<p style="text-align: left;">但职场里真正让人头疼的,往往不是写文案,而是<strong>开完会之后谁来把一地鸡毛整理清楚。</strong></p>
<p style="text-align: left;">于是,我们给它安排了第二份工作,考验它的实战办公能力。</p>
<h2 style="text-align: left;"><strong>实测二:把一场产品周会变成可执行方案</strong></h2>
<p style="text-align: left;">我们以<strong>“智能客服Agent V2.0 需求与技术评审会”为主题</strong>,原汁原味复刻了一份大家刚开完周会后可能会拿到的、同音错字多且穿插着琐碎闲聊的万字原始会议实录材料,并让Qwen3.8-Flash一次性完成了提取总结、整理表格和会后通知邮件三项工作。</p>
<h6><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/e90f3781-4262-4bcd-bf38-ff5701f34af1.jpeg" title="" /><strong>△</strong>图片由AI生成,“token”听成“偷啃”真是太有生活了</h6>
<p style="text-align: left;">提示词如下:</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/853d788c-648d-4c16-8799-4a6110bbe31f.jpeg" title="" /></p>
<p style="text-align: left;">默认模式下,<strong>不到4分钟,Qwen3.8-Flash就圆满完成了所有任务</strong>,且五条核心结论总结、表格分工内容均准确无误,邮件格式规范,收件人也与会议内容一一对应。</p>
<p style="text-align: center;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/39a7e375-058d-4b8c-95dc-48d8912f7522.jpeg" title="" /><br /><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/08e4e151-0bf5-4bf9-9595-c8eafe12155d.jpeg" title="" /><br /><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/f43bd5f1-01e5-40f2-afa0-061be7512c20.jpeg" title="" /></p>
<h6><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/b56c7c77-5dcd-4a2e-ab2d-5186c2f44679.jpeg" title="" /><strong>△</strong>部分测试结果图</h6>
<p style="text-align: left;"><strong>甚至没有要求它,它也会自行贴心地给我们梳理出了会议中尚未讨论出结果的事项</strong>、方便我们下次开会继续讨论,be like:</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/3061c6ac-4fd9-4207-9111-7bf59fb59444.jpeg" title="" /></p>
<p style="text-align: left;"><strong>而且到这一步,我的额度还没烧完哦!</strong></p>
<p style="text-align: left;">啊哈哈这种不受限的感觉真是太爽了。</p>
<p style="text-align: left;">现在,<strong>Qwen 3.8 Flash已经在“千问办公”平台首发上线,API接口也已同步开放</strong>,大家可以去试试啦!</p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/59e4a275-fa73-4721-a334-a54d4c983df3.jpeg" title="" /></p>
<h2 style="text-align: left;"><strong>One More Thing</strong></h2>
<p style="text-align: left;"><strong>国产大模型价格战打得更猛了。</strong></p>
<p style="text-align: left;">就在Qwen 3.8 Flash开源的几乎同一时间,智谱也开源了GLM-5系列首个原生多模态模型<strong>GLM-5.3-Flash</strong>,也就是之前在网上爆火的“牛来”大模型Ox Alpha。</p>
<p style="text-align: left;">测评中,该模型的<strong>性能比肩Claude Opus 4.8,价格却砍到了GLM-5.3的1/10。</strong></p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/90839976-a6c9-4df9-bb98-e12bf1188076.jpeg" title="" /></p>
<p style="text-align: left;">而且GLM-5.3-Flash还慷慨地开放了<strong>为期两周的半价活动</strong>,这意味着,<strong>活动期内的GLM-5.3-Flash的价格仅为GLM-5.3的1/20,为Opus4.8的1/40。</strong></p>
<p style="text-align: left;"><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/3919e502-4c6a-45a3-b2d7-cb7e2ab5c814.jpeg" title="" /></p>
<p style="text-align: left;">此外,Qwen 3.8 Flash和GLM-5.3-Flash还有一个<strong>共同点</strong>,那就是他们这次都以超低的价格杀了DeepSeek-V4-Flash个措手不及(DeepSeek骂骂咧咧地走开了):</p>
<h6><img alt="图片" class="wscnph" src="https://wpimg-wscn.awtmt.com/db4d7854-a980-4b0b-a913-860f9b98d59d.jpeg" title="" /><span style="color: #808080;">△DeepSeek-V4-Flash、Qwen 3.8 Flash、GLM-5.3-Flash价格对比图</span></h6>
<p style="text-align: left;">没得说,太卷了。</p>
<p style="text-align: left;"><span style="color: #808080;">本文来源:<a href="https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247916257&idx=2&sn=9ddd628027aa65a42d11022feb6810b1&chksm=e96ccf1bad92b5d67777e393e9cee63052a7111e55d6a9f87bd1dbc68ddc2b0a6ec01cac8fdd&scene=0&xtrack=1" rel="noopener" target="_blank">量子位</a></span></p><div style="color: #666; margin-bottom: 15px;">风险提示及免责条款</div>
<div>
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
</div>