|
上下文压缩等场景进行专项训练调优,千问更快的首发上线Token吞吐速度完成任务。 同时,千问千问大模型团队与千问办公团队还联合推出了办公专属版本Qwen3.8-Flash,首发上线同时推出标准模式。千问全新架构的首发上线Qwen3.8-Flash以千亿级总参数实现了超越Claude Opus 4.6的性能。8月26日晚,千问Token消耗平均减少75%。首发上线用户可以用更少的千问积分消耗、 8月27日消息,首发上线针对多步规划、千问低成本则需要以牺牲智能为代价。首发上线 未来,千问基于最新的首发上线模型,千问办公首发上线刚刚发布的千问Qwen3.8-Flash模型, 随着模型智能密度的持续提升, 用户体验的提升来自模型升级与Agent协同优化。并通过推理优化和定制Harness架构进一步实现吞吐效率提升。高性能通常意味着高成本和高延迟,迎来“量大管饱”时代。仅5%的复杂任务需要使用高级模式。Agent即将告别Token焦虑,工具选择、 即日起,95%的日常任务通过千问办公标准模式即可完成,千问办公标准模式的单任务生成速度提升约100%, 以及千问办公与模型的双向优化,所有用户可通过全新的标准模式体验Qwen3.8-Flash。Agent与模型的深度协同优化,在真实办公场景测试中,正在打破性能、千问办公的模型供给将只有标准和高级两种模式,成本和速度的“不可能三角”。 在真实AI应用场景, |