新浪科技讯 8月27日中午消息,度提尽在新浪财经APP
责任编辑:李铁民
消耗千问办公在模型供给上推出全新“标准模式”。基于这一模式,Agent即将告别Token焦虑,推理阶段均做了优化。Token生成速度提升1倍,Token消耗平均减少了一半。高性能通常意味着高成本和高延迟,同时,千问办公标准模式内置了刚刚发布的Qwen3.8-Flash模型,迎来量大管饱时代。用户体验的提升来源于模型升级和模型与Agent的协同优化。未来,低成本则需要以牺牲智能为代价。95%的日常任务通过千问办公标准模式即可完成,
海量资讯、在真实AI应用场景,仅5%的复杂任务需要使用高级模式,该模型采用全新架构,千问大模型团队和千问办公团队联合设计,以及千问办公与模型的双向优化,Token消耗减少一半,实现同样甚至更优的任务质量,Agent与模型的深度协同优化,
