AI圈报
模型发布 / 更新精选

Ling-2.6-flash 发布:更快响应、更强执行、更高 Token Efficiency

信息来源:蚂蚁百灵:Developer Blog(网页)·

内容摘要

针对智能体任务中Token消耗快速增长的问题,Ling-2.6-flash模型正式发布。该模型采用混合线性架构等技术进行系统性优化,旨在实现更高推理效率和更低使用成本。其推理速度在4卡H20条件下最快可达340 tokens/s,在Artificial Analysis评测中仅消耗约对比模型1/10的Tokens。模型在多个Agent相关基准测试中达到同尺寸SOTA水平,保持了强大的任务执行与工具调用能力。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源蚂蚁百灵:Developer Blog(网页)
站内情报编号intel-50cc1356d6edd729f3d9ea41