蚂蚁百灵发布 Ling-3.0-flash,定位高效执行轻量模型
蚂蚁百灵Ling-3.0-flash用1/8总参数对标旗舰模型,转向提升“智能密度”,专为Agent长程工作流设计。
蚂蚁百灵发布Ling-3.0-flash模型,总参数量124B,激活参数5.1B,强调快速响应与稳定工具调用,旨在以更低成本承担Agent系统中的执行工作,实现“智以密胜”。
正文摘录
少即是多,这次轮到大模型来证明 编辑|Panda、+0 每逢重要的新模型发布,我们编辑部通常比新闻本身更早进入工作状态:提前打开官网、直播和社交媒体,等结果陆续出来,大家一边热火朝天地开始写文章,一边梳理参数、榜单和演示案例,判断这一次技术究竟向前走了多远。 这套流程已经相当熟练,大模型行业似乎也形成了一种默认的审美:更多的参数,更长的上下文,更复杂的推理,以及越来越接近「全能」的能力清单。 但设计圈有一句经典名言: Less is More 。它强调设计要保持克制,知道哪里应该保留,哪里可以舍弃。 模型或许也一样。看发布会久了,我们很容易把注意力全部放在能力上限上,仿佛我们每天上班遇到的最大困难,是办公室里缺少一位能够证明黎曼猜想的同事。 其实,大多数工作并不涉及人类文明的终极命运。它们只是数量很多、过程重复、要求明确,同时又有一套复杂的流程。这种时候我们需要的往往是一个反应够快、听得懂话、能够稳定使用的工具。 7 月 24 日,蚂蚁集团旗下百灵大模型发布的最新模型 Ling-3.0-flash ,正是沿着这一思路设计的。它是一款面向 Agent 长程工作流的 Flash 模型,总参数量为 124B、激活参数量为 5.1B,强调快速响应、稳定调用工具,以及适合高频使用的可控成本。上下文方面,Ling-3.0-flash 原生支持 256K,可扩展至 1M,并能在长输入下保持较高召回率。