抱抱脸模型TOP榜,我现在只服yuxinlu1
杀进一众大厂中间
正文摘录
一位个人开发者,竟然在一众大厂中,杀进了抱抱脸 Models Trending 榜的前排?! 第二是百度的无限 OCR,最近悄悄开源的,一口气能解析 40 多页文档,下载量也来到了 7 万。 再一看下载量——最新数据已高达 20.7 万 和 53.6 万 。好家伙,这是什么神仙模型来了? 甚至在此前一周,这位个人开发者的模型一度霸榜抱抱脸,力压 GLM-5.2 一头,连智谱负责人都在 X 上公开推荐: 也就是说,在智谱、百度、Qwen、NVIDIA…这些名字中间,一个个人开发者账号硬生生挤进了 TOP,而且下载量还这么高。 比如智谱 GLM-5.2,753B 超大参数,国产明星大模型;百度 Unlimited-OCR,踩中了最近很火的 OCR 和文档理解方向。 再往下还有 Qwen 的 AgentWorld、英伟达的 LocateAnything、微软的 FastContext。 国产开源大模型的熟面孔也都在列:MiniMax M3、Kimi-K2.7-Code、DeepSeek-V4-Pro。 图像生成方向也有 Krea,新模型 Krea-2-Turbo 和 Krea-2-Raw 都在榜上。 仔细一看,这两个新模型,主要把 Fable 5 的编程推理能力,蒸进了一个本地能跑的 Gemma4-12B 小模型里。 4.5GB 显存就能跑,本地、离线、零 API 成本。普通玩家一张消费级显卡,甚至一台带统一内存的 Mac,就能把它跑起来。 据模型卡,它的训练数据是“可验证”的代码推理:每条思维链对应的代码,都得真跑过测试、通过了才留下。 教师数据主要来自 Cursor 的 Composer 2.5 ,外加 Fable 5 ——Composer 2.5 做错的题,会交给 Fable 5 重新推一遍,生成新的推理链和正确代码。