华东师大智金院发布金融基模Mint-Agent 商业订单超亿元
金融AI不只是能答,还要能做完并接受审查;Mint-Agent用更小模型和更低成本在金融任务上超过了顶级通用模型。
华东师大智金院发布金融原生智能体基模Mint-Agent(一种能自主搜索、计算并给出可审计结论的金融AI模型)。27B版在金融智能体评测FinanceAgentBench v2上得分60.49%,超过GPT-5.6和Claude Opus 4.8,单题推理成本仅为后两者的约22%和10%。商业订单已超亿元。
正文摘录
华师大智金院孵化金融原生基模 Mint-Agent:超越 GPT-5.6 与 Claude Opus 4.8,商业订单已超亿元 .jpg) 由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上, 27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。与此同时,Mint-Agent 商业订单已超亿元,开始从模型能力验证进入规模化金融场景验证阶段。  图 1|Mint-Agent 在六项核心金融评测中的表现。上排考察有界金融推理与可靠性,下排考察开放环境中的搜索、工具调用与长程执行;FinanceAgentBench v2 为三次运行均值。