动态

Fireworks AI 发布 RFT Beta,用于训练和拥有专家开放模型

Fireworks AI 发布 RFT Beta,用于训练和拥有专家开放模型
Lin Qiao
🔥 第1/7天——启动强化微调 🔥

今天我们正式启动 Fireworks AI 上的强化微调(RFT)Beta 版——一种简单、可扩展的方式来训练和拥有你的专家开放模型。在这一方向上,产品与模型协同设计将成为未来的常态。

你只需指定一个对输出进行评分的评估函数,并提供少量示例,即可运行 RFT 训练,无需任何基础设施设置,并可无缝部署到生产环境。
💡 使用 RFT,我们的用户已经实现了:
→ 匹配或超越 GPT-4o mini 和 Gemini flash 等封闭前沿模型的质量
→ 响应时间提升 10 倍到 40 倍
→ 涵盖客服、代码生成和创意写作等用例

它专为迭代速度而设计,具备:
✅ 用于交互式开发的 Web IDE
✅ 用于快速上手的 OSS reward-kit
✅ 最先进的模型——Llama、Qwen、Phi、DeepSeek 等
✅ 即日起可自助使用
✅ 未来两周免费!

用例包括:
→ 带函数调用的智能体推理
→ 干净快速编译的代码修复
→ 创意写作
→ 数学问题求解

立即开始使用,或联系我们训练用于生产环境的大型模型!
动态Lin Qiao2025-06-09原文

相关内容