本地部署大模型吞吐量有限,规模化需用云API。
本地部署大模型,就算你显卡性能拉满,稳定每秒跑100Token,24小时不间断满载运行,一天满打满算也就跑出8.64M Token。
拿这点吞吐量去搞什么Agent自动化集群、海量合成数据或者大批量业务分析,简直是杯水车薪。本地部署图个数据隐私和自己折腾确实香,但真要搞规模化、高并发的大用量,还是得老老实实去调云端API。😂
拿这点吞吐量去搞什么Agent自动化集群、海量合成数据或者大批量业务分析,简直是杯水车薪。本地部署图个数据隐私和自己折腾确实香,但真要搞规模化、高并发的大用量,还是得老老实实去调云端API。😂