Qwopus3.6-35B-A3B-v1模型已发布,附链接。
大家好,又见面了!我们最新的Qwopus3.6-35B-A3B-v1现已上线,再次令人叹为观止!完整的HF space基准测试展示和说明在评论区,大家可以自行得出结论!GGUF链接如下。我们在这次训练中解决了一些问题,因为使用了更复杂的流程,所以耗时较长,但完全值得!这个模型性能媲美显著更大的模型,开箱即用,在单张5090上运行速度可达162tps。在我看来,其Web前端能力超过了基础Qwen 3.6 27B。在完全相同的提示下,该模型能一次性生成更完整的网页。它更冗长,但对于这类工作来说是好事。与基础35B相比,思考效率似乎也有所提升,且没有牺牲输出质量或深度,这太不可思议了!当提示要求深度时,它会思考得更仔细,输出质量也相应提高,而不会像基础模型那样连简单答案都要等半天。VRAM较少的用户可以通过部分卸载到系统RAM以非常实用的速度运行,性能与基础27B密集版本相当甚至更好。因此,如果你无法将27B放入GPU,这款模型在卸载后能提供更强的能力和速度。或者,如果你能容纳27B,这款模型似乎以超过3倍的速度表现更好!我真心相信,在Q5_K_M量化下,Qwopus3.6-35B-A3B-v1是目前消费级硬件上最强的一次性前端和推理模型之一!非常期待看到大家的作品!期待听到你们的反馈!请进行全面基准测试,并告知你可能发现的任何特性!我洗耳恭听,新的27B正在训练中,很快完成!https://t.co/K4TSqooGLr