返回首页
一周热榜
为语音助手整理了一个全面的开源测试套件。您可以在以下链接查看,包括当前的排行榜:https://git.cicero.sh/aquila/ha-voice-test-suite
测试是可重复的,并提供了清晰的说明,指导您如何在自己的机器上运行它们。
我只有一块4GB显存的GPU,因此只能测试像Qwen3 4B Instruct这样的小型大语言模型。目前正在运行Gemma 4,但速度非常慢,可能还需要24到48小时才能完成。
我尝试过像Claude Sonnet 5和Grok 4.5这样的云模型,但每次都受到速率限制,感到厌烦所以放弃了。也许有其他人比我更频繁地使用AI,并且有合适的速率限制,愿意在一些前沿模型上运行测试套件,我相信大家会很欣赏看到这些结果。我已经很有信心它们会在60到90分钟的测试中获得低90分的成绩,所以对此并不太担心。
如果有人有更大的GPU,并愿意在更大的20B+本地大语言模型上试试,那就太好了。对任何模型运行测试都相当简单,说明在自述文件中。
祝您愉快!