The Verge编辑启动本地AI实测项目,在Mac Studio上运行Hermes与Qwen模型,尝试摆脱云端服务处理个人数据。

测试选用参数规模达70亿的Qwen2.5模型,配合Hermes量化版本,推理延迟约120毫秒,全程无需联网。该编辑表示:“本地AI的隐私优势明显,但配置复杂度远超预期。”

70亿参数模型在Mac Studio上实现120毫秒推理延迟,表明消费级硬件已具备承载大语言模型的能力,AI大模型本地化部署门槛正在下降。

来源:权威科技媒体