跳到正文
原文
Mozilla Hacks· Stephen Hood·· 2024-04-25精选AI 评分76

llamafile 发布 v0.8,强化本地大模型运行性能

Llamafile’s progress, four months in

AI 导读

Mozilla 发布 llamafile v0.8,支持更多开放模型,并通过 tinyBLAS 为 NVIDIA 和 AMD GPU 加速本地推理。该版本新增 84 个矩阵乘法内核,使提示词评估性能较此前提升 10 倍;项目还优化了 Raspberry Pi 5,并支持单条命令生成 llamafile。

推荐理由

v0.8 聚焦本地模型运行体验,tinyBLAS 简化 NVIDIA 与 AMD GPU 加速,84 个矩阵乘法内核将提示词评估性能提升 10 倍,并同步支持新模型。

来源:Mozilla Hacks · hacks.mozilla.org