跳到主要内容
David Loor
关于服务项目博客联系方式
←返回博客

#gemma

带有 gemma 标签的文章共 1 篇。

找到 1 篇文章
2026-06-08
13 min read

本地 Gemma 在 AIdaemon 上运行缓慢,直到我修复了 llama.cpp 和提示词大小

我想在本地 Gemma 4 26B 上通过 llama.cpp 运行 AIdaemon,而不是 Ollama。在 M4 Pro 上,生成速度约为 45 token/s。由于 14k token 的提示词预填充需要 8 到 9 秒才能让模型写出第一个字,代理回合仍然感觉很卡顿。

aisoftware-developmentopen-source

保持更新

将最新文章和见解发送到您的收件箱。

不发送垃圾邮件,可随时退订。

归档
  • 本地 Gemma 在 AIdaemon 上运行缓慢,直到我修复了 llama.cpp 和提示词大小
David Loor

AI、云和 Web 解决方案架构师

关于服务项目博客书架

© 2026 David Loor。保留所有权利。

david@davidloor.com