Перейти к основному содержимому
David Loor
Обо мнеУслугиПроектыБлогКонтакты
←Вернуться в блог

#gemma

1 статей с тегом gemma.

Найдено 1 пост
2026-06-08
13 min read

Локальная Gemma была слишком медленной с AIdaemon, пока я не исправил llama.cpp и размер промпта

Я хотел использовать AIdaemon с локальной Gemma 4 26B через llama.cpp, а не Ollama. Генерация работала со скоростью ~45 токенов/с на M4 Pro. Взаимодействие с агентом всё ещё казалось заторможенным, потому что предварительное заполнение промптов размером 14k токенов занимало от 8 до 9 секунд, прежде чем модель написала хотя бы одно слово.

aisoftware-developmentopen-source

Будьте в курсе

Получайте последние посты и аналитику на вашу почту.

Без спама. Отписаться можно в любое время.

Архив
  • Локальная Gemma была слишком медленной с AIdaemon, пока я не исправил llama.cpp и размер промпта
David Loor

Архитектор решений в области AI, Cloud и Web

Обо мнеУслугиПроектыБлогКнижная полка

© 2026 David Loor. Все права защищены.

david@davidloor.com