Naar hoofdinhoud
David Loor
Over MijDienstenProjectenBlogContact
←Terug naar Blog

#gemma

1 artikelen met de tag gemma.

Gevonden 1 bericht
2026-06-08
13 min read

Lokale Gemma was te traag met AIdaemon totdat ik llama.cpp en de promptgrootte heb aangepast

Ik wilde AIdaemon op lokale Gemma 4 26B via llama.cpp, niet Ollama. Generatie draaide op ~45 tok/s op een M4 Pro. Agent-beurten voelden nog steeds vastgelopen omdat prefill op 14k-token prompts 8 tot 9 seconden duurde voordat het model een enkel woord schreef.

aisoftware-developmentopen-source

Blijf Op de Hoogte

Ontvang de nieuwste berichten en inzichten rechtstreeks in uw inbox.

Geen spam. Altijd uitschrijfbaar.

Archief
  • Lokale Gemma was te traag met AIdaemon totdat ik llama.cpp en de promptgrootte heb aangepast
David Loor

AI, Cloud & Web Solutions Architect

Over MijDienstenProjectenBlogBoekenplank

© 2026 David Loor. Alle rechten voorbehouden.

david@davidloor.com