Пользователи r/LocalLLaMA сообщают, что после свежих коммитов в llama.cpp нарушилась работа chat-template для старых DSv4 GGUFs — перестало корректно обрабатываться preserve_thinking. Проблема уже исправлена в актуальных коммитах, но владельцам старых GGUF-файлов нужно обновить шаблон в конфиге вручную.
Без корректного шаблона модель теряет способность к связной цепочке рассуждений. Проблема затрагивает тысячи пользователей, запускающих DeepSeek V4 локально.