deniom3
(Deniom)
1
Для любителей пострадать тут на днях вышла gemma4 12B сегодня появилась MTP версии на 4070ti 12Gb vram получилось 110-120токенов
Параметры запуска:
.\llama-server -m C:/Users/denio/.cache/lm-studio/models/unsloth/gemma-4-12B-it-qat-GGUF/gemma-4-12B-it-qat-UD-Q4_K_XL.gguf --host 192.168.0.102 --port 8080 --spec-draft-model C:/Users/denio/.cache/lm-studio/models/unsloth/gemma-4-12B-it-qat-GGUF/gemma-4-12B-it-Q8_0-MTP.gguf --spec-type draft-mtp --spec-draft-n-max 4 -fitt 1024 --cache-type-k q4_0 --cache-type-v q4_0 -np 1 -fa 1 --alias “gemma-4-12B” -c 131072
С агентами не пробовал пока новую версию но из наблюдейний были проблемы с инструментами в опенкод вчера
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
3
Ну для агента хз я хочу в опенкод юзать
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
4
Гемма что бы писала код а облачная модель ставила задачи и проверяла
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
5
deniom3
(Deniom)
6
Но это походу только для чистой версии от гугл
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
8
Ну вчера она мне все таки накодила даже не мтп версия но тогда было 50-60 токенов всего
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
9
Но были проблемы с едит и контекстом
Оригинал в Telegram · @deniom3
deniom3
(Deniom)
11
Может но не супер стабильно… По крайней мере в опен код путается переодически. Квен 35б стабильней хоть и всего 35-40 токенов
Оригинал в Telegram · @deniom3