Главная Контакты

Реклама

Опрос пользователей

Оцените работу движка


Календарь

«    Июль 2026    »
ПнВтСрЧтПтСбВс
 12345
6789101112
13141516171819
20212223242526
2728293031 

Как запустить локальную LLM на старой видяхе без боли?

Народ, столкнулся с проблемой. Хочу погонять локально Llama 3 на своей древней RTX 2060, но памяти катастрофически не хватает. Слышал, что есть какой-то хитрый софт для оптимизации квантования, типа kraken или аналогов, который ужимает веса чуть ли не в 2 бита без полной потери качества. Кто-нибудь пробовал подобные костыли?

Реально ли получить хоть 15 токенов в секунду или проще забить и копить на новую карту?

рабочее зеркало ЌРÁЌÉH

Популярные теги

Уважаемый посетитель, Вы зашли на сайт как незарегистрированный пользователь. Мы рекомендуем Вам зарегистрироваться либо войти на сайт под своим именем.
Разместил: Handmade_Queen

Добавление комментария

Ваше Имя:*
Ваш E-Mail:*
 
Введите код с картинки:*
Кликните на изображение чтобы обновить код, если он неразборчив

Новости партнёров