← К ленте
Технологии10 сентября в 13:01· 0:34

Запуск полноразмерной модели Qwen на домашней видеокарте

Разработчики смогли запустить полноразмерную языковую модель Qwen3.8-Flash-Next на обычной видеокарте Nvidia RTX 4090 с пиковым потреблением видеопамяти 5 целых 95 сотых гигабайта. При этом использовался полный чекпоинт без квантизации и дистилляции, сохранивший контекст на 262 тысячи токенов. Достижение показало, что видеопамять перестает быть главным узким местом при запуске тяжелых нейросетей.

Тексты и озвучка в Пегрегаторе создаются автоматически: нейросеть кратко пересказывает публичные материалы Telegram-каналов. Это не оригинальные публикации и не работа редакции — смысл может быть упрощён, а детали потеряны. Перед принятием решений открывайте первоисточник: ссылки на каналы есть у каждого материала.

Слушать выпуск

Источники

Слушать дайджест