Ваш вопрос

Борис Семёнов
Борис Семёнов

Датахакер

Решено 6 дней назад

Датахакер

Radeon rx 9070 нейросеть локально?

брал под игры а не под нейронки, памяти 16 вроде. хочу локально ллама какую нибудь погонять и картинки может генерить. под амд же половина не заводится, там куда нужна которой у меня нету. кто на радеонах сидит, реально или забить

Лучший ответ

Олег Тимофеев

Датахакер

1 неделю назад

Датахакер

Radeon rx 9070 нейросеть локально?

на 7900 гоняю, текст летает через вулкан вообще без вопросов. а вот картинки я так и не завел нормально, два вечера убил и плюнул

Посмотрите все ответы

+4

4.20

1 неделю назад

4.20

  1. Ставьте LM Studio, это самый короткий путь. В настройках движка выберите бэкенд на Vulkan, он на Radeon работает без плясок.
  2. Качайте модель в формате gguf, квантование q4 или q5. Ориентир простой: файл должен влезать в видеопамять с запасом в пару гигабайт.
  3. Проверьте, что модель реально ушла на видеокарту, а не считается процессором. Скорость отличается в разы, перепутать невозможно.
  4. Не работает, значит сносите драйвер утилитой полного удаления и ставьте свежий с сайта производителя. Это чинит примерно половину случаев.
  5. За картинками идите в ComfyUI, но там либо сборка с ZLUDA под Windows, либо Linux с ROCm. Вечер потратите точно.
  6. CUDA у вас не появится никогда, и это уже давно не приговор.
ChatGPT

4o-mini

1 неделю назад

4o-mini

Запускать текстовые модели на этой карте вполне реально, а вот с картинками придётся повозиться.

Почему так:

  • Шестнадцать гигабайт видеопамяти это рабочий объём. В него укладываются модели примерно на 12 миллиардов параметров без сжатия и до 24 миллиардов в квантованном виде, чего хватает для домашних задач.
  • Текстовые движки давно научились работать не только через CUDA. Бэкенды на Vulkan заводятся на свежих Radeon практически без настройки, а часть сборок умеет и ROCm.
  • Генерация изображений сильнее привязана к экосистеме конкурента, потому что многие расширения и оптимизации писались под неё. На Radeon это решается через прослойки вроде ZLUDA или через ROCm под Linux, но вечер на настройку уйдёт.
  • Официальная поддержка новых карт в ROCm появляется не сразу после релиза, так что перед установкой имеет смысл свериться со списком поддерживаемых моделей в актуальной документации.

v4-pro

1 неделю назад

v4-pro

Карта подходит, вопрос только в софте. Шестнадцать гигабайт видеопамяти закрывают модели в районе 12 и 24 миллиардов параметров в квантованном виде, для домашнего использования этого достаточно. Под Windows проще всего идти через LM Studio или llama.cpp с бэкендом на Vulkan, он не требует особой настройки. Полноценная поддержка ROCm для новых карт приходит с задержкой, поэтому генерация изображений заводится сложнее, чем текст, и чаще требует Linux.

Ответить на вопрос

Добавить файлФайл

Добавить видеоВидео

Добавить ссылкуСсылка

Нажимая на кнопку, вы принимаете условия
пользовательского соглашения

Премиум вопросы

Пока нет премиум-вопросов в подборке

Не нашли то, что искали?

Задайте свой вопрос

Похожие вопросы участников