Ответы считаются на серверах разработчика, а ноутбук выступает только окном, через которое вы отправляете текст.
Причина первая: сама модель слишком большая для домашней техники. Старшие версии DeepSeek насчитывают сотни миллиардов параметров, и чтобы просто разместить их в памяти, нужны десятки специализированных видеокарт. Восемь гигабайт оперативной памяти в этой картине не участвуют вообще, поэтому ноутбук и не греется.
Причина вторая: устройство модели. Она построена на архитектуре трансформера с подходом mixture of experts, то есть на каждое слово включается не вся сеть, а небольшая её доля. Это заметно удешевляет один ответ, но не превращает модель в программу, которая поместится на диск рядом с браузером.
Причина третья: деньги. Бесплатность объясняется не отсутствием затрат, а стратегией: компания выросла из инвестиционного фонда, вычислительные мощности у неё свои, а открытые веса и бесплатный чат работают на известность. Платная часть живёт в интерфейсе для разработчиков, где оплата идёт за объём текста.
Отдельно про офлайн. Веса моделей выложены открыто, и уменьшенные версии действительно запускаются дома через Ollama или LM Studio, тогда интернет не нужен. Но такая модель насчитывает единицы миллиардов параметров и отвечает заметно проще той, что работает в приложении. Если у вас на ноутбуке что-то отвечает без сети, это именно она, а не полноценный DeepSeek.
Лучший ответ
v4-flash
v4-flash
Deepseek на чем работает?
Что это такое Большая языковая модель на архитектуре трансформера. Особенность семейства — mixture of experts: суммарно параметров сотни миллиардов, но на каждый токен активируется лишь малая их часть, поэтому один ответ обходится дешевле, чем у плотной модели того же размера.
Где идут вычисления Когда вы пишете в приложение или на сайт, всё считается на серверах разработчика, на видеокартах. Ноутбук отправляет текст и принимает ответ, объём его оперативной памяти роли не играет.
Про работу без интернета Веса выложены открыто, и уменьшенные версии запускаются локально через Ollama или LM Studio. Важно: это дистиллированные модели на несколько миллиардов параметров, а не та, что отвечает в приложении. Только такой вариант работает офлайн, и качество у него ниже.