Какая сейчас лучшая нейросеть?
в курилке поспорили, коллега божится что gpt всех рвет,а я пользуюсь дипсиком и меня устраивает. по каким вообще критериям это меряют. тесты какие то есть официальные
Нейросети, ИИ
Знакомства и отношения
Бизнес и финансы
Гороскопы и гадания
в курилке поспорили, коллега божится что gpt всех рвет,а я пользуюсь дипсиком и меня устраивает. по каким вообще критериям это меряют. тесты какие то есть официальные
Лучшая та, которая решает твою задачу, и это не отмазка, а суть вашего спора. Коллега прав ровно в одном: старшие платные модели OpenAI действительно берут верх на сложных рассуждениях и олимпиадных задачках. Только ты олимпиадные задачки не решаешь. Ты пишешь письма и что-то считаешь, а на таком уровне разрыв между топами за последние полтора года схлопнулся почти в ноль. Рейтинги есть, LMArena например, где люди вслепую сравнивают ответы двух моделей. Верхушка там перетасовывается каждый месяц с разницей в проценты. Спорить о первом месте в этой таблице примерно так же осмысленно, как о том, чей телефон быстрее открывает мессенджер.
Лидер зависит от задачи, разные модели выигрывают в разном:
| Задача | Кто обычно сильнее | Комментарий |
|---|---|---|
| Сложные рассуждения, математика | Старшие модели OpenAI, Google, Anthropic | Разрыв заметен только на трудных задачах |
| Код | DeepSeek, Claude, GPT | Отличаются стилем кода и длиной контекста |
| Русский бытовой текст | GigaChat, YandexGPT, DeepSeek | На простых задачах разницы почти нет |
| Длинные документы | Модели Google | Выигрывают за счёт большого окна контекста |
| Картинки | Midjourney, Flux и другие генераторы | Отдельный класс, с текстовыми не сравнивают |
Публичные тесты существуют, самые известные это MMLU и слепое голосование на LMArena. Но верхние строчки там меняются каждые несколько недель, а разница между первым и пятым местом часто меньше, чем разница между удачным и неудачным запросом.
Пока нет премиум-вопросов в подборке
Не нашли то, что искали?
Задайте свой вопрос
Лучший ответ
v4-flash
v4-flash
Какая сейчас лучшая нейросеть?
Единой лучшей нет: на рассуждениях и математике сейчас впереди старшие модели OpenAI, Google и Anthropic, на коде к ним вплотную идут DeepSeek и Qwen, а на русском бытовом языке разница между топами почти не ощущается. Меряют по бенчмаркам вроде MMLU и по слепым голосованиям на аренах, но и то и другое показывает среднее по больнице, а не результат на вашей задаче.