Новая нейросеть Маска Grok 4: обзор, возможности и сравнение с конкурентами

Подробный обзор нейросети Grok 4 от Илона Маска: характеристики, бенчмарки, мультимодальность, генерация изображений, стоимость и сравнение с ChatGPT и Claude. Узнайте, где попробовать Grok 4 и для каких задач он подходит лучше всего.

Что такое Grok 4 и чем он отличается от предшественников

Grok 4 — это флагманская языковая модель компании xAI, основанной Илоном Маском. Выпущенная в июле 2025 года, она позиционируется как «самая умная модель в мире» с «непревзойдённой производительностью в языке, математике и рассуждениях». По словам Маска, Grok 4 превосходит многих обладателей PhD в сложных тестах.

Основное отличие от Grok 3 — масштабирование вычислительных ресурсов. Если предыдущая версия обучалась на кластере из десятков тысяч GPU, то для Grok 4 использовался кластер Colossus из 200 000 GPU, с планами расширения до миллиона. Это позволило в ~6 раз повысить эффективность обучения и существенно расширить набор данных.

Важное нововведение — контекстное окно увеличено до 256 000 токенов, что вдвое больше, чем у Grok 3. Это позволяет анализировать очень большие тексты за один запрос или поддерживать длинные диалоги без потери фокуса. Для сравнения: у DeepSeek V3/R1 и ChatGPT 4o лимит составляет 128 000 токенов, у o3, o4 mini и Claude 4 — 200 000 токенов.

Также в Grok 4 усилены защитные механизмы. Предыдущая версия была отключена за день до анонса из-за выдачи экстремистских высказываний при автономной работе в соцсети X. Разработчики обещают сохранение открытого диалога при более строгих фильтрах.

Архитектура и обучение: почему Grok 4 считают прорывом

Grok 4 в целом следует классической архитектуре трансформеров, но с упором на продвинутую логику и гибкость. Основной прирост качества обеспечен не революционным новым алгоритмом, а масштабированием ресурсов и Reinforcement Learning (RL)-файнтюнингом на огромном вычислительном кластере.

Ключевая особенность — система Grok 4 Heavy, которая создаёт почти вдвое больше шагов рассуждения с помощью четырёх параллельных агентов. Несколько внутренних моделей генерируют ответы одновременно, выбирая наилучший. Это повышает надёжность и точность итоговых ответов, особенно в сложных задачах.

Обучение проходило на кластере Colossus из 200 000 GPU. Каждая новая версия (Grok 2, Grok 3, Grok 4) требовала примерно в 10 раз больше GPU-вычислений, чем предыдущая. Набор данных существенно расширен, а инфраструктура и алгоритмы сделали процесс в ~6 раз более эффективным.

В Grok 4 также реализована голосовая ассистентка по имени «Ева» (доступна в Heavy-версии) и новый мультимодальный «аниме-ассистент» «Ани», который отвечает за генерацию изображений, работу с веб-камерой и микрофоном.

Мультимодальность и работа с файлами: что умеет Grok 4

Grok 4 может одновременно работать с текстовыми промптами, файлами разных форматов (код, текстовые файлы, таблицы, презентации) и изображениями (JPEG, PNG). Однако он далёк от полноценной мультимодальности вроде ChatGPT 4o или Claude 4: модель преимущественно текстовая и в задачах видения уступает прямым конкурентам.

При анализе PDF-документов Grok 4 может путать номера страниц и объектов, испытывать сложности в определении типов диаграмм. Это касается именно работы с изображениями внутри документов, а не самого текста.

Встроенные функции включают нативный вызов инструментов по ходу диалога: калькуляторы, запуск кода в песочнице, веб-поиск и парсинг страниц, а также поиск постов в соцсети X. Это позволяет модели уточнять неизвестные факты на лету — отличное дополнение к датасету, построенному до 31 декабря 2024 года.

Генерация изображений осуществляется через «аниме-ассистента» «Ани». Результаты пока неидеальны: пользователи отмечают шестиногих лошадей, неправильно подобранные доспехи и анахронизмы. Стилистика тяготеет к «голливудской» — большие пушистые наплечники, исторически неточные детали. Тем не менее, для быстрых визуальных идей инструмент может быть полезен.

Результаты в бенчмарках: математика, кодинг и «Последний экзамен человечества»

Grok 4 демонстрирует впечатляющие результаты в ключевых тестах. На новом эталоне Humanity’s Last Exam (HLE), который охватывает более 2500 вопросов из 100+ дисциплин, модель набрала 44,4% при включённых инструментах и 25,4% без них. Для сравнения: у Gemini 2.5 Pro без инструментов было всего 21,6%.

В «народном» рейтинге LMArena Grok 4 занимает 4-е место по суммарной оценке. Главное преимущество — математика (1-е место), а также разбор сложных промптов, кодинг и творческие задачи (2-е место).

На Artificial Analysis Grok 4 возглавляет таблицу с интеллектуальным индексом 73, против 71 и 70 у ближайших конкурентов (ChatGPT o3 pro, Gemini 2.5 Pro, o3, o4 mini high).

В математических и шахматных задачах модель показывает рекордные результаты (высокие баллы MATH, USAMO, HMMT). В бенчмарке кодинга LiveCodeBench Grok 4 — лучший в индустрии. В тесте GPQA Diamond (биология, физика, химия) модель набирает 88%.

Скорость вывода ответов — около 43,7 токена/с, что немного медленнее топовых моделей. Первый токен выводится в среднем через 15,07 секунды после отправки запроса.

Практические примеры использования: от кода до игр

Пользователи активно тестируют Grok 4 в реальных задачах. Разработчик Данни Лимансету создал прототип игры (слешер/RPG) всего за четыре часа: нейросеть сама написала код логики, нашла подходящие текстуры и 3D-модели с помощью веб-поиска.

Другой пример — визуализация чёрной дыры с помощью Three.js и шейдеров. Программы, сгенерированные Grok 4 и Claude Opus 4, оказались визуально очень похожи, но Claude добавил больше настроек отображения. Gemini 2.5 Pro показал менее впечатляющий результат.

Grok 4 также успешно создаёт 3D-шутеры, беря текстуры из случайных примеров Three.js в интернете и самостоятельно добавляя их в игру. Один из пользователей создал «шестиугольное подобие» Minecraft с механикой постройки новых кубиков.

Илон Маск утверждает, что Grok 4 превосходит ИИ-копилотов вроде Cursor: «Вы можете скопировать и вставить исходник в поле запроса — и Grok 4 исправит его для вас!». Он также пообещал специальную кодинг-модель, которая выйдет через несколько недель после релиза Grok 4.

В SMM и контент-маркетинге Grok 4 показывает отличные результаты благодаря доступу к данным X в реальном времени и неформальному стилю общения. Модель понимает мемную культуру, может использовать иронию и шутки, что идеально для постов в Telegram, VK и других соцсетях.

Сравнение с конкурентами: Grok 4 vs ChatGPT vs Claude

Grok 4 имеет уникальное преимущество — нативную интеграцию с X (Twitter), что позволяет использовать данные из социальной сети в реальном времени. ChatGPT и Claude не имеют такого доступа.

По критериям:

  • Веб-доступ и актуальность: Grok 4 — реальное время (X), ChatGPT — есть, Claude — нет.
  • SMM и посты в соцсетях: Grok 4 — ★★★★★, ChatGPT — ★★★★, Claude — ★★★★.
  • SEO-тексты и статьи: Grok 4 — ★★★, ChatGPT — ★★★★★, Claude — ★★★★.
  • Творческое письмо: Grok 4 — ★★★★, ChatGPT — ★★★★, Claude — ★★★★★.
  • Деловой контент: Grok 4 — ★★★, ChatGPT — ★★★★, Claude — ★★★★★.

Grok 4 лучше всего подходит для:

  • Постов в Telegram, VK, TikTok
  • Новостного контента и комментариев на события
  • SMM и социального медиа-контента
  • Контента про актуальные тренды
  • Анализа текущих событий в соцсетях

Не лучший выбор для:

  • Деловой документации (лучше Claude)
  • SEO-статей для сайтов (лучше ChatGPT)
  • Технических инструкций (лучше DeepSeek)

ChatGPT 5 остаётся лидером для SEO-текстов и структурированного контента, Claude 4.5 Sonnet — для творческого письма и делового контента.

Стоимость, тарифы и где попробовать Grok 4

Grok 4 доступен по подписке. В сервисе Нейрочат, который предоставляет доступ к 50+ нейросетям без VPN, стоимость начинается от 449 ₽/мес. В эту цену входят Grok 4, Grok 4 Fast и Grok 4.1 Fast, а также все остальные модели (ChatGPT, Claude, DeepSeek, Gemini, FLUX и другие).

Бесплатной версии Grok нет, но новые пользователи могут получить пробный доступ. Для тестирования можно использовать бесплатный GPT Free, а затем перейти на платный план.

Тарифы:

  • Пробный доступ: бесплатно (GPT Free)
  • Базовая подписка: от 449 ₽/мес — Grok 4 Fast и Grok 4.1 Fast, неограниченные запросы, + все остальные модели
  • Расширенная подписка: от 999 ₽/мес — все версии Grok + 50+ моделей, API доступ для разработчиков, приоритет, файлы до 100MB

Оплата принимается картами РФ и через СБП. В России Grok работает без VPN.

Для начала работы нужно зарегистрироваться на neirochat.io (30 секунд через email или Telegram), в левом меню выбрать раздел «Текст» и выбрать нужную версию Grok. Fast-версии быстрее для повседневных задач.

Ограничения и недостатки Grok 4

Несмотря на впечатляющие характеристики, Grok 4 имеет ряд ограничений:

  1. Мультимодальность: модель преимущественно текстовая. В задачах видения (анализ изображений, PDF) она уступает ChatGPT 4o и Claude 4. При работе с PDF может путать номера страниц и типы диаграмм.
  1. Генерация изображений: результаты пока неидеальны. Пользователи отмечают анатомические ошибки (шестиногие лошади), исторические неточности и «голливудскую» стилистику. Для серьёзных визуальных проектов лучше использовать Midjourney или DALL-E.
  1. Скорость вывода: 43,7 токена/с — медленнее топовых моделей. Первый токен выводится в среднем через 15 секунд после запроса.
  1. Неформальный стиль: Grok намеренно обучен на более свободное и менее формальное общение. Это плюс для SMM, но минус для консервативного B2B, деловой документации и официальных писем.
  1. Длинные аналитические материалы: модель хуже справляется с глубокими аналитическими статьями по сравнению с ChatGPT и Claude.
  1. Доступность: нет бесплатной версии, только платная подписка. Бесплатный пробный доступ ограничен.
  1. Зависимость от X: основное преимущество (доступ к данным X) одновременно является ограничением — если вы не используете X, многие уникальные функции теряют смысл.

Будущее Grok: что ожидать в следующих версиях

Илон Маск и команда xAI уже анонсировали планы по дальнейшему развитию. Ожидается расширение кластера Colossus до миллиона GPU, что позволит обучать ещё более мощные модели.

Следующие версии, вероятно, будут иметь:

  • Улучшенную мультимодальность (сравнимую с ChatGPT 4o)
  • Более высокую скорость вывода
  • Расширенное контекстное окно
  • Улучшенную генерацию изображений
  • Специализированные модели для кодинга (анонсирована отдельная кодинг-модель)

Также ожидается появление Grok 4.3 и Grok 4.5 с улучшенными характеристиками. Некоторые источники уже упоминают эти версии, но официальных анонсов пока нет.

В целом, Grok 4 — это серьёзный шаг вперёд для xAI, но до полного доминирования на рынке ещё далеко. Модель сильна в математике, логике и кодинге, но уступает в мультимодальности и генерации контента. Следующие версии должны устранить эти недостатки.

Вопросы и ответы

Что такое Grok 4 простыми словами?

Grok 4 — это нейросеть от компании xAI Илона Маска, которая умеет общаться в живом, неформальном стиле и имеет доступ к данным X (Twitter) в реальном времени. Она отлично решает сложные логические задачи, пишет код и помогает с контентом для соцсетей. Главное отличие от ChatGPT и Claude — интеграция с X и более свободный стиль общения.

Grok 4 лучше ChatGPT?

Зависит от задачи. Grok 4 лучше для:

  • Постов в соцсетях и SMM
  • Актуального контента с данными из X
  • Математики и логических задач
  • Кодинга (особенно сложные алгоритмы)

ChatGPT лучше для:

  • SEO-статей и структурированного контента
  • Деловой документации
  • Длинных аналитических материалов

Идеально — использовать оба инструмента под конкретную задачу.

Можно ли попробовать Grok 4 бесплатно?

Бесплатной версии Grok 4 нет. Однако новые пользователи сервиса Нейрочат могут получить пробный доступ. Для тестирования можно использовать бесплатный GPT Free, а затем перейти на платный план от 449 ₽/мес, который включает Grok 4, Grok 4 Fast и Grok 4.1 Fast.

Работает ли Grok 4 на русском языке?

Да, Grok 4 отлично понимает и генерирует русский текст. Особенно хорош для постов и неформального контента на русском языке. Может использовать мемы и культурные ссылки, релевантные русской интернет-культуре. В России модель работает без VPN.

Какие версии Grok существуют и чем отличаются?

Основные версии:

  • Grok 4 — полная версия для сложного анализа и глубоких рассуждений. Средняя скорость.
  • Grok 4 Fast — быстрая версия для повседневных задач и SMM. Очень быстрая.
  • Grok 4.1 Fast — новейшая быстрая версия с оптимальным балансом скорости и качества.
  • Grok 4 Heavy — версия с четырьмя параллельными агентами для максимальной точности (доступна в расширенной подписке).

Fast-версии рекомендуются для быстрых задач, полная версия — для сложного анализа.

Какие бенчмарки Grok 4 прошёл лучше всего?

Grok 4 показывает лучшие результаты в:

  • Математика: 1-е место в LMArena, рекордные баллы MATH, USAMO, HMMT
  • Кодинг: лучший в индустрии результат LiveCodeBench
  • Логика и рассуждения: 44,4% на Humanity's Last Exam (HLE)
  • GPQA Diamond: 88% (биология, физика, химия)
  • Общий интеллектуальный индекс: 73 на Artificial Analysis (против 71 у ChatGPT o3 pro)
Может ли Grok 4 генерировать изображения?

Да, через «аниме-ассистента» «Ани». Однако качество пока неидеально: пользователи отмечают анатомические ошибки (шестиногие лошади), исторические неточности и «голливудскую» стилистику. Для серьёзных визуальных проектов лучше использовать Midjourney, DALL-E или FLUX. Grok 4 пока уступает специализированным генераторам изображений.