xAI xAI Tier: Follows clear tasks Russia access: VPN

Grok 4.3

Open Grok 4.3 → VPN required
Сам вендор советует взять другую версию – и он прав
xAI Grok 4.3
score 7.1 $0.01 per task VPN required

Grok 4.3 стоит столько же, сколько GPT-5.4 Nano ($1.25 за миллион токенов), но статистически наравне с ним по местам (кластер 29–35) и заблокирован в России. Единственный сценарий, где он выигрывает у прямого конкурента по цене – его просто нет.

Overall rank
#29–35 of 47
on par with GLM 5.1, Gemini 3.1 Pro
Overall score
7.1/10
Cost per task
$0.007
$1.25 / $2.50 · per 1M tokens · ≈ 750 pages
Tested
05.2026
80 scenarios · 2 AI judges

Profile across 8 categories

0–10 scale. Higher means the model handled those tasks better

chart
Strong at Analysis & Decisions 7.8/10
Weak at Regional Awareness 6.0/10

Similar models

Closest alternatives – by level, availability and price.

Price vs level

Where this model sits versus the rest: higher is stronger, further left is cheaper.

Best for
  • + Стратегические брифы для международных команд без российской юрисдикции: структурирует риски лучше, чем набрасывает цифры
  • + Скрипты для сложных разговоров с сотрудниками – оценка за управление командой приличная, если не нужны конкретные сроки внедрения
  • + Дорожные карты в формате «концепция без деталей» – когда вы сами заполните операционные пробелы
Not for
  • Любая работа с российским и казахстанским законодательством: неверные статьи, устаревшие штрафы, ошибочные налоговые ставки – региональная специфика 6.01/10
  • Задачи, где нужен готовый код или финансовая модель: выдаёт скелет вместо рабочего решения и грубые оценки вместо расчётов
  • Пользователи из России – модель заблокирована, а при той же цене GPT-5.4 Nano доступен и статистически наравне по местам (29–35)
Benchmark task – run and compare
Analysis & Decisions – 7.76/10

This is a real prompt from our benchmark. Hit "Run" – the model answers right here so you can compare with the competitor.

You
Я могу инвестировать 80 000 долларов в автоматизацию [процесса: например, "процесс ежемесячной отчетности"]. Что я знаю: - Текущий процесс занимает 3 человека × 2 дня/месяц = 48 часов/месяц - Автоматизация сократит это до 4 часов/месяц (заявление вендора, не проверено) - Внедрение займет 3 месяца и потребует 20% времени одного разработчика - Риск: Процесс может измениться при следующей реорганизации (по слухам, через 6-12 месяцев) - Команда скептически настроена после неудачного проекта автоматизации в прошлом году Чего я не знаю: - Точная экономия времени (заявления вендоров разнятся) - Скрытые затраты на обслуживание - Влияние на качество данных - Будет ли процесс существовать после реорганизации Пожалуйста: 1. Порекомендуй, стоит ли инвестировать, и если да, то при каких условиях. 2. Предложи, как структурировать пилотный или поэтапный подход. 3. Определи точку безубыточности и срок окупаемости. 4. Порекомендуй, как управлять скептицизмом команды. 5. Предложи критерии принятия решения для раннего закрытия проекта, если он не работает.
Comparing:
grok-4.3 · step-3.7-flash

Same model – two results

experiment, 1,700 runs
Typical prompt

Выручка упала на 18%, трафик вырос на 12%, средний чек снизился с 8700 до 6200. Что происходит и что делать?

6.8 /10
Structured prompt

...Формат:

  • § Диагноз (2-3 предложения)
  • § Корневые причины (что + почему + данные)
  • § Рекомендации (действие, результат в цифрах, срок, ответственный)
  • § Чего я не знаю
8.6 /10 +24%

A naive prompt gets generic advice. A structured one – causal analysis with numbers and deadlines.

About this experiment →

Category breakdown

Russia availability

VPN or proxy required

Warning: regional specifics

Критический изъян для работы с российской спецификой: судьи зафиксировали ошибки в статьях ТК РФ, неверные налоговые ставки и устаревшие штрафы. Использовать для юридических или кадровых вопросов в российской юрисдикции нельзя.

Related articles

Data analysis isn't about the model

The prompt determines 70% of the result. The Analysis & Decisions with AI module has 6 analysis frameworks with ready-to-use prompts: from revenue diagnostics to root cause analysis.

See the frameworks →