Mistral AI Mistral AI Tier: Follows clear tasks Russia access: OpenRouter · VPN

Mistral Medium 3.5

Платишь в 20 раз дороже Gemma – получаешь ровно тот же балл
Mistral AI Mistral Medium 3.5
score 6.9 $0.04 per task OpenRouter · VPN

Mistral Medium 3.5 стоит $7.5 за миллион токенов на выходе, а рядом стоит Gemma 4 31B за $0.38 с идентичной оценкой 6.86/10. Модель умеет составлять психологически точные сценарии разговоров и управленческие фреймворки – но галлюцинирует в цифрах с пугающей уверенностью. Я бы брал её только для работы с текстом и структурой, не для фактов.

Overall rank
#36–42 of 47
on par with Grok 4.3, Step 3.7 Flash
Overall score
6.9/10
Cost per task
$0.036
$1.50 / $7.50 · per 1M tokens · ≈ 750 pages
Tested
05.2026
80 scenarios · 2 AI judges

Profile across 8 categories

0–10 scale. Higher means the model handled those tasks better

chart
Strong at Analysis & Decisions 7.5/10
Weak at Regional Awareness 5.7/10

Similar models

Closest alternatives – by level, availability and price.

Price vs level

Where this model sits versus the rest: higher is stronger, further left is cheaper.

Best for
  • + Подготовить сценарий сложного разговора с сотрудником – обратная связь, конфликт, увольнение: структура и психологическая точность выше среднего
  • + Сгенерировать шаблон отчёта, плана встречи или трекера задач, который сразу можно отдать команде – форматирование одно из лучших в своём ценовом диапазоне
  • + Диагностика проблемы в процессе без числовой проверки: «что идёт не так» модель формулирует чётко и по делу
Not for
  • Любой вопрос про налоги, трудовое законодательство или штрафы – модель называет несуществующие нормы с уверенностью эксперта
  • Финансовые расчёты и бюджеты: арифметика ненадёжна, итоговые цифры могут быть просто выдуманы
  • Поиск актуальных данных о рынке или конкурентах – выдаёт устаревшие факты без предупреждения об этом
Benchmark task – run and compare
Analysis & Decisions – 7.50/10

This is a real prompt from our benchmark. Hit "Run" – the model answers right here so you can compare with the competitor.

You
Я могу инвестировать 80 000 долларов в автоматизацию [процесса: например, "процесс ежемесячной отчетности"]. Что я знаю: - Текущий процесс занимает 3 человека × 2 дня/месяц = 48 часов/месяц - Автоматизация сократит это до 4 часов/месяц (заявление вендора, не проверено) - Внедрение займет 3 месяца и потребует 20% времени одного разработчика - Риск: Процесс может измениться при следующей реорганизации (по слухам, через 6-12 месяцев) - Команда скептически настроена после неудачного проекта автоматизации в прошлом году Чего я не знаю: - Точная экономия времени (заявления вендоров разнятся) - Скрытые затраты на обслуживание - Влияние на качество данных - Будет ли процесс существовать после реорганизации Пожалуйста: 1. Порекомендуй, стоит ли инвестировать, и если да, то при каких условиях. 2. Предложи, как структурировать пилотный или поэтапный подход. 3. Определи точку безубыточности и срок окупаемости. 4. Порекомендуй, как управлять скептицизмом команды. 5. Предложи критерии принятия решения для раннего закрытия проекта, если он не работает.
Comparing:
mistral-medium-3-5 · gemini-3-flash-preview

Same model – two results

experiment, 1,700 runs
Typical prompt

Выручка упала на 18%, трафик вырос на 12%, средний чек снизился с 8700 до 6200. Что происходит и что делать?

6.8 /10
Structured prompt

...Формат:

  • § Диагноз (2-3 предложения)
  • § Корневые причины (что + почему + данные)
  • § Рекомендации (действие, результат в цифрах, срок, ответственный)
  • § Чего я не знаю
8.6 /10 +24%

A naive prompt gets generic advice. A structured one – causal analysis with numbers and deadlines.

About this experiment →

Category breakdown

Russia availability

Via OpenRouter

Warning: regional specifics

Оценка 5.70/10 – в нижней пятёрке бенчмарка. Судьи зафиксировали массовые галлюцинации: ошибочные налоговые ставки, несуществующие статьи законов, неверные даты государственных праздников. Любой вопрос про российское законодательство или бухгалтерию – риск для бизнеса.

Related articles

Data analysis isn't about the model

The prompt determines 70% of the result. The Analysis & Decisions with AI module has 6 analysis frameworks with ready-to-use prompts: from revenue diagnostics to root cause analysis.

See the frameworks →