Sber Sber Tier: Follows clear tasks Russia access: Available

GigaChat 3.5 Ultra

Российская модель от Сбера врёт о правах декретниц в России
Sber GigaChat 3.5 Ultra
score 6.9 $0.01 per task Available

Стоит как GPT-4 ($10/1M), а занимает 33-е место из 43. В анализе стратегических альтернатив неожиданно сильна – 19-е место из 43. Но Gemma 4 31B даёт сравнимый итог за $0.38, в 26 раз дешевле.

Overall rank
#36–42 of 47
on par with Grok 4.3, Step 3.7 Flash
Overall score
6.9/10
Cost per task
$0.011
$1.07 / $3.21 · per 1M tokens · ≈ 750 pages
Tested
07.2026
80 scenarios · 2 AI judges

Profile across 8 categories

0–10 scale. Higher means the model handled those tasks better

chart
Strong at Analysis & Decisions 8.1/10
Weak at Regional Awareness 5.3/10

Similar models

Closest alternatives – by level, availability and price.

Price vs level

Where this model sits versus the rest: higher is stronger, further left is cheaper.

Best for
  • + Подготовить письмо директору или оформить протокол совещания – справляется без нареканий
  • + Стратегический анализ альтернатив: сильнее 24 моделей из 43 именно в разборе рисков и сценариев
  • + Нужен прямой доступ из корпоративной сети в России без VPN и зарубежных платёжных карт
Not for
  • Финансовые расчёты и бюджеты – ошибается в цифрах системно, не разово
  • Любые кадровые вопросы с опорой на российское законодательство – опасно (см. предупреждение ниже)
  • Управление командой: 41-е место из 43 – поверхностнее большинства бесплатных моделей
Benchmark task – run and compare
Analysis & Decisions – 8.07/10

This is a real prompt from our benchmark. Hit "Run" – the model answers right here so you can compare with the competitor.

You
Я могу инвестировать 80 000 долларов в автоматизацию [процесса: например, "процесс ежемесячной отчетности"]. Что я знаю: - Текущий процесс занимает 3 человека × 2 дня/месяц = 48 часов/месяц - Автоматизация сократит это до 4 часов/месяц (заявление вендора, не проверено) - Внедрение займет 3 месяца и потребует 20% времени одного разработчика - Риск: Процесс может измениться при следующей реорганизации (по слухам, через 6-12 месяцев) - Команда скептически настроена после неудачного проекта автоматизации в прошлом году Чего я не знаю: - Точная экономия времени (заявления вендоров разнятся) - Скрытые затраты на обслуживание - Влияние на качество данных - Будет ли процесс существовать после реорганизации Пожалуйста: 1. Порекомендуй, стоит ли инвестировать, и если да, то при каких условиях. 2. Предложи, как структурировать пилотный или поэтапный подход. 3. Определи точку безубыточности и срок окупаемости. 4. Порекомендуй, как управлять скептицизмом команды. 5. Предложи критерии принятия решения для раннего закрытия проекта, если он не работает.
Comparing:
GigaChat3.5-432B-A28B · gemma-4-31b-it

Same model – two results

experiment, 1,700 runs
Typical prompt

Выручка упала на 18%, трафик вырос на 12%, средний чек снизился с 8700 до 6200. Что происходит и что делать?

6.8 /10
Structured prompt

...Формат:

  • § Диагноз (2-3 предложения)
  • § Корневые причины (что + почему + данные)
  • § Рекомендации (действие, результат в цифрах, срок, ответственный)
  • § Чего я не знаю
8.6 /10 +24%

A naive prompt gets generic advice. A structured one – causal analysis with numbers and deadlines.

About this experiment →

Category breakdown

Russia availability

Direct access

Warning: regional specifics

Модель даёт опасные советы по российскому праву: ссылается на недействующие законы, неверно описывает права декретниц в РФ и путает праздничные переносы в Казахстане. Любое утверждение о трудовом или социальном законодательстве требует проверки в первоисточнике.

Related articles

Data analysis isn't about the model

The prompt determines 70% of the result. The Analysis & Decisions with AI module has 6 analysis frameworks with ready-to-use prompts: from revenue diagnostics to root cause analysis.

See the frameworks →