Tööriistade Võrdlus

40 GigaChat juhtumit: kontrollime Sberi võrdlusuuringut andmetega

18 min lugemist

Sber – Venemaa suurim pank ja üks selle riigi juhtivaid tehisintellekti arendajaid – andis välja reklaami-eriprojekti: nelikümmend ärijuhtumit ettevõtetest, kes võtsid kasutusele GigaChati (Sberi enda vestlusmudeli) ja räägivad selle mõjust. EdTech, MedTech, HRTech, küberturve, PropTech. Ilusad kaardid, konkreetsed numbrid, päris idufirmad.

Sberi reklaamprojekt

Pildil: kiirendi Sber500×GigaChat reklaamslaid „Sammu võrra ees" – 40 idufirmat 9 valdkonnast. Lubatud efektid: äriprotsessid kuni x16 kiiremad, kulud kuni 90% väiksemad, ülesannete automatiseerimine kuni 95%, käive kuni 30% suurem.

Meil on võrdlusuuring: 29 mudelit, 4 308 sõltumatut hinnangut juhtimisülesannetel. GigaChat on selles teise testlaine järel viimasel, 29. kohal. See loob huvitava olukorra.

Mitte sellepärast, et Sber valetaks. Juhtumid on päris, idufirmad olemas, automaatika töötab. Küsimus on muus: kas see oli optimaalne mudel ülesannete jaoks, mida nad lahendasid?

Loe edasi
40 GigaChat juhtumit: kontrollime Sberi võrdlusuuringut andmetega
99% kvaliteedist 1,4% hinnaga: mis on TI-mudelite turul valesti
6 min

99% kvaliteedist 1,4% hinnaga: mis on TI-mudelite turul valesti

Enamik juhte valib TI-mudeli nii: võtab kõige kallima saadaoleva. Loogika on arusaadav – kallim tähendab paremat. Nii on ettevõttetarkvara puhul viimased kakskümmend aastat toiminud.

TI-mudelite turg 2026. aastal on teisiti korraldatud. Ühe päringu maksumus varieerub $0,0001 kuni $0,17 – kolm suurusjärku. Aga tegelik kvaliteedierinevus kümne parima mudeli vahel? 0,24 punkti viiepallisel skaalal. Samal ajal Wharton / GBK Collective fikseerib: kolmandik ettevõtete TI-projektidest ei jõua piloodist kaugemale. Ja Epoch AI näitab, et vaid 5,6% kasutajatest rakendab TI-d tõeliselt süvitsi.

Võib-olla pole küsimus selles, milline mudel on parem, vaid selles, kas preemiumile üle maksmine annab tüüpiliste juhtimisülesannete puhul proportsionaalselt parema tulemuse.

Me kontrollisime. Vastus osutus oodatust karmimaks.

Kuidas YandexGPT-st maksimum kätte saada: mis töötab ja mis mitte
10 min

Kuidas YandexGPT-st maksimum kätte saada: mis töötab ja mis mitte

Miljonid inimesed Venemaal kasutavad Alice’i iga päev – mitte sellepärast, et nad seda valiksid, vaid sellepärast, et see on tasuta, sisse ehitatud Yandexi brauserisse ja töötab ilma VPN-ita. YandexGPT, Alice’i kapoti all olev mudel, on parim Venemaa mudel meie võrdlusuuringus, kuid GPT-5.4-ni jääb tal veel pikk maa.

Kas sellelt on võimalik saada GPT-le lähedasi vastuseid, kui õppida õigesti küsima? Me kontrollisime seda katses: kümme promptimistehnikat, kuus juhtimisülesannet, kaks sõltumatut LLM-kohtunikku. Lühike vastus: jah, on võimalik – aga kõik tehnikad ei tööta ja mõned teevad asja hullemaks.

Allpool on konkreetsed mallid, mille saad kohe vestlusse kopeerida, ning antimustrid, mida tasub vältida.

Kimi Moonshotilt 2026: K3, K2.6, K2.7-Code ja agendid juhile
15 min

Kimi Moonshotilt 2026: K3, K2.6, K2.7-Code ja agendid juhile

Kas avatud Hiina mudel suudab konkureerida OpenAI ja Anthropicu suletud lipulaevadega? Meie sõltumatu testimise põhjal jõudis uus Kimi K3 (ilmus 16. juulil 2026) 2. kohale 47 mudeli seast. Kõrgemal on ainult GPT-5.6 Sol – ja erinevalt sellest on Kimi K3 avatud kaaludega, kordades odavam kui GPT või Claude ning seda saab jooksutada oma infrastruktuuris, mis EL-i ettevõttele tähendab andmete suveräänsust ja lihtsamat GDPR-i vastavust.