Sber predstavil nový model umelej inteligencie GigaChat 3.5 Ultra, ktorý podľa informácií spoločnosti poskytuje vyšší výkon pri programovaní, matematických výpočtoch a analýze veľkých objemov textu. Model je dostupný bezplatne používateľom GigaChat aj vývojárom vo forme otvoreného zdrojového kódu (Open Source).

Spoločnosť uvádza, že GigaChat 3.5 Ultra dokáže generovať dlhé texty až štyrikrát rýchlejšie ako predchádzajúca verzia a zároveň využíva menej výpočtových zdrojov. Nový model je tiež takmer dvakrát kompaktnejší ako jeho predchodca.

Základom modelu je architektúra vyvinutá spoločnosťou Sber s technológiou Linear Attention (lineárna pozornosť). Tá umožňuje efektívnejšie spracovávať dlhé dokumenty postupným zhromažďovaním kontextu namiesto opätovnej analýzy celého textu.

Hlavné vylepšenia

Programovanie a matematika

Podľa informácií spoločnosti Sber model presnejšie generuje a kontroluje programový kód, efektívnejšie rieši matematické úlohy a finančné výpočty a lepšie pracuje s číselnými údajmi. Spoločnosť uvádza, že technológia môže byť užitočná pre vývojárov, analytikov a inžinierov pri každodennej práci.


Analýza veľkých dokumentov

Nový model je určený na analýzu zmlúv, technických predpisov, správ a ďalších rozsiahlych dokumentov. Sber tvrdí, že vďaka architektúre lineárnej pozornosti sa rýchlosť spracovania dokumentov zvýšila až štvornásobne pri zachovaní presného pochopenia kontextu.


Podpora AI agentov

GigaChat 3.5 Ultra je tiež určený na vývoj autonómnych AI agentov. Model dokáže samostatne vyhľadávať informácie, generovať a spúšťať kód, komunikovať s externými službami a pripravovať konečný výsledok, čím automatizuje rôzne rutinné procesy, ako je spracovanie údajov, monitorovanie a príprava pravidelných správ.


Porovnanie s inými modelmi

Podľa údajov spoločnosti Sber v interných testoch GigaChat 3.5 Ultra prekonáva predchádzajúci vlajkový model spoločnosti v úlohách súvisiacich s programovaním, matematikou, riešením viacstupňových logických problémov a vedením konverzácií v ruskom jazyku.

Spoločnosť tiež uvádza, že v niekoľkých ukazovateľoch výkonu sa nový model priblížil k jednému z najpopulárnejších veľkých jazykových modelov s otvoreným zdrojovým kódom — DeepSeek 3.2, pričom si zachoval takmer dvojnásobne menšiu architektúru.

Zdroj: giga.chat