Lokálne AI výpočty šetria náklady, suverenitu nezaručia

ASUS ponúka firmám superpočítače na lokálny beh AI agentov. Vlastné železo zníži účty za tokeny a latenciu, dátovú suverenitu však nezaručí: 92 % suverénnych modelov je natrénovaných na čipoch NVIDIA.

Lokálne AI výpočty šetria náklady, suverenitu nezaručia
Robot riesiaci lokalnu AI (Zdroj: Generovane pomocou ChatGPT)
Písmo: A- | A+

Upozornenie: Tento príspevok bol vytvorený za asistencie umelej inteligencie pod vedením a s redakčnými úpravami človeka.

ASUS na summite Ai4 v Las Vegas ponúkol firmám superpočítače na lokálny beh AI agentov; v ten istý týždeň Counterpoint Research zverejnil, že 92 % suverénnych jazykových modelov bolo natrénovaných na čipoch NVIDIA.

Pre firmu, ktorá zvažuje presun AI z cloudu do vlastnej serverovne, z toho vyplýva jedno. Z troch vecí, ktoré lokálna prevádzka (on-premise) sľubuje — predvídateľné náklady, nižšia latencia, dátová suverenita — sa prvé dve dajú kúpiť. Tretia nie. Načasovanie nie je náhodné: účty za tokeny prvýkrát narazili na rozpočtové stropy a pamäť je najdrahšia za desaťročie.

SkryťVypnúť reklamu
Článok pokračuje pod video reklamou
SkryťVypnúť reklamu
Článok pokračuje pod video reklamou

Prečo firmy zvažujú vlastné železo

Náklady na agentov prekonali finančné plány aj vo veľkých firmách. Uber vyčerpal celý rozpočet na AI kódovacie nástroje na rok 2026 už v apríli, po štyroch mesiacoch, keď sa Claude Code rozšíril medzi približne 5 000 inžinierov rýchlejšie, ako predpokladali finančné modely. Technologický riaditeľ Praveen Neppalli Naga to potvrdil pre The Information. Firma následne zaviedla strop 1 500 dolárov mesačne na zamestnanca a na jeden nástroj.

Rozdiel medzi metrovaným cloudom a vlastným hardvérom je v tomto prípade rozdielom medzi variabilným a fixným nákladom — nie nutne medzi drahým a lacným.

Trh na to reaguje aj mimo hardvéru. Startup Sapiom, ktorý smeruje jednotlivé dopyty na najlacnejší dostatočne schopný model, získal 35 miliónov dolárov v sérii A vedenej fondom Dragonfly, jedenásť mesiacov po založení. Podľa firmy klesol jednému zákazníkovi mesačný účet za tokeny z 1,2 milióna dolárov na približne 100 tisíc. Je to tvrdenie Sapiomu o vlastnom klientovi, nie nezávislé meranie.

SkryťVypnúť reklamu

Tlak na úspory má oporu v prieskumoch. V prieskume KPMG Global AI Pulse za druhý kvartál 2026 uviedlo len 7 % vedúcich pracovníkov, že má preukázanú návratnosť investícií do AI, pričom priemerný výdavok zostal na 188 miliónoch dolárov. Prieskum meria sebahodnotenie manažérov, nie auditované účtovné výsledky.

SkryťVypnúť reklamu

Suverénny hosting, cudzí kremík

Suverenita sa v praxi zastavuje na úrovni hostingu. Counterpoint preskúmal viac ako 80 krajín mimo USA a Číny; približne 55 z nich vyvinulo domáci jazykový model. Riaditeľ Marc Einstein k tomu povedal, že hosting je čoraz suverénnejší, zdroj AI čipov nie (v angličtine: „hosting is increasingly Sovereign while the AI chip source is not"). AMD drží podľa Counterpointu 4 % suverénnej AI infraštruktúry.

SkryťVypnúť reklamu

Ide o odhad jednej analytickej firmy a týka sa trénovania modelov, nie podnikovej inferencie. Iná metodika dá iné číslo: index CNAS pripisuje NVIDII GPU v 52 % sledovaných suverénnych infraštruktúrnych projektov.

Vlastné železo drahne — a tlačí aj na predajcov „dôveryhodnej AI"

Dátové centrá majú v roku 2026 spotrebovať 70 % svetovej produkcie pamäťových čipov, čo za 18 mesiacov strojnásobilo ceny DRAM. CSIS uvádza opatrnejšie rozpätie 50 až 70 %.

Dôsledok dolieha aj na ASUS. Podľa Nikkei Asia HP, ASUS a Acer dokončili okolo polovice roka 2026 kvalifikáciu DRAM čipov čínskej CXMT a začali ich používať v obmedzenom počte notebookov, prevažne pre trhy mimo USA. CXMT vedie Pentagon ako firmu s väzbami na čínsku armádu a zákonodarcovia vo Washingtone lobujú za jej zaradenie na čiernu listinu.

SkryťVypnúť reklamu

Presnosť tu rozhoduje: hovoríme o notebookoch, nie o podnikových systémoch ASUS postavených na NVIDIA DGX, ktoré používajú HBM od inej trojice dodávateľov. Správa stojí na nemenovaných zdrojoch a nebola oficiálne potvrdená. Podstatné je smerovanie — to isté budovanie dátových centier, ktoré firmy tlačí do vlastnej serverovne, im zdražuje hardvér, ktorý si tam majú postaviť.

Lacnejšia cesta môže byť menší model, nie väčší stroj

Liquid AI vydala 4. augusta 2026 model LFM2.5-2.6B, ktorý podľa firmy dekóduje 220 tokenov za sekundu na Apple M5 Max a 113 na procesore AMD Ryzen AI Max+ 395, pod 2,5 GB pamäti. Na telefóne je to približne 30 tokenov za sekundu — sedemkrát menej ako na notebooku Apple.

Sú to čísla z karty modelu, nie z nezávislého testu. Liquid AI zároveň model neodporúča na agentové úlohy náročné na programovanie a znalosti; tam väčšie modely stále vedú. Pre podnik, ktorý chce lokálneho agenta na triedenie dokumentov, je to iná investičná úvaha ako 748-gigabajtový stroj pod stolom.

Čo sledovať

Tri konkrétne body. Zaradenie CXMT na americkú čiernu listinu by okamžite zúžilo dodávateľské možnosti výrobcov PC. SK Hynix plánuje rozšíriť výrobu HBM v Južnej Kórei a USA, no nové kapacity nedosiahnu objemovú výrobu pred koncom roka 2027. A tretí kvartálny prieskum KPMG ukáže, či sa sedmička pohne — ak nie, rozpočty na AI sa budú v roku 2027 obhajovať ťažšie ako dnes.

Martin Sečkár

Martin Sečkár

Bloger 
  • Počet článkov:  35
  •  | 
  • Páči sa:  28x

Pouzivam AI na pisanie pribehov, komentarov a svojho newsletra zamerane na AI novinky(https://www.linkedin.com/newsletters/svet-ai-tvoren%C3%BD-ai-7349186484307951619/). Priestor na sme.sk by som rad vyuzit na umiestnenie AI vytvorenych, clovekom overenych poviedok a komentarov k aktualnemu dianiu. Hladam priestor kde sa vyjadrit a neostat ticho v tejto zlozitej spolocenskej situacii. Zoznam autorových rubrík:  NezaradenáUmelà Inteligencia

Prémioví blogeri

Yevhen Hessen

Yevhen Hessen

36 článkov
Marcel Rebro

Marcel Rebro

316 článkov
Pavol Koprda

Pavol Koprda

10 článkov
Jana Čavojská

Jana Čavojská

27 článkov
reklama
SkryťZatvoriť reklamu