• Technologie
  • Byznys
  • Software
  • Hardware
  • Internet
  • Telco
  • Science
  • České IT
  • Události
Žádné výsledky
Zobrazit všechny výsledky
ITBiz.cz
ITBiz.cz
Žádné výsledky
Zobrazit všechny výsledky

Malé modely AI mají být velkým trendem

Pavel Houser
3. 1. 2025
| Komentujeme
Chvála černých skřínek

V záplavě prognóz technologického vývoje (nejen) v roce 2025 zde prozatím trochu zapadlo jedno téma, které se v souvislosti s umělou inteligencí na zahraničních vědeckých i technologických webech zmiňuje poměrně často: „zmenšení“ AI. Namísto velkých jazykových modelů LLM můžeme očekávat důraz na modely menší, respektive kompozitní architekturu.
Důvodů je hned několik: menší modely jde snáze provozovat přímo na koncových zařízeních, což snižuje rizika spojená s přesouváním dat (do firemního datového centra) nebo přímo s jejich předáváním třetí straně (při používání „veřejných“ služeb AI na serverech poskytovatele, při trénování modelů speciálně pro potřeby firmy…). Na koncových zařízeních se může provádět nejenom provoz, ale i trénování modelů.
Za druhé, méně robustní modely šetří energii a mohou ulevit těžce zkoušeným datovým centrům (tento problém se bude, jak se předpokládá, dále zvyšovat) – i když samozřejmě málokdo stojí o to, aby mu umělá inteligence vybíjela mobil. (Jinak úzkým hrdlem pro provoz i menšího modelu AI v koncovém zařízení bude nejspíš grafický procesor.)
Za třetí určitý typ aplikací potřebuje rychlé zpracování dat přímo u jejich zdrojů, tedy v edge prostředí. Okrajem infrastruktury přitom může být leccos.
A nakonec, menší, navzájem spolupracující modely mohou dávat i lepší výsledky. „Obecný“ model se může například spojovat se specializovaným, pokud usoudí, že otázka je na něj příliš odborná. V aplikaci pro daný obor si zase vystačíme přednostně se znalostmi určitého typu a důležité je opět hlavně to, aby model zjistil, kdy se má zeptat dál.
Viz také: Jak naučit modely umělé inteligence efektivně spolupracovat

Prakticky všechny podnikové aplikace jsou zaměřené „oborově“, prakticky žádná nepotřebuje znát informace (např.) o historii nebo zoologii.
Vědci z Princetonu a Stanfordu navrhli i provoz původně stejného LLM tak, že lokálně v zařízení poběží nějaká ořezaná verze (doslova se mluví o kompresi LLM). Takových algoritmů ovšem existuje více.
O budoucnosti menších modelů svědčí i to, že už je nabízejí také poskytovatelé těch velkých: Google, Microsoft, Meta a OpenAI a Amazon. A pokud menší modely fungují v režimu pro více uživatelů, pak jsou při stejné zátěži zdrojů pochopitelně rychlejší a zvládnou obsloužit současně více uživatelů.
A co se týče kompozitní architektury, Nicolas de Bellefonds z Boston Consulting Group dokonce navrhl následující uspořádání: vstupní interakci s uživatelem povede pouze velmi malý model, jehož jediným úkolem bude posoudit složitost otázky (takže porozumět jí ale bude muset dost přesně) a rozhodnout, který konkrétní, respektive jak velký model bude potřeba k jejímu zodpovězení; kdy „jak velký“ znamená „jaký nejmenší možný“…

Rubriky: Technologie

Související příspěvky

Články

Investice do infrastruktury AI měly zpomalit, ale IDC nyní svou prognózu mění

12. 11. 2025
Enterprise AI 2025: ambice vs. realita
Články

Enterprise AI 2025: ambice vs. realita

11. 11. 2025
Zprávičky

Čína motivuje firmy k přechodu na domácí čipy pro AI levnější elektřinou

7. 11. 2025
Huawei AI ilustracni
Články

HPE představuje inovace v AI s využitím technologií NVIDIA

7. 11. 2025

Napsat komentář

Vaše e-mailová adresa nebude zveřejněna. Vyžadované informace jsou označeny *

Souhlasím se Zásadami ochrany osobních údajů .

Zprávičky

Meta lákala zaměstnance OpenAI na bonus ve výši 100 milionů dolarů

Umělá inteligence se stává klíčovým prvkem bezpečnostních strategií

Pavel Houser
12. 11. 2025

Ve světle narůstajících kybernetických hrozeb stále více organizací přistupuje k umělé inteligenci (AI) jako

EK zvažuje, jak vyloučit čínské dodavatele z komunikačních sítí v EU

ČTK
12. 11. 2025

Evropská komise zkoumá možnosti, jak přinutit členské státy Evropské unie, aby ze svých telekomunikačních

Google investuje v příštích 4 letech v Německu 5,5 miliard eur

ČTK
12. 11. 2025

Americký internetový gigant Google investuje v příštích čtyřech letech v Německu 5,5 miliard eur

NÚKIB nařizuje aktualizovat MS Exchange Server

Podvodníci zneužívají zranitelnost ve službě Windows Server Update Services

Pavel Houser
11. 11. 2025

Experti ze Sophos Counter Threat Unit (CTU) odhalili, že kybernetičtí útočníci zneužívají zranitelnost ve

AWS oznamuje Fastnet, specializovaný vysokorychlostní transatlantický kabel spojující USA a Evropu

Pavel Houser
11. 11. 2025

Amazon Web Services (AWS) oznámil výstavbu Fastnetu – strategického transatlantického optického kabelu, který propojí

Fujitsu má novou platformu pro partnerskou spolupráci

SoftBank prodala za téměř 6 miliard dolarů celý svůj podíl v Nvidii

ČTK
11. 11. 2025

Japonský technologický konglomerát SoftBank prodal za 5,83 miliardy dolarů (zhruba 122,5 miliardy Kč) celý

IDC: Globální trh s tablety ve třetím čtvrtletí klesl, jedničkou zůstal Apple

ČTK
11. 11. 2025

Celosvětový trh s počítačovými tablety po šesti čtvrtletích nepřetržitého růstu ve třetím čtvrtletí klesl.

Čína osvobodí od cla vývoz čipů Nexperia pro civilní použití

ČTK
11. 11. 2025

Čína zavedla opatření, která osvobozují od vývozních omezení čipy Nexperia určené pro civilní použití.

Tiskové zprávy

Sandisk uvádí na trh nejmenší 1TB USB-C flash disk na světě

ZEBRA SYSTEMS: Omezené rozpočty a podceňování rizik jsou hlavní překážky k lepší kybernetické bezpečnosti

Red Hat podporuje digitální suverenitu Evropské unie

ČSÚ: Umělou inteligenci používá třetina populace

Společnosti Pure Storage a Cisco dodávají AI továrny pro podniky ve spolupráci s NVIDIA

Praha 6 získala od Letiště Praha 1200 licencí pro školení žáků ZŠ v otázkách kyberbezpečnosti

Zpráva dne

Neděste se upgradu: Windows 11 Pro na Halloween jen za €20.00 na Goodoffer24

Neděste se upgradu: Windows 11 Pro na Halloween jen za €20.00 na Goodoffer24

Redakce
15. 10. 2025

Halloween je tady a s ním i strašidelné ceny za software! Tak neváhejte a...

Komentujeme

Christian Klein, generální ředitel SAP

Digitální suverenita nestojí na ideálech, ale na konkrétních výsledcích

Christian Klein
23. 10. 2025

Diskuse o digitální suverenitě nabývá na celém světě na intenzitě. V dnešní době geopolitické nejistoty a...

Slovník

Efektivní frekvence

Color marketing

Zoner Photo Studio

Kategorie

  • Články
  • Komentujeme
  • Slovník
  • Tiskové zprávy
  • Zprávičky

Portál ITbiz.cz přináší informace z IT a byznysu již od roku 2006. Provozuje jej internetové vydavatelství Nitemedia.  Mezi další naše projekty patří například ABClinuxu.cz a Sciencemag.cz. Na stránce Redakce naleznete informace o redakci a možnostech inzerce.

Rubriky

Akce a události Byznys Cloud Ekomerce Hardware Internet Operační systémy Podnikový software Právo Science Security Technologie Telekomunikace veře Veřejná správa Vývoj a HTML Zpráva dne České IT
Žádné výsledky
Zobrazit všechny výsledky
  • Technologie
  • Byznys
  • Software
  • Hardware
  • Internet
  • Telco
  • Science
  • České IT
  • Události

© 2019 Vydává Nitemedia s.r.o. Hosting zajišťuje Greenhousing.cz.

Tento web používá cookies. Pokračováním dáváte souhlas s jejich používáním. Více na itbiz.cz/soukromi.