Microsoft v posledních letech postupně posiluje svou pozici v oblasti umělé inteligence a nyní se zdá, že se od modelů OpenAI stále více distancuje. Na začátku srpna 2026 společnost představila novou kreslicí neuronku nazvanou MAI-Image-2.5-Pro, která má ambice stát se klíčovým nástrojem pro generování a úpravu obrázků v jejích produktech. Tento krok je součástí širšího trendu, kdy Microsoft vyvíjí vlastní technologie, aby snížil závislost na externích dodavatelích AI řešení. Nový model je již integrován do aplikací jako PowerPoint, OneDrive a Bing, kde nahrazuje dříve používané technologie od OpenAI, jako je Dall-e a GPT Image.
MAI-Image-2.5-Pro se vyznačuje vysokou kvalitou generovaných obrázků a efektivitou při zpracování. Microsoft uvádí, že tento model dokáže snížit zatížení grafických výpočetních jednotek až o 84 % ve srovnání s předchozími modely, což přináší nejen úsporu zdrojů, ale i zrychlení celého procesu generování. V praxi to znamená, že uživatelé PowerPointu mohou rychleji vytvářet vizuálně atraktivní prezentace, zatímco OneDrive umožňuje efektivnější úpravy existujících obrázků. Tyto změny mají za následek zvýšení úspěšnosti při ukládání upravených obrázků o 26 % a snížení latence o čtvrtinu u 95 % požadavků.
Ekonomické aspekty a dostupnost modelu
Dalším důležitým aspektem nového modelu MAI-Image-2.5-Pro jsou ekonomické náklady spojené s jeho používáním. Microsoft nabízí různé cenové modely, kdy za milion vstupních textových tokenů zaplatíte pět dolarů, zatímco za milion obrazových tokenů je cena osm dolarů. Výstupní náklady na milion obrazových tokenů jsou však výrazně vyšší, a to až 106 dolarů. Tyto ceny naznačují, proč Microsoft ve svých produktech častěji používá levnější variantu MAI-Image-2.5 Flash, která je také integrována do Bingu jako výchozí volba pro generování obrázků. Firmy, které chtějí využít nejnovější technologie, se tak musí rozhodnout mezi kvalitou a náklady na provoz.
Nové modely pro generaci zvuku
Kromě kreslicí neuronky Microsoft představil také nový model pro generaci zvuku, MAI-Voice-2-Flash. Tento model se zaměřuje na vytváření akusticky kvalitních a přirozených zvukových výstupů, což je zvláště důležité pro aplikace jako jsou call centra a další komunikační platformy. MAI-Voice-2-Flash by měl zlepšit uživatelskou zkušenost a poskytnout společnosti konkurenční výhodu v oblasti AI generovaných audio řešení. Tímto krokem Microsoft opět potvrzuje svůj závazek k inovacím a vývoji vlastních technologií, které mohou nahradit tradiční modely a přinést uživatelům efektivnější a kvalitnější služby.
