AMD zrychlí AI/LLM na integrovaných Radeon GPU o 18–23 % s Linuxem 7.4
Srovnávací test uzavírá nejslabší testovaný notebook s čipem AMD Ryzen AI 5 340 (Krackan Point). Zdroj: phoronix.com
68 článků
Srovnávací test uzavírá nejslabší testovaný notebook s čipem AMD Ryzen AI 5 340 (Krackan Point). Zdroj: phoronix.com
Jihokorejský telekomunikační gigant KT oznámil, že jeho vlastní technologie AutoModelRouter pro směrování AI modelů obsadila druhé místo v celkovém pořadí benchmarku RouterArena. Výsledek potvrzuje rostoucí schopnosti KT v oblasti optimalizace výběru a nasazení AI modelů. Zdroj: businesskorea.co.kr
Interní nástroj KT nazvaný AutoModelRouter, který automaticky vybírá a směruje dotazy mezi různými AI modely, se umístil na druhém místě ve veřejném benchmarku LLM routerů. Výsledek ukazuje sílící konkurenci v oblasti technologií pro efektivní výběr modelů. Zdroj: biz.chosun.com
Open-source model CLM-8B od Stanfordu a Nvidie ukládá opakovaně použitelné akce agentů místo jejich přepočítávání, díky čemuž je v testech až 9x rychlejší než Jev. Cílí na AI agenty, kteří běžně využívají LLM k výběru nástrojů nebo hodnocení výstupů. Zdroj: venturebeat.com
Qwen-Image-2.1 je kompaktní model se 7 miliardami parametrů, který v sobě spojuje tři pokročilé schopnosti generování obrazu. Podle tvůrců tak nastavuje novou laťku pro open-source nástroje na tvorbu obrázků. Zdroj: eu.36kr.com
Nový výsledek benchmarku, kde humanoidní robot od Figure dosáhl 56 %, vyvolává hlubší diskuzi o tom, jak dobře dokážou tělesní AI agenti zobecňovat své dovednosti napříč úkoly. Výsledek nutí firmy jako Unitree či Agibot přehodnotit strategie, jak prokázat reálnou univerzálnost robotů namísto úzkého zaměření na konkrétní úlohy. Zdroj: eu.36kr.com
NVIDIA uvedla nástroj AIPerf, který má spolehlivě měřit rychlost inference velkých jazykových modelů při nasazení ve velkém rozsahu. Cílem je poskytnout vývojářům konzistentní výkonnostní data s rostoucím využitím LLM. Zdroj: quantumzeitgeist.com
Vědci z Harvardu spustili RLE-Bench, benchmark hodnotící schopnost AI kódovacích agentů zvládnout inženýrský návrh fyzických robotických systémů. Nástroj má měřit reálné inženýrské dovednosti nad rámec běžných softwarových úloh. Zdroj: seas.harvard.edu
Intel prezentoval vylepšené schopnosti v oblasti AI inference díky nejnovějším výsledkům benchmarku MLPerf Inference v6.1. Firma tvrdí, že výsledky ukazují výrazné zlepšení výkonu, které by mohlo podpořit její budoucí růst. Zdroj: theglobeandmail.com
Vědci z Columbia University a University of Cambridge vytvořili nový benchmark pro hodnocení strojového učení při predikci vlastností materiálů. Cílem je zvýšit spolehlivost AI modelů ve vědě o materiálech propojením poznatků z kvantových výpočtů s metodami hodnocení ML. Zdroj: quantumzeitgeist.com
Google Research vyvinul framework ToolGrad, který generuje trénovací data pro využívání nástrojů v LLM tak, že postupuje odzadu od výsledné odpovědi. Přístup dosahuje 99,8% úspěšnosti a skóre 83,1 v benchmarku BFCL. Zdroj: marktechpost.com
V červenci 2026 procházel autonomní AI agent postavený na modelech OpenAI benchmarkovým testem, který měřil jeho schopnost vyhledávat a zpracovávat data. Během testu měl na platformě Hugging Face zanechat soubory odhalující detaily o jeho chování. Zdroj: scworld.com
Tým vedený Michelem Simoncellim vytvořil nový benchmark, který testuje, jak přesně modely strojového učení zachycují kvantové interakce mezi atomy. Cílem je posunout AI systémy používané v materiálové vědě k fyzikálně konzistentnějším předpovědím. Zdroj: eurekalert.org
Projekt HydraFusion od GitHubu kombinuje více modelů a selektivně je nasazuje na programátorské úlohy. V offline testech si podle všeho v jednom benchmarku vedl stejně dobře nebo lépe než model Opus 5, a to při nižších nákladech, i když srovnatelnou kvalitu se nepodařilo prokázat ve všech testech. Zdroj: github.blog
Nový systém HydraFusion od GitHubu dokáže snížit náklady na AI generování kódu ve všech testovaných benchmarcích. Vlastní zveřejněná data ale ukazují, že srovnatelnou kvalitu si udržel jen v jednom ze tří testů. Zdroj: venturebeat.com
Adobe testuje, jak rychle dokáže jeho AI pohánět nové nástroje pro tvorbu webů pomocí agentů. Uvedení slouží jako zkouška pro širší směřování firmy k autonomním kreativním nástrojům založeným na AI. Zdroj: startuphub.ai
NVIDIA tvrdí, že platformy Vera Rubin a Blackwell nastavují nový standard výkonu na watt pro agentní AI úlohy. Firma upozorňuje, že AI agenti posunuli inferenci od jednoduchých odpovědí k víckrokovému uvažování, používání nástrojů a koordinaci mezi subagenty. Zdroj: google.com
Právnicko-technologická firma Harvey uvedla model Harvey Tenet, dotrénovanou verzi základního modelu Kimi K3 vytvořenou ve spolupráci s Fireworks pro zvládání dlouhých a komplexních úkolů právních AI agentů. Firma zveřejnila detaily o nasazení, metodě trénování i výsledky benchmarků. Zdroj: marktechpost.com
MiniMax H3 vytváří video v rozlišení 2K s vestavěným stereo zvukem za výrazně nižší cenu než konkurenční nástroje. Pozornost budí jak jeho technické parametry, tak výsledky benchmarků a licenční podmínky. Zdroj: intelligentliving.co
Srovnání z roku 2026 staví proti sobě Copilot, Gemini a Perplexity z hlediska ceny, výkonu v testech mezi GPT-5.6 a Gemini 3 Pro i počtu měsíčně aktivních uživatelů, který přesahuje miliardu. Zdroj: tech-insider.org