Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
715 článků
Důležitost:VýzkumRAG optimization
Nižší latenci a náklady RAG pipeline zajistí méně volání LLM, ne rychlejší model
Agentní návrhy RAG pipeline nechávají model rozhodovat v každém kroku, což prudce zvyšuje počet volání LLM. Text argumentuje, že snížení zbytečných volání je efektivnější cestou ke snížení latence a nákladů než nákup rychlejšího modelu. Zdroj: towardsdatascience.com
Důležitost:VýzkumLLM training efficiency
CoLA: efektivnější způsob trénování velkých jazykových modelů
Vědci vyvinuli metodu nazvanou CoLA, která snižuje nároky na výpočetní výkon a paměť při trénování velkých jazykových modelů. Cílem přístupu je učinit vývoj LLM podstatně úspornějším. Zdroj: anl.gov
Důležitost:SpuštěníTencent Hy3 model release
Tencent rozšiřuje globální dostupnost jazykového modelu Hy3
Tencent zpřístupnil svůj model Hy3, dříve známý jako Hunyuan, více uživatelům po celém světě po jeho oficiálním spuštění 6. července. Velký jazykový model je nyní dostupný širšímu okruhu zájemců mimo Čínu. Zdroj: telecompaper.com
Důležitost:ZprávaAI hardware supply chain
Proč se čínští giganti AI stále nedokážou odpoutat od čipů Nvidia?
Přestože Peking tlačí na nezávislost na zahraničních čipech, přední čínští vývojáři AI nadále trénují své nejpokročilejší modely na hardwaru Nvidia. Podle zdrojů z oboru domácí čipy zatím nestačí na požadavky vývoje nejmodernějších LLM. Zdroj: amp.scmp.com
Důležitost:VýzkumLLM-human cognition
Sledování očí odhalilo rozdíly mezi čtením lidí a zpracováním textu AI
Nová studie porovnala data ze sledování pohybu očí s tím, jak texty zpracovávají velké jazykové modely. Výsledky ukázaly zřetelné odlišnosti mezi způsobem lidského čtení a fungováním LLM. Zdroj: neurosciencenews.com
Důležitost:VýzkumCompact LLM architecture
UNIST představil kompaktní jazykový model, který si zachovává výkon
Jihokorejská univerzita UNIST vyvinula menší velký jazykový model postavený na architektuře Global Mixture of Experts, která sdílí neuronové moduly napříč vrstvami. Díky tomu se sníží velikost modelu i nároky na paměť, aniž by utrpěl výkon. Zdroj: dongascience.com
Důležitost:ZprávaLLM selection guide
GDIT radí, jak vybrat správný LLM pro kritické mise
Společnost GDIT vydala návod na výběr vhodného velkého jazykového modelu pro AI aplikace klíčové pro dané mise. Reaguje tím na rostoucí zájem o technologie stojící za generativní AI, včetně zpracování přirozeného jazyka a znalostních grafů. Zdroj: news.clearancejobs.com
Důležitost:VýzkumLLM education
Přednáška Stanfordu CS229 vysvětluje, jak se staví velké jazykové modely
Přednáška z předmětu CS229 na Stanfordu stručně popisuje postup tvorby jazykových modelů podobných ChatGPT. Je součástí širšího programu univerzity zaměřeného na AI, dostupného i veřejnosti. Zdroj: mshale.com
Důležitost:Zprávamodel optimization
Korejská univerzita UNIST vyvinula AI techniku, která zmenší jazykové modely o 63 %
Výzkumníci z univerzity UNIST představili architekturu GMoE založenou na principu mixture-of-experts, která snižuje počet parametrů jazykových modelů až o 63 % při zachování výkonu. Přístup by mohl velké AI modely zlevnit a zjednodušit jejich nasazení. Zdroj: en.sedaily.com
Důležitost:Zprávamodel release
Čínský DeepSeek možná trumfne i nejchytřejší model OpenAI
Čínská AI firma DeepSeek spustila svůj nejvýkonnější jazykový model DeepSeek R1 jako bezplatnou webovou aplikaci přístupnou komukoliv. Podle prvních srovnání by model mohl v některých úlohách konkurovat nebo dokonce překonat nejschopnější model OpenAI. Zdroj: mashable.com
Důležitost:Zprávasecurity
Severokorejští hackeři si podle reportu staví AI nástroje pro kyberútoky
Podle nové zprávy vyvinula severokorejská hackerská skupina nástroje na bázi jazykových modelů a nashromáždila software, který má automatizovat kyberútoky a analýzu odcizených dat. Nástroje by skupině měly umožnit rychlejší zpracování ukradených informací a rozšíření útoků. Zdroj: reuters.com
Důležitost:Zprávahealthcare
Čína zpřístupnila zdarma AI nástroj pro screening DNA u vzácných nemocí
Čínští vědci uvolnili open-source AI framework, který má pomoci odhalovat a analyzovat vzácná genetická onemocnění pomocí DNA. Tým doufá, že bezplatný přístup k nástroji přispěje ke spravedlivější dostupnosti precizní medicíny ve světě. Zdroj: scmp.com
Důležitost:Zprávasecurity
Severokorejská skupina Kimsuky si podle zprávy spustila lokální LLM pro automatizaci útoků na Jižní Koreu
Hackerská skupina Kimsuky, spojovaná se severokorejskou Generální rozvědnou správou, si podle informací zprovoznila vlastní lokálně provozovaný jazykový model. Ten má skupině pomáhat automatizovat část útoků zaměřených na jihokorejské cíle. Zdroj: biz.chosun.com
Důležitost:Názorhealthcare
AI už na lékařských testech předčí lidské doktory
AI modely stále častěji dosahují lepších výsledků než lidští lékaři na standardizovaných zkouškách, plné převzetí zdravotnictví ale zatím nehrozí. Odborníci ale tvrdí, že by AI mohla lékařům výrazně více pomáhat, pokud by se více využívala v praxi. Zdroj: reason.com
Důležitost:Zprávadeployment
Apple v Číně oficiálně zapojil Alibaby Qwen do Apple Intelligence
Apple formálně integroval AI model Qwen od Alibaby do Apple Intelligence pro uživatele v Číně. Model je dostupný přes Siri a čínským uživatelům iPhonů tak nabízí lokálně vyhovující AI variantu. Zdroj: voi.id
Důležitost:VýzkumLLM reasoning efficiency
Nová metoda Arbitrage zrychluje uvažování LLM pomocí chytré spekulace
Výzkumníci představili techniku Arbitrage, která díky tzv. advantage-aware speculation zefektivňuje dlouhé řetězce uvažování (chain-of-thought) u velkých jazykových modelů. Cílem je snížit výpočetní náklady bez ztráty kvality odpovědí. Zdroj: machinelearning.apple.com
Důležitost:ZprávaAI infrastructure
SK Telecom a Rebellions rozšiřují korejskou infrastrukturu pro AI čipy
SK Telecom a Rebellions posilují domácí infrastrukturu pro inferenci AI v Jižní Koreji, zatímco čipy Nvidia si celosvětově udržují dominanci při trénování suverénních AI modelů. Krok má posílit lokální alternativy v oblasti AI hardwaru. Zdroj: upi.com
Důležitost:VýzkumLLM benchmarks
Benchmark srovnal přesnost 36 LLM v převodu textu na SQL dotazy
Nový test prověřil 36 velkých jazykových modelů na 759 otázkách z datasetu BIRD-SQL, přičemž každý model musel nejprve sám určit správnou databázi z 11 možností a poté napsat SQL dotaz. Benchmark ukazuje, jak přesně jednotlivé LLM zvládají převod přirozeného jazyka do funkčního SQL. Zdroj: aimultiple.com
Důležitost:VýzkumAI ethics in healthcare
Studie: jazyková zaujatost LLM může ohrozit rovný přístup ke zdravotní péči
Výzkumníci se zabývají tím, jak jazykové modely nasazené ve zdravotnictví mohou nést skryté jazykové předsudky ovlivňující rovnost péče. Práce navrhuje princip „jazykové spravedlnosti“ jako způsob, jak toto riziko zmírnit. Zdroj: nature.com
Důležitost:SpuštěníModel releases
Modely Qwen3 se zaměřují na uvažování, programování i běžné úlohy
Série Qwen3 odráží trend, kdy AI modely zvládají čím dál složitější uvažování, programování i běžné úkoly. Jednotlivé varianty jsou přizpůsobeny různým způsobům nasazení a výkonovým požadavkům. Zdroj: trendhunter.com