AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

667 článků

Důležitost:Zprávamodel optimization

Korejská univerzita UNIST vyvinula AI techniku, která zmenší jazykové modely o 63 %

Výzkumníci z univerzity UNIST představili architekturu GMoE založenou na principu mixture-of-experts, která snižuje počet parametrů jazykových modelů až o 63 % při zachování výkonu. Přístup by mohl velké AI modely zlevnit a zjednodušit jejich nasazení. Zdroj: en.sedaily.com

Důležitost:Zprávahealthcare

Čína zpřístupnila zdarma AI nástroj pro screening DNA u vzácných nemocí

Čínští vědci uvolnili open-source AI framework, který má pomoci odhalovat a analyzovat vzácná genetická onemocnění pomocí DNA. Tým doufá, že bezplatný přístup k nástroji přispěje ke spravedlivější dostupnosti precizní medicíny ve světě. Zdroj: scmp.com

Důležitost:Zprávasecurity

Severokorejští hackeři si podle reportu staví AI nástroje pro kyberútoky

Podle nové zprávy vyvinula severokorejská hackerská skupina nástroje na bázi jazykových modelů a nashromáždila software, který má automatizovat kyberútoky a analýzu odcizených dat. Nástroje by skupině měly umožnit rychlejší zpracování ukradených informací a rozšíření útoků. Zdroj: reuters.com

Důležitost:Zprávamodel release

Čínský DeepSeek možná trumfne i nejchytřejší model OpenAI

Čínská AI firma DeepSeek spustila svůj nejvýkonnější jazykový model DeepSeek R1 jako bezplatnou webovou aplikaci přístupnou komukoliv. Podle prvních srovnání by model mohl v některých úlohách konkurovat nebo dokonce překonat nejschopnější model OpenAI. Zdroj: mashable.com

Důležitost:Zprávasecurity

Severokorejská skupina Kimsuky si podle zprávy spustila lokální LLM pro automatizaci útoků na Jižní Koreu

Hackerská skupina Kimsuky, spojovaná se severokorejskou Generální rozvědnou správou, si podle informací zprovoznila vlastní lokálně provozovaný jazykový model. Ten má skupině pomáhat automatizovat část útoků zaměřených na jihokorejské cíle. Zdroj: biz.chosun.com

Důležitost:Názorhealthcare

AI už na lékařských testech předčí lidské doktory

AI modely stále častěji dosahují lepších výsledků než lidští lékaři na standardizovaných zkouškách, plné převzetí zdravotnictví ale zatím nehrozí. Odborníci ale tvrdí, že by AI mohla lékařům výrazně více pomáhat, pokud by se více využívala v praxi. Zdroj: reason.com

Důležitost:Zprávadeployment

Apple v Číně oficiálně zapojil Alibaby Qwen do Apple Intelligence

Apple formálně integroval AI model Qwen od Alibaby do Apple Intelligence pro uživatele v Číně. Model je dostupný přes Siri a čínským uživatelům iPhonů tak nabízí lokálně vyhovující AI variantu. Zdroj: voi.id

Důležitost:VýzkumLLM reasoning efficiency

Nová metoda Arbitrage zrychluje uvažování LLM pomocí chytré spekulace

Výzkumníci představili techniku Arbitrage, která díky tzv. advantage-aware speculation zefektivňuje dlouhé řetězce uvažování (chain-of-thought) u velkých jazykových modelů. Cílem je snížit výpočetní náklady bez ztráty kvality odpovědí. Zdroj: machinelearning.apple.com

Důležitost:VýzkumLLM benchmarks

Benchmark srovnal přesnost 36 LLM v převodu textu na SQL dotazy

Nový test prověřil 36 velkých jazykových modelů na 759 otázkách z datasetu BIRD-SQL, přičemž každý model musel nejprve sám určit správnou databázi z 11 možností a poté napsat SQL dotaz. Benchmark ukazuje, jak přesně jednotlivé LLM zvládají převod přirozeného jazyka do funkčního SQL. Zdroj: aimultiple.com

Důležitost:ZprávaAI infrastructure

SK Telecom a Rebellions rozšiřují korejskou infrastrukturu pro AI čipy

SK Telecom a Rebellions posilují domácí infrastrukturu pro inferenci AI v Jižní Koreji, zatímco čipy Nvidia si celosvětově udržují dominanci při trénování suverénních AI modelů. Krok má posílit lokální alternativy v oblasti AI hardwaru. Zdroj: upi.com

Důležitost:VýzkumAI ethics in healthcare

Studie: jazyková zaujatost LLM může ohrozit rovný přístup ke zdravotní péči

Výzkumníci se zabývají tím, jak jazykové modely nasazené ve zdravotnictví mohou nést skryté jazykové předsudky ovlivňující rovnost péče. Práce navrhuje princip „jazykové spravedlnosti“ jako způsob, jak toto riziko zmírnit. Zdroj: nature.com

Důležitost:ZprávaData privacy in LLMs

Spoluzakladatel firmy varuje: data jednou vložená do LLM se už nedají odstranit

Spoluzakladatel společnosti super{set} upozorňuje, že firmy čelí podobnému dilematu jako dříve vydavatelé, kteří svěřili obsah Googlu — jakmile data jednou natrénují velký jazykový model, nelze je zpětně vyjmout ani snadno prověřit. Komentář otevírá otázky kontroly dat a odpovědnosti při trénování AI. Zdroj: ppc.land

Důležitost:SpuštěníModel releases

Modely Qwen3 se zaměřují na uvažování, programování i běžné úlohy

Série Qwen3 odráží trend, kdy AI modely zvládají čím dál složitější uvažování, programování i běžné úkoly. Jednotlivé varianty jsou přizpůsobeny různým způsobům nasazení a výkonovým požadavkům. Zdroj: trendhunter.com

Důležitost:Zprávamodel release

ByteDance vyvíjí model s 10 biliony parametrů – překonat by měl i Anthropic

Čínský gigant ByteDance pracuje na novém velkém jazykovém modelu, který má mít až 10 bilionů parametrů. To by z něj učinilo větší model než vlajkovou loď Anthropic. Podrobnosti o trénovacích datech ani termínu vydání zatím nejsou známé. Zdroj: mezha.ua

Důležitost:Spuštěníenterprise llm

Pojišťovna Allstate spustila vlastní jazykový model ALLIE

Americká pojišťovna Allstate představila svůj vlastní velký jazykový model s názvem ALLIE. Podle generálního ředitele Toma Wilsona firma sází na 'strategii taženou technologií', nikoli jen podporovanou technologií. Zdroj: insurancejournal.com

Důležitost:Spuštěníopen-source model

Tencent rozšiřuje open-source model Hy3 na mezinárodní trhy

Tencent zpřístupňuje svůj open-source jazykový model Hy3 i mimo Čínu. Model je zaměřený na uvažování, programování, plnění instrukcí a nasazení v AI agentech. Zdroj: gulfbusiness.com

Důležitost:Zprávaai hardware

AMD kupuje Taalas a chce natvrdo zapojit AI modely do čipů, obejde tak limity paměti GPU

Akvizice startupu Taalas má AMD pomoct vyřešit problém s pamětí, který brzdí inferenci AI na GPU. Technologie Taalas natrvalo vypaluje váhy modelu přímo do tranzistorů, takže odpadá potřeba DRAM při běhu modelu. Zdroj: techtimes.com

Důležitost:Výzkumlocal ai deployment

Vědec z University of Alberta vytvořil lokální AI nástroj, který nepotřebuje cloud

Jonathan Schaeffer, emeritní profesor University of Alberta, vyvinul lokální AI platformu pro výzkumníky, spisovatele a právníky, kteří nechtějí posílat citlivá data do cloudu. Nástroj zpracovává AI úlohy přímo na počítači uživatele. Zdroj: govtech.com

Důležitost:VýzkumLLM acceleration

UniSpec zrychluje LLM bez ztráty kvality a bez nutnosti přetrénování

UniSpec je nový přístup, který zrychluje běh velkých jazykových modelů beze ztráty kvality výstupu a bez nutnosti model znovu trénovat. Automaticky se přizpůsobuje různým typům hardwaru a zvládá i vícejazyčné úlohy. Zdroj: eurekalert.org

Důležitost:ZprávaAnthropic Claude research application

Model od Anthropic prý našel jednoduchý protipříklad k 87 let staré matematické hypotéze

Matematik z Anthropic tvrdí, že mu AI model označovaný jako Claude Fable 5 pomohl objevit překvapivě jednoduchý protipříklad, který zpochybňuje dlouho platnou Jacobiho hypotézu. Pokud se tvrzení potvrdí, šlo by o pozoruhodný případ, kdy AI přispěla k čisté matematice. Zdroj: sciencedaily.com