AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

981 článků

Důležitost:VýzkumRAG optimization

Nižší latenci a náklady RAG pipeline zajistí méně volání LLM, ne rychlejší model

Agentní návrhy RAG pipeline nechávají model rozhodovat v každém kroku, což prudce zvyšuje počet volání LLM. Text argumentuje, že snížení zbytečných volání je efektivnější cestou ke snížení latence a nákladů než nákup rychlejšího modelu. Zdroj: towardsdatascience.com

Důležitost:VýzkumLLM healthcare applications

Studie zkoumá, co brání radiologům nechat se zmást AI

Nový výzkum zkoumá podmínky, za kterých radiologové úspěšně spolupracují s LLM, aniž by je zmátly nesprávné výstupy. Klíčovými faktory jsou správně nastavená důvěra v AI model a vlastní klinická erudice lékaře. Zdroj: radiologybusiness.com

Důležitost:VýzkumLLM healthcare training

Simulace s ChatGPT učí sestry na JIP zvládat krizovou komunikaci

Nový výukový protokol využívá ChatGPT k simulaci vypjatých rozhovorů s rodinami pacientů pro začínající sestry na jednotkách intenzivní péče. Cílem je naučit je zvládat deeskalaci a krizovou komunikaci, což patří k běžným výzvám na JIP. Zdroj: cureus.com

Důležitost:Výzkummultimodal healthcare applications

Multimodální LLM sleduje vývoj orálního lichen planus v nové studii

Longitudinální studie testovala schopnost multimodálního LLM klasifikovat vývoj nemoci a odhadovat riziko u pacientů s orálním lichen planus. Výzkum hodnotil, jak přesně model dokáže sledovat změny v čase ve srovnání s tradičními diagnostickými postupy. Zdroj: nature.com

Důležitost:Zprávamobile LLM applications

Proč jsem na Androidu vyměnil Perplexity za lokální LLM

Autor popisuje, jak přešel z aplikace Perplexity, kterou dříve použil místo Google vyhledávání, na lokální LLM běžící přímo v telefonu s Androidem. Hlavním lákadlem jsou okamžité odpovědi i bez připojení k internetu. Zdroj: androidpolice.com

Důležitost:VýzkumLLM fine-tuning

Návod ukazuje, jak vytvořit kompaktní LLM zaměřený na uvažování

Nový praktický návod popisuje streamování, kurátorství a fine-tuning datasetu SupraLabs zaměřeného na logické uvažování pro tvorbu malého jazykového modelu. Pokrývá celý proces od sběru dat až po ladění modelu. Zdroj: marktechpost.com

Důležitost:Názormodel distillation

Jaké náklady hrozí AI firmám, které nevyužívají distilaci modelů?

Analýza tvrdí, že velké AI firmy riskují vyšší náklady a ztrátu konkurenceschopnosti, pokud nevyužijí techniky distilace modelů. Distilace je popsána jako způsob, jak dát tréninku rychlý a efektivní start k vysoké výkonnosti. Zdroj: eu.36kr.com

Důležitost:VýzkumLLM training efficiency

CoLA: efektivnější způsob trénování velkých jazykových modelů

Vědci vyvinuli metodu nazvanou CoLA, která snižuje nároky na výpočetní výkon a paměť při trénování velkých jazykových modelů. Cílem přístupu je učinit vývoj LLM podstatně úspornějším. Zdroj: anl.gov

Důležitost:VýzkumLLM-human cognition

Sledování očí odhalilo rozdíly mezi čtením lidí a zpracováním textu AI

Nová studie porovnala data ze sledování pohybu očí s tím, jak texty zpracovávají velké jazykové modely. Výsledky ukázaly zřetelné odlišnosti mezi způsobem lidského čtení a fungováním LLM. Zdroj: neurosciencenews.com

Důležitost:SpuštěníTencent Hy3 model release

Tencent rozšiřuje globální dostupnost jazykového modelu Hy3

Tencent zpřístupnil svůj model Hy3, dříve známý jako Hunyuan, více uživatelům po celém světě po jeho oficiálním spuštění 6. července. Velký jazykový model je nyní dostupný širšímu okruhu zájemců mimo Čínu. Zdroj: telecompaper.com

Důležitost:ZprávaAI hardware supply chain

Proč se čínští giganti AI stále nedokážou odpoutat od čipů Nvidia?

Přestože Peking tlačí na nezávislost na zahraničních čipech, přední čínští vývojáři AI nadále trénují své nejpokročilejší modely na hardwaru Nvidia. Podle zdrojů z oboru domácí čipy zatím nestačí na požadavky vývoje nejmodernějších LLM. Zdroj: amp.scmp.com

Důležitost:ZprávaLLM selection guide

GDIT radí, jak vybrat správný LLM pro kritické mise

Společnost GDIT vydala návod na výběr vhodného velkého jazykového modelu pro AI aplikace klíčové pro dané mise. Reaguje tím na rostoucí zájem o technologie stojící za generativní AI, včetně zpracování přirozeného jazyka a znalostních grafů. Zdroj: news.clearancejobs.com

Důležitost:VýzkumCompact LLM architecture

UNIST představil kompaktní jazykový model, který si zachovává výkon

Jihokorejská univerzita UNIST vyvinula menší velký jazykový model postavený na architektuře Global Mixture of Experts, která sdílí neuronové moduly napříč vrstvami. Díky tomu se sníží velikost modelu i nároky na paměť, aniž by utrpěl výkon. Zdroj: dongascience.com

Důležitost:VýzkumLLM education

Přednáška Stanfordu CS229 vysvětluje, jak se staví velké jazykové modely

Přednáška z předmětu CS229 na Stanfordu stručně popisuje postup tvorby jazykových modelů podobných ChatGPT. Je součástí širšího programu univerzity zaměřeného na AI, dostupného i veřejnosti. Zdroj: mshale.com

Důležitost:Zprávamodel release

Čínský DeepSeek možná trumfne i nejchytřejší model OpenAI

Čínská AI firma DeepSeek spustila svůj nejvýkonnější jazykový model DeepSeek R1 jako bezplatnou webovou aplikaci přístupnou komukoliv. Podle prvních srovnání by model mohl v některých úlohách konkurovat nebo dokonce překonat nejschopnější model OpenAI. Zdroj: mashable.com

Důležitost:Zprávasecurity

Severokorejská skupina Kimsuky si podle zprávy spustila lokální LLM pro automatizaci útoků na Jižní Koreu

Hackerská skupina Kimsuky, spojovaná se severokorejskou Generální rozvědnou správou, si podle informací zprovoznila vlastní lokálně provozovaný jazykový model. Ten má skupině pomáhat automatizovat část útoků zaměřených na jihokorejské cíle. Zdroj: biz.chosun.com

Důležitost:Zprávasecurity

Severokorejští hackeři si podle reportu staví AI nástroje pro kyberútoky

Podle nové zprávy vyvinula severokorejská hackerská skupina nástroje na bázi jazykových modelů a nashromáždila software, který má automatizovat kyberútoky a analýzu odcizených dat. Nástroje by skupině měly umožnit rychlejší zpracování ukradených informací a rozšíření útoků. Zdroj: reuters.com

Důležitost:Zprávamodel optimization

Korejská univerzita UNIST vyvinula AI techniku, která zmenší jazykové modely o 63 %

Výzkumníci z univerzity UNIST představili architekturu GMoE založenou na principu mixture-of-experts, která snižuje počet parametrů jazykových modelů až o 63 % při zachování výkonu. Přístup by mohl velké AI modely zlevnit a zjednodušit jejich nasazení. Zdroj: en.sedaily.com

Důležitost:Zprávahealthcare

Čína zpřístupnila zdarma AI nástroj pro screening DNA u vzácných nemocí

Čínští vědci uvolnili open-source AI framework, který má pomoci odhalovat a analyzovat vzácná genetická onemocnění pomocí DNA. Tým doufá, že bezplatný přístup k nástroji přispěje ke spravedlivější dostupnosti precizní medicíny ve světě. Zdroj: scmp.com

Důležitost:Názorhealthcare

AI už na lékařských testech předčí lidské doktory

AI modely stále častěji dosahují lepších výsledků než lidští lékaři na standardizovaných zkouškách, plné převzetí zdravotnictví ale zatím nehrozí. Odborníci ale tvrdí, že by AI mohla lékařům výrazně více pomáhat, pokud by se více využívala v praxi. Zdroj: reason.com