Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
1 000 článků
Důležitost:VýzkumLLM applications - healthcare
Využití LLM pro automatické čištění dat v klinických databázích
Elektronické zdravotní záznamy (EHR) jsou stále častěji využívány pro klinický výzkum a strojové učení, trpí však chybějícími hodnotami a nekvalitními daty. Nová studie zkoumá, zda dokážou velké jazykové modely (LLM) tyto problémy automatizovaně řešit. Zdroj: cureus.com
Důležitost:ZprávaLLM pricing comparison
Ceny LLM: Srovnání 15+ poskytovatelů
Náklady na LLM se dnes dělí do dvou kategorií: rozpočet na API volání účtovaný za tokeny a měsíční předplatné v rozmezí 8–200 dolarů. Výběr správného modelu závisí na způsobu použití – zda jde o programové volání, nebo o přímou práci uživatele s chatovým rozhraním. Zdroj: aimultiple.com
Důležitost:Spuštěníopen reasoning model release
ZAYA1-8B: výkonný open-source model trénovaný na GPU AMD Instinct MI300
Model ZAYA1-8B je kompaktní open-source reasoning model, jehož hlavní předností je trénink na GPU AMD Instinct MI300 – přímém konkurentu karet Nvidia. Jde o ukázku toho, že alternativy k Nvidia ekosystému jsou schopné pohánět moderní AI výzkum. Zdroj: venturebeat.com
Důležitost:Výzkumquantum computing + LLM
Multiverse Computing snížil perplexitu LLM o 1,4 % na 156qubitovém procesoru
Výzkumníci z Multiverse Computing dosáhli zlepšení perplexity – metriky kvality jazykového modelu – o 1,4 % pomocí 156qubitového kvantového procesoru. Výsledek naznačuje, že kvantové výpočty mohou v budoucnu přispět k optimalizaci trénování i inference LLM. Zdroj: quantumzeitgeist.com
Důležitost:NázorClaude security capabilities
Záplaty nestačí: přichází vlna zranitelností odhalených AI
Anthropic 7. dubna oznámil model Claude Mythos Preview a zároveň přiznal, že více než 99 % jím odhalených zranitelností nelze tradičním záplatováním efektivně řešit. Podle komentáře SC Media to představuje zásadní zlom v přístupu ke kybernetické bezpečnosti. Zdroj: scworld.com
Důležitost:VýzkumLLM inference efficiency
Sakana AI se zaměřuje na efektivnější inferenci LLM
Sakana AI zveřejnila na LinkedIn informace o svém výzkumu zaměřeném na zrychlení velkých jazykových modelů a snížení jejich nároků na zdroje. Cílem je učinit inferenci LLM dostupnější a méně náročnou na výpočetní výkon. Zdroj: tipranks.com
Důležitost:ZprávaLLM inference hardware
Optické AI servery zrychlují inferenci velkých jazykových modelů
Server Iris Nova od společnosti Lumai využívá optické výpočty ke spouštění AI modelů s nízkou spotřebou energie. Optický přístup slibuje výrazně efektivnější inferenci LLM oproti tradičním GPU řešením. Zdroj: designnews.com
Důležitost:Výzkuminterpretability/mechanistic AI
Natural Language Autoencoders: Turning Claude’s thoughts into text
When you talk to an AI model like Claude, you talk to it in words. Internally, Claude processes those words as long lists of numbers, before again producing... Zdroj: anthropic.com
Google Chrome Is Downloading a 4GB AI Model Onto Your Device Without Consent, Researcher Warns
Even if you aren't using Google Gemini, it might be using your device. Security researcher Alexander Hanff, also known as “That Privacy Guy,” recently... Zdroj: gizmodo.com
Důležitost:VýzkumLLM benchmarks/medical reasoning
New AI model beats doctors at clinical reasoning, diagnosis
A large language model (LLM) matched or exceeded hundreds of expert physicians in diagnostic and management reasoning tasks across six experiments,... Zdroj: msn.com
Důležitost:Zprávaon-device LLM/Google Chrome
Chrome silently installs a 4 GB local LLM on your computer
A new theoretical framework reveals an inescapable trade-off between efficiency, compactness, and recall in long sequence models. Zdroj: startuphub.ai
Důležitost:Spuštěnílong-context LLM architecture
Subquadratic získal 29 milionů dolarů na AI architekturu pro dlouhý kontext
Společnost Subquadratic, která vyvíjí architektury velkých jazykových modelů s dlouhým kontextem, oznámila spuštění modelu SubQ 1M-Preview. Firma zároveň uzavřela seed kolo financování ve výši 29 milionů dolarů. Zdroj: pulse2.com
Důležitost:Zprávasovereign LLM development
Thajsko spouští AI projekt za 80 milionů bahtů pro vlastní LLM
Thajská vláda připravuje spuštění nového projektu velkého jazykového modelu (LLM) v thajštině. Cílem je zajistit suverenitu země v oblasti umělé inteligence a podpořit její další rozvoj. Zdroj: bangkokpost.com
Málo známý miamský startup Subquadratic se v úterý hlasitě ohlásil světu s odvážným tvrzením: postavil prý první velký jazykový model s dosud nevídanou efektivitou. Výzkumníci jsou skeptičtí a požadují nezávislé ověření těchto výsledků. Zdroj: venturebeat.com
Důležitost:VýzkumLLM inference acceleration on TPUs
3× rychlejší inference LLM na Google TPU díky spekulativnímu dekódování
Nový přístup inspirovaný difuzními modely přináší výrazné zrychlení inference velkých jazykových modelů na Google TPU. Na rozdíl od klasického autoregresivního spekulativního dekódování, kde lehký model předpovídá tokeny, tato metoda dosahuje až trojnásobného zrychlení. Zdroj: developers.googleblog.com
AI překonává lékaře v klinickém uvažování, ale samostatná praxe je zatím sci-fi
Nová studie ukazuje, že velký jazykový model překonal lékaře v řadě úloh zaměřených na klinické uvažování. Autoři výzkumu přesto varují, že technologie zatím není připravena pracovat bez dohledu odborného personálu. Zdroj: techtarget.com
Důležitost:Spuštěnínew LLM startup launch
Subquadratic získal 29 milionů dolarů na kontextová okna o délce 12 milionů tokenů
Startup Subquadratic dnes oznámil svůj vstup na trh s seed investicí ve výši 29 milionů dolarů. Vyvíjí nový typ generativního AI modelu, jehož klíčovou vlastností má být kontextové okno s kapacitou 12 milionů tokenů. Zdroj: siliconangle.com
Důležitost:Názornational LLM strategy
Indie zvažuje vývoj vlastních LLM modelů
Analytici z LiveMint argumentují, že důvody proti budování domácích velkých jazykových modelů (LLM) slábnou a Indie by měla investovat do vlastních řešení. Země tak chce snížit závislost na zahraničních technologiích v oblasti AI. Zdroj: letsdatascience.com
Důležitost:ZprávaLLM deployment/satellite
DPhi Space úspěšně spustil AI jazykový model na orbitální družici
Společnost DPhi Space uvedla do provozu platformu Clustergate-2, která jako první úspěšně provozovala vision-language model přímo na palubě satelitu na oběžné dráze. Jde o průlomový krok pro zpracování dat přímo ve vesmíru bez nutnosti jejich přenosu na Zemi. Zdroj: ggba.swiss