Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
705 článků
Důležitost:VýzkumModel optimization
LLM s 28,9 miliony parametrů běží na mikrokontroléru za 8 dolarů
Velké jazykové modely si obvykle spojujeme s výkonnými GPU a stovkami gigabajtů paměti. Tento projekt ale ukazuje, že kompaktní model s 28,9 miliony parametrů zvládne běžet i na levném mikrokontroléru. Zdroj: hackster.io
Důležitost:VýzkumRAG methods
GraphRAG vs. vektorové RAG: kdy se znalostní grafy opravdu vyplatí
Mnoho týmů dnes do svých RAG pipeline automaticky přidává znalostní grafy. Rozbor nedávného výzkumu zkoumá, zda GraphRAG skutečně zlepšuje kvalitu odpovědí oproti klasickému vektorovému RAG. Zdroj: venturebeat.com
Důležitost:VýzkumAI data integration
Pilotní projekty MCP mají propojit LLM s otevřenými datovými portály
Pilotní projekty s vládami Uruguaye a Brazílie testovaly Model Context Protocol (MCP) jako strukturovaný způsob, jak mohou AI systémy přistupovat k aktuálním a spolehlivým otevřeným datům. Zdroj: govinsider.asia
Důležitost:ZprávaNational AI development
Thajsko usiluje o AI suverenitu díky vlastním jazykovým modelům
Thajsko vyvíjí vlastní velké jazykové modely, včetně ThaiLLM pod vedením Big Data Institute, v rámci širší snahy o dosažení AI suverenity. Zdroj: bangkokpost.com
Důležitost:PolitikaEuropean AI strategy
Evropská komise zvažuje nahradit americkou technologii v náborovém nástroji
Evropská komise podle informací zvažuje nahradit americkou technologii v novém digitálním náborovém nástroji evropskými cloudovými a AI alternativami. Zdroj: euractiv.com
Důležitost:ZprávaAI investment
Rodinný fond Wang Huiwena investuje do AI od LLM po AI agenty
Podrobná analýza mapuje investiční strategii v AI podporovanou rodinným fondem Wang Huiwena, která pokrývá celý řetězec odvětví – od základního výzkumu technologií až po AI agenty. Zdroj: eu.36kr.com
Důležitost:SpuštěníLLM release
Sakana AI spouští japonské LLM API
Sakana AI představila Sakana Namazu, LLM API zaměřené na japonštinu postavené na modelu Kimi K2.6. Služba má lépe rozumět firemnímu kontextu a podporovat agentické nástroje. Zdroj: startuphub.ai
Důležitost:ZprávaAPI security
Claude prý skrytě značkuje API požadavky, upozorňují vývojáři
Podle zpráv Anthropic vkládá do API požadavků Claude skryté steganografické značky. Vysvětlujeme, co to může znamenat pro vývojáře stavějící na této platformě. Zdroj: sitepoint.com
Důležitost:Spuštěníacademic access
Advanced Research Computing rozšiřuje přístup k jazykovým modelům
Advanced Research Computing v říjnu spustilo novou sadu služeb postavených na LLM, kterou nyní mohou využívat všichni studenti, akademici i zaměstnanci. Cílem je zpřístupnit AI nástroje pro výzkum a výuku širší univerzitní komunitě. Zdroj: news.vt.edu
Důležitost:Výzkumagents
Pohled na inteligentní agenty poháněné jazykovými modely
Nový přehledový text se věnuje inteligentním agentům, dlouhodobému cíli výzkumu AI, ve světle pokroků u velkých jazykových modelů. Popisuje klíčové definice, metody a možný budoucí vývoj agentů založených na LLM. Zdroj: wires.onlinelibrary.wiley.com
Důležitost:Výzkumtraining optimization
Odlehčení na hostitele řeší nedostatek GPU paměti při trénování LLM v JAXu
Trénování velkých jazykových modelů často narazí na limity paměti GPU dřív, než se plně využije výpočetní výkon, kvůli objemu vah modelu, gradientů a stavů optimizéru. Nové řešení využívá takzvaný host offloading v JAXu ke zmírnění těchto paměťových úzkých hrdel. Zdroj: developer.nvidia.com
Důležitost:Výzkumagents
ARTEM dává agentům s LLM smysl pro prostor a čas
Výzkumníci představili ARTEM (Agentic Retrieval with Temporal-Episodic Memory), hybridní architekturu agentů kombinující LLM se samoorganizující se neuronovou pamětí. Cílem je vybavit AI agenty lepší prostorovou a časovou epizodickou pamětí pro přesnější uvažování v kontextu. Zdroj: ojs.aaai.org
Důležitost:Výzkummedical applications
CancerLLM: nový jazykový model určený pro onkologii
Vědci představili CancerLLM, jazykový model se 7 miliardami parametrů zaměřený speciálně na oblast onkologie. Cílem je zlepšit výkon LLM při úkolech spojených s rakovinou a pomoci lékařům v praxi. Zdroj: nature.com
Důležitost:Zprávabenchmarks
Jak skutečně měřit výkon jazykových modelů
S rostoucím rozšířením velkých jazykových modelů se odborníci ptají, které benchmarky vlastně vypovídají něco podstatného. Text hodnotí současné metody testování LLM a jejich limity. Zdroj: cacm.acm.org
Důležitost:Zprávaresources
Pět knih, které vám pomohou lépe pochopit jazykové modely
Přehled doporučuje pět knih zaměřených na budování, doladění a nasazení LLM. Hodí se pro ty, kdo chtějí hlouběji proniknout do technické stránky vývoje jazykových modelů. Zdroj: kdnuggets.com
Důležitost:ZprávaLLM security vulnerability
Zásadní chyba dělá z LLM snadný terč pro útoky
Výzkumníci odhalili fundamentální slabinu, díky které lze LLM snadno přimět k tomu, aby dělaly věci, které by neměly – například poradily, jak sabotovat navigační systém letadla. Zdroj: technologyreview.com
Důležitost:Zprávarobotics AI model
TurboVLA dosahuje výkonu 7B robotického AI bez jazykového modelu, běží na 32 Hz na běžné GPU
Poslední tři roky se výzkum vision-language-action (VLA) modelů opíral o předpoklad, že špičkové robotické AI musí obsahovat velký jazykový model. TurboVLA tento předpoklad zpochybňuje – dosahuje srovnatelných výsledků bez něj a zvládá běžet i na spotřebitelské GPU. Zdroj: techtimes.com
Důležitost:Zprávaspace LLM deployment
NASA vyslala Google Gemma model na oběžnou dráhu
NASA nasadila jazykový model Gemma od Googlu do vesmíru a testuje tak koncept orbitálních datacenter. Otázka, zda takové systémy zvládnou provoz nejrozsáhlejších a nejschopnějších AI modelů, zůstává předmětem sporů. Zdroj: aol.com
Důležitost:Spuštěníconversational AI
PolyAI představil nový hlasový model pro přirozenější AI hovory v reálném čase
Vývojář konverzačních AI agentů PolyAI Ltd. oznámil model Dialog-RSN-1, který má hovory vedené AI asistenty přiblížit přirozené lidské konverzaci. Zdroj: siliconangle.com
Důležitost:Zprávaopen-source models
Po open-source vydání Kimi K3 se otevřené špičkové modely zdají reálnější
Uvolnění modelu Kimi K3 jako open source naznačuje, že strategie vývojářů AI vydávat vysoce optimalizované a výkonné modely veřejně nabírá na síle. Zdroj: eu.36kr.com