AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

705 článků

Důležitost:VýzkumModel optimization

LLM s 28,9 miliony parametrů běží na mikrokontroléru za 8 dolarů

Velké jazykové modely si obvykle spojujeme s výkonnými GPU a stovkami gigabajtů paměti. Tento projekt ale ukazuje, že kompaktní model s 28,9 miliony parametrů zvládne běžet i na levném mikrokontroléru. Zdroj: hackster.io

Důležitost:VýzkumRAG methods

GraphRAG vs. vektorové RAG: kdy se znalostní grafy opravdu vyplatí

Mnoho týmů dnes do svých RAG pipeline automaticky přidává znalostní grafy. Rozbor nedávného výzkumu zkoumá, zda GraphRAG skutečně zlepšuje kvalitu odpovědí oproti klasickému vektorovému RAG. Zdroj: venturebeat.com

Důležitost:VýzkumAI data integration

Pilotní projekty MCP mají propojit LLM s otevřenými datovými portály

Pilotní projekty s vládami Uruguaye a Brazílie testovaly Model Context Protocol (MCP) jako strukturovaný způsob, jak mohou AI systémy přistupovat k aktuálním a spolehlivým otevřeným datům. Zdroj: govinsider.asia

Důležitost:ZprávaNational AI development

Thajsko usiluje o AI suverenitu díky vlastním jazykovým modelům

Thajsko vyvíjí vlastní velké jazykové modely, včetně ThaiLLM pod vedením Big Data Institute, v rámci širší snahy o dosažení AI suverenity. Zdroj: bangkokpost.com

Důležitost:PolitikaEuropean AI strategy

Evropská komise zvažuje nahradit americkou technologii v náborovém nástroji

Evropská komise podle informací zvažuje nahradit americkou technologii v novém digitálním náborovém nástroji evropskými cloudovými a AI alternativami. Zdroj: euractiv.com

Důležitost:ZprávaAI investment

Rodinný fond Wang Huiwena investuje do AI od LLM po AI agenty

Podrobná analýza mapuje investiční strategii v AI podporovanou rodinným fondem Wang Huiwena, která pokrývá celý řetězec odvětví – od základního výzkumu technologií až po AI agenty. Zdroj: eu.36kr.com

Důležitost:SpuštěníLLM release

Sakana AI spouští japonské LLM API

Sakana AI představila Sakana Namazu, LLM API zaměřené na japonštinu postavené na modelu Kimi K2.6. Služba má lépe rozumět firemnímu kontextu a podporovat agentické nástroje. Zdroj: startuphub.ai

Důležitost:ZprávaAPI security

Claude prý skrytě značkuje API požadavky, upozorňují vývojáři

Podle zpráv Anthropic vkládá do API požadavků Claude skryté steganografické značky. Vysvětlujeme, co to může znamenat pro vývojáře stavějící na této platformě. Zdroj: sitepoint.com

Důležitost:Spuštěníacademic access

Advanced Research Computing rozšiřuje přístup k jazykovým modelům

Advanced Research Computing v říjnu spustilo novou sadu služeb postavených na LLM, kterou nyní mohou využívat všichni studenti, akademici i zaměstnanci. Cílem je zpřístupnit AI nástroje pro výzkum a výuku širší univerzitní komunitě. Zdroj: news.vt.edu

Důležitost:Výzkumagents

Pohled na inteligentní agenty poháněné jazykovými modely

Nový přehledový text se věnuje inteligentním agentům, dlouhodobému cíli výzkumu AI, ve světle pokroků u velkých jazykových modelů. Popisuje klíčové definice, metody a možný budoucí vývoj agentů založených na LLM. Zdroj: wires.onlinelibrary.wiley.com

Důležitost:Výzkumtraining optimization

Odlehčení na hostitele řeší nedostatek GPU paměti při trénování LLM v JAXu

Trénování velkých jazykových modelů často narazí na limity paměti GPU dřív, než se plně využije výpočetní výkon, kvůli objemu vah modelu, gradientů a stavů optimizéru. Nové řešení využívá takzvaný host offloading v JAXu ke zmírnění těchto paměťových úzkých hrdel. Zdroj: developer.nvidia.com

Důležitost:Výzkumagents

ARTEM dává agentům s LLM smysl pro prostor a čas

Výzkumníci představili ARTEM (Agentic Retrieval with Temporal-Episodic Memory), hybridní architekturu agentů kombinující LLM se samoorganizující se neuronovou pamětí. Cílem je vybavit AI agenty lepší prostorovou a časovou epizodickou pamětí pro přesnější uvažování v kontextu. Zdroj: ojs.aaai.org

Důležitost:Výzkummedical applications

CancerLLM: nový jazykový model určený pro onkologii

Vědci představili CancerLLM, jazykový model se 7 miliardami parametrů zaměřený speciálně na oblast onkologie. Cílem je zlepšit výkon LLM při úkolech spojených s rakovinou a pomoci lékařům v praxi. Zdroj: nature.com

Důležitost:Zprávabenchmarks

Jak skutečně měřit výkon jazykových modelů

S rostoucím rozšířením velkých jazykových modelů se odborníci ptají, které benchmarky vlastně vypovídají něco podstatného. Text hodnotí současné metody testování LLM a jejich limity. Zdroj: cacm.acm.org

Důležitost:Zprávaresources

Pět knih, které vám pomohou lépe pochopit jazykové modely

Přehled doporučuje pět knih zaměřených na budování, doladění a nasazení LLM. Hodí se pro ty, kdo chtějí hlouběji proniknout do technické stránky vývoje jazykových modelů. Zdroj: kdnuggets.com

Důležitost:ZprávaLLM security vulnerability

Zásadní chyba dělá z LLM snadný terč pro útoky

Výzkumníci odhalili fundamentální slabinu, díky které lze LLM snadno přimět k tomu, aby dělaly věci, které by neměly – například poradily, jak sabotovat navigační systém letadla. Zdroj: technologyreview.com

Důležitost:Zprávarobotics AI model

TurboVLA dosahuje výkonu 7B robotického AI bez jazykového modelu, běží na 32 Hz na běžné GPU

Poslední tři roky se výzkum vision-language-action (VLA) modelů opíral o předpoklad, že špičkové robotické AI musí obsahovat velký jazykový model. TurboVLA tento předpoklad zpochybňuje – dosahuje srovnatelných výsledků bez něj a zvládá běžet i na spotřebitelské GPU. Zdroj: techtimes.com

Důležitost:Zprávaspace LLM deployment

NASA vyslala Google Gemma model na oběžnou dráhu

NASA nasadila jazykový model Gemma od Googlu do vesmíru a testuje tak koncept orbitálních datacenter. Otázka, zda takové systémy zvládnou provoz nejrozsáhlejších a nejschopnějších AI modelů, zůstává předmětem sporů. Zdroj: aol.com

Důležitost:Spuštěníconversational AI

PolyAI představil nový hlasový model pro přirozenější AI hovory v reálném čase

Vývojář konverzačních AI agentů PolyAI Ltd. oznámil model Dialog-RSN-1, který má hovory vedené AI asistenty přiblížit přirozené lidské konverzaci. Zdroj: siliconangle.com

Důležitost:Zprávaopen-source models

Po open-source vydání Kimi K3 se otevřené špičkové modely zdají reálnější

Uvolnění modelu Kimi K3 jako open source naznačuje, že strategie vývojářů AI vydávat vysoce optimalizované a výkonné modely veřejně nabírá na síle. Zdroj: eu.36kr.com