Sakana AI spouští japonské LLM API
Sakana AI představila Sakana Namazu, LLM API zaměřené na japonštinu postavené na modelu Kimi K2.6. Služba má lépe rozumět firemnímu kontextu a podporovat agentické nástroje. Zdroj: startuphub.ai
Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
981 článků
Sakana AI představila Sakana Namazu, LLM API zaměřené na japonštinu postavené na modelu Kimi K2.6. Služba má lépe rozumět firemnímu kontextu a podporovat agentické nástroje. Zdroj: startuphub.ai
Podrobná analýza mapuje investiční strategii v AI podporovanou rodinným fondem Wang Huiwena, která pokrývá celý řetězec odvětví – od základního výzkumu technologií až po AI agenty. Zdroj: eu.36kr.com
Evropská komise podle informací zvažuje nahradit americkou technologii v novém digitálním náborovém nástroji evropskými cloudovými a AI alternativami. Zdroj: euractiv.com
Podle zpráv Anthropic vkládá do API požadavků Claude skryté steganografické značky. Vysvětlujeme, co to může znamenat pro vývojáře stavějící na této platformě. Zdroj: sitepoint.com
Advanced Research Computing v říjnu spustilo novou sadu služeb postavených na LLM, kterou nyní mohou využívat všichni studenti, akademici i zaměstnanci. Cílem je zpřístupnit AI nástroje pro výzkum a výuku širší univerzitní komunitě. Zdroj: news.vt.edu
Přehled doporučuje pět knih zaměřených na budování, doladění a nasazení LLM. Hodí se pro ty, kdo chtějí hlouběji proniknout do technické stránky vývoje jazykových modelů. Zdroj: kdnuggets.com
Vědci představili CancerLLM, jazykový model se 7 miliardami parametrů zaměřený speciálně na oblast onkologie. Cílem je zlepšit výkon LLM při úkolech spojených s rakovinou a pomoci lékařům v praxi. Zdroj: nature.com
Nový přehledový text se věnuje inteligentním agentům, dlouhodobému cíli výzkumu AI, ve světle pokroků u velkých jazykových modelů. Popisuje klíčové definice, metody a možný budoucí vývoj agentů založených na LLM. Zdroj: wires.onlinelibrary.wiley.com
Výzkumníci představili ARTEM (Agentic Retrieval with Temporal-Episodic Memory), hybridní architekturu agentů kombinující LLM se samoorganizující se neuronovou pamětí. Cílem je vybavit AI agenty lepší prostorovou a časovou epizodickou pamětí pro přesnější uvažování v kontextu. Zdroj: ojs.aaai.org
Trénování velkých jazykových modelů často narazí na limity paměti GPU dřív, než se plně využije výpočetní výkon, kvůli objemu vah modelu, gradientů a stavů optimizéru. Nové řešení využívá takzvaný host offloading v JAXu ke zmírnění těchto paměťových úzkých hrdel. Zdroj: developer.nvidia.com
S rostoucím rozšířením velkých jazykových modelů se odborníci ptají, které benchmarky vlastně vypovídají něco podstatného. Text hodnotí současné metody testování LLM a jejich limity. Zdroj: cacm.acm.org
Poslední tři roky se výzkum vision-language-action (VLA) modelů opíral o předpoklad, že špičkové robotické AI musí obsahovat velký jazykový model. TurboVLA tento předpoklad zpochybňuje – dosahuje srovnatelných výsledků bez něj a zvládá běžet i na spotřebitelské GPU. Zdroj: techtimes.com
NASA nasadila jazykový model Gemma od Googlu do vesmíru a testuje tak koncept orbitálních datacenter. Otázka, zda takové systémy zvládnou provoz nejrozsáhlejších a nejschopnějších AI modelů, zůstává předmětem sporů. Zdroj: aol.com
Výzkumníci odhalili fundamentální slabinu, díky které lze LLM snadno přimět k tomu, aby dělaly věci, které by neměly – například poradily, jak sabotovat navigační systém letadla. Zdroj: technologyreview.com
Uvolnění modelu Kimi K3 jako open source naznačuje, že strategie vývojářů AI vydávat vysoce optimalizované a výkonné modely veřejně nabírá na síle. Zdroj: eu.36kr.com
Nová vrstva správy nabízí firmám jednotnou, kontrolovanou cestu pro každé volání nástroje, API požadavek, interakci agenta i LLM prompt. Podniky totiž stále více potřebují dohlížet na nástroje a API, které využívají jejich AI agenti. Zdroj: securityboulevard.com
Vývojáři Debianu minulý týden zahájili diskusi o obecné resoluci upravující využívání AI jazykových modelů v projektu. Na stole je nyní pět různých návrhů. Zdroj: phoronix.com
JetBrains zveřejnil experimentální plugin pro IntelliJ IDEA, který umožňuje Kotlin/JVM projektům předávat runtime logiku LLM přímo z Kotlin kódu. Zdroj: infoworld.com
Vývojář konverzačních AI agentů PolyAI Ltd. oznámil model Dialog-RSN-1, který má hovory vedené AI asistenty přiblížit přirozené lidské konverzaci. Zdroj: siliconangle.com
Projekt African Trust & Safety LLM Challenge, podpořený organizací GSMA, představil benchmark s 4 216 ověřenými a reprodukovatelnými testy zaměřenými na bezpečnost AI. Cílem je zaplnit mezery v hodnocení bezpečnosti pro africké jazyky a kulturní kontexty, které dosud existující benchmarky LLM opomíjely. Zdroj: thefastmode.com