AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

981 článků

Důležitost:SpuštěníLLM release

Sakana AI spouští japonské LLM API

Sakana AI představila Sakana Namazu, LLM API zaměřené na japonštinu postavené na modelu Kimi K2.6. Služba má lépe rozumět firemnímu kontextu a podporovat agentické nástroje. Zdroj: startuphub.ai

Důležitost:ZprávaAI investment

Rodinný fond Wang Huiwena investuje do AI od LLM po AI agenty

Podrobná analýza mapuje investiční strategii v AI podporovanou rodinným fondem Wang Huiwena, která pokrývá celý řetězec odvětví – od základního výzkumu technologií až po AI agenty. Zdroj: eu.36kr.com

Důležitost:PolitikaEuropean AI strategy

Evropská komise zvažuje nahradit americkou technologii v náborovém nástroji

Evropská komise podle informací zvažuje nahradit americkou technologii v novém digitálním náborovém nástroji evropskými cloudovými a AI alternativami. Zdroj: euractiv.com

Důležitost:ZprávaAPI security

Claude prý skrytě značkuje API požadavky, upozorňují vývojáři

Podle zpráv Anthropic vkládá do API požadavků Claude skryté steganografické značky. Vysvětlujeme, co to může znamenat pro vývojáře stavějící na této platformě. Zdroj: sitepoint.com

Důležitost:Spuštěníacademic access

Advanced Research Computing rozšiřuje přístup k jazykovým modelům

Advanced Research Computing v říjnu spustilo novou sadu služeb postavených na LLM, kterou nyní mohou využívat všichni studenti, akademici i zaměstnanci. Cílem je zpřístupnit AI nástroje pro výzkum a výuku širší univerzitní komunitě. Zdroj: news.vt.edu

Důležitost:Zprávaresources

Pět knih, které vám pomohou lépe pochopit jazykové modely

Přehled doporučuje pět knih zaměřených na budování, doladění a nasazení LLM. Hodí se pro ty, kdo chtějí hlouběji proniknout do technické stránky vývoje jazykových modelů. Zdroj: kdnuggets.com

Důležitost:Výzkummedical applications

CancerLLM: nový jazykový model určený pro onkologii

Vědci představili CancerLLM, jazykový model se 7 miliardami parametrů zaměřený speciálně na oblast onkologie. Cílem je zlepšit výkon LLM při úkolech spojených s rakovinou a pomoci lékařům v praxi. Zdroj: nature.com

Důležitost:Výzkumagents

Pohled na inteligentní agenty poháněné jazykovými modely

Nový přehledový text se věnuje inteligentním agentům, dlouhodobému cíli výzkumu AI, ve světle pokroků u velkých jazykových modelů. Popisuje klíčové definice, metody a možný budoucí vývoj agentů založených na LLM. Zdroj: wires.onlinelibrary.wiley.com

Důležitost:Výzkumagents

ARTEM dává agentům s LLM smysl pro prostor a čas

Výzkumníci představili ARTEM (Agentic Retrieval with Temporal-Episodic Memory), hybridní architekturu agentů kombinující LLM se samoorganizující se neuronovou pamětí. Cílem je vybavit AI agenty lepší prostorovou a časovou epizodickou pamětí pro přesnější uvažování v kontextu. Zdroj: ojs.aaai.org

Důležitost:Výzkumtraining optimization

Odlehčení na hostitele řeší nedostatek GPU paměti při trénování LLM v JAXu

Trénování velkých jazykových modelů často narazí na limity paměti GPU dřív, než se plně využije výpočetní výkon, kvůli objemu vah modelu, gradientů a stavů optimizéru. Nové řešení využívá takzvaný host offloading v JAXu ke zmírnění těchto paměťových úzkých hrdel. Zdroj: developer.nvidia.com

Důležitost:Zprávabenchmarks

Jak skutečně měřit výkon jazykových modelů

S rostoucím rozšířením velkých jazykových modelů se odborníci ptají, které benchmarky vlastně vypovídají něco podstatného. Text hodnotí současné metody testování LLM a jejich limity. Zdroj: cacm.acm.org

Důležitost:Zprávarobotics AI model

TurboVLA dosahuje výkonu 7B robotického AI bez jazykového modelu, běží na 32 Hz na běžné GPU

Poslední tři roky se výzkum vision-language-action (VLA) modelů opíral o předpoklad, že špičkové robotické AI musí obsahovat velký jazykový model. TurboVLA tento předpoklad zpochybňuje – dosahuje srovnatelných výsledků bez něj a zvládá běžet i na spotřebitelské GPU. Zdroj: techtimes.com

Důležitost:Zprávaspace LLM deployment

NASA vyslala Google Gemma model na oběžnou dráhu

NASA nasadila jazykový model Gemma od Googlu do vesmíru a testuje tak koncept orbitálních datacenter. Otázka, zda takové systémy zvládnou provoz nejrozsáhlejších a nejschopnějších AI modelů, zůstává předmětem sporů. Zdroj: aol.com

Důležitost:ZprávaLLM security vulnerability

Zásadní chyba dělá z LLM snadný terč pro útoky

Výzkumníci odhalili fundamentální slabinu, díky které lze LLM snadno přimět k tomu, aby dělaly věci, které by neměly – například poradily, jak sabotovat navigační systém letadla. Zdroj: technologyreview.com

Důležitost:Zprávaopen-source models

Po open-source vydání Kimi K3 se otevřené špičkové modely zdají reálnější

Uvolnění modelu Kimi K3 jako open source naznačuje, že strategie vývojářů AI vydávat vysoce optimalizované a výkonné modely veřejně nabírá na síle. Zdroj: eu.36kr.com

Důležitost:SpuštěníLLM security

Cequence AI Gateway zavádí správu LLM a řeší bezpečnostní mezery v přístupu k modelům

Nová vrstva správy nabízí firmám jednotnou, kontrolovanou cestu pro každé volání nástroje, API požadavek, interakci agenta i LLM prompt. Podniky totiž stále více potřebují dohlížet na nástroje a API, které využívají jejich AI agenti. Zdroj: securityboulevard.com

Důležitost:PolitikaLLM usage policy

Debian zvažuje pět návrhů týkajících se používání AI a LLM v projektu

Vývojáři Debianu minulý týden zahájili diskusi o obecné resoluci upravující využívání AI jazykových modelů v projektu. Na stole je nyní pět různých návrhů. Zdroj: phoronix.com

Důležitost:SpuštěníLLM runtime tool

JetBrains uvolnil KotlinLLM, generátor kódu pro runtime, jako open source

JetBrains zveřejnil experimentální plugin pro IntelliJ IDEA, který umožňuje Kotlin/JVM projektům předávat runtime logiku LLM přímo z Kotlin kódu. Zdroj: infoworld.com

Důležitost:Spuštěníconversational AI

PolyAI představil nový hlasový model pro přirozenější AI hovory v reálném čase

Vývojář konverzačních AI agentů PolyAI Ltd. oznámil model Dialog-RSN-1, který má hovory vedené AI asistenty přiblížit přirozené lidské konverzaci. Zdroj: siliconangle.com

Důležitost:Výzkumbenchmarks

Nový africký benchmark testuje bezpečnost AI napříč jazyky

Projekt African Trust & Safety LLM Challenge, podpořený organizací GSMA, představil benchmark s 4 216 ověřenými a reprodukovatelnými testy zaměřenými na bezpečnost AI. Cílem je zaplnit mezery v hodnocení bezpečnosti pro africké jazyky a kulturní kontexty, které dosud existující benchmarky LLM opomíjely. Zdroj: thefastmode.com