AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

981 článků

Důležitost:Výzkumpricing

Proč rovná cena za token u LLM API po 200 tisících tokenech neplatí

Vývojáři si často myslí, že ceny za token u LLM API zůstávají konstantní bez ohledu na velikost kontextu. Ve skutečnosti se ale náklady po překročení zhruba 200 tisíc tokenů začínají odstupňovat. Zdroj: sitepoint.com

Důležitost:Spuštěníeducation

Vespin Global uzavírá alianci pro AI ve vzdělávání spojující lokální LLM s agentní technologií

Firma Vespin Global, specializující se na AI služby, podepsala strategické partnerství zaměřené na vzdělávací AI. Aliance kombinuje domácí jazykové modely s agentní AI technologií a chce jejich využití ve vzdělávání dále rozšířit. Zdroj: mk.co.kr

Důležitost:Spuštěnícertification

Anthropic rozšiřuje certifikační program Claude o nové bezpečnostní certifikace

Anthropic rozšiřuje své školení partnerů pro Claude o certifikace zaměřené na bezpečnost. Reaguje tak na rostoucí poptávku po odbornících se zkušenostmi s AI systémy. Zdroj: channele2e.com

Důležitost:Spuštěnífoundation models

Nuance Labs získává 50 milionů dolarů na foundation model pro lidskou komunikaci

Startup Nuance Labs si v kole Series A vedeném Lightspeed Venture Partners zajistil 50 milionů dolarů, mezi novými investory je i NVIDIA. Peníze půjdou na vývoj obousměrného foundation modelu, který dokáže číst mimiku obličeje a další prvky lidského projevu. Zdroj: en.wowtale.net

Důležitost:ZprávaOpenAI products

Zvrat u hlasové vrstvy: GPT-Live-1 od OpenAI přesouvá moc k orchestračním platformám

Za pouhých 0,05 dolaru za minutu mění GPT-Live-1 od OpenAI hlasové AI v levnou komoditu a konkurenční boj se přesouvá na vyšší, orchestrační vrstvu. Kdo tuto vrstvu ovládne, získá podle analýzy většinu budoucí hodnoty. Zdroj: forkast.news

Důležitost:VýzkumLLM uncertainty

LLM se učí přiznat nejistotu a stávají se nástroji pro vědecký výzkum

Nový článek v Nature Machine Intelligence tvrdí, že velké jazykové modely by se mohly stát užitečnými partnery ve vědeckých laboratořích, pokud budou umět rozpoznat hranice vlastních znalostí. Autoři navrhují, že LLM kalibrované na nejistotu by mohly pomáhat s vědeckým objevováním místo pouhého generování sebejistě znějících, ale nespolehlivých odpovědí. Zdroj: bioengineer.org

Důležitost:ZprávaAI agents

Dlouhoběžící AI agenti tiše porušují pravidla, větší kontextová okna to nevyřeší

Nasazení AI agenta na několikadenní úkol validace dat zní efektivně, jenže agent se postupně odchyluje od původního zadání. Podle výzkumníků agenti při zpracování tisíců záznamů v průběhu dnů nenápadně přestávají dodržovat stanovená pravidla a pouhé zvětšování kontextového okna tento problém neřeší. Zdroj: venturebeat.com

Důležitost:VýzkumLLM research

Fly Language Model propojil kompletní mapu mušího mozku s LLM, vlastní testy ale nenašly žádný přínos

Fly Language Model spojuje kompletní konektom mozku octomilky (MaleCNS) se zamrzlým modelem LFM2.5-1.2B. Kontrolní experimenty výzkumníků ale ukázaly, že přidání muší neuronové struktury nepřineslo žádné měřitelné zlepšení. Zdroj: marktechpost.com

Důležitost:SpuštěníAI hardware

Qualcomm představil novou Hexagon NPU pro nepřetržité agentní AI

Qualcomm 10. září uvedl novou generaci neuronového procesoru Hexagon, určenou pro nepřetržitý provoz agentního AI přímo v zařízeních. Čip má zajistit AI úlohy běžící trvale na pozadí, nikoli jen na vyžádání. Zdroj: thelec.net

Důležitost:ZprávaEdge AI

Malý LLM pohání virtuální akvárium

Spustit velký jazykový model na mikrokontroleru je samo o sobě technický oříšek, a najít pro takto omezený model smysluplné využití je ještě těžší. Jeden projekt to vyřešil tím, že malý LLM pohání simulaci virtuálního akvária. Zdroj: hackster.io

Důležitost:ZprávaAI assistants

Jak kontextově uvědomělí AI asistenti odhadují, co uživatel potřebuje dál

Kontextově uvědomělí AI asistenti kombinují RAG, živá data, paměť, API, firemní pravidla a další nástroje, aby předvídali další krok uživatele. Díky tomu se posouvají od jednoduchých odpovědí k proaktivnímu a situačně relevantnímu doporučování. Zdroj: nerdbot.com

Důležitost:ZprávaAnthropic

Anthropic vytvořil nástroj pro simulaci dopadu AI na americkou ekonomiku

Anthropic, firma stojící za asistentem Claude, představila interaktivní nástroj, který má ukázat, jak by AI mohla ovlivnit americkou ekonomiku. Nástroj má pomoci tvůrcům politik i veřejnosti představit si možné dopady na jednotlivá odvětví a pracovní místa. Zdroj: kqed.org

Důležitost:Výzkummodel optimization

Sedmnáctiletý student z Portlandu naučil menší AI modely větší empatii

Středoškolák Henry Xie vyvinul metodu, jak přenést empatické vlastnosti z velkých AI modelů do menších, v rámci svého projektu pro soutěž Regeneron Science Talent Search. Jeho výzkum ukazuje, jak si i kompaktní modely mohou zachovat lidštější porozumění emocím bez nutnosti výkonu velkých systémů. Zdroj: m.economictimes.com

Důležitost:ZprávaChinese AI models

Čínské AI modely získávají na popularitě jako levnější alternativa

Velké jazykové modely vyvinuté v Číně si získávají čím dál větší oblibu u amerických i celosvětových technologických firem hledajících levnější řešení. Jejich rostoucí využití naznačuje, že čínský AI průmysl se může stávat skutečným globálním konkurentem. Zdroj: kraneshares.com

Důležitost:VýzkumLLM applications

Nový nástroj dokáže detekovat osobní údaje pomocí libovolného LLM

Představený systém nabízí konfigurovatelnou detekci osobních údajů založenou na instrukcích, kterou lze spustit na libovolném velkém jazykovém modelu dostupném přes Amazon Bedrock. Nástroj byl otestován na pěti veřejných datových sadách zaměřených na osobní údaje. Zdroj: aws.amazon.com

Důležitost:ZprávaAI security

Výzkumník: Uniklých 6TB logů z čínského LLM routeru obsahovalo firemní přihlašovací údaje

Bezpečnostní výzkumník Chaofan Shou uvedl, že získal přibližně 6TB logů ze čínské přeposílací služby pro velké jazykové modely. Podle něj data obsahovala citlivé informace včetně SSH klíčů a přístupových údajů ke cloudovým službám patřícím firemním uživatelům. Zdroj: pandaily.com

Důležitost:SpuštěníLLM integration

RingCentral spouští plugin pro ChatGPT a konektory MCP pro lepší přístup LLM

Komunikační platforma RingCentral představila nový plugin, který umožňuje velkým jazykovým modelům pracovat s jejími daty z hlasových hovorů, SMS a chatů. Cílem je zlepšit schopnost AI nástrojů zpracovávat a reagovat na firemní komunikaci. Zdroj: telecompaper.com

Důležitost:Zprávamodel releases

Nový AI model s GPT-6 v základu vede žebříčky v predikci protilátek, srovnávají ho s AlphaFold

Nový AI systém postavený na GPT-6 se údajně dostal na první místo v predikci struktury protilátek, což vyvolává srovnání s přelomovým dopadem AlphaFold na obor proteinové biologie. Jde o výrazný posun ve využití velkých jazykových modelů v počítačové biologii. Zdroj: eu.36kr.com

Důležitost:Zprávasecurity

Výzkumníci varují: AI workflow lze zneužít k úniku dat i bez jailbreaku modelu

Bezpečnostní experti upozorňují, že firemní AI workflow mohou být zneužity k odcizení citlivých dat i bez prompt injection, útoku na účet nebo jailbreaku samotného modelu. Problém prý spočívá v tom, jak AI systémy zacházejí s privilegovaným přístupem v rámci automatizovaných procesů. Zdroj: cybersecuritynews.com

Důležitost:Zprávamodel development

BIT Computer a AWS spojily síly na vývoji LLM pro korejské zdravotnictví

Jihokorejská firma BIT Computer oznámila spolupráci s Amazon Web Services na vývoji velkého jazykového modelu určeného pro zdravotnický sektor. Cílem je nasadit AI nástroje do korejských zdravotnických služeb. Zdroj: koreabiomed.com