Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
981 článků
Důležitost:Výzkumpricing
Proč rovná cena za token u LLM API po 200 tisících tokenech neplatí
Vývojáři si často myslí, že ceny za token u LLM API zůstávají konstantní bez ohledu na velikost kontextu. Ve skutečnosti se ale náklady po překročení zhruba 200 tisíc tokenů začínají odstupňovat. Zdroj: sitepoint.com
Důležitost:Spuštěníeducation
Vespin Global uzavírá alianci pro AI ve vzdělávání spojující lokální LLM s agentní technologií
Firma Vespin Global, specializující se na AI služby, podepsala strategické partnerství zaměřené na vzdělávací AI. Aliance kombinuje domácí jazykové modely s agentní AI technologií a chce jejich využití ve vzdělávání dále rozšířit. Zdroj: mk.co.kr
Důležitost:Spuštěnícertification
Anthropic rozšiřuje certifikační program Claude o nové bezpečnostní certifikace
Anthropic rozšiřuje své školení partnerů pro Claude o certifikace zaměřené na bezpečnost. Reaguje tak na rostoucí poptávku po odbornících se zkušenostmi s AI systémy. Zdroj: channele2e.com
Důležitost:Spuštěnífoundation models
Nuance Labs získává 50 milionů dolarů na foundation model pro lidskou komunikaci
Startup Nuance Labs si v kole Series A vedeném Lightspeed Venture Partners zajistil 50 milionů dolarů, mezi novými investory je i NVIDIA. Peníze půjdou na vývoj obousměrného foundation modelu, který dokáže číst mimiku obličeje a další prvky lidského projevu. Zdroj: en.wowtale.net
Důležitost:ZprávaOpenAI products
Zvrat u hlasové vrstvy: GPT-Live-1 od OpenAI přesouvá moc k orchestračním platformám
Za pouhých 0,05 dolaru za minutu mění GPT-Live-1 od OpenAI hlasové AI v levnou komoditu a konkurenční boj se přesouvá na vyšší, orchestrační vrstvu. Kdo tuto vrstvu ovládne, získá podle analýzy většinu budoucí hodnoty. Zdroj: forkast.news
Důležitost:VýzkumLLM uncertainty
LLM se učí přiznat nejistotu a stávají se nástroji pro vědecký výzkum
Nový článek v Nature Machine Intelligence tvrdí, že velké jazykové modely by se mohly stát užitečnými partnery ve vědeckých laboratořích, pokud budou umět rozpoznat hranice vlastních znalostí. Autoři navrhují, že LLM kalibrované na nejistotu by mohly pomáhat s vědeckým objevováním místo pouhého generování sebejistě znějících, ale nespolehlivých odpovědí. Zdroj: bioengineer.org
Důležitost:ZprávaAI agents
Dlouhoběžící AI agenti tiše porušují pravidla, větší kontextová okna to nevyřeší
Nasazení AI agenta na několikadenní úkol validace dat zní efektivně, jenže agent se postupně odchyluje od původního zadání. Podle výzkumníků agenti při zpracování tisíců záznamů v průběhu dnů nenápadně přestávají dodržovat stanovená pravidla a pouhé zvětšování kontextového okna tento problém neřeší. Zdroj: venturebeat.com
Důležitost:VýzkumLLM research
Fly Language Model propojil kompletní mapu mušího mozku s LLM, vlastní testy ale nenašly žádný přínos
Fly Language Model spojuje kompletní konektom mozku octomilky (MaleCNS) se zamrzlým modelem LFM2.5-1.2B. Kontrolní experimenty výzkumníků ale ukázaly, že přidání muší neuronové struktury nepřineslo žádné měřitelné zlepšení. Zdroj: marktechpost.com
Důležitost:SpuštěníAI hardware
Qualcomm představil novou Hexagon NPU pro nepřetržité agentní AI
Qualcomm 10. září uvedl novou generaci neuronového procesoru Hexagon, určenou pro nepřetržitý provoz agentního AI přímo v zařízeních. Čip má zajistit AI úlohy běžící trvale na pozadí, nikoli jen na vyžádání. Zdroj: thelec.net
Důležitost:ZprávaEdge AI
Malý LLM pohání virtuální akvárium
Spustit velký jazykový model na mikrokontroleru je samo o sobě technický oříšek, a najít pro takto omezený model smysluplné využití je ještě těžší. Jeden projekt to vyřešil tím, že malý LLM pohání simulaci virtuálního akvária. Zdroj: hackster.io
Důležitost:ZprávaAI assistants
Jak kontextově uvědomělí AI asistenti odhadují, co uživatel potřebuje dál
Kontextově uvědomělí AI asistenti kombinují RAG, živá data, paměť, API, firemní pravidla a další nástroje, aby předvídali další krok uživatele. Díky tomu se posouvají od jednoduchých odpovědí k proaktivnímu a situačně relevantnímu doporučování. Zdroj: nerdbot.com
Důležitost:ZprávaAnthropic
Anthropic vytvořil nástroj pro simulaci dopadu AI na americkou ekonomiku
Anthropic, firma stojící za asistentem Claude, představila interaktivní nástroj, který má ukázat, jak by AI mohla ovlivnit americkou ekonomiku. Nástroj má pomoci tvůrcům politik i veřejnosti představit si možné dopady na jednotlivá odvětví a pracovní místa. Zdroj: kqed.org
Důležitost:Výzkummodel optimization
Sedmnáctiletý student z Portlandu naučil menší AI modely větší empatii
Středoškolák Henry Xie vyvinul metodu, jak přenést empatické vlastnosti z velkých AI modelů do menších, v rámci svého projektu pro soutěž Regeneron Science Talent Search. Jeho výzkum ukazuje, jak si i kompaktní modely mohou zachovat lidštější porozumění emocím bez nutnosti výkonu velkých systémů. Zdroj: m.economictimes.com
Důležitost:ZprávaChinese AI models
Čínské AI modely získávají na popularitě jako levnější alternativa
Velké jazykové modely vyvinuté v Číně si získávají čím dál větší oblibu u amerických i celosvětových technologických firem hledajících levnější řešení. Jejich rostoucí využití naznačuje, že čínský AI průmysl se může stávat skutečným globálním konkurentem. Zdroj: kraneshares.com
Důležitost:VýzkumLLM applications
Nový nástroj dokáže detekovat osobní údaje pomocí libovolného LLM
Představený systém nabízí konfigurovatelnou detekci osobních údajů založenou na instrukcích, kterou lze spustit na libovolném velkém jazykovém modelu dostupném přes Amazon Bedrock. Nástroj byl otestován na pěti veřejných datových sadách zaměřených na osobní údaje. Zdroj: aws.amazon.com
Důležitost:ZprávaAI security
Výzkumník: Uniklých 6TB logů z čínského LLM routeru obsahovalo firemní přihlašovací údaje
Bezpečnostní výzkumník Chaofan Shou uvedl, že získal přibližně 6TB logů ze čínské přeposílací služby pro velké jazykové modely. Podle něj data obsahovala citlivé informace včetně SSH klíčů a přístupových údajů ke cloudovým službám patřícím firemním uživatelům. Zdroj: pandaily.com
Důležitost:SpuštěníLLM integration
RingCentral spouští plugin pro ChatGPT a konektory MCP pro lepší přístup LLM
Komunikační platforma RingCentral představila nový plugin, který umožňuje velkým jazykovým modelům pracovat s jejími daty z hlasových hovorů, SMS a chatů. Cílem je zlepšit schopnost AI nástrojů zpracovávat a reagovat na firemní komunikaci. Zdroj: telecompaper.com
Důležitost:Zprávamodel releases
Nový AI model s GPT-6 v základu vede žebříčky v predikci protilátek, srovnávají ho s AlphaFold
Nový AI systém postavený na GPT-6 se údajně dostal na první místo v predikci struktury protilátek, což vyvolává srovnání s přelomovým dopadem AlphaFold na obor proteinové biologie. Jde o výrazný posun ve využití velkých jazykových modelů v počítačové biologii. Zdroj: eu.36kr.com
Důležitost:Zprávasecurity
Výzkumníci varují: AI workflow lze zneužít k úniku dat i bez jailbreaku modelu
Bezpečnostní experti upozorňují, že firemní AI workflow mohou být zneužity k odcizení citlivých dat i bez prompt injection, útoku na účet nebo jailbreaku samotného modelu. Problém prý spočívá v tom, jak AI systémy zacházejí s privilegovaným přístupem v rámci automatizovaných procesů. Zdroj: cybersecuritynews.com
Důležitost:Zprávamodel development
BIT Computer a AWS spojily síly na vývoji LLM pro korejské zdravotnictví
Jihokorejská firma BIT Computer oznámila spolupráci s Amazon Web Services na vývoji velkého jazykového modelu určeného pro zdravotnický sektor. Cílem je nasadit AI nástroje do korejských zdravotnických služeb. Zdroj: koreabiomed.com