AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

996 článků

Důležitost:ZprávaAI Security

Na darknetu roste prodej ukradených AI účtů, tzv. LLM jacking

Podle deníku Financial Times hackeři stále častěji unášejí firemní účty pro AI modely a cloudové služby a následně je prodávají na darknetu. Trend označovaný jako „LLM jacking“ poukazuje na rostoucí bezpečnostní rizika spojená s firemním nasazením AI. Zdroj: biz.chosun.com

Důležitost:ZprávaAI Benchmarks

KT se svým AI routerem obsadila druhé místo v žebříčku RouterArena

Jihokorejský telekomunikační gigant KT oznámil, že jeho vlastní technologie AutoModelRouter pro směrování AI modelů obsadila druhé místo v celkovém pořadí benchmarku RouterArena. Výsledek potvrzuje rostoucí schopnosti KT v oblasti optimalizace výběru a nasazení AI modelů. Zdroj: businesskorea.co.kr

Důležitost:SpuštěníNational AI Initiatives

Turecko spouští národní AI platformu EVREN pro obranný průmysl

Turecko spustilo novou národní AI platformu s názvem EVREN, jejímž cílem je posílit domácí obranný průmysl. Iniciativa odráží rostoucí vládní investice do AI technologií určených pro vojenské a bezpečnostní účely. Zdroj: dailysabah.com

Důležitost:NázorAI Alignment

Od zákazů k navigaci: jak se mění přístup ke korekci chování generativní AI

Snahy zabránit generativní AI v chybných nebo škodlivých výstupech se posouvají k aktivnějšímu způsobu usměrňování jejího chování. Důraz se přesouvá od prostých zákazů k cílenému vedení AI systémů ke správným rozhodnutím. Zdroj: newelectronics.co.uk

Důležitost:ZprávaLLM security

AI agenti odhalují bezpečnostní mezeru mezi čtením dat a jejich úpravou

Debaty o bezpečnosti AI se obvykle točí kolem samotného modelu – jestli je zarovnaný, odolný vůči jailbreaku nebo jestli nehalucinuje. Rostoucím rizikem je ale propast mezi tím, k jakým datům mají AI agenti přístup, a tím, jaké systémy mohou skutečně měnit. Zdroj: venturebeat.com

Důležitost:Spuštěnímodel routing

KT vyvinula technologii, která automaticky vybírá vhodný AI model

Jihokorejská firma KT vytvořila takzvaný LLM router, který analyzuje uživatelský dotaz a automaticky vybere nejvhodnější AI model pro odpověď. Systém nazvaný Router Arena přitom porovnává výkon různých LLM a podle toho směruje požadavky. Zdroj: mk.co.kr

Důležitost:Zprávamodel benchmarks

KT s technologií AutoModelRouter obsadila druhé místo v benchmarku LLM routerů

Interní nástroj KT nazvaný AutoModelRouter, který automaticky vybírá a směruje dotazy mezi různými AI modely, se umístil na druhém místě ve veřejném benchmarku LLM routerů. Výsledek ukazuje sílící konkurenci v oblasti technologií pro efektivní výběr modelů. Zdroj: biz.chosun.com

Důležitost:VýzkumLLM evaluation

Dokážou LLM spolehlivě automatizovat tvorbu meta-analýz?

Vědci stále častěji testují velké jazykové modely pro úkoly jako interpretace odborné literatury, extrakce dat či podpora statistických analýz při syntéze důkazů. Studie zkoumá, nakolik jsou LLM spolehlivé při automatizované tvorbě meta-analýz. Zdroj: nature.com

Důležitost:ZprávaLLM comparison

Jev vs. LLM: test AI, která místo generování rozhoduje

Nástroj Jev od TypeSafe AI byl otestován na 3080 klasifikačních úlohách, aby se porovnala jeho přesnost, latence, kalibrace a jistota odpovědí s běžnými LLM. Cílem bylo zjistit, zda systém zaměřený na rozhodování dokáže překonat generativní modely ve strukturovaných úkolech. Zdroj: towardsdatascience.com

Důležitost:Zprávamodel deployment challenges

Experti varují: zkreslení modelu je skrytým rizikem pro AI v telekomunikacích

Datový vědec Priyank Jain z Boost Mobile upozorňuje, že telekomunikační odvětví podceňuje nenápadné problémy s daty, které rozhodují o tom, zda AI modely fungují správně. Podle něj si takzvané model skew zaslouží mnohem větší pozornost, než dostává. Zdroj: fiercewireless.com

Důležitost:Zprávamodel selection

Proč mohou malé jazykové modely být lepší volbou pro federální AI

Vládní agentury by mohly ušetřit náklady a získat lepší kontrolu, pokud by velikost modelu volily podle konkrétního úkolu místo automatického sáhnutí po tom největším. Menší, cíleně navržené modely mohou nabídnout srovnatelné výsledky při nižších nákladech a riziku. Zdroj: fedtechmagazine.com

Důležitost:ZprávaLLM societal impact

Jaké jsou širší společenské dopady velkých jazykových modelů?

IBM popisuje velké jazykové modely jako pokročilé AI systémy trénované na obrovských datasetech, aby dokázaly rozumět textu a generovat ho podobně jako člověk. Text se zaměřuje na to, jak jejich masivní rozšíření mění komunikaci, práci i společnost jako celek. Zdroj: daily-sun.com

Důležitost:Výzkummodel architecture

TimeBraid propojuje modely pro časové řady a jazyk kvůli lepším predikcím

Výzkumníci představili TimeBraid, rodinu modelů, které spojují předtrénované jazykové modely se základními modely pro časové řady. Cílem je zkombinovat přednosti obou přístupů a zlepšit tak analýzu i predikci časových dat. Zdroj: alphaxiv.org

Důležitost:Zprávagovernment applications

Proč jsou pro státní správu často výhodnější malé jazykové modely

Federální agentury nemusí vždy sahat po největším dostupném AI modelu — volba velikosti podle konkrétní úlohy může snížit náklady a zlepšit kontrolu nad systémem. Odborníci tvrdí, že tento přístup je pro odpovědné zavádění AI ve státní správě praktičtější. Zdroj: fedtechmagazine.com

Důležitost:ZprávaAI in science

Objev Anthropicu připomínající CRISPR je zajímavý, ale sotva na úrovni Nobelovy ceny

Anthropic oznámil, že jeho model Claude pomohl identifikovat systém úprav genů podobný CRISPR. Komentátoři ale upozorňují, že nejde o převratný vědecký skok, spíš jen o další užitečný nástroj do sbírky metod genového inženýrství. Zdroj: newscientist.com

Důležitost:ZprávaAI ethics

Mohou být jazykové modely etickými poradci pro zdravější urbanismus?

LLM se čím dál častěji využívají k tvorbě textových doporučení v oblasti urbanismu, plánování měst i veřejného zdraví. Jejich rostoucí role vyvolává otázku, zda se dá těmto modelům důvěřovat jako spolehlivým etickým poradcům v tématech ovlivňujících lidský život. Zdroj: techxplore.com

Důležitost:ZprávaAI in healthcare

AI odhaluje skryté souvislosti mezi bylinami a nemocemi ve starých lékařských textech

Tradiční bylinná medicína za tisíce let nahromadila obrovské, ale roztříštěné množství poznatků o tom, které rostliny pomáhají na jaké neduhy. Jazykové modely nyní pomáhají procházet tato kusá historická data a odhalovat dosud skryté souvislosti mezi bylinami a nemocemi. Zdroj: bioengineer.org

Důležitost:ZprávaAI startups

Bývalý výzkumník DeepMind shání miliony na nový startup zaměřený na reasoning

Bývalý výzkumník z DeepMind podle informací shání desítky milionů dolarů pro nový startup Metis Reasoning. Případ ukazuje, že investoři čím dál víc sázejí na přístupy k AI, které jdou nad rámec klasických velkých jazykových modelů. Zdroj: pymnts.com

Důležitost:SpuštěníLLM optimization

Liner spouští API, které firmám sníží náklady na LLM o více než polovinu

Liner představil nové API, které každý požadavek automaticky nasměruje na nejlevnější model schopný úkol zvládnout, místo aby vždy sahal po drahých špičkových modelech. Firma tvrdí, že tento přístup dokáže snížit firemní výdaje na LLM o více než 50 %. Zdroj: manilatimes.net

Důležitost:PolitikaAI evaluation

Tchajwan hodnotí AI modely, zda zemi opravdu rozumí, nejen jazykově

Tchajwanské ministerstvo digitálních záležitostí zveřejnilo výsledky hodnocení tzv. suverénní AI, které má ukázat, zda modely Tchajwan skutečně chápou, nejen umí komunikovat tradiční čínštinou. Cílem je propojit vládu a firmy při budování důvěryhodného lokálního AI ekosystému. Zdroj: moda.gov.tw