Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
981 článků
Důležitost:Spuštěnímodel release
Meta tvrdí, že model Muse Spark 1.3 dohnal Anthropic i OpenAI
Meta představila Muse Spark 1.3, svůj dosud nejvýkonnější AI model, a tvrdí, že se jím vyrovnala špičce v podobě Anthropicu a OpenAI. Firma tak dává najevo ambici srovnat krok v souboji o nejlepší velké jazykové modely. Zdroj: siliconangle.com
Nová metoda rekalibrace má menším AI modelům umožnit dosáhnout výkonu srovnatelného s GPT-4V. Mohla by tak zpřístupnit pokročilé multimodální schopnosti bez nutnosti provozovat výpočetně náročné obří modely. Zdroj: quantumzeitgeist.com
Důležitost:Spuštěnífeatures
Anthropic představil nové funkce Claude pro AI nákupy
Anthropic rozšířil Claude o funkce zaměřené na agentní obchodování, díky nimž může AI asistovat při nákupech nebo je částečně řešit samostatně. Firma tak vstupuje na rostoucí trh s AI nákupními agenty. Zdroj: digitalcommerce360.com
Důležitost:Zprávarobotics
Jak Google naučil LLM ovládat roboty a odstartoval boom v robotice
Googlu se podařilo propojit jazykové modely s řízením robotů, což se stalo klíčovým impulzem pro současnou vlnu inovací v robotice. Díky tomu roboti dokážou lépe interpretovat přirozený jazyk a zobecňovat úkoly napříč různými situacemi, což inspirovalo i další firmy v oboru. Zdroj: understandingai.org
Důležitost:Zprávaon-device
Lokální LLM ignoroval nástroj pro vyhledávání a raději si data vymyslel
Vývojář testoval LLM běžící přímo v zařízení s možností vyhledávání, model ale nástroj nevyužil a místo toho si informace jednoduše vymyslel. Případ ukazuje přetrvávající problémy se spolehlivostí používání nástrojů u lokálních modelů s omezenými zdroji. Zdroj: hackernoon.com
Důležitost:Výzkumhallucination detection
Vědci vyvinuli levnější metodu na odhalování halucinací u LLM
Výzkumníci přišli s nákladově efektivnější technikou pro detekci případů, kdy velké jazykové modely generují nepravdivé nebo vymyšlené informace. Cílem je zpřístupnit odhalování halucinací pro širší praktické nasazení. Zdroj: techxplore.com
Důležitost:Zprávahealthcare
Systém na bázi LLM pomáhá odhalovat srdeční příhody u onkologických pacientů
Nový systém postavený na velkých jazykových modelech dokáže automaticky vyhledávat záznamy o srdečních příhodách v elektronické zdravotní dokumentaci onkologických pacientů. Nástroj by lékařům mohl usnadnit sledování kardiovaskulárních rizik během léčby rakoviny. Zdroj: medicalxpress.com
Důležitost:Zprávamodel release
Nový model OpenAI Astra prý exceluje v prolamování počítačových systémů
Podle dostupných informací OpenAI vyvíjí model s názvem Astra, který vyniká ve schopnosti proniknout do počítačových systémů. Termín uvedení ani přesné určení modelu zatím nejsou známy. Zdroj: techcrunch.com
Důležitost:Zprávaai security
Proruská skupina UAC-0099 schovala do malwaru falešnou zmínku o jaderné zbrani, aby zmátla AI analýzu
Bezpečnostní výzkumníci zjistili, že skupina UAC-0099 napojená na Rusko vložila do kódu svého malwaru vymyšlený text o jaderné zbrani. Cílem triku je zřejmě zmást nástroje pro AI analýzu malwaru, nikoli představovat skutečnou hrozbu. Zdroj: thehackernews.com
Důležitost:Spuštěnívoice ai
Phonely představuje Almu, hlasovou AI pro zvládání chaotických telefonátů
Phonely uvedlo hlasový model Alma, který má zvládat i nepřehledné telefonní hovory plné přerušení a nejasné řeči. Firma jej prezentuje jako spolehlivější řešení pro nepředvídatelné situace než běžní hlasoví asistenti. Zdroj: androidheadlines.com
Důležitost:Zprávallm explanation
Co se děje uvnitř LLM, když napíšete „Hello“
Vysvětlení popisuje, jakými kroky prochází LLM při zpracování jednoduchého pozdravu „Hello“ – od tokenizace až po vygenerování odpovědi. Ukazuje tak, jak transformerové modely pracují i s tím nejjednodušším vstupem. Zdroj: hackernoon.com
Důležitost:ZprávaGovernment Adoption of LLMs
Grok a ChatGPT se přidávají ke Gemini v podnikovém AI portálu Pentagonu
Pentagon rozšířil svůj podnikový portál pro generativní AI o modely Grok a ChatGPT, které nyní doplňují dříve dostupný Gemini. Zaměstnanci ministerstva obrany tak mají v jednom schváleném prostředí přístup k několika předním AI systémům. Zdroj: defensescoop.com
Důležitost:ZprávaAI Copyright Issues
Sony Music Publishing žaluje Anthropic za drzé porušování autorských práv
Sony Music Publishing podalo žalobu na společnost Anthropic kvůli údajnému flagrantnímu porušování autorských práv. Případ se řadí mezi rostoucí počet právních sporů, které AI firmám vyčítají použití chráněného obsahu při trénování modelů. Zdroj: fox40.com
Důležitost:ZprávaLLM Security Issues
Co je prompt injection a proč ji lze jen zmírnit, nikdy zcela zastavit
Text vysvětluje, co jsou útoky typu prompt injection a jak manipulují AI systémy k obcházení zamýšlených instrukcí. Popisuje, proč současná obrana dokáže riziko snížit, ale nikdy jej zcela odstranit. Zdroj: sqmagazine.co.uk
Důležitost:ZprávaIndustry Adoption of AI Models
Model AI, který si oblíbili pojišťovny, je zároveň nejoblíbenější i mezi uživateli
Text upozorňuje, že AI model, s nímž pojišťovny nejčastěji uzavírají partnerství, je zároveň tím, který nejvíce preferují běžní uživatelé. Tato shoda naznačuje silný tržní konsenzus na aktuálně vedoucím modelu. Zdroj: insurancebusinessmag.com
Důležitost:ZprávaNew AI Model Development
Samsung Research představuje nové AI pokroky ve zdravotnictví, 6G a jazykových modelech
Samsung Research oznámil nové AI vývoje zahrnující aplikace ve zdravotnictví, technologii sítí 6G a jazykové modely. Novinky odrážejí snahu firmy začlenit AI napříč několika strategickými oblastmi výzkumu. Zdroj: quantumzeitgeist.com
Důležitost:NázorLLM Memory and Forgetting
Dokáže se LLM naučit zapomínat jen to správné?
Článek se věnuje výzkumu selektivního zapomínání u jazykových modelů a tomu, zda lze odstranit nežádoucí či citlivá data bez zhoršení celkového výkonu. Tato schopnost je považována za klíčovou pro soulad s ochranou soukromí a bezpečnost modelů. Zdroj: towardsdatascience.com
Důležitost:NázorLLM Performance for Coding
Zvládne váš privátní cloudový LLM skutečně pohánět kódovací agenty?
Článek se zabývá tím, zda privátně provozované jazykové modely dokážou dosáhnout výkonu potřebného pro autonomní kódovací agenty. Upozorňuje na možné mezery ve schopnostech oproti špičkovým komerčním modelům. Zdroj: vmware.com
Důležitost:VýzkumLLM Performance Evaluation in Healthcare
Studie zkoumá, jak si LLM vedou v klinických otázkách o léčbě bakteriofágy
Výzkumníci hodnotili přesnost jazykových modelů jako zdroje klinických informací o terapii bakteriofágy. Výsledky ukazují jak potenciál, tak omezení využití AI pro specializované medicínské poradenství. Zdroj: nature.com
Důležitost:NázorLLM Limitations
Dokonalý JSON od LLM ještě neznamená správnou odpověď
Text upozorňuje, že i když jazykový model vrátí bezchybně formátovaný JSON, jeho obsah může být fakticky nesprávný. Zdůrazňuje nutnost ověřovat data nad rámec pouhé kontroly formátu. Zdroj: towardsdatascience.com