AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

981 článků

Důležitost:Spuštěnímodel release

Meta tvrdí, že model Muse Spark 1.3 dohnal Anthropic i OpenAI

Meta představila Muse Spark 1.3, svůj dosud nejvýkonnější AI model, a tvrdí, že se jím vyrovnala špičce v podobě Anthropicu a OpenAI. Firma tak dává najevo ambici srovnat krok v souboji o nejlepší velké jazykové modely. Zdroj: siliconangle.com

Důležitost:Zprávaefficiency

Technika „rekalibrace“ dovoluje malým modelům konkurovat GPT-4V

Nová metoda rekalibrace má menším AI modelům umožnit dosáhnout výkonu srovnatelného s GPT-4V. Mohla by tak zpřístupnit pokročilé multimodální schopnosti bez nutnosti provozovat výpočetně náročné obří modely. Zdroj: quantumzeitgeist.com

Důležitost:Spuštěnífeatures

Anthropic představil nové funkce Claude pro AI nákupy

Anthropic rozšířil Claude o funkce zaměřené na agentní obchodování, díky nimž může AI asistovat při nákupech nebo je částečně řešit samostatně. Firma tak vstupuje na rostoucí trh s AI nákupními agenty. Zdroj: digitalcommerce360.com

Důležitost:Zprávarobotics

Jak Google naučil LLM ovládat roboty a odstartoval boom v robotice

Googlu se podařilo propojit jazykové modely s řízením robotů, což se stalo klíčovým impulzem pro současnou vlnu inovací v robotice. Díky tomu roboti dokážou lépe interpretovat přirozený jazyk a zobecňovat úkoly napříč různými situacemi, což inspirovalo i další firmy v oboru. Zdroj: understandingai.org

Důležitost:Zprávaon-device

Lokální LLM ignoroval nástroj pro vyhledávání a raději si data vymyslel

Vývojář testoval LLM běžící přímo v zařízení s možností vyhledávání, model ale nástroj nevyužil a místo toho si informace jednoduše vymyslel. Případ ukazuje přetrvávající problémy se spolehlivostí používání nástrojů u lokálních modelů s omezenými zdroji. Zdroj: hackernoon.com

Důležitost:Výzkumhallucination detection

Vědci vyvinuli levnější metodu na odhalování halucinací u LLM

Výzkumníci přišli s nákladově efektivnější technikou pro detekci případů, kdy velké jazykové modely generují nepravdivé nebo vymyšlené informace. Cílem je zpřístupnit odhalování halucinací pro širší praktické nasazení. Zdroj: techxplore.com

Důležitost:Zprávahealthcare

Systém na bázi LLM pomáhá odhalovat srdeční příhody u onkologických pacientů

Nový systém postavený na velkých jazykových modelech dokáže automaticky vyhledávat záznamy o srdečních příhodách v elektronické zdravotní dokumentaci onkologických pacientů. Nástroj by lékařům mohl usnadnit sledování kardiovaskulárních rizik během léčby rakoviny. Zdroj: medicalxpress.com

Důležitost:Zprávamodel release

Nový model OpenAI Astra prý exceluje v prolamování počítačových systémů

Podle dostupných informací OpenAI vyvíjí model s názvem Astra, který vyniká ve schopnosti proniknout do počítačových systémů. Termín uvedení ani přesné určení modelu zatím nejsou známy. Zdroj: techcrunch.com

Důležitost:Zprávaai security

Proruská skupina UAC-0099 schovala do malwaru falešnou zmínku o jaderné zbrani, aby zmátla AI analýzu

Bezpečnostní výzkumníci zjistili, že skupina UAC-0099 napojená na Rusko vložila do kódu svého malwaru vymyšlený text o jaderné zbrani. Cílem triku je zřejmě zmást nástroje pro AI analýzu malwaru, nikoli představovat skutečnou hrozbu. Zdroj: thehackernews.com

Důležitost:Spuštěnívoice ai

Phonely představuje Almu, hlasovou AI pro zvládání chaotických telefonátů

Phonely uvedlo hlasový model Alma, který má zvládat i nepřehledné telefonní hovory plné přerušení a nejasné řeči. Firma jej prezentuje jako spolehlivější řešení pro nepředvídatelné situace než běžní hlasoví asistenti. Zdroj: androidheadlines.com

Důležitost:Zprávallm explanation

Co se děje uvnitř LLM, když napíšete „Hello“

Vysvětlení popisuje, jakými kroky prochází LLM při zpracování jednoduchého pozdravu „Hello“ – od tokenizace až po vygenerování odpovědi. Ukazuje tak, jak transformerové modely pracují i s tím nejjednodušším vstupem. Zdroj: hackernoon.com

Důležitost:ZprávaGovernment Adoption of LLMs

Grok a ChatGPT se přidávají ke Gemini v podnikovém AI portálu Pentagonu

Pentagon rozšířil svůj podnikový portál pro generativní AI o modely Grok a ChatGPT, které nyní doplňují dříve dostupný Gemini. Zaměstnanci ministerstva obrany tak mají v jednom schváleném prostředí přístup k několika předním AI systémům. Zdroj: defensescoop.com

Důležitost:ZprávaAI Copyright Issues

Sony Music Publishing žaluje Anthropic za drzé porušování autorských práv

Sony Music Publishing podalo žalobu na společnost Anthropic kvůli údajnému flagrantnímu porušování autorských práv. Případ se řadí mezi rostoucí počet právních sporů, které AI firmám vyčítají použití chráněného obsahu při trénování modelů. Zdroj: fox40.com

Důležitost:ZprávaLLM Security Issues

Co je prompt injection a proč ji lze jen zmírnit, nikdy zcela zastavit

Text vysvětluje, co jsou útoky typu prompt injection a jak manipulují AI systémy k obcházení zamýšlených instrukcí. Popisuje, proč současná obrana dokáže riziko snížit, ale nikdy jej zcela odstranit. Zdroj: sqmagazine.co.uk

Důležitost:ZprávaIndustry Adoption of AI Models

Model AI, který si oblíbili pojišťovny, je zároveň nejoblíbenější i mezi uživateli

Text upozorňuje, že AI model, s nímž pojišťovny nejčastěji uzavírají partnerství, je zároveň tím, který nejvíce preferují běžní uživatelé. Tato shoda naznačuje silný tržní konsenzus na aktuálně vedoucím modelu. Zdroj: insurancebusinessmag.com

Důležitost:ZprávaNew AI Model Development

Samsung Research představuje nové AI pokroky ve zdravotnictví, 6G a jazykových modelech

Samsung Research oznámil nové AI vývoje zahrnující aplikace ve zdravotnictví, technologii sítí 6G a jazykové modely. Novinky odrážejí snahu firmy začlenit AI napříč několika strategickými oblastmi výzkumu. Zdroj: quantumzeitgeist.com

Důležitost:NázorLLM Memory and Forgetting

Dokáže se LLM naučit zapomínat jen to správné?

Článek se věnuje výzkumu selektivního zapomínání u jazykových modelů a tomu, zda lze odstranit nežádoucí či citlivá data bez zhoršení celkového výkonu. Tato schopnost je považována za klíčovou pro soulad s ochranou soukromí a bezpečnost modelů. Zdroj: towardsdatascience.com

Důležitost:NázorLLM Performance for Coding

Zvládne váš privátní cloudový LLM skutečně pohánět kódovací agenty?

Článek se zabývá tím, zda privátně provozované jazykové modely dokážou dosáhnout výkonu potřebného pro autonomní kódovací agenty. Upozorňuje na možné mezery ve schopnostech oproti špičkovým komerčním modelům. Zdroj: vmware.com

Důležitost:VýzkumLLM Performance Evaluation in Healthcare

Studie zkoumá, jak si LLM vedou v klinických otázkách o léčbě bakteriofágy

Výzkumníci hodnotili přesnost jazykových modelů jako zdroje klinických informací o terapii bakteriofágy. Výsledky ukazují jak potenciál, tak omezení využití AI pro specializované medicínské poradenství. Zdroj: nature.com

Důležitost:NázorLLM Limitations

Dokonalý JSON od LLM ještě neznamená správnou odpověď

Text upozorňuje, že i když jazykový model vrátí bezchybně formátovaný JSON, jeho obsah může být fakticky nesprávný. Zdůrazňuje nutnost ověřovat data nad rámec pouhé kontroly formátu. Zdroj: towardsdatascience.com