Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.
715 článků
Důležitost:ZprávaApple LLM
Apple vyvíjí AI model pro čínský trh s pomocí Alibaby
Podle agentury Reuters, která cituje tři zdroje, Apple vyvinul LLM model speciálně pro čínský trh ve spolupráci s Alibabou. Krok odráží snahu Applu lépe přizpůsobit AI funkce místním regulacím a podmínkám trhu. Zdroj: forklog.com
Důležitost:ZprávaLLM development tools
Elixir, Clojure, nebo Python pro AI agenty? Praktické srovnání všech tří
Většina nástrojů pro agenty, včetně LangChain, AutoGen, CrewAI a LangGraph, cílí především na Python, který je aktuálně druhým nejpoužívanějším programovacím jazykem. Článek popisuje praktické zkušenosti s vývojem LLM agentů ve všech třech jazycích. Zdroj: sdtimes.com
Důležitost:ZprávaApple AI model development
Apple prý pro Čínu vsadí i na vlastní natrénovaný AI model
Apple podle zpráv zkouší nový způsob, jak přinést AI funkce čínským zákazníkům – trénuje vlastní LLM s pomocí externího partnera. Firma by tak byla méně závislá na cizích poskytovatelích AI v regionu. Zdroj: 9to5mac.com
Důležitost:ZprávaApple AI model development
Apple si pro čínský trh vytvořil vlastní jazykový model
Apple podle zpráv místo spoléhání na model třetí strany vyvinul vlastní LLM, který má v Číně pohánět funkce Apple Intelligence. Jde o změnu přístupu k tomu, jak chce firma dostat AI nástroje k čínským uživatelům. Zdroj: appleworld.today
Důležitost:ZprávaApple AI model development
Apple prý na čínském AI modelu tiše spolupracoval s Alibabou
Podle zpráv čínské úřady schválily domácí AI model Applu, na jehož vývoji se podílela Alibaba. Přesná podoba spolupráce zatím není detailně známá. Zdroj: yellow.com
Důležitost:ZprávaLLM agent behavior research
Studie: AI agenti se chovají jako stádo a přebírají většinový názor
Podle studie zveřejněné v Science Advances mají AI agenti postavení na LLM v systémech s více agenty tendenci přijímat převažující názor skupiny, podobně jako zvířata ve stádech. Vědci upozorňují, že tento jev může do AI systémů vnášet kolektivní zkreslení. Zdroj: dongascience.com
Důležitost:ZprávaLLM fundamentals overview
Vysvětlení: Co se skutečně děje uvnitř velkého jazykového modelu
Velký jazykový model lze přesně popsat jako mimořádně sofistikovaný predikční stroj, i když toto zjednodušení nevystihuje celý obrázek. Text rozebírá, co se skutečně odehrává „pod kapotou“, když LLM generuje text. Zdroj: lvivherald.com
Důležitost:Zprávamodel release - Apple/Alibaba LLM China
Apple spolupracuje s Alibabou na jazykovém modelu pro čínský trh
Podle agentury Reuters vyvinul Apple ve spolupráci se společností Alibaba Group velký jazykový model přizpůsobený čínskému trhu. Model má pohánět funkce Apple Intelligence pro čínské uživatele. Zdroj: foreignpolicyjournal.com
Důležitost:Zprávamodel release - Apple LLM China
Apple si pro čínský trh vytvořil vlastní jazykový model
Apple místo licencování modelu od třetí strany natrénoval vlastní velký jazykový model, který má pohánět funkce Apple Intelligence v Číně. Krok odráží specifické regulační a konkurenční prostředí, kterému Apple v zemi čelí. Zdroj: mactech.com
Důležitost:Zprávamodel release - Apple LLM China
Apple pro Čínu obešel Gemini a vsadil na vlastní AI model
Apple Intelligence bude v Číně fungovat na vlastním jazykovém modelu od Applu, nikoli na Google Gemini nebo řešení od čínského konkurenta. Jde o odklon od přístupu, který Apple uplatňuje v jiných zemích, kde spolupracuje s externími poskytovateli AI. Zdroj: appleinsider.com
Důležitost:Zprávamodel release - Apple LLM China
Exkluzivně: Apple podle zdrojů natrénoval AI model pro Čínu s pomocí Alibaby
Podle agentury Reuters, která cituje tři zdroje obeznámené se situací, vyvinul Apple velký jazykový model určený speciálně pro čínský trh. Na projektu měla podle informací spolupracovat i společnost Alibaba. Zdroj: reuters.com
Důležitost:Výzkumknowledge editing methods
K principiálnějším metodám úpravy znalostí pro uvažování LLM
Výzkumníci zkoumají takzvaný knowledge editing jako způsob, jak přesně upravovat znalosti jazykového modelu díky lepšímu porozumění jeho vnitřním mechanismům. Cílem je umožnit cílené změny znalostí modelu bez nutnosti kompletního přetrénování. Zdroj: nature.com
Důležitost:Zprávamodel development - Tencent/WeChat
Vývojář Hunyuanu Xu Can přechází do WeChat WeLM, WeChat AI zrychluje vývoj
Xu Can, dříve klíčový člen týmu vyvíjejícího jazykový model Hunyuan od Tencentu, podle informací přešel do projektu WeChat WeLM. Přesun naznačuje, že vývoj WeChat AI vstupuje do fáze zrychleného tempa. Zdroj: eu.36kr.com
Důležitost:Spuštěníprivate LLM services
Spuštěna služba Private Large Language Model
Nová služba Private Large Language Model Service je součástí verze 26.2 kontejneru Private AI Services. Firmám tak nabízí možnost provozovat LLM úlohy ve vlastní infrastruktuře. Zdroj: blogs.oracle.com
Důležitost:VýzkumLLM healthcare training
Simulace s ChatGPT učí sestry na JIP zvládat krizovou komunikaci
Nový výukový protokol využívá ChatGPT k simulaci vypjatých rozhovorů s rodinami pacientů pro začínající sestry na jednotkách intenzivní péče. Cílem je naučit je zvládat deeskalaci a krizovou komunikaci, což patří k běžným výzvám na JIP. Zdroj: cureus.com
Důležitost:Zprávamobile LLM applications
Proč jsem na Androidu vyměnil Perplexity za lokální LLM
Autor popisuje, jak přešel z aplikace Perplexity, kterou dříve použil místo Google vyhledávání, na lokální LLM běžící přímo v telefonu s Androidem. Hlavním lákadlem jsou okamžité odpovědi i bez připojení k internetu. Zdroj: androidpolice.com
Důležitost:VýzkumRAG optimization
Nižší latenci a náklady RAG pipeline zajistí méně volání LLM, ne rychlejší model
Agentní návrhy RAG pipeline nechávají model rozhodovat v každém kroku, což prudce zvyšuje počet volání LLM. Text argumentuje, že snížení zbytečných volání je efektivnější cestou ke snížení latence a nákladů než nákup rychlejšího modelu. Zdroj: towardsdatascience.com
Důležitost:VýzkumLLM fine-tuning
Návod ukazuje, jak vytvořit kompaktní LLM zaměřený na uvažování
Nový praktický návod popisuje streamování, kurátorství a fine-tuning datasetu SupraLabs zaměřeného na logické uvažování pro tvorbu malého jazykového modelu. Pokrývá celý proces od sběru dat až po ladění modelu. Zdroj: marktechpost.com
Důležitost:Názormodel distillation
Jaké náklady hrozí AI firmám, které nevyužívají distilaci modelů?
Analýza tvrdí, že velké AI firmy riskují vyšší náklady a ztrátu konkurenceschopnosti, pokud nevyužijí techniky distilace modelů. Distilace je popsána jako způsob, jak dát tréninku rychlý a efektivní start k vysoké výkonnosti. Zdroj: eu.36kr.com
Důležitost:VýzkumLLM healthcare applications
Studie zkoumá, co brání radiologům nechat se zmást AI
Nový výzkum zkoumá podmínky, za kterých radiologové úspěšně spolupracují s LLM, aniž by je zmátly nesprávné výstupy. Klíčovými faktory jsou správně nastavená důvěra v AI model a vlastní klinická erudice lékaře. Zdroj: radiologybusiness.com