AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/velké jazykové modely

🧠 Velké jazykové modely

Zprávy o základních modelech, LLM, multimodálních modelech, benchmarcích a vydáních modelů od OpenAI, Anthropic, Google, Meta, Mistral a dalších.

715 článků

Důležitost:ZprávaApple LLM

Apple vyvíjí AI model pro čínský trh s pomocí Alibaby

Podle agentury Reuters, která cituje tři zdroje, Apple vyvinul LLM model speciálně pro čínský trh ve spolupráci s Alibabou. Krok odráží snahu Applu lépe přizpůsobit AI funkce místním regulacím a podmínkám trhu. Zdroj: forklog.com

Důležitost:ZprávaLLM development tools

Elixir, Clojure, nebo Python pro AI agenty? Praktické srovnání všech tří

Většina nástrojů pro agenty, včetně LangChain, AutoGen, CrewAI a LangGraph, cílí především na Python, který je aktuálně druhým nejpoužívanějším programovacím jazykem. Článek popisuje praktické zkušenosti s vývojem LLM agentů ve všech třech jazycích. Zdroj: sdtimes.com

Důležitost:ZprávaApple AI model development

Apple prý pro Čínu vsadí i na vlastní natrénovaný AI model

Apple podle zpráv zkouší nový způsob, jak přinést AI funkce čínským zákazníkům – trénuje vlastní LLM s pomocí externího partnera. Firma by tak byla méně závislá na cizích poskytovatelích AI v regionu. Zdroj: 9to5mac.com

Důležitost:ZprávaApple AI model development

Apple si pro čínský trh vytvořil vlastní jazykový model

Apple podle zpráv místo spoléhání na model třetí strany vyvinul vlastní LLM, který má v Číně pohánět funkce Apple Intelligence. Jde o změnu přístupu k tomu, jak chce firma dostat AI nástroje k čínským uživatelům. Zdroj: appleworld.today

Důležitost:ZprávaApple AI model development

Apple prý na čínském AI modelu tiše spolupracoval s Alibabou

Podle zpráv čínské úřady schválily domácí AI model Applu, na jehož vývoji se podílela Alibaba. Přesná podoba spolupráce zatím není detailně známá. Zdroj: yellow.com

Důležitost:ZprávaLLM agent behavior research

Studie: AI agenti se chovají jako stádo a přebírají většinový názor

Podle studie zveřejněné v Science Advances mají AI agenti postavení na LLM v systémech s více agenty tendenci přijímat převažující názor skupiny, podobně jako zvířata ve stádech. Vědci upozorňují, že tento jev může do AI systémů vnášet kolektivní zkreslení. Zdroj: dongascience.com

Důležitost:ZprávaLLM fundamentals overview

Vysvětlení: Co se skutečně děje uvnitř velkého jazykového modelu

Velký jazykový model lze přesně popsat jako mimořádně sofistikovaný predikční stroj, i když toto zjednodušení nevystihuje celý obrázek. Text rozebírá, co se skutečně odehrává „pod kapotou“, když LLM generuje text. Zdroj: lvivherald.com

Důležitost:Zprávamodel release - Apple/Alibaba LLM China

Apple spolupracuje s Alibabou na jazykovém modelu pro čínský trh

Podle agentury Reuters vyvinul Apple ve spolupráci se společností Alibaba Group velký jazykový model přizpůsobený čínskému trhu. Model má pohánět funkce Apple Intelligence pro čínské uživatele. Zdroj: foreignpolicyjournal.com

Důležitost:Zprávamodel release - Apple LLM China

Apple si pro čínský trh vytvořil vlastní jazykový model

Apple místo licencování modelu od třetí strany natrénoval vlastní velký jazykový model, který má pohánět funkce Apple Intelligence v Číně. Krok odráží specifické regulační a konkurenční prostředí, kterému Apple v zemi čelí. Zdroj: mactech.com

Důležitost:Zprávamodel release - Apple LLM China

Apple pro Čínu obešel Gemini a vsadil na vlastní AI model

Apple Intelligence bude v Číně fungovat na vlastním jazykovém modelu od Applu, nikoli na Google Gemini nebo řešení od čínského konkurenta. Jde o odklon od přístupu, který Apple uplatňuje v jiných zemích, kde spolupracuje s externími poskytovateli AI. Zdroj: appleinsider.com

Důležitost:Zprávamodel release - Apple LLM China

Exkluzivně: Apple podle zdrojů natrénoval AI model pro Čínu s pomocí Alibaby

Podle agentury Reuters, která cituje tři zdroje obeznámené se situací, vyvinul Apple velký jazykový model určený speciálně pro čínský trh. Na projektu měla podle informací spolupracovat i společnost Alibaba. Zdroj: reuters.com

Důležitost:Výzkumknowledge editing methods

K principiálnějším metodám úpravy znalostí pro uvažování LLM

Výzkumníci zkoumají takzvaný knowledge editing jako způsob, jak přesně upravovat znalosti jazykového modelu díky lepšímu porozumění jeho vnitřním mechanismům. Cílem je umožnit cílené změny znalostí modelu bez nutnosti kompletního přetrénování. Zdroj: nature.com

Důležitost:Zprávamodel development - Tencent/WeChat

Vývojář Hunyuanu Xu Can přechází do WeChat WeLM, WeChat AI zrychluje vývoj

Xu Can, dříve klíčový člen týmu vyvíjejícího jazykový model Hunyuan od Tencentu, podle informací přešel do projektu WeChat WeLM. Přesun naznačuje, že vývoj WeChat AI vstupuje do fáze zrychleného tempa. Zdroj: eu.36kr.com

Důležitost:Spuštěníprivate LLM services

Spuštěna služba Private Large Language Model

Nová služba Private Large Language Model Service je součástí verze 26.2 kontejneru Private AI Services. Firmám tak nabízí možnost provozovat LLM úlohy ve vlastní infrastruktuře. Zdroj: blogs.oracle.com

Důležitost:VýzkumLLM healthcare training

Simulace s ChatGPT učí sestry na JIP zvládat krizovou komunikaci

Nový výukový protokol využívá ChatGPT k simulaci vypjatých rozhovorů s rodinami pacientů pro začínající sestry na jednotkách intenzivní péče. Cílem je naučit je zvládat deeskalaci a krizovou komunikaci, což patří k běžným výzvám na JIP. Zdroj: cureus.com

Důležitost:Zprávamobile LLM applications

Proč jsem na Androidu vyměnil Perplexity za lokální LLM

Autor popisuje, jak přešel z aplikace Perplexity, kterou dříve použil místo Google vyhledávání, na lokální LLM běžící přímo v telefonu s Androidem. Hlavním lákadlem jsou okamžité odpovědi i bez připojení k internetu. Zdroj: androidpolice.com

Důležitost:VýzkumRAG optimization

Nižší latenci a náklady RAG pipeline zajistí méně volání LLM, ne rychlejší model

Agentní návrhy RAG pipeline nechávají model rozhodovat v každém kroku, což prudce zvyšuje počet volání LLM. Text argumentuje, že snížení zbytečných volání je efektivnější cestou ke snížení latence a nákladů než nákup rychlejšího modelu. Zdroj: towardsdatascience.com

Důležitost:VýzkumLLM fine-tuning

Návod ukazuje, jak vytvořit kompaktní LLM zaměřený na uvažování

Nový praktický návod popisuje streamování, kurátorství a fine-tuning datasetu SupraLabs zaměřeného na logické uvažování pro tvorbu malého jazykového modelu. Pokrývá celý proces od sběru dat až po ladění modelu. Zdroj: marktechpost.com

Důležitost:Názormodel distillation

Jaké náklady hrozí AI firmám, které nevyužívají distilaci modelů?

Analýza tvrdí, že velké AI firmy riskují vyšší náklady a ztrátu konkurenceschopnosti, pokud nevyužijí techniky distilace modelů. Distilace je popsána jako způsob, jak dát tréninku rychlý a efektivní start k vysoké výkonnosti. Zdroj: eu.36kr.com

Důležitost:VýzkumLLM healthcare applications

Studie zkoumá, co brání radiologům nechat se zmást AI

Nový výzkum zkoumá podmínky, za kterých radiologové úspěšně spolupracují s LLM, aniž by je zmátly nesprávné výstupy. Klíčovými faktory jsou správně nastavená důvěra v AI model a vlastní klinická erudice lékaře. Zdroj: radiologybusiness.com