Návod ukazuje, jak vytvořit kompaktní LLM zaměřený na uvažování
Nový praktický návod popisuje streamování, kurátorství a fine-tuning datasetu SupraLabs zaměřeného na logické uvažování pro tvorbu malého jazykového modelu. Pokrývá celý proces od sběru dat až po ladění modelu. Zdroj: marktechpost.com
Důležitost:ZprávaDeveloper Tools
Microsoft a GitHub přidávají vývojářům víc kontroly nad AI nástroji
Nová nastavení pro hloubku uvažování modelů a důkladnost code review v Copilotu umožňují vývojářům zvolit, kolik AI výkonu daný úkol potřebuje, s ohledem na rychlost, kvalitu a spotřebu kreditů. Zdroj: visualstudiomagazine.com
Důležitost:Zprávaresources
Pět knih, které vám pomohou lépe pochopit jazykové modely
Přehled doporučuje pět knih zaměřených na budování, doladění a nasazení LLM. Hodí se pro ty, kdo chtějí hlouběji proniknout do technické stránky vývoje jazykových modelů. Zdroj: kdnuggets.com
Bezpečnostní fine-tuning LLM může skrytě oslabit ochranu před útoky
Fine-tuning umožňuje přizpůsobit obecný LLM konkrétnímu úkolu pomocí cíleného tréninku na vybraných příkladech. Nová analýza ukazuje, že bezpečnostní fine-tuning může nechtěně zanést skryté slabiny, které útočníci dokážou zneužít k obcházení ochran. Zdroj: blogs.cisco.com
Důležitost:ZprávaLLM fine-tuning on Apple Silicon
Fine-tuning jazykových modelů na Apple Silicon s MLX
Dřív fine-tuning jazykového modelu znamenal pronájem cloudových GPU a sledování rostoucího účtu. Pokud vlastníte Mac s čipem Apple Silicon, můžete model přizpůsobit přímo u sebe díky frameworku MLX. Zdroj: kdnuggets.com
Microsoft zvažuje nasazení DeepSeeku, jak rostou náklady na OpenAI
Microsoft uvažuje o začlenění fine-tunované verze čínského open-source modelu DeepSeek V4 do svého podnikového AI nástroje Copilot Cowork. Důvodem jsou rostoucí náklady spojené s využíváním modelů OpenAI. Zdroj: digitimes.com
Microsoft ladí výkon AI agentů podle kritérií definovaných uživatelem
Funkce Agent Optimizer zajišťují, že Foundry Hosted Agents dodržují uživatelem stanovená kritéria pro instrukce, dovednosti, modely a popisy nástrojů. Cílem je systematické vylaďování agentního chování bez manuálních zásahů. Zdroj: cloudwars.com
Důležitost:Výzkummultimodal LLM applications
Doladěný multimodální LLM řídí autonomní rozpoznávání tvarů u tensegrity robota
Výzkumníci integrovali fine-tuned multimodální LLM do šestičlánkové tensegrity struktury vybavené flexibilními senzory pro autonomní rozpoznávání stavu a tvarů. Systém ukazuje potenciál pro průzkum náročných prostředí, včetně vesmírných misí. Zdroj: nature.com
Důležitost:ZprávaAI video model comparison
Souboj AI video gigantů: Gemini Omni vs. Seedance 2.0
Trh s generativním AI videem vstoupil v roce 2026 do éry ostrého soupeření. Google nasazuje novou generaci modelu Gemini Omni, zatímco Seedance 2.0 láká tvůrce svým kinematografickým stylem a výraznou vizuální silou. Zdroj: findarticles.com
Důležitost:VýzkumLLM fine-tuning/post-training
Průvodce post-tréninkem LLM: od SFT přes DPO až po GRPO pomocí TRL
Tento praktický tutoriál provází vývojáře celým procesem post-trénování velkých jazykových modelů pomocí knihovny TRL (Transformer Reinforcement Learning). Výukový materiál pokrývá metody od Supervised Fine-Tuning přes DPO až po reasoning s GRPO. Zdroj: marktechpost.com
Důležitost:Zpráva
Cognizant ladí velké jazykové modely pomocí evolučních strategií
Cognizant představil čtyři nové výzkumné práce ze svého AI Lab, které popisují, jak společnost dolaďuje velké jazykové modely (LLM) pomocí evolučních strategií. Tento přístup představuje alternativu k tradičním metodám fine-tuningu. Zdroj: thefastmode.com
Důležitost:Zpráva
AI agent navrhl RISC-V procesorové jádro od nuly
Po předchozích experimentech z let 2020 a 2023, kdy modely GPT-2 a GPT-4 pomáhaly navrhovat části logických obvodů nebo 8bitové procesory, posunul nový výzkum laťku výše. AI agent tentokrát samostatně navrhl celé jádro RISC-V CPU. Zdroj: spectrum.ieee.org
Důležitost:Zpráva
Trh platforem pro trénink LLM na míru: výhled do 2030 a 2035
Zpráva mapuje příležitosti v oblasti doménově specifického trénování modelů, škálovatelného fine-tuningu a bezpečných nasazení. Mezi klíčové hráče patří AWS, NVIDIA, IBM, Microsoft, OpenAI, Databricks a Hugging Face. Zdroj: uk.finance.yahoo.com