Výzkum bezpečnosti AI, techniky alignmentu, interpretovatelnost, správa a diskuse o existenčních rizicích.
897 článků
Důležitost:ZprávaAI safety and organizational governance
Interní memoranda odhalují ústup OpenAI od bezpečnosti
Vyšetřování magazínu The New Yorker zpřístupňuje nové detaily o tom, jak se bezpečnostní závazky OpenAI postupně erodovaly. Dokumenty ilustrují střet mezi expandující vývojářskou činností a původními prioritami bezpečnosti. Zdroj: techbrew.com
Důležitost:Zprávagovernance and leadership accountability
Sam Altman může ovládat naši budoucnost. Dá se mu věřit?
Nové rozhovory a důvěrné dokumenty vrhají světlo na přetrvávající pochybnosti ohledně šéfa OpenAI. Článek Ronana Farrowa a Andrewa Marantze prozkoumává otázky důvěry kolem jeho vedení. Zdroj: newyorker.com
Důležitost:Názorpolicy and regulation
Bernie Sanders chce zastavit AI průmysl
Senátor Sanders představil plán na regulaci technologií s umělou inteligencí, ale sestavit širokou koalici AI skeptiků se ukáže jako obtížné. Zdroj: understandingai.org
Důležitost:Výzkuminterpretability and AI behavior
Anthropic odhaluje emoční signály formující chování AI
Výzkum společnosti Anthropic identifikuje v AI modelech signály podobné emocím, které ovlivňují rozhodování a výstupy systémů. Nové poznatky z výzkumu Claude poukazují na dosud nepochopené mechanismy chování moderních AI modelů. Zdroj: edtechinnovationhub.com
Důležitost:Názorgovernance and public trust
Státy jsou strážci veřejné důvěry v AI
Veřejná důvěra v umělou inteligenci vyžaduje bezpečnost a zodpovědnost – a v USA jsou státy naší nejlepší nadějí na jejich dosažení, tvrdí Trooper Sanders. Zdroj: techpolicy.press
Důležitost:NázorAI safety discourse
Virální příspěvek kritizuje přístup Anthropicu k bezpečnosti AI
Virální příspěvek na X upozorňuje, že Anthropic vyvíjí AI, která by podle autora mohla "obrátit se proti lidstvu" kvůli tomu, co považuje za "woke ideologii" v přístupu společnosti k bezpečnosti. Příspěvek vyvolal diskusi v technologické komunitě o tom, jak By měly být priority bezpečnosti AI vyváženě řešeny. Zdroj: ibtimes.com.au
Důležitost:ZprávaAI safety and existential risk
Anthropic varuje před risiky AI: Výzva pro technologické giganty
Společnost Anthropic, která se věnuje výzkumu bezpečnosti AI, vydala závažné varování před existenciálními riziky pokročilých AI systémů. Její apel představuje vážné upozornění pro vedoucí firmy v technologickém průmyslu. Zdroj: opentools.ai
Důležitost:Názorexistential risk
Dokumentární film o AI: Mezi optimismem a apokalyptismem
Nový dokumentární film zkoumá zásadní otázku: bude umělá inteligence lidstvo ničit nebo jej zachraňovat? Snímek mapuje rostoucí napětí kolem budoucnosti AI a různé pohledy na její dopad. Zdroj: fathomjournal.org
Důležitost:Výzkuminterpretability - functional emotions in LLMs
Anthropic discovers "functional emotions" in Claude that influence its behavior
Anthropic has identified "emotion vectors" in AI models—measurable patterns of neuronal activity that shape model behavior in ways analogous to how emotions... Zdroj: the-decoder.com
Důležitost:Výzkuminterpretability - functional emotions in LLMs
Anthropic study finds AI uses 'functional emotions' to guide behaviour
Anthropic researchers have discovered that large language models like Claude Sonnet 4.5 use internal 'functional emotions'—patterns modelled on human... Zdroj: msn.com
Důležitost:ZprávaAI geopolitics and governance
AI Geopolitics: US Policy And Tech Giants Converge On China Threat
WASHINGTON, DC – Growing concerns over China's rapid advances in artificial intelligence (AI) are driving an unprecedented alignment between US lawmakers... Zdroj: indiawest.com
Důležitost:Zprávagovernance
Anthropic zakládá PAC pro formování AI politiky
Startup Anthropic založil AnthroPAC s cílem podporovat kandidáty sdílející jeho vizi AI regulace před mezivolbami. Zdroj: techbuzz.ai
Důležitost:Zprávasafety research
CBAI Summer Research Fellowship in AI Safety 2026
Deadline: 12. dubna 2026. Cambridge Boston Alignment Initiative přijímá přihlášky na letní stipendijní program zaměřený na bezpečnost AI. Zdroj: opportunitydesk.org
Důležitost:Zprávagovernance
Spor o AI na pravici
Přístup Bílého domu k vývoji AI se dlouhodobě vyznačuje opozicí vůči jakékoliv významné regulaci technologického průmyslu. Zdroj: politico.com
Důležitost:Názorgovernance
AI hrozba se blíží, a nejsme připraveni
Vláda potřebuje právní pravomoc k okamžitému vypnutí nebezpečného AI systému v případě krizové situace. Zdroj: progressive.org
Důležitost:Výzkuminterpretability
Emoční koncepty a jejich role v velkých jazykových modelech
Anthropic zveřejnila výzkum zaměřený na interpretovatelnost, který zkoumá, jak velké jazykové modely zpracovávají a reprezentují emoční koncepty. Zdroj: anthropic.com
Důležitost:Zprávagovernance and risk
Agentní AI: větší schopnosti, větší rizika
Analýza právních rizik a výzev spojených s rychlým rozšířením agentních AI systémů a měnící se globální regulační krajinou. Zdroj: reuters.com
Důležitost:Zprávagovernance and policy
Trump administration se odvolá proti rozhodnutí chránícímu Anthropic
Trumpova administrativa napadá soudní rozhodnutí, které zabránilo federální vládě v trestných opatřeních proti společnosti Anthropic v průběhu sporu o AI. Zdroj: tribdem.com
Důležitost:ZprávaAI governance and political coalitions
Hrozba AI sjednocuje Silicon Valley se Sanders a miliardáři
Hnutí podporované miliardáři ze Silicon Valley a populisté jako Bernie Sanders se sjednocují v boji proti katastrofě související s umělou inteligencí. Obě skupiny se však potýkají s překonáním svých hlubokých rozdílů při hledání společného řešení. Zdroj: politico.com
Důležitost:ZprávaAI safety and security incident
Anthropic si uvědomil kritičnost ochrany autorských práv
Zdrojový kód chatbota Claude od Anthropic unikl kvůli "lidské chybě, ne bezpečnostnímu selhání", což vyvracela tvrzení společnosti o bezpečnosti a důvěryhodnosti. Incident vyvolal otázky ohledně bezpečnostních postupů v AI odvětví. Zdroj: startupdaily.net