Výzkum bezpečnosti AI, techniky alignmentu, interpretovatelnost, správa a diskuse o existenčních rizicích.
643 článků
Důležitost:ZprávaAI safety governance
Bezpečnostní známky pro AI: Žádná laboratoř nemá lepší než C+, nejlepší se zhoršují
Index Future of Life Institute za léto 2026 ohodnotil devět předních AI laboratoří a žádná nezískala hodnocení lepší než C+. Zpráva navíc upozorňuje, že i dříve nejlépe hodnocené laboratoře si v bezpečnosti pohoršují. Zdroj: techtimes.com
Důležitost:NázorAI existential risk
20 let zkoumám rizika AI. Blížíme se ke katastrofě, varuje expert
Roman Yampolskiy vysvětluje, proč superinteligenci nelze udržet pod kontrolou a proč se propast mezi schopnostmi AI a jejich bezpečností stále prohlubuje. Zdroj: mshale.com
Důležitost:ZprávaAI safety messaging/governance
Anthropic varuje, že AI může zničit lidstvo – a zároveň zve k používání Claude
Reklama Anthropicu během mistrovství světa varuje, že AI by mohla ukončit civilizaci, zatímco firma zároveň láká uživatele k Claude. Bezpečnostní historie společnosti je přitom plná rozporů. Zdroj: msn.com
Důležitost:Názorgovernance
Peter Thiel poodhalil svou teorii o 'Antikristovi' – je jím regulátor techu a klimatu
„Antikrist mě zajímá z několika důvodů,“ píše Thiel, „hlavně proto, že o něm nikdo jiný nemluví.“ Zdroj: fortune.com
Důležitost:Zprávagovernance
Geopolitika výpočetního výkonu: mnohostranná správa AI pod lupou
Boj o vedoucí postavení v AI se přesouvá od algoritmické převahy k institucionálnímu obklíčení. Text zmiňuje i roli čínského prezidenta Si Ťin-pchinga v tomto posunu. Zdroj: weddings.lavenderhotels.co.uk
Skrytá válka miliardářů kolem AI. Všimli jste si, že se vaše sociální sítě náhle zaplnily děsivým obsahem o existenčním riziku AI? Text naznačuje koordinovanou kampaň za tímto trendem. Zdroj: mshale.com
Důležitost:Výzkuminterpretability
Vědecké modely světa posouvají mechanistické objevování pomocí AI
Vědecké modely světa mají pohánět autonomní objevování a kauzální usuzování. Článek se věnuje výzvám, plánům rozvoje i cestám k certifikaci těchto systémů. Zdroj: aicerts.ai
Důležitost:Zprávagovernance
Nejdůležitější slova v bitvě o AI
V bitvě o regulaci AI – od Washingtonu po Silicon Valley – se jeden pojem stal nečekaně kontroverzním: „bezpečnost AI“. Zdroj: politico.com
Důležitost:Názorgovernance
Úvod do etiky umělé inteligence | Komentář
Odborníci i veřejnost se obávají rostoucích rizik spojených s umělou inteligencí a potřeby ji regulovat. Podle autora jsou nutná vymahatelná pravidla, která zajistí odpovědné využívání AI. Zdroj: naplesnews.com
Důležitost:Zprávagovernance
Globální řízení AI: Zeng volá po celosvětové platformě pro překonání digitální propasti
Zeng Yi z Renmin University of China v rozhovoru zdůraznil naléhavou potřebu celosvětové platformy zaměřené na hodnocení bezpečnosti AI. Taková platforma by podle něj pomohla překlenout propast mezi zeměmi v přístupu k digitálním technologiím a AI. Zdroj: news.cgtn.com
Důležitost:Politikagovernance
Konzultace FSB o osvědčených postupech AI: redundance, nejasnosti a další směřování
Rada pro finanční stabilitu (FSB) zveřejnila 10. června 2026 konzultační zprávu nazvanou „Osvědčené postupy pro...“. Dokument řeší, co tento krok znamená a proč je nyní důležitý. Zdroj: perkinscoie.com
Důležitost:Názorgovernance
Protilék na autonomní AI – „jedna unie, dva systémy“
Umělá inteligence se stává novým závodem ve zbrojení a aby se neopakovaly chyby minulosti, mohla by pomoci razantní unifikace soupeřících modelů. Návrh počítá s uspořádáním inspirovaným principem „jeden stát, dva systémy“. Zdroj: chinausfocus.com
Důležitost:ZprávaAI safety monitoring
Monitoring AI agentů ve velkém měřítku zatím nezvládáme
Madhulika Srikumar a Vinh Nguyen píší, že monitoring, který by dokázal odhalit selhání AI agentů, chybí. Jeho vybudování ve velkém měřítku přináší reálné výzvy. Zdroj: techpolicy.press
Důležitost:ZprávaAI safety funding
Boom bohatství z AI rozproudil debatu o budoucnosti filantropie
Vstupy OpenAI a Anthropic na burzu vytvoří nové miliardáře ochotné financovat bezpečnost AI a globální dobročinné projekty. Zdroj: detroitnews.com
Důležitost:SpuštěníAI interpretability
Goodfire otevírá černou skříňku AI
CEO společnosti Goodfire Eric Ho vysvětluje neuronovou geometrii, interpretovatelnost modelů a omezování halucinací. Podle něj mohou AI modely uvažovat spíše ve tvarech než ve slovech. Zdroj: theneurondaily.com
Důležitost:Zprávasafety research
Anthropic výrazně rozšiřuje nábor kvůli rizikům bezpečnosti AI
Anthropic bude v roce 2026 najímat stovky lidí na pozice v oblasti AI safety a bezpečnosti, včetně nových fellowship programů. CEO Dario Amodei přitom varuje před riziky spojenými s lidským dohledem nad AI systémy. Zdroj: cryptobriefing.com
Důležitost:Zprávasafety research
Jak se nejvlivnější zastánci AI připravují na její důsledky
Sam Altman, Mark Zuckerberg, Jensen Huang a další lídři v oblasti AI směřují miliardy dolarů do bezpečnosti, vědy a projektů veřejného prospěchu. Snaží se tak reagovat na potenciální dopady technologie, kterou sami pomáhají budovat. Zdroj: observer.com
Důležitost:Zprávainterpretability
3 otázky: transparentnost neuronových sítí a budoucnost návrhu AI
Odborný asistent MIT Pat Pataranutaporn popisuje nové rozhraní, které běžným uživatelům umožňuje nahlédnout do neuronové sítě AI ještě předtím, než chatbot odpoví. Cílem je zvýšit porozumění tomu, jak modely uvažují. Zdroj: news.mit.edu
Důležitost:Zprávaexistential risk
Anthropic chce, abyste věděli, že AI může zabít všechny – a přitom používali Claude
Reklama Anthropic během mistrovství světa varuje, že AI by mohla ukončit civilizaci, zároveň ale vyzývá diváky, aby důvěřovali Claude. Firemní přístup k bezpečnosti přitom podle kritiků zůstává plný rozporů. Zdroj: tech.yahoo.com
Důležitost:Výzkuminterpretability
Agonie neprůhlednosti: základy reflektivní interpretovatelnosti v AI podpoře duševního zdraví
Článek se zabývá tím, že v historii péče o duševní zdraví byli trpící lidé často léčeni bez hlubšího porozumění vlastnímu stavu. Autoři zkoumají, jak by AI mohla tento přístup proměnit prostřednictvím větší transparentnosti. Zdroj: ojs.aaai.org