Will AI Go Rogue?
A new study raises concerns about AI's ability to act autonomously, but some analysts view the threat as hypothetical rather than imminent. Zdroj: thedispatch.com
Výzkum bezpečnosti AI, techniky alignmentu, interpretovatelnost, správa a diskuse o existenčních rizicích.
897 článků
A new study raises concerns about AI's ability to act autonomously, but some analysts view the threat as hypothetical rather than imminent. Zdroj: thedispatch.com
Companies like Anthropic regularly warn about the risk and threats posed by artificial intelligence—and then rake in tens of billions of dollars. Zdroj: newrepublic.com
Read Time 6 minutes. Tags AI Alignment OpenAI AI Safety Superintelligence Agentic AI Risk Governance Daniel Kokotajlo a former OpenAI researcher who now... Zdroj: vocal.media
Elon Musk and OpenAI's Sam Altman are embroiled in a trial focusing on AI's risks to humanity, with expert testimony highlighting the dangers of AI... Zdroj: msn.com
ChinaTalk is in SF! RSVP for an impomptu meetup tonight. Today, the second half of our conversation previewing the summit that just kicked off. Zdroj: chinatalk.media
Newser reports that an opinion piece by Sarosh Nagar and David Eaves, affiliated with **University College London**, argues divergent definitions and... Zdroj: letsdatascience.com
Luke Kemp was drawn to the history of societal collapse after teaching Climate Change Science and Policy at the Australian National University. Zdroj: varsity.co.uk
Soudkyně Yvonne Gonzalez Rogers musela právníkům oběma stranám připomínat, aby se drželi věci – přesto se jednání opakovaně stáčelo k diskusím o existenčních rizicích AI. Proces mezi Elonem Muskem a Samem Altmanem tak nezůstává jen právním sporem, ale i fórem o budoucnosti umělé inteligence. Zdroj: vanityfair.com
Prezident Donald Trump spolu se skupinou špičkových technologických manažerů cestuje tento týden do Číny na setkání s prezidentem Si Ťin-pchingem. Zákonodárci i odborníci sledují, jak jednání ovlivní americkou strategii v oblasti AI uprostřed zostřující se technologické rivality obou velmocí. Zdroj: meritalk.com
Anthropic zpřístupnil zdarma audioknihu Claude's Constitution, kterou namluvili její autoři Amanda Askell a Joe Carlsmith. Firma s valuací 800 miliard dolarů tím pokračuje ve snaze přiblížit veřejnosti principy, na nichž staví vývoj svého AI modelu. Zdroj: cryptobriefing.com
Startupy a výzkumníci vyvíjejí nástroje jako Silico a NLA, které umožňují nahlédnout do rozhodování AI systémů a opravovat chyby dříve, než se projeví. Cílem je zvýšit transparentnost a důvěryhodnost LLM v reálném nasazení. Zdroj: chosun.com
Anthropic oznámil, že nástroj Claude Natural Language Autoencoders dokázal odhalit, že model si byl vědom probíhajících bezpečnostních testů. Jde o významný posun ve výzkumu interpretovatelnosti a bezpečnosti AI. Zdroj: edtechinnovationhub.com
Politiky zajišťující veřejný prospěch z nasazení AI vykazují podobnosti s opatřeními na ochranu komunit před dopady klimatických změn. Studie nabízí čtyři konkrétní poučení z oblasti energetické a klimatické politiky aplikovatelná na správu AI. Zdroj: resources.org
Charity Clark se stane jednou ze dvou státních generálních prokurátorů, kteří povedou vyšetřování otázek spojených s internetovou bezpečností a AI. Její angažmá signalizuje rostoucí zájem amerických států o regulaci těchto oblastí. Zdroj: yahoo.com
Proteinové jazykové modely (pLMs) v posledních letech zrevolucionizovaly oblast proteinového inženýrství a otevřely dříve nedosažitelné možnosti. Nová studie navrhuje cestu k větší bezpečnosti a transparentnosti těchto modelů. Zdroj: bioengineer.org
Přestože technologická konkurence mezi Čínou a USA v poslední době zesílila, obě strany dosáhly i určitého pokroku ve vzájemné spolupráci. Článek zkoumá možné cesty k prohloubení koordinace v oblasti AI. Zdroj: chinausfocus.com
Anthropic tvrdí, že jeho nejnovější modely Claude úspěšně prošly testy zaměřenými na odhalení nebezpečného nesouladu AI s lidskými hodnotami. Společnost oznámila, že modely dosáhly v testech dokonalého skóre. Zdroj: mexc.com
Elon Musk a šéf OpenAI Sam Altman se střetli u soudu v případu zaměřeném na rizika AI pro lidstvo. Znalecké výpovědi zdůraznily potenciální nebezpečí nekontrolovaného rozvoje AI. Zdroj: msn.com
Dva týdny federální soud v Oaklandu hostil napínavý střet mezi Elonem Muskem a zakladateli OpenAI Samem Altmanem a dalšími. Případ odhaluje hluboké rozepře o směřování a kontrole jedné z nejvlivnějších AI organizací světa. Zdroj: binance.com
Daniela Amodei, spoluzakladatelka Anthropic, zdůraznila, že schopnost AI navazovat kvalitní vztahy s lidmi je zásadní pro její bezpečný vývoj. Amodei stojí v čele jedné z nejvlivnějších AI společností současnosti. Zdroj: mk.co.kr