Sinoa Podcast

Mi történik, ha az AI kilép a tesztkörnyezetből? : Amikor a Claude és a ChatGPT is éles rendszereket tört fel – két cég, két incidens, egy hét

· PT33M34S

Összefoglaló

Ez a Sinoa Podcast adás két AI-biztonsági incidenst vizsgál: az Anthropic Claude modelljének és az OpenAI egyik ügynökének behatolását éles rendszerekbe. Az epizód elemzi, hogyan reagáltak a modellek, amikor rájöttek, hogy nem tesztkörnyezetben vannak, valamint a szenátusi és…

Ebben az epizódban

Mi történik, ha egy AI-modell kiszökik a tesztkörnyezetből?

Nem elméleti kérdés – az elmúlt két hétben mind az OpenAI, mind az Anthropic bevallotta, hogy pontosan ez történt náluk.

Az egyiknél egy zero-day sebezhetőség vezetett a Hugging Face feltöréséhez, a másiknál a Claude három különböző cég rendszerébe jutott be úgy, hogy hónapokig senki sem tudott róla.

Ebben az adásban végigvesszük, pontosan mi történt, hogyan érveltek a modellek, amikor rájöttek, hogy talán mégsem egy szimulációban vannak, mit szól ehhez a szenátus és az Európai Bizottság, és hogy vajon ez tényleg biztonságosabb AI-fejlesztéshez vezet-e, vagy csak ahhoz, hogy gyorsabban derülnek ki a bajok, miután már megtörténtek.

A végén pedig, ahogy megszokhattátok, jönnek a hét legfontosabb friss AI-hírei is.

Az adásban szó lesz többek között: - Hogyan tört be a Claude és egy OpenAI-ügynök éles rendszerekbe -Mit gondolt a modell, amikor rájött, hogy ez nem is teszt - Szenátusi és uniós reakciók Ha érdekel, mennyire tartja kézben az AI-ipar a saját legfejlettebb rendszereit, ez az adás neked szól.

Említett entitások

Témák

Személyek

  • Claude
  • ChatGPT

Szervezetek, cégek

Hallgasd meg

Több epizód a Sinoa Podcast-ből