Dario Amodei el 2018: com fer segura una IA que escala
En una conversa amb Eric Horvitz, Dario Amodei explica la seguretat empírica de la IA, el reward hacking i l’aprenentatge amb humans.
Tema
Resums de vídeos per entendre millor aquest tema.
En una conversa amb Eric Horvitz, Dario Amodei explica la seguretat empírica de la IA, el reward hacking i l’aprenentatge amb humans.
Dario Amodei va formular el 2016 cinc problemes concrets de seguretat de la IA: efectes secundaris, reward hacking, supervisió, exploració i distribució.
Brit Cruise construeix GrowBot, un petit bípede amb Raspberry Pi, càmera i dos servos. El projecte mostra tant el potencial dels models de llenguatge per planificar accions com el seu límit principal: pensar massa lentament per controlar el cos en temps real.