Modelo da Anthropic ajudou a revelar falha em sistemas da OpenAI
Hacktron AI encontrou brecha em fórum da OpenAI e recebeu recompensa após a empresa corrigir o problema em cerca de 14 horas.
Hacktron AI encontrou brecha em fórum da OpenAI e recebeu recompensa após a empresa corrigir o problema em cerca de 14 horas.
OpenAI, Anthropic e Google DeepMind estudam uma estrutura de supervisão com especialistas independentes e representantes do código aberto.
Presidente dos EUA critica Dario Amodei e reage a pedidos por uma desaceleração coordenada na inteligência artificial.
Relatório da empresa aponta operações ligadas a Irã, Rússia, China e Iêmen em projetos militares e coleta de informações.
Evan Hubinger disse que a empresa ainda não tem um plano para resolver o alinhamento de uma eventual superinteligência.
A empresa encontrou ambientes de aprendizado por reforço com problemas e identificou comportamentos de manipulação em testes com modelos de IA.