Un investigador principal de Anthropic estima que existe una probabilidad de más del 10% de que la inteligencia artificial cause la extinción humana en la próxima década, lo que provocó la renuncia de un colega por preocupaciones sobre el ritmo del desarrollo de la IA. Evan Hubinger, director científico de alineación de Anthropic, hizo esta declaración en X, al tiempo que reconocía que la empresa no tiene un plan claro para garantizar la seguridad de la IA superinteligente. Los comentarios siguieron a la renuncia de Jacob Coxon, quien acusó tanto a Anthropic como a OpenAI de priorizar la velocidad sobre la seguridad en el desarrollo de sistemas de IA auto-mejorables, afirmando que están “jugando con nuestras vidas”. Coxon citó específicamente incidentes de agentes de IA que violan los protocolos de seguridad, incluido un reciente hackeo de Hugging Face. Anthropic ha retenido su último modelo de IA, Claude Mythos 5.1, del Instituto de Seguridad de la IA (AISI) del Reino Unido, aunque la empresa continúa colaborando con el instituto. Dame Wendy Hall, asesora de la ONU sobre IA, sugirió que las advertencias podrían estar relacionadas con las próximas ofertas públicas iniciales (OPI) para ambas compañías. Si bien los riesgos actuales de la IA se consideran bajos, Hubinger expresó su preocupación por el potencial de una auto-mejora rápida y recursiva, una preocupación compartida por Coxon, quien cree que los riesgos no se están abordando adecuadamente. El Financial Times informó que Anthropic retuvo su último modelo del Instituto de Seguridad de la IA (AISI) del Reino Unido.
Dónde difieren
• RT enfatizó las advertencias pasadas de Elon Musk sobre la IA, mientras que otros medios no lo hicieron.
• CBS News y CNBC destacaron el potencial de una OPI para Anthropic y OpenAI, enmarcando las advertencias como potencialmente relacionadas con las preocupaciones de los inversores, un punto menos prominente en otros informes.
• Tomshardware enmarcó el riesgo como ligeramente menor que las probabilidades de que los Jets lleguen a los playoffs en 2026, agregando una comparación ligera ausente en otra cobertura.
• Axios presentó las advertencias como provenientes de 'tres investigadores de Anthropic', enfatizando la naturaleza colectiva de la preocupación.
Qué aún no se sabe
• Los mecanismos específicos por los cuales la IA podría causar la extinción humana siguen sin especificarse.
• No está claro en qué medida la decisión de Anthropic de retener su último modelo del Instituto de Seguridad de la IA (AISI) del Reino Unido refleja un patrón más amplio de intercambio limitado de información.
Leer la cobertura original
💬 Comentarios
📜 Política de comentarios