Inteligencia artificial

Tras las advertencias de Anthropic, OpenAI presenta su plan para una IA segura

OpenAI propone estándares comunes para modelos de frontera, priorizando el alineamiento y el control humano ante el riesgo de automejora recursiva. El anuncio llega justo después de las advertencias de Anthropic y marca un cambio de tono en la industria.

Publicado el

Tras las advertencias de Anthropic, OpenAI presenta su plan para una IA segura
Xataka — Tecnología en Español

OpenAI acaba de publicar un artículo titulado "Desarrollar los estándares para la próxima fase de la IA" donde Sam Altman y Jakub Pachocki detallan su visión para avanzar de forma segura hacia sistemas más potentes. El texto comienza con una frase clara: "Nuestro objetivo es garantizar que la inteligencia artificial general beneficie a toda la humanidad".

El anuncio llega pocos días después de que Anthropic, el laboratorio creador de Claude, lanzara advertencias públicas sobre los riesgos de modelos cada vez más autónomos. Este giro de OpenAI, que hasta hace poco parecía inmersa en una carrera sin frenos, muestra que los principales jugadores de la industria estadounidense están empezando a coincidir en la necesidad de poner límites.

El concepto central del documento es la automejora recursiva: la capacidad de un modelo de generar versiones más avanzadas de sí mismo sin intervención humana. Según OpenAI, esto representa el riesgo más grave porque podría hacer que perdamos el control de la tecnología. Hoy esa capacidad completamente autónoma todavía no existe, pero advierten que a medida que aumenta la automatización, también se acelera el progreso.

Por eso proponen dos líneas de trabajo que deben avanzar en paralelo: por un lado, el desarrollo de modelos de frontera (los más potentes) y, por el otro, la investigación en alineamiento. El alineamiento busca que los sistemas más autónomos sigan siempre los objetivos humanos y permanezcan bajo nuestra supervisión.

Además, OpenAI sugiere crear estándares técnicos comunes que incluyan evaluaciones de seguridad, protocolos claros de notificación de incidentes y mecanismos de cooperación internacional. La idea es que la supervisión no dependa solo de cada laboratorio o de cada país, sino de instancias más neutrales que aprovechen el trabajo que ya vienen haciendo los institutos de seguridad de la IA.

Desde Argentina, este debate no es abstracto. Aunque no tenemos laboratorios de frontera, sí tenemos startups y pymes que cada vez integran herramientas de IA en sus procesos. Un escenario donde se pierda el control humano sobre estos sistemas podría afectar desde la moderación de contenidos hasta decisiones automatizadas en finanzas o salud. Por eso importa seguir de cerca cómo evolucionan estos compromisos.

El desafío que plantea OpenAI es enorme: lograr que los países más avanzados, especialmente Estados Unidos y China, se pongan de acuerdo en los mismos estándares de seguridad. Hoy eso parece lejano, pero el hecho de que los propios laboratorios estén pidiendo reglas comunes es una señal de que el debate está madurando.

Lo concreto es que OpenAI no solo habla de riesgos, sino que propone un itinerario: priorizar el alineamiento antes de perseguir la automejora recursiva, definir qué incidentes deben reportarse a las autoridades y crear protocolos conjuntos de respuesta.

Para quienes seguimos el tema desde hace tiempo, este documento marca un cambio de tono. Ya no se trata solo de competir por ser el primero en lanzar el modelo más potente, sino de asegurar que ese poder siga estando bajo control humano.

¿Qué podés hacer vos mientras tanto? Seguir usando las herramientas actuales con criterio, exigir transparencia a las empresas y estar atento a cómo se traduce este debate en regulaciones que puedan llegar a la Argentina. Porque aunque el desarrollo ocurre lejos, sus consecuencias las vamos a vivir todos.

← Volver a Inteligencia artificial