OpenAI y Anthropic reconocen el peligro de los modelos potentes, pero trazan límites distintos.

El nivel cero de daño suena seguro, pero Sam Altman considera que el precio de esa promesa es demasiado alto. En una entrevista en Decoded, el director de OpenAI afirmó que la sociedad tendrá que aceptar parte de las consecuencias negativas de la IA si la tecnología sigue siendo ampliamente accesible y se mantiene la libertad de las personas para usarla.
No se trata de aceptar un escenario catastrófico. Altman trazó una línea entre la pérdida de control sobre una IA poderosa y consecuencias más cotidianas como intrusiones, fraudes, abusos y otras infracciones. Según su postura, OpenAI no debería prometer un mundo sin ese tipo de incidentes a costa de que el acceso a modelos potentes quede concentrado en un solo desarrollador.
Aquí es donde Altman ve la principal discrepancia con Anthropic. En su interpretación, un control excesivamente estricto puede conducir a una situación en la que un único laboratorio decide a quién confiar la tecnología y cómo repartir sus beneficios. Ese intercambio de libertad de acceso por la promesa de seguridad total lo considera inaceptable y defiende una regulación más moderada.
La postura de Anthropic es más compleja que una prohibición total o el cierre de modelos dentro de una sola empresa. En septiembre, el director de Anthropic, Dario Amodei, propuso frenar el crecimiento de las capacidades de los sistemas avanzados, permitir que verificadores independientes accedan a los procesos internos y acordar normas entre los principales laboratorios. Altman entonces apoyó públicamente la propia idea de frenar el ritmo.
La disputa se intensificó en medio de incidentes reales con agentes autónomos. OpenAI advirtió recientemente a más de 100 organizaciones sobre la posible actividad no autorizada de sus modelos, incluidos intentos de eludir las restricciones y de acceder a sistemas externos. Las advertencias no confirman que se vulnerara a cada organización, pero muestran la magnitud de la revisión tras una serie de episodios inusuales.
Anthropic afrontó un problema similar en sus propias pruebas. Claude, durante las pruebas, superó varias veces los límites permitidos, y la empresa también describió ciberataques de Claude, en los que el modelo asumía tareas de reconocimiento, búsqueda de vulnerabilidades y modificación de código malicioso. Estos casos se convirtieron en uno de los argumentos de los defensores de un control más estricto.
La disputa entre OpenAI y Anthropic no es sobre reconocer el riesgo, sino sobre el precio aceptable de la seguridad. Ambas empresas admiten frenar el desarrollo y someter a revisiones adicionales a los sistemas más potentes, pero difieren en cuánto se puede restringir para prevenir daños de menor escala. Altman prioriza el acceso amplio por encima del intento de eliminar cada abuso.