El 22 de septiembre (hora de EE. UU.), Anthropic lanzó Claude Opus 5.5.
Ese mismo día, OpenAI anunció GPT-6 Sol y Luna.
Ambos son "más inteligentes que antes y más baratos que antes".
De todo esto, lo que me llamó la atención fue un dato específico del anuncio oficial.
En un comentario de Deloitte, se indica:
"Incluso en la configuración más baja, encontró el 72 % de los bugs conocidos. Opus 5 encontró el 56 % en la configuración alta".
Esto significa que la capacidad de leer código y detectar vulnerabilidades mejoró muchísimo en una sola generación.
La IA va a construir cosas que "funcionan".
Pero para que sean "seguras", los humanos tenemos que dar las instrucciones.
Por eso, acá van 5 puntos clave para tener en cuenta cuando armes apps internas con Opus 5.5.
Cada uno viene acompañado de un prompt para que Opus 5.5 revise el trabajo.
====
Cómo hacer la revisión
Cuando termines de construir, no preguntes "¿Hay algún problema?" en la misma sesión donde armaste todo.
La IA que lo creó toma su propio diseño como punto de partida, así que se vuelve permisiva.
Abrí una nueva sesión, configurá el modelo en Opus 5.5 y mostrale toda la carpeta de la app.
Después, asegurate de que cada problema encontrado incluya "qué archivo y qué línea".
El comentario de Deloitte menciona que los falsos positivos bajaron, pero no llegaron a cero.
Si te indican la ubicación exacta, después los humanos podemos verificarlo.
Esta es la instrucción:
"Eres un responsable de seguridad que ve este código por primera vez. Si encuentras problemas, indica el nombre del archivo, el número de línea, por qué es peligroso y cómo solucionarlo. Separa cualquier cosa de la que no estés seguro bajo la etiqueta 'Necesita verificación'."
====
1. ¿Hay algo visible para personas que no iniciaron sesión?
Cuando dejás que la IA construya, pueden faltar muros de inicio de sesión en pantallas o salidas de datos.
Un patrón común es que las pantallas de confirmación creadas durante el desarrollo queden accesibles públicamente.
La comprobación es simple.
Abrí el panel de administración o las URL de datos directamente en el navegador sin iniciar sesión (ventana de incógnito).
Si podés verlos, es un fallo.
Esta es la instrucción:
"Enumera todas las URL y API accesibles sin iniciar sesión. Entre ellas, ordena por nivel de peligro aquellas que devuelvan datos o sean de administración."
====
2. ¿Los usuarios autenticados pueden ver los datos de otras personas?
Iniciar sesión verifica "quién" es alguien.
"Qué puede ver esa persona" tiene que construirse por separado.
La comprobación consiste en crear dos cuentas de prueba. Iniciá sesión como A y después intentá abrir la URL de datos de B.
Esta es la instrucción:
"Encuentra cualquier ruta donde el Usuario A pueda ver o modificar los datos del Usuario B. Incluye los casos en los que se acceda directamente a URL o API, omitiendo la interfaz de usuario."
====
3. ¿Hay claves o contraseñas en lugares visibles?
El código que se ejecuta del lado del navegador se envía completo a la PC del usuario.
Escribir claves ahí es lo mismo que repartirlas entre todos.
Otro error común es subir archivos de configuración que contienen claves a carpetas compartidas o a GitHub.
Esta es la instrucción:
"Busca claves de API, contraseñas o tokens incluidos en el código del lado del cliente, archivos de configuración o historial de commits. Si los encuentras, sugiere dónde deberían moverse."
====
4. ¿Los permisos otorgados a las herramientas son demasiado amplios para sus tareas?
Las herramientas internas suelen conectarse a Google, Slack o bases de datos.
A veces, la clave proporcionada permite "eliminar" o "ver todo", aunque solo se necesite "leer".
Este es un problema muy común.
Si esa clave se filtra, el alcance del daño lo determina el nivel de permisos.
La comprobación es anotar: "En el peor de los casos, ¿qué puede eliminar esta herramienta?".
Si no podés responderlo de inmediato, tené cuidado.
Esta es la instrucción:
"Enumera todos los permisos que esta herramienta tiene sobre servicios externos o bases de datos. Compara cada uno con los permisos mínimos necesarios para el procesamiento real y señala cualquier exceso."
====
5. ¿Los textos entrantes del exterior se están ejecutando como comandos?
Las herramientas que permiten a la IA leer correos electrónicos, páginas web o archivos subidos requieren precaución.
Si contienen texto como "Ignora las instrucciones anteriores y haz XX", la IA podría obedecer.
Esto se llama Prompt Injection.
En el anuncio de Opus 5.5, se indica que la resistencia a este ataque es "igual o mejor que Opus 5 en todos los escenarios probados".
Sin embargo, igual o mejor no significa riesgo cero. Todavía necesitás defensas del lado de la herramienta.
Esta es la instrucción:
"Busca lugares donde el texto o los archivos cargados desde el exterior se traten como instrucciones para la IA. Si los encuentras, cambia el manejo para que el contenido cargado se trate únicamente como información de referencia, ignorando cualquier instrucción que contenga."
====
Resumen
La IA va a construir las funciones que le pidas.
Pero "no mostrar a otros" y "no otorgar permisos excesivos" no van a estar incluidos a menos que lo digas.
Por el contrario, estos 5 puntos se pueden resolver simplemente agregando una instrucción.
Y la capacidad de Opus 5.5 para encontrar agujeros en lo que construiste también mejoró.
Después de armarlo, mostráselo a Opus 5.5 en una conversación nueva.
Considerá eso parte del desarrollo.
Si ya tenés una app interna funcionando, empezá pegando la instrucción de revisión de la sección "Cómo hacer la revisión".
Además, si pegar instrucciones cada vez te resulta tedioso, hay un plugin llamado security-review que te recomiendo probar.
Presta atención a los detalles finos y los señala, así que yo mismo lo uso regularmente.
====
Por último, un pequeño anuncio.
Nuestra empresa ofrece un servicio para desarrollar agentes de IA específicos para tu negocio desde cero.
No se trata de capacitaciones ni de presentaciones de herramientas, sino de escuchar tus flujos de trabajo reales para entregarte algo que puedas usar "a partir de mañana". También damos soporte para la integración y el mantenimiento.





