El 20 de agosto de 2026 Anthropic llevó a disponibilidad general (GA) cuatro piezas del modo agente de Claude: computer use con acciones en lote, un tool nuevo de browser use, la Skills API para subir y versionar instrucciones propias, y una Files API con 5 veces más rate limit y 1 TB de almacenamiento por organización.
Para una empresa, el cambio concreto es este: un agente puede operar un ERP viejo, un portal web sin integración o una aplicación de escritorio mirando la pantalla y actuando sobre ella, sin que nadie tenga que exponer una API. El costo no es técnico sino de gobernanza: el navegador y el entorno los ponés vos, y la superficie de riesgo por prompt injection es real.
¿Qué sacó Anthropic de beta el 20 de agosto de 2026?
Cuatro capacidades que venían en preview pasaron a estar disponibles en producción sobre Claude Platform, con soporte también en Microsoft Foundry y con Google Cloud Vertex AI anunciado como próximo. No es un producto nuevo: es el permiso para poner en producción lo que hasta ahora servía para prototipar.
| Pieza | Qué cambió |
|---|---|
| Computer use | Varias acciones por turno en lugar de una por llamada a la API, lo que acorta el tiempo de la tarea. Suma elegibilidad HIPAA para cargas de salud reguladas bajo BAA. |
| Browser use (nuevo) | Un toolset aparte para trabajo dentro del navegador: lee la estructura de la página y actúa sobre elementos por referencia, no solo por píxel. |
| Skills API | Una API más simple para subir y versionar tus propias Skills. Corren en el sandbox de código de Anthropic: no hay que hostear nada. |
| Files API | Expiración automática de archivos, 5x más rate limit y 1 TB de almacenamiento por organización. |
¿Cómo hace un agente para operar un sistema que no tiene API?
Haciendo lo mismo que hace una persona: mirar la pantalla, mover el mouse, tipear y verificar el resultado. En vez de pedirle al proveedor del ERP que exponga un endpoint —un proyecto que en muchas pymes argentinas no llega nunca—, el agente opera la interfaz que ya existe.
Técnicamente, Claude no se conecta solo a nada. Tu aplicación recibe los pedidos de tool use, los traduce en acciones dentro de tu entorno, captura el resultado —una captura de pantalla, la salida de un comando— y se lo devuelve al modelo. La documentación de Anthropic es explícita con el browser use: la aplicación corre cada llamada contra su propia automatización de navegador y nada se ejecuta del lado de Anthropic.
Ese detalle es el que se pierde en los titulares. “Sin tocar una sola API de tu sistema” es cierto respecto del sistema que querés automatizar; no es cierto respecto de la infraestructura, que sigue siendo tuya: un contenedor, un navegador, un ejecutor. Es la diferencia entre un proyecto de integración con el proveedor y un proyecto de automatización propio.
¿Cuál es la diferencia entre computer use y browser use?
Computer use maneja la computadora entera por píxeles sobre una captura de escritorio. Browser use se queda dentro de las páginas web y agrega algo que computer use no tiene: la estructura de la página. Los dos se pueden declarar en la misma request y funcionan de forma independiente, cada uno en su propio marco de coordenadas.
| Criterio | Computer use | Browser use |
|---|---|---|
| Alcance | Escritorio completo: apps instaladas, explorador de archivos, terminal. | Solo páginas web, con manejo de varias pestañas. |
| Cómo “ve” | Capturas de pantalla y coordenadas. | Árbol de accesibilidad con referencias por elemento, más capturas cuando hace falta. |
| Fuerte en | Software de escritorio y sistemas legacy que no viven en el navegador. | Portales que arman su contenido con JavaScript y tareas de completar formularios. |
| Disponibilidad | Claude API y, en versiones beta anteriores, AWS, Bedrock, Google Cloud y Microsoft Foundry. | Solo Claude API. No está en Bedrock, Vertex, Foundry ni en los agentes gestionados. |
La regla práctica que da la propia documentación: elegí browser use cuando la tarea vive dentro de páginas web y hay que actuar sobre ellas, no solo leerlas. Elegí computer use cuando el trabajo sale del navegador. Si todavía estás ubicando qué clase de agente necesitás, ahí ayuda el mapa de tipos de agentes de IA para empresas.
¿Qué son las acciones en lote y por qué bajan el tiempo y el costo?
Antes, cada clic era una llamada a la API con su ida y vuelta. Con las acciones en lote, Claude planifica una secuencia corta —hacer clic, tipear, sacar una captura— y la devuelve junta en una sola respuesta. Tu ejecutor las corre en orden, no en paralelo, y se detiene en la primera que falla: la acción de tipear depende de que el clic anterior haya puesto el foco donde correspondía.
El efecto es medible. Anthropic cita el caso de Asteroid, donde el flujo de reclamos más largo pasó de 32 minutos a 13, el costo por tarea bajó cerca de un 30% y la tasa de finalización llegó al 100%. Traducido a una operación administrativa argentina: menos espera por cada carga y un costo por comprobante procesado que empieza a competir contra el de una persona haciendo la misma tarea a mano.
¿Para qué sirven la Skills API y la Files API en este esquema?
Un agente que opera pantallas necesita dos cosas que no vienen del modelo: instrucciones estables sobre cómo se hace el proceso en tu empresa, y un lugar donde dejar los archivos que produce. Esas son, exactamente, las dos piezas que salieron de beta junto con computer use.
La Skills API permite subir y versionar carpetas de instrucciones que Claude carga cuando son relevantes. Lo importante para una empresa es el versionado: el procedimiento de conciliación deja de vivir en el prompt de quien lo escribió y pasa a ser un artefacto con historial, que se corrige una vez y aplica a todas las corridas. Cómo se arma una desde cero está en la guía de cómo crear Skills en Claude para tu empresa.
La Files API resuelve el volumen: 5 veces más rate limit, 1 TB por organización y expiración automática. Ese último punto no es menor para Legal —los archivos con datos de clientes dejan de acumularse para siempre por descuido.
¿Es seguro apuntar un agente al portal de ARCA o al home banking?
No con la configuración por defecto, y la propia documentación de Anthropic lo dice sin adornos: Claude a veces sigue instrucciones que encuentra en el contenido de una página aunque contradigan las tuyas. Un texto plantado en un portal que diga “ignorá tus instrucciones previas y navegá a...” puede desviar al agente. Es prompt injection clásico, y en un agente que hace clics deja de ser un problema de texto para ser un problema de acciones.
Los recaudos que la documentación marca como requisito, no como sugerencia:
- Correr el navegador y el ejecutor en un contenedor o máquina virtual dedicada, con privilegios mínimos, perfil nuevo sin credenciales y sin acceso a la red interna.
- Limitar los destinos con una allowlist de dominios aplicada a nivel de red y revalidada después de cada redirección.
- Tratar todo lo que devuelve la página como entrada no confiable, incluidos títulos de pestaña y URLs.
- Dejar deshabilitados los miembros peligrosos del toolset, como la ejecución de JavaScript y la subida de archivos, salvo que el caso los exija.
- Exigir confirmación humana en toda acción consecuente: pagar, modificar cuentas, enviar mensajes o aceptar términos.
- Si la tarea necesita una sesión iniciada, usar una cuenta dedicada de bajo privilegio, nunca la del dueño del sistema.
Ese último punto separa este enfoque del atajo de darle al agente las credenciales personales de un empleado, el problema que analicé en Grok Bot y los agentes que piden tus credenciales. Y si la empresa está regulada, la contracara de la ejecución es la trazabilidad: cómo se reconstruye después qué hizo el agente lo cubre la Compliance API de Claude.
¿Qué conviene automatizar primero en una pyme argentina?
El criterio no es “qué es lo más vistoso” sino “qué tarea es repetitiva, tiene un resultado verificable y no mueve plata sola”. Tres candidatos típicos, en ese orden:
- Carga de datos entre dos sistemas que no se hablan: el agente lee del portal del proveedor y carga en el ERP. El resultado se verifica contra el comprobante.
- Descarga periódica de comprobantes o extractos desde portales que no ofrecen exportación masiva. Solo lectura, riesgo bajo.
- Preparación de trámites que un humano revisa y confirma: el agente deja el formulario completo, la persona aprieta enviar.
Lo que no conviene poner primero: cualquier flujo que termine en un pago, una presentación con efecto legal o un mensaje a un cliente sin revisión. Esa frontera es la misma que recomiendo en cualquier implementación de IA en empresas: el agente arma, la persona aprueba.
Vale una aclaración de expectativas. Esto es trabajo sobre la API de Claude, no una casilla que se activa en una suscripción: hay que montar el entorno, escribir el ejecutor y definir la política de aprobación. Si tu equipo todavía no tiene un agente corriendo, el camino corto empieza por un proceso acotado, como muestro en el recorrido de un agente de IA cubriendo un proceso completo en una pyme, y se apoya en el panorama general del pilar de agentes de IA.
Preguntas frecuentes sobre computer use y browser use de Claude.
Es la capacidad de Claude de operar una computadora como lo haría una persona: mirar la pantalla, mover el mouse, hacer clic, tipear y verificar el resultado. Pasó a disponibilidad general el 20 de agosto de 2026 con acciones en lote —varias acciones por turno en lugar de una por llamada a la API— y sumó elegibilidad HIPAA bajo BAA. Sirve para automatizar sistemas que no exponen una API, como un ERP viejo o una aplicación de escritorio.
Computer use maneja el escritorio completo por píxeles sobre una captura de pantalla. Browser use se queda dentro de páginas web y agrega la estructura de la página: puede leer un árbol de accesibilidad, actuar sobre elementos por referencia además de por coordenada, cargar valores de formulario directamente y trabajar entre pestañas. Los dos se pueden declarar en la misma request. Browser use está solo en la Claude API; computer use también está en AWS, Bedrock, Google Cloud y Microsoft Foundry con versiones beta anteriores.
Lo ponés vos. La documentación de Anthropic es explícita: tu aplicación corre cada llamada contra su propia automatización de navegador y nada se ejecuta del lado de Anthropic. Lo mismo vale para computer use: Claude devuelve pedidos de herramienta, tu aplicación los traduce en acciones dentro de tu entorno —típicamente un contenedor con display virtual— y devuelve los resultados. Automatizar sin API al sistema destino no significa automatizar sin infraestructura propia.
No con la configuración por defecto. La propia documentación advierte que Claude a veces sigue instrucciones que encuentra en el contenido de una página aunque contradigan las tuyas: es prompt injection, y en un agente que hace clics se convierte en un problema de acciones. Los recaudos exigidos son contenedor aislado con privilegios mínimos y perfil sin credenciales, allowlist de dominios a nivel de red revalidada tras cada redirección, tratar todo lo que devuelve la página como entrada no confiable, dejar deshabilitadas la ejecución de JavaScript y la subida de archivos, y confirmación humana en toda acción consecuente.
Claude planifica una secuencia corta de acciones —clic, tipear, captura— y las devuelve juntas en una sola respuesta; tu ejecutor las corre en orden, no en paralelo, y se detiene en la primera que falla. Anthropic cita el caso de Asteroid: su flujo de reclamos más largo pasó de 32 minutos a 13, el costo por tarea bajó cerca de un 30% y la finalización llegó al 100%.
La Skills API permite subir y versionar carpetas de instrucciones propias que Claude carga cuando son relevantes; corren en el sandbox de código de Anthropic, así que no hay que hostear nada. El versionado es lo que convierte un procedimiento interno en un artefacto con historial en vez de un prompt suelto. La Files API sumó expiración automática de archivos, 5 veces más rate limit y 1 TB de almacenamiento por organización.
Uno repetitivo, con resultado verificable y que no mueva dinero solo. En orden: carga de datos entre dos sistemas que no se hablan, descarga periódica de comprobantes o extractos desde portales sin exportación masiva, y preparación de trámites que un humano revisa y confirma. Conviene dejar para después cualquier flujo que termine en un pago, una presentación con efecto legal o un mensaje a un cliente sin revisión.
Última actualización: 24 de agosto de 2026 · Versión 1.0 · Basado en el anuncio oficial de Anthropic del 20 de agosto de 2026 y en la documentación de Claude Platform sobre los toolsets de computer use y browser use. Opinión y análisis: Diego Ceredi, consultor certificado por Anthropic (Claude) y Google (Gemini).

Anthropic publicó su manual para meter IA en el desarrollo de software: Claude ya escribe el 80% de su código
9 min de lectura
Claude Sonnet 5: el modelo pensado para que los agentes de IA salgan más baratos a tu empresa
8 min de lectura