La división de Google dedicada a la inteligencia artificial, ha anunciado la integración de la capacidad de uso del ordenador como una función nativa dentro del modelo Gemini 3.5 Flash. Con anterioridad a esta actualización, la característica operativa para interactuar con sistemas informáticos se encontraba disponible únicamente como una versión independiente bajo la denominación de Gemini 2.5. Gracias a este cambio en la arquitectura del sistema, los desarrolladores disponen ahora de la posibilidad de programar agentes personalizados que interactúan directamente con distintos entornos operativos, abarcando tanto los navegadores web como los dispositivos móviles y los sistemas de escritorio.
Esta actualización de las capacidades del modelo se dirige fundamentalmente a la ejecución de tareas de automatización empresarial complejas y de largo recorrido, entre las que se incluyen las pruebas continuas de software o la gestión automatizada del flujo de trabajo en las aplicaciones profesionales. Los responsables de tecnología e integradores pueden acceder a estas herramientas a través de la interfaz de programación de aplicaciones de la marca y de su plataforma de agentes orientada al sector corporativo. Distintas organizaciones de la industria del software, como es el caso de Browserbase, Browser Use y UIPath, ya han empezado a aplicar estas capacidades de interacción en sus operaciones.
En el ámbito de la fiabilidad operativa y la protección de los sistemas, Google ha aplicado un entrenamiento específico destinado a mitigar los riesgos derivados de la manipulación de instrucciones cuando los agentes operan en entornos de producción reales. Para complementar esta protección básica, las organizaciones tienen a su disposición sistemas de salvaguarda de carácter opcional diseñados para mantener el control sobre los procesos automatizados.
La primera de estas medidas de contención permite configurar el modelo para que exija la validación explícita por parte de un usuario humano antes de llevar a cabo acciones de naturaleza crítica o que resulten irreversibles para la infraestructura, mientras que la segunda medida consiste en la interrupción automática y preventiva de las tareas en curso si la plataforma identifica de manera interna un intento de inyección indirecta de comandos no autorizados.
Para garantizar un despliegue seguro en las infraestructuras corporativas, los creadores del sistema aconsejan adoptar una estrategia de seguridad basada en la defensa en múltiples capas, lo que requiere combinar obligatoriamente estas novedades de software con entornos de ejecución aislados, una verificación humana constante, y controles de acceso sumamente rigurosos.
Los profesionales que deseen experimentar con esta herramienta de interacción pueden hacerlo a través de un entorno de demostración habilitado a tal efecto, o bien iniciar el desarrollo de sus agentes consultando la documentación oficial proporcionada en los canales para desarrolladores de Google.



