Imagina que estás mirando la pantalla de tu PC y de repente el ratón empieza a moverse solo, rellena un formulario que tienes abierto en el navegador y pulsa el botón de enviar. Qué mal rollo, ¿no?
Pues eso es precisamente en lo que está trabajando ahora mismo Anthropic, la desarrolladora de Claude, uno de los mejores chatbots IA del mercado. Al fin y al cabo, si un modelo de lenguaje puede leer y entender texto escrito, ¿por qué no aprovechar esa habilidad para interactuar con nuestro PC y hacer todo ese trabajo pesado que tan poco nos gusta?
Aunque la idea de fondo es buena, lo cierto es que tengo la sensación de que están sobrepasando una enorme línea roja. Si la IA (y Claude no es una excepción) todavía sufre alucinaciones cuando le hacemos una pregunta normalita, ¿Qué pasará cuando le pidamos que rellene el formulario para las actividades extraescolares de nuestro hijo, o para que haga la reserva de un videojuego online que llevamos tiempo esperando?
«Pásame el ratón y el teclado, que yo me encargo»
Según indican los creadores de Claude, el chatbot ahora cuenta con una función llamada simplemente “uso de la computadora”, que le permite ver lo que tienes en la pantalla de tu PC. Para ello, Claude hace una captura de pantalla y analiza lo que tiene delante. A partir de ahí, y siempre según las indicaciones de nuestro prompt, el chatbot podrá escribir texto, pulsar botones y utilizar algunas de las herramientas y programas de uso común disponibles en PC.
Anthropic ha dejado claro que esta nueva función todavía está en pañales, y la IA aún tiene problemas para hacer tareas sencillas como un scroll, hacer zoom o arrastrar elementos de un lugar a otro. Pero la funcionalidad está en camino. Vaya que sí lo está. De hecho, ya se puede usar con la última beta pública del modelo Claude 3.5.
«En esta etapa, todavía es una función experimental, a veces engorrosa y propensa a errores”, dicen desde Anthropic. “Hemos lanzado el “uso de la computadora” con anticipación para así poder recibir comentarios de los desarrolladores y esperamos que la capacidad mejore rápidamente con el tiempo.” Claro que sí.
Podéis ver un ejemplo de cómo funciona esta nueva herramienta en este post de Twitter (X) que Anthropic publicó hace un par de días. El objetivo es que podamos usar la IA para realizar tareas repetitivas y automatizarlas, dándole así un uso más amplio que el de un simple chatbot conversacional.
Según indican desde Cnet, parece que Anthropic ya está trabajando con empresas como Asana, Canva, Cognition, DoorDash, Replit y The Browser Company para integrar esta funcionalidad en sus productos. No se si Anthropic conseguirá su objetivo, pero tal y como está el asunto de las alucinaciones IA en este momento sin duda parece una herramienta de lo más arriesgada. Repito, la idea es buena. Pero no se si hemos llegado ya a ese punto en el que podemos confiar tanto en la IA como para mandarle tareas que claramente necesitan un mínimo de supervisión humana.
Quizá también te interese:
- Ya puedes hablar con Gemini Live en español: así se activa
- Pi, un chatbot IA que habla como ChatGPT Plus y es gratuito
- Así es OpenAI o1, la IA que “piensa y razona” antes de responder
¿Tienes Telegram instalado? Recibe el mejor post de cada día en nuestro canal. O si lo prefieres, echa un vistazo a nuestro canal de WhatsApp.




