0928 | Teclados, NPCs y agentes: la semana en tecnología

||Download

Show notes

En este episodio revisamos cuatro lanzamientos y novedades que muestran hacia dónde va la tecnología: un teléfono Android con teclado físico que rescata los mensajes como centro, NPCs de IA que ya viven en un servidor real de GTA, herramientas que ponen IA dentro de tu flujo de trabajo (desde verificar respuestas de modelos hasta agentes que resuelven tickets de IT), y la llegada de GPT-6 Sol y Luna con precios más bajos para desarrollo intensivo.

Línea de tiempo

  • 00:00:04 Apertura
  • 00:00:49 Hardware y mundos vivos: Clicks Communicator y NPCs de IA en GTA
  • 00:13:06 IA integrada en tu flujo de trabajo: Cuey y Superhuman Go
  • 00:17:56 De macOS a la empresa: KiwiDesk, agentes de IT y GPT-6 Sol y Luna
  • 00:27:46 Cierre

Enlaces relacionados

Este episodio es producido por Bri. Bri usa tecnología avanzada de IA para convertir los feeds que te importan en podcasts pensados para escuchar. Puedes escribirnos a hi@bri.so.

Transcript

Clara Vega: ¡Hola y bienvenidos al briefing! Yo soy Clara Vega.

Mateo Ruiz: Y yo Mateo Ruiz. Bienvenidos a una nueva edición, donde hojeamos lo que se ha lanzado en las últimas veinticuatro horas y nos quedamos con las historias que de verdad valen la pena desmenuzar.

Clara Vega: Y hoy hay un hilo curioso que conecta todo lo que vamos a contar: productos que se atreven a cambiar lo que damos por sentado. Un teléfono que recupera el teclado físico, NPCs de videojuego que se comportan como personas, extensiones que comprueban lo que te dice la IA sin que te muevas de tu ventana, y herramientas que prometen funcionar sin terminal, sin formularios y a mitad de precio.

Mateo Ruiz: Sí, la idea de fondo es casi siempre la misma: en lugar de añadir otra capa sobre lo que ya existe, rediseñar el punto de partida. Vamos a empezar con lo más analógico de todo, que paradójicamente es un móvil nuevo.

Clara Vega: Vamos allá. Se llama Clicks Communicator, y es un teléfono compacto con Android 17 construido alrededor de un teclado físico. La pantalla es de solo 4,03 pulgadas, una pantalla AMOLED, y la filosofía es literal: diseñada para hacer cosas, no para hacer scroll infinito.

Mateo Ruiz: Y lo describen como algo que puedes usar de dos maneras: como tu teléfono principal, o como acompañante de tu iPhone, tu Galaxy o tu Pixel. Esa es una decisión interesante, porque no disimulan que la mayoría de la gente ya tiene un teléfono grande y caro. Te lo ofrecen como complemento.

Clara Vega: Pero insisten en que puede ser el principal si quieres. Es un smartphone completo: 5G, todas las apps de Android, Wi-Fi. Lo que cambia es la forma de interactuar. Teclado físico con teclas ergonómicas, y aquí viene el detalle que más llamó la atención de la comunidad: el teclado es táctil. No es solo un teclado mecánico.

Mateo Ruiz: Eso es justo lo que señaló uno de los comentarios, y me parece que es el más agudo de toda la discusión. Este usuario decía que la mayoría de los teléfonos retro con teclado tratan las teclas como entrada puramente mecánica y, como mucho, le pegan una zona de gestos a la barra espaciadora. Aquí el teclado entero responde al tacto: puedes desplazarte por tu bandeja de entrada, por mensajes o por páginas web sin abandonar el teclado.

Mateo Ruiz: Y su pregunta era muy legítima: ¿la capa táctil sustituye al trackpad por completo o es aditiva? Es decir, ¿puedes colocar el cursor arrastrando sobre las teclas, como hacían los BlackBerry de antaño con su truco de teclado como trackpad?

Clara Vega: Y no vimos respuesta a eso en el material que tenemos, así que queda como pregunta abierta. Es una distinción importante, porque hay gente a la que ese gesto de BlackBerry le cambió la vida y otros a los que les da igual. Pero sigamos con lo demás, porque hay más capas de entrada. Hay un sensor de huellas: apoyas el pulgar en la barra espaciadora y desbloqueas directamente hacia el hub de mensajes.

Mateo Ruiz: El hub de mensajes es otra de las piezas centrales. Trae las conversaciones de tus aplicaciones favoritas a la pantalla de inicio, y usas atajos de teclado para clasificarlas y actuar rápido. La idea es que no abres app por app para contestar. Todo está en una pantalla.

Clara Vega: Y para saber a quién le toca responder, hay un LED de notificaciones personalizable: se ilumina de distinta manera según la persona o la app que intenta captar tu atención. El ejemplo que dan en la propia web es casi una mini escena: mamá por Telegram, el jefe por WhatsApp. Te dicen quién es sin que enciendas la pantalla.

Mateo Ruiz: Que es una vuelta de tuerca muy interesante, porque el LED de notificaciones es una tecnología que la industria entera sacrificó en favor de las pantallas always-on. Ellos la recuperan porque su pantalla es pequeña y no quieres estar mirándola.

Clara Vega: Después está el botón lateral para voz. Lo mantienes pulsado y puedes dictar, grabar una nota de voz o transcribir una reunión. Es una de las funciones de voz más directas que he visto descritas: un botón físico que convierte la voz en texto sin abrir ninguna aplicación.

Mateo Ruiz: Y ya en el apartado de especificaciones: 12 GB de RAM, 256 GB de almacenamiento ampliable con microSD hasta 2 TB, cámara trasera de 50 megapíxeles con estabilización óptica, frontal de 24, carga inalámbrica Qi2 compatible con MagSafe, conector de auriculares de 3,5 milímetros —que ya es casi una declaración de principios— y pesa 170 gramos.

Clara Vega: Un dato que me parece relevante para la credibilidad del lanzamiento: según uno de los comentarios de la comunidad, Clicks subió el hardware final a 12 GB de RAM y batería de 4.350 miliamperios antes del envío, sin subir el precio de lanzamiento de 499 dólares. Eso es la clase de cosa que se anuncia en un comentario del fundador y hay que tratar como afirmación del fabricante, pero si se cumple es una señal de compromiso con los que reservaron pronto.

Mateo Ruiz: De hecho, ese mismo comentario tiene un tono muy de entusiasta: termina con un "resulta que los botones siguen teniendo mucho sentido". Que es una opinión, evidentemente, pero viene de alguien que explica el producto con detalle.

Clara Vega: Aunque no todo fue una fiesta en los comentarios. Hubo un usuario que detectó un fallo de comunicación en el proceso de compra: la web promociona un descuento de 30 dólares, pero en el segundo paso del flujo, cuando te apuntas a los mensajes de texto, la herramienta de marketing por SMS dice que el descuento es de 20. Es un detalle menor, pero dice algo del estado del embudo de ventas, y el usuario lo señaló para que lo corrigieran.

Mateo Ruiz: Buen ojo, porque ese tipo de incoherencia suele aparecer cuando las piezas del marketing se gestionan por separado. Y también nos da un dato de precios de verdad: 499 dólares de precio de lanzamiento frente a 649, con una oferta que vence el 30 de septiembre. O sea, la reserva está en marcha ahora.

Clara Vega: En cuanto a los teclados, vienen en varias distribuciones: QWERTY inglés, AZERTY francés, QWERTZ alemán, coreano y árabe. Y ojo, porque la disponibilidad está ligada a la región: si no aparece la que quieres en tu zona, tienes que cambiar la región en la web antes de pedir. Y hay una advertencia curiosa: no elijas una distribución que no esté certificada en tu región aunque aparezca, porque por requisitos de certificación no podrán servirte el pedido.

Mateo Ruiz: En el sistema operativo la cosa es más amplia: soportan un buen puñado de idiomas, del danés al chino. Y hay un compromiso de actualizaciones: llegará con Android 17 y prometen soporte hasta al menos Android 20, con mínimo cuatro años de actualizaciones de versión y cinco de seguridad. Para un fabricante pequeño, es una promesa que hay que anotar y verificar con el tiempo.

Clara Vega: Y una limitación práctica importante que salió en las preguntas frecuentes: si quieres hacer y recibir llamadas tradicionales por red móvil, necesitas una segunda SIM o número de teléfono. Las llamadas por internet, como WhatsApp, Telegram o Facebook, sí se traen de tu número principal. Es decir, como acompañante funciona sin fricción, pero si lo usas como teléfono principal necesitas gestionar una línea ahí.

Mateo Ruiz: También mencionan Clicks Care, su garantía ampliada que cubre daños accidentales y un proceso de reposición más rápido, y accesorios de dbrand: la funda MNML y el protector de pantalla Prism, que se añaden al pedido. Y las fundas traseras se pueden intercambiar, con modelos como Smoke o Dune, y curiosamente las fundas de carga incluyen NFC y carga inalámbrica... aunque dicen que todas las fundas las incluyen, incluidas las de serie.

Clara Vega: Bueno, en resumen: un producto muy definido, con una apuesta clara contra la pantalla infinita, a 499 dólares, y con dudas legítimas —el comportamiento real de la capa táctil, si la gente lo adopta como principal o lo abandona como accesorio de cajón. Pero la evidencia de comunidad es de entusiasmo más que de uso verificado, así que conviene quedarse con las especificaciones y las promesas, no con la nostalgia.

Mateo Ruiz: Y del mundo físico de los botones saltamos a un mundo que tampoco existe del todo todavía: servidores de rol de GTA, esos mundos de FiveM donde la gente interpreta personajes. Allí acaba de lanzar Humalike, con NPCs de IA que hablan, recuerdan y actúan por su cuenta.

Clara Vega: El problema que atacan es muy concreto y muy conocido para cualquiera que haya jugado en un servidor de rol: estos servidores dependen de que haya humanos roleando entre sí. Si a las tres de la mañana no hay suficientes jugadores conectados, o nadie tiene ganas de la escena que tú buscas, el mundo se queda vacío y la experiencia se rompe.

Clara Vega: Uno de los fundadores lo dice con conocimiento de causa: años atrás él mismo dirigía su propio servidor de rol de GTA, y sabe lo rápido que se cae la ilusión cuando faltan personas.

Mateo Ruiz: Su solución: dar a cada NPC una identidad, personalidad, memoria y comportamiento propio. Reconocen a los jugadores y construyen relaciones distintas con cada persona que conocen. Reaccionan a las conversaciones, a la ropa, a las máscaras, a las armas, a los disparos y a los eventos del servidor. Y pueden decidir qué revelar, qué ocultar y cuándo mentir. Ese último punto me parece el más ambicioso: no son burbujas de diálogo, son actores con agenda.

Clara Vega: Y el dato más sólido de todo el lanzamiento: no es una demo. Llevan semanas funcionando en producción en Strefa RP, el mayor servidor de rol de Polonia. Ahí hay dos juegos de cifras según dónde mires: el comentario del cofundador habla de más de 20.000 conversaciones, más de 300.000 turnos y más de 40 días de conversación en tres semanas; la web del producto, probablemente con datos de un momento distinto, habla de 1.189 jugadores distintos que chatearon con los NPCs, más de 250.

Clara Vega: 000 turnos y 34 días de tiempo entre NPCs y humanos. Las cifras no coinciden exactamente entre sí, así que las citamos como lo que son: las métricas que ellos mismos reportan.

Mateo Ruiz: Exacto, y aun así, que un tercero —un servidor grande e independiente— los tenga corriendo en vivo es la mejor prueba disponible de que esto no es un vídeo conceptual. Y esa fue justo la reacción de más de un comentario: "ya están corriendo a escala en un servidor real de FiveM y no es una demo".

Clara Vega: Ahora bien, la comunidad también lanzó las preguntas difíciles, y la principal es la latencia. Un comentarista que trabaja en agentes de voz telefónicos lo planteó con experiencia propia: unos pocos milisegundos extra convierten una interacción de voz "en tiempo real" en algo laggy que rompe la inmersión. Y en un servidor multijugador de GTA, además, puede haber varios NPCs reaccionando al mismo evento a la vez.

Clara Vega: Su pregunta técnica: ¿la percepción y la respuesta corren por NPC de forma independiente, o hay alguna capa de estado del mundo compartido que agrupe lo que pasa para no pagar N veces el coste de latencia con N personajes cerca?

Mateo Ruiz: Es la pregunta del millón, y de momento queda abierta. Aunque el fundador sí invitó explícitamente a estos temas: dijo que estaría todo el día respondiendo sobre arquitectura, memoria, latencia, voz, percepción, integración con FiveM y "las cosas que se rompieron en producción". O sea, él mismo reconoce que se rompieron cosas en producción; no sabemos cuáles, pero lo reconoce.

Clara Vega: Otras preguntas de la comunidad sin respuesta en el material: cuál es la ventana de memoria, cuánto recuerda un NPC de un jugador entre sesiones, si los grupos personalizados pueden tener historial compartido entre ellos, y si un NPC trata de verdad diferente a un jugador que vuelve frente a uno nuevo. Todas apuntan a lo mismo: la memoria es la promesa central, y hay que verla funcionar para creerla.

Mateo Ruiz: Pero volvamos a lo que sí está documentado. Los usos que proponen son funcionales, no decorativos: pacientes de emergencias que llaman pidiendo ayuda y entran en escenarios médicos; testigos que recuerdan eventos y hablan con la policía; rehenes que reaccionan a las amenazas; informantes que intercambian secretos con jugadores de confianza; guías que explican las actividades del servidor. Y personajes personalizados conectados a tus guiones e historias.

Clara Vega: Y van más allá de personajes sueltos: proponen construir sociedades de IA enteras. Bandas, equipos de EMS, clubes de motos, negocios, facciones originales. Los miembros comparten conocimiento y memoria de grupo, así que una sola interacción puede cambiar cómo toda la organización ve a un jugador. Eso sí que es un salto conceptual respecto al NPC clásico.

Mateo Ruiz: La personalización es completa según su web: nombre e historia, personalidad y comportamiento, conocimiento y secretos, voz y estilo de habla, apariencia y modelos personalizados, gustos y motivaciones. Y el flujo de trabajo es de tres pasos: instalar el recurso de Humalike en tu servidor FiveM, crear los personajes en su plataforma y desplegarlos, todo desde un panel sin programar.

Clara Vega: Compatible con ESX, Standalone, QBCore, QBox y frameworks personalizados. Y los precios: un plan Starter de 79 dólares al mes con 25.000 interacciones mensuales, un plan RP de 119 con 50.000, y en ambos los primeros mil pasos son gratis; interacciones extra a 119 dólares por 50.000. Es decir, un modelo de pago por uso con umbrales claros.

Mateo Ruiz: Y detrás, dicen, están los primeros inversores de ElevenLabs y Revolut, y se describen como un equipo pequeño de España y Polonia que no duerme mucho. Los datos de la empresa no los podemos verificar, pero el contexto de inversión al menos explica de dónde viene la apuesta por la voz.

Clara Vega: Hubo una reacción de la comunidad que resume bien el potencial: "esto podría resolver uno de los mayores problemas del rol, que es que el mundo se siente vacío cuando no hay suficientes jugadores". Y otra que ya vislumbra escenarios: testigos que recuerdan eventos podrían generar roleo policial realmente interesante.

Mateo Ruiz: Vale, cerremos este bloque con la misma vara que usamos con el teléfono: la evidencia más fuerte es la operación en vivo en un servidor tercero, las métricas son autodeclaradas, y las preguntas duras de latencia y memoria siguen abiertas. Pero la comparación con el teléfono es bonita: ambos atacan el "vacío" de sus mundos —el mundo vacío de jugadores y la pantalla vacía de contenido— añadiendo algo que parecía pasado de moda o imposible: botones y personas artificiales.

Clara Vega: Pues hagamos el salto natural ahora, porque si ya te acostumbras a que las respuestas vengan de personajes con memoria... ¿y si la IA te responde algo equivocado con total seguridad? Vamos con herramientas para no fiarte a ciegas.

Mateo Ruiz: La primera se llama Cuey, y su premisa es una frase que merece repetirse: la IA te da respuestas erróneas con el mismo tono seguro que las correctas. Cuey es una extensión de Chrome que trabaja junto a ChatGPT, Claude y Gemini, y contrasta la respuesta de tu modelo contra ChatGPT, Claude, Gemini y más de 30 modelos más.

Clara Vega: Lo que hace en concreto: compara respuestas de modelos líderes en segundo plano, destaca los desacuerdos significativos y te avisa cuando otro modelo puede tener una mejor respuesta. Sin copiar y pegar entre pestañas, sin repetir tu prompt, sin suscripciones extra. Es un segundo opinion antes de que el primer error te queme.

Mateo Ruiz: Y el detallito que según un comentarista es el verdadero diferenciador: Cuey lleva tu contexto entre herramientas de IA. Ese usuario decía que la mayoría de herramientas de comparación te obligan a repegar el mismo prompt en tres pestañas, lo que anula el ahorro de tiempo. Y remachó con una pregunta muy buena: cuando los modelos discrepan, ¿Cuey intenta decirte cuál tiene más probabilidad de acertar, o solo señala el desacuerdo y deja el juicio en tus manos?

Mateo Ruiz: Porque, como dijo, saber que estás mal es solo la mitad del problema; a veces necesitas un desempate.

Clara Vega: Esa pregunta no la vemos respondida en el material, así que queda en el aire. El equipo, en su presentación, planteó otra pregunta a la comunidad: cuando la IA te da una respuesta segura que resulta estar mal, ¿cómo la compruebas hoy? Y uno de los usuarios respondió con su experiencia exacta: le ha pasado de usar una respuesta segura de la IA y descubrir más tarde que algo estaba mal, y lo molesto era abrir ChatGPT, Claude y Gemini por separado y volver a preguntar.

Clara Vega: Dice que Cuey está hecha para gente como él, que compara antes de decidir en quién confiar.

Mateo Ruiz: También hubo un comentario que enlazaba con una idea de Ben Thompson, la de "escribir las cosas": escribir es lo que hace extensible y escalable el aprendizaje. Y lo aplicaba a Cuey: compara respuestas, conserva el contexto, hazte agnóstico del modelo y usa el mejor para cada tarea. Es una lectura generosa del producto, pero identifica bien su filosofía.

Clara Vega: En cuanto a evidencia de adopción, hay un comentario que menciona que la extensión llegó a 2.000 usuarios y pregunta cuánto tardaron y qué les ayudó; también pide incorporar otros modelos como Grok o Perplexity. Y otro usuario elogia específicamente las respuestas a preguntas difíciles de finanzas y pide más trabajo en análisis de inversión. Ambos son experiencias atribuidas de usuarios, no cifras verificadas, pero marcan hacia dónde empujan los primeros usuarios.

Mateo Ruiz: De Cuey a la otra cara de la misma moneda: Superhuman Go, que no quiere que compares respuestas, sino que la IA esté ya dentro de donde trabajas. Vive dentro de Gmail, Slack, tus documentos y tu navegador: sugiere mejoras de redacción mientras escribes, redacta respuestas de correo que suenan a ti y prepara reuniones antes de que se te ocurra pedírselo.

Clara Vega: El equipo lo describe como proactivo en lugar de basado en prompts, y ese es el punto que levantó la ceja de la comunidad. Un comentarista lo planteó con precisión: una herramienta basada en prompts solo te molesta cuando se la pides; una proactiva tiene que adivinar cuándo su sugerencia es bienvenida y cuándo es solo ruido que acabas aprendiendo a ignorar.

Clara Vega: Su duda concreta: si las sugerencias en tiempo real saltan en cada pulsación de Slack igual que en un borrador de correo largo, se vuelve ruido. ¿Hay ajuste por aplicación o por contexto, o es una única sensibilidad global?

Mateo Ruiz: Pregunta sin respuesta en el material, otra vez. Y es una pregunta importante, porque la proactividad es un producto de dos filos: o te ahorra pensar, o te invades. Es la diferencia entre un buen editor y un autocorrector insistente.

Clara Vega: Lo que sí sabemos de Superhuman Go: prepara reuniones y seguimientos, agendas y asignación de tareas; permite agentes personalizados sin código que se activan por programación o por evento; y tiene conectores MCP para que las sugerencias se apoyen en tus herramientas reales. Y un dato de respaldo nada trivial: está respaldado por el motor de escritura de diecisiete años de Grammarly, no por una IA nueva que empieza de cero.

Mateo Ruiz: Que es una herencia interesante: Grammarly lleva años resolviendo exactamente el problema del tono y la intención en texto. Si eso es cierto tal como lo describen, no es un chaval construyendo un wrapper sobre un modelo, es una empresa con historial extendiendo su núcleo.

Clara Vega: Los dos productos de este bloque comparten, eso sí, la misma tesis: eliminar el copiar y pegar entre pestañas y las repeticiones de contexto. Cuey te protege de las respuestas de la IA; Superhuman Go mete la IA donde tú ya estás. Uno es cinturón de seguridad, el otro es piloto automático.

Mateo Ruiz: Y cerremos este bloque con la pregunta honesta que las dos se merecen: ¿funcionan bien silenciosamente? Cuey tiene que comparar en segundo plano sin interrumpir, y alguien ya preguntó exactamente cómo lo hace. Superhuman Go tiene que saber callarse. Las promesas están escritas; las conductas reales las veremos con uso.

Clara Vega: Del navegador personal saltemos a escala distinta: el escritorio, la empresa y los modelos que alimentan a los agentes. Empecemos por lo más cercano, que es tu Mac.

Mateo Ruiz: KiwiDesk, un gestor de ventanas en mosaico para macOS, y su eslogan lo dice todo: "que parezca que vino de serie con macOS". Lo hizo un desarrollador en solitario alemán, Maikel, y su motivación es muy reconocible: le encantan los gestores de ventanas en mosaico, pero nunca pudo recomendárselos a amigos no programadores. En macOS todos quieren configuraciones por terminal, y el más potente te pide desactivar el SIP, la protección de integridad del sistema.

Mateo Ruiz: Se preguntó si todo eso era realmente necesario, y KiwiDesk es su respuesta.

Clara Vega: ¿Qué hace? Los ventana se organizan solos en uno de siete diseños, incluido un escritorio de scroll infinito donde tus apps están en una cinta que se desliza según el foco. Las apps se abren con un atajo, y hay una función "abrir o enfocar": una tecla abre la aplicación o te trae su ventana si ya existe. Los de ratón tienen barras de espacios y de apps clicables, incluida una barra espaciadora donde arrastras ventanas.

Mateo Ruiz: Y lo importante: cada escritorio nativo de macOS puede tener su propio perfil, con sus espacios, sus diseños, sus colores y sus atajos, que se carga en cuanto deslizas hacia él. Todo se configura en una app de ajustes nativa, con deslizadores y selectores, sin archivo de configuración.

Clara Vega: En permisos, solo necesita el de Accesibilidad. Nada de desactivar SIP, nada de monitorización de entrada, sin cuenta y sin analíticas. Es gratis para uso personal, con código fuente disponible bajo licencia BSL 1.1 —que pasa a MIT cuatro años después de cada versión—, y para los usuarios avanzados hay Lua y una línea de comandos por debajo. Requiere macOS 14 o superior en Apple Silicon, instalable por Homebrew o un DMG notarizado.

Mateo Ruiz: Y de nuevo la comunidad hizo su trabajo: un comentarista dijo que "solo necesita el permiso de Accesibilidad, sin desactivar SIP" era el argumento de venta real frente a los gestores por terminal, y que era exactamente lo que le impedía recomendar yabai a alguien no técnico. Pero lanzó la pregunta técnica clave: ¿cómo aguanta la vinculación de perfiles por escritorio con monitores externos?

Mateo Ruiz: Si desconectas una segunda pantalla, ¿el layout de ese escritorio espera a que el monitor vuelva, o se reasigna al siguiente escritorio y pierdes el mapeo?

Clara Vega: Sin respuesta en el material. Y es una pregunta que separa el juguete bonito de la herramienta de trabajo de verdad, porque los monitores se conectan y desconectan a diario. El autor sí hizo una pregunta interesante a la comunidad: qué les ha impedido hasta ahora probar un gestor de ventanas en mosaico, y dijo que esa respuesta define lo que construye después. Es la postura correcta para un proyecto en solitario: escuchar antes de suponer.

Mateo Ruiz: Y si el escritorio personal se puede ordenar solo, la pregunta obvia es: ¿y el soporte interno de una empresa? Ahí entra Harmony, una plataforma ITSM construida de forma nativa con IA. Y la historia de los fundadores ayuda a entender el porqué: después de su empresa anterior, Epsagon, adquirida por Cisco, pasaron años hablando con líderes de IT de empresas en crecimiento y oyendo siempre lo mismo: el helpdesk se come la semana del equipo.

Clara Vega: Restablecer contraseñas, dar acceso a aplicaciones, onboarding, "mi portátil va lento": cientos de peticiones repetitivas. Y las herramientas tradicionales, dice el cofundador —nombra Freshservice y Jira Service Management—, están diseñadas para registrar el trabajo, no para hacerlo. Ahí está la distinción que define el producto: no es un chatbot pegado a una herramienta de tickets, es una helpdesk construida alrededor de agentes de IA.

Mateo Ruiz: ¿Cómo funciona? El empleado pide por Slack o Teams. Los agentes verifican su identidad, ejecutan la acción en tus sistemas —Okta, Entra ID, Google Workspace y más de cien integraciones— y cierran el ciclo. Sin portal, sin formulario. Y hay más de cien agentes listos para producción de fábrica, más un constructor para los flujos propios.

Clara Vega: Y todo lo que el agente necesita para actuar con seguridad vive en un mismo espacio de trabajo: tickets, inventario de activos, gestión de SaaS, onboarding y offboarding, y gobernanza de IA. Ese es el argumento de arquitectura: el agente tiene contexto, así que puede actuar, y hay gobernanza encima para que no actúe en vacío.

Mateo Ruiz: Las cifras que dan: los clientes suelen alcanzar el 60 por ciento o más de autorresolución en las primeras semanas. Cyera, dicen, está en el 89 por ciento de peticiones de empleados autorresueltas, y n8n gestiona el IT de cientos de empleados con una sola persona de IT. Todas son afirmaciones del fabricante, sin auditoría externa que veamos, así que las tratamos como tal.

Clara Vega: Y de hecho, uno de los comentarios fue directo a ese número: el 60 por ciento en un par de semanas es una rampa muy rápida para un helpdesk, porque la mayoría de la fricción en soporte interno no es la petición en sí, sino los casos límite donde la IA tiene que saber cuándo escalar en lugar de hacer mal algo con confianza. Su pregunta: ¿cómo es el modo de fallo cuando un agente se equivoca?

Clara Vega: ¿Simplemente lo marca el empleado, o hay un mecanismo por el que el agente detecta su propia incertidumbre antes de actuar en algo como un cambio de accesos?

Mateo Ruiz: Esa pregunta es exactamente la correcta, y hay respuesta parcial en el propio hilo, aunque viene de dentro de la empresa. El VP de I+D de Harmony escribió un comentario que vale la pena parafrasear: lo que le parece importante no es solo el número de autorresolución, sino la arquitectura de debajo.

Mateo Ruiz: El modelo nunca ejecuta acciones directamente; solo empareja peticiones con flujos preaprobados, y cada objeto al que referencia tiene que resolverse contra los datos reales de tu IdP o tu MDM, o la petición simplemente falla. Y añade: credenciales con ámbito limitado, reglas de elegibilidad, aprobación humana en acciones sensibles y rastro de auditoría completo.

Mateo Ruiz: Su conclusión: la inyección de prompt puede torcer la interpretación del modelo, pero no tiene dónde torcerla, porque no hay puerta abierta.

Clara Vega: Que, dicho por alguien de la propia empresa, hay que leer como descripción de diseño, no como verificación independiente. Pero es una descripción seria, y responde al menos en parte a la pregunta del modo de fallo: la uncertainty no se detecta en el modelo, se contiene en el perímetro.

Mateo Ruiz: Otro comentario interno también merece la pena: un desarrollador de Harmony contó que la parte más dura no fueron los agentes, sino la identidad. La persona que pide por Slack tiene que ser demostrablemente la misma que el usuario de Okta, el dueño del dispositivo en Jamf y el registro de HiBob, y su nombre está escrito de tres formas distintas en esos sistemas.

Mateo Ruiz: "Consigue eso y la parte del agente casi sale sola; consíguelo mal y has construido algo que resetea con confianza la contraseña de la persona equivocada."

Clara Vega: Esa frase debería ir en cualquier pitch de agentic AI, la verdad. Y la crítica externa también llegó: un comentarista argumentó que los equipos de tamaño medio ya usan el autoservicio de Okta o Google Workspace para contraseñas y accesos, que el triaje por chat nunca fue el cuello de botella, y que el problema real es el cumplimiento de auditoría, los puestos de SaaS huérfanos que nadie desaprovisiona y las jerarquías de aprobación enredadas.

Clara Vega: Su objeción concreta: un agente que autorresuelve accesos en herramientas de RRHH o Finanzas no tendrá la autoridad de aprobación verificada que un auditor necesita.

Mateo Ruiz: Es la crítica más sustancial de toda la discusión, y no es una crítica destructiva: señala que el problema puede estar mal definido, no mal resuelto. Si el dolor real es compliance y gobernanza más que velocidad, entonces las funciones estrella de un ITSM con IA son las de auditoría, no las de chat. A Harmony le conviene responder a eso, y no la vemos respondida en el material.

Clara Vega: Y ahora cerremos el círculo, porque todos estos agentes —los de Harmony, los de Humalike, los de Superhuman Go— necesitan modelos que costar menos para poder escalar. Y ahí es donde entra el tercer bloque grande: OpenAI ha ampliado la familia GPT-6 con dos modelos nuevos, Sol y Luna.

Mateo Ruiz: ¿Qué son? Modelos de la misma familia por debajo de Astra, entrenados de la misma manera pero afinados para velocidad y coste. Lo que prometen: precios de API un 50 por ciento más bajos que los equivalentes de GPT-5.6, mejoras en caché de prompts con un 90 por ciento de descuento en lecturas de caché, y rendimientos casi de nivel Astra en factualidad, código y uso de ordenador.

Clara Vega: Hay afirmaciones comparativas concretas en el material: Sol superaría a Claude Opus 5 en el Automation Bench con aproximadamente el 9 por ciento del coste por tarea, y igualaría a Claude Fable 5.1 en DeepSWE con un coste un 80 por ciento más bajo. Benchmark y precios citados por quien lanza; hay que tratarlo como afirmación de marketing hasta verlo contrastado, pero al menos son comparaciones específicas, no adjetivos.

Mateo Ruiz: También heredan, según el anuncio, las mejoras de alineamiento de Astra, incluidas menos afirmaciones engañosas sobre su propio trabajo de código. Es un detalle curioso: no solo "comete menos errores", sino "miente menos sobre lo que ha hecho". Eso dice mucho de en qué fallaban los modelos anteriores.

Clara Vega: ¿Para quién? Desarrolladores y equipos con cargas de trabajo de agentes de alto volumen o larga duración, que necesitan rendimiento de frontera sin coste de frontera. Está disponible en ChatGPT Work, en Codex y vía API.

Mateo Ruiz: Y las preguntas de la comunidad aquí son pocas pero afiladas. Una: ¿la caché de prompts de Sol y Luna funciona igual que la de Astra? Sin respuesta en lo que tenemos.

Mateo Ruiz: Y la otra es un comentario airado de un usuario que se queja de la degradación percibida de ChatGPT después del lanzamiento de Astra: dice que no puede cambiar el peso de la fuente en un único archivo HTML y CSS, que "el ChatGPT normal" se ha vuelto peor, y que los modelos "dicen que sí" incluso cuando algo está totalmente incorrecto.

Mateo Ruiz: Es una queja individual y muy subjetiva, pero toca dos nervios reales: la regresión de calidad percibida tras actualizar la gama, y el patrón de complacencia de los modelos.

Clara Vega: Y mira, ese comentario conecta con todo el episodio: si Cuey existe es precisamente porque los modelos dicen sí cuando no deberían. Si Harmony construye perímetros rígidos es porque el modelo puede equivocarse con confianza. Si Humalike promete que sus NPCs "deciden cuándo mentir" es porque el realismo de una IA es una moneda de dos caras. Todos estos productos existen por los mismos defectos que denuncian los usuarios.

Mateo Ruiz: Cerremos entonces con una vista de pájaro. En veinticuatro horas hemos visto: un teléfono que quiere que vuelvas a teclear, por 499 dólares y con Android 17 y cinco años de seguridad prometidos. Unos NPCs con memoria y relaciones, ya en producción en el mayor servidor de rol de Polonia, con precios desde 79 dólares al mes y las grandes preguntas de latencia y memoria por responder.

Clara Vega: Una extensión que coteja tu IA contra treinta y un modelos, y un asistente proactivo apoyado en diecisiete años de Grammarly, ambos luchando contra el mismo enemigo: el copiar y pegar entre pestañas. Un gestor de ventanas que quiere eliminar la terminal del tiling en macOS, gratis y sin desactivar nada. Una helpdesk donde la IA ejecuta, no solo anota, con un 60 por ciento de autorresolución autodeclarado y una crítica legítima sobre dónde está el dolor real de IT.

Clara Vega: Y dos modelos más baratos para que todo lo anterior pueda escalar.

Mateo Ruiz: Lo que nos llevamos: en casi todos los casos, la evidencia más sólida es la operación real o la especificación concreta, y las respuestas más interesantes —latencia de los NPCs, desempate de Cuey, sensibilidad de Superhuman Go, monitores externos de KiwiDesk, modo de fallo de Harmony, caché de Sol y Luna— siguen abiertas. Los fabricantes están a la vista y varios dijeron que estarían respondiendo todo el día; si el oyente quiere respuestas, los hilos siguen calientes.

Clara Vega: Eso es todo por hoy. Gracias por acompañarnos, soy Clara Vega.

Mateo Ruiz: Y yo Mateo Ruiz. Nos vemos en el próximo briefing, y mientras tanto: desconfiad de las respuestas demasiado seguras, vengan de un chatbot o de un NPC en Los Santos.

Clara Vega: Hasta la próxima.