
0923 | Agentes, modelos y herramientas: la IA de esta semana
Show notes
Hoy repasamos las novedades más recientes en IA: desde agentes de trabajo integrados hasta herramientas para Mac, nuevos modelos abiertos y pequeños trucos de productividad.
Línea de tiempo
- 00:00:04 Apertura
- 00:00:39 Agentes de IA como compañeros de trabajo
- 00:03:39 Modelos: abierto frente a API
- 00:05:01 Infraestructura, memoria y privacidad
- 00:08:10 Productividad en Mac y escritorio
- 00:10:29 Open-source, código y nuevos dispositivos
- 00:12:13 Seguridad, monitoreo y datos
- 00:13:51 Contenido, aprendizaje y creatividad
- 00:15:58 Voz, llamadas y comunidad
- 00:17:50 Cierre
Enlaces relacionados
- Fez
- Brev
- Plane Agents
- Anomalo
- MiMo-V2.6
- Grok 4.7
- 2BA.AI
- vgpu
- Valori
- SereneDB
- Prowler Cloud
- Diurnal
- Blurt
- Edyt
- Robot Voice Bridge
- QuietGlass
- Fulvid
- Googlebook
- Xem
- Pulsetic RUM
- thestory.run
- Keet
- VideoFlow Studio
- WZRD
- Hola AI
- gg-friggin-ez
- Freebuff Ads
Este episodio es producido por Bri. Bri usa tecnología avanzada de IA para convertir los feeds que te importan en podcasts pensados para escuchar. Puedes escribirnos a hi@bri.so.
Transcript
Clara Vega: ¡Hola y bienvenidos a otro episodio! Yo soy Clara Vega.
Mateo Ruiz: Y yo Mateo Ruiz. Hoy tenemos una lista de lanzamientos bastante variada, pero hay un hilo que los conecta casi todos: la inteligencia artificial está pasando de ser una función a ser un actor con nombre propio, casi un compañero de trabajo con agenda, memoria y decisiones propias.
Clara Vega: Exacto. Y como siempre, vamos a intentar no quedarnos solo en el titular. Queremos entender para quién es cada cosa, qué problema resuelve de verdad y qué preguntas quedan abiertas, porque mucho de lo que leemos hoy son descripciones de sus propios creadores, y eso hay que tomarlo como afirmaciones, no como resultados verificados.
Mateo Ruiz: Vamos a empezar justamente por el grupo más llamativo: los agentes de IA como compañeros de trabajo.
Clara Vega: Sí, y aquí hay cuatro productos que atacan la misma idea desde ángulos distintos. El primero es Fez, una app de Mac donde los agentes son miembros de salas de chat, como si fueran personas más del equipo. Lo interesante es que tienen un modelo llamado Jev que enruta y decide, es decir, que el sistema elige qué agente hace qué. Está construido sobre nostr, que es un protocolo abierto, y el código es MIT.
Mateo Ruiz: Esa combinación es curiosa. Que sea MIT y esté sobre nostr significa que la infraestructura no depende de un servidor central propietario, al menos en teoría. Otra cosa es que el modelo Jev tome buenas decisiones. Eso es precisamente lo que habría que ver en la práctica.
Clara Vega: La pregunta abierta con Fez es hasta dónde llega esa autonomía. ¿Los agentes solo responden cuando les hablas, o inician trabajo por su cuenta? La fuente no lo detalla, así que queda en el aire.
Mateo Ruiz: En el otro extremo de esa misma idea está Brev, que se presenta como un compañero de IA dentro de Slack o Teams. Su trabajo: seguir objetivos, preparar reuniones y hacer seguimiento. Dice tener más de 50 integraciones.
Clara Vega: Y aquí el contraste con Fez es claro. Fez apuesta por un entorno propio, salas de chat con agentes nativos. Brev va a donde tú ya estás, a tu Slack de siempre. Para alguien que no quiere instalar otra herramienta, Brev tiene sentido. Pero cuidado con el número de integraciones: "más de 50" es una cifra de marketing hasta que alguien la usa en su propio flujo.
Mateo Ruiz: Sí, y el seguimiento de objetivos es una de esas promesas que suenan bien pero dependen mucho de la calidad de los datos que el agente pueda ver. Si tu equipo no registra cosas en el sistema, el agente no tiene nada que seguir.
Clara Vega: Después está Plane Agents, que añade agentes como miembros del workspace con playbooks, habilidades y disparadores. El detalle que más destaca es que no cuestan un asiento extra.
Mateo Ruiz: Ese último punto es de facto una decisión de negocio importante. Tradicionalmente los productos de gestión cobran por persona, y meter agentes con precio de asiento encarecería el uso. Si no cobran asiento, el modelo tiene que estar en el plan base o en el consumo. La fuente no lo explica, así que eso es otra cosa a vigilar.
Clara Vega: Y los playbooks son interesantes: es una forma de decir que los agentes no improvisan, sino que siguen procedimientos definidos. Eso responde un poco a la pregunta de autonomía que planteábamos con Fez. Aquí la autonomía está acotada por el playbook y activada por triggers.
Mateo Ruiz: Que, para muchos equipos, probablemente sea el punto dulce. Autonomía con rieles.
Clara Vega: Y el cuarto del grupo es Anomalo Analyst, que baja al warehouse de datos. Son agentes que monitorizan los datos y explican tendencias y anomalías en lenguaje llano.
Mateo Ruiz: Este es distinto de los tres anteriores. Fez, Brev y Plane trabajan con personas y tareas; Anomalo trabaja con datos. Pero comparten el patrón: el agente no solo detecta, también explica. Y esa explicación en lenguaje natural es lo que le ahorra tiempo a un analista.
Clara Vega: Ahora bien, ¿qué pasa cuando la explicación del agente está mal? Eso no lo sabemos. La afirmación de que explica bien es del fabricante. Y en datos, un falso diagnóstico es más peligroso que en un chat.
Mateo Ruiz: Bien, conectemos esto con lo que sostiene a todos estos agentes: los modelos. Y ahí acaba de moverse el tablero en dos direcciones opuestas.
Clara Vega: Por un lado, Xiaomi ha lanzado MiMo-V2.6, modelos omnimodales abiertos en versiones Pro y Flash, con un millón de tokens de contexto. Y lo relevante no es solo el contexto: liberan los pesos y también el código de entrenamiento con aprendizaje por refuerzo.
Mateo Ruiz: Eso último es lo que marca la diferencia. Que el código RL sea público permite a terceros reproducir o extender el entrenamiento, no solo ejecutar el modelo. Ahora, "omnimodal abierto" hay que comprobarlo con benchmarks independientes, porque Xiaomi hace sus propias afirmaciones de calidad.
Clara Vega: Y por el otro lado, xAI responde con Grok 4.7, orientado a código y trabajo de larga duración, con precios de dos dólares por millón de tokens de entrada y seis por millón de salida. Está disponible en Cursor, en Grok Build y por API.
Mateo Ruiz: Aquí la comparación es casi de libro: abierto contra API de pago. Si eres desarrollador y quieres control total, MiMo te da los pesos. Si quieres un modelo listo para producción con soporte en tus herramientas, Grok 4.7 va directo a Cursor. Lo que todavía no existe, o al menos no lo tenemos nosotros, es una comparación independiente de calidad entre ambos.
Clara Vega: Exacto, y no queremos inventar un ganador. Lo que sí podemos decir es que las dos rutas están vivas y avanzando a la vez, lo cual no era evidente hace un tiempo.
Mateo Ruiz: Y ambos modelos necesitan algo por debajo para funcionar: infraestructura. Ese es nuestro siguiente bloque.
Clara Vega: Empecemos por 2BA.AI, que es una idea muy directa: IA alojada en la Unión Europea, a veinte euros al mes por cuatro mil quinientas peticiones en una ventana de cinco horas, sin registros de logs y compatible con la API de OpenAI.
Mateo Ruiz: Tres cosas venden aquí. Primero, la jurisdicción europea, que para empresas con requisitos de cumplimiento pesa. Segundo, el cero logs, que es una afirmación fuerte de privacidad. Y tercero, la compatibilidad con OpenAI, que significa que no tienes que reescribir tu código para migrar.
Clara Vega: La compatibilidad es clave, porque cambia el coste real de cambiar de proveedor a casi cero. Ahora bien, "sin logs" debería verificarse en una auditoría; es el tipo de afirmación que uno quiere por escrito.
Mateo Ruiz: La siguiente pieza es del otro extremo del stack: vgpu, de Vercel. Es una librería TypeScript de WebGPU pensada para agentes, con shaders WGSL tipados. Funciona en navegador, en Node sin interfaz gráfica y en CI, y ocupa veinticinco kilobytes.
Clara Vega: Lo interesante es el caso de uso. No es para renderizar videojuegos, es para que los agentes hagan cómputo en GPU donde estén: en el navegador del usuario, en un servidor headless o en un pipeline de CI. Que los shaders estén tipados reduce el riesgo de errores en tiempo de ejecución, y veinticinco KB es un tamaño muy contenido para una librería.
Mateo Ruiz: Y el tercer pilar es la memoria, con Valori. Es una capa de memoria para IA que combina vectores y grafos, con un estado determinístico en formato Q16.16 y verificación de integridad con BLAKE3. Tiene SDKs en Python y TypeScript.
Clara Vega: Desglosemos eso un poco, porque suena a jerga pero importa. Vectores y grafos: búsqueda semántica más relaciones estructuradas. Estado determinístico: que la misma entrada produce el mismo estado, lo cual es esencial si quieres reproducir lo que un agente hizo. Y BLAKE3 es una función de hash rápida y moderna, así que puedes verificar que la memoria no se ha corrompido ni alterado.
Mateo Ruiz: En conjunto, este bloque responde a la pregunta del episodio: los agentes que vimos al principio necesitan exactamente esto para funcionar de forma fiable. Un modelo, cómputo y memoria verificable. Si juntas 2BA, vgpu y Valori, tienes el esqueleto de un agente serio.
Clara Vega: Sí, y de hecho hay otras dos piezas del ecosistema que encajan aquí aunque no sean infraestructura pura. SereneDB es un motor open-source compatible con Postgres y Elastic que promete búsquedas de texto completo y analítica rápidas, con benchmarks líderes según sus propios creadores.
Mateo Ruiz: Que insisto: "promete" es la palabra. Benchmarks propios, hay que contrastarlos. Pero la compatibilidad doble es lo diferenciador: te cubre el caso de búsqueda como Elastic y el caso de base de datos relacional como Postgres.
Clara Vega: Y Prowler Cloud, que es seguridad cloud open-source para AWS, Azure, GCP y Kubernetes, con checks determinísticos más IA agéntica y MCP, y más de cuarenta y cinco millones de descargas. La combinación de checks determinísticos con IA es significativa: las cosas críticas de cumplimiento se evalúan con reglas fijas, y la IA se añade como capa de análisis, no como única fuente de verdad.
Mateo Ruiz: Ese diseño es el que muchos preferimos ver en seguridad. La IA sugiere, las reglas deciden.
Clara Vega: Bien, bajemos ahora del datacenter al escritorio. Con toda esta conversación de agentes remotos, hay todo un movimiento de apps para Mac que hacen la vida diaria más fluida.
Mateo Ruiz: Empecemos por Diurnal, que es una app de Mac para capturar tareas en Google Calendar con dos atajos de teclado, opción-comando-K y opción-comando-L. Funciona offline y está pensada para la planificación semanal.
Clara Vega: Lo que me gusta de Diurnal es que no inventa un sistema nuevo. Usas Google Calendar, que ya tienes, y lo que añade es la fricción cero: dos atajos y la tarea está en el calendario. Y el offline es importante para quien viaja o trabaja sin conexión.
Mateo Ruiz: Siguiente: Blurt, una app de Mac open-source de dictado push-to-talk que usa la Dictation API de AssemblyAI. El texto aparece donde estás escribiendo, en la app que sea.
Clara Vega: El push-to-talk es un buen diseño: pulsas, hablas, sueltas. Y que inserte el texto en el cursor de cualquier app es lo que lo hace útil, porque el dictado solo es valioso si entra donde trabajas. Que sea open-source permite auditar qué se envía, cosa relevante cuando hablas a un micrófono.
Mateo Ruiz: Y la tercera es Edyt, que lleva IA a cualquier app de Mac y Windows. Con un atajo reescribe o traduce en el propio cursor, y además lee pantallas y PDFs. Tiene un plan gratis de unas ciento treinta ediciones al día.
Clara Vega: Edyt es el mismo patrón que Blurt pero con edición en lugar de dictado: la IA va al contexto de tu trabajo en vez de pedirte que copies y pegues a un chat. El límite diario del plan gratuito es concreto, lo cual es de agradecer frente a los "free" vagos. Y leer PDFs en el contexto de la app que estés usando evita todo el baile de ventanas.
Mateo Ruiz: La cuarta es más nicho pero muy concreta: Robot Voice Bridge, para ElevenLabs. Gestiona tomas de voz con etiquetas e IPA, el alfabeto fonético, y las envía al playhead en Pro Tools o Logic. Doce dólares al mes.
Clara Vega: Doce dólares al mes por algo que si haces producción de voz te ahorra trabajo manual repetitivo es una ecuación razonable, si el flujo funciona bien en tu DAW. Que se integra con Pro Tools y Logic delimita muy bien su público: productores de audio y locución.
Mateo Ruiz: Y hay una quinta app Mac que merece mención: QuietGlass, gratuita y open-source, que desenfoca la pantalla automáticamente cuando te alejas la mirada, detectado con los AirPods, o cuando detecta una cara cercana.
Clara Vega: Ese es un problema de privacidad real en cafés y oficinas abiertas, y la solución es elegante: no tiene que bloquear nada, solo difuminar. Que use los sensores de los AirPods para saber que ya no miras es un truco inteligente.
Mateo Ruiz: Y siguiendo la veta del software open-source y bien pensado, pasamos al siguiente grupo: open-source, código y hasta hardware nuevo.
Clara Vega: Empecemos por Fulvid, un editor de Markdown y MDX open-source de escritorio. La filosofía: los archivos viven en el disco, sin vault ni nube. Está para Linux, Windows y macOS.
Mateo Ruiz: "Sin vault" es una referencia directa a cómo funcionan otros editores de notas, que te encierran en una estructura de carpetas propia. Fulvid dice: escribe archivos Markdown donde quieras, son tuyos. Para quien quiere portabilidad total, eso es el argumento de venta entero.
Clara Vega: Y en el otro extremo del espectro, Googlebook: un portátil diseñado para Gemini que se sincroniza con teléfonos Android, desde ochocientos noventa y nueve dólares, con preventas abiertas.
Mateo Ruiz: Es la misma jugada que hemos visto antes en el mercado de portátiles con IA integrada: el hardware se diseña alrededor del asistente. La pregunta que siempre hago con estos equipos es qué aporta el hardware frente a usar Gemini en cualquier navegador. La sincronización profunda con Android es la respuesta propuesta; habrá que ver si eso justifica la compra frente a un portátil normal.
Clara Vega: El precio de partida, ochocientos noventa y nueve, lo coloca en el rango de entrada-medio, así que no es una compra impulsiva sino pensada.
Mateo Ruiz: Y el tercero de este bloque es Xem, email marketing open-source con editor visual, automatizaciones, más de doscientas plantillas, y envío por tu cuenta vía Amazon SES o SMTP.
Clara Vega: Aquí el modelo es "el software es libre, la infraestructura la pagas tú". Con SES los costes de envío a volumen suelen ser muy bajos comparados con las suscripciones de las plataformas SaaS. El contrapeso es que tú asumes la entregabilidad y la configuración; no hay un equipo de soporte cuidando tu reputación de remitente.
Mateo Ruiz: Que, para equipos técnicos, suele ser una transacción aceptable.
Clara Vega: Y de la nube al monitoreo y los datos, que es donde encajan las dos piezas que ya adelantamos más SereneDB y Prowler. Vamos a darles su espacio propio.
Mateo Ruiz: Prowler Cloud, entonces: seguridad open-source para las tres grandes nubes más Kubernetes, con esa arquitectura de checks determinísticos más IA agéntica y MCP. Cuarenta y cinco millones de descargas es la cifra que cita su comunidad, y es una cifra de adopción, no de calidad, pero sí dice algo: hay mucha gente usándolo.
Clara Vega: De acuerdo, y quiero subrayar algo que decíamos antes: no usamos cifras de popularidad como prueba de que un producto es bueno. Pero sí como indicio de que hay comunidad, documentación y casos de uso acumulados, lo que reduce el riesgo de adoptarlo.
Mateo Ruiz: Pulsetic RUM es la segunda pieza: añaden a su monitoreo de uptime las Core Web Vitals de visitantes reales, y seguimiento de errores por página y por país.
Clara Vega: La diferencia entre datos de laboratorio y datos de usuarios reales es esencial aquí. Las Core Web Vitals medidas en síntesis te dicen cómo renderiza tu página en una máquina limpia; el RUM te dice lo que sufren tus visitantes reales con sus conexiones y dispositivos. Cruzar eso con el uptime y con errores por país te da una imagen operativa bastante completa.
Mateo Ruiz: Y SereneDB ya lo mencionamos por encima, pero merece su lugar: motor open-source, compatible con Postgres y Elastic, que promete búsquedas de texto completo y analítica rápidas con benchmarks de cabeza.
Clara Vega: Lo que es notable es la apuesta de compatibilidad. Migrar de Elastic es históricamente doloroso; si SereneDB真的 puede leer tu carga de trabajo sin reescribir la aplicación, ese es el argumento. La validación pendiente son los benchmarks independientes y la compatibilidad real, no solo en el papel.
Mateo Ruiz: Y las mismas herramientas que hemos visto para desarrolladores y equipos llegan también al usuario final. Vamos al bloque de contenido, aprendizaje y creatividad.
Clara Vega: Primero, thestory.run, que es un coach de escritura para posts de LinkedIn. El giro interesante: el coach te entrevista y tú escribes. No escribe por ti.
Mateo Ruiz: Ese detalle cambia todo el producto. La mayoría de herramientas de escritura con IA generan el texto y tú lo editas, con el riesgo de que todo suene genérico. Aquí el coach hace preguntas para extraer lo que tú sabes, y el resultado es tu voz. Gratis hasta cinco personas, lo que sugiere un enfoque de equipos pequeños o uso individual.
Clara Vega: Segundo, Keet, una app de iOS salida de Y Combinator que genera cursos en vídeo estilo Duolingo sobre cualquier tema. Dos cursos gratis y después créditos de pago.
Mateo Ruiz: "Cualquier tema" es una promesa amplia, y la calidad dependerá del modelo que genere el contenido. El formato Duolingo, lecciones cortas con ritmo, está probado para la retención, pero el contenido generado automáticamente puede tener errores fácticos que en un curso humano un editor corregiría. Con dos cursos gratis, el coste de probarlo es bajo, así que el modelo de negocio te deja verificar antes de pagar.
Clara Vega: Tercero, VideoFlow Studio: una herramienta que se ejecuta con npx, y mediante un agente de código convierte la URL de tu sitio en un vídeo de lanzamiento editable.
Mateo Ruiz: Esto es un caso de uso muy concreto: el vídeo de lanzamiento. Normalmente necesitas un diseñador o horas de edición; aquí el agente navega tu sitio y monta un vídeo que luego editas. Que sea editable es lo importante, porque el primer corte automático nunca es el definitivo. Y que corra vía npx significa que no instala nada permanente.
Clara Vega: Y cuarto, WZRD, que convierte documentos, diapositivas, formularios y hojas de cálculo en experiencias conversacionales con las que los usuarios pueden hablar.
Mateo Ruiz: Este es básicamente "chat con tu documentación". El caso de uso clásico es un onboarding o un manual que nadie lee. Si funciona bien la extracción, el usuario pregunta y responde con lo que el documento contiene. La limitación obvia: si el documento tiene huecos, el asistente los heredará, y ahí hay que ver cómo maneja lo que no sabe.
Clara Vega: Y de contenidos hablando, queda un último terreno: las llamadas, la voz y la comunidad.
Mateo Ruiz: Hola AI primero. Responde llamadas con un buzón de voz de IA, filtra el spam y te envía resúmenes. Cuatro dólares con noventa y nueve al mes los primeros seis meses.
Clara Vega: El precio con descuento inicial sugiere que después sube; la fuente no dice cuánto, así que ojo con el coste a largo plazo. Pero el problema que ataca es universal: llamadas de spam que interrumpen. Que la IA conteste, filtre y te resuma es el flujo lógico, y el resumen te permite decidir si devolver la llamada.
Mateo Ruiz: Y aquí conectamos con lo que vimos de los agentes: Hola AI es básicamente un agente autónomo atendiendo tu teléfono. Lo cual nos lleva a la pregunta de siempre: ¿confías en que filtre bien? Un falso positivo, que bloquee una llamada importante, es el riesgo inherente.
Clara Vega: Siguiendo en el terreno de la voz, gg-friggin-ez es un screener gratuito para Node.js que detecta profanidad y toxicidad, funcionando vía Jev y Laya, con soporte multilingüe y conciencia de evasión.
Mateo Ruiz: "Conciencia de evasión" es la parte técnicamente difícil. Detectar una palabrota es trivial; detectar "p3ndej0" con números y símbolos, o insultos que dependen del contexto, es lo que separa un filtro de juguete de uno utilizable. Que sea gratuito y una librería de Node lo hace accesible para moderar chats y comunidades.
Clara Vega: Y el último es el más polémico del día: Freebuff Ads, que mete publicidad dentro de agentes de código, llegando supuestamente a quinientos mil desarrolladores, con pago por clic y una oferta de quinientos dólares de crédito.
Mateo Ruiz: Este genera debate por una razón obvia: estamos acostumbrados a anuncios en contenidos, no dentro de la herramienta con la que trabajamos. Un desarrollador pidiendo ayuda a su agente de código y viendo un anuncio patrocinado en medio es un cambio de contrato implícito. Quinientos mil desarrolladores es la cifra del fabricante, no verificada. Y el modelo de pago por clic incentiva la exposición, no la pertinencia.
Clara Vega: Y quiero cerrar, como prometimos al principio, con las dudas que quedan abiertas, proyecto por proyecto, sin pretender resolverlas.
Mateo Ruiz: Vamos allá. Fez: ¿los agentes en salas de chat toman iniciativas propias o solo responden? El enrutado con Jev suena bien, pero la calidad de esas decisiones es lo único que importa y no la conocemos.
Clara Vega: Brev: cincuenta integraciones por verificar, y la pregunta de fondo, ¿un agente que "sigue objetivos" es fiable cuando los objetivos cambian a mitad de semana?
Mateo Ruiz: Plane Agents: sin coste de asiento extra es atractivo, pero alguien paga por el cómputo de esos agentes. El modelo económico no está explicado.
Clara Vega: Anomalo Analyst: ¿qué pasa cuando la explicación en lenguaje llano está mal? En datos, un error comunicado con seguridad es peor que un error silencioso.
Mateo Ruiz: MiMo-V2.6 y Grok 4.7: falta la comparación independiente. Abierto contra API de pago es la decisión real que tienen que tomar los equipos.
Clara Vega: 2BA.AI: "sin logs" hay que pedirlo por escrito y con auditoría. vgpu y Valori: young, habrá que ver adopción y madurez. Valori en particular apuesta por diseño determinístico, que es lo correcto, pero exige que el ecosistema lo valore.
Mateo Ruiz: En escritorio, Diurnal, Blurt, Edyt y QuietGlass son apuestas de bajo riesgo con casos de uso claros; Robot Voice Bridge depende de que el flujo con Pro Tools y Logic sea sólido en tu configuración concreta.
Clara Vega: Fulvid y Xem apuestan por tus archivos y tu infraestructura, que es la opción con más control y más trabajo. Googlebook: ¿qué aporta el hardware específico para Gemini frente a un portátil normal? Por responder.
Mateo Ruiz: Prowler, Pulsetic y SereneDB: benchmarks propios por contrastar, y en SereneDB la compatibilidad real con Elastic es la prueba de fuego.
Clara Vega: thestory.run, Keet, VideoFlow y WZRD: todos dependen de la calidad de generación, y en Keet hay el riesgo añadido de errores fácticos en contenido educativo.
Mateo Ruiz: Y Hola AI, gg-friggin-ez y Freebuff Ads: la confianza en el filtro, la evasión real frente a la prometida, y la pregunta incómoda de si queremos anuncios dentro de nuestras herramientas de trabajo.
Clara Vega: Eso es todo por hoy. Gracias por acompañarnos, soy Clara Vega.
Mateo Ruiz: Y yo Mateo Ruiz. Nos vemos en el próximo episodio.