
0821 | Grok 4.6, NobodyWho, Checksum AI y ProtoNote: novedades de IA
Show notes
Episodio repleto de lanzamientos y herramientas nuevas. xAI presenta Grok 4.6 con razonamiento continuo para agentes de larga duración y tarifas sin cambios; NobodyWho ejecuta modelos de lenguaje 100 % en el dispositivo sin claves de API en seis frameworks; Checksum AI genera, ejecuta y auto-repara pruebas de Playwright en cada pull request; y bitdrift AI destaca como el lanzamiento central, una plataforma de observabilidad móvil agéntica que consulta el comportamiento de los usuarios en vivo si
Línea de tiempo
- 00:00:00 Apertura
- 00:00:37 Grok 4.6 y el razonamiento continuo en agentes
- 00:02:18 NobodyWho: modelos locales sin API en seis frameworks
- 00:03:57 Checksum AI: pruebas de Playwright que se auto-reparan
- 00:05:28 bitdrift AI: observabilidad móvil agéntica
- 00:06:47 ProtoNote: comentar prototipos con notas clavadas
- 00:08:01 Aloud: de comentarios hablados a tareas de código
- 00:09:28 MeetStream AI: un agente con asiento en la reunión
- 00:10:43 HyNote for Mac: notas de reuniones privadas
- 00:11:15 Hermai Brand API: marca blanca por dominio
- 00:12:43 Lifelong: salud familiar con Alo AI
Enlaces relacionados
- Grok 4.6 - Bri Product Hunt
- NobodyWho - Bri Product Hunt
- Checksum AI - Bri Product Hunt
- bitdrift.ai - Bri Product Hunt
- ProtoNote - Bri Product Hunt
- Aloud - Bri Product Hunt
- MeetStream AI - Bri Product Hunt
- HyNote for Mac - Bri Product Hunt
- Hermai Brand API - Bri Product Hunt
- Lifelong - Bri Product Hunt
Este episodio es producido por Bri. Bri usa tecnología avanzada de IA para convertir los feeds que te importan en podcasts pensados para escuchar. Puedes escribirnos a hi@bri.so.
Transcript
Clara Vega: Bienvenidos a Product Hunt diario, en Bri Radio. Yo soy Clara Vega.
Mateo Ruiz: Y yo soy Mateo Ruiz. Hoy hablamos del anuncio de Grok 4.6 por parte de xAI, enfocado en agentes de larga duración, y del motor de inferencia NobodyWho, que corre modelos de lenguaje completamente en local.
Clara Vega: También repasamos Checksum AI, una plataforma de pruebas continuas para equipos que entregan código cada vez más rápido, y la visibilidad móvil agéntica de bitdrift AI.
Mateo Ruiz: Y como siempre, cerramos con las novedades de la comunidad: comentarios hablados sobre aplicaciones, prototipos con IA y más. Comenzamos.
Clara Vega: El 12 de agosto de 2026, xAI anunció Grok 4.6, un modelo que la compañía orienta a agentes de larga duración y a trabajo interactivo y visual más ambicioso. Según xAI, mantiene tareas complejas a lo largo de muchos pasos, investiga dominios poco familiares y, en trayectorias largas, empieza a autocomprobar y verificar su propio trabajo antes de continuar, refinando los resultados tras varias rondas de comentarios. La empresa también dice que produce primeros pases más sólidos en proyectos visuales e interactivos, definiendo estructura y lenguaje visual en una sola pasada. En el índice de inteligencia de Artificial Analysis, que combina nueve benchmarks, Grok 4.6 obtiene 61 puntos y la página afirma que iguala a GPT-5.6 Sol; en esa misma tabla, Fable 5 Max lidera con 62 y Grok 4.5 High queda en 56.
Mateo Ruiz: La tabla también muestra una separación interesante según la tarea. Grok 4.6 supera a GPT-5.6 Sol Max en GDPVal-AA v2, con mil setecientos cincuenta y tres frente a mil setecientos veintiocho, pero queda por detrás en DeepSWE v1.1, con un sesenta y cinco coma nueve por ciento frente al setenta y tres por ciento, y en Terminal-Bench v3.0, con un veintiséis por ciento frente al treinta y cuatro coma seis. Y conviene recordar que xAI aclara que las cifras de los competidores provienen de system cards o leaderboards publicados por sus propios desarrolladores.
Clara Vega: En cuanto a disponibilidad, Grok 4.6 salió ese mismo día en Cursor y en Grok Build, además de la API y socios como OpenRouter, Vercel y Cloudflare. El precio anunciado es de dos dólares por millón de tokens de entrada.
Clara Vega: Cambiando de tema, NobodyWho es un motor de inferencia construido sobre llama.cpp para ejecutar modelos de lenguaje grandes completamente en el dispositivo; la página lo presenta como open-source y gratuito, sin claves de API, cargos ocultos ni llamadas a la nube. Soporta Swift, Kotlin, Flutter, React Native, Python y Godot. Entre sus funciones declaradas están las llamadas a herramientas con tipos seguros que generan automáticamente la gramática a partir de la firma de la función para evitar JSON malformado, la entrada multimodal de imagen y audio, texto a voz con backends como Kokoro o Pocket TTS, voz a texto con Whisper y aceleración por GPU vía Vulkan o Metal. Además, dice ser compatible con miles de modelos preentrenados en formato GGUF, incluidos Gemma, Qwen, Mistral y LFM.
Mateo Ruiz: Un detalle que llama la atención es su afirmación sobre el contexto: usa un cambio de contexto preventivo que, según consta, conserva el historial completo sin límites de longitud de mensaje. Tiene aplicaciones demo para iOS, Android, Apple Watch y Vision Pro. En GitHub, el repositorio muestra alrededor de mil estrellas, setenta y cinco forks y mil novecientos ochenta y siete commits, con licencia EUPL-1.2, y la versión Kotlin publicada es la dos punto cero para Android y JVM de escritorio.
Clara Vega: Pierre, de NobodyWho, sostiene que pasaron meses haciendo que la inferencia local fuera lista para producción en seis plataformas y no solo una demo, pero esa afirmación no está verificada de forma independiente. En los comentarios, un usuario preguntó cómo sería la primera inferencia en un Mac de gama media con Qwen 1.5B y si esto está listo para uso diario, una duda abierta que el motor todavía no responde por completo.
Mateo Ruiz: Checksum AI, por su parte, es una plataforma de pruebas continuas basada en IA para equipos que entregan código más rápido de lo que el control de calidad manual puede cubrir. Su consejero delegado, Gal, afirma que genera, ejecuta y auto-repara pruebas de extremo a extremo y de API en cada pull request, entregándolas como código Playwright estándar en el repositorio del equipo, sin formato propietario ni bloqueo. El proceso declarado tiene dos fases: un agente detecta qué cambió y genera o actualiza las pruebas, mientras otro clasifica los fallos como bug real o prueba obsoleta, envía los bugs reales a Jira, Linear o Slack y corrige las pruebas obsoletas de forma autónoma.
Clara Vega: La tesis de fondo que plantea Gal es que las herramientas de codificación con IA resolvieron la generación de código, pero no la verificación, y por eso Checksum se enfoca ahí. En los testimonios de clientes, que son afirmaciones del fabricante, Counterpart declara operar un equipo de control de calidad diez veces mayor por menos de la mitad del costo de un desarrollador offshore y no haber tenido interrupciones de producción; su gerente de ingeniería, Ron Alexssen, dijo que por menos de la mitad del salario de un desarrollador offshore tiene el impacto de un equipo de control de calidad completo. Söderberg & Partners, por su lado, pasó de cero cobertura a cobertura completa en semanas y recupera noventa horas mensuales de pruebas manuales.
Mateo Ruiz: Y Postilize declara un setenta por ciento menos de bugs, ciclos de ingeniería un treinta por ciento más rápidos y cero pruebas inestables. En la discusión, un empleado de Checksum, con la advertencia de que trabaja allí, describió cómo funciona el sistema por dentro.
Clara Vega: Para cerrar, bitdrift AI fue el lanzamiento central del informe. bitdrift lo presenta como la primera plataforma del mundo de observabilidad móvil agéntica: según su cofundador y consejero delegado, Pete, es un sistema de observabilidad en tiempo real y de fidelidad completa que permite a agentes de inteligencia artificial consultar el comportamiento de los usuarios móviles y actuar sobre él de forma autónoma. Está construido sobre la API pública de bitdrift y lo que llaman habilidades bd.
Mateo Ruiz: La diferencia que plantea la compañía es frente a las herramientas que dependen de datos muy muestreados y desactualizados: bitdrift observa el cien por ciento de los dispositivos y usuarios, sin muestreo, y su plano de control puede añadir instrumentación a toda la flota al instante, sin esperar a una nueva versión de la aplicación ni a la aprobación de la App Store. La propia web reporta más de cincuenta y dos millones de flujos concurrentes, más de mil millones de instalaciones y cumplimiento de SOC 2 Tipo II.
Clara Vega: En cuanto a resultados, los primeros usuarios citados por la empresa hablan de investigaciones más rápidas y de una mejora de diez veces en el tiempo medio de resolución de incidencias. En la discusión comunitaria, un equipo pequeño que migró desde Firebase y usa bitdrift desde enero describe la integración como fluida, con sobrecarga de rendimiento mínima y sin aumentar sus costes, y otro comentarista valora poder conocer la historia completa de un fallo en lugar de adivinar tras un informe de caída.
Mateo Ruiz: ProtoNote quiere resolver algo muy concreto: compartir un prototipo hecho con IA y que los demás comenten justo donde ocurre el problema. Se sube un HTML, una imagen o un PDF y el sistema genera un enlace; quien lo recibe deja una nota clavada en el punto exacto de la página, sin crearse una cuenta, solo con un nombre.
Clara Vega: Hmm y lo interesante es que varios archivos subidos juntos pasan a ser páginas de un mismo proyecto. Eso me recuerda al conector con Claude: según el creador, le dices "haz de esto un ProtoNote" y el enlace compartible vuelve en el propio chat, sin descargar nada.
Mateo Ruiz: Eso es una afirmación del creador, no algo verificado de forma independiente. Igual que la idea de devolver las notas a Claude para que aplique los cambios y publique la nueva versión sola. El producto además se presenta como privado por defecto: solo lo ve quien tiene el enlace. En el plan gratuito tienes tres prototipos activos con revisores y notas ilimitados, y el de pago cuesta diez dólares al mes con prototipos ilimitados, carpetas, historial de versiones y saber quién vio el prototipo y cuándo.
Clara Vega: Y el creador dice haberlo construido en solitario, identificado por un comentarista como Zach Friesen. Cuenta que antes su flujo era descargar el HTML, dejarlo en Slack y esperar, sin forma de comentar en el navegador, y recibir respuestas vagas o capturas con un círculo rojo.
Mateo Ruiz: Aloud es otra vuelta al mismo problema, pero desde el lado opuesto: en vez de comentar el prototipo de otro, convierte tus propios comentarios hablados sobre una aplicación en tareas listas para un agente de código. Es de Wojciech Dobry y funciona en macOS: graba voz, pantalla y transcripción en vivo mientras hablas de tu build.
Clara Vega: La clave está en lo que hace la limpieza con una sola pulsación: reescribe la transcripción para reflejar lo que quisiste decir, se queda solo con las decisiones que mantuviste y te hace una pregunta a la vez sobre pasajes ambiguos, anclada a la línea y con una respuesta recomendada y una alternativa. Además extrae las capturas a las que apuntabas, las recorta y las subtitula.
Mateo Ruiz: De ahí arma tareas pensadas para un agente en un worktree, dirigidas a Claude Code, Cursor o Codex, y puedes copiar una o exportar la sesión como un único archivo HTML autocontenido. Lo que me convence es la privacidad: la transcripción usa Whisper en el dispositivo, el audio y el vídeo nunca salen del Mac, y solo sale el texto, y únicamente cuando pides la limpieza. Aunque el sitio muestra "First build is coming", así que todavía no está confirmado que exista un build disponible para descargar.
Clara Vega: En la comunidad, un usuario que dice trabajar a diario con agentes de código afirmó que el cuello de botella ya no es el código sino el brief, y que Aloud evita escribir en cinco minutos lo que se dice en diez segundos. Otro comentarista valoró el poder señalar en pantalla para no tener que describir dónde está cada elemento.
Mateo Ruiz: MeetStream AI no grabó y resume después: según sus cofundadores, el agente participa en la reunión en vivo. Es una API única que captura más de cincuenta puntos de datos en tiempo real de Zoom, Google Meet y Teams, desde audio y vídeo por participante hasta transcripciones con atribución de hablante y el ciclo completo de la reunión mediante webhooks.
Clara Vega: La capa de voz es lo que cambia la foto: el agente se une como participante con permisos acotados, escucha, habla y ejecuta herramientas a mitad de llamada, por ejemplo actualizando un CRM mientras el cliente sigue hablando. Sin eso, el CTO explica que la mayoría de las configuraciones combinan tres proveedores: una API de bot para entrar en la sala, una plataforma de voz externa y un widget que los une.
Mateo Ruiz: Con los MeetStream Infrastructure Agents, la orquestación vive en la misma plataforma que ocupa el asiento, con una única superficie de integración y sin pile de licencias separada. La transcripción, el lenguaje y la voz son intercambiables con proveedores como Deepgram, AssemblyAI, OpenAI, Gemini, ElevenLabs y Sarvam. Y el agente puede operar en modo pipeline con la palabra de activación Hey MIA, o en modo tiempo real donde decide por sí mismo cuándo hablar, y puede llamar a herramientas MCP a mitad de la reunión y reportar el resultado por voz.
Mateo Ruiz: HyNote for Mac ataca los tres dolores que le atribuye al software de reuniones: privacidad, fricción y costo. La propuesta es transcripción local gratuita y cien por ciento privada, con el reconocimiento de voz corriendo íntegramente en el dispositivo para que las conversaciones confidenciales nunca salgan del hardware.
Clara Vega: Y funciona sin meter un bot incómodo en la lista de asistentes: captura el audio del sistema directamente, a través de Zoom, Google Meet y Microsoft Teams. Eso lo distingue de los asistentes que se unen como participante visible, algo que a mucha gente le genera rechazo en reuniones con clientes.
Clara Vega: Hermai ha presentado en Product Hunt una API pensada justo para el problema que aparece cuando un SaaS B2B empieza a vender a más de una empresa: la marca blanca. Cuando un cliente se registra con un correo de trabajo o un dominio, la llamada POST a su ruta de retorno de marca lee solo el dominio y devuelve el logotipo, los colores, la descripción de la empresa y un tema listo para aplicar, de modo que cada cuenta se ve propia desde el primer inicio de sesión.
Mateo Ruiz: Y lo interesante es quién está detrás y por qué. El creador, al que un comentarista llama Kingsong, cuenta que la marca blanca aparecía como requisito en los acuerdos en cuanto vendían a más de una empresa, pero hacerla a mano no sobrevive al registro de autoservicio. Por eso la descripción que devuelve sirve para precargar el perfil del cliente, sugerir funciones según su negocio y modelar la incorporación, y esa misma llamada alimenta la precarga de formularios o el enriquecimiento de registros.
Clara Vega: Trae salvaguardas que valen la pena señalar. Cada campo incluye su fuente y su marca de tiempo, los colores se comprueban por contraste antes de entregarse y hay un respaldo que conserva el tema propio del producto. La marca del cliente se aplica al logotipo, el nombre, las acciones y la navegación principales y los estados de foco, mientras que errores, advertencias, acciones destructivas, colores semánticos de datos, texto, código, claves de API y el diseño del producto permanecen fijos. Según la página, la API nunca almacena el nombre del buzón de correo. Y el precio es lo más sencillo: gratis para hasta mil marcas al mes, todos los meses y sin tarjeta.
Mateo Ruiz: Lifelong es una aplicación de salud familiar para iPhone que se plantea distinto al resto: en lugar de girar alrededor de una sola persona, está diseñada alrededor del hogar. Organiza por persona los registros, medicamentos, síntomas, citas, actividad y sueño, y permite conectar los wearables que la familia ya usa, incluidos Apple Watch, Oura y otros compatibles a través de Apple Health.
Clara Vega: Incluye a Alo, su compañero de inteligencia artificial integrado, para registrar actualizaciones, preguntar por síntomas, cambios de medicación, resultados recientes o patrones, y realizar acciones sencillas. El punto en el que insiste el anuncio es que Lifelong es para que la familia la use junta, no para que una persona supervise a las demás: el uso compartido queda bajo control del usuario y cada persona tiene su propio espacio de salud. También aclara que no diagnostica ni prescribe, y que no es un dispositivo médico ni ofrece consejo médico.
Mateo Ruiz: En cuanto a cómo se distribuye: solo para iPhone, gratuita con compras dentro de la aplicación, en inglés, para mayores de trece años y con un tamaño de unos 129,7 megabytes. Tiene una calificación de cinco sobre cinco basada en una única reseña. Lifelong Plus se presenta como una sola membresía que cubre a todos los invitados de la familia, con una prueba gratuita de 14 días compartida. La app declara que los datos están cifrados, que nunca se venden y que no se usan para anuncios, según lo que Apple muestra en su ficha.
Clara Vega: Cerramos hoy con dos motores muy distintos: el Grok 4.6 de xAI, que según la empresa se enfoca en agentes de larga duración y en trabajo interactivo y visual más ambicioso, y NobodyWho, ese motor de inferencia de código abierto que corre modelos de lenguaje completamente en el dispositivo, sin claves de API.
Mateo Ruiz: Y aunque cada uno va por su lado, los dos hablan del mismo giro: llevar las tareas complejas más lejos, ya sea en la nube o directamente en tu propio dispositivo. Gracias por acompañarnos hasta aquí.
Clara Vega: Ha sido un gusto. Hasta la próxima.