0821 | Grok 4.6 para agentes, NobodyWho open-source no dispositivo, ProtoNote e Checksum AI

||Download

Show notes

Neste episódio, os apresentadores percorrem dez lançamentos de IA. Começam com o Grok 4.6 da xAI, que adiciona raciocínio contínuo a fluxos agênticos mantendo o preço de dois e seis dólares por milhão de tokens. Em seguida, destacam o NobodyWho, um motor de inferência open source que roda LLMs totalmente no dispositivo em seis frameworks sem chaves de API, e o Checksum AI, plataforma que escreve, executa e auto-corrige testes Playwright em cada pull request. Também trazem o bitdrift, primeira pl

Linha do tempo

  • 00:00:00 Abertura
  • 00:00:41 Grok 4.6 com raciocínio contínuo em agentes
  • 00:02:36 NobodyWho roda LLMs no dispositivo
  • 00:04:37 Checksum AI e testes Playwright em PRs
  • 00:05:20 bitdrift e observabilidade móvel agêntica
  • 00:06:01 ProtoNote anota protótipos e aplica com Claude
  • 00:07:43 Aloud transforma voz em tarefas para agentes
  • 00:09:28 MeetStream AI dá assento ao agente na reunião
  • 00:11:25 HyNote for Mac mantém notas privadas no dispositivo
  • 00:13:10 Hermai Brand API gera tema do cliente
  • 00:15:04 Lifelong organiza saúde familiar no iPhone

Links relacionados

Este episódio é produzido pela Bri. O Bri usa tecnologia avançada de IA para transformar os feeds importantes para você em podcasts feitos para ouvir. Fale conosco em hi@bri.so.

Transcript

Sofia Almeida: Bem-vindos ao Product Hunt diário, na Bri Radio. Eu sou a Sofia Almeida, e, comigo, está o Rafael Costa. Hoje temos um programa recheado: o novo Grok 4.6 da xAI, um motor de inferência de código aberto chamado NobodyWho, e ferramentas como a ProtoNote e o Aloud para protótipos e feedback.

Rafael Costa: E ainda tem a MeetStream AI para reuniões com agentes, o HyNote de transcrição privada para Mac, e o Lifelong, um app de saúde construído em torno da família. Muita coisa boa para destrinchar por aqui.

Sofia Almeida: A xAI anunciou o Grok 4.6 no dia doze de agosto de 2026, uma atualização do Grok 4.5 com foco declarado em agentes de longa duração e em trabalhos interativos e visuais mais ambiciosos. Segundo a página do produto, o modelo já está disponível no Cursor e no Grok Build, além da API e de parceiros como OpenRouter, Vercel e Cloudflare.

Rafael Costa: E o preço é interessante: começa em dois dólares por um milhão de tokens de entrada e seis dólares por um milhão de tokens de saída, com uma variante rápida ao dobro do preço. Na primeira semana, o fabricante dá o dobro do uso incluído no Grok Build e no Cursor, e um participante da comunidade comentou que o upgrade chegou mantendo a mesma taxa de dois e seis dólares.

Sofia Almeida: Nos benchmarks que a xAI divulgou, o Grok 4.6 empata com o GPT-5.6 Sol Max no índice de inteligência da Artificial Analysis, uma pontuação composta por nove benchmarks: ambos marcam sessenta e um. Para comparar, o Grok 4.5 High marca cinquenta e seis e o Fable 5 Max marca sessenta e dois.

Rafael Costa: Mas quando a gente olha prova a prova, o resultado não é uniforme. O Grok 4.6 supera o GPT-5.6 Sol Max no GDPVal–AA na versão dois, com mil setecentos e cinquenta e três contra mil setecentos e vinte e oito, e também no CursorBench na versão três ponto dois, com quase setenta por cento contra sessenta e sete vírgula dois. Só que fica atrás no DeepSWE, com sessenta e cinco vírgula nove por cento contra setenta e três, e no Terminal-Bench, com vinte e seis por cento contra trinta e quatro vírgula seis. A página registra ainda que os números dos concorrentes vêm dos system cards ou leaderboards publicados pelos próprios desenvolvedores.

Sofia Almeida: O lançamento em destaque aqui é o NobodyWho, um motor de inferência de código aberto e gratuito para rodar modelos de linguagem inteiramente no dispositivo, construído sobre o llama.cpp. Segundo o criador, Pierre, a meta foi deixar a inferência local pronta para produção em seis plataformas e frameworks, e não só uma demonstração que funciona num único aparelho. A proposta dispensa chaves de API e chamadas de nuvem, operando offline.

Rafael Costa: Os recursos anunciados incluem conversas com modelos abertos como Gemma, Qwen e Mistral, entrada multimodal para imagens e áudio, transcrição de fala com qualquer modelo Whisper e síntese de fala com os backends Kokoro, Pocket TTS e Supertonic. Também há chamada de ferramentas com saída de schema válido garantido — a gramática é gerada a partir da assinatura da função — e download de modelos do Hugging Face ou de qualquer URL. Para conversas longas existe um mecanismo de contexto que se desloca de forma antecipada, sem limite rígido de mensagens.

Sofia Almeida: A aceleração por GPU usa Vulkan ou Metal, e o motor é compatível com milhares de modelos no formato GGUF. Agora, a parte de plataformas: Kotlin, Swift, Python, Flutter, React Native e Godot, com pacotes no Maven Central, no Swift Package Manager, no npm, no pub.dev, no PyPI e no AssetLib. Tem ainda aplicativos de demonstração para iOS, Android, Apple Watch e Vision Pro, e o repositório no GitHub é público sob a licença EUPL–1 ponto dois.

Rafael Costa: Na comunidade, um comentarista elogiou o foco em privacidade, capacidade offline e suporte amplo de plataformas. Outro relatou que já viu demos que funcionam, mas que demoram doze minutos para carregar o modelo — então o custo de tempo de inicialização continua sendo um ponto de atenção para quem quiser usar no dia a dia.

Sofia Almeida: Agora o Checksum AI, que se apresenta como a companheira de testes do seu agente de código. É uma plataforma contínua de testes voltada para engenharia e nativa de IA, criada para equipes que entregam mais rápido do que a QA manual consegue acompanhar.

Rafael Costa: A ferramenta gera, executa e auto-corrige testes de ponta a ponta e de API em cada pull request, tudo como código Playwright padrão dentro do próprio repositório. Quando um teste falha, o Checksum diz se encontrou um bug real ou se o teste ficou desatualizado — e aí corrige as falhas falsas para que o conjunto continue acompanhando a velocidade dos agentes de código.

Sofia Almeida: E tem o bitdrift, que se descreve como a primeira plataforma agêntica de observabilidade móvel do mundo. É um sistema de observabilidade em tempo real e fidelidade total que permite que agentes de IA consultem o comportamento dos usuários no celular e ajam sobre ele de forma autônoma, construído sobre a API pública do bitdrift e os bd skills.

Rafael Costa: Jornadas de usuário, métricas de performance e mudanças de comportamento ficam disponíveis quando o agente precisa delas, e não dez dias depois esperando um lançamento de app. Os primeiros usuários relatam investigações mais rápidas e uma melhora de dez vezes no tempo de correção de incidentes.

Sofia Almeida: Saiu no Product Hunt o ProtoNote, uma ferramenta que muda a forma de receber feedback sobre protótipos criados com inteligência artificial: em vez de baixar o HTML, mandar pelo Slack e receber um "está bom" ou uma captura com um círculo vermelho, o destinatário digita só um nome e deixa notas ancoradas no ponto exato da página, sem criar conta. Zach Friesen, que diz ter construído o produto sozinho, descreve esse fluxo antigo como o problema central.

Rafael Costa: O diferencial é a integração com o Claude: o serviço funciona como um servidor MCP remoto, e no chat "transforme isto em um ProtoNote" devolve o link direto, sem etapa de download. Quando chegam notas, você pede para puxá-las e aplicar, e o Claude incorpora as mudanças e publica uma nova versão sozinho. Na demonstração do site, o conector busca seis notas, reescreve um título conforme a nota da revisora Maya, acrescenta detalhes ao botão e publica a versão quatro.

Sofia Almeida: As notas ficam presas ao ponto exato da versão — na versão dois, os comentários antigos permanecem no lugar. Arquivos enviados juntos viram páginas de um mesmo projeto, cada uma com suas notas, e os protótipos ganham pastas e um local permanente.

Rafael Costa: A privacidade e o preço estão definidos: o serviço é privado por padrão, visível só para quem recebe o link, e o painel indica quando alguém visualizou. O plano gratuito traz três protótipos ativos, com revisores e notas ilimitados e notificações por e-mail; o plano Pro custa dez dólares por mês e adiciona protótipos ilimitados, pastas e histórico.

Rafael Costa: Outro lançamento é o Aloud, um app gratuito para macOS em Apple silicon que transforma feedback falado em tarefas para agentes de código. Você grava voz, tela e transcrição ao vivo juntas enquanto fala do app, com o gravador oculto do vídeo. Num clique, ele reescreve a transcrição para o que você realmente quis dizer, mantém só as decisões que se mantiveram e sugere capturas onde você disse "isto", "aqui" ou "aquele botão".

Sofia Almeida: Ele também faz perguntas sobre pontos ambíguos, uma de cada vez, sobre a linha em questão, já com uma resposta recomendada e uma alternativa. Em seguida, gera tarefas dimensionadas para um agente num worktree, e você pode copiar uma tarefa ou exportar a sessão como um único arquivo HTML autocontido para levar ao Claude Code, ao Cursor ou ao Codex.

Rafael Costa: A privacidade fica no dispositivo: a transcrição usa o Whisper local, então áudio e vídeo nunca saem do Mac, e só o texto sai, apenas quando você pede a limpeza. Na comunidade, o gargalo descrito não era o código, e sim o briefing — um comentarista dizia gastar cinco minutos digitando o que falaria em dez segundos e ainda deixar de fora a captura que tornava o problema óbvio; outro disse que o apontamento é a parte que usaria, por economizar o tempo de descrever localizações.

Sofia Almeida: Ficam perguntas em aberto: um comentarista perguntou se o app se limita ao Whisper, já que usa o dictation do Raycast, e outro perguntou o que exatamente sai quando a transcrição precisa ser limpa e enviada. Um terceiro comentarista mencionou já fazer um fluxo parecido com o Whisperflow, dizendo ao Claude Code o que mudar nas telas, e usando o Fable para orquestrar agentes Opus.

Sofia Almeida: A MeetStream AI foi lançada como uma API e infraestrutura unificada para agentes de IA em reuniões, e muda o papel do agente: ele entra como participante da chamada, ouve, fala e age enquanto a reunião acontece, em vez de gerar resumos depois. Segundo o cofundador sidhdharth, a empresa construiu duas camadas. A primeira é um mecanismo unificado de captura, uma API que coleta mais de 50 pontos de dados em tempo real por reunião, incluindo áudio e vídeo por participante, transcrições ao vivo com atribuição de falante e o ciclo de vida completo da reunião via webhook, em Zoom, Google Meet e Teams.

Rafael Costa: A segunda é a camada de infraestrutura de voz: o agente entra como participante real com permissões limitadas, fala durante a conversa e chama ferramentas no meio da chamada — o exemplo citado é atualizar CRMs enquanto o cliente ainda fala. O CTO Navaneeth Jawahar descreve a arquitetura como o produto. O MIA, MeetStream Infrastructure Agents, coloca a orquestração dentro da mesma plataforma que detém o assento na reunião, o que significa uma única superfície de integração, sem host de voz externo, sem HTML injetado e sem pilha de licenças separada.

Sofia Almeida: Os modelos de transcrição, LLM e voz são plugáveis — Deepgram, AssemblyAI, OpenAI, Gemini, ElevenLabs e Sarvam são citados. Há dois modos de operação: pipeline-mode com wake word, como "Hey MIA", e realtime-mode, em que o próprio agente decide quando falar. No meio da reunião, o agente também pode chamar funções ou ferramentas MCP e reportar o resultado por voz, fechando o loop de agir durante a conversa em vez de só ouvir.

Rafael Costa: Para fechar os anotadores de IA, o HyNote for Mac é um app gratuito de transcrição local para macOS, apresentado como 100% privado. O reconhecimento de fala roda inteiramente no dispositivo, usando o hardware local do Mac, então o áudio de reuniões confidenciais, discussões financeiras e estratégias internas nunca sai da máquina — sem upload para a nuvem, sem assinatura recorrente e sem limite por minuto. Ele captura o áudio do sistema direto em Zoom, Google Meet e Microsoft Teams, sem enviar um bot de anotação para a lista de participantes.

Sofia Almeida: Além de reuniões ao vivo, ele ingere arquivos de áudio locais, PDFs, fotos de lousa, links do YouTube e clipes da web, reunindo tudo em um segundo cérebro pesquisável com IA. O criador afirma tê-lo construído para resolver duas frustrações com anotadores de IA padrão: bots invasivos convidados às reuniões e upload de áudio confidencial para servidores de terceiros, além de ferramentas que só funcionam em reuniões ao vivo. Um comentarista parabenizou a equipe pelo sexto lançamento do app por continuar oferecendo-o gratuitamente.

Rafael Costa: A postura local e sem bot rendeu elogios na comunidade: um comentarista disse que privacidade não deveria ser um plano pago, e outro apontou a utilidade para equipes reguladas, onde enviar o áudio de reuniões a outro serviço já é um problema. Mas ficam perguntas em aberto: se o HyNote captura o áudio dos dois lados de uma reunião com um cliente e se é preciso obter consentimento de todos os participantes, e o que exatamente sai do Mac na sincronização — o que permanece local de fato não chegou a ser fechado na discussão.

Sofia Almeida: A Hermai Brand API resolve um problema que o próprio criador dizia aparecer em toda negociação: entregar um SaaS B2B white label, com a marca do cliente, sem que isso dependa de trabalho manual. No cadastro, uma única chamada recebe o e-mail corporativo ou o domínio e devolve o logotipo, as cores, a descrição da empresa e um tema pronto, para que a conta já pareça do cliente desde o primeiro login.

Rafael Costa: E o detalhe de privacidade é que ela lê apenas o domínio — o nome da caixa de correio nunca é armazenado. Cada campo ainda traz a fonte e o timestamp, e as cores passam por verificação de contraste antes de chegarem ao produto, com fallback que mantém o tema próprio da aplicação.

Sofia Almeida: A mesma chamada também serve para preenchimento de formulários, onboarding e enriquecimento de registro. Os guardrails definem onde a marca do cliente pode aparecer, enquanto erros, avisos e cores semânticas de status permanecem com o produto.

Rafael Costa: No plano gratuito, são mil marcas por mês sem cartão, e um resultado bem-sucedido consome um crédito Hermai — verificações pendentes, resultados mal-sucedidos e a entrega do logotipo não consomem. Acima disso, o Starter custa quarenta e nove dólares mensais por quinze mil créditos, e o Pro, cento e quarenta e nove por sessenta mil.

Sofia Almeida: Há ainda um skill local para Claude Code ou Codex que permite pré-visualizar a integração num dashboard próprio sem chave de API, com cinco marcas reais de exemplo: HubSpot, Discord, Casper, The New York Times e Berkshire Hathaway. Na discussão, um comentarista relatou ter testado a demonstração com o e-mail de trabalho e gostado da rapidez.

Sofia Almeida: O Lifelong é um aplicativo de saúde familiar construído em torno da família, não de uma única pessoa: cada membro tem seu próprio espaço, e registros, medicamentos, sintomas, consultas, atividade e sono ficam reunidos num só lugar, com compartilhamento controlado por pessoa.

Rafael Costa: A motivação, segundo os criadores — Gurleen, Param e o autor do anúncio — veio da história do avô de um deles. Quando ele perdeu a mobilidade, o pai derrubou duas paredes de casa para caber uma cama hospitalar, porque o sistema de cuidados parava na porta de casa. O app tenta aliviar a carga de quem normalmente lembra o que cada especialista disse.

Sofia Almeida: Ele conecta Apple Health, Apple Watch, Oura e outros wearables compatíveis para acompanhar tendências de sono, atividade, recuperação e frequência cardíaca. Também grava consultas com consentimento e guarda o resumo e o plano de cuidados, e inclui o Alo, assistente de IA que responde perguntas sobre as informações que a família escolhe guardar e transforma foto ou PDF de um resultado em registro.

Rafael Costa: Está disponível apenas para iPhone, com compras integradas; o Lifelong Plus tem teste gratuito de 14 dias, e uma assinatura cobre todos que a família convidar. A empresa afirma que os dados são criptografados, nunca vendidos e nunca usados para anúncios, mas essas práticas informadas pela AHANA STUDIOS LIMITED ainda não foram verificadas pela Apple, segundo a própria listagem. E o app não diagnostica, não prescreve, não é dispositivo médico e não oferece aconselhamento médico.

Sofia Almeida: Fechamos com o Grok 4.6 da xAI, lançado em agosto, e o NobodyWho, um motor gratuito de código aberto para rodar modelos de linguagem diretamente no dispositivo, sem chaves de API.

Rafael Costa: É isso: agentes de longa duração e inferência local de verdade, cada um na sua direção.

Sofia Almeida: Obrigado por acompanhar. Até a próxima.