
1007 | Código, Agentes e Polêmicas
Show notes
Um passeio pelas notícias da semana: o debate sobre apps vibe-coded, modelos abertos gigantes, agentes de IA e privacidade, novas ferramentas open-source, regulação e vigilância, e ciência do gelo à geothermal.
Linha do tempo
- 00:00:04 Abertura
- 00:00:38 Vibe coding e o futuro dos apps pessoais
- 00:02:46 Exemplos reais: Darkplug e Berth
- 00:04:39 Modelos abertos e matemática de fronteira
- 00:06:20 Decisions API e hardware aberto
- 00:07:28 Agentes de IA: saúde, produto e privacidade
- 00:09:32 Vigilância e regulação
- 00:10:53 Segurança open-source
- 00:12:31 AnyPS5 e Polars 2.0
- 00:14:03 Desktop Linux e casa inteligente
- 00:15:30 Nobel do IceCube e geothermal
- 00:16:45 Biomassa e resiliência da natureza
- 00:18:35 Encerramento
Links relacionados
- Vibecoding Photoshop: Time and pressure
- Vibecoding isn't as fun as writing code by hand
- The Early History of Smalltalk (1993)
- Show HN: I turned my iPhone and a $20 smart plug into an f-stop timer
- Berthd
- Mistral Large 4: "Le Chonk"
- Mistral Large 4
- Sharing AI progress in mathematics
- Decisions API is in public beta
- OpenTPU – An open-source AI accelerator, developed by AI
- Utah to let AI examine patients and prescribe medication without human oversight
- Claude Code’s suggested message feature: I think the real customer is the model
- Meta's Muse Is an Adorable Privacy and Security Dumpster Fire
- Toronto-Based VPN Provider Plans to Quit Canada over Lawful-Access Bill
- California closed the Montana license plate loophole
- OpenSSH 10.6
- Gleam doesn't compile to Erlang source anymore
- AnyPS5: Port PS5 binaries to PC without emulation (87% system libraries mapped)
- Polars 2.0
- Penguin Mail – open-source Rust email client for Linux with AI
- Tapo (Rust/Python library) now speaks TP-Link's TPAP protocol
- Nobel Prize in Physics 2026: Francis Halzen
- World's First enhanced geothermal power plant completed in just 23 months
- What's Earth's dominant species by mass?
- Nature's capacity to 'bounce back' when species are lost is overestimated: study
Este episódio é produzido pela Bri. O Bri usa tecnologia avançada de IA para transformar os feeds importantes para você em podcasts feitos para ouvir. Fale conosco em hi@bri.so.
Transcript
Sofia Almeida: Olá, bem-vindos a mais um episódio do nosso podcast. Eu sou a Sofia Almeida.
Rafael Costa: E eu sou o Rafael Costa. E hoje o fio condutor é bem interessante: por um lado, uma discussão fervendo na comunidade sobre apps pessoais feitos com IA — a tal vibe coding — e se o software grande ainda faz sentido; por outro, um monte de notícias que mostram exatamente onde essa mesma IA está chegando: modelos abertos de fronteira, aceleradores de hardware desenhados por IA, agentes que prescrevem remédio, e até um Nobel de Física. Vamos mergulhar direto.
Sofia Almeida: Vamos começar justamente pela tese mais polêmica. Um artigo que circulou argumenta que apps pessoais vibe-coded — aqueles que você basicamente descreve e a IA escreve — vão substituir o software grande quando a necessidade é de nicho. A lógica é: por que esperar que uma empresa construa a ferramenta perfeita para o seu problema específico se você pode simplesmente... construir a sua, falando com um modelo?
Rafael Costa: E a discussão nos comentários ficou espinhosa logo de cara. Alguns comentaristas compraram a ideia, dizendo que nunca foi tão barato resolver um problema pessoal seu com código. Outros discordaram frontalmente, e o ponto de discordância central era: as plataformas ainda importam? A tese do artigo assume que você consegue viver fora dos ecossistemas grandes, mas vários comentaristas apontaram que distribuição, compatibilidade e manutenção continuam sendo o verdadeiro fosso — não o código em si.
Sofia Almeida: E tem uma contraponto muito interessante a esse debate: um autor que programou com IA e escreveu que vibecoding é, na prática, menos divertido que programar à mão. A expressão dele é boa: a diversão é "frontloaded" — carregada no começo. Você tem aquele pique inicial de ver o código aparecendo, mas depois não vem a satisfação de um trabalho bem-feito, nem o aprendizado que você teria se tivesse escrito você mesmo.
Rafael Costa: Isso conecta com um comentário que reapareceu essa semana: o texto clássico do Alan Kay de 1993, "Early History of Smalltalk", voltou ao debate. E as pessoas ficaram discutindo por que Smalltalk perdeu para Java — e vários viram paralelos diretos com a era da IA. A pergunta implícita é: ferramentas que facilitam demais o ato de programar de forma superficial acabam produzindo ecossistemas piores? É a mesma tensão do debate dos apps pessoais, só que três décadas antes.
Sofia Almeida: Bom, mas em vez de ficarmos só no abstrato, vale olhar exemplos concretos — porque é aí que o debate dos apps vibe-coded ganha carne. Um exemplo que apareceu: o Darkplug. É um app de iPhone que transforma uma tomada inteligente Shelly, de uns vinte dólares, em um timer para ampliador de câmara escura fotográfica.
Rafael Costa: E é um caso de uso delicioso, porque é exatamente o tipo de coisa que o mercado nunca vai construir: quem ainda revela foto em papel é uma minoria minúscula. O Darkplug faz o timing em f-stops — que é como os fotógrafos de câmara escura pensam na exposição — e também tiras de teste. E o detalhe que amarra com o nosso primeiro bloco: o autor vibe-codou a coisa toda com o Codex.
Sofia Almeida: Ou seja, é a tese do artigo funcionando na prática. Ninguém ia fabricar comercialmente um timer de ampliador com f-stop em 2026 — mas uma pessoa com uma Shelly de vinte dólares e uma tarde livre resolveu o problema dela. É o argumento dos defensores dos apps pessoais materializado.
Rafael Costa: Outro exemplo, esse mais ambicioso: o Berth. É um app open-source para macOS, com um daemon, que roda agentes de código nas suas próprias máquinas. E a sacada é a persistência: os agentes continuam trabalhando mesmo quando o seu laptop entra em sleep. Você literalmente pode fechar a tampa e o agente segue rodando no seu hardware.
Sofia Almeida: Isso também é parte da mesma história, né? A vibe coding não é só "gerar um appzinho"; ela está mudando o modo como a gente abstrai o próprio trabalho de programar. Você delega sessões inteiras de código para agentes que rodam na sua máquina, e a ferramenta existe porque alguém quis esse controle — dados locais, hardware próprio, nada de nuvem obrigatória.
Rafael Costa: E é exatamente aí que a conversa pula para quem está construindo os modelos por trás disso tudo. Porque agentes de código precisam de modelos bons, e essa semana tivemos notícias grandes dos dois lados do Atlântico.
Sofia Almeida: Começando pela Mistral. O Mistral Large 4 — e o apelido é "Le Chonk", o que já entrega o tamanho — tem um trilhão de parâmetros, com 49 bilhões ativos, então é um modelo esparsos multimodal. A promessa é que os pesos abertos saem no fim do mês. E o detalhe de infraestrutura que chamou atenção: foi treinado em 3.800 GPUs Grace Blackwell, na Europa.
Rafael Costa: E o desempenho reportado é relevante para a nossa conversa sobre agentes. Em DeepSWE, o Le Chonk rivaliza com o GLM 5.3, e é apontado como líder entre os modelos open-weight fora da China. E há um número que fala direto para quem usa agentes de código: 82% num teste de reproduzir e aplicar patch numa vulnerabilidade real. Não é um benchmark sintético — é reproduzir um bug de segurança e consertá-lo.
Sofia Almeida: Do lado da OpenAI, o movimento foi diferente, mas na mesma direção de abertura: eles publicaram no GitHub resultados de matemática de um modelo de fronteira interno, com formalizações em Lean — ou seja, provas verificadas por máquina, não só texto bonito. E, curioso, eles têm consultado um grupo consultivo do Institute for Advanced Study. Matemática de fronteira saindo de um modelo, com verificação formal, é sinal de que a fronteira está migrando de "escreve código" para "faz ciência".
Rafael Costa: E, ainda no eixo de ferramentas para desenvolvedor, a OpenAI lançou uma Decisions API em beta público. A ideia é diferente do chat tradicional: a API verifica condições, escolhe entre opções e pontua rubricas. É uma API feita para decisões estruturadas, não conversa. O preço fica na casa de dez centavos por milhão de tokens de input, e ela aceita imagens. E há um rival chamado Jev, que é mais barato — então esse nicho de "APIs de decisão" já tem concorrência de preço.
Sofia Almeida: Do lado do hardware aberto, tem uma história que é quase meta: o openTPU, um acelerador de IA open-source que foi desenhado por IA. E ele funciona de verdade — roda modelos como o Qwen3 numa placa FPGA Kintex-7, chegando a cerca de 86 tokens por segundo depois de um ciclo de autoaperfeiçoamento. Pensa na simetria com o nosso primeiro bloco: apps pessoais vibe-coded, e agora um chip vibe-coded. A mesma lógica de "descreve o que você quer e a IA constrói" chegou ao silício.
Rafael Costa: Mas onde essa IA encontra o mundo real de forma mais desconfortável é em duas frentes: saúde e vigilância de produto. Vamos lá. Utah se tornou o primeiro estado dos EUA a permitir que uma IA examine pacientes e prescreva medicamentos sem supervisão direta. O caso concreto é o app Nolla Health, que trata acne: quatro dólares e noventa e nove por mês, e só medicamentos tópicos.
Sofia Almeida: É um escopo deliberadamente estreito — acne, cremes tópicos — o que faz sentido como porta de entrada, porque o risco é baixo. Mas o precedente é enorme: um estado dizendo formalmente que um modelo pode fazer o exame e assinar a prescrição, sem um médico humano no circuito direto. A pergunta que fica no ar, e que ninguém fechou, é o que acontece quando o escopo cresce — quando não é mais acne.
Rafael Costa: E do lado do produto, tem um artigo que gerou discussão quente. A tese: o recurso de sugestões de mensagem do Claude Code — aquelas mensagens prontas que o sistema sugere que você envie — na verdade mira o modelo como cliente. Ou seja, você estaria otimizando a conversa para o modelo, não para você. E nos comentários o clima era de ceticismo, com várias pessoas vendo um ângulo de coleta de dados por trás: sugestões padronizadas facilitariam comparar respostas e treinar.
Sofia Almeida: E se a gente está falando de agentes com muito acesso e pouca supervisão, tem que falar de um caso que a Techdirt crucificou: o Meta Muse. É um agente da Meta com acessos sensíveis, e o argumento do Techdirt é que isso é uma falha grave de privacidade e segurança. E nos comentários do HN, leitura recorrente: várias pessoas viram isso não como acidente, mas como um padrão intencional da empresa. "Intencional" é a palavra que apareceu — não é um bug que escapou, é uma escolha de design.
Rafael Costa: Que é uma pontuação que conecta direto com o nosso próximo bloco, porque é exatamente sobre governos exigindo ganchos de vigilância em software. O caso: o Psiphon, ferramenta de contorno de censura com vinte milhões de usuários, anunciou que planeja sair do Canadá se o Bill C-22 passar. E o que o projeto faria — ou seria forçado a fazer — é instalar ganchos secretos de vigilância nos provedores.
Sofia Almeida: Pensa no que isso significa para uma ferramenta cujo propósito é proteger usuários sob censura. Se o Canadá aprova uma lei que força backdoors secretos, o Psiphon alega que não pode continuar operando de lá com credibilidade. E o comentário que se impõe: não é ameaça vazia — a confiança é o produto inteiro. Um Psiphon com ganchos secretos conhecidos é um Psiphon morto para os vinte milhões de usuários.
Rafael Costa: E do lado legislativo mais mundano, mas não menos interessante: a Califórnia fechou a brecha das placas de Montana. A história: empresas de fachada registravam veículos em Montana para escapar de impostos estaduais. O projeto de lei 1406, assinado em 30 de setembro de 2026, faz com que os membros dessas empresas de fachada passem a responder pessoalmente pelos impostos de veículos.
Sofia Almeida: É uma correção cirúrgica: em vez de perseguir cada arranjo, o estado vai direto na pessoa por trás da fachada. Fim da jogativa na prática. Bom, e se o tema agora é software que precisa ser confiável — e software de segurança — vamos falar de ferramentas open-source da semana, porque tem duas que dialogam com tudo isso.
Sofia Almeida: Primeiro: OpenSSH 10.6 foi lançado. E há uma mudança de política relevante embutida: a equipe está fazendo releases de segurança mais frequentes, e a razão declarada é que há mais bugs sendo descobertos por IA. Ou seja, o mesmo ferramental que gera código está encontrando falhas em software crítico em ritmo que obriga os mantenedores a acelerar o ciclo.
Rafael Costa: E nesta release específica, eles mitigaram um ataque de side-channel ligado à compressão do SSH. Não vamos entrar em detalhes criptográficos, mas é o tipo de falha sutil que exatamente esse tipo de análise automatizada encontra. E há uma ironia estrutural: a IA que gera código é a mesma força que encontra os bugs nele. O ciclo de segurança inteiro está sendo comprimido pelos dois lados.
Sofia Almeida: Do lado das linguagens: Gleam 1.19 trouxe uma mudança de compilação que os usuários vão sentir na hora. Em vez de gerar código-fonte Erlang, o compilador agora gera Erlang abstract forms diretamente — ele fala com a VM num nível mais baixo. O resultado prático: compilação bem mais rápida e stacktraces com linhas precisas, apontando exatamente onde está o erro no seu código Gleam, não no Erlang gerado.
Rafael Costa: E aí pulemos para dois projetos grandes da comunidade. O primeiro é o AnyPS5, e é uma história impressionante de engenharia reversa: uma ferramenta open-source que porta executáveis de PS5 para Linux e Windows sem emulação. Não é um emulador — os jogos rodam nativamente no seu sistema. E o progresso reportado: 87% das bibliotecas de sistema já mapeadas. É GPL-2, e o projeto já está com 6,5 mil estrelas no GitHub.
Sofia Almeida: Sem emulação é a parte chave, porque emulação é onde esses projetos normalmente morrem — performance despenca. Portar os executáveis direto é uma aposta muito mais ousada. E o outro destaque é o Polars 2.0, para quem trabalha com dados. A versão 2.0 traz SQL de primeira classe, spill-to-disk ligado por padrão — usando cerca de 80% da RAM como limite antes de despejar para o disco — e um novo Map dtype. E no benchmark, lidera o TPC-H e o TPC-DS contra o DuckDB e o DataFusion.
Rafael Costa: Note o detalhe do spill-to-disk por padrão: o Polars está dizendo "você não precisa gerenciar memória, nós cuidamos disso e damos o melhor resultado". É uma aposta de ergonomia com prova de desempenho embaixo. E a competição com DuckDB e DataFusion é saudável — nenhum deles saiu da discussão, só que desta rodada o Polars está na frente nos dois benchmarks principais.
Sofia Almeida: Falando de software de desktop, tem dois projetos que preenchem nichos exatamente como o nosso primeiro bloco previa. O Penguin Mail: um cliente de e-mail para Linux, GPL-3, escrito em Rust com GTK. Ele suporta Gmail, Outlook e IMAP, tem calendário — e um detalhe que virou assinatura dos tempos que vivemos: assistente de IA opcional, desligado por padrão.
Rafael Costa: Desligado por padrão — e isso não é detalhe, é posicionamento. Depois de toda a conversa que a gente teve sobre Meta Muse e coleta de dados, um projeto open-source que te dá a IA mas não te empurra ela é uma resposta quase política. E o outro projeto é o tapo, a biblioteca para tomadas inteligentes TP-Link. A versão 0.11.1 suporta o protocolo TPAP, que não é documentado publicamente — eles fizeram engenharia reversa e implementam SPAKE2+.
Sofia Almeida: E por que isso importa? Porque a TP-Link tem um switch de "compatibilidade de terceiros" que, quando ligado, habilita um modo de integração. Com o TPAP suportado nativamente pela biblioteca, você pode manter esse switch desligado — seus dispositivos ficam no modo padrão da TP-Link, e você ainda controla tudo com software open-source. Menos superfície de ataque, menos dependência de APIs proprietárias habilitadas.
Rafael Costa: E isso nos leva naturalmente à parte de ciência, porque tem duas histórias que mostram engineering — humana e geológica — em outra escala. A primeira: o Nobel de Física de 2026 foi para Francis Halzen, pelo IceCube. E o IceCube é exatamente o que parece maluco: um detector de neutrinos de um quilômetro cúbico construído na Antártida. Neutrinos astrofísicos de alta energia — partículas que atravessam o planeta e quase nunca interagem com nada.
Sofia Almeida: Construir um detector desse tamanho no gelo da Antártida, para capturar as partículas mais esquivas do universo — e agora um Nobel por isso. E a outra história de engenharia em escala é terrestre: a Fervo concluiu a primeira planta de geotermia aprimorada do mundo, a Cape Station, em Utah. E o tempo é a manchete: vinte e três meses. É o primeiro terço dos 100 megawatts planejados, num sítio que pode chegar a 4 gigawatts.
Rafael Costa: Vinte e três meses para a primeira planta de geotermia aprimorada é velocidade de deploy que a indústria não costuma ver — e o headroom do sítio, até 4 GW, é o que deixa a gente atento: isso não é piloto, é o começo de algo que pode escalar de verdade.
Sofia Almeida: E para fechar, duas histórias que colocam a gente de volta no planeta. A primeira é uma curiosidade estatística: qual é a espécie com maior biomassa da Terra? Resposta: a black spruce, a pícea preta, com mais de 11 bilhões de toneladas. Entre os animais, lidera o gado, com 650 milhões de toneladas — o que diz muito sobre nós, porque é biomassa que a gente criou. E os humanos? Cerca de 350 milhões de toneladas, praticamente empatados com o krill da Antártida.
Rafael Costa: Gado com quase o dobro da biomassa de toda a humanidade. E o número dos 11 bilhões de toneladas de uma única espécie de árvore é o tipo de fato que reorganiza a sua intuição sobre o que domina o planeta — não são nós, nem formigas, é uma conífera boreal.
Sofia Almeida: E a segunda história é a nota que precisa acompanhar qualquer celebrada otimista: um estudo mostra que a capacidade da natureza de "se recuperar" após a perda de espécies está superestimada. Os nichos ecológicos não são preenchidos de novo em escala de tempo humano. Ou seja, quando uma espécie some, não é só tirar uma peça do quebra-cabeça — o quebra-cabeça não se remonta sozinho, pelo menos não num prazo que a gente vá ver.
Rafael Costa: É um fecho apropriado, porque amarra com tudo que a gente conversou: a gente constrói ferramentas cada vez mais rápidas — apps em uma tarde, modelos de um trilhão de parâmetros, plantas geotérmicas em dois anos — mas os sistemas naturais seguem no ritmo deles, e esse ritmo não acelera porque nossa tecnologia acelerou. Fica a pergunta que o estudo deixa em aberto: o que exatamente a gente está assumindo quando diz que a natureza "se recupera"?
Sofia Almeida: Por hoje é isso. A gente volta em breve com mais. Até lá, bons códigos — vibe ou não.
Rafael Costa: Tchau, pessoal!