1009 | 从烧屏到聊天室:技术与人的温度

||Download

Show notes

本期节目从一块烧屏的显示器和一件会发光的T恤讲起,聊聊复古技术与屏幕上的老玩法;接着聚焦AI:OpenAI的数学论文风波与营收口径争议、Opus 5.5花74美元建起卡尔维诺的“看不见的城市”、以及“别让AI替你写代码”的忠告;然后是本地语音识别、电池比燃气轮机更便宜、.lan域名之争、H-1B政策变化;最后回到人与人之间——闲聊的信任价值、Orkut创始人的新愿景和一位坦桑尼亚学生的毕业故事。

时间轴

  • 00:00:04 开场
  • 00:00:34 QD-OLED 显示器长期实测:烧屏与亮度衰减
  • 00:02:43 把光缝在衣服上:LED灯丝T恤
  • 00:04:02 老技术的新生:浏览器里的Demo场景与DVD菜单
  • 00:06:33 走进Elizabeth Holmes的桌面:Theranos.world
  • 00:07:41 OpenAI数学论文风波:撤稿与形式化
  • 00:09:32 OpenAI营收口径争议
  • 00:10:34 AI的创造力与限度:74美元的城市与'自己写代码'
  • 00:12:01 本地语音识别:Whistle小模型
  • 00:13:01 电池赢了:储能比燃气轮机更便宜
  • 00:14:08 网络规则之争:.lan域名与H-1B政策
  • 00:15:58 人与社区:闲聊的信任、Orkut的回归与坦桑尼亚的学生
  • 00:17:48 收尾

相关信息

本期节目由 Bri 出品。Bri 使用先进的 AI 技术将你在意的资讯转换成适合收听的播客。如需联系,请发邮件至 hi@bri.so。

Transcript

茉莉: 大家好,欢迎收听本期节目,我是茉莉。

白桦: 我是白桦。今天这一期挺有意思的,故事从一个屏幕慢慢走到一件衣服,再走进浏览器里的老程序,然后一头扎进AI的世界,最后又落回到人和人之间。

茉莉: 对,主线其实是一条:发光的东西、跑起来的东西、算出来的东西,最后都是为人的连接服务的。那我们从头开始,先聊屏幕。

白桦: 最近TechSpot做了一个很“苦力”的测试:一台QD-OLED显示器,拿来当生产力工具用了整整30个月,累计8000小时。

茉莉: 8000小时,按每天八小时算,差不多是每天上班都在用,用了三年多。

白桦: 结论呢,坏消息不算大,但消息是真的:出现了可测量的烧屏,亮度也下降了。

茉莉: 这个对办公用户来说就是关键问题了,因为OLED那种鲜艳的画质,看电影、看照片是享受,但办公场景意味着什么?意味着任务栏、菜单栏、浏览器的白色工具栏,一挂就是几个小时,位置从来不变。

白桦: 对,静置的界面就是烧屏的温床。你每天打开同样的软件、同样的布局,那些固定元素的像素一直被点亮,日积月累就留下痕迹。

茉莉: 所以这次的实测等于把一个大家一直在担心的事情,变成了一个有数据支撑的事实:不是传言,是真的量出来了。

白桦: 那接下来会怎么样?我猜厂商不会坐视不管。他们可能会在固件保护上做文章,比如更积极的像素位移,让画面悄悄地整体挪动几像素,避免同一批像素永远承受同样的负担。

茉莉: 还有老化补偿,通过降低 neighboring 像素的电压来均衡亮度衰减,另外还有屏保、像素刷新这些机制。另一个大家会盯着的,就是保修政策,到底烧屏保不保?

白桦: 对,这个问题很现实。你花大价钱买了显示器,三年后菜单栏印在屏幕上了,算不算质量问题?厂商的保修条款现在都很模糊。

茉莉: 所以我的建议是,如果你是重度办公用户,买QD-OLED之前先想想你的使用模式:如果每天都是那几个固定软件开十小时,那就要慎重,或者买之前先把保修条款读清楚。

白桦: 这也提醒我们,OLED的画质优势是有代价的,代价就是“静态内容不友好”。不过QD-OLED是“发光”的,有人干脆把发光的东西缝到衣服上去了。

茉莉: 哦,你这个过渡我接住了。scottbez1干了这么一件事:把柔性的LED灯丝缝到T恤上,让它真的发亮。

白桦: 这个不是玩具吧?他用ESP32来控制,还配了Boost转换器来供电。

茉莉: 对,ESP32是个很常见的微控制器,能跑WiFi和蓝牙;Boost转换器就是把电池的低电压升到LED需要的电压。这些是正经的电子工程活儿。

白桦: 最有意思的是他先量了LED灯丝的实际长度,然后根据这个长度去设计衣服上的发光路径。

茉莉: 这就是软硬件协同设计。你不是先画一个漂亮的图案然后想办法塞灯进去,而是反过来,让设计服从材料的物理约束。灯丝多长,路径就多长,弯曲半径多少,走线就怎么绕。

白桦: 这种“让软件迁就硬件”的思路,其实跟很多可穿戴设备的工程思路是一致的,因为柔性电子的物理限制很硬,你必须尊重它。

茉莉: 而且这个项目的可复制性很强,玩具但不是垃圾,它说明一个人用现成的模块就能做出以前只有大公司才做得出来的东西。

白桦: 这让我想到另一种“老东西跑起来”的快乐,不过这个老东西不是衣服,是软件。

茉莉: 好,接下来我们聊聊经典PC演示场景。

白桦: 有些人可能不熟悉“demoscene”这个词,它是80、90年代欧洲,尤其北欧流行的一种文化:一群程序员和美工比赛,看谁能在严格的限制下做出最炫的实时音视觉演示,像一段会动的音乐MV,但所有画面都是代码实时算出来的。

茉莉: 里面的名作像Second Reality,1993年Future Crew做的,当年在PC上跑要靠纯x86汇编和VGA卡。这种东西今天还能跑吗?

白桦: 能,而且是在浏览器里跑。思路是这样的:用x86模拟器还原当年的CPU行为,或者把原来的代码通过C转译的方式翻译过来,最后编译成WebAssembly,让浏览器执行。

茉莉: 这个组合很聪明,因为它不去“重制”,不重画、不重做音乐,而是直接让当年的二进制在今天的机器上复生。怀旧的味道是完全保真的。

白桦: 限制催生创造力这个道理在demoscene上体现得最纯粹。当年的限制是什么?几百KB的内存,几MHz的CPU,于是人们想出各种技巧。今天限制没了,但那种限制下的智慧反而成了被保存和被欣赏的对象。

茉莉: 而说到“限制催生交互”,我立刻想到另一个被大家遗忘的平台:DVD。

白桦: 对,我们这一代人可能记得DVD的开机菜单、选集、花絮,但很少有人想过那些菜单本身就是小程序。

茉莉: 它是怎么实现的?DVD的Subpicture,就是叠加在画面上的字幕层,只有2位色深,也就是4种颜色。就这么穷的一个图层,DVD的虚拟机还提供了一组寄存器,叫GPRM和SPRM,可以存储和读取状态。

白桦: 所以菜单可以记住你选了什么、根据条件跳转到不同的画面,本质上是一台有条件分支的状态机。有人甚至用这套东西做出了小游戏。

茉莉: 是的,2位色深加几个寄存器,这就是当年交互设计的全部材料。但它撑起了整个DVD消费体验的门面。跟刚才的demoscene一样:穷,但穷得有创意。

白桦: 这两个故事的共同点在于:技术复活不是靠情怀滤镜,而是靠模拟、转译、形式化描述这些扎实手段,把旧的行为完整保留下来。

茉莉: 好,那接下来我们看一个把“怀旧”和“互动”结合得更狠的例子,它怀旧的不是好东西,是一桩公司丑闻。

白桦: Theranos.world,一个互动模拟,让你坐到Elizabeth Holmes的办公桌前。

茉莉: Elizabeth Holmes就是Theranos的创始人,那家公司声称只用一滴血就能做全套血液检测,后来被证明是骗局,Holmes本人也被定罪。

白桦: 这个模拟的特别之处在于内容来源:所有的文本和邮件都是从法庭记录里来的,不是编剧编的。

茉莉: 这就很有意思了。它本质上是把司法档案转换成一种可以体验的叙事。你读判决书的时候是旁观者,你在模拟里坐到她的桌前,点开那些邮件的时候,你是近身处在一个正在崩塌的决策环境里。

白桦: 这是历史和游戏的一个交叉点。历史上你学的是“发生了什么”,游戏给你的是“当时看起来像什么”。

茉莉: 它也提出了一个伦理问题:用丑闻中的真实文件做互动体验,会不会太像娱乐化?但如果处理得当,它其实是一种新的档案教育形式。

白桦: 好,怀旧和互动讲完了,我们进入本期的重头戏,AI。而且第一个故事就有点尴尬,是OpenAI自己尴尬。

茉莉: OpenAI撤回了三篇数学手稿,包括跟Kuga–Satake簇和K3曲面相关的,原因是发现了符号错误。

白桦: 数学论文里的符号错误可不是小事,一个正负号错了,整条证明链可能就断了。

茉莉: 这个事的背景是OpenAI在尝试让AI生成数学证明,然后发布。他们现在公开了一份“数学历史”的账目:总共719个结果里,大约300个,也就是42%,完成了形式化;有过三次撤回,14篇修订手稿,6项新的Lean形式化。

白桦: 这里得跟不熟悉Lean的朋友解释一下:Lean是一个证明助手,你把证明用计算机能检验的语言写出来,机器逐条验证逻辑,人是骗不过机器的。

茉莉: 所以Lean形式化正在变成一个质量闸门。AI写的证明,你读起来觉得对,审稿人读起来觉得对,但只要没过Lean,就总有可能藏着符号错误。

白桦: 这次的撤回恰恰说明这个闸门起作用了,或者说,说明还没有充分形式化的东西就急着发布,是有风险的。

茉莉: Terence Tao,就是那位菲尔兹奖得主,也在讨论一个他称为“Math 2.0”的想法:数学不应该只看重解决难题,还应该看重阐述、社区和新的研究方向。换句话说,数学的价值不只在于“答案对”,还在于“这个结果能不能让更多人接得住、往下走”。

白桦: 把这两件事放在一起看,其实是一个提醒:AI可以生成看起来很漂亮的结果,但数学共同体的信任机制,验证、同行评议、形式化,一个都不能省。

茉莉: 数学的账算完了,我们来看另一本账,OpenAI的营收账。

白桦: 据《金融时报》的报道,OpenAI把它的年化营收数字下调了大约200亿美元。

茉莉: 对,这个量级不是小修小补。而且下调的原因不是业务崩了,而是统计口径:他们此前用来跟Anthropic比较的方法,和Anthropic自己用的方法不一样,等于拿苹果跟橘子比。

白桦: 为什么这事重要?因为现在整个行业都在用这些“年化营收”的数字来估计AI到底是个多大的市场,投资、估值、政策讨论都建立在这些数字上。

茉莉: 但问题在于,外界几乎没办法核验这些数字。是不是确认收入?有没有一次性合同?是订阅摊销还是真金白银到账?外人看不到。每家公司都可以选一个对自己最有利的口径。

白桦: 所以这次的教训是:看到AI公司的营收数字,先问一句“这是按什么口径算的”,再决定信多少。

茉莉: 好,营收的事说完了,我们来看AI更明亮的一面,但马上又会引出一个提醒。

白桦: 有个很震撼的案例:Opus 5.5,也就是一个AI模型,在1.5小时内,花大约74美元的API费用,动用了6个并行的子代理,把卡尔维诺的小说《看不见的城市》做成Three.js可视化。

茉莉: 卡尔维诺那本书本身就是55个城市,每个城市都是马可·波罗向忽必烈汗描述的一幅想象图景,特别适合视觉化。这个项目等于让AI当了一次完整的创意工程师:读文本、做设计、写代码、出场景。

白桦: 这个案例展示了AI在创意工程上的真实潜力,不是替代一个工具,而是调度整个工作流程。

茉莉: 但同一个话题下有一个反向的声音,来自Carson Gross。他对学生的建议是:即使有了AI,也要自己写代码。

白桦: 他的理由是:写代码的过程其实是学阅读和理解的过程。如果你把代码都外包给AI,你永远学不会读代码,也就永远无法判断AI给你的是好是坏。

茉莉: 他的建议是折中而不是禁止:把AI当导师,让它解释、点评、陪你学,而不是当代笔,让它替你写。这两件事放在一起看就很清楚,AI能产出作品,这是74美元能买到的;但真正的能力仍然要自己练,这个是买不到的。

白桦: 好,接下来我们看一个小而强的本地AI模型,它属于另一个方向:不往云上去,往你的机器上压。

茉莉: 这个模型叫Whistle,很小,只有16.9MB,却支持7种语言的语音识别。

白桦: 16.9MB是什么概念?很多手机上的一张照片都不止这个大小,而这是一个完整的语音识别模型。

茉莉: 它可以完全在本地CPU上跑,不需要GPU、不需要云端,而且延迟极低,第一个token只要11毫秒。

白桦: 这意味着什么?意味着隐私友好,因为你的语音不用上传;意味着低延迟,因为不用等网络往返;还意味着可以离线用,飞机上、地下室里、没有信号的地方都能工作。

茉莉: 它走的是跟大模型相反的路:不追求最强,追求“够用且在你口袋里”。这条路线对嵌入式设备、无障碍工具、本地笔记应用,都很实际。

白桦: 本地化算力讲完了,我们再来看本地化能源,这次的数据甚至更惊人。

茉莉: Wood Mackenzie做了一项分析,对比4小时电池储能和开式循环燃气轮机这两种调峰电源的成本,覆盖了43个市场。

白桦: 结果呢?电池储能在全部43个市场里都更便宜。一个不落。

茉莉: 这是一个拐点信号。过去调峰、备用电力的默认答案是燃气轮机,因为它启动快、部署快。现在4小时电池在成本上全面胜出,意味着电力市场的竞标逻辑要变了。

白桦: 为什么4小时这个时长关键?因为很多电网的晚高峰或可再生能源缺口,正好在4小时这个量级。电池能覆盖这个时段,就抢掉了燃气轮机最核心的经济生存空间。

茉莉: 当然这42个、43个市场之外的地区,比如电网条件很特殊的地方,情况可能不同,而且长时储能是另一个问题,4小时解决不了连续几天的风光不足。但就调峰这个赛道而言,天平已经倾斜了。

白桦: 好,从能源回到网络空间,接下来两个故事都跟“规则由谁定”有关。

茉莉: 第一个是关于域名的。ICANN收到了一个新的顶级域名申请,叫做.lan。

白桦: 听起来人畜无害对吧?问题在于.lan早就被“民间征用”了。比如OpenWRT,那个很流行的开源路由器系统,默认就用.lan作为本地域名后缀。

茉莉: 也就是说,无数家庭和企业的内网设备已经在用myrouter.lan这样的地址了。如果.lan真的成为正式的公共gTLD,那这些内网用法就可能跟公共DNS产生冲突和混淆。

白桦: 批评者指出,RFC 8375早就为此规定了答案:家庭网络的本地域名应该用home.arpa,这个后缀被保留下来专门给内网用,不会跟公共命名空间打架。

茉莉: 所以争论点就是:一个已经被广泛民间使用、但从未被正式批准的名字,该不该被正式商业化为gTLD?批准了伤害存量用户,不批准又显得ICANN对现实视而不见。

白桦: 第二个故事是政策面的。美国政府以涉嫌签证滥用为由,把微软等一批公司从Permament Labor Certification计划中剔除了。

茉莉: 这个计划是技术人才引进的一个环节,跟H-1B等签证路径相关。被剔除意味着这些公司在申请永久劳工认证时会遇到阻碍,直接影响他们雇佣和留住外国技术人才。

白桦: 一个是命名规则之争,一个是人才政策收紧,两件事的共性是:互联网和科技行业的运行规则,正在由监管者主动重写,而不是行业自然演化。接下来我们回到更本源的东西,人和人。

茉莉: 好,最后一个板块,我们聊三个看起来不相关、但内核相通的故事。

白桦: 第一个来自Ken Arneson,2015年写的一段观察:正式话题开始前的闲聊,small talk,其实有真实的功能,它建立信任,降低说话时的脆弱感。

茉莉: 这个洞见对做产品的人很有启发。很多线上协作工具把闲聊当成“浪费时间”来优化掉,结果是会议更高效了,但人更孤独了,大家不愿意说真话、不敢提分歧。

白桦: 因为在一个没有人情味的频道里,说错话的代价显得很高;闲聊实际上是在为之后的关键发言铺设心理安全。

茉莉: 第二个故事是Orkut的创始人Büyükkökten发起的一场运动,推广更人性化、更社区导向的社交网络。Orkut这个名字对老网民有特殊意义,它曾是Google旗下的社交产品,在巴西占据过主导地位,比Facebook在当地还火。

白桦: 他现在的观点是,社交媒体走到今天,算法推荐和广告驱动的模式让人和人更疏远,他想要一种回归社区本位的社交产品。

茉莉: 第三个故事最小,但可能最动人:一个501(c)(3)的教育项目,在坦桑尼亚资助学生,已经运营十年。

白桦: 他们资助的学生里有一位叫Anwarite,已经大学毕业了。而项目现在还在支持另外5名学生。

茉莉: 十年,从资助一个中学生到她拿到学位,再到继续资助下一批学生。这不是一个爆发性的故事,是一个慢的故事。

白桦: 你看这三个故事连起来:闲聊需要时间,社区需要时间,一个学生读完大学需要十年。它们共同的敌人是“快”。

茉莉: 我们这一期从发光的屏幕讲到发光的衣服,从浏览器的老程序讲到办公桌上的丑闻,从数学的严谨讲到营收的口径,从74美元的城市讲到16.9MB的语音,从赢过燃气轮机的电池讲到.lan的域名和H-1B的政策,最后落回到闲聊、社区和一个坦桑尼亚学生。

白桦: 这些故事看似零散,其实都在回答同一个问题:技术应该为谁、为什么样的生活服务?

茉莉: 我们下一期再见。

白桦: 再见。