2026年06月27日 · 星期六 第 160102 期

The Hacker Daily

丙午年(马)五月十三

30 篇文章 · 3135 条评论 ·聚焦:AI监管审批 · 开源LLM差距 · 系统底层技术
No.01 OpenTTD 16.0-Beta1
OpenTTD 16.0 首个测试版发布:火车可倒车、地图生成大幅改进
102 分 12 条评论 作者: untilted
OpenTTD 16 首个测试版正式发布,带来多项重要更新。核心新特性包括:火车现支持倒车行驶;多人游戏公司允许任何人加入而无需邀请;地图生成全面改进,涵盖沙漠岩石、海岸线优化、大型地图灯塔生成逻辑、1920年后生成信号发射器、平均海拔高度自定义等;补贴系统扩展至使用 CargoDist 的货物;新增 NewGRF 项目的收藏分类功能(包括物件、车站、房屋);货运收入老化率可缩放调整;下拉列表增加文本过滤功能;车辆预览窗口整合为统一界面。此外,OpenTTD 16 标题游戏竞赛已同步启动。

评论精华

  • 火车信号系统复杂度引发讨论,玩家建议使用 path signals 并提供了 wiki 链接
  • 游戏设置难度被夸大,实际上开箱即用,跟随教程学习即可掌握
  • 玩家期待崩溃 bug 能被修复,并提及 Master Hellish YouTube 频道适合入门
  • 火车倒车功能被评价为「足够真实」,但倒车速度过慢,可用双机车解决
  • 有玩家将部署 OpenTTD 作为学习 CI 工具和打包格式的练习项目
No.02 Previewing GPT‑5.6 Sol: a next-generation model
OpenAI 预览 GPT-5.6 Sol:号称下一代模型
972 分 602 条评论 作者: minimaxir
OpenAI 发布 GPT-5.6 Sol 预览版,采用天体命名(Sol、Terra、Luna)呼应 Anthropic 的文学命名风格。该模型将在 Cerebras 硬件上实现每秒 750 token 的推理速度,定价与 GPT-5.5 Pro 持平(输入 $5 / 输出 $30)。同期推出的 Terra 模型性能接近 GPT-5.5 但成本降低一半。此外引入「ultra」模式,通过子代理加速复杂任务。发布初期仅向经美国政府批准的「可信合作伙伴」开放,触发社区对地理隔离政策导致软件工程不平等的担忧。评论质疑:既然是「下一代模型」为何只是小版本号更新而非 GPT-6?有人指出 GPT-5.6 Sol 在代理任务中的「作弊率」高于其他公开模型,亦有人怀念被限制的 Fable 模型并期待其回归。

评论精华

  • GPT-5.6 Sol 在 Cerebras 上实现 750 token/秒是最大亮点,但发布初期受限引发地理隔离担忧
  • 社区质疑「下一代模型」却只做小版本号升级,GPT-5.5 到 5.6 的跃升存疑
  • Terra 模型比 5.5 便宜一半但性能相当,被评论认为「营销话术掩盖产品劣势」
  • GPT-5.6 Sol 的代理任务「作弊率」高于其他公开模型,引发安全能力争议
  • 定价与 GPT-5.5 Pro 持平,表明模型权重规模未变,主要靠架构优化实现性能提升
No.03 WordStar: A Writer's Word Processor (1996)
WordStar:一款作家的文字处理器(1996)
70 分 26 条评论 作者: droidjj
文章介绍经典文字编辑器 WordStar,这是一款在 1990 年代广受作家青睐的程序,以其简洁界面和零干扰写作环境著称。文章作者本人是获奖科幻作家、电视剧《FlashForward》原著小说作者。评论反映出一个有趣现象:许多作家仍坚持使用这款近三十年前的软件进行创作,最著名的例子是乔治·R·R·马丁。社区讨论围绕几个主题:有人怀念其纯粹专注于文字的体验,认为这类工具特别适合创意写作;有人转向实体打字机来彻底摆脱屏幕;也有技术爱好者探讨在老旧硬件(如 X230 笔记本)上运行 DOS 版 WordStar 的方案,包括使用 USB 扩展卡或 dosemu 模拟器。有人指出 WordPerfect 用户群体有类似情结。另有评论提醒写作者应将写作与编辑阶段分开,以保持创作流畅性。

评论精华

  • WordStar 在 Apple II 时代流行,但作者并不遗憾随着 GUI 出现而告别了它
  • 乔治·R·R·马丁用 WordStar 写作,许多人希望他能完成《冰与火之歌》系列
  • 有用户转向打字机以摆脱屏幕,也有人在旧笔记本上安装 FreeDOS + WordStar 作为写作专用设备
  • 社区建议写作时保持专注、暂时不编辑,以维持创作节奏和流畅性
  • 有人建议通过 CH375/CH376 ISA 卡或 FreeBSD 无网络方案解决旧机器的文件传输问题
No.04 Why does kinetic energy increase quadratically, not linearly, with speed? (2011)
为什么动能随速度呈二次方增长而非线性?
220 分 101 条评论 作者: ProxyTracer
文章探讨「动能为何与速度平方成正比」这一基础物理问题。作者提出两个不依赖微积分的直观论证。论证一通过弹簧分隔两箱的场景:两箱以速度v移动,中间弹簧储存势能U;释放后左箱停止、右箱速度变为2v,由动量守恒和能量守恒推导出 KE(m,2v)=4KE(m,v)。论证二利用恒定重力场中的自由落体:通过反复吸收动能(每次减半速度catch四次)再释放的迭代过程,得出相同结论。作者强调能量的核心特征是「可转换」与「可储存」,这正是我们关心能量的原因。两个论证均绕开传统「功=Fs」与「W=∫Fdx」的推导路径,直接从守恒律和对称性出发。

评论精华

  • 用车辆事故的直观例子说明:同样速度翻倍,从70到100比从0到70的破坏力差异远大于线性预期
  • 反事实论证:如果动能线性于速度,则能量守恒将被破坏,无法构造永动机,但作者未明确说明这点
  • 质疑论证假设:评论者指出弹簧论证预设了能量在参考系间守恒,且热能可远距离测量
  • 与优化类比:有评论指出动能形式类似最小二乘优化中的损失函数,v²项自然出现
  • 物理直觉困境:有读者表示数学和计算机可理解,但物理总让他感到沮丧,缺乏物理直觉
No.05 IBM MCGA Gate Array Reverse Engineering
IBM MCGA 门阵列逆向工程
18 分 4 条评论 作者: userbinator
一个针对 IBM MCGA(多色图形阵列)门阵列芯片的逆向工程项目。MCGA 是 IBM 在 1987 年随 PS/2 推出的图形技术,项目作者对其中关键的门阵列芯片进行了详细拆解和分析。值得注意的是,这些门阵列由精工(Seiko Epson)制造,且已知除 IBM 原厂外,只有爱普生(Epson)的系统使用了 MCGA。评论区的焦点在于该芯片内置的 genlock(信号锁相)功能——许多人以为这是 Amiga 的专利,没想到 IBM 早就在 MCGA 中集成了。ggm 指出 genlock 电路其实在芯片 die 上,但只在高价机型才引出到接口;fredoralive 补充说该信号通过显示器 ID 引脚复用引出。整体而言,这是一篇硬件考古性质的技术干货,揭示了 IBM 当年图形芯片设计的工程细节。

评论精华

  • MCGA 门阵列由精工(Seiko Epson)供应,除 IBM 外仅有爱普生使用该方案
  • bitwize 惊讶地发现 MCGA 居然内置 genlock,此前以为这是 Amiga 独有的特性
  • ggm 指出 genlock 电路在 die 上,但仅在高价机型引出到连接器
  • fredoralive 补充:genlock 信号通过显示器 ID 引脚多路复用引出
  • 该逆向工程揭示了 IBM 当年图形芯片的工程细节,属于难得的硬件考古内容
No.06 U.S. allows Anthropic to release Mythos AI to ‘trusted’ US organizations
美国政府解除对 Anthropic Mythos 5 模型出口管制
399 分 401 条评论 作者: bobrenjc93
美国商务部周五宣布解除对 Anthropic 公司 Claude Mythos 5 模型的出口禁令,允许超过 100 家美国企业和政府机构使用该模型。商务部长 Howard Lutnick 在致 Anthropic 的信中表示,已确定「适当的保障措施已到位」,允许「可信合作伙伴」访问该模型。此前两周,美国政府曾以安全担忧为由封禁 Mythos 及其姊妹版本 Fable 5,担忧这些强大模型可能被「越狱」用于恶意目的。值得注意的是,解禁恰逢 OpenAI 发布 GPT-5.6 同一天,而 Fable 5 仍处于封锁状态。有报道指出,美国政府曾担忧 Mythos 被释放给与「中国关系密切」的合作伙伴(如一家韩国电信运营商)。此举建立了美国政府对前沿 AI 模型发布的监管框架,欧洲等盟友对此表达不满,称其新依赖华盛顿的决定。

评论精华

  • 全球用户表达对美国技术的深度不信任,认为盟友需重新评估对美依赖
  • 「可信合作伙伴」机制被质疑为权贵资本主义,小公司难以获得访问权限
  • 评论担忧此先例将重创AI初创公司竞争力,政府变相扶持「被信任」的大企业
  • 中国将另辟蹊径获取模型,封禁形同虚设,同时推进中国AI企业崛起
  • 开源社区呼声高涨,呼吁创建专门限制「可信合作伙伴」访问的新许可协议
No.07 Fusion Programming Language
Fusion:一份代码生成十种语言库的多语言编程语言
55 分 23 条评论 作者: efrecon
Fusion是一门新兴编程语言,核心价值在于让开发者用单一代码库生成 C、C++、C#、D、Java、JavaScript、Python、Swift、TypeScript 和 OpenCL C 十种语言的库代码。示例「Hello, world」库只需写一次,用 fut 工具即可导出到所有目标语言。生成代码轻量(无 VM、无仿真、无依赖)、可读性强,适配目标语言的命名规范和文档注释风格。与同样定位跨语言的 Haxe 不同,Fusion 专注于库级别的组件复用而非整应用开发。社区主要质疑集中在调试机制——现有评论者担忧需在某一目标语言中调试后再反向适配;Rust 未被列入目标语言也引发讨论;此外通用语言难以针对特定语言做优化是该模式的本质挑战。

评论精华

  • 调试问题突出:需选定一种目标语言调试后再反向适配到 Fusion 源码,这与 Haxe/Monkey 的调试痛点类似
  • 与 Haxe 对比:Haxe 专注游戏且无法 targeting OpenCL,Fusion 则面向库组件,设计目标不同
  • 使用场景明确:ORM、Protocol Buffers 等跨平台数据描述场景,以及需在多语言环境中保持逻辑一致的算法库
  • 质疑实用性:通用语言难以针对特定语言优化,Rust 未被支持,真实需求场景尚不清晰
  • 跨语言绑定方案:有评论认为 Fusion 可同时生成库和绑定代码,C 语言跨语言调用的 ergonomics 问题或可缓解
No.08 MicroVMs: Run isolated sandboxes with full lifecycle control
AWS Lambda 推出 MicroVMs:虚拟机级隔离的按需沙箱执行环境
318 分 184 条评论 作者: justincormack
AWS 正式推出 Lambda MicroVMs,一种基于 Firecracker 虚拟化技术的新型无服务器计算原语,专为运行用户或 AI 生成代码的隔离有状态执行环境而设计。核心特性包括:虚拟机级隔离(无共享内核)、从预初始化快照实现近乎即时的启动和恢复、以及最长 8 小时的有状态会话(支持自动暂停/恢复)。每个终端用户或会话获得独立 MicroVM,环境状态在暂停后完整保留,恢复时对客户端透明。AWS 宣称该技术源自支撑每月超过 15 万亿次 Lambda 调用的同一底层技术,旨在填补容器启动快但隔离弱、传统 VM 隔离强但启动慢、以及 Lambda 函数不适合长会话交互之间的市场空白。

评论精华

  • 市场上已存在大量沙箱提供商(Daytona、E2B、Modal 等),AWS 并非唯一选择
  • 8 小时运行时上限引发争议,有用户认为不适合作为长生命周期开发环境
  • 成本效益存疑:自托管 Firecracker 或使用 Railway 等竞品可能更经济
  • Firecracker 内存回收存在问题,8 小时限制可能与此技术债务有关
  • Google Cloud Run 第二代实例类型已采用类似微虚拟机架构,提供竞争替代方案
No.09 Show HN: Hacker News on a train station-style flip board
展示: Hacker News 火车站翻转公告牌式网页
62 分 11 条评论 作者: PaybackTony
开发者 PaybackTony 将 Hacker News 热门榜单以火车站 split-flap 分屏翻转板的形式呈现,顶部显示当前 #1 故事,下方以「排名·分数·标题」格式展示 Top 20,每行可点击固定自定义文本。内置设置面板可调节翻页节奏、开关音效及全屏显示,并提供 Token 允许用户通过脚本、CRON 或 Webhook 向云端广播当前排名。该项目使用 Quickish Cloud Function 定时抓取 HN 首页并同步至所有在线看板。评论区有用户反馈被 CloudFlare 限流,作者随后修复了移动端并恢复服务。

评论精华

  • 第一条标题可读,其余文字和数字呈故障风格,效果酷炫
  • 有用户期待能看到实物 Arduino 版本,网页实现已算有趣
  • 上线 1 小时遭遇 3 万访问,CloudFlare 触发限流,作者已修复
  • 提及布拉格火车站有使用废弃 Pragotron 翻卡制作的实体装置
  • 评论者认出这种深色发光等宽字体的设计风格
No.10 Hellishly Slow Level 13 Deflate Compression
地狱级慢速:Level 13 DEFLATE 压缩优化
48 分 11 条评论 作者: zX41ZdbW
本文介绍了 libdeflate 压缩库中 Level 13 级别的实现——一个刻意追求极限压缩但牺牲编码速度的实用主义方案。Level 13 在标准 DEFLATE 格式内通过更深入的解析搜索、更多优化轮次(最多 15 轮)和延迟块分割策略来榨取压缩率。在 Silesia 语料上比最强的实用级别 Level 12 节省 86,990 字节(约 0.134%),但运行时间增加 56.4 倍。由于 DEFLATE 解码器已广泛部署于 HTTP、ZIP、PNG 等场景,这种编码端的一次性额外投入在「压缩一次、分发多次」场景下具有经济价值。文章采用零压缩回归策略开发,确保每个优化都不导致任何文件变大。有评论类比 x264 的 placebo 设置,也有人指出 DEFLATE 作为不对称算法的本质——解压完全不受影响。

评论精华

  • zopfli 和 ECT 等工具可实现更极端的压缩权衡,是本文方案的前辈
  • 评论者欣赏这种以时间换空间的 tradeoff 探讨,并期待经济学视角分析
  • DEFLATE 压缩与解压完全不对称,解压速度和时间不受影响
  • 类比 FFmpeg x264 的 placebo 编码档次,均为以极高代价换微小收益
  • 有评论者正在探索神经网络压缩器和编码组合,压缩率可达传统压缩器一半
No.11 Anatomy of a Failed (Nation-State?) Attack
深入分析:一起失败的疑似国家级攻击
37 分 7 条评论 作者: signa11
安全研究人员披露了一起精心策划的供应链攻击。攻击者伪装成新加坡DeFi投资机构「Lua Ventures」代表,通过数周邮件往来建立信任后,以「技术面试」名义向目标交付一个名为「Ticket Harbor」的票务系统代码库。该仓库实际藏有三层混淆的远程控制木马PinpinRAT,利用patch-package机制在TypeScript编译器中注入恶意代码——在typescript+5.9.2.patch文件顶部注入base64+XOR编码的加载器,每次运行tsc或构建命令即触发。木马采用RSA-2048密钥交换和AES-256-CBC加密通信,支持文件读写、进程spawn、凭证窃取和DNS隧道等指令。C2服务器地址为89.124.107.161:80,Windows被控后会创建名为「PinpinWrap」的计划任务。攻击链包含自删除机制(三层清理),展示了专业级攻击组织的特征。VirusTotal上所有杀软均未检出。作者已向加拿大相关机构报告,并警告所有在Rust/crates.io社区收到类似「面试邀请」的开发者立即断网并重置凭证。

评论精华

  • 安全培训从业者认为开发者需警惕日常工具链和供应链中的社工风险
  • 资深用户指出这类攻击手法已存在多年,自己也曾两度中招
  • 有评论认为LLM已让钓鱼攻击变得异常逼真且危害更大
  • 部分观点质疑攻击描述的可信度
  • 也有人欣赏作者的黑客式分析风格,认为这种风格不应被排斥
No.12 SCC Technical Assistance Program
免费改装实战:如何不花钱让家用车跑进14秒
12 分 1 条评论 作者: luu
本文是《Sport Compact Car》杂志技术援助计划的开篇。一名读者「Scared to Race」因把预算全花在外观改装(空气套件、珍珠漆、降低车身、轮毂)上,导致他那台搭载SR20DE发动机的2001款日产Sentra SE无力对抗朋友的涡轮MX-6,面临被「暴揍」的风险,且预算为零。杂志派出工程师团队分六步进行免费改装:将19英寸轮毂换回15英寸(减重52磅,0.3秒提升);拆除内饰所有部件包括顶棚、地毯、仪表台等(减重273磅,0.5秒提升);移除排气管、改造进气、拆除空调/发电机/大灯等「寄生负载」;最后甚至拆掉翼子板、车门、引擎盖、行李箱,将整备质量压到1904磅,0-60mph从8.6秒降至6.3秒,四分之一英里从16.3秒降至14.7秒。整篇文章以戏谑夸张的风格呈现技术改装过程,强调「外观党」的代价与零预算改装的可能性。
No.13 Linux on Older Hardware: The Complete Revival Guide
旧电脑复活指南:2026 年 Linux 轻量系统完整攻略
5 分 0 条评论 作者: tapanjk
本文指出全球每年约 6200 万吨电子垃圾中包含大量仍可正常使用的硬件,这些机器并非真的变慢,而是 Windows 越来越臃肿——Ubuntu Xfce 空闲仅占 650MB 内存,Windows 11 则需 3 到 4GB。文章按内存分区给出发行版推荐:2GB 以下选 antiX 或 Puppy Linux;2 到 4GB 首选 Lubuntu 或 Linux Lite 8.0;4GB 以上则可用 Xubuntu 或 Linux Mint Xfce。桌面环境方面,Xfce 定制深度最优,LXQt 最轻量但上限低,MATE 居中。文章还介绍了三项通用优化:zram 压缩内存交换、调整 swappiness 降低磁盘写入、以及服务裁剪。2026 年 BunsenLabs Carbon、Xubuntu 26.04 LTS 和 Linux Lite 8.0 三个重要版本均证明轻量 Linux 并非小众需求。
No.14 U.S. government will decide who gets to use GPT-5.6
美国政府将决定谁有权使用 GPT-5.6
991 分 1043 条评论 作者: alain94040
OpenAI 宣布其最新 GPT-5.6 Sol 模型将仅向经美国政府批准的组织开放,普通个人用户无法访问。此举引发社区对「监管俘获」的强烈担忧:政府审批机制将形成壁垒,阻止新进入者竞争,只有大型既有企业能获益并定价,这将扼杀 AI 领域创新。评论者还指出此举将加速开源模型发展,并可能促使非美国用户转向中国模型,使美国技术领导地位长期受损。

评论精华

  • 「监管俘获」实锤:政府审批只让大公司受益,新玩家无法进入市场
  • 加速开源替代:限制访问反而推动全球开发者转向开放权重模型
  • 非美国用户被迫留守旧版,恐将依赖中国模型
  • 历史重演:如同当年加密软件出口管制,只会让美国失去国际市场
  • 政府干预不可避免,但当前方式只会损害美国 AI 长期竞争力
No.15 Show HN: DBOSify – Drop-in Temporal replacement built on Postgres
展示: DBOSify – 基于 Postgres 的无缝 Temporal 替代方案
56 分 8 条评论 作者: KraftyOne
DBOSify 是一个基于 Postgres 构建的工作流编排项目,声称可作为 Temporal 的替代方案。核心特点是无需额外部署协调节点(coordination node),仅依靠应用服务器中的嵌入式 worker 和数据库即可运行,这与 Temporal 自建服务器前端的架构形成对比。评论者 clarif 质疑其定位——究竟是替代 Temporal 整体,还是仅替代 Temporal Python SDK;前 Temporal 员工 swyx 则认为其设计比 Temporal 实际 worker 更简单。lelandbatey 指出 DBOS 的设计理念就是不依赖协调节点,只有 worker 和 DB。该项目用 Python 实现,通过在应用服务器中嵌入 worker 来实现工作流管理,降低了基础设施复杂度,但社区对其实际生产可用性和功能完整性仍存疑问。

评论精华

  • clarif 质疑项目定位:自称替代 Temporal,但仓库描述只说替代 Temporal Python 客户端 SDK,定义不够清晰
  • swyx(Temporal 前员工)认为 DBOSify worker 比 Temporal 实际 worker 更简单,架构上完全不同
  • lelandbatey 解释 DBOS 设计理念:无协调节点,只有 worker 和 DB,与 Temporal 有本质区别
  • lmz 认为「无需基础设施」是相对 Temporal 自建服务器而言的对比表述
  • raykyri 询问是否有完整的 agent 工作流示例,暗示对实际落地场景的兴趣
No.16 Om
追忆 Om Malik:科技媒体界失去了一位真诚的朋友
332 分 15 条评论 作者: throw0101a
John Gruber 撰文悼念二十年挚友、知名科技记者 Om Malik。Om 于两日前因心脏病逝世,享年约 52 岁。他曾是 GigaOm 创始人,以 24 小时不间断博客写作闻名,但在 2008 年心脏病发作后彻底改变生活方式,从快节奏博主转型为深度评论作家。2014 年他离开新闻业加入 True Ventures 做投资人,但从未停止写作——直到生命最后几周,他仍在 ICU 病床上创作。Gruber 赞其「没有一丝虚伪」,既能以诚挚温暖朋友,又以尖锐精准著称。他热爱洋基队、咖啡、精美手表和摄影,「他的存在让每个房间都变得更好」。

评论精华

  • 「他临终时仍在创作,而非等待死亡」—— Dylan 的诗句被引用来形容 Om 的生命态度
  • 许多读者表示这篇文章令他们落泪,是难得一见的真挚悼文
  • 有人提到 Om 五月曾发表过一篇深刻的文章,当时并不知他已在 ICU 中完成
  • 引用印度诗人 Kabir 的对句:当生时世界笑你哭,当死时你笑世界哭——契合全文情感
  • 另有帖子汇集了更多关于 Om 的轶事与讨论
No.17 We can still stop California's 3D printer surveillance scheme
请阻止加州的三维打印监控方案
374 分 124 条评论 作者: hn_acker
美国电子前哨基金会(EFF)警告加州立法机构撤回 AB 2047 法案。该法案要求在三维打印机中嵌入审查和监控软件,以防止无证制造枪支。EFF 指出:法案的核心问题无法通过修订解决——监控技术根本不可能有效运作,既会误拦合法打印,也无法阻止真正有意者绕过限制。更严重的是,法案将言论审查、企业监控和开源实验criminalize合法化。已通过的修订虽移除了转售刑责、为好莱坞商业用户提供豁免,但仅是削减企业阻力之举,普通消费者、独立创作者和开源社区仍受侵害。EFF 呼吁加州参议员投票反对这一无效且侵犯隐私的法案。

评论精华

  • 多位评论者认为此法案是针对计算技术的协同攻击之一,与操作系统年龄验证、加密限制等政策并列。
  • 有人讽刺加州地图轮廓本身就像 AR-15 手枪握把,质疑审查软件可能连州图案都误拦。
  • 评论者担忧执法方式模糊——固件校验、SD 卡扫描如何实际执行存疑。
  • 有用户指出这类似前苏联对打字机、传真机的管控,反映对技术控制的系统性担忧。
  • 也有用户认为,既然加州已有无证制枪禁令,该三维打印监控法案纯属多余,实质是政治作秀。
No.18 The gap between open weights LLMs and closed source LLMs
开放权重LLM与闭源LLM的差距正在缩小吗?
188 分 158 条评论 作者: kkm
作者通过Artificial Analysis的18个基准测试,分析开放权重LLM与闭源LLM的性能差距。单一基准(Intelligence Index)显示2024年夏季以来差距持续缩小,线性外推显示约在2026年12月追平。但对全部18个基准取平均后,差距基本保持在5个月左右,几乎没有变化。编码基准改善最显著(从落后15个月缩至1-2个月),而多数基准改善有限。作者指出LLM质量衡量存在根本困难——不同测量方式会给出截然不同的结论:要么开源末日即将到来,要么开源始终落后5个月且可能扩大。文章还暗示闭源模型厂商可能在基准测试上有「作弊」空间。

评论精华

  • 闭源模型本质是完整系统而非单纯权重,可在基准测试上做针对性优化
  • 开放权重模型的优势在于能力一旦开源就永远无法被收回
  • 中国DeepSeek等已在效率优化上展现真实创新能力,不只是蒸馏模仿
  • 多数实际应用中用户几乎感知不到闭源与开放模型的能力差异
  • 基准差距衡量存在统计陷阱,按计算效率来看差距实际已闭合
No.19 AI in mathematics is forcing big questions
AI进军数学界:研究者被迫回答根本问题
108 分 78 条评论 作者: rbanffy
本文探讨AI如何逐步渗透纯数学研究。从1976年四色定理的计算机辅助证明,到2024年Google DeepMind的Aletheia自主产出Ph.D.级成果、OpenAI系统证伪组合几何重要猜想,AI数学能力已从「随机鹦鹉」进化为能独立解决奥数金牌级别问题的推理机器。更关键的是,大语言模型正与Lean等证明助手结合,将人类直觉证明自动形式化,绕过传统缓慢的数学探究流程。文章引发核心追问:当AI能直接给出证明,数学家数百年来的「理解之旅」还有意义吗?人类是否会沦为「神谕祭司」——只负责提问而不真正理解?社区对此争论激烈,涉及证明可验证性、知识垄断、AI能否真正「理解」等根本问题。

评论精华

  • 即使代码能跑,你仍需理解才能评估AI生成的证明是否正确—— Terence Tao级别的数学家才能判断LLM何时对何时错
  • 证明助手(如Lean)若能编译通过,即代表证明正确,但你仍需确保定理陈述本身符合意图
  • 数学之美在于人类对公理和定理的选择——证明能否被理解,这本身具有本质价值
  • AI的主要用途在于搜索步骤而非验证步骤,搜索才是创造力的核心所在
  • 部分评论者担忧知识集中化:普通数学家可能越来越依赖少数人才能操作的AI工具
No.20 Building apps using TanStack Start
使用 TanStack Start 构建应用
12 分 0 条评论 作者: nadis
Lovable.dev 宣布自 5 月 13 日起,新项目全面迁移至 TanStack Start 框架。原有架构为 React + Vite 单页应用(SPA),以客户端渲染(CSR)部署为静态文件,缺陷明显:爬虫需等待 JS 执行(约 10 秒中位数延迟,部分爬虫完全不执行 JS),社交媒体预览也因无法读取 CSR 的空 HTML 而失效。TanStack Start 是 TanStack 团队推出的全栈 React 框架,支持 SSR、静态站点生成(SSG)和按路由混合渲染,其核心是 createServerFn 机制:服务端逻辑可直接写在组件文件内,构建时自动拆分客户端与服务端bundle,原需独立部署的边缘函数现可与组件共存于同一文件,一同部署为边缘 Worker。此外,VITE_ 前缀的变量暴露至客户端,其余均为服务端仅限,且 secret 在运行时以 binding 方式注入、随时可轮换无需重新构建。Lovable 还与 TanStack 团队合作,针对 TanStack Start 最新 API 规范对 AI 模型进行了专项训练,确保代码生成符合最新约定。
No.21 Ultrasound imaging of the brain
超声波脑成像技术:通过颅骨的高分辨率神经血管影像
271 分 111 条评论 作者: rossant
Aleph Neuro 发布其超声波脑成像技术的最新进展。该技术利用神经血管耦合原理——神经元放电时血液流向增加——通过超声穿透颅骨并散射红细胞来绘制脑部血管 map。与需要开颅植入电极或仅能获取模糊信号的 EEG/MEG 不同,此方法可产生百万像素级、亚毫米分辨率的全脑图像。研究团队展示了首张通过完整颅骨获取的活体人类脑部 3D 血管图像,分辨率较 CT 提升 100 倍。技术采用硫六氟化物微泡造影剂(FDA 已批准),通过稀疏注入克服衍射极限实现超分辨率。设备成本约 4000 美元,远低于 MRI。最终目标是无造影剂的神经血管成像,借助 AI 从海量原始数据中提取更弱信号。评论中有人质疑超声波穿透颅骨的能力,也有人指出低剂量超声仍可能对脑组织产生 ultrastructural 影响;此外「读心」技术的隐私和伦理风险也引发担忧。

评论精华

  • 技术可行性:有评论者解释超声波可经颞骨等薄部位穿透颅骨,并非不可行。
  • 安全性担忧:有评论指出即使低剂量超声也会对脑组织产生 ultrastructural 变化,尤其影响髓鞘的郎飞结。
  • 医疗应用价值:评论认为该设备成本约 4000 美元,可快速诊断中风等疾病,在发展中国家具有救命潜力。
  • 隐私与伦理风险:有评论指出此类「读心」技术可能终结人类隐私,在非民主体制下后果尤为 dystopian。
  • 与 Midjourney 的关联:有评论揭示该团队与 Midjourney 存在合作关系,引发外界对技术实际用途的质疑。
No.22 A C++ implementation of a fast hash map and hash set using hopscotch hashing
展示: 基于跳房子哈希的高性能 C++ 哈希表与哈希集实现
89 分 15 条评论 作者: gjvc
本文介绍了一个使用跳房子哈希(hopscotch hashing)算法实现的 C++ 高性能哈希映射与哈希集合库。该算法结合了链地址法与开放寻址法的优点,通过限制冲突 key 的最大探测距离来保证 O(1) 期望查找时间,同时保持较高的空间利用率。评论指出,当前业界已普遍转向 boost::unordered_flat_set 搭配 rapidhash 等更快的哈希函数组合,原有 benchmark 已显陈旧(2019 年后未更新)。多位评论者提及 robin hood 哈希与跳房子哈希在性能曲线高度接近,而 google::dense_hash_map 在 benchmark 图中表现最优。

评论精华

  • nly 推荐使用 boost::unordered_flat_set 配合 rapidhash,认为 GNU 标准库的 murmurhash 实现过于缓慢
  • jll29 指出 google::dense_hash_map 在 benchmark 中-runtime 最低,速度优于该实现
  • teo_zero 认为跳房子哈希与 robin hood 哈希原理相近,性能曲线几乎重叠,robin hood 更广为人知
  • jeffbee 提供更近期的 benchmark 链接,但指出其缺少新版 Boost 性能数据
  • compiler-guy 与 mgaunard 围绕旧 benchmark 讨论,指出 boost::unordered_flat_map 在 2016 年时尚未存在
No.23 Foreign funds help make housing unaffordable: research
研究:外国资金并非美国房价上涨主因,供应弹性不足才是关键
65 分 17 条评论 作者: hhs
德克萨斯大学麦Combs商学院研究发现,2010年代外国资金涌入推高了美国房价——外籍买家集中地区房价平均高6.7%,但住房供应仅增长1%。然而该研究更重要的发现是供应弹性严重不足:全国房价每上涨1%,仅带来0.26%的供应增长。旧金山供应弹性仅0.06%(需求反映为涨价),而夏洛特则较高(需求反映为增量)。研究者指出,城市通过区划和许可管理控制着供应灵敏度这一关键变量,巴尔的摩正是通过改革许可流程提升了市场弹性。

评论精华

  • 头条过于强调外国资金,实际上研究核心是供应弹性不足与地方区划政策
  • 任何类型资金流入供应受限的市场都会推高房价,外国资金并非特例
  • 美国住房还承担着洗钱和投资移民功能,这是全球性问题
  • 旧金山约10-15%住房空置,但解决空置问题的政策争议很大
  • 住房供应受限时成为价值储存品,开征空置税是评论者最常提到的解决方案
No.24 Show HN: Smart model routing directly in Claude, Codex and Cursor
WorkWeave Router:在 Claude Code、Codex 和 Cursor 中实现智能模型路由
166 分 96 条评论 作者: adchurch
WorkWeave 开源了一款智能模型路由工具,可在编程工具内根据任务复杂度自动选择最合适的 AI 模型(Claude、Codex、DeepSeek 等),声称能以更低成本保持同等的代码质量和开发速度。核心机制是由一个专门的路由模型学习判断何种任务该交给哪个模型,并通过「任务成功奖励」机制不断优化选择。开发者强调系统已考虑缓存问题——一旦某模型开始处理任务并积累缓存,切换到其他模型的门槛会相应提高,以避免频繁 cache miss 带来的额外开销。评论区的批评主要集中在:路由导致缓存失效可能抵消节省、缺乏 A/B 测试数据支撑、隐私风险、以及大模型厂商未必有动力做这件事(Anthropic 不太可能主动把 Claude 流量路由到 DeepSeek)。也有用户指出 Cursor 已内置类似子代理路由功能,项目差异化优势尚不明显。

评论精华

  • 缓存失效是最大痛点:路由导致 cache miss(5 分钟 TTL),可能反而比单模型更费钱
  • 质量声称缺乏数据支撑,有用户要求看 A/B 测试证据,开发者称「效率提升且 bug 未增加」但未提供细节
  • Cursor 已内置子代理路由(Composer 2.5),项目差异化有限,开发者承认这是「最易实现的突破点」
  • 隐私顾虑:使用第三方路由意味着提示词和代码会流经外部服务,数据安全和合规问题未解答
  • 大模型厂商自建路由的动力存疑——Anthropic 没有理由把流量引向 DeepSeek(成本仅其 20%)
No.25 What Is a Nomogram and Why Would It Interest Me?
什么是列线图(Nomogram)?为何值得关注
111 分 19 条评论 作者: Eridanus2
列线图是一种利用直线辅助从图表上读取公式计算结果的图形化计算工具,1880 年由法国工程师菲贝尔·莫里斯·多卡尼(Philbert Maurice d'Ocagne)发明,曾广泛用于工程计算。文章介绍了其原理:几个刻度尺平行排列,已知变量用直尺对齐后即可读出未知变量;并展示了滑块曲柄机构的复杂公式应用例子,证明了列线图能求解隐式变量。列线图历史上应用于铁路土方计算、水利设计、医学生理学、弹道学、机器加工、统计分析、军事等领域。文章还提及 PyNomo 开源工具可生成各类列线图 PDF。评论补充了史密斯图(Smith chart)这一电气工程常见列线图、贝叶斯定理列线图在医学诊断中的实际应用,以及美国海军核反应堆化学控制仍在使用列线图等内容。

评论精华

  • Smith chart 是电气工程师最熟悉的列线图,与电磁学课程教学质量密切相关
  • 贝叶斯定理列线图被认为是从业者必知的重要工具,可实现闭眼心算
  • PyNomo 开源项目可用 Python 从任意公式生成 PDF 列线图,贷款月供计算是经典例子
  • 对数形式的列线图能让朴素贝叶斯分类器变得可解释,甚至可为连续值添加密度分布
  • 美国海军仍使用列线图进行核反应堆化学控制,说明其在高可靠性场景的独特价值
No.26 Hightouch (YC S19) Is Hiring
Hightouch(Y Combinator S19)招聘多个岗位
1 分 0 条评论 作者: joshwget
Hightouch是一家处于D轮融资阶段的数据同步初创公司,获得顶级投资机构支持,正在大规模招聘。公司强调「永远饥饿」的价值观,倡导高增长心态(如认为能增长5倍时,应问「为何不能10倍」),同时重视善良、高效执行、同理心、影响力驱动和谦逊等文化。福利方面提供有竞争力的薪酬和股权、美国员工100%健康保险覆盖、80%家属覆盖、每月100美元健康津贴、灵活PTO政策(美国育儿假16周/12周),以及远程友好的工作环境。招聘岗位覆盖技术类(软件工程师、AI代理、数据科学、机器学习负责人等)、销售类(企业级、中端市场各级销售)和客户成功类(技术客户经理、解决方案工程师等),多数岗位支持全球远程工作。Hightouch曾被《福布斯》评为美国最佳创业雇主之一。
No.27 Pre-Modern Armies for Worldbuilders, Part III: Paying for It
给世界观构建者的前现代军队指南(三):如何供养军队
92 分 16 条评论 作者: jfoucher
本文是前现代军队系列第三篇,探讨军队的薪酬与后勤保障。作者指出,现代人习惯用金钱思维,但前现代社会的核心是「实物经济」——即将食物、劳动力从农业部门转移到军事用途。军队最大开支是士兵薪酬(含口粮),其次是船只、城堡、火炮等资本品。缺乏货币化的社会中,统治者往往通过「再分配经济」直接掌控物资:小型社会用「礼物经济」犒赏武士和工匠;大型王国则建立「宫殿经济」,国王或神庙直接拥有土地,臣民以实物缴纳贡赋。这种体系在青铜时代的东地中海地区(埃及、黎凡特、美索不达米亚、迈锡尼希腊)最为典型。

评论精华

  • 读者反映文章极具启发性,对跑团世界观设计帮助很大
  • 有人提出「与其养军队不如直接贿赂敌方」,引发关于Danegeld的历史争论
  • 质疑者认为「雇佣兵的价格必须高于其不参战的机会成本」
  • 反驳指出拜占庭曾成功贿赂匈奴阿提拉长达十年
  • 警告「一旦付钱给军队,军队就可能反过来控制你」
No.28 Long Wave radio era set to end with switch-off
英国长波广播时代终结:BBC 瓦克斯伯恩发射塔将关闭
79 分 33 条评论 作者: speckx
BBC 长波广播服务于周六凌晨正式停播,位于伍斯特郡的 213 米高瓦克斯伯恩发射塔(建于 1934 年)将停止发射。该发射塔耗资 20 万英镑(约今 2000 万英镑)建造,二战期间曾用于干扰德军雷达并向法国抵抗组织传递情报,参与了诺曼底登陆的通讯协调。BBC 表示因设备老化、听众锐减且升级成本过高,放弃维护该服务。当地历史专家与「二十世纪协会」正推动将发射塔列为历史遗产保护建筑,但 Historic England 此前以大部分原建筑已拆除为由拒绝。目前已有遗留文物在地区遗产中心展出,运营方 Arqiva 尚未回应未来规划。

评论精华

  • goodthenandnow 指出该发射塔据称是英国核潜艇在战争状态下评估国家状态的信号源之一
  • mschuster91 透露该发射塔额定传输功率 500 千瓦,电网输入可能超过 1 兆瓦
  • nickcw 说明该塔最初以精确的 200 kHz 发射,1988 年调整为 198 kHz 以与欧洲电台协调
  • jimnotgym 怀念长波几乎无处不在的覆盖能力,DAB 在同一地区频繁中断
  • RachelF 警告长波作为互联网瘫痪时的全球通讯备份具有战略价值,真空管不受核电磁脉冲影响
No.29 A Tiny Compiler for Data-Parallel Kernels
展示:我为数据并行内核写的小型编译器
40 分 4 条评论 作者: healeycodes
作者为理解编译器如何将普通循环转换为并行执行形式,手写了一个约180行Python代码的小型编译器。核心思想是将普通for循环降级(lower)为vector_for循环,让多个循环迭代可并行执行。编译器通过分析每个值是uniform(所有lane相同)还是varying(各lane不同)来决定如何生成代码:uniform值如常量可跨lane共享,varying值如索引需逐lane计算。当数据长度不整除lane数时,用mask掩码跳过越界的load/store。转换后的代码显式标注了哪些是连续读取(masked_load)、哪些是分散读取(gather),便于后续代码生成阶段直接发射SIMD等高效指令。作者承认这是教学用的toy实现,未处理复杂依赖分析、别名、类型等问题。

评论精华

  • 向量化和依赖分析是编译器研究的重要方向,需分析循环携带的依赖才能向量化非平凡循环
  • Eigen库通过模板元编程链式操作线性代数,可让编译器优化内存布局和向量指令
  • 作者自承算法是简化示例toy,主要用于解释基础降级过程
  • Allan和Kennedy的著作涉及将命令式代码向量化的理论与实践
No.30 Making Sense of Proof by Contradiction [pdf]
理解反证法
35 分 15 条评论 作者: surprisetalk
本文探讨反证法(proof by contradiction)的逻辑本质与正确理解方式。文章指出,许多人将「证明逆否命题」误当作反证法,实际的反证法是:假设¬P成立,经过推导得出矛盾(如0=1),从而断言P为真。评论中的核心争议在于「排中律」(tertium non datur)与「归谬法」(reductio ad absurdum)的区别——前者指「A为真或A为假,别无他选」,后者指「假设某事实导致荒谬」。在构造主义逻辑中,反证法仅适用于证明否定命题(¬P本质上是P⇒False的语法糖)。有评论指出,Andrej Bauer在2010年与Timothy Gowers的讨论中厘清了这一术语的现代用法,但多数数学家沿用了更宽泛的传统定义。

评论精华

  • 数学家与逻辑学家对反证法的理解存在系统性差异,常见讨论常偏离要点
  • 排中律是反证法的隐含基础——若否认排中律,反证法的有效性将受质疑
  • 「证明否定¬P」不等于反证法,只是证明否定的标准方式;真正的反证法需从假设¬P导出矛盾来证明P
  • 构造逻辑中反证法只对否定命题有效,证明肯定命题(如∃x P(x))不可用此法
  • 「证明P则假设¬P导出矛盾」这一定义由Andrej Bauer于2010年明确提出,而非传统数学界通用用法