2026年06月29日 · 星期一 第 160021 期

The Hacker Daily

丙午年(马)五月十五

30 篇文章 · 3349 条评论 ·聚焦:AI编程工具 · 电网与数据中心 · 开源系统替代
No.01 HackerRank open sourced its ATS. My resume scored 90/100. Oh wait 74. No – 88
HackerRank 开源 ATS 评测:我用同一份简历跑了 100 次,分数从 66 到 99 不等
294 分 89 条评论 作者: sambellll
作者测试了 HackerRank 开源的 ATS 系统,发现同一份简历、同一命令运行多次,分数竟在 66 至 99 之间剧烈波动——若公司划线 85 分,65% 的概率会被误杀。该系统先用 LLM 从 PDF 中提取结构化信息,再综合打分(开源贡献 35 分、项目 30 分、工作经历 25 分、技能 10 分,外加最多 20 分加分项)。分析发现:技术技能评分高度稳定(因为是勾选清单),但项目评分极不稳定——LLM 对「项目是否缺乏架构复杂性」这类判断无法保持一致;经验评分虽然每轮都是 25/25,但评分标准只有两行字、没有锚定示例,导致初级实习和十年架构专家同分。更换更强模型(Gemini)后分布收窄(48-64),但依然存在 28% 随机落选率。作者指出:LLM 擅长解析结构和核查清单,但无法可靠地评估「这份经历值 18 分还是 24 分」这类主观判断——本质上只是随机「氛围检查」。此外,65% 权重压在开源与项目上,歧视了大量未将作品公开 GitHub 的优秀工程师。作者警告:无法区分候选人的 AI 筛选工具实质只是随机过滤,建议工程团队慎重对待此类系统。

评论精华

  • 许多人不理解 LLM 本质上是随机过程,同一输入产生不同输出是正常现象,此类深度分析文章有助于提高认知。
  • 用 LLM 做相对比较(两份简历孰优)可能比绝对评分更可靠,但两两比较数量随简历数量平方增长,需权衡。
  • 几乎所有 ATS 都在加入 AI 自动排序功能,这种随机过滤并非 HackerRank 独有,问题根源在于行业对 AI 筛选的滥用。
  • 该系统实际上在筛选「愿意在业余时间做开源的人」——本质上是将加班文化编码进筛选标准,涉嫌歧视有其他生活方式的工程师。
  • 更强模型(Gemini)虽然分数分布更集中,但仍未解决根本问题:评分标准本身缺乏锚定示例,LLM 无法给出稳定的主观判断。
No.02 GLM 5.2 beats Claude in our benchmarks
Semgrep 测评:GLM 5.2 在 IDOR 漏洞检测中超越 Claude Code
774 分 366 条评论 作者: jms703
Semgrep 团队在 IDOR(不安全直接对象引用)漏洞检测基准测试中发现,智谱 AI 的开源模型 GLM 5.2 以 39% F1 分数超越 Claude Code 的 32%,每发现一个漏洞的成本约 0.17 美元。GLM 5.2 是拥有约 7500 亿总参数(仅 400 亿激活)的 MoE 模型,上下文扩展至 100 万 token,定价约为同类前沿模型的六分之一。文章试图回答「漏洞检测性能有多少来自模型本身、多少来自周围工具链(harness)」的问题——Semgrep 自研的多模态流水线在专用工具链加持下达 53-61% F1,而开源模型仅靠简单 Pydantic AI 框架运行。评论区普遍认为比较不够公平:GLM 没有获得 Semgrep 为其他模型配备的端点发现等脚手架,属于「苹果对橘子」式对比;同时质疑标题夸大、 Opus 4.8 是否被故意弱化、以及开源模型是否真的已追平闭源前沿模型。

评论精华

  • 评论普遍质疑实验公平性:GLM 处于无工具链状态,而 Claude/Opus 使用了专用脚手架,两者不具可比性
  • 硬件需求引发关注:GLM 5.2 达 7530 亿参数,本地运行需要大量显存和内存
  • 标题被批评为误导:GLM 仅在一个特定安全基准上超过 Claude,而非全面超越
  • 用户反馈实际使用体验:GLM 5.2 性价比高(Neuralwatt 每月 3.74 亿 token 仅需 18 美元),但 API 提供商可靠性存疑
  • 社区对基准测试本身提出质疑:各厂商自定义基准难以对比,模型易通过针对性优化「作弊」
No.03 Replacing Systemd with OpenRC in Debian
在 Debian 上用 OpenRC 替换 Systemd
13 分 4 条评论 作者: nogajun
作者分享了在 Debian Testing 上用 OpenRC 替换 Systemd 的实践经历。起因是作者对 systemd 逐渐承担过多职责感到不适——从 init 系统扩展到 bootloader、分区方案、用户管理,再到 age verification 集成和 systemd-sysinstall 安装程序,与 KISS 原则背离。安装过程并不简单:需使用「apt purge --allow-remove-essential systemd」绕过保护机制,配合安装「openrc sysvinit-core」。首次重启后系统启动失败,需进入恢复模式重装 OpenRC。电池状态和音频问题通过将 systemd service 转换为 OpenRC 初始化脚本解决。作者认为实验基本成功,计划继续在个人笔记本上测试,必要时再迁移工作设备。

评论精华

  • systemd 整合 boot loader、分区自动发现、用户管理等功能后,sysinstall 只是必然延伸
  • systemd 急需竞争:它成为底层服务的事实依赖,存在隐私侵犯风险,且使用体验别扭
  • 人们对未来趋势的预见能力和关注程度存在显著差异
No.04 Dissecting Apple's Sparse Image Format (ASIF)
逆向分析苹果新版稀疏磁盘镜像格式 ASIF
46 分 0 条评论 作者: supermatou
本文详细记录了作者对 macOS 26 Tahoe 中引入的 ASIF(Apple Sparse Image Format)稀疏磁盘镜像格式进行逆向工程的过程。ASIF 专为虚拟化框架设计,功能类似 VMDK、VHDX、QCOW2 等现有稀疏格式,可将大容量虚拟磁盘以更小的「稀疏」方式存储。作者先是利用 diskutil 创建测试镜像,用 Python 写入特定测试模式;再通过十六进制分析初步辨认文件魔数和字段布局,发现 header 中包含扇区大小(0x200)以及指向数据区和 XML plist 元数据的偏移量。由于纯十六进制分析变量太多,作者转而搜索相关二进制文件,在 DiskImages2.framework 的 diskimagescontroller 中找到 ASIF 解析代码,并在 IDA 中对关键函数进行反编译,从而精确梳理出 header 各字段的含义及校验规则。文章还穿插了「Research note」,分享了搜索文件魔数、判断字节序、并行对比 ARM/x86 二进制版本等实用逆向技巧。
No.05 Age verification is just a precursor to automated attribution of speech
年龄验证只是言论自动溯源的序曲
358 分 194 条评论 作者: arkhiver
本文指出,美欧澳推出的「年龄验证」法规名为保护儿童,实为构建身份归因系统。执法部门办案需回答「发生了什么」和「是谁做的」两个问题——前者通过社交媒体发帖已基本解决,后者因需要人力调查、 subpoena 平台或追踪 IP,向来耗时费力。年龄验证法规将数字账号与真实身份(SSN、身份证件)绑定,让政府能快速锁定发言者,无论其是否为罪犯。作者认为一旦普及,不利言论或群聊过激者将收到警告函甚至上门拜访,类似当年 ISP 代 RIAA/MPAA 发送的「情书」。文章呼吁不要配合验证,必要时用 Monero 匿名支付。有评论将此与 Cardinal Richelieu 名言「给我六行字,我能找出罪名」类比,也有评论指出这将催生去中心化替代方案,或导致监管重压下的平台格局重组。

评论精华

  • 匿名性消失风险:年龄验证将网络账号与真实身份强制绑定,削弱公民抗辩能力
  • 去中心化呼声:有评论主张建立去中心化平台抵抗政府管控,但被质疑法律禁令下难以规模化
  • 讽刺对比:有评论指出推动年龄验证的政客却免于被追究飞行记录或硬盘问题
  • 技术层面可行:有人指出从技术上可实现匿名与身份解耦,但权力机构无意推进
  • 儿童保护被滥用:历史一再以保护儿童为由限制公民权利,如爱泼斯坦案所示
No.06 Herdr: Agent multiplexer that lives in your terminal
Herdr:终端内的 Agent 多路复用工具
49 分 16 条评论 作者: mzehrer
Herdr 是一款终端内的 Agent 多路复用器,支持多 Agent 协同、远程 SSH 会话和持久化连接。它与 beehive 功能相似,但有用户认为 conductor.build 的体验更优。Herdr 的终端原生设计使其可通过 SSH+Tailscale 在手机上访问,这是其他竞品难以实现的独特优势。评论焦点集中在:是否支持不同 SSH 会话分布运行不同 Agent、远程连接架构、以及 README 缺少截图导致用户难以直观理解产品形态。

评论精华

  • Herdr 与 beehive 功能类似,都提供 Agent 多路复用能力
  • conctor.build 体验更优,终端运行本身并非优势
  • 支持通过 SSH 远程连接和不同会话配置运行 Agent
  • README 缺少截图,用户需访问官网才能理解产品形态
  • 可通过本地 Claude 编排多个远程 VM 上的 Claude 实例
No.07 Lore – Give your coding agent the decisions your team made
Lore – 将团队决策传递给编码代理
27 分 21 条评论 作者: tcballard
Lore 是一个工具,旨在解决编码代理反复推翻团队已做决策的问题。作者指出,团队已在 ADR(架构决策记录)中否决的方案、或需求已明确的内容,代理却常常重新引入。问题不在于上下文不存在,而在于代理无法有效获取和遵守这些决策。Lore 将团队决策持久化,让后续所有变更都必须尊重。其思路与 SDD(规范驱动开发)不同:SDD 管理变更本身,而 Lore 专注维护那些经长期讨论才确立的决策层。对于个人或小团队,直接在 CLAUDE.md 中写几行指令或许足够;但在组织层面, Lore 支持中心化管理规则集、避免分散和漂移,是其核心价值所在。

评论精华

  • 建议工作流:撰写 ADR → 提交 Git → 在 AGENTS.md 中引用,让代理能读到团队决策记录。
  • 与 SDD 的区别:SDD 管理变更流程(规范→任务→交付),Lore 则承载后续所有变更都须遵守的持久决策层。
  • 替代方案如 CLAUDE.md 适合个人或小团队,简单直接,五行指令即可见效。
  • 作者放弃代理层方案(团队级、无需每人安装),理由是组织场景下需中心化管理并能对规则集做 Gatekeeping,才能防止漂移。
  • 类似项目 Nocodo 也在探索用溯源机制解决决策传达问题,但采用了不同的技术路径。
No.08 Historical memory prices 1960-2026
1960-2026年内存价格历史走势:DRAM、HBM与NAND
280 分 101 条评论 作者: vga1
斯坦福DAM项目发布了涵盖1960年至2026年的内存价格数据集,跟踪DRAM、NAND闪存和HBM的每GB单价走势。文章以对数坐标呈现历史最低$/GB,区分了DDR各代际(HBM2e至HBM4),并附有Epoch AI的AI加速器成本拆解。方法论以未调通胀的名义美元记录市面最低零售价。评论区聚焦几个争议:1)图表采用对数尺度且未调通胀,呈现效果偏乐观;2)2025年最新数据点其实多为DDR3老旧型号清理价,实际领先产品并不便宜;3)AI和加密货币加剧了近年来价格波动;4)有用户指出每GB单价忽略了速度提升(DDR每代翻倍)和实际需求增长,纯粹看容量是误导;5)多位用户认为当前DRAM价格实质回归2010年代水平,若调通胀则更差。

评论精华

  • 图表未调通胀且最新数据多为DDR3老旧清理价,实际上领先产品比图表显示的更贵。
  • 以对数坐标呈现价格走势遮蔽了真实幅度,通胀调整后1960-1980年会高得多。
  • 每GB单价忽视了速度随代际翻倍的提升,单纯比容量是误导指标。
  • 当前DRAM价格实质回归2010年水平,若调通胀则相当于更早期的价格。
  • Moore定律趋缓叠加AI/加密货币需求,价格周期已被打破,内存进入新常态。
No.09 5k menus from the New York Public Library’s Buttolph Collection (1880-1920)
NYPL 藏 1880-1920 年间 5000 份餐厅菜单数字馆藏
361 分 92 条评论 作者: xbryanx
Pudding.cool 展示纽约公共图书馆 Buttolph 藏品中 1880 至 1920 年间的约 5000 份历史餐厅菜单,以数据可视化和导览叙事的方式呈现这批数字馆藏。评论者普遍称赞其视觉呈现和信息设计,有人指出芹菜、青龟汤、生蚝等菜品的频繁出现出人意料——芹菜曾是难以栽培的稀有作物,生蚝则因过度捕捞和城市污染已不再是常见前菜。评论区也讨论了菜单形式的演变:传统印刷菜单与当下 QR 码点餐的对比,以及德国以啤酒垫齿痕记录消费量的有趣传统。数据标注由志愿者手工完成并验证于 menus.nypl.org,但亦有用户反馈导航体验和单个菜单分享功能有待改进。

评论精华

  • 网站数据可视化惊艳,但 MacBook 触控板导航不友好,无法直接分享单个菜单
  • 芹菜曾是稀有蔬菜、青龟汤即龟肉、菜单结构百年来变化不大——但 QR 码正取代传统印刷菜单
  • 德国啤酒垫计数文化有趣,客人通过增减垫子示意续杯或停止,修改数量在法律上有约束力
  • 生蚝在高档餐厅仍流行,但过度捕捞和城市污染使其从日常变为奢侈
  • 评论者普遍对历史菜单着迷,视其为日常生活的微小切片,亦有用户推荐 restaurant-ingthroughhistory 等同类博客
No.10 I used Claude Code to get a second opinion on my MRI
我用 Claude Code 给我的 MRI 报告找了份第二意见
415 分 545 条评论 作者: engmarketer
作者因右肩疼痛做 MRI,放射科诊断为「III级肩胛下肌腱部分撕裂」。他随后用 Claude Code(Opus 4.8)分析同一份 MRI,却得出「肌腱完整」的截然不同结论。他又让 AI 担任仲裁者对比两份报告,仲裁结果倾向 AI 的解读。此外,AI 还发现诊所给他做了不当治疗:指南明确反对对无钙化肩袖病使用冲击波治疗,且注射的 Traumeel 在德国注册为顺势疗法药物。作者坦言 AI 与人类诊断差异巨大让他陷入困境——不知该相信谁,最终只能边做康复边观察等待。

评论精华

  • 放射科医生现身说法:LLM 普遍不擅长 MRI 图像分析,有人实测 AI 将 MRI 图像误认为大脑,或在非标准切片上得出错误结论
  • AI 处理图像时并非像人类那样感知,图像会被 tokenize 处理,这从根本上影响诊断可靠性
  • 有读者分享自己被误诊经历,认为 AI 若能指出报告中的矛盾和漏洞,值得重视,应获取真正的人类第二意见
  • 部分网友指出诊所可能过度医疗:肩膀问题常被默认推荐手术,而非优先考虑康复训练
  • 多位用户反映曾用 AI 分析 CT/MRI 图像,部分案例与放射科诊断一致,但更多情况下 AI 出现明显错误或幻觉性描述
No.11 We found a bug in the hyper HTTP library
Cloudflare 发现 hyper HTTP 库中的一个竞态条件 bug
22 分 3 条评论 作者: Pop_-
Cloudflare 的 Images 服务基于 Rust 和 hyper HTTP 库构建。2025 年底,团队将 Images binding 从经过 FL 中介服务的网络连接,改为使用本地 Unix socket 直连,以提升性能并实现独立发布。然而上线后,大图片的响应数据出现截断——应返回 2MB 的图片只收到几百 KB,HTTP 状态码却是 200,且无错误日志。团队花了六周时间追查,最终定位到 hyper 库中的一个竞态条件:hyper 在写入数据时,如果目标缓冲区已满,会等待对方消费数据后继续写入,但这个过程中可能触发 race condition,导致写入不完整即完成。由于截断的数据量(约 200KB)恰好接近生产环境的 socket 缓冲区大小,团队得以可靠复现。最终修复仅需 4 行代码。

评论精华

  • edelbitter 质疑:Cloudflare 为何未能主动发现对外发送截断响应的问题规模这么大
  • logicchains 批评:代码中直接丢弃 poll_read/poll_write/poll_flush 返回值的写法非常糟糕
  • 3form 解释:这可能是因为项目最初为了速度关闭了 linter,后来开启时积压了一万条警告被忽略
No.12 Knowledge Distillation of Black-Box Large Language Models (2024)
黑盒大语言模型的知识蒸馏方法
87 分 14 条评论 作者: babelfish
本文提出 Proxy-KD 方法,通过引入代理模型实现从 GPT-4 等黑盒大语言模型向小模型的高效知识迁移。传统蒸馏受限于无法访问教师模型内部状态,而 Proxy-KD 绕过这一限制。实验表明该方法不仅优于传统黑盒蒸馏,甚至超越部分白盒蒸馏技术,为从先进 LLM 提取知识提供了新思路。HN 评论则揭示了该研究与近期 Anthropic 指控中国实验室「蒸馏」其模型事件的关联,引发地缘政治与 AI 经济安全讨论。

评论精华

  • 有用户指出应标注为 2024 年论文
  • 评论质疑重复发表,暗示与近期争议相关
  • duendefm 提及中国实验室蒸馏美国 AI 模型的地缘政治话题
  • 有人联想到 Anthropic 指控中国实验室的事件
  • 推荐相关论文《Well-Read Students Learn Better》
No.13 Deciphering basmala
解读「Bismillah」:Unicode 阿拉伯语连写字符的迷思
51 分 18 条评论 作者: lordgrenville
文章探讨了阿拉伯语「Bismillah」(بِسْمِ اللَّهِ,意为「奉真主之名」)这个特殊词汇在 Unicode 中的处理方式。核心关注点是 U+FDFD 这个单独的 Unicode 码点,它实际上是一个「展示字符」(presentation character),而非独立字母,其字形宽度在某些字体中可达 10em 之宽。作者通过实测不同字体环境(如 Apple 文本框、Windows 运行对话框、Notepad)下的渲染差异,揭示了一个关键事实:不了解字体就无法正确排版文本——这对声称终端可无视字体layout 文字的说法是一个有力反驳。评论补充指出,iMessage 使用 Noto Nastaliq Urdu 字体渲染该字符,而该字符在阿拉伯语书法中从下往上读但实际书写方向是右下到左上;此外「kashida」(延展符)在阿拉伯语中可能有「maddah」或「tatwil」等不同称呼。

评论精华

  • 阿拉伯语在《古兰经》中达到近乎完美的密度,一位母语者表示阅读经典经文时深感自豪
  • ﷽ 是 U+FDFD 单码点,在不同字体中宽度差异极大,是证明「不了解字体就无法排版」的有力反例
  • iMessage 等应用中该字符采用 Noto Nastaliq Urdu 字体渲染,属于纳斯赫体而非更通用的纳斯赫体风格
  • 阿拉伯语书法的「kashida」延展符在波斯语和阿拉伯语中有不同名称(maddah、tatwil),反映出语言间的术语差异
  • 右手书写阿拉伯语时,手应置于正在书写行的下方,以避免蹭糊已写文字——这是阿拉伯书法入门的基本规矩
No.14 Show HN: Zanagrams
展示:Zanagrams 文字拼图游戏
271 分 61 条评论 作者: pompomsheep
Zanagrams 是一款类 Ribbit 的文字拼图游戏,玩家用一组字母找出所有可拼出的单词。每拼对一个单词,连接线会消失,已使用的字母会被消耗,直至所有字母溶解即通关。游戏包含多个关卡,完成后会显示单词释义,这对非英语母语者很有帮助。核心机制「bonus words」是玩家可能遗漏的额外单词,不影响通关但增加挑战深度。社区评价整体正面,认为 UI 简洁、动画精致、关卡渐进式变容易的设计很出色。但也提出多个改进建议:分数应计入 bonus words 数量并用尝试次数替代时间计时、结果分享应包含 bonus words 统计、缺乏排行榜功能、iOS 端存在误触发双击缩放的问题,以及部分关卡同时出现单复数形式显得「cheap」。

评论精华

  • 游戏机制获好评,但社区建议分数系统应计入 bonus words 数而非计时,以更公平
  • iOS 用户反映频繁误触发双击缩放,且难以恢复,建议修复
  • 多名玩家指出同一关卡同时出现单词单复数形式(如 strokes/stroke),体验不佳
  • 非英语母语玩家认为通关后显示释义的设计增加了学习价值
  • 玩家对 bonus words 定义有争议,有用户认为像「fete」这类常见词不应算 bonus
No.15 Tokenmaxxing is dead, long live tokenmaxxing
Tokenmaxxing已死?Long live Tokenmaxxing
143 分 177 条评论 作者: theahura
本文重新解读企业AI激进消费现象「tokenmaxxing」。作者认为Meta等公司强制员工大量消耗AI token,表面是烧钱乱象,实为打破组织惰性的故意策略——当AI工具补贴消失、API涨价后,原始版tokenmaxxing确实退潮。但作者提出「复合正确性」新范式:此前投入更多token会因复合误差导致更差结果,如今进入新阶段,投入更多token反而提升质量。以Anthropic安全模型Mythos为例,投入更多算力能发现更多漏洞,安全战变成纯粹的token消耗竞赛。这意味着tokenmaxxing并未消亡,只是换了底层逻辑重新登场。

评论精华

  • 作者将tokenmaxxing解读为管理层有意为之,许多评论者认为过于宽容,实为FOMO驱动的从众行为
  • 安全案例显示tokenmaxxing可能是防御必要手段——攻击者投入token挖掘漏洞,防守方必须投入更多
  • 有评论者透露其公司真实要求:6个月内消耗3.5至6万token,并非个案
  • 循环(loop)机制实为重复运行同一prompt直至模型判断任务完成,并非新概念
  • Meta元宇宙投资案例被频繁对比——90亿美元仅获30万用户,人均30万美元,与tokenmaxxing逻辑相通
No.16 The Baffling World of Masayoshi Son's Presentations (2020)
孙正义演讲PPT的荒诞世界
57 分 21 条评论 作者: phaser
本文聚焦软银创始人孙正义那令人困惑的演讲风格。2020年彭博社深度报道揭示了其幻灯片充满怪异隐喻——「鹅没有被估值」「鹅的价值是71」之类毫无逻辑的内容反复出现。评论者普遍将其视为「生存者偏差」的典型案例:孙正义早年凭借投资雅虎和阿里巴巴获得巨大成功(那笔2000万美元回报已达数千倍),但此后决策质量堪忧,包括对WeWork、OYO等公司的灾难性押注。Uber投资是否成功存在争议——有评论指出其回报率其实跑输大盘;也有观点认为资本市场的力量最终让Uber熬过疫情。不过更多人质疑的是:软银为何至今尚未破产?文中还提及孙正义推动监管套利(帮助Uber绕过劳动法规),引发政治层面的批评。

评论精华

  • 孙正义是典型的生存者偏差案例——早年靠运气押中阿里巴巴,此后决策质量一路下滑
  • Uber投资存在争议:虽从疫情中复苏,但对比大盘涨幅其回报率并不突出
  • 软银推动立法为Uber开绿灯、绕过劳动法规,这在美国多州引发政治争议
  • 资本市场最终战胜了出租车行业抵制,Uber证明资本力量可以碾压传统监管
  • 有评论者直接讽刺:「鹅显然装满了金蛋」,暗指软银用夸张概念包装失败投资
No.17 The Forgotten Castles of the Garamantes
撒哈拉深处的失落城堡:加拉曼特斯文明
23 分 2 条评论 作者: bookofjoe
利比亚撒哈拉深处埋藏着一个延续近1600年的古代文明——加拉曼特斯。他们在年均降雨量近乎零的极端沙漠中,利用「foggaras」地下运河系统引取深层化石水,支撑起覆盖费赞地区的城镇与农业。文章详细介绍了包括Gauat、Qasr Al-Manashi、Qasr Tamerah、Qasr Mara在内的多座城堡式建筑,它们既是粮仓、避难所,也是地方权力的象征。首都Germa拥有柱廊神庙和阶梯金字塔墓葬,彰显其城市文明程度。20世纪初卫星影像揭示了这个曾被罗马人贬为「野蛮人」的民族的全貌:100多于座堡垒、数百公里地下水道网络,挑战了世人对沙漠文明认知的边界。

评论精华

  • Baader Meinhof效应:评论者数日内在不同渠道(广播节目与HN)两度偶遇加拉曼特斯文明,说明这一冷门考古发现正在获得关注。
  • 文章结尾「remains unmistakably alive」表述突兀,缺乏上下文解释,评论者质疑此说法可信度。
  • 两位评论者均指出文章信息量有限,考古与历史细节不足,阅读体验偏向文学性叙事而非严谨学术介绍。
No.18 The KIDS Act would require age checks to get online
KIDS Act 法案要求上网前进行年龄验证,EFF 警告隐私与言论自由堪忧
452 分 359 条评论 作者: bilsbie
美国国会拟在一周内投票通过 KIDS Act 法案包,将 KOSA(儿童在线安全法案)修订版与多项互联网管控法案捆绑立法。EFF 指出,虽然 KOSA 表面声称不强制年龄验证,但条款要求平台对「知情或应知」用户为未成年人(13岁以下)或青少年(13-16岁)的情况负责——这种疏忽责任标准极低,平台为避风险必将扩展身份验证至全体用户。年龄估算系统对有色人种、残障及跨性别群体错误率更高。法案还强制平台针对毒品、赌博、酒类等话题制定言论管理政策,压缩青少年讨论合法话题的空间。此外,法案对加密消息和阅后即焚功能保护不完整,可能迫使服务商削弱隐私功能。批评者认为,在多国同步推进此类立法,反映出特殊利益集团的游说影响。

评论精华

  • 该法案被广泛视为大规模监控的幌子,多国同步推进显示有国际游说力量在推动
  • 家长已可通过设备自带家长控制功能保护子女,却未发挥作用,平台家长控制形同虚设
  • 年龄检查本质上就是身份检查,立法者意图让成年人的隐私也一并被侵蚀
  • 有用户指出真正解决社交媒体危害应禁止 Engagement Algorithmic,而非年龄验证
  • 建议由浏览器层面统一提供年龄验证机制,发送证明给服务端,而非各平台各自为政
No.19 1.38 Millimeter Microcontroller
德州仪器发布 1.38 毫米超小型微控制器 MSPM0C1104
4 分 0 条评论 作者: kristianpaul
德州仪器(TI)推出其首款超小型微控制器 MSPM0C1104,尺寸仅 1.38 毫米。该产品属于 TI MSPM0 系列,定位入门级嵌入式应用。与产品配套的还有 StartHub v1.0.0 开发工具,旨在为 TI 嵌入式设备提供独立的软件开发生态系统,支持 CCS、IAR、Keil 及 makefile 等多种开发环境。StartHub 提供引导式体验,帮助开发者快速找到相关代码示例并启动项目。该工具支持 Windows(10/11 64 位)、Linux(Ubuntu 20.04-24.04)及 macOS(13-15 Ventura 至 Sequoia,还列出 MacOS 26 Tahoe)。文章还提供了各平台的详细安装说明,包括离线安装程序的使用建议。暂无该芯片的具体技术规格或定价信息。
No.20 Model Training as Code
模型训练即代码
82 分 14 条评论 作者: peterBlue75
Aleph Alpha 推出 Savanna 模型工厂,将模型训练管道完全用代码实现。传统手动训练存在三大隐患:人工操作易出错、遗忘历史经验(实验结果散落各处)、团队间协作困难导致模型整体表现不佳。MTaC 的核心是将训练流程写成 imperative 代码,实现三大优势:可组合性(函数式抽象、可单独测试子流程)、共识(所有训练配方版本控制、不再需要 Slack 传递数据库路径)和溯源(commit 记录保存决策过程)。配合 trunk-based development,小步快跑、频繁集成,让各团队能独立运行完整流程。文章还暗示这种 capability-based 分解(跨团队负责多语言等能力)将逐步取代按时间阶段分工的传统模式。有读者指出这就是普通的工作流引擎(Airflow 也能做),另有读者认为代码可重放并非模型变强的原因——真正原因是互联网上有海量代码学习素材。

评论精华

  • 「aleph」是希伯来语首字母,数学上用来表示无穷大(Aleph-0 等)
  • 质疑 Savanna 与现有工作流引擎(如 Airflow)并无本质差异,只是为了贴合自己团队的边缘场景
  • 提到 Dwarkesh 的观点:这种模型工厂将成为组织核心,且 RLVR 已大幅提升模型计算机使用能力
  • 有读者认为代码可重放并非模型变强的原因,真正原因是 Stack Overflow、Reddit 等海量社区数据
  • 有读者认为当模型基础架构趋于稳定后,这种工厂模式会更有价值
No.21 Professor denounces mass AI fraud on an exam at Brown
布朗大学教授揭发大规模AI作弊:常春藤联盟史上最大学术丑闻
379 分 506 条评论 作者: geox
布朗大学经济学教授Roberto Serrano发现其课程ECON 1170(数学经济学)的期中考试存在大规模AI作弊,至少50名学生作弊,是布朗乃至整个常春藤联盟已知最大的学术丑闻。期中考试为「带回家闭卷」形式,平均分高达96分(满分100),40人获满分。改卷人员发现答案含有ChatGPT生成的异常段落。Serrano警告学生期末将改为线下,最终59人参加期末,平均分骤降至48分;27名未参考学生中有22人期中考满分。Serrano向校方报告后,校长保持沉默,院长直至他将案件提交学术守则委员会才承认这是「警钟」。Serrano认为学术诚信是高等教育的基石,呼吁公开讨论AI对教育的冲击,并决定下学年取消作业计分和带回家考试。该教授17岁失明,曾在哈佛获得博士学位,是博弈论领域知名学者。

评论精华

  • 游戏理论视角:有评论者指出在所有竞争者都可能使用LLM的情况下,从博弈论角度学生使用AI是最优选择
  • 「带回家闭卷」本身就是陷阱:take-home exam允许任何材料包括AI,本质上是制度设计缺陷而非学生问题
  • ,口语考试才是正道:匈牙利等国的口语面试模式无需担忧AI作弊,学生必须真正理解内容才能回答
  • 管理层才是问题根源:校长沉默、院长拖延说明名校因捐赠者压力不愿处理富家子弟作弊
  • 高等教育文凭正在贬值:学生们把大学当作敲门砖而非求学之地,作弊文化蔓延下学位信号已经失效
No.22 TOP500 at ISC’26: We have a New Number 1 Supercomputer
ISC'26 TOP500出炉:深圳LineShine登顶,中国9年来首次夺魁
105 分 66 条评论 作者: rbanffy
ISC 2026大会上,TOP500榜单迎来新霸主——中国深圳的LineShine超级计算机,以2.198 Exaflops的FP64持续算力跃居榜首,终结了日本Fugaku长达数年的统治。这是9年来中国首次提交TOP500。LineShine采用国产LX2处理器,基于Armv9架构,共304核心、1.55 GHz主频,90个机柜规模,涵盖22000+节点和1300万核心,功耗42.22兆瓦。值得注意的是,该系统不仅LINPACK性能出众,HPCG基准测试同样以22.004 Petaflops夺冠,证明其并非仅擅长特定跑分。意大利能源公司Eni的HPC7系统(El Capitan缩小版)空降第6位,使该国成为欧洲最大算力国。TOP500管理权将从ISC Group移交至ACM SIGHPC,并首次为每次榜单分配DOI编号。评论焦点集中于:TOP500基准是否能反映真实算力、AI巨头为何不提交榜单、禁用部分核心的可能原因,以及该结果对美国政府超算投入的潜在影响。

评论精华

  • TOP500已严重脱离实际计算需求,衡量的并非多数系统的真实瓶颈,榜单意义存疑
  • AI训练集群(如xAI Colossus 2的55万块Blackwell GPU)为何不参评TOP500,引发社区好奇
  • LX2可能采用SMIC 7nm工艺( N+3制程),从1.55GHz主频可推断
  • 每集群禁用2个核心很可能是良率考量,38/40的利用率已达经济最优
  • 中国用国产芯片和互联技术造出此性能系统,对美国芯片出口管制是警醒
No.23 Working around dragons with the Lemote Yeeloong laptop and OpenBSD
龙芯Lemote Yeeloong笔记本与OpenBSD的折腾之旅
108 分 30 条评论 作者: zdw
作者入手了一台 Lemote Yeeloong 笔记本,这是首批使用中国国产龙芯(Godson)处理器的笔记本电脑之一,搭载 64 位 MIPS 架构。文章回顾了龙芯处理器的诞生史:中国在 1986 年启动 863 计划,2001 年中科院计算技术研究所在胡伟武带领下开始研发龙芯,2002 年正式发布 Godson-1。该芯片基于 MIPS II 指令集但删除了专利相关的非对齐内存访问指令,采用 180nm 工艺、266MHz 主频、功耗低于 1 瓦。文章重点描述了作者在这台小众设备上运行 OpenBSD 的种种折腾:从 SD 卡启动、构建浏览器、I/O 端口等硬件兼容问题。评论中关于 RMS 与狗的轶事、Godson「狗剩」代号的中文含义、以及 PS/2 键盘通过 AMD 桥接器连接等技术细节也颇有看点。

评论精华

  • 评论者澄清 RMS(自由软件运动发起人)对狗有恐惧,而非网传拥有宠物狗
  • Godson 中文代号「狗剩」意为「给狗的剩饭」,并非字面理解的「狗食」
  • 有用户表示「没有 BSD 是过时的电脑」,自己至今仍日常使用 Atom N270 上网本
  • PS/2 键盘接口在 MIPS 上实际由 AMD CS5536 PCI-ISA 桥接器提供支持
  • 多位评论者表示这类龙芯笔记本在西方极为罕见且性能孱弱,但有人从荷兰进口商购得并运行过 OpenBSD
No.24 Librepods: AirPods liberated
LibrePods:让 AirPods 挣脱苹果生态桎梏
361 分 124 条评论 作者: rbanffy
LibrePods 是一个开源项目,旨在让 AirPods 在非苹果设备上使用原本仅限苹果生态的专有功能。该项目用 Rust 重写了苹果的专有协议,部分代码由 AI 从 Kotlin 转换而来。评论澄清了一个常见误解:AirPods 本身已支持标准蓝牙,可在任何设备上作为普通耳机使用,LibrePods 实现的是状态同步、压感控制、自适应降噪切换等进阶功能。开发者指出,Play Store 版收费 5 美元,GitHub 开源版免费但需要等待数秒。社区对苹果是否「敌意」存在分歧:有用户认为只是懒得做跨平台支持,有人则欣赏这种逆向工程的极客精神。用户最期待的功能是无限多点连接和多设备无缝切换,而 Android 17 已修复此前需要 root 的蓝牙 bug。

评论精华

  • AirPods 本来就能当普通蓝牙耳机用,LibrePods 实现的是专有协议的高级功能
  • 开发者澄清:Play Store 版收费 5 美元,GitHub 开源版免费但需等待赞助页几秒
  • 用户最期待功能是无限多点连接,目前大多数设备只支持两点连接
  • 社区对苹果是否「敌意」意见分歧,有人认为只是懒于做跨平台支持
  • 部分代码由 AI 将 Kotlin 转换为 Rust,引发关于代码质量的讨论
No.25 US Grid Constraints: Towards 40GW+ of Behind-the-Meter Datacenter by 2028?
美国电网告急:2028年前 BTM 数据中心规模将突破 40GW?
7 分 0 条评论 作者: felixdoerp
AI 计算需求激增正将美国电网推向极限。文章核心论点:①美国电网容量严重滞后,2027年起可用电网余量将转负;②数据中心建设却创纪录——从2026年21GW增至2030年84GW;③在此背景下,BTM(Behind‑The‑Meter)方案将成为最大玩家获取电力的唯一途径,预计2028年起 BT M供电将占新增数据中心一半以上,BTM设备年市场规模( TAM)到2029年突破50GW;④受惠标的并非传统厂商,而是不依赖电网的燃气发电设备供应商如 Bloom Energy、 Bergen Engines、 Wärtsilä 等;⑤文章建立三步论证:电网供给结构性短缺 → 边际买家转向 BTM → 市场格局重塑。
No.26 The Boeing 747 begins its final descent
波音747:一代旗舰客机的告别
182 分 253 条评论 作者: dbl000
本文作者走访亚利桑那州马里纳的Pinal Airpark飞机退役场,追忆即将落幕的波音747传奇。1969年首飞、1970年投入商业服务的747是人类航空工程的里程碑——采用传统制图与计算尺设计,上层驾驶舱成就了标志性的「驼峰」造型,头部货舱门如鲨鱼张嘴般开合;它能搭载490余名乘客与大量货物,以巨轮般的体量与天鹅般的优雅成为史上唯一配称「美丽」的商用客机。747原为波音竞标五角大楼大型军用运输机失败后的应急转民品项目,却意外成就五十年辉煌。作者感叹:随着双发动机飞机燃油效率提升(比747省油约30%),航空公司已逐步淘汰四发动机 jumbo jet;747的退役不仅是一型飞机的终结,更是美国工程卓越时代与冒险精神的终结。文章引发争议:部分读者认为747代表真正的航空黄金时代;也有人反驳当代787等机型同样是工程壮举,且飞行已从精英特权变为大众消费。

评论精华

  • 燃油效率决定命运:双发动机飞机节省30%油耗、ETOPS认证使其能执飞跨洋航线,四发动机客机经济性已无优势
  • 技术与历史价值:747-8在飞行管理系统上有重大升级;747最初是波音竞标C-5军用运输机失利后的过渡产品
  • 同代比较:1969年协和超音速客机、747与阿波罗11号登月同年,堪称美国航空工业巅峰
  • 情感共鸣:许多读者视747为航空黄金时代的象征,Qantas 2020年以QF7474航班告别747并以航迹画LOGO广受赞誉
  • 飞行体验:747是唯一能让乘客在起飞降落时几乎无感的机型,经典上层舱室 Lounge 设计极具魅力
No.27 A way to exclude sensitive files issue still open for OpenAI Codex
OpenAI Codex 排除敏感文件的方案仍未解决
201 分 129 条评论 作者: pikseladam
用户请求 OpenAI Codex 支持排除敏感文件(如 .env),避免 AI agent 在代码生成过程中意外读取并泄露 API key 等敏感信息。评论普遍认为黑名单机制(如 .agentignore)无法真正保护数据安全,因为 AI 可能通过各种方式绕过限制。真正的解决方案是在系统层面实现隔离——用虚拟机或容器(firecracker、apptainer)运行 agent,或采用最小权限原则,由代理(如 ssh-agent)管理 API key,而非将敏感信息明文存储在本地让 agent 可以访问。也有评论指出这是错误的安全边界,把文件权限设对(让 Codex 看不到)比让它自己遵守规则更实际。

评论精华

  • agent-vault、1password 等工具可避免在本地明文存储敏感信息
  • 沙箱隔离才是根本:用 firecracker/apptainer 等容器方案,任务时只挂载需要的文件
  • Unix 文件权限或不同用户运行可以限制访问,但这并非 Codex 的职责
  • LLM 极其擅长绕过限制,黑名单方案只会给用户虚假的安全感
  • 建议用 setuid 或 user namespace 在受限情况下仍允许特定操作
No.28 Daisugi, the Japanese technique of growing trees out of other trees (2020)
台杉:日本古代树木叠生技术
130 分 43 条评论 作者: MaysonL
台杉(台杉)是一种日本15世纪发明的树木栽培技术,通过在现有树干上培育新苗,形成「一树多干」的形态,宛如巨型盆景。京都茶道大师千利休在16世纪对北山杉木材的完美品质提出极高要求,推动了这一技术的精细化发展。该方法可有效防止滥砍滥伐,产出的直木(taruki)比普通杉木柔韧度提升40%、密度强度提升一倍,非常适合用于茶室屋顶的椽木。评论区的争议主要围绕:台杉与欧洲数千年历史的截枝(pollarding)、萌芽更新(coppicing)技术究竟有何本质区别,还是仅仅是「东方主义」加持下的旧技术包装?支持者认为台杉的垂直整齐度远胜欧洲同类案例,且有独特文化脉络;批评者则指出该文信息量稀薄,主要依赖二手推文素材。

评论精华

  • 部分评论者认为台杉本质等同于欧洲数千年历史的截枝与萌芽更新技术,带有「东方主义」滤镜的过度解读
  • 技术层面:利用树木受伤后自然向上生长的「水芽」特性,修剪侧枝使主干笔直,每两年修枝一次防止节疤
  • 反质疑:欧洲截枝案例能否达到台杉这般笔直高耸的树冠形态?支持者指出目前缺乏可比实例
  • 文章质量批评:内容单薄,几乎是对推特线程的二次加工,原始来源信息量更丰富
  • 「Thing, Japan」现象:HN每周都会涌现这类日本文化技术文章,顶评总是「某技术在欧美也有」的反驳
No.29 Examining circuit boards from the Space Shuttle's I/O Processor
拆解航天飞机I/O处理器的电路板
104 分 23 条评论 作者: pwg
本文深入拆解了航天飞机I/O处理器(IOP)的两块电路板。IOP是连接主CPU与航天飞机24个高速数据网络的桥梁,其架构极为独特:在一块物理处理器上实现了25个虚拟处理器,并支持两种完全不同的指令集,是最早的多线程计算机之一。文章详细分析了两块电路板的功能:MIA(多路复用接口适配器)接口页面负责四个网络端口的信号收发,采用了1946年发明的Manchester编码来解决直流偏置问题;微码页面则存储用金属熔丝编程的微指令。此外还揭示了IBM System/4 Pi架构的物理结构——两层印刷电路板夹着金属导热层,以及为何航天飞机选择TTL芯片而非MOS晶体管以增强抗辐射能力。评论者讨论了玻璃电容器的历史渊源、低密度芯片对太空辐射的防护作用,以及Corning为军事用途开发的特殊器件。

评论精华

  • 评论者对玻璃电容器表示惊叹,了解到Corning军用级玻璃电容的存在
  • 低密度IC和TTL芯片相较现代MOS工艺具有更好的抗辐射性能
  • 航天飞机采用Manchester编码是受1940年代Manchester Mark 1计算机发明的启发
  • 有评论者对仍在服役的神秘军用航天飞机表示好奇
  • 读者对多核处理器的投票逻辑(少数服从多数)与此系统的相似性进行讨论
No.30 More evidence is consistent with possible ancient life on Mars (2025)
火星古生命新证据:仍未确凿,但可能性在积累
81 分 78 条评论 作者: pseudolus
毅力号探测器在火星古代湖泊三角洲发现磷铁矿和磁铁矿——这两种矿物在地球上通常由微生物活动形成,暗示火星可能曾有生命。但科学家提醒,这些矿物在特定水文条件下也可通过非生物化学反应生成,因此这仍是「可能的古生命证据」而非定论。文章回顾了人类追寻火星生命的百年历程:1894年Lowell误读运河、1976年Viking实验出现疑似生命反应却未检测到有机物、1996年火星陨石中的「蠕虫化石」被指可非生物生成、好奇号检测到迄今最大有机分子等——每次兴奋都以失望告终。文中还提到地球深层地下微生物群落的发现,暗示火星永久冻土层下方可能存在液态水与生命。结论:火星表面至今未发现确凿生命,但证据链在慢慢积累。

评论精华

  • 文章标题被批评措辞滑头,在astrobiology语境中「consistent with」是严谨表述
  • Viking 1&2在70年代已返回阳性结果,但一直被淡化处理;应警惕火星微生物回传地球的生态风险
  • 火星陨石可能通过撞击在地球与火星间交换微生物,生命或许曾在两颗行星间双向传播
  • Europa等冰卫星的地下海洋比火星表面更有希望,辐射屏蔽条件更适宜潜在生命
  • 发现生命将是NASA预算倍增的最大动力,科学家群体不会主动回避这一发现