2026年09月03日 · 星期四 第 160054 期

The Hacker Daily

丙午年(马)七月廿二

30 篇文章 · 2681 条评论 ·聚焦:大模型 · 计算历史 · 浏览器推理
No.01 Muse Spark 1.3
Meta 发布 Muse Spark 1.3
540 分 365 条评论 作者: bvaldivielso
Meta 推出 Muse Spark 1.3,被社区视为一次明显追赶前沿模型的发布:评论提到其在 Artificial Analysis 智能指数和 DeepSWE 等基准上接近甚至短暂超过部分主流竞品,尤其强调速度、代码能力和低价。最大讨论点是定价分层:普通版本声称不用于改进产品,而「contributor」版本允许 Meta 使用数据训练,价格低到约二十分之一,被认为对个人开发者和爱好者很有吸引力。争议也集中在这里:有人称赞透明地标出数据价值,也有人担心隐私、Meta 信誉、许可和此前开源权重承诺。另有用户认为 Gemini 3.8 Flash 仍更便宜或更强,Spark 1.2 的实际体验也存在分歧。

评论精华

  • 「contributor」低价是最大亮点,但代价是允许训练数据回流。
  • 不少人称 1.3 基准成绩强,代码任务和速度表现接近前沿。
  • 也有人认为 Gemini 3.8 Flash 更便宜、更稳,Spark 体验未必领先。
  • 社区对 Meta 的隐私、信誉、许可和开源权重承诺仍有疑虑。
  • 部分开发者已用 1.2 做编程或写作,评价从惊喜到失望不一。
No.02 Gemini 3.8 Flash and 3.8 Flash Cyber
Google 发布 Gemini 3.8 Flash 与网络安全版
982 分 560 条评论 作者: bratao
Google 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber,称其在保持 3.7 Flash 速度与低价的同时,显著提升编码、长程代理任务和多步推理能力,输入每百万 token 0.75 美元、输出 3.75 美元。普通版面向开发者、企业和订阅用户,强调会在复杂任务中投入更多推理和工具调用;Cyber 版通过 Fairwind Program 仅向受信防御方开放,主打漏洞发现和自动修复。文章列举 DeepSWE、CyberGym、CWE-Bench、Chrome 与 Wiz 内部评测等成绩,并强调 CBRN、网络攻击和提示注入防护。争议集中在基准可比性、真实延迟、Google 产品入口混乱,以及 Flash 系列实际开发可靠性是否匹配榜单表现。

评论精华

  • 许多用户认为 Flash 系列被低估,性能接近旗舰模型但价格更低。
  • 开发者称 3.7/3.8 在 JavaScript、HTML、图像识别、文档抽取等任务上表现突出。
  • 也有人批评真实开发中不如 Claude、Codex 稳定,代码质量有时鲁莽。
  • 社区质疑 Google 基准数字变化、缺少速度说明,以及产品入口和命名混乱。
  • Cyber 版只向受信防御方开放,引发普通用户对可用性和发布意义的抱怨。
No.03 The Computer Museum of America reclamation project
美国计算机博物馆藏品重启整理计划
32 分 11 条评论 作者: rbanffy
原美国计算机博物馆及圣迭戈计算机博物馆的藏品,已在圣迭戈州立大学图书馆地下室保存 21 年。2025 年一笔捐赠让团队开始重新索引、募资和宣传这批资源。文章强调,这可能是全球最大的计算机革命与信息时代实物和档案库之一,不只包括硬件,也有杂志、爱好者通讯、软件、书籍和手册。作者认为,计算机技术在过去 70 年深刻改变了人类工作、学习和娱乐方式,这批藏品可帮助社会学、工程、历史、人类学等领域研究这种变化如何发生。评论则更多转向现实难题:计算机博物馆很难长期维持,尤其是让设备保持可运行。

评论精华

  • 有人感叹计算机博物馆难以存续,波士顿旧馆也已成为历史。
  • 荷兰 HomeComputerMuseum 被推荐,藏品多且允许公众上手使用。
  • 一位评论者批评博物馆偏爱签名和名人物件,忽视真正的先锋硬件。
  • 有人指出山景城计算机历史博物馆延续了波士顿馆的脉络。
  • Living Computer Museum 曾尝试保持设备运行,但最终资金耗尽并清算拍卖。
No.04 Holden's Lightning Flight
霍尔登的闪电战斗机意外飞行
143 分 27 条评论 作者: ColinWright
1966 年,英国皇家空军工程军官沃尔特·霍尔登在莱纳姆基地为一架英制电气「闪电」截击机做地面电气故障测试时,误把油门推过加力燃烧门槛。没有头盔、无线电和座舱盖,弹射座椅处于地面惰性模式,起落架也被锁定放下,他被迫起飞,并险些撞上油车和正在起飞的彗星客机。霍尔登凭早年小型教练机经验绕场三次,最终尾擦地着陆,飞机仅轻微受损并重返服役。调查认为他未违反当时命令,也确实挽救了自己和飞机;事件随后促成相关地面测试规程修订。

评论精华

  • 读者补充闪电性能惊人,可极快爬升并执行高空拦截。
  • 有人指出彗星客机也有因金属疲劳导致事故的航空史背景。
  • 多名评论质疑为何让非闪电资质人员执行测试,可能源于停场收尾压力。
  • 有评论认为空军事后处理体现了英式委婉问责,而非单纯追责。
  • 霍尔登原始回忆被推荐阅读,其中提到事件后对高速飞行留下心理阴影。
No.05 Pre-Release of Polars 2.0
Polars 2.0 预发布:默认启用流式引擎与更严格 API
8 分 0 条评论 作者: komape
Polars 发布 2.0 首个候选版,正式版将在数周内推出。此次大版本并非主打新功能,而是清理旧设计、调整默认行为。最大变化是 LazyFrame 查询默认使用「流式引擎」,官方预计整体可带来约 5 倍性能提升并显著降低内存占用,但 join、group_by、unpivot 等操作默认不再保证行顺序,需要通过 maintain_order 显式开启。2.0 还强化了「严格、快速失败」原则:is_in 不再默认进行可能有损的类型转换,横向 concat 默认要求高度一致,字符串转日期、枚举与整数互转等模糊 cast 被专用方法取代。新版还增加了删除属性和参数的专门异常,帮助用户迁移到新 API。未来 2.x 还计划推进真正的 out-of-core、IO 插件、S3 读取、SQL、成本优化器和异步管线。
No.06 Google avoids a breakup of its ad tech business
谷歌广告技术业务避免被拆分
358 分 260 条评论 作者: donohoe
《纽约时报》报道,在美国司法部广告技术反垄断案中,谷歌虽已被法院认定在相关广告技术市场存在垄断行为,但最新补救措施没有要求拆分其广告技术业务。争议集中在:涉案部分主要是 Google Ad Manager、广告交易所和发布商广告服务器等「广告技术」环节,而非 Alphabet 更庞大的搜索广告收入;该业务年收入约 300 亿美元,占 Alphabet 约 8%,且已连续多个季度下滑。评论区普遍认为处罚力度不足,担心谷歌只需承诺停止滥用行为即可过关;也有人指出拆分复杂、法院需按法律和具体市场界定裁决,不能简单等同于惩罚整个谷歌广告帝国。

评论精华

  • 多数评论认为法院补救太轻,垄断认定后仍未触及核心控制力。
  • 不少人主张用累进税、强制拆分或更严格并购审查替代漫长诉讼。
  • 有评论区分「广告」与「广告技术」,认为涉案业务并非谷歌全部广告收入。
  • 部分人怀疑政治捐款和游说影响结果,也有人反驳法官背景不支持阴谋论。
  • 技术评论解释谷歌同时掌握广告主、发布商工具和交易所,形成利益冲突。
No.07 Three sites made 215,128 “best software” pages for AI. Perplexity cites them
三家新站批量制造 21 万个软件榜单,被 Perplexity 引用
393 分 190 条评论 作者: jakobgreenfeld
文章测试 Perplexity 的 sonar 与 sonar-pro:向 380 个软件采购类别提问,收集 7534 条引用。结果显示近六成引用来自 Tranco 排名 10 万名以后的网站,23.4% 不在前百万;部分新域名在 2023 年后才出现。Guideflow 这类非评测站的营销博客成为第三大来源。作者还发现 wifitalents、worldmetrics、gitnux 三站疑似同一运营方,批量生成 21.5 万个「最佳软件」页面,并用「Facts & Grounding Page」等面向检索系统的描述吸引 AI 引用。文章认为 AI 搜索的检索层缺乏来源怀疑,可能被专为被引用而生的内容污染;但评论也质疑文章本身像 AI 生成、且可能同样是反 Perplexity 的内容营销实验。

评论精华

  • 许多人认为 Perplexity 暴露了 AI 搜索缺乏反垃圾机制。
  • 不少评论指出文章本身也像 AI 生成,存在自我讽刺。
  • 有人质疑多篇反 Perplexity 文章同时上榜,像是操纵或营销。
  • 开发者和用户分享经历:LLM 常引用竞品软文或虚假页面。
  • 部分评论认为产品搜索本来就是垃圾内容重灾区,问题不只在 AI。
No.08 Creating Backup Storage Sucks
搭建个人备份存储为什么这么烦
41 分 35 条评论 作者: smarmelling
作者尝试用免费方案实现个人文件的「3-2-1」备份:主力 mini-PC 保存 Sync 目录,经 Syncthing 同步到另一台充当 NAS 的小主机和 Windows 笔记本;手机和平板则靠 Tailscale 远程访问。第二层用移动硬盘和 restic 做本地加密压缩备份,第三层尝试用 Google Drive 免费空间做异地备份,并处理照片、邮件等边缘问题。文章的价值不在给出最佳实践,而是记录普通用户在同步、备份、移动端访问、文件系统兼容和免费云存储之间反复妥协的真实过程。评论普遍指出作者混淆了同步、主存储和备份,建议把 NAS 作为数据真源,并强调离线、不可变和定期恢复演练的重要性。

评论精华

  • 多人指出 Syncthing 只是同步,不应被当作备份层。
  • 建议用 NAS、TrueNAS、ZFS、SMB/NFS 简化真源和备份结构。
  • 不少人强调离线副本、防勒索和定期恢复演练比自动同步更关键。
  • 有评论推荐 restic Web UI、Backblaze、Time Machine、imap-backup 等工具。
  • 社区提醒 ZFS 去重存在风险,git 与 Syncthing 混用也容易出问题。
No.09 Can I opt out of my input or output data being used for training?
Mistral 数据训练退出方式说明引发隐私争议
428 分 188 条评论 作者: teekert
Mistral 帮助页说明,在特定情况下,用户输入与输出内容可能被纳入模型训练,包括对话、文档和用户上传内容。不同产品的退出路径不同:Vibe 可在管理面板隐私设置中关闭「允许交互用于训练模型」;移动端需在「数据与账户控制」中取消「启用数据共享」;Mistral Studio 与 API 则可在管理面板关闭「匿名改进数据」。争议焦点在于部分服务默认并非退出训练,企业版与普通用户待遇不同,社区担心付费产品也默认收集数据,并质疑其作为欧洲隐私友好替代方案的定位。

评论精华

  • 许多用户批评默认用于训练应改为明确选择加入,尤其是付费产品。
  • 有人认为企业版默认退出、普通用户默认加入,显示隐私保护分层。
  • 部分评论质疑所有 AI 公司都会训练用户数据,退出承诺难以信任。
  • 也有人指出 Mistral 只是按欧洲规则披露,未必代表新近改变。
  • 开发者关注 API、团队计划和 PII 在提示词中被保留训练的 GDPR 风险。
No.10 Reverse Engineering Unknown File Formats with ImHex
用 ImHex 逆向未知文件格式
178 分 34 条评论 作者: carlos-menezes
文章以游戏 FEZ 的二进制存档为例,展示如何从未知文件格式一步步推导出完整结构定义。作者先用 ImHex 观察文件是否压缩、加密或有魔数,再定位游戏的 C# 程序与保存逻辑,通过反编译找到 BinaryWriter 写入字段的顺序。随后把 DateTime、版本号、可空对象、字符串、7-bit 编码整数、键值对列表等逐一映射到 ImHex 的「Pattern Language」,让十六进制数据变成可读结构。文章价值在于把逆向流程具体化:不是凭空猜格式,而是结合样本、上下文、代码路径和可执行模式定义迭代验证。

评论精华

  • 不少人称赞 ImHex 的 Pattern Language 适合快速映射专有二进制结构。
  • 评论补充经验:先看熵判断压缩或加密,再结合应用上下文推格式。
  • 有人建议生成两个只差一个操作的存档,用字节 diff 快速定位字段。
  • 社区提到 Kaitai Struct、Ghidra、IDA、LLM 等可作为辅助工具。
  • 也有人调侃未知格式常常只是 zip、SQLite、JSON 或 protobuf 的套娃。
No.11 Launch HN: RonanRX (YC S26) – Personalized Peptides and GLP-1s
RonanRX:个性化肽类药物与 GLP-1 服务
56 分 62 条评论 作者: lloydarmbrust
RonanRX 是一家 YC S26 公司,主打个性化肽类药物和 GLP-1 减重治疗,试图把远程医疗、医生处方、反馈式剂量调整和药物制造供应链垂直整合。创始人称目前与伙伴共同生产 API,未来 9 个月内部分内化,核心护城河在于根据患者反馈与医生审核实现个性化处方,而非单纯复制现有 GLP-1 诊所。HN 讨论集中在法律与监管风险:复方药房豁免、FDA 供给判断、专利诉讼、非 FDA 批准药物能否推荐等;也有人质疑这与灰色市场或普通远程 GLP 服务差异不够。另一个高频反馈是官网文案明显 AI 化、缺乏医疗信任感,但部分评论认可其供应链和反馈闭环方向。

评论精华

  • 最受关注的是复方药房、专利和 FDA 监管风险。
  • 创始人称关键在个性化剂量反馈与医生审核闭环。
  • 有人质疑与众多 GLP 远程开方服务差异不明显。
  • 官网被批评为 AI 味重,削弱医疗产品信任感。
  • 部分用户关心价格、保险覆盖和口服肽类分发可能性。
No.12 Higher Multipoles of the Cow
球形奶牛的高阶多极展开
57 分 17 条评论 作者: MrOrelliOReilly
这篇 arXiv 论文以物理学笑话「球形奶牛」为出发点,严肃地套用多极展开框架:把球形奶牛视为零阶近似,并进一步定义非球对称奶牛的几何、多极系数、势场与相互作用。作者还用基准奶牛演示计算方法,讨论旋转奶牛因引力波辐射而自旋减慢等在球对称下会被抹去的效应。文章显然带有愚人节论文色彩,但也借幽默形式解释了为什么物理建模常从对称近似出发,以及高阶修正何时变得重要。

评论精华

  • 读者欢迎这种轻松的 arXiv 内容,认为比常见推理论文有趣。
  • 有人指出远处引力场近似球形,是物理近似可行的核心原因。
  • 评论补充壳层定理与伯克霍夫定理,可把球形进一步近似为点质量。
  • 多位读者注意到论文初版和修订版都在 4 月 1 日,确认其玩笑属性。
  • 社区围绕「点奶牛近似」等梗继续发挥,评论以幽默为主。
No.13 Fable 5.1 World Modeling
Fable 5.1 生成可漫游 3D 世界
222 分 65 条评论 作者: surreal_
PhiloLabs 展示了用 Fable 5.1 生成交互式 3D 世界的实验:例如旧金山 Union Square、京都手绘风场景等,可在浏览器中漫游,包含街道、店招、车流和行人逻辑,甚至由智能体在场景内录制导览视频。作者称 Union Square 是一次性生成,但依赖很长提示词、子代理和自检循环,约耗时 2 小时、成本约 33 美元。评论认为效果漂亮,展示了用代码生成世界而非直接产 mesh 的潜力;但也质疑标题中「world model」含义混乱、成本过高、缺少 GitHub Pages 演示、拓扑/纹理/优化与大型游戏可用性仍不足。

评论精华

  • 多人希望提供在线 Demo、短视频、教程和成本/失败率细节。
  • 主要质疑是单个世界约 33 美元,离游戏量产还很远。
  • 有人认为代码生成几何可绕开传统 mesh 拓扑和贴图难题。
  • 评论将其联想到 VRML、开放世界游戏、AR 游戏和影视场景漫游。
  • 「world model」一词被认为误导,和 AI 世界模型概念容易混淆。
No.14 LLMs and Self-Referentiality
LLM 与自指性的失落神话
20 分 9 条评论 作者: mavdol04
Scott Aaronson 反思《哥德尔、艾舍尔、巴赫》等思想传统曾把智能与「自指」「怪圈」紧密相连,甚至 Penrose 也从相反立场认为哥德尔式自指限制了机器智能。但 2026 年的 LLM 已在许多可判定智力任务上超越多数人类,而其技术栈并未显式内置自指机制;模型谈论自身、哥德尔或自指,只是大规模预训练和语言普适性的副产物。作者认为,真正被验证的是「智能即预测、预测即压缩」这一脉络,而非自指作为会话智能前提的观念。不过意识和主观体验是否仍与自指相关,仍未解决。

评论精华

  • 有人认为缺乏真实自指正是推理缺陷根源,只是被工具框架掩盖。
  • 评论质疑 LLM 只引用冻结训练世界,并不真正认识当前自身。
  • 有人指出 Hofstadter 也许谈的是意识而非一般智能。
  • 多位评论认为智能、意识、自我意识等概念混用导致争论混乱。
  • 有人把 LLM 成功视为「苦涩教训」:规模和通用性胜过手工理念。
No.15 Show HN: OwnTime – a chess clock for your day's priorities
展示:OwnTime,用棋钟管理每日优先事项
61 分 29 条评论 作者: fmos
OwnTime 把一天当作一盘棋:用户先设定少数优先事项和每日时间预算,同一时间只有一个倒计时运行,切换任务会自动暂停其他计时;预算耗尽时触发闹钟,午夜重置。它主打 iPhone 与 Apple Watch,手表可快速查看和启停,并支持 Siri、快捷指令和 Ultra 动作按钮。作者强调它关注想把时间花在哪里,而不是事后追踪损失;数据不上云、无账号,可导出完整 SQLite 历史自行分析。社区总体认可概念和执行,但也提出 Android 缺席、计时应支持正计时、循环提醒、配色主题、界面文案和示例含义不够清楚等改进点。

评论精华

  • 不少人喜欢棋钟式时间预算和手表、语音集成。
  • 多名用户遗憾只支持苹果生态,希望有非 iPhone 版本。
  • 有人请求循环提醒、久坐提示,作者称会考虑。
  • 用户希望支持正计时或类似工时表的记录方式。
  • 评论质疑文案和配色像 AI 生成,作者已调整并解释设计。
No.16 Wendell Berry has died
温德尔·贝里去世
177 分 95 条评论 作者: Curiositry
《纽约时报》讣告报道,美国作家、诗人、农民与社会批评家温德尔·贝里去世。评论区回顾他以《美国的失落》《杰伯·克劳》等作品影响农业、地方共同体、生态伦理与技术批判讨论;许多人称他身体力行,提醒现代社会追问「人的尺度」、好工作与土地责任。争议集中在他对技术和工业农业的怀疑:支持者认为他不是反对工具本身,而是反对脱离共同体与责任的规模化体系;批评者则认为他浪漫化前现代农耕,忽视贫困、饥荒和现代技术带来的解放,也有人质疑其立场的现实可行性。

评论精华

  • 多位读者追忆《美国的失落》对其农业观和生活选择的影响。
  • 社区将贝里与皮尔西格、克里斯托弗·亚历山大等人的「质量」思想相联系。
  • 不少人赞赏他提出技术应服务人的尺度,而非无限扩张。
  • 批评者认为他浪漫化艰苦农耕,低估现代医疗、机械和规模化收益。
  • 也有评论指出他并非简单反技术,而是主张技术受共同体和责任约束。
No.17 Biggest dark matter detector spots a single weird particle
最大暗物质探测器捕捉到一个异常粒子事件
280 分 95 条评论 作者: randycupertino
Science 报道称,位于南达科他地下金矿旧址、使用约 7 吨液氙的 LUX-ZEPLIN 暗物质探测器,在 2.8 吨年数据中发现了一个难以归类的异常事件。研究团队排查了放射性背景、宇宙射线、重建错误等常见来源,但仍无法确定其性质;若为真实信号,可能暗示比传统「WIMP」更复杂的暗物质或其他新物理。不过社区普遍强调,单个事件统计意义很弱,约一百到数百分之一的偶然概率远不足以构成发现。后续三倍数据尚待处理,若出现更多类似事件才可能改变判断。

评论精华

  • 许多评论赞赏团队审慎排查背景噪声,但认为单例只能提示线索。
  • 有人指出科学发表本就像公开求证,方便同行和理论家跟进。
  • 讨论集中在如何排除中微子、放射性背景和重建误差等常规解释。
  • 部分人质疑暗物质假说,也有人用引力透镜和星系旋转证据反驳。
  • 社区提醒高能物理中过早显著性常会回落,需等待更多数据验证。
No.18 Aging brains blend memories together instead of just forgetting them
衰老大脑并非只是遗忘,而是会把记忆混合在一起
263 分 115 条评论 作者: mdp2021
文章称,一项关于记忆与年龄的研究发现,年长者的记忆错误不只是信息消失,更常表现为把相近事件、地点、人物或时间线混合,类似细节层面的「串线」。评论指出,这与照护失智亲属、个人回忆被照片校正、梦境混入现实等经验相符;也有人认为记忆本来就是每次提取都会被重写的主观重构。争议集中在研究样本很小、年龄段分布不足,难以证明是生物衰老导致,还是一生累积信息过多、重复经历增多、睡眠和昼夜节律变化等因素所致。另有读者质疑报道本身可能是 AI 生成的低质科普。

评论精华

  • 多人用照片、家庭经历和失智照护印证记忆会错配时间地点。
  • 有人质疑样本仅 61 人且年龄分布断层,不能推出终身衰退曲线。
  • 不少评论认为记忆本就会在回想时被重写,并非老年独有。
  • 讨论提出大脑信息累积、重复经历、睡眠节律也可能解释混淆。
  • 部分读者批评原报道像 AI 生成科普,需直接看论文。
No.19 Qantas Airbus A380 engine failure in 2010 (2023)
澳航 32 号航班 A380 发动机爆裂事故
123 分 76 条评论 作者: gumby
文章回顾 2010 年澳航 QF32 空客 A380 在新加坡起飞后遭遇罗尔斯·罗伊斯 Trent 900 发动机非包容性涡轮盘爆裂的事故。评论显示,根因可能是油管加工中仅约 0.2 毫米的偏差导致润滑油泄漏、起火并引发涡轮盘超速解体,碎片击穿机翼、燃油箱和多套系统。飞机虽严重受损且超重、部分功能失效,但依靠 A380 冗余设计和驾驶舱多名高经验飞行员,最终安全返航,无人伤亡。讨论焦点集中在极限工程容差、制造与质检失误、非包容性发动机故障几乎无法完全防护,以及澳航安全声誉与空客设计的作用。

评论精华

  • 涡轮盘碎片能量巨大,发动机外壳通常无法完全包容。
  • 事故根源被认为是油管加工偏差和质检流程失效。
  • 许多人称赞机组经验、A380 冗余设计和澳航安全文化。
  • 维修耗时 535 天、花费 1.39 亿美元,但仍有经济价值。
  • 评论推荐 Admiral Cloudberg、Aviation Herald 和相关纪录片作为延伸阅读。
No.20 Engineering of the fastest WebAssembly interpreters
最快 WebAssembly 解释器的工程实践
86 分 6 条评论 作者: herobird
Wasmi 2.0 发布,核心目标是重做执行引擎并提升 WebAssembly 解释性能。作者称新版在 Apple M2 Pro 的 wasmi-benchmarks 几何平均上比 Wasmi 1.0 快约 2.2 倍,并在 Apple、AMD EPYC、Intel Xeon 等平台上跻身最快的可移植 Wasm 解释器之列,同时保持优秀启动性能。文章重点解释了四种指令派发模式、统一执行处理器签名、调用约定限制、累加器寄存器、默认线性内存快速路径等工程取舍。争议点主要在于这类解释器与原生执行或 JIT 编译运行时的差距:社区认为即便解释器很快,也远未接近原生。

评论精华

  • 有人询问 Wasmi 解释性能是否已接近原生执行。
  • 评论者称 Wasmtime Cranelift 曾在 SPEC 2017 上约慢于 LLVM 原生 1.5 至 1.9 倍。
  • 另一评论认为顶级 Wasm 运行时通常仍比原生慢 10% 到 2 倍,解释器更难接近。
  • 有人追问「慢 10% 到 100%」这一表述是否理解正确。
No.21 Exit the Cave
走出洞穴
250 分 90 条评论 作者: akkartik
作者反思当下流行的私下苦练式「洞穴」叙事:独处训练、打磨产品或自我优化看似自律,却也容易让人把可控投入误认成真实进展。借高中摔跤经历,他发现技术和体能重要,但真正的检验来自赛场;自己长期只是避免失败和羞耻,并非真正追求胜利。文章主张任何有价值的追求都需要面对现实反馈:作家要读者,创业者要客户,运动员要对手,恋爱也要承受被拒绝。评论区则质疑作者把失败归因于「不够想赢」过于简化,也强调内在满足、长期练习和公开检验之间需要平衡。

评论精华

  • 多人认同「让现实教你」:产品、写作和训练都需要真实反馈。
  • 反对者认为失败可能来自天赋、资源或市场,不应归咎于意志不足。
  • 有人强调若目标是自娱或内在成长,未必需要走出洞穴。
  • 创业评论聚焦先销售再构建、从小受众验证需求。
  • 也有人指出互联网让公开发布更像对虚空喊话,反馈越来越稀缺。
No.22 The shrinking landscape of linguistic diversity in the age of LLMs
LLM 时代,语言多样性正在收缩
132 分 113 条评论 作者: Anon84
这篇 Nature Human Behaviour 论文研究了 7 个跨领域数据集、超过 88 万篇文本,认为 LLM 作为写作助手的普及会在保留核心内容的同时压平个人风格。作者发现,经 LLM 润色或改写后,写作复杂度方差显著下降 21–50%,并更强化主流群体特征、削弱少数或个体化表达。这意味着语言中原本可用于识别身份、心理状态、社会背景的信号会被稀释,可能影响心理诊断、个性化服务、招聘评估和文化保存。争议在于:统一风格是否能提升清晰度,还是会把写作、思考和文化差异一并商品化。

评论精华

  • 不少人切身感到用 LLM 写文档后,文字不再像自己。
  • 有人认为问题早由电视、全球化和互联网推动,LLM 只是加速器。
  • 支持者说统一表达可减少误解,提高跨文化沟通效率。
  • 反对者担心语言差异承载思想、身份和文化,不只是审美。
  • 技术讨论集中在后训练、低温采样和模型坍缩导致风格趋同。
No.23 Altair Basic Interpreter Source Code (1975) [pdf]
Altair BASIC 解释器源码(1975)
56 分 33 条评论 作者: Eridanus2
这份 PDF 公开了 1975 年 Altair BASIC 解释器的早期微软源码,被视为微软创立起点的重要文物。评论关注其历史价值:盖茨和艾伦在约两个月内完成可运行 BASIC,代码注释密集,且 4K 版本仍支持单精度浮点,显示当时在极小内存中的工程取舍。争议集中在来源与原创性:有人认为应承认 DEC 和 Dartmouth BASIC 的影响,甚至质疑是否参考了 DEC 源码;也有人指出微软 BASIC 的实现路线不同。社区还讨论了源码保存、早期软件共享文化,以及微软 BASIC 因授权给多家硬件厂商而流行的商业背景。

评论精华

  • 多人认为 DEC、Dartmouth BASIC 对 Altair BASIC 有重要影响。
  • 评论惊叹两个月内完成解释器及大量注释的生产力。
  • 浮点例程被视为微软 BASIC 相比整数 BASIC 的关键优势。
  • 有人追问源码是否已 OCR 并能在模拟器中运行。
  • 讨论早期源码保存不易,许多软件和游戏源码后来遗失。
No.24 Async Rust vs RTOS showdown (2022)
Async Rust 与 RTOS 的嵌入式对比
80 分 42 条评论 作者: kooi
文章把 Embassy/Rust 的异步执行模型与 FreeRTOS/C 放到 STM32F446 微控制器上对比,目标不是讨论 Rust 与 C 语言本身,而是比较两种并发模型在较普通嵌入式程序中的表现。作者设计了 LED 闪烁、按钮中断状态共享、消息队列串口输出等任务,并计划用示波器测量 GPIO 中断耗时、任务恢复延迟、程序体积和静态内存占用,同时讨论编程体验。核心背景是 Rust future 通过轮询和 waker 运行,Embassy 采用静态任务、无分配器和协作式调度;RTOS 则保存线程上下文并支持抢占。争议集中在测试负载偏轻、串口瓶颈、异步并非 RTOS,以及文章年代较早。

评论精华

  • 多人认为标题容易误导,Async Rust 不是 RTOS,应写成嵌入式异步 Rust 对比 C RTOS。
  • 批评者指出测试 CPU 负载很轻,协作式调度在有显著计算任务时结论可能不同。
  • 有人认为串口消费者远慢于生产者,按钮延迟指标不足以代表整体系统性能。
  • 评论提到 Embassy 后来已有多优先级执行器等近似抢占能力,2022 年细节需谨慎看待。
  • 部分嵌入式开发者认为真实项目更常见 Zephyr、RTIC 或传统 RTOS,Embassy 仍显得不够像 FreeRTOS。
No.25 A Selection of Los Alamos Rolodex Business Cards
洛斯阿拉莫斯名片夹中的冷战科技名片
160 分 41 条评论 作者: 1970-01-01
这组图片展示了来自洛斯阿拉莫斯相关名片夹的商业名片,原文正文很短,核心价值主要在视觉与历史材料本身:这些名片记录了围绕国家实验室、军工、核技术、电子器件、爆炸技术和高技术小公司的生态。社区讨论把它视为冷战时期科技产业文化的切片:公司名称常显得像科幻或游戏设定,设计却比今天许多名片更朴素、有辨识度。争议不多,更多是怀旧、考据与延伸发现,包括电话格式年代、Rolodex 打孔导致信息被裁切,以及这些实验室废弃物来源于 Ed Grothus 的「The Black Hole」收藏。

评论精华

  • 有人补充 CLUI 2016 年通讯,说明这些名片夹的来源背景。
  • 评论者喜爱旧名片的标志、配色和简洁感,认为比今天更难忘。
  • 不少公司名被认为像「Fallout」设定,如「Blast-N-Peen」等。
  • 有人考据具体公司和人物,发现部分企业或产品线仍有现实延续。
  • Rolodex 打孔让读者理解旧名片底部留白的实际功能。
No.26 Nango (YC W23) is hiring across eng, product and GTM (SF and remote)
Nango 招聘工程、产品和 GTM 岗位
1 分 0 条评论 作者: bastienbeurier
Nango 正在招聘工程、产品和 GTM 岗位,工作地点包括旧金山和远程。公司强调全远程协作、以结果而非工时衡量产出,并以开源、透明和开发者友好为核心文化。岗位面向开发者工具领域,团队希望成员为同行解决熟悉的痛点,并通过快速反馈循环改进产品。原文还突出其技术挑战,包括开发者体验、高规模系统和 API 碎片化等问题;团队由来自开发者基础设施公司的资深人士带领,并称收入与使用量正在快速增长,认为当前是加入的合适时机。
No.27 We could save petabytes of cache storage with Zstandard and Pingora
Cloudflare 用 Zstandard 和 Pingora 扩大缓存容量
104 分 40 条评论 作者: torutofu
Cloudflare 原型「Cache Transcoding」在 Pingora 缓存写盘前,把符合条件的未压缩文本响应用 Zstandard level 3 压缩,缓存内和跨数据中心传输都保持压缩态,面向客户端再解压。测试中合格资产平均缩小约 2.8 倍,CPU 额外成本仅数个百分点,可换来 PB 级有效缓存容量和 Tiered Cache 带宽节省。系统只处理 200 OK、无 Content-Encoding、可压缩文本、长度至少 4 KiB 的对象,避开媒体、Range、预压缩和未知长度响应。争议集中在术语是否应叫转码、Range 请求如何高效支持,以及是否应按冷热内容选择性压缩。

评论精华

  • 有人建议结合 zstd 字典和压缩头部,小对象也可能值得处理。
  • 多位评论者追问 Range 请求,认为需 seekable frames 或分块索引支持。
  • 有人比较文件系统和传输层压缩,质疑是否应由上层应用感知。
  • 社区讨论冷热内容策略:压缩冷内容或按读取频率重压缩或许更合理。
  • NPM、PyPI、容器镜像等场景被举例,重复内容可用增量或分块去重进一步节省。
No.28 Poisson Disk Sampling
泊松圆盘采样
155 分 19 条评论 作者: vismit2000
文章介绍 Robert Bridson 2007 年一页论文中的「泊松圆盘采样」算法:在随机放置树木、图形采样或模拟对象时,既保持随机感,又保证点之间有最小距离。核心做法是用网格加速碰撞检测,并从已有点周围环带生成候选点。作者进一步提出两类优化:二维中利用父子点关系排除必然无效的角度区间;通过调整半径采样分布,让新点更靠近或远离父点,以提高密度。但过度追求密度会产生线状、空洞等伪影,削弱随机感,因此需要在紧密填充和视觉自然之间折中。

评论精华

  • 有人分享了可视化调试界面和 Observable 生成器等相关工具。
  • 图形开发者讨论 GPU、shader 中实现 Bridson 算法的困难。
  • 多位评论者联想到蓝噪声和游戏草地随机摆放问题。
  • 有人质疑生成点出现线状伪影,建议考虑低差异序列。
  • 评论区区分低差异序列与低差异点集的目标差别。
No.29 Reasons robotics is hard
为什么通用机器人如此困难
82 分 47 条评论 作者: ddp26
文章认为,AI 在知识工作中进展显著,但物理世界里的通用机器人远未出现类似 ChatGPT 的突破,公众主要只能看到易被剪辑和挑选的演示视频。作者逐项梳理难点:人手的自由度、触觉密度、灵巧性和耐用性极难复制;复杂视觉理解、任务分解、实时反应、上下文判断、协作、安全速度、力量、续航和移动能力都尚未解决。LLM 依赖海量文本数据成功,而机器人缺少同等规模的物理交互数据。文章并非否认机器人进步,而是提醒不要把实验室演示误读为可规模化的人工劳动替代。

评论精华

  • 机器人专家补充:柔顺控制、在线适应和微型机械同样是核心难题。
  • 多位评论者认为高自由度泛化比自动驾驶更难,数据缺口尤其严重。
  • 有人主张先出现的会是更聪明的专用家电,而非人形通用机器人。
  • 仓储拣选和包裹配送被视为衡量真实进展的重要指标。
  • 部分评论认为中国硬件迭代和产业投入可能更快突破现有瓶颈。
No.30 WebLLM: high-performance in-browser LLM inference engine
WebLLM:浏览器内高性能大模型推理引擎
112 分 17 条评论 作者: saikatsg
WebLLM 是 MLC AI 的浏览器端大语言模型推理引擎,核心卖点是在本地浏览器中通过 WebGPU 运行模型,避免服务器推理并提升隐私与离线能力。评论区反馈显示,它曾被用于个人项目,但当前争议集中在可用性与维护状态:有人认为项目长期未更新,模型支持停留在 Gemma 2 附近,建议改用 Transformers.js;也有人提醒每个浏览器会话可能下载 500MB 到 1GB 模型文件,产品接入时应明确告知。实际运行门槛也较高,多个用户遇到 WebGPU 不可用、浏览器 flag、硬件加速和 GPU 限制错误,说明它更像面向实验和特定环境的技术方案,而非开箱即用的生产级组件。

评论精华

  • 多名用户称项目已久未更新,建议考虑 Transformers.js。
  • 浏览器会话需下载数百 MB 到 1GB 模型,应提前披露。
  • 演示站依赖 WebGPU,部分环境直接报不支持错误。
  • Firefox 和 Chrome 可能需手动开启 WebGPU 或硬件加速。
  • 有人遇到 GPU 存储缓冲区限制,实际体验不稳定。