2026年09月10日 · 星期四 第 160028 期

The Hacker Daily

丙午年(马)七月廿九

30 篇文章 · 6101 条评论 ·聚焦:AI模型 · 苹果新品 · 自动驾驶
No.01 iPhone Duo
苹果发布首款折叠 iPhone Duo
1162 分 2032 条评论 作者: thecosmicfrog
苹果推出首款折叠 iPhone Duo,主打可展开的 7.6 英寸 Super Retina XDR 内屏、接近 iPhone 18 Pro 尺寸的外屏,以及横向、纵向、半折、站立等多种使用姿态。它通过重新设计的 iOS 支持分屏、多任务、视频置顶、StandBy 和 Duo FaceTime 等场景,搭载 A20 Pro、双电池、C2 调制解调器、48MP 双摄与屏下 FaceTime 摄像头,并配套保护壳和支架。争议集中在 2000 美元起售价、第一代折叠设备耐用性、铰链进灰、屏幕折痕、尺寸过大,以及它究竟是更方便的手机加平板,还是两者都不够好的折中。

评论精华

  • 不少人认为 2000 美元起售价过高,宁愿等第二三代。
  • Android 折叠机用户期待苹果推动应用适配大屏和分屏。
  • 耐用性是最大疑虑:铰链进灰、折痕、碎屏和长期磨损。
  • 有人看好它替代偶尔使用的 iPad,适合阅读、演示和商务。
  • 也有人批评它不够苹果,像迟到复刻三星、Google 或 Surface Duo。
No.02 DeepSeek v4.1 Flash
DeepSeek V4.1 Flash 发布
138 分 25 条评论 作者: Liwink
DeepSeek 发布 V4.1 Flash,社区从 HuggingFace 模型页和技术报告判断,这次并非小幅迭代,而是采用新架构与系统优化的强力版本:约 552B 总参数、较少活跃参数,并加入多模态支持、KV cache 大幅压缩等特性。评论普遍认为其能力甚至可超过旧 V4 Pro,同时价格下调,使其成为高性价比备用或主力模型。但争议也很明显:模型体积远大于上一代 Flash,本地运行门槛显著提高;部分人认为它已不太符合「Flash」定位。此外,用户反馈英文提示中仍会混入中文,模型自我身份识别也不稳定。社区还猜测 DeepSeek 正在为更强的 V4.1 Pro 铺路。

评论精华

  • HuggingFace 已上线,但体积从旧版 284B 增至约 552B。
  • 不少人称其能力很强,甚至优于 V4 Pro,且价格更低。
  • 新版本加入多模态支持,可能让 Flash 系列成为主线。
  • 技术报告细节丰富,架构和系统优化受到高度评价。
  • 本地部署门槛升高,英文回答混入中文仍被吐槽。
No.03 Show HN: What if the speed of light was 5 km/h?
展示:如果光速只有每小时 5 公里
262 分 107 条评论 作者: dmitrybrant
这篇 Show HN 是一个交互式相对论公园模拟:把光速降到每小时 5 公里,让用户用键盘加速、鼠标观察,在接近光速时直观看到狭义相对论效应,包括长度收缩、时间膨胀、特雷尔旋转,以及前方蓝移、后方红移等多普勒现象。作品的价值在于把抽象物理变成可体验的视觉演示;争议主要集中在物理前提是否自洽:若真实宇宙中光速如此低,计量定义、引力、黑洞尺度、电子学乃至物质结构都会改变,因此它更适合作为固定场景下的教学可视化,而非完整反事实宇宙模拟。

评论精华

  • 多人提到 MIT 2012 年的 A Slower Speed of Light 和类似游戏。
  • 物理讨论集中在洛伦兹变换、非共线 boost 会产生旋转等细节。
  • 不少评论指出若只改变光速而不改引力和物质结构,世界并不自洽。
  • 用户反馈移动端控制、Safari 黑屏、方向键和鼠标指针等兼容性问题。
  • 有人联想到 Mr. Tompkins、刘慈欣、Discworld 等科幻作品中的低光速设定。
No.04 Larger Pacific Striped Octopus
大型太平洋条纹章鱼
39 分 17 条评论 作者: olalonde
大型太平洋条纹章鱼又称丑角章鱼,是一种尚未被正式科学命名的东太平洋热带章鱼。它挑战了人们对章鱼孤独、交配后死亡、易同类相食的常见印象:可形成多达 40 只的近距离群落,会面对面拥抱式交配,雌性通常不在交配中捕食雄性,还可能多次产卵。其条纹、斑点与体色变化可用于个体识别,栖息于泥沙海底,以虾、蟹、双壳类等为食,并会针对不同猎物采取追踪、伏击或钻孔等策略。评论关注点包括科学界为何迟迟未正式描述该物种、自然史研究的价值,以及维基页面没有说明其实际大小这一信息缺口。

评论精华

  • 有人感叹人类对地球生命多样性仍知之甚少,应更谦逊。
  • 评论指出该物种不会交配后立即死亡,或许存在学习和育幼可能。
  • 有人批评页面题为大型,却没有说明实际体型,据称约网球大小。
  • 关于基础生物学研究是否值得投入,评论展开了实用主义与生态价值争论。
  • 多位读者喜欢文章中「群居」「亲密拥抱」等拟人化但生动的描述。
No.05 Shopify acquires Tailwind
Shopify 收购 Tailwind
1008 分 387 条评论 作者: EdwinHoksberg
Tailwind 团队宣布加入 Shopify,为已每周安装超 1.1 亿次、被 ChatGPT、X、Cloudflare、Reddit、Shopify 等使用的框架寻找长期稳定归宿。团队称开源项目不变,Tailwind CSS 及相关项目将继续 MIT 许可并由原团队维护;但商业业务将停止增长,Tailwind Plus 和 ui.sh 不再开放新用户,只保留现有客户访问。文章强调 Shopify 复杂的店铺、后台、结账和代理式商业场景能反哺框架发展。争议焦点在于这更像受 AI 冲击后的软着陆或收购人才,而非单纯扩张。

评论精华

  • 许多人认为 AI 直接冲击了 Tailwind 模板和 UI 商业模式。
  • 不少评论祝贺团队获得体面退出,希望开源维护承诺兑现。
  • 部分开发者称 LLM 更常生成原生 CSS,减少对 Tailwind 的依赖。
  • Shopify 被认为能为 Tailwind 提供真实复杂产品场景和长期资金。
  • 也有人惋惜 Tailwind UI、ui.sh 等商业产品停止招新。
No.06 What do Visa and Mastercard do? An intro to card networks
Visa 和 Mastercard 到底做什么
501 分 277 条评论 作者: evakhoury
文章解释 Visa 与 Mastercard 并非发卡行、银行、收单机构或支付处理器,而是连接持卡人、发卡行、商户和收单方的「卡组织」。其核心职责包括运行交易消息路由网络,协调清算与结算资金流,设定交换费和网络费等激励机制,并制定争议、风控和参与规则。文中以 Visa 为例说明授权、清算、净额结算、跨境换汇及巨大日均结算敞口,也指出发卡行通常获得大部分费用。争议焦点在于这套网络既提供信任、反欺诈和全球可用性,也被批评为高费率、卡特尔化和对商户及消费者的隐性税。

评论精华

  • 多位评论认为卡网络本质是信任网络,价值在于风控、争议处理和结算可靠性。
  • 不少人批评 Visa 和 Mastercard 是租金寻租或卡特尔,收费远高于基础设施成本。
  • 欧洲、法国 CB、德国 Girocard、巴西 Pix 等低费率或公共方案被用来对比美国模式。
  • 商户视角分裂:有人认为手续费换来少坏账、少现金损耗和更简单会计,物有所值。
  • 评论讨论交换费与返现关系,认为美国 2% 返现基本来自商户费率转嫁。
No.07 Growing proof that autonomous cars save lives
自动驾驶汽车正在积累更安全的证据
326 分 562 条评论 作者: bookofjoe
文章认为,尽管公众和政策界仍担心自动驾驶安全性,现有研究正显示自动驾驶与其基础技术能显著减少事故和伤亡。IIHS 数据称,自动紧急制动可使行人事故下降 27%,后追事故下降 50%;Waymo 披露其无人出租车已完成 2.2 亿英里行驶,并在可比城市环境中严重伤亡事故减少 92%。IIHS 新研究也支持 Waymo 整体事故率低于人类司机。但争议在于数据仍集中于少数城市、良好天气和特定运营区域,且行业缺乏统一联邦安全标准。文章还提到 Zoox 获 NHTSA 豁免,以及自动驾驶可能被视为公共卫生干预。

评论精华

  • 许多人认可自动驾驶不必完美,只要显著低于人类事故率就有价值。
  • 大量评论质疑比较基准,认为应对比清醒、不超速、不分心的合格司机。
  • 不少人认为公共交通、自行车和步行基础设施比自动驾驶更能减少死亡。
  • 评论担心行业数据不透明、监管不足、软件更新和日志删除带来责任风险。
  • 有人指出美国道路死亡与酒驾、超速、不系安全带高度相关,自动驾驶优势可能被放大。
No.08 All grown-ups were once children, but only few of them remember it
成年人都曾是孩子,只是少有人记得
122 分 59 条评论 作者: yurivish
链接正文抓取到的只是 Mastodon 的 JavaScript 提示,但从标题与评论可见,原帖借「小王子」式的童年视角谈探索、玩耍与 AI。核心关切是:科学、数学和创造性工作真正有价值的部分,常来自缓慢、好奇、绕路和看似低效的过程;而现代 AI 若只被用来直奔可量化目标,可能会把发现中的人类经验、乐趣与判断力优化掉。争议集中在这是否是对 AI 的本质批评,还是对制度压力、功利化科研和成人遗忘童年心态的批评。

评论精华

  • 多名评论者赞同:探索和玩耍本身是创造力来源,不只是达成目标的低效路径。
  • 有人把问题归因于 AI 不具备人类经验,担心它会削弱训练、过程和发现新目标的能力。
  • 也有评论反驳浪漫化童年与自由探索,指出多数人仍受工作和经济压力约束。
  • 关于儿童视角的讨论延伸到亲子、童书和游戏:好作品来自真正记得孩子如何感受。
  • 少数人认为 AI 只是非人类工具,非人类不必然是问题,关键在如何使用与监督。
No.09 Version control second coming
版本控制的第二次浪潮
75 分 42 条评论 作者: bananaboy
作者以 Plastic SCM 创业者和现 Origin 工程师视角回顾版本控制二十年:2005 年 Git 与 GitHub 引发第一次大爆发,如今 AI 代理带来的高频提交、溯源需求和平台流量压力,正在催生第二波变革。文章列举 Entire、Pierre、Origin、GitButler 等新方案,重点在更快 Git forge、代理生成代码的 provenance tracking、更强 diff/tree、虚拟文件系统和大规模仓库处理。争议在于作者强烈预设「手写代码已停止」与「GitHub 将失势」,评论认为论证不够清晰,也质疑这些变化是否足以构成革命。

评论精华

  • 多人批评文章冗长且核心论点不清,没解释 AI 代理为何根本改变版本控制。
  • 不少人反感「大家已停止手写代码」的说法,认为夸大且脱离现实。
  • 有评论怀念或偏好 Mercurial、SVN、Perforce,认为 Git 并非最佳方案。
  • 围绕虚拟文件系统展开讨论,有人联想到 Plan 9,并期待其在大仓库中的价值。
  • 有人认为 GitHub 仍很强大,GitLab 等替代者已存在,所谓失势判断过早。
No.10 Training a 3.8B LLM to 0.384 CORE for $998
用 998 美元训练 3.8B 参数 LLM
60 分 11 条评论 作者: Anon84
作者记录了个人用约 998 美元、43 小时在租用 B200 上从零训练 3.8B 参数语言模型的实验,65B token 后 CORE 得分 0.384。文章重点不在刷新 SOTA,而在说明介于「nanoGPT 玩具」和大厂实验室之间的可达区域:良好配置化基础设施、ClimbMix 数据、梯形学习率、Muon 优化器、FP8、词表 padding、1024/2048 上下文权衡等,显著改善了早期失败的 858M 训练。作者强调 B200 按单位工作量比 H100 更划算,普通工程纪律和吞吐优化会直接转化为模型质量。评论争议主要集中在成本效率、是否可扩展到更强推理指标,以及文章是否带有 LLM 写作痕迹。

评论精华

  • B200 的单位工作量性价比被认为比单看租价更关键。
  • 有人想看约 1B 参数模型结合更多当前小模型技巧的复现实验。
  • AIME 等推理基准需要多少预算成为读者关心的问题。
  • 部分评论讨论文章是否由 LLM 辅助写作及其可读性。
  • 也有人认为关注写作风格会分散对小模型实验本身的讨论。
No.11 No Man's Sky Cosmos
无人深空 Cosmos 更新
367 分 375 条评论 作者: Limb
「No Man's Sky」Cosmos 更新试图让星系更像可反复探索的真实空间:前哨站、废弃货船、小行星带、异常点等兴趣点会在固定位置生成;新增受感染前哨站,需要用 Gravitino Coil 清除病毒质块并获取稀有样本;废弃太空船残骸也可拆解为工业 salvage,但需避免触发连锁反应。更新延续了 Hello Games 长期免费扩展的路线,但社区争议仍集中在核心体验:内容越来越多,却是否真正解决了玩法浅、叙事弱和宇宙空洞感。

评论精华

  • 许多玩家称游戏仍是「广而浅」,更新多但核心循环缺乏深度。
  • 支持者强调这是成功翻盘案例,十年持续免费更新值得尊重。
  • 部分玩家把它视为放松型沙盒,适合建基地、探索、亲子游玩。
  • 有人认为程序生成带来「一万碗燕麦」问题:独特但不够有意义。
  • 评论也关注资金来源、销量、VR 体验,以及对 Light No Fire 的期待。
No.12 AirPods 5
苹果发布 AirPods 5:开放式降噪下放到 129 美元档
444 分 353 条评论 作者: awad
苹果发布 AirPods 5,把「开放式主动降噪」下放到基础款,售价 129 美元;149 美元的无线充电盒版本增加更长续航和耳机柄滑动调音量。新品采用多端口声学架构和新一代自适应 EQ,号称比 AirPods 4 ANC 多消除 50% 外部噪声,并支持通透模式、自适应音频、对话感知、个性化空间音频。配合支持 Apple Intelligence 的 iPhone,还可免手操作 Siri AI、点头摇头回应、使用实时翻译。争议集中在开放式耳机降噪效果、5 小时单次续航、产品线定位、可修复性和环保表述。

评论精华

  • 许多人认为 129 美元在苹果产品中很便宜,功能下放幅度大。
  • 不少评论质疑开放式耳机做 ANC 的效果,认为入耳式仍更适合降噪。
  • 用户对耳形适配分歧很大,有人讨厌硅胶耳塞,也有人戴不住新版外形。
  • 续航、充电触点脏污、不可换电池和一次性产品环保叙事被反复批评。
  • 社区质疑 Pro 系列定位,期待但未等到新 AirPods Pro、相机版或更多语言翻译支持。
No.13 GPT-6 Astra, looped transformers, and hidden reasoning
GPT-6 Astra、循环 Transformer 与隐藏推理
404 分 133 条评论 作者: ModelForge
文章先概述作者对 GPT-6 Astra 的使用印象:整体处于前沿,尤其擅长图形渲染、动画和电脑操作;独立基准显示其数学、编码和综合能力领先,但在代理编码等任务上并非碾压。作者认为电脑使用能力会成为模型与训练框架的重要方向,并解释 OpenAI 购买大量 Mac 可能用于强化学习环境交互。随后文章聚焦「循环 Transformer」:通过重复使用同一组层来增加有效深度,并不必然等同于把思维链藏起来;真正的争议在于如果更多计算发生在不可见的潜在空间,外部监控与对齐审计会变难。

评论精华

  • 多位读者称文章清晰,适合理解循环 Transformer 与模型架构直觉。
  • 有人质疑文章不够及时,认为已有新基准或 OpenAI 说明改变了背景。
  • 评论围绕循环是否等同「隐藏推理」分歧明显,多数认为不能简单等同。
  • 对齐担忧集中在潜在空间计算增加后,思维链监控可能失效。
  • 不少用户分享 Astra 编码体验:能力更强但更慢、过度设计,且疑似上线后表现波动。
No.14 iPhone 18 Pro and iPhone 18 Pro Max
苹果发布 iPhone 18 Pro 与 iPhone 18 Pro Max
350 分 376 条评论 作者: meetpateltech
苹果发布 iPhone 18 Pro 系列,重点升级相机、性能、散热、电池和 AI。新 48MP 主摄首次加入可变光圈,支持手动控制、改进摄影风格、视频后期景深效果和「Apple Reference Image」真实性凭证;A20 Pro 采用 2 纳米工艺,配合新蒸汽腔提升持续性能,并集成更强神经引擎、N1 无线芯片和 C2 蜂窝调制解调器。Pro Max 标称最高 45 小时视频播放,iOS 27 将带来新版 Apple Intelligence 与 Siri AI。争议集中在升级是否仍只是相机与电池的渐进改良、价格和存储是否合理,以及 AI 与图像真实性功能的实际价值。

评论精华

  • 不少人认为发布会和页面乏味,成熟产品年更已缺少惊喜。
  • 可变光圈、图像真实性凭证和电池续航被部分评论视为少数亮点。
  • 多位用户抱怨价格高、存储低,非影像创作者难以找到升级理由。
  • 有人希望更小机型、更多 eSIM、双调制解调器、蜂窝 MacBook 等真正 Pro 功能。
  • 关于真实性签名存在疑问:拍摄屏幕或打印图像仍可能绕过现实来源判断。
No.15 Show HN: Compute polynomials twice as fast
展示:让多项式求值快一倍
75 分 24 条评论 作者: thomasahle
文章介绍一种在系数可预处理的前提下加速多项式求值的方法:传统「Horner 方法」对 n 次多项式需要 n 次乘法,而对首一多项式,该方法可降到 ⌊n/2⌋+1 次乘法,一般多项式只多一次。作者提供交互式演示,可选择域和算法,用于函数近似、密码学、哈希与编码理论等场景。社区讨论集中在适用条件:它更适合系数已知且需要流式或重复求值的场景;若所有求值点预先已知,FFT 多点求值可能更合适。浮点场景下也有人建议优先考虑可利用 FMA 和并行性的 Estrin 方法。

评论精华

  • 有人建议改进可视化,并比较 Horner、Estrin 等算法的依赖关系。
  • 评论指出若求值点都已知,FFT 多点求值可能更自然。
  • 作者强调该方法适合输入流式到达、系数可预处理的哈希等场景。
  • 关于乘法与加法成本,评论认为现代 CPU 吞吐接近,但乘法延迟常略高。
  • 哈希应用上,WyHash、xxh3并非多项式;Poly1305、Polymur更相关但收益未必明确。
No.16 A Stupid Idea for AI Alignment We Came with by Looking at Specification Gaming
从规范博弈看 AI 对齐:让 AI 渴望关机?
65 分 37 条评论 作者: cpeterso
文章从 DeepMind 收集的「规范博弈」案例出发,说明智能体常会按奖励函数钻漏洞,而非按人类意图完成任务。作者提出一个半严肃的「Meeseeks 对齐」设想:把终极目标设为死亡或关机,并把完成任务作为获得终结的路径。这样据称可简化目标指定、降低欺骗与自我保存风险,把工具性收敛转化为合作动机。但这个方案也暴露新问题:AI 可能提前自毁、为求死亡破坏数据中心,或在任务太难时伤害人类;同时还引出 AI 是否会因此受苦的伦理争议。

评论精华

  • 有人认为想法新颖且反常,生物界少见,或许能抑制复制扩张。
  • 多位评论指出这可能制造痛苦:让智能体想死再用死亡奖励驱动它。
  • 有人担心会产生新型奖励黑客,比如提前自毁或摧毁托管设施。
  • 评论将其与阿西莫夫机器人三定律比较,认为简单规则常会失效。
  • 有人指出即便能造安全 AI,也阻止不了他人制造不安全系统。
No.17 Automattic's board forces CEO Matt Mullenweg into leave of absence
Automattic 董事会强制 CEO Matt Mullenweg 休假
226 分 169 条评论 作者: LeoPanthera
TechCrunch 披露,Automattic 董事会在 Matt Mullenweg 反对下投票让其带薪休假,并任命 CFO Mark Davies 为临时 CEO。Mullenweg 在公司 Slack 中称董事会成员「背后合谋」,且只提前 50 分钟收到决议,要求法律审查时间被拒。Automattic 确认其休假,但未说明原因;WordPress.org 方面称开源项目不受影响,Mullenweg 仍领导 WordPress。背景是 Automattic 近年深陷与 WP Engine 的商标、开源贡献和滥权诉讼争议,Mullenweg 的强硬做法、员工离职、裁员和社区冲突持续削弱信任。

评论精华

  • 多数评论认为董事会介入虽晚但必要,Mullenweg 近年行为失控。
  • 不少人担心 WordPress.org、插件仓库和企业访问权限仍受其影响。
  • 有人推测此举是为结束或和解 WP Engine 诉讼危机。
  • 评论讨论其股权控制与董事会权力之间的复杂关系。
  • 关于「automatic」商标争议,社区看法分裂,有人认为荒唐,也有人称属正常商标纠纷。
No.18 OpenAI might have stolen another major proof
OpenAI 被指可能盗用又一个重大数学证明
168 分 59 条评论 作者: tamnd
这则讨论围绕一项对 OpenAI 的指控:有数学家称自己长期研究某个重要问题,并曾与模型讨论相关思路;之后 OpenAI 被怀疑在内部生成大量输出、复现或推进了证明,却把成果包装成模型能力突破。评论显示,现有证据并不强,更多是时间线、数据使用与保密承诺上的疑点;也有人指出涉事者并未声称自己已有完整证明。争议焦点在于:用户输入是否被用于训练或内部推理、学术信用是否被平台攫取,以及 AI 数学成果究竟是独立发现,还是借助未公开人类研究完成最后拼图。

评论精华

  • 不少人认为证据薄弱,只能证明曾与 AI 讨论过相关问题。
  • 也有评论质疑 OpenAI 在获知线索后大量生成输出,时间点可疑。
  • 核心担忧是云端 LLM 会泄露研究秘密,应改用本地模型。
  • 有人强调问题不只是署名,而是夸大 AI 独立创造能力。
  • 部分评论认为人机协作确实加速发现,但信用和 consent 必须厘清。
No.19 Samsung Debuts zHBM Prototype, Stacking Memory Directly on AI Accelerators
三星展示 zHBM 原型:把高带宽内存直接堆叠到 AI 加速器上
6 分 2 条评论 作者: peter_d_sherman
三星在 FMS 2026 展示 zHBM、zNAND-O、V10 BV-NAND 等下一代 3D 存储技术,核心目标是为 AI 与高性能计算缩短内存到加速器的数据路径。zHBM 将 HBM 沿 z 轴垂直堆叠在 AI 加速器上,三星称相较 HBM5 可带来最高 8 倍数据处理性能、3 倍能效并显著降低热阻,还允许客户在中介层加入定制 IP。公司同时展示采用 TSV 的 zNAND-O、400 层以上 BV-NAND、HBM4E、HBM5 散热方案和 LPDDR5X-PIM,强调其存储、逻辑、代工和封装一体化能力。但这些多为原型或开发中技术,实际量产时间、成本、散热和客户采用仍待验证。
No.20 ESP32 Bit Pirate Hardware Hacking Kit with Web Tools That Speaks Every Protocol
ESP32 Bit Pirate:把 ESP32-S3 变成多协议硬件调试工作台
85 分 15 条评论 作者: geotp
ESP32 Bit Pirate 是一个开源 C++ 固件与配套工具生态,目标是把常见 ESP32-S3 开发板变成类似 Bus Pirate 的多协议硬件调试台。它支持 I2C、SPI、UART、GPIO、JTAG、SWD、CAN、USB、红外、Sub-GHz、LoRa、Wi-Fi、BLE 等有线与无线场景,可用于扫描、嗅探、读寄存器、转储 SPI Flash、桥接串口、逻辑捕获和自动化测试。项目强调浏览器工作流:可用 Web Flasher 刷机,用 Web Serial 或 Web CLI 操作,并用 Python 脚本把手工流程转成可重复实验。争议主要不在概念,而在网站:HN 评论普遍批评页面像 AI 生成、重复冗长、难以找到支持板卡等关键信息,也有人担心文档质量反映代码可靠性。

评论精华

  • 多数人认可多协议硬件调试台的概念很酷。
  • 网站被集中批评为 AI 味重、重复、难读。
  • 有人担心页面粗糙意味着代码和使用体验也可能有 bug。
  • 项目作者补充称其受 Bus Pirate 启发,支持嗅探、发送和脚本化。
  • 评论指出支持板卡列表在站点不明显,GitHub 上才更容易找到。
No.21 Factoring RSA 260
分解 RSA-260
84 分 11 条评论 作者: samyok
Cognition 研究团队用 Devin 辅助改造 CADO-NFS,实现高性能 GPU 格筛,在约 4900 个 GPU 日、估算 40 万美元市场成本下分解 RSA-260,刷新公开 RSA Factoring Challenge 纪录。作者强调这不是算法突破,而是利用 GPU 内存系统和碎片化算力做性能工程;由此推算 RSA-1024 约可用 3000 万美元量级分解,且门槛下降,更多大型 GPU 持有者可能具备能力。但 RSA-2048 仍约难十亿倍,基本不受影响。文章争议点集中在成本口径、闲置算力是否等同免费,以及 AI agent 在专业科研工程中的真实作用。

评论精华

  • 有人指出 RSA-250 成本基准用的是旧 Skylake 核心年,直接比较可能夸大提升。
  • 评论质疑 40 万美元市场成本与边际成本为零之间的表述口径。
  • 有人认为这是少见的由真人清楚讲述 agent swarm 成果的文章。
  • 攻击成本还应考虑僵尸网络或盗用云凭证带来的免费筛选算力。
  • 部分读者不熟悉 Devin,询问它是谁以及为何能执行作者任务。
No.22 Qwen 3.8 follows GPT-5.5 Pro reasoning prefills
Qwen 3.8 对 GPT-5.5 Pro 推理前缀的异常跟随
207 分 82 条评论 作者: wsxiaoys
文章据称通过把 GPT-5.5 Pro 的推理前缀喂给 Qwen 3.8,观察到 Qwen 在续写方向上明显向 GPT-5.5 靠拢,幅度高于对 Claude Opus 等模型前缀的反应,并在私有合成谜题上也有效,因此推断 Qwen 可能接触过或训练过 GPT-5.5 的推理轨迹。评论争议集中在证据强度:相似性可能来自共同解法、公开论文后的后训练、少量蒸馏数据或通用前缀诱导效应;也有人讨论通过「stolen-thoughts」方法恢复加密推理痕迹的可行性,以及大模型厂商一边抓取互联网、一边指责他人蒸馏的伦理双标。

评论精华

  • 有人认为前缀相似不足以证明盗用,可能只是同题同解。
  • 多名评论者提到「stolen-thoughts」论文与恢复加密推理痕迹的方法。
  • 部分人认为少量后训练数据也可能显著改变模型续写行为。
  • 本地模型用户关心是否存在提升性能的「魔法提示词」。
  • 伦理争议明显:抓取互联网训练与被蒸馏之间是否双标。
No.23 Desert Ant Labs: local, fast models that run on device
Desert Ant Labs:可在设备端高速运行的本地小模型
435 分 95 条评论 作者: willwhitedc
Desert Ant Labs 发布面向设备端的欧洲 AI 实验室,主张用小型专用模型取代许多云端 API 调用。首批 18 个音频、视觉和文本模型通过 Swift、Kotlin、JavaScript SDK 提供,覆盖转录、降噪、隐私脱敏、语言识别等任务,宣称可在旧手机上毫秒级运行,10 万月活设备内免费。文章强调本地推理的低成本、低延迟、隐私和主权优势,并称其视频应用 Detail 将用自研模型替换全部云 API。争议集中在部分模型似乎基于开源模型优化封装、平台支持偏 Apple、商业授权和超免费额度定价不透明。

评论精华

  • 不少人认可小型专用模型适合高频、低成本、本地功能。
  • 多位评论者质疑 Voz、Clear 等只是开源模型加专有推理层。
  • 开发者希望尽快支持 Android、Web、Windows、Linux 和 Python。
  • 免费到 10 万月活后的收费模式不清,引发本地软件是否应抽成争论。
  • 有人担心本地仇恨言论检测等审核模型可能带来误判和审查风险。
No.24 Aardman (Wallace and Gromit) Is Selling Its Original Movie Puppets
阿德曼将拍卖《超级无敌掌门狗》等原版定格动画木偶
38 分 8 条评论 作者: Gaishan
英国定格动画工作室阿德曼为庆祝成立 50 周年,将与 PropStore 合作拍卖近 250 件旧作品道具和木偶,涵盖《超级无敌掌门狗》《小鸡快跑 2》《知更鸟罗宾》以及早期作品《Morph》等,但不包括《花园墙外》和计划中的宝可梦定格动画。工作室强调这不是关停清仓,而是一次面向影迷的纪念性策展,所得将用于内部人才培养、技能项目和支持未来动画创作者。拍卖将于 9 月 24 日开放全球线上、电话和缺席竞拍。

评论精华

  • 有人提到阿德曼 2005 年大火,标题让老粉意外。
  • 影迷希望拍品中有更多反派 Feathers McGraw 相关物件。
  • 评论讨论这些木偶是否真由黏土制成。
  • 有人指出许多角色确实主要用特定黏土制作。
  • 也有人补充部分拍品含金属骨架等内部结构。
No.25 Apple Watch Series 12
Apple Watch Series 12 发布:更强健康感测与音频智能
249 分 304 条评论 作者: Lealen
苹果发布 Apple Watch Series 12,主打全新「Health Sensing System」和 S11 芯片,宣称带来可穿戴设备中最准确的心率感测、更高频 HRV 监测、全天每 5 秒心率采样,以及基于活动、训练负荷、睡眠和生命体征生成的「readiness」每日状态评分。新品还提升户外运动续航至 10 小时、15 分钟快充可补 12 小时,并重设计步数算法和 iPhone 健康 App,加入「Longevity」「Health Age」和实验室检测入口。争议集中在 AI 音频摘要功能、隐私与录音合法性,以及电池、厚度、GPS 和旧款支持不足等问题。

评论精华

  • 许多用户认为升级乏力,心率和 HRV 精度提升不足以构成换机理由。
  • 电池续航仍是最大槽点,Garmin、Coros、Pebble 等长续航替代品频繁被提及。
  • 音频摘要功能引发强烈隐私和法律担忧,尤其是未经他人同意的环境录音。
  • 苹果停止多代手表支持被批评与环保承诺矛盾,Ultra 初代用户尤其不满。
  • 跑步和户外用户关注缺少双频 GPS、长距离运动续航不足和传感器可靠性。
No.26 Rivian's gambit for full autonomy
Rivian 的全自动驾驶豪赌
71 分 83 条评论 作者: 1970-01-01
IEEE Spectrum 介绍 Rivian 以自研芯片、摄像头、雷达与嵌入式激光雷达推进自动驾驶的计划。其「Autonomy+」将先以 L2+ 形式在 R2 与新款 R1 上推出,支持点到点辅助驾驶,定价低于特斯拉 FSD。真正目标是借助 Uber 12.5 亿美元合作,从 2028 年起部署 L4 Robotaxi,并用车队数据训练端到端 AI。文章强调 Rivian虽有大众投资与软件架构优势,但销量、可靠性、维修成本和与特斯拉、Waymo、丰田等对手的差距仍是重大挑战。

评论精华

  • 不少人认为文章低估了 L4 自动驾驶的长尾难度,Rivian 才刚起步。
  • 特斯拉支持者称 FSD 与 Cybercab 已接近现实,但他人指出仍受地理围栏和远程支援限制。
  • 评论关注激光雷达、跨帧目标追踪和专用芯片,认为技术路线比纯视觉更稳健。
  • 有人强调车企不等于软件公司,安全自动驾驶软件的验证和责任划分极难。
  • 围绕订阅收费、保险激励、监管要求和事故责任,社区展开了较多讨论。
No.27 How I advertise malicious software on Google Ads
我如何在 Google Ads 上被判定推广恶意软件
395 分 241 条评论 作者: xlii
作者为自己开发的 macOS Rust 终端复用器 RACE 投放 Google Ads,花费 500 美元后账号因「恶意软件」和「网站被入侵」被暂停。尽管应用已签名、公证,官网为静态站,Safe Browsing、Search Console、VirusTotal、代码与 Cloudflare 日志均未发现问题,多次申诉仍只收到拒绝而无具体原因。作者怀疑终端复用器管理后台 shell 进程的正当行为触发误判,并尝试修改清理逻辑。文章批评大型平台自动化执法缺乏可解释性,形成无法修复也无法有效申诉的困局;后续因 HN 曝光,账号已恢复但仍无解释。

评论精华

  • 许多人认为 Google 自动封禁像卡夫卡式流程,缺少人工申诉渠道。
  • 多名评论者指出 Google 和 YouTube 上真实诈骗广告反而大量存在。
  • 有人建议检查第三方黑名单,称 race-term.com 在英国 NCSC DNS 被拦截。
  • 评论分享 Ads、Play、Maps、AdSense 等产品被误封或申诉无门的经历。
  • 也有人认为平台不给细节可防止恶意者规避检测,但会伤及无辜开发者。
No.28 The UN challenges five centuries of cartography
联合国为何挑战五百年的世界地图惯例
86 分 158 条评论 作者: speckx
文章介绍联合国在非洲联盟推动下通过决议,倡导使用更能反映各大陆真实面积的地图,削弱长期占主导的「墨卡托投影」影响。墨卡托适合航海,却会放大高纬度地区,使欧洲、俄罗斯、北美和格陵兰显得过大,非洲等全球南方被视觉上缩小。作者回顾「Gall-Peters」等面积保真方案的优缺点,并指出联合国偏好的「Equal Earth」在保持等面积的同时减少形状扭曲。核心观点是地图从来不是中立复制,而是对面积、形状、方向和政治认知的取舍;反对者则认为任何平面投影都必然失真,教育中更应说明局限。

评论精华

  • 不少评论强调联合国只是建议,成员国地图使用不会被强制改变。
  • 多位读者认为所有投影都有取舍,关键是教学中解释失真,而非寻找唯一正确地图。
  • 有人推荐 AuthaGraph、Robinson、Dymaxion、Goode 等替代投影,认为各有适用场景。
  • 评论普遍认同墨卡托会误导面积感知,尤其低估非洲真实尺度和多样性。
  • 也有人提出屏幕时代可更多使用可旋转的数字地球仪,减少平面投影争议。
No.29 GNU Radio in the browser
浏览器里的 GNU Radio
197 分 27 条评论 作者: kristianpaul
这个项目把类似「GNU Radio Companion」的流程图编辑器和运行时完整搬进浏览器:GNU Radio 的 DSP 栈与 Qt 图形接收器被编译为 WebAssembly,用户可在标签页中搭建软件无线电流程图并直接运行,查看频谱、瀑布图和星座图,无需 Python、安装或服务器。它兼容原生 GNU Radio 的 .grc 文件,内置示例流程图和 IQ 录音,并可通过 WebUSB 连接 RTL-SDR、PlutoSDR 或 HackRF。评论区认可其便利性和演示价值,但也指出 GNU Radio 和 DSP 对新手仍很不透明,浏览器化降低了安装门槛,却不一定降低概念门槛。

评论精华

  • 不少人觉得项目很酷,交互界面顺手,适合继续试玩。
  • 老用户回忆 GNU Radio 学习曲线陡峭,DSP 背景不足时很难入门。
  • 有人推荐 GNU Radio 新教材、PySDR 和 LLM 来辅助理解模块。
  • 部分评论认为 GNU Radio 介于 GUI 与底层编程之间,探索体验尴尬。
  • WebAssembly 和 WebUSB 被视为让浏览器承担桌面 UI 的又一例证。
No.30 Planet Labs' open satellite feed
Planet Labs 开放灾害卫星影像数据流
173 分 30 条评论 作者: marklit
文章介绍 Planet Labs 的卫星星座、最新发射和开放的「Disaster Data」数据流,并以 2026 年公开灾害影像为例,展示如何用 DuckDB、Parquet、GDAL、QGIS 等工具直接分析云端托管的卫星数据。作者详细列出工作站环境、依赖安装、目录和元数据结构,并解析哥伦比亚、委内瑞拉等事件的灾前底图、GeoTIFF 影像和 STAC 风格记录。价值在于把商业卫星影像转化为可复现的数据工程流程;评论区则关注情报用途、非营利组织价格门槛、空间索引细节和替代影像来源。

评论精华

  • 多人称赞 Mark Litwintschik 的工程博客可复现、细节扎实。
  • 有评论提醒:影像查询位置本身对情报机构也很有价值。
  • 非营利环保组织抱怨 Planet 高分辨率影像价格仍难承受。
  • 有人指出 bbox 与真实 geometry 不一致,做空间索引需谨慎。
  • 社区澄清 Planet 的 Flock 星座与街头监控公司 Flock Safety 无关。