No.01
Muse Spark 1.3
Meta 发布 Muse Spark 1.3
540 分
365 条评论
作者: bvaldivielso
Meta 推出 Muse Spark 1.3,被社区视为一次明显追赶前沿模型的发布:评论提到其在 Artificial Analysis 智能指数和 DeepSWE 等基准上接近甚至短暂超过部分主流竞品,尤其强调速度、代码能力和低价。最大讨论点是定价分层:普通版本声称不用于改进产品,而「contributor」版本允许 Meta 使用数据训练,价格低到约二十分之一,被认为对个人开发者和爱好者很有吸引力。争议也集中在这里:有人称赞透明地标出数据价值,也有人担心隐私、Meta 信誉、许可和此前开源权重承诺。另有用户认为 Gemini 3.8 Flash 仍更便宜或更强,Spark 1.2 的实际体验也存在分歧。
No.02
Gemini 3.8 Flash and 3.8 Flash Cyber
Google 发布 Gemini 3.8 Flash 与网络安全版
982 分
560 条评论
作者: bratao
Google 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber,称其在保持 3.7 Flash 速度与低价的同时,显著提升编码、长程代理任务和多步推理能力,输入每百万 token 0.75 美元、输出 3.75 美元。普通版面向开发者、企业和订阅用户,强调会在复杂任务中投入更多推理和工具调用;Cyber 版通过 Fairwind Program 仅向受信防御方开放,主打漏洞发现和自动修复。文章列举 DeepSWE、CyberGym、CWE-Bench、Chrome 与 Wiz 内部评测等成绩,并强调 CBRN、网络攻击和提示注入防护。争议集中在基准可比性、真实延迟、Google 产品入口混乱,以及 Flash 系列实际开发可靠性是否匹配榜单表现。
No.03
The Computer Museum of America reclamation project
美国计算机博物馆藏品重启整理计划
32 分
11 条评论
作者: rbanffy
原美国计算机博物馆及圣迭戈计算机博物馆的藏品,已在圣迭戈州立大学图书馆地下室保存 21 年。2025 年一笔捐赠让团队开始重新索引、募资和宣传这批资源。文章强调,这可能是全球最大的计算机革命与信息时代实物和档案库之一,不只包括硬件,也有杂志、爱好者通讯、软件、书籍和手册。作者认为,计算机技术在过去 70 年深刻改变了人类工作、学习和娱乐方式,这批藏品可帮助社会学、工程、历史、人类学等领域研究这种变化如何发生。评论则更多转向现实难题:计算机博物馆很难长期维持,尤其是让设备保持可运行。
No.04
Holden's Lightning Flight
霍尔登的闪电战斗机意外飞行
143 分
27 条评论
作者: ColinWright
1966 年,英国皇家空军工程军官沃尔特·霍尔登在莱纳姆基地为一架英制电气「闪电」截击机做地面电气故障测试时,误把油门推过加力燃烧门槛。没有头盔、无线电和座舱盖,弹射座椅处于地面惰性模式,起落架也被锁定放下,他被迫起飞,并险些撞上油车和正在起飞的彗星客机。霍尔登凭早年小型教练机经验绕场三次,最终尾擦地着陆,飞机仅轻微受损并重返服役。调查认为他未违反当时命令,也确实挽救了自己和飞机;事件随后促成相关地面测试规程修订。
No.05
Pre-Release of Polars 2.0
Polars 2.0 预发布:默认启用流式引擎与更严格 API
8 分
0 条评论
作者: komape
Polars 发布 2.0 首个候选版,正式版将在数周内推出。此次大版本并非主打新功能,而是清理旧设计、调整默认行为。最大变化是 LazyFrame 查询默认使用「流式引擎」,官方预计整体可带来约 5 倍性能提升并显著降低内存占用,但 join、group_by、unpivot 等操作默认不再保证行顺序,需要通过 maintain_order 显式开启。2.0 还强化了「严格、快速失败」原则:is_in 不再默认进行可能有损的类型转换,横向 concat 默认要求高度一致,字符串转日期、枚举与整数互转等模糊 cast 被专用方法取代。新版还增加了删除属性和参数的专门异常,帮助用户迁移到新 API。未来 2.x 还计划推进真正的 out-of-core、IO 插件、S3 读取、SQL、成本优化器和异步管线。
No.06
Google avoids a breakup of its ad tech business
谷歌广告技术业务避免被拆分
358 分
260 条评论
作者: donohoe
《纽约时报》报道,在美国司法部广告技术反垄断案中,谷歌虽已被法院认定在相关广告技术市场存在垄断行为,但最新补救措施没有要求拆分其广告技术业务。争议集中在:涉案部分主要是 Google Ad Manager、广告交易所和发布商广告服务器等「广告技术」环节,而非 Alphabet 更庞大的搜索广告收入;该业务年收入约 300 亿美元,占 Alphabet 约 8%,且已连续多个季度下滑。评论区普遍认为处罚力度不足,担心谷歌只需承诺停止滥用行为即可过关;也有人指出拆分复杂、法院需按法律和具体市场界定裁决,不能简单等同于惩罚整个谷歌广告帝国。
No.07
Three sites made 215,128 “best software” pages for AI. Perplexity cites them
三家新站批量制造 21 万个软件榜单,被 Perplexity 引用
393 分
190 条评论
作者: jakobgreenfeld
文章测试 Perplexity 的 sonar 与 sonar-pro:向 380 个软件采购类别提问,收集 7534 条引用。结果显示近六成引用来自 Tranco 排名 10 万名以后的网站,23.4% 不在前百万;部分新域名在 2023 年后才出现。Guideflow 这类非评测站的营销博客成为第三大来源。作者还发现 wifitalents、worldmetrics、gitnux 三站疑似同一运营方,批量生成 21.5 万个「最佳软件」页面,并用「Facts & Grounding Page」等面向检索系统的描述吸引 AI 引用。文章认为 AI 搜索的检索层缺乏来源怀疑,可能被专为被引用而生的内容污染;但评论也质疑文章本身像 AI 生成、且可能同样是反 Perplexity 的内容营销实验。
No.08
Creating Backup Storage Sucks
搭建个人备份存储为什么这么烦
41 分
35 条评论
作者: smarmelling
作者尝试用免费方案实现个人文件的「3-2-1」备份:主力 mini-PC 保存 Sync 目录,经 Syncthing 同步到另一台充当 NAS 的小主机和 Windows 笔记本;手机和平板则靠 Tailscale 远程访问。第二层用移动硬盘和 restic 做本地加密压缩备份,第三层尝试用 Google Drive 免费空间做异地备份,并处理照片、邮件等边缘问题。文章的价值不在给出最佳实践,而是记录普通用户在同步、备份、移动端访问、文件系统兼容和免费云存储之间反复妥协的真实过程。评论普遍指出作者混淆了同步、主存储和备份,建议把 NAS 作为数据真源,并强调离线、不可变和定期恢复演练的重要性。
No.09
Can I opt out of my input or output data being used for training?
Mistral 数据训练退出方式说明引发隐私争议
428 分
188 条评论
作者: teekert
Mistral 帮助页说明,在特定情况下,用户输入与输出内容可能被纳入模型训练,包括对话、文档和用户上传内容。不同产品的退出路径不同:Vibe 可在管理面板隐私设置中关闭「允许交互用于训练模型」;移动端需在「数据与账户控制」中取消「启用数据共享」;Mistral Studio 与 API 则可在管理面板关闭「匿名改进数据」。争议焦点在于部分服务默认并非退出训练,企业版与普通用户待遇不同,社区担心付费产品也默认收集数据,并质疑其作为欧洲隐私友好替代方案的定位。
No.10
Reverse Engineering Unknown File Formats with ImHex
用 ImHex 逆向未知文件格式
178 分
34 条评论
作者: carlos-menezes
文章以游戏 FEZ 的二进制存档为例,展示如何从未知文件格式一步步推导出完整结构定义。作者先用 ImHex 观察文件是否压缩、加密或有魔数,再定位游戏的 C# 程序与保存逻辑,通过反编译找到 BinaryWriter 写入字段的顺序。随后把 DateTime、版本号、可空对象、字符串、7-bit 编码整数、键值对列表等逐一映射到 ImHex 的「Pattern Language」,让十六进制数据变成可读结构。文章价值在于把逆向流程具体化:不是凭空猜格式,而是结合样本、上下文、代码路径和可执行模式定义迭代验证。
No.11
Launch HN: RonanRX (YC S26) – Personalized Peptides and GLP-1s
RonanRX:个性化肽类药物与 GLP-1 服务
56 分
62 条评论
作者: lloydarmbrust
RonanRX 是一家 YC S26 公司,主打个性化肽类药物和 GLP-1 减重治疗,试图把远程医疗、医生处方、反馈式剂量调整和药物制造供应链垂直整合。创始人称目前与伙伴共同生产 API,未来 9 个月内部分内化,核心护城河在于根据患者反馈与医生审核实现个性化处方,而非单纯复制现有 GLP-1 诊所。HN 讨论集中在法律与监管风险:复方药房豁免、FDA 供给判断、专利诉讼、非 FDA 批准药物能否推荐等;也有人质疑这与灰色市场或普通远程 GLP 服务差异不够。另一个高频反馈是官网文案明显 AI 化、缺乏医疗信任感,但部分评论认可其供应链和反馈闭环方向。
No.12
Higher Multipoles of the Cow
球形奶牛的高阶多极展开
57 分
17 条评论
作者: MrOrelliOReilly
这篇 arXiv 论文以物理学笑话「球形奶牛」为出发点,严肃地套用多极展开框架:把球形奶牛视为零阶近似,并进一步定义非球对称奶牛的几何、多极系数、势场与相互作用。作者还用基准奶牛演示计算方法,讨论旋转奶牛因引力波辐射而自旋减慢等在球对称下会被抹去的效应。文章显然带有愚人节论文色彩,但也借幽默形式解释了为什么物理建模常从对称近似出发,以及高阶修正何时变得重要。
No.13
Fable 5.1 World Modeling
Fable 5.1 生成可漫游 3D 世界
222 分
65 条评论
作者: surreal_
PhiloLabs 展示了用 Fable 5.1 生成交互式 3D 世界的实验:例如旧金山 Union Square、京都手绘风场景等,可在浏览器中漫游,包含街道、店招、车流和行人逻辑,甚至由智能体在场景内录制导览视频。作者称 Union Square 是一次性生成,但依赖很长提示词、子代理和自检循环,约耗时 2 小时、成本约 33 美元。评论认为效果漂亮,展示了用代码生成世界而非直接产 mesh 的潜力;但也质疑标题中「world model」含义混乱、成本过高、缺少 GitHub Pages 演示、拓扑/纹理/优化与大型游戏可用性仍不足。
No.14
LLMs and Self-Referentiality
LLM 与自指性的失落神话
20 分
9 条评论
作者: mavdol04
Scott Aaronson 反思《哥德尔、艾舍尔、巴赫》等思想传统曾把智能与「自指」「怪圈」紧密相连,甚至 Penrose 也从相反立场认为哥德尔式自指限制了机器智能。但 2026 年的 LLM 已在许多可判定智力任务上超越多数人类,而其技术栈并未显式内置自指机制;模型谈论自身、哥德尔或自指,只是大规模预训练和语言普适性的副产物。作者认为,真正被验证的是「智能即预测、预测即压缩」这一脉络,而非自指作为会话智能前提的观念。不过意识和主观体验是否仍与自指相关,仍未解决。
No.15
Show HN: OwnTime – a chess clock for your day's priorities
展示:OwnTime,用棋钟管理每日优先事项
61 分
29 条评论
作者: fmos
OwnTime 把一天当作一盘棋:用户先设定少数优先事项和每日时间预算,同一时间只有一个倒计时运行,切换任务会自动暂停其他计时;预算耗尽时触发闹钟,午夜重置。它主打 iPhone 与 Apple Watch,手表可快速查看和启停,并支持 Siri、快捷指令和 Ultra 动作按钮。作者强调它关注想把时间花在哪里,而不是事后追踪损失;数据不上云、无账号,可导出完整 SQLite 历史自行分析。社区总体认可概念和执行,但也提出 Android 缺席、计时应支持正计时、循环提醒、配色主题、界面文案和示例含义不够清楚等改进点。
No.16
Wendell Berry has died
温德尔·贝里去世
177 分
95 条评论
作者: Curiositry
《纽约时报》讣告报道,美国作家、诗人、农民与社会批评家温德尔·贝里去世。评论区回顾他以《美国的失落》《杰伯·克劳》等作品影响农业、地方共同体、生态伦理与技术批判讨论;许多人称他身体力行,提醒现代社会追问「人的尺度」、好工作与土地责任。争议集中在他对技术和工业农业的怀疑:支持者认为他不是反对工具本身,而是反对脱离共同体与责任的规模化体系;批评者则认为他浪漫化前现代农耕,忽视贫困、饥荒和现代技术带来的解放,也有人质疑其立场的现实可行性。
No.17
Biggest dark matter detector spots a single weird particle
最大暗物质探测器捕捉到一个异常粒子事件
280 分
95 条评论
作者: randycupertino
Science 报道称,位于南达科他地下金矿旧址、使用约 7 吨液氙的 LUX-ZEPLIN 暗物质探测器,在 2.8 吨年数据中发现了一个难以归类的异常事件。研究团队排查了放射性背景、宇宙射线、重建错误等常见来源,但仍无法确定其性质;若为真实信号,可能暗示比传统「WIMP」更复杂的暗物质或其他新物理。不过社区普遍强调,单个事件统计意义很弱,约一百到数百分之一的偶然概率远不足以构成发现。后续三倍数据尚待处理,若出现更多类似事件才可能改变判断。
No.18
Aging brains blend memories together instead of just forgetting them
衰老大脑并非只是遗忘,而是会把记忆混合在一起
263 分
115 条评论
作者: mdp2021
文章称,一项关于记忆与年龄的研究发现,年长者的记忆错误不只是信息消失,更常表现为把相近事件、地点、人物或时间线混合,类似细节层面的「串线」。评论指出,这与照护失智亲属、个人回忆被照片校正、梦境混入现实等经验相符;也有人认为记忆本来就是每次提取都会被重写的主观重构。争议集中在研究样本很小、年龄段分布不足,难以证明是生物衰老导致,还是一生累积信息过多、重复经历增多、睡眠和昼夜节律变化等因素所致。另有读者质疑报道本身可能是 AI 生成的低质科普。
No.19
Qantas Airbus A380 engine failure in 2010 (2023)
澳航 32 号航班 A380 发动机爆裂事故
123 分
76 条评论
作者: gumby
文章回顾 2010 年澳航 QF32 空客 A380 在新加坡起飞后遭遇罗尔斯·罗伊斯 Trent 900 发动机非包容性涡轮盘爆裂的事故。评论显示,根因可能是油管加工中仅约 0.2 毫米的偏差导致润滑油泄漏、起火并引发涡轮盘超速解体,碎片击穿机翼、燃油箱和多套系统。飞机虽严重受损且超重、部分功能失效,但依靠 A380 冗余设计和驾驶舱多名高经验飞行员,最终安全返航,无人伤亡。讨论焦点集中在极限工程容差、制造与质检失误、非包容性发动机故障几乎无法完全防护,以及澳航安全声誉与空客设计的作用。
No.20
Engineering of the fastest WebAssembly interpreters
最快 WebAssembly 解释器的工程实践
86 分
6 条评论
作者: herobird
Wasmi 2.0 发布,核心目标是重做执行引擎并提升 WebAssembly 解释性能。作者称新版在 Apple M2 Pro 的 wasmi-benchmarks 几何平均上比 Wasmi 1.0 快约 2.2 倍,并在 Apple、AMD EPYC、Intel Xeon 等平台上跻身最快的可移植 Wasm 解释器之列,同时保持优秀启动性能。文章重点解释了四种指令派发模式、统一执行处理器签名、调用约定限制、累加器寄存器、默认线性内存快速路径等工程取舍。争议点主要在于这类解释器与原生执行或 JIT 编译运行时的差距:社区认为即便解释器很快,也远未接近原生。
No.21
Exit the Cave
走出洞穴
250 分
90 条评论
作者: akkartik
作者反思当下流行的私下苦练式「洞穴」叙事:独处训练、打磨产品或自我优化看似自律,却也容易让人把可控投入误认成真实进展。借高中摔跤经历,他发现技术和体能重要,但真正的检验来自赛场;自己长期只是避免失败和羞耻,并非真正追求胜利。文章主张任何有价值的追求都需要面对现实反馈:作家要读者,创业者要客户,运动员要对手,恋爱也要承受被拒绝。评论区则质疑作者把失败归因于「不够想赢」过于简化,也强调内在满足、长期练习和公开检验之间需要平衡。
No.22
The shrinking landscape of linguistic diversity in the age of LLMs
LLM 时代,语言多样性正在收缩
132 分
113 条评论
作者: Anon84
这篇 Nature Human Behaviour 论文研究了 7 个跨领域数据集、超过 88 万篇文本,认为 LLM 作为写作助手的普及会在保留核心内容的同时压平个人风格。作者发现,经 LLM 润色或改写后,写作复杂度方差显著下降 21–50%,并更强化主流群体特征、削弱少数或个体化表达。这意味着语言中原本可用于识别身份、心理状态、社会背景的信号会被稀释,可能影响心理诊断、个性化服务、招聘评估和文化保存。争议在于:统一风格是否能提升清晰度,还是会把写作、思考和文化差异一并商品化。
No.23
Altair Basic Interpreter Source Code (1975) [pdf]
Altair BASIC 解释器源码(1975)
56 分
33 条评论
作者: Eridanus2
这份 PDF 公开了 1975 年 Altair BASIC 解释器的早期微软源码,被视为微软创立起点的重要文物。评论关注其历史价值:盖茨和艾伦在约两个月内完成可运行 BASIC,代码注释密集,且 4K 版本仍支持单精度浮点,显示当时在极小内存中的工程取舍。争议集中在来源与原创性:有人认为应承认 DEC 和 Dartmouth BASIC 的影响,甚至质疑是否参考了 DEC 源码;也有人指出微软 BASIC 的实现路线不同。社区还讨论了源码保存、早期软件共享文化,以及微软 BASIC 因授权给多家硬件厂商而流行的商业背景。
No.24
Async Rust vs RTOS showdown (2022)
Async Rust 与 RTOS 的嵌入式对比
80 分
42 条评论
作者: kooi
文章把 Embassy/Rust 的异步执行模型与 FreeRTOS/C 放到 STM32F446 微控制器上对比,目标不是讨论 Rust 与 C 语言本身,而是比较两种并发模型在较普通嵌入式程序中的表现。作者设计了 LED 闪烁、按钮中断状态共享、消息队列串口输出等任务,并计划用示波器测量 GPIO 中断耗时、任务恢复延迟、程序体积和静态内存占用,同时讨论编程体验。核心背景是 Rust future 通过轮询和 waker 运行,Embassy 采用静态任务、无分配器和协作式调度;RTOS 则保存线程上下文并支持抢占。争议集中在测试负载偏轻、串口瓶颈、异步并非 RTOS,以及文章年代较早。
No.25
A Selection of Los Alamos Rolodex Business Cards
洛斯阿拉莫斯名片夹中的冷战科技名片
160 分
41 条评论
作者: 1970-01-01
这组图片展示了来自洛斯阿拉莫斯相关名片夹的商业名片,原文正文很短,核心价值主要在视觉与历史材料本身:这些名片记录了围绕国家实验室、军工、核技术、电子器件、爆炸技术和高技术小公司的生态。社区讨论把它视为冷战时期科技产业文化的切片:公司名称常显得像科幻或游戏设定,设计却比今天许多名片更朴素、有辨识度。争议不多,更多是怀旧、考据与延伸发现,包括电话格式年代、Rolodex 打孔导致信息被裁切,以及这些实验室废弃物来源于 Ed Grothus 的「The Black Hole」收藏。
No.26
Nango (YC W23) is hiring across eng, product and GTM (SF and remote)
Nango 招聘工程、产品和 GTM 岗位
1 分
0 条评论
作者: bastienbeurier
Nango 正在招聘工程、产品和 GTM 岗位,工作地点包括旧金山和远程。公司强调全远程协作、以结果而非工时衡量产出,并以开源、透明和开发者友好为核心文化。岗位面向开发者工具领域,团队希望成员为同行解决熟悉的痛点,并通过快速反馈循环改进产品。原文还突出其技术挑战,包括开发者体验、高规模系统和 API 碎片化等问题;团队由来自开发者基础设施公司的资深人士带领,并称收入与使用量正在快速增长,认为当前是加入的合适时机。
No.27
We could save petabytes of cache storage with Zstandard and Pingora
Cloudflare 用 Zstandard 和 Pingora 扩大缓存容量
104 分
40 条评论
作者: torutofu
Cloudflare 原型「Cache Transcoding」在 Pingora 缓存写盘前,把符合条件的未压缩文本响应用 Zstandard level 3 压缩,缓存内和跨数据中心传输都保持压缩态,面向客户端再解压。测试中合格资产平均缩小约 2.8 倍,CPU 额外成本仅数个百分点,可换来 PB 级有效缓存容量和 Tiered Cache 带宽节省。系统只处理 200 OK、无 Content-Encoding、可压缩文本、长度至少 4 KiB 的对象,避开媒体、Range、预压缩和未知长度响应。争议集中在术语是否应叫转码、Range 请求如何高效支持,以及是否应按冷热内容选择性压缩。
No.28
Poisson Disk Sampling
泊松圆盘采样
155 分
19 条评论
作者: vismit2000
文章介绍 Robert Bridson 2007 年一页论文中的「泊松圆盘采样」算法:在随机放置树木、图形采样或模拟对象时,既保持随机感,又保证点之间有最小距离。核心做法是用网格加速碰撞检测,并从已有点周围环带生成候选点。作者进一步提出两类优化:二维中利用父子点关系排除必然无效的角度区间;通过调整半径采样分布,让新点更靠近或远离父点,以提高密度。但过度追求密度会产生线状、空洞等伪影,削弱随机感,因此需要在紧密填充和视觉自然之间折中。
No.29
Reasons robotics is hard
为什么通用机器人如此困难
82 分
47 条评论
作者: ddp26
文章认为,AI 在知识工作中进展显著,但物理世界里的通用机器人远未出现类似 ChatGPT 的突破,公众主要只能看到易被剪辑和挑选的演示视频。作者逐项梳理难点:人手的自由度、触觉密度、灵巧性和耐用性极难复制;复杂视觉理解、任务分解、实时反应、上下文判断、协作、安全速度、力量、续航和移动能力都尚未解决。LLM 依赖海量文本数据成功,而机器人缺少同等规模的物理交互数据。文章并非否认机器人进步,而是提醒不要把实验室演示误读为可规模化的人工劳动替代。
No.30
WebLLM: high-performance in-browser LLM inference engine
WebLLM:浏览器内高性能大模型推理引擎
112 分
17 条评论
作者: saikatsg
WebLLM 是 MLC AI 的浏览器端大语言模型推理引擎,核心卖点是在本地浏览器中通过 WebGPU 运行模型,避免服务器推理并提升隐私与离线能力。评论区反馈显示,它曾被用于个人项目,但当前争议集中在可用性与维护状态:有人认为项目长期未更新,模型支持停留在 Gemma 2 附近,建议改用 Transformers.js;也有人提醒每个浏览器会话可能下载 500MB 到 1GB 模型文件,产品接入时应明确告知。实际运行门槛也较高,多个用户遇到 WebGPU 不可用、浏览器 flag、硬件加速和 GPU 限制错误,说明它更像面向实验和特定环境的技术方案,而非开箱即用的生产级组件。
评论精华