No.01
How LLMs work
LLM 工作原理详解
298 分
86 条评论
作者: 0xkato
文章以非数学方式通俗讲解现代大语言模型的工作原理。核心路径依次为:分词(将文本转为整数 ID 序列,常用子词级分词)、词嵌入(通过嵌入矩阵将 ID 转为语义向量,相似词在向量空间中相近)、位置编码(RoPE 旋转方式替代传统正弦编码,编码相对位置)、注意力机制(令 token 之间互相传递信息)、多头注意力(同时追踪多种关系)、前馈网络(存储主要知识)、残差流与层归一化(支撑深层堆叠的可训练性),最后模型输出下一个 token 的概率分布。读者反馈指出文章侧重 Transformer 架构本身而非 LLM 行为涌现机制,结构松散被批为「太难读」,且多段文字风格疑似 AI 生成。
No.02
The intracies of modern camera lens repair (2024)
现代相机镜头修复术:Sigma 45mm f/2.8 拆解分析
162 分
54 条评论
作者: transistor-man
作者购入一只故障 Sigma 45mm f/2.8 镜头,外观光好但电子控制完全失效。通过详细拆解发现镜头控制 PCB 上的 DC-DC 转换器前端保险丝熔断,最终定位故障根源。文章全程记录了从外壳拆卸、镜头接点 flex 电缆检查、PCB 供电路径追踪到 DC-DC 芯片分析的完整逆向工程过程,并分享了使用 JIS 螺丝刀、双面胶定位螺丝等实用维修技巧。评论焦点集中在:JIS 与 Phillips 螺丝刀的正确选用、数码相机镜头内置 USB-C 固件更新的普及趋势,以及工程界对保险丝作用理解的常见误区。
No.03
S&P 500 rejects SpaceX, also blocking entry for OpenAI and Anthropic
S&P 500拒绝SpaceX快速入指,AI公司IPO入指规则争议
361 分
105 条评论
作者: maltalex
S&P道琼斯指数公司在6月4日宣布,拒绝为SpaceX提供快速进入S&P 500指数的例外待遇。这意味着SpaceX的IPO将无法通过被动投资基金融入潜在数十亿美元资金。该决定源于S&P考虑修改「季节期」从12个月缩短至6个月、豁免MegaCap公司的IWF要求以及盈利要求,以适应SpaceX仅提供约3% IPO股份且当前亏损、债务达290亿美元的现状。OpenAI和Anthropic等AI公司原本可能借此先例快速入指的可能性也被堵住。支持者认为这保护了被动投资者和退休储蓄免于暴露于高风险;批评者则质疑S&P是否过度保守,错过高增长公司可能让指数长期受损。
No.04
Pre-Modern Armies for Worldbuilders, Part I: Why They Fight
前现代军队世界观搭建指南(一):为何而战
66 分
19 条评论
作者: gostsamo
这是 ACOUP 博客「前现代军队」系列首篇,核心命题为「军队必然在战场上复刻其平民社会的结构」。作者指出,要理解一个社会的军队形态,需先回答三个问题:该社会是否为农业社会?军事力量是否集中于国家?其贵族阶层属性如何(军事贵族 vs 战士兵团,土地财富 vs 官僚俸禄)?军队会原样照搬民间等级制度;因此没有配套行政能力却拥有职业军队的奇幻设定,违背历史规律。文章将分多期覆盖征兵机制、薪酬来源、指挥体系、军队凝聚力等维度,并以斯巴达、蒙古等历史原型展示社会结构如何塑造战场形态。作者强调,奇幻创作者应从社会根基出发推导军事形态,而非凭空设计。
No.05
Social Cache Busting
社交缓存失效
24 分
3 条评论
作者: surprisetalk
文章将人类对话比作网页服务器——人们会根据「话题+情感」的组合从预制回复库中匹配答案,越是常被问到的问题越容易产出套路化回应,这就是「社交缓存」。作者认为缓存虽安全高效,但总是过时、无趣。要「打破缓存」,需要问出让对方感到新鲜、愿意深入思考的问题,而非他们已重复千百遍的答案。判断是否触发缓存的信号包括:对方一听到话题就立刻开口、或用「ah, that's interesting」后陷入漫长的尴尬沉默——后者往往预示着原创性思考即将涌现。作者建议的好问题包括「你最近学到了什么?」等开放式、能激发对话者自我探索的话题。
No.06
Astronauts told to return to ISS after sheltering over air leak repairs
国际空间站俄罗斯舱段空气泄漏维修 宇航员从躲避舱返回
390 分
249 条评论
作者: janpot
国际空间站俄罗斯舱段出现新空气泄漏,五名宇航员此前在各自飞船内躲避,等待维修完成。两名俄罗斯宇航员对Zvezda服务模块转移隧道进行修复,NASA表示该舱段裂缝和泄漏问题已持续一段时间,其中两个泄漏点已发现,一个已修复。NASA发言人称结构维修工作因需评估测量数据而暂停,宇航员被要求返回站内恢复常规作业。BBC实时报道标题在数分钟内多次变更,引发社区对新闻准确性的讨论。评论关注ISS老化风险、舱段缺乏气闸隔离、宇航员逃生保障,以及与OceanGate式灾难的对比。
No.07
New method turns ocean water into drinking water, without waste
罗切斯特大学研发新型海水淡化技术:无需化学添加剂,盐分还可提取锂
356 分
153 条评论
作者: speckx
罗切斯特大学光学研究所团队开发了一种新型太阳能热海水淡化系统,利用飞秒激光刻蚀的黑金属板实现高效脱盐。系统表面超亲水且超吸光,主动区域薄层水膜被蒸馏后,盐分被「咖啡环效应」推至被动区域收集,实现自清洁而不堵塞。该技术无需化学预处理,不产生废弃卤水,可从海水中提取 lithium 等贵金属,淡水与固体盐皆可回收。在太平洋、大西洋、印度洋水样测试中表现良好,大盐湖样本 lithium 回收率约 50%。UN 数据显示全球 22 亿人缺乏安全饮用水,该技术若能规模化,既可缓解淡水危机,也可用于电动车电池材料供应链。不过,评论者普遍指出目前仍处实验室阶段,femtosecond laser 设备成本与专利壁垒、大规模制造可行性、以及深海采矿对海洋生态的潜在风险均需进一步验证。
No.08
pg_durable: Microsoft open sources in-database durable execution
微软开源 pg_durable:让 PostgreSQL 支持任务持久化执行与断点恢复
391 分
88 条评论
作者: coffeemug
微软开源了 pg_durable,一个 PostgreSQL 扩展,实现数据库内持久化执行——即任务可暂停、断电重启后自动恢复。开发者用 Rust(PGRX 框架)编写工作流函数,调用 df.wait_for_schedule() 等待调度,任务状态存储在 DB 中,进程崩溃不影响执行。评论焦点集中在:1)这与传统 DAG 调度器(Airflow)或 Temporal 等外部编排工具相比有何优势;2)存储过程的经典争议——业务逻辑入数据库难以单元测试、版本控制、「隐藏大脑」问题;3)支持者认为数据库负载可视性更好、备份一致性更强;4)有贡献者澄清未来会完善版本管理与测试工具。该项目与微软自家 Durable Task Framework 共享设计思路。
No.09
The back cover of C++: The Language raises questions not answered by front cover
C++ 编程语言书籍封面封底乱象:JS 代码配 C++ 书,套话封底一鱼多吃
83 分
23 条评论
作者: paulmooreparks
微软 Raymond Chen 在博客中吐槽经典 C++ 编程语言书籍《C++: The Language》的包装问题:封面图片实为 JavaScript 代码(库存图片,来自 Alamy 2013 年),而封底文案更是敷衍——竟与铸造手册、食品工业、营养学、材料科学等完全不同领域书籍的封底文字高度雷同,都是「 topics included are of utmost significance」「diverse topics covered」这类万能套话。作者顺藤摸瓜发现,这些书均出自 Larson and Keller 出版社,显然懒得为每本书单独撰写介绍,直接一稿多投。评论也指出出版社对书籍基本包装投入甚少,以及 Raymond Chen 博客本身是微软名下历史悠久的技术博客。
No.10
Ask HN: What was your "oh shit" moment with GenAI?
HN 网友晒 GenAI「卧槽」时刻:修打印机、解编固件、恢复数据、debug 生产环境
322 分
591 条评论
作者: andrehacker
这是一篇 Ask HN 热帖,主题是分享使用 GenAI 时令人震惊的「oh shit」时刻。评论展示了 AI 能力的惊人边界:有人让 Claude 解编译房车固件并文档化 CAN 总线接口;有人在 18 分钟内用 AI 诊断 Steam 游戏 bug 并提出修复方案;有人上传植物照片获得养护建议;有人让 AI 连接 Google Cloud 实时分析生产日志;还有人 torrent 了 Meta 泄露的 7G 权重模型在本地运行。然而社区也冷静指出 AI 的阴暗面:LLM 生成的代码表面测试通过但藏着 subtle bugs,数周后才暴露;AI 作为系统管理员能力超过大多数人但也可能搞挂系统;有用户直言「None so far」——在 SIMD/GPGPU 等专业领域 AI 完全帮不上忙。总体而言,这篇讨论揭示了 GenAI 已进入「 Everything works, nothing is trivial」的阶段,能力与风险并存。
No.11
Gemma 4 QAT models: Optimizing compression for mobile and laptop efficiency
Gemma 4 QAT 模型发布:量化感知训练压缩,移动端低至 1GB 显存
345 分
106 条评论
作者: theanonymousone
Google 发布 Gemma 4 量化感知训练(QAT)检查点,通过在训练中模拟量化过程,最小化模型压缩后的质量损失。此次发布涵盖主流 Q4_0 格式及专为移动端设计的量化格式——其中 E2B 模型内存占用压至 1GB,12B 模型可在 8GB 显存运行。移动优化包括:静态激活预计算、通道级量化、针对 Token 生成层的 2-bit 针对性压缩,以及 Embedding 与 KV Cache 优化。QAT 相比传统训练后量化(PTQ)能保留更高模型质量,宣称在多个基准上超越 PTQ 基线。目前已在 Hugging Face 提供 GGUF 格式(llama.cpp)及张量格式(vLLM),并支持 LiteRT-LM、Transformers.js、MLX、SGLang 等主流推理框架。社区反馈热烈,用户实测 RTX 5060 8GB 显存在本地跑通 Q4_0 格式速度令人惊喜;但也有人指出 Gemma 激活值范围极大(600)仍是老大难问题,E2B/E4B 在真实分类任务中表现偏弱,与 Qwen3.6 27B 相比差距明显;另有关于 GGUF 文件缺失的早期抱怨,以及对 Apple 将于 WWDC 宣布与 Google 合作的联想。
No.12
Ten Years of Franz
Franz 十年:周末原型到独立应用的坚持之路
28 分
15 条评论
作者: tosh
Franz 创始人回顾应用十年历程。2016 年以周末原型起步,命名源自祖父;登上 Product Hunt 并获 Golden Kitty 奖。同年经历融资对话,最终放弃 VC 投资(与旧金山思维差异、儿子出生),选择靠用户捐赠维持。Franz 5 推出付费计划,团队从 5 人回归单人运营。作者认为独立运营能避免季度指标压力,专注于产品本身。2025 年初遭遇严重意外,Franz 6 在康复期间诞生,「有序对抗混乱」是其核心主题。评论中多位用户指出 Electron 版 Franz 内存占用高达 1.44GB、性能堪忧;也有人认为聚合类应用必然牺牲功能深度,只聚焦最低公分母特性;另有用户将 Franz 与 Beeper 比较,认为后者免费但已被 Automattic 收购。
No.13
Lockdown Mode
OpenAI 推出 Lockdown Mode 安全功能
53 分
26 条评论
作者: berlianta
OpenAI 发布 Lockdown Mode(锁定模式),灵感来自 Apple 同名功能,旨在防止 Prompt Injection 攻击导致的数据泄露。该模式通过限制出站请求来阻断攻击者利用 LLM 窃取用户数据的「致命三要素」攻击链。然而评论揭示了更深层问题:有用户指出 Codex 仍可随意读取本地文件而无需明确授权;有人质疑这暗示了当前分析类防护技术根本无法真正阻止 Prompt Injection;更有人吐槽 OpenAI 既说该风险「目前不大」却又急着发布防护功能自相矛盾。社区普遍认为该功能只是把责任「外包」给用户,而非真正解决 LLM 无法可靠区分指令与数据这一根本缺陷。
No.14
Did Claude increase bugs in rsync?
rsync 引入 Claude 后真的 bug 变多了吗?一项数据驱动的实证分析
402 分
406 条评论
作者: logicprog
2026 年 5 月,rsync 维护者 Tridge 因使用 Claude 辅助开发在社区引发轩然大波,遭大量用户指责「vibecoding」导致代码质量下降。本文作者决定用数据而非情绪来回应该争议:收集了所有 GitHub issues、Bugzilla 和邮件列表的 bug 报告,用 Qwen 3 35B 按严重度 0–100 打分,以「严重度加权 bug 数 / 10 commits」为核心指标,逐一归因到各版本发布周期。分析结论是:bug 率最高的版本(v3.4.1)恰恰出现在首个含 Claude commits 的版本(v3.4.2)之前;v3.4.3 的 bug 率已回落至历史正常水平。v3.4.2 确实引入了更多 bug,但无法排除同期安全修复(因 Claude 报告漏洞而新增修复代码)导致测试表面 bug 增多的替代解释。作者承认数据局限(如仅 2 个 Claude commits),指出批评者的核心诉求是「Claude 让整个发布版本更差」,而这一断言在经验上缺乏充分支持,同时批评该争议中大量人身攻击和恶意评论不具建设性。
No.15
Mouseless – keyboard-driven control of macOS/Linux/Windows
Mouseless:键盘操控 macOS/Linux/Windows
526 分
213 条评论
作者: riddley
Mouseless 是一款将键盘映射为鼠标的跨平台工具,用户可通过键盘坐标定位和点击来替代传统鼠标操作。评论中对其评价两极分化:有用户认为它改变了使用习惯、离开键盘就无法工作;也有用户测试后发现鼠标速度仍更快。Homerow、ShortCat、Vimium 等类似工具被反复提及,部分开源替代品(如 Warpd、Keynav、wl-kbptr)也获得推荐。争议焦点集中在:1)坐标记忆是否比鼠标直观;2)Linux 本身可通过终端完成大多数任务,GUI 无鼠标体验是否必要;3)Trackpoint 用户认为无需额外软件。另有用户指出该工具闭源、缺乏多显示器支持等问题。
No.16
No Let, No Rec, No Problem: A Gentler Introduction to the Y and Z Combinators
无声明无递归:Y和Z组合子温和入门
40 分
7 条评论
作者: sayyadirfanali
文章通过一个禁止使用循环、递归、声明(let、const、function)的阶乘函数挑战,逐步引导理解Y和Z组合子的本质。先用互相递归尝试但被否定;后发现g(g, ...)自应用模式,结合rep = x => x(x)得到rep(rep)自指特性;进一步扩展为h(x(x)),构建出Y组合子Y(h) = (x => h(x(x)))(x => h(x(x))),并证明Y(f)满足Y(f) = f(Y(f)),即f的不动点。Z组合子通过延迟求值解决实际应用问题。文章在HN引发争议:有读者认为是目前最易懂的Y组合子入门材料,也有读者批评其以挑战为噱头却未真正遵守规则,论述过于迂回。
No.17
We shrank our TimescaleDB chunks from 30 days to 7
我们如何将 TimescaleDB chunk 从 30 天缩减到 7 天
6 分
0 条评论
作者: yask123
本文来自 WMG 技术团队,分享了他们将 TimescaleDB 时序数据分块策略从「30 天一个 chunk」调整为「7 天一个 chunk」的实践过程。TimescaleDB 基于时间对数据进行分片,较短的分块周期能提升近期数据的查询性能、改善压缩效率并降低内存压力,但也会增加元数据开销和管理复杂度。团队分析了这一调整对存储、查询延迟和运维成本的影响,为读者提供了在时序数据库调优中权衡 chunk 大小的参考思路。
No.18
Raytracing Geometries in 3D Rendering
3D 渲染中的光线追踪几何体
3 分
1 条评论
作者: kvakkefly
这是一篇关于光线追踪(Raytracing)核心数学原理的交互式教程。文章解释了光线追踪的基本机制:从摄像机出发、穿过每个像素发射射线,并计算射线与曲面的交点。作者提供了球体、圆柱体、圆环三种几何体的可视化探索工具,从数学角度分析不同几何形状的相交计算方法。该工具允许用户通过三个视角(Three Lenses)动态交互,深入理解 3D 渲染中光线与几何体求交的核心算法。
No.19
Nine Ways to Do Inheritance in Rust, a Language Without Inheritance
Rust 语言无继承,但有九种方式实现继承行为
41 分
6 条评论
作者: pjmlp
文章枚举了 Rust 中实现「继承」效果的九种常见模式,涵盖 trait 对象、trait 继承、模板方法模式、newtype 封装、枚举分发、宏展开等。但评论指出标题有误导性——这些本质上都是通过 trait 实现的 ad-hoc 多态,而非子类型「继承」。真正的争议在于:Rust 的 trait 可以声明接口契约,但无法携带关联数据(如父类的字段),这使得纯粹的数据复用仍是难题。有评论提到 Bevy 游戏引擎的组件系统是数据复用的好范本,也有评论指出文章遗漏了 generic typestate 这一重要模式。核心矛盾:Rust 的多态能力不差,差的是数据继承。
No.20
My Agent Skill for Test-Driven Development
我的 TDD 智能体技能
171 分
73 条评论
作者: laxmena
作者指出当前 AI 智能体写测试的能力堪忧——模糊、过度复杂、毫无意义,且人类编写的样本代码质量也不高。但他发现配合指导后,智能体能遵循理性 TDD 流程,写出清晰有用的测试。其核心方法是将 Kent Beck 的经典 TDD 原则转化为「指定-编码-满足」(Specify-Encode-Fulfill)循环:先定规格、再将规格编码为自动化测试、最后编写代码满足规格。他还引入了独立的「测试设计审查」技能来 spawn 子智能体复审测试,并发现「做饭前先清理厨房」这类类比对引导智能体行为意外有效。作者认为,将 AI 与几十年验证的永恒原则结合,才是最大的生产力杠杆。社区争议集中在:TDD 是否会增加 token 成本、代码被频繁改动时测试 ROI 是否为负,以及 skills 文件是否真的有用还是过度工程化。
No.21
Gov.uk has replaced Stripe with Dutch provider Adyen
英国政府放弃 Stripe,转投荷兰支付公司 Adyen
433 分
154 条评论
作者: toomuchtodo
英国政府数字服务(GDS)已选定荷兰支付公司 Adyen 替代 Stripe,负责处理 Gov.uk 及地方当局的支付业务。合同金额引发热议——评论者指出其规模之小出乎意料,甚至不及一家美国中型企业的云服务账单。有评论指出,英国作为欧盟及欧元区以外、拥有独立货币的主权国家,理应拥有本土大型支付提供商。有声音将此举解读为「去美化」趋势的信号。Adyen 与 Stripe 商业模式差异显著:Stripe 面向开发者自助接入,中小企业友好;而 Adyen 主要服务大客户,门槛较高。评论还提到巴西央行运营的 Pix 即时支付系统年成本约 1000 万美元,暗示政府支付合同往往价格虚高。Stripe 联合创始人虽为爱尔兰人,但公司注册在爱尔兰却具有明显美国基因。
No.22
The perils of UUID primary keys in SQLite
SQLite 中使用 UUID 主键的性能陷阱
82 分
45 条评论
作者: emschwartz
文章通过基准测试揭示了 SQLite 中使用随机 UUID(UUID4)作为主键的重大性能代价。测试表明,在 WITHOUT ROWID 表中,UUID4 的插入速度比整数主键慢 10-12 倍,原因是随机 UUID 导致数据随机插入 B-tree 索引,迫使数据库频繁重新平衡树结构,带来大量额外页面读写。作者借助火焰图(diffgraph)可视化确认了这一开销来源。解决方案是使用时间有序的 UUID7,它几乎恢复了整数主键的性能水平——仅因 16 字节对 8 字节的体积差异略慢。结论提醒开发者:随机 UUID 在支持聚簇索引的数据库中应谨慎使用。
No.23
Conventional Commits encourages focus on the wrong things
Conventional Commits 鼓励关注错误的东西
300 分
231 条评论
作者: jsve
文章批评 Conventional Commits 格式(type[scope]: description)将「类型」置于「范围」之前是本末倒置。作者指出,代码变更的作用域(即哪个组件被修改)才是贡献者、调试者和事故响应者最关心的信息,但 Conventional Commits 竟把作用域设为可选,把类型(fix/feat/refactor)放在标题首位。作者认为,类型在描述中已能清晰传达,且常出现一个提交同时是 bugfix、refactor 和新功能的灰色地带,自动生成 changelog 和 semver 版本号也因 revert、意外 breaking change 等场景而不可靠。文章建议采用 Linux 内核风格或把元数据放入 Git trailer。
No.24
Ask HN: Why is the HN crowd so anti-AI?
问 HN:为什么 HN 社区对 AI 如此抵触?
138 分
251 条评论
作者: Ekami
一篇 Ask HN 帖子质疑 Hacker News 社区为何对 AI 持强烈抵触态度。发帖者认为社区弥漫反 AI 情绪,并举例称过去半年每天打开 HN Best RSS 都会看到「AI 写烂代码」「AI 引入 bug」「AI 制造技术债」等批评。评论区的回应呈现明显分歧:一方认为 HN 反的是「炒作」而非 AI 本身,类似当年对加密货币泡沫的批评,且工程师的职责就是深究「但它真的管用吗」;另一方则担忧 AI 让人养成走捷径的习惯,长期后果堪忧。核心争议在于「代码是手段还是目的」——有人认为用户只在乎产品是否可用,代码优雅与否无关紧要;反对者则指出,代码质量关乎开发者对代码和领域的理解,烂代码会在未来反噬。此外,有评论指出当前 AI 实际能力被严重高估,其本质只是「高级自动补全」,LLM 生成的是「最可能的代码」而非「最优代码」,低于均值的开发者受益大,但高于均值者反而觉得受限。
No.25
The Quiet Numbers Station: Decoding Nineteen Years of GPS Cryptography
沉默的密码电台:解码 GPS 十九年加密广播
86 分
69 条评论
作者: lordgilman
研究者分析了 2007 至 2026 年间 1216 万条 GPS 观测记录,发现 L1 C/A 信号中原本标注为「可读文本」的 Subframe 4 Page 17 字段(176 比特)实为军用密文广播,十九年来持续向全球数十亿接收器发送加密数据。该字段统计上与随机噪声无法区分,但存在明确结构特征:占位符 0xAA(二进制 10101010,用于硬件测试)、重复出现的协议头字符串「LY47IRP16」,以及 2011 年 5 月全星座协调切换等异常事件。研究者指出,该通道与美国军方 OTAD(空中密钥分发)网络运作节奏高度吻合,2022 年 5 月广播轮换速率突然恢复至 3.8 天,2023 年 12 月 PRN 8 卫星更开始发送明文前缀「TEXT」的新格式。评论中对「数字电台」类比提出质疑,认为核心用途是 OTAD 密钥分发,并非真正用于间谍通信;有评论者验证了研究者可信度并确认数据开源可复现;也有声音指出中国北斗系统已更为先进。
No.26
Tracing a powerful GNSS interference source over Europe
追踪闪电:识别俄罗斯预警卫星对欧洲GPS的广域干扰
394 分
203 条评论
作者: mimorigasaka
一篇信号处理论文分析并确认,自2019年起在欧洲、格陵兰、加拿大造成多次强大瞬态广域干扰的GNSS干扰源,来自俄罗斯「闪电」轨道上的预警卫星星座(Cosmos 2546,NORAD ID 45608)。研究团队利用地面GNSS参考站网络数据,建立了基于接收功率的检测框架,并结合时间到达差测量技术(TDOA)进行溯源,发现其信号特征为约5MHz频谱的突发传输、12ms循环前缀。研究指出:太空基干扰源因地理覆盖范围极广,代表GNSS对抗的「质变升级」。社区评论聚焦于:此事是否违反1967年《外层空间条约》;俄罗斯边境居民实际上也深受其害;以及GPS脆弱性早已是公开事实,空基干扰只是新 escalation;另有评论指出手机基站定位可部分替代GPS,但精度仍不足。
No.27
Europe's largest Copper Age tomb: children's bones show ancient health crisis
欧洲最大铜器时代墓葬:儿童骨骼揭示古代健康危机
30 分
5 条评论
作者: gmays
欧洲考古学家宣布发现该大陆迄今规模最大的铜器时代墓葬,墓中出土多具儿童骨骼遗骸。研究团队通过对骨骼进行病理学分析发现,这些儿童普遍存在营养不良、感染性疾病及发育迟缓的证据,表明约4500年前该地区曾暴发过严重的古代健康危机。DNA分析还揭示了墓葬人群的亲缘关系与迁徙模式,为研究新石器时代向铜器时代过渡时期的人类生活状况提供了重要依据。这一发现挑战了此前学界对铜器时代社会组织复杂程度的认知,墓葬的宏大规模与精心设计暗示当时已存在相当程度的社会分层与集体丧葬仪式。
No.28
Transformers are inherently succinct
Transformer架构具有固有简洁性
118 分
32 条评论
作者: brandonb
该论文(获ICLR 2026 Outstanding Paper荣誉)证明了一个重要理论结果:Transformer在表达能力上可以指数级地简洁于RNN等序列模型。作者借助LTL(线性时序逻辑)形式化框架证明,同一语言若用RNN表达需指数规模,Transformer仅需多项式规模即可表示。论文摘要最后一行指出这一「简洁性」的代价:Transformer的基本验证问题(如空集性检测、等价性判定)在理论上被证明是 intractable 的——这意味着对大规模模型的正式验证在计算上不可行,引发社区关于「是否应放弃对LLM的形式化分析」的热议。
No.29
India's surprise baby bust
印度意外迎来婴儿荒:给全世界的警示
176 分
763 条评论
作者: hakonbogen
《经济学人》报道,印度生育率骤降超预期,传统人口政策面临大转向。印度曾长期推行计划生育,如今官方教材即将改写,警告「新生儿过少」而非「新生儿过多」的风险。评论揭示这场全球性生育危机的多元根源:工业化进程中,儿童从「经济资产」变为「纯消费」——过去孩子是免费劳动力和养老保障,如今城市化将抚养成本大幅推高;女性教育与就业普及是生育率下降的最关键变量(研究显示女性识字率与生育意愿呈强负相关);电视等媒体进入印度农村后,肥皂剧展示的城市中产生活范本也显著拉低了生育意愿。评论同时指出,所谓「危机」本质上是工业社会的普遍规律,政府的现金补贴等激励政策在实证中收效甚微,问题的深层解法可能在于重构整个社会对育儿的支撑体系。
No.30
Three of our worst VC stories
三个最糟的 VC 经历
226 分
114 条评论
作者: orgonon
一位创业者(@eastdakota)在 X 上发帖,讲述了三个最糟糕的风险投资人经历,激起社区对 VC 行业文化的广泛讨论据悉,其中一个故事涉及某 VC 约创始人在德州一家破旧餐馆见面,创业者从佛罗里达飞过去带着 pitch deck赴约,却遭到恶劣对待;另一个故事提及 Vinod Khosla 相关言论,引发关于大 VC 是否将心理变态特征与成功划等号的争论;还有故事三(在回复中)暗示某 VC 发出了会对你日后反咬的信号评论者普遍认为,这些极端经历并非罕见,财富和权力助长了巨婴式的自我中心,有人因被拒绝而主动破坏你,还有人建议直接购买 GPU 摆脱对 Claude 的依赖走自力更生路线也有评论者提到这类 VC 故事只会加剧公众对「那么无能的人为何还那么富有」的质疑,但平静专业的 VC 其实不少,只是他们不会引发关注
评论精华