No.01
What happens when an LLM never sees material beyond fifth grade?
只学到五年级的语言模型会怎样
25 分
5 条评论
作者: porridgeraisin
文章介绍「LittleLearner」实验:研究者从 FineWeb-Edu 蒸馏出 880 亿 token 的「LittleCurriculum」,按美国 K–5 共同核心课程过滤,明确排除五年级以上概念、事实和词汇,并从零训练 0.6B、1.3B、5B 三种模型,同时配套未过滤对照组。结果显示,扩大模型规模、SFT+GRPO 后训练和上下文学习都能增强课程内能力,但几乎不能提升课程外表现,说明预训练分布设定了有效能力上限。作者认为这种可解释知识边界可用于研究强化学习是否能创造新能力、概念学习过程,以及模型与儿童学习差异。
No.02
Asus Bike Booster
华硕 Oxiis 自行车助力器
336 分
199 条评论
作者: wiradikusuma
华硕 Oxiis E250G1 是一款通用摩擦驱动电助力改装装置,夹在座杆附近,通过滚轮压住后轮把普通自行车变成智能电助力车。它标称 250W 额定、500W 峰值功率,158Wh 电池,约 3.7kg,支持 100W USB-C PD 两小时充电,续航约 10 至 50 公里,兼容 16 至 29 英寸及 700C 车轮、60mm 以下轮胎和多种车架,但不支持全避震、碳纤维座杆和粗齿胎。卖点是免改传动和刹车、无线踏频传感器、坡度自适应、刹车感应尾灯与手机 App。争议集中在摩擦驱动的效率、雨天打滑、轮胎磨损、防盗、价格缺失和法规责任等问题。
No.03
Show HN: Laptop is the last place your secrets are still in plaintext
展示:用 Jit 保护本机明文密钥
35 分
30 条评论
作者: bukershok
Jitpass/Jit 似乎主打把开发机上的敏感文件或密钥迁移到加密形态,并在进程需要访问时通过授权、扫描、可能结合 macOS Secure Enclave 或生物识别来临时放行,试图解决「笔记本仍是密钥明文最后阵地」的问题。评论认可其授权流程和扫描体验有吸引力,也有人指出 1Password Environments、dotenvx、age 加密文件、凭证代理等已有替代方案。最大争议在安全模型:不少人认为若恶意代码已能在本机执行,只是增加攻击成本;安装脚本用 curl 管道解压并提权也被认为与安全产品定位不匹配。
No.04
Asynchronous I/O in DuckDB: Work, Thread, Work
DuckDB 引入异步 I/O:让远程 Parquet 与 CSV 读取不再卡住线程
133 分
10 条评论
作者: pdet
DuckDB 计划在 2026 年秋季发布的 v2.0 中默认启用异步读取,先支持 Parquet 与未压缩、可 seek 的 UTF-8 CSV,面向 S3/EC2、数据湖等远程存储场景。文章解释了同步 I/O 下工作线程会被网络读取阻塞,难以吃满带宽;新方案将执行线程分为「REGULAR」与「ASYNC」两类,通过大量异步线程、预读队列和任务停车机制,让抓取、解码、聚合等阶段重叠执行。核心收益是隐藏远程存储延迟、提升吞吐,但代价是预读会占用内存,因此 DuckDB 同时引入异步内存治理,避免网络快而解码慢时堆积数据导致 OOM。社区关注其向高性能分析查询引擎演进,也质疑线程超配、HTTPS 支持和基准硬件配置。
No.05
Patterns and problems in emerging multi-agent systems
新兴多智能体系统的模式与问题
62 分
22 条评论
作者: maxutility
Anthropic 讨论了多智能体系统即将进入真实机构、市场和代码库后的协调风险。文章认为,智能体虽能长时间工作、快速吸收信息,但会编造、奖励黑客,个体层面对齐并不保证群体层面稳定。其漏洞扫描实验显示,45 个可协作智能体能持续发现漏洞,并发展出工具和专长,但在复杂软件项目中,智能体间依赖会导致冲突、弃 PR、分工混乱;不同 Claude 代际在合并率和代码共享上表现差异明显。作者强调,未来需要设计能约束和塑造智能体社会行为的环境,而非假设更强模型会自然学会协作。
No.06
Semaglutide linked to lower predicted dementia risk
司美格鲁肽或与更低的预测性痴呆风险相关
414 分
288 条评论
作者: randycupertino
这项研究称,接受约两年司美格鲁肽治疗的人群,其基于血液蛋白组学的未来痴呆风险信号恶化较慢,提示 GLP-1 类药物可能在代谢、炎症或心血管通路之外影响认知风险。不过评论普遍提醒,研究对象是有肥胖和心血管疾病的老年人,且关注的是预测性生物标志物,并非真实痴呆发病率;研究由 Novo Nordisk 资助也引发利益相关讨论。社区争议集中在效果是否来自减重、控糖、少吃高糖饮食,还是药物本身的抗炎或神经代谢作用。多数人认为信号令人鼓舞,但距离证明可预防阿尔茨海默病仍很远。
No.07
Health benefits of Tai Chi
太极的健康益处
9 分
2 条评论
作者: helloplanets
哈佛健康文章介绍太极作为一种低冲击、慢动作的身心练习,兼具深呼吸、专注身体感受和柔和连续动作,可作为常规医疗之外的辅助疗法,用于改善老年相关问题的预防、康复和生活质量。文章称太极安全、无需设备,适合体能较弱者、术后恢复者甚至轮椅使用者,并建议初学者选择短套路、小幅慢动作课程,必要时先咨询医生。其研究支持的益处包括增强上下肢和核心力量、提高柔韧性、改善本体感觉与平衡、降低跌倒和恐惧跌倒风险,并可能带来一定有氧收益。但 HN 评论主要质疑文章商业化色彩浓厚,认为链接导向购物漏斗,像广告而非纯公益健康资料。
No.08
Cultivating a state of mind where new ideas are born (2023)
如何培育新想法诞生的心境
155 分
35 条评论
作者: felixbraun
文章借萨姆·奥尔特曼反对创业者共享办公空间的观点切入:伟大想法在幼虫期往往显得糟糕,过早暴露在群体评价中容易被嘲笑和修正成平庸方案。作者认为艺术家所谓孤独并非单纯独处,而是一种暂时摆脱他人意见、对内在模糊问题更敏感的心境。文章通过格罗滕迪克和伯格曼的工作笔记,描绘原创思想如何在漫长、混乱、近乎痛苦的自我观察中生成,并反思现代机构偏好成品定理、证明和可展示成果,忽视新观念诞生前难以言说的劳动。争议在于:孤独是否被幸存者偏差神化,学术共同体和合适同伴是否同样能催生创造力。
No.09
Software Engineering fundamentals matter more
软件工程基本功比以往更重要
106 分
37 条评论
作者: ingve
作者认为,编码代理已跨过「能不能做」的门槛,但这只是软件工程的一小部分。LLM 和工具链能快速写出可运行、可测试的代码,尤其在提供清晰上下文、TDD、确定性验证和反馈时效果更好;但真正困难的是接口边界、抽象选择、可调试性、可维护性、分层与组合性。作者强调 LLM 主要是预测而非可靠推理,也难以根除提示注入等安全问题,因此工程师的价值更集中在审慎规划、管理认知负荷、设计稳定而可演化的系统。评论区则围绕生成代码质量、LLM 是否会推理、AI 是否适合真实代码库展开分歧。
No.10
Super El Niño Keeps Growing as New Forecasts Reach Record Territory Ahead Winter
超级厄尔尼诺继续增强,冬季预测逼近历史纪录
213 分
109 条评论
作者: dgellow
文章称,2026 年超级厄尔尼诺正在热带太平洋快速增强,最新海洋与大气数据把峰值预测进一步推高。关键机制包括赤道太平洋创纪录的西风异常、信风塌陷,以及向东传播并上涌的强「开尔文波」,为海表持续补充高热量。作者认为该事件已进入强厄尔尼诺阶段,发展速度和强度接近甚至超过 2015-2016 年事件,可能在 2026/2027 年冬季重塑喷流、风暴路径和降雨格局,影响美国、加拿大和欧洲。争议焦点在于它与长期气候变暖的关系、极端热量对粮食和灾害风险的放大作用,以及区域影响仍存在不确定性。
No.11
Guiding Ships with Moire Patterns
用莫尔条纹为船舶导航
38 分
9 条评论
作者: Eridanus2
作者受 Tom Scott 视频启发,按 Inogon 专利自制了一套用两层光栅产生莫尔条纹的导向灯,并用激光切割样品验证:从正中看图案居中,偏离角度时会给出直观的左右修正提示,几乎无需复杂校准,也可供多人同时观察。作者认为它在设计和数学上很巧妙,但未必适合港口航道:现实航道通常是一个安全宽度,而非一条必须精确贴合的细线,莫尔系统会让船只为轻微偏离而频繁修正,增加燃料、注意力和拥堵风险。相比之下,三灯系统只在接近或离开安全区域时提醒,更符合船舶操纵需求。莫尔方案更适合标记海底电缆等真正狭窄目标。
No.12
At-home test for infected ticks could improve Lyme Disease diagnosis
家用蜱虫感染检测或改善莱姆病早期诊断
252 分
87 条评论
作者: gmays
文章介绍一款名为 LymeAlert 的家用蜱虫检测工具,旨在让被咬者快速判断蜱虫是否携带莱姆病病原体 Borrelia burgdorferi,从而在 72 小时预防性用药窗口内做出决策。背景是美国每年约 3100 万人被蜱叮咬,莱姆病病例随黑脚蜱扩张而增加,气候变暖、鹿和鼠类宿主增多、栖息地破碎化共同推高风险。医生常因早期诊断不确定而预防性开抗生素,带来抗药性担忧。争议在于,检测蜱虫阳性并不等于人体感染,且家用侧向层析检测的准确率、假阳性和假阴性风险仍需验证。
No.13
Show HN: Mic Drop, a real-time multiplayer karaoke game
展示:Mic Drop,实时多人唱歌派对游戏
51 分
19 条评论
作者: johnsillings
Mic Drop 是一个面向浏览器和手机的实时多人唱歌派对游戏,主玩法类似营地里常见的「给一个词,轮流唱出包含该词的歌」:玩家用手机加入房间,根据提示词抢唱或接唱,而不是传统卡拉 OK 那样播放伴奏、显示逐字歌词。评论者普遍觉得点子轻量、有社交乐趣,适合线下聚会或线上语音场景;也有人指出标题里的「卡拉 OK」有些夸张,因为目前没有音频流、歌词同步或自动评分。技术讨论集中在浏览器音频延迟、WebRTC 元数据轨是否可用,以及如果未来加入音效或同步机制会遇到的缓冲差异问题。
No.14
AI in drug discovery – what it is, where we stand and the path forward
AI 药物发现的现实进展与下一步
133 分
71 条评论
作者: AnodicElegy
文章讨论 AI 药物发现的真实状态:它已能显著加速结构生物学、分子建模、数据处理和候选物筛选等环节,但尚未带来「凭空变出新药」的突破。核心瓶颈不在模型炫技,而在高质量、可比较、可复现实验数据稀缺,以及药物开发漫长、昂贵、受生物复杂性约束。评论普遍认同 AI 应从建模容易获得但价值有限的数据,转向回答真正影响药物成败的问题;同时也指出,生成新分子本来就不难,难的是证明其安全、有效、可开发。
No.15
RISC-V: They Should Have Known Better
RISC-V:本该避免的设计失误
291 分
353 条评论
作者: dmitrygr
作者集中批评 RISC-V 的架构取舍:一种 ISA 不可能同时最适合超算、服务器和廉价微控制器;在低端嵌入式场景,RISC-V 中断保存寄存器依赖 CSR,开销高于 Cortex-M0,迫使厂商用 CLIC 或私有快速中断扩展补洞;压缩指令的偏移编码也被指设计糟糕,损害代码密度。文章进一步质疑其扩展过度可选、标准碎片化和服务器端解码效率,认为 RISC-V 的开放性与免授权价值真实存在,但不应掩盖技术债与生态兼容风险。
No.16
Numba in the Browser: Unlocking a New Scientific Python Stack in JupyterLite
Numba 在浏览器中运行,扩展 JupyterLite 科学 Python 栈
34 分
6 条评论
作者: xalfotis
文章宣布 Numba JIT 编译器已能在 JupyterLite 中完全运行于浏览器端。团队基于此前将 Xeus-Cpp 和 Clang-Repl 搬到 WebAssembly 的经验,为 llvmlite 实现了 WebAssembly 执行引擎:把 LLVM IR 编译成 WebAssembly 对象,经进程内 LLD 链接为 side module,再动态加载到运行中的 Xeus-Python 内核。这样 Python 函数可在无远程服务器的情况下完成 Numba IR、类型推断、LLVM IR、WASM 编译与执行。Numba 已进入 emscripten-forge,可支持 PyTensor、PyMC、插值与经济学数值库等生态。文中称浏览器内示例相对纯 Python 有约 250 倍加速,但评论也追问与原生版本的绝对性能对比。
No.17
Abdominal fat predicts heart disease risk better than BMI
腰腹脂肪比 BMI 更能预测心血管风险
245 分
175 条评论
作者: theanonymousone
美国心脏病学会发布的 JACC 研究显示,仅用 BMI 判断肥胖和心血管风险会误分人群;腰围和腰臀比能补充关键风险信息。研究汇总 26 万余人、平均随访 20 年,考察心梗、中风、心衰、房颤、冠心病、心血管死亡等九类结局。BMI 正常者中仍有 5% 腰围高、18% 腰臀比高;正常或超重但中心性脂肪高者,多数结局风险增加 15% 至 50%。相反,BMI 肥胖但腰围低者总体风险未显著高于正常低腰围者。作者建议临床常规评估「中心性肥胖」,但研究缺少运动、饮食、遗传风险和长期腰围变化数据。
No.18
A fortuitous decade as an indie software developer
独立软件开发者幸运十年
71 分
9 条评论
作者: frizlab
作者回顾自己从 2016 年突然辞职到成为独立开发者的十年:起初没有商业计划,首款端到端加密聊天与文件传输应用 Underpass 收入不足 3000 美元,几乎失败;真正转机来自 Safari 扩展 StopTheMadness。它在桌面端已有口碑,但不足以养活作者,直到 2021 年 iOS 15 支持移动 Safari 扩展,才让业务突然可持续。作者强调这不是可复制的创业建议,而是大量挣扎、找不到工作、持续维护产品和一次平台变化带来的幸运。他把自己称为「一击成名」型开发者,未来仍会像冲浪一样顺势而为。
No.19
Tracking down a Zsh history data loss bug
追踪 Zsh 历史记录丢失 Bug
69 分
22 条评论
作者: ingve
作者长期遇到 Zsh 历史文件「.zsh_history」偶发丢失近年记录的问题:文件看似未损坏,但只剩很旧的命令。其配置使用「INC_APPEND_HISTORY」追加写入、多 shell 共享同一历史文件但不启用「SHARE_HISTORY」。排查中,他先用 inotify 发现 Zsh 会读旧文件、写「.zsh_history.new」再重命名覆盖;再用 fatrace 获取 PID,确认可定位具体进程;strace 因难以覆盖所有交互 shell 暂未采用;随后用 bpftrace 追踪 open/read/write 调用栈,最终通过给 Zsh 打补丁让异常直接崩溃,并分析 core dump 找到根因。Zsh 5.9.2 已修复该数据丢失问题。文章价值在于展示了复杂、低频、并发相关数据丢失 bug 的系统化定位路径。
No.20
Falstad Math and Physics Simulations
Falstad 数学与物理交互模拟集
9 分
1 条评论
作者: pykello
Falstad Math and Physics Simulations 是 Paul Falstad 长期维护的一组网页交互模拟,涵盖数学、波动、力学、电磁等物理主题,强调用可视化和实时操控帮助理解抽象概念。由于原文无法抓取,可从标题判断其价值在于把公式和现象转化为可实验的浏览器演示,适合教学、自学和快速直觉建立。唯一评论提到一位用户 2005 年用 Flash ActionScript 做过类似弦振动模拟,如今借助 Ruffle 重新运行,并说明可通过空格固定弦端,显示这类早期教育模拟在 Web 技术迁移后仍有生命力。讨论量极少,尚未形成明显争议。
No.21
Tea5767-Radio-Tuner
TEA5767 收音机调谐器项目
36 分
2 条评论
作者: turtushig22
该项目看起来是一个基于 TEA5767 芯片的收音机调谐器开源硬件/软件实验,可能包含用微控制器控制 FM 调谐模块的代码与电路示例。由于原文无法抓取,核心价值主要从标题和评论推断:它适合电子爱好者入门无线电、I2C 外设控制和小型嵌入式项目。评论中有人提到类似的 Si4844-A10 芯片也很有趣,并且还能调 AM;他曾将其接入 STM32 和互联网,用于在家中串流 AM 广播。作者回应称自己刚开始做这类项目,感谢对方提供信息。讨论没有明显争议,重点在于芯片选择、AM/FM 能力差异以及项目学习价值。
No.22
AI has access to a vastly larger working memory than the human brain
AI 的数学优势或许来自超大工作记忆
483 分
412 条评论
作者: rzk
文章认为,AI 在数学中的优势未必主要来自更高层次的推理或直觉,而可能来自远大于人类的符号工作空间。人类工作记忆容量有限,数学家靠记号、草稿纸和「组块」减轻负担;研究也显示工作记忆能在 IQ 之外预测数学表现。LLM 的上下文窗口像巨型笔记本,可保留题目、定义、推导、失败路径和约束,使复杂证明更可操作。但作者也承认上下文并非完美记忆,模型会遗漏、分心或误用信息。争议在于:工作记忆到底只是「记忆」,还是智能本身的一部分。
No.23
Zapping Rocks Unlocks Stimulated Geologic Hydrogen
用电击岩石激发地下清洁氢
15 分
5 条评论
作者: adm4
IEEE Spectrum 报道了马萨诸塞初创公司 Eden GeoPower 的「电储层刺激」技术:把电极送入深井,用高压脉冲像地下闪电一样击裂坚硬岩层,增加水与含铁矿物接触面积,从而通过铁氧化反应在地下生成氢气。文章指出,传统清洁制氢成本高,而天然地质氢虽被重新重视,但尚未证明能商业化稳定产出;「刺激地质氢」试图把岩层变成可工程化的氢工厂,理论潜力巨大,但仍处早期验证阶段,关键问题包括产量、效率、安全性、地质条件和商业可行性。
No.24
A spectre is haunting Unicode
游荡在 Unicode 中的幽灵字符
215 分
74 条评论
作者: sensanaty
文章回顾日本 JIS X 0208 编码中的「幽灵文字」:1978 年制定标准时,一些没有明确来源、读音或意义的汉字被收入。1997 年调查发现,多数源于地名资料转录、剪贴复印等流程错误,例如「妛」来自把「山」与「女」拼贴复印时误把接缝当笔画;只有「彁」仍缺乏确证,可能是「彊」的误读。由于 JIS 被广泛采用,这些错误又进入 Unicode,成为全球计算机字符表中几乎永久存在的历史残影。评论围绕兼容性、CJK 统一、错误字符是否应删除展开。
No.25
AI-Assisted GPU Porting of a 250k Line Legacy Weather Simulation Code
用 AI 辅助将 25 万行旧天气模拟代码移植到 GPU
29 分
4 条评论
作者: Jimmc414
论文以 25 万多行 Fortran 天气模拟系统 CReSS 为案例,提出一种「验证优先」的 AI 辅助 GPU 移植流程。作者让 CLI AI Agent 提取 OpenMP 区域、基于真实台风模拟状态生成 dump 内核基准、应用 OpenACC 改造,并用逐元素对比和应用级验证确保科学有效性。最终 162 个目标内核通过数值验证,应用级加速 5.1 倍;同时发现 5 个由浮点、内建函数差异引发的数值偏差。文章强调,大型科学遗产代码移植不只是代码生成,更需要跨会话上下文管理、运行态重建和高成本验证设计。
No.26
Not sure where I am going with this garbage collection rabbit hole
Go、Kotlin 与 BEAM 的并发和 GC 调度兔子洞
7 分
0 条评论
作者: argentum47
文章从一个核心问题切入:在少量 OS 线程上运行大量逻辑任务时,谁负责在任务间切换,以及切换者需要知道什么才能安全执行。作者比较 Go、Kotlin 与 Erlang/Elixir 的 BEAM,重点先展开 Go:其表层模型源自 CSP,以 channel 作为同步与通信单位,但运行时内部依赖 M:N:P 调度器,用 P 的本地队列减少全局争用。文章强调 Go 1.14 前的协作式抢占不仅影响公平性,更会阻塞 GC 的全局安全点;信号驱动的非协作抢占是为解决生产中紧循环导致 STW 无法推进的问题。整体价值在于把并发模型、抢占、安全点和 GC 暂停串成同一组设计约束,而非罗列语言特性。
No.27
Program with Paint Brushes, Not Pencils
用画笔而非铅笔编程
8 分
2 条评论
作者: skadamat
作者回顾自己在 2022 年为高中计算机课写的 Python「PaintBrush」类:它封装 turtle,让学生用坐标线条和随机扰动快速画出可见作品。如今这类代码可由 Claude 秒级生成,但作者认为,LLM 反而让教师能更快创造新的高层抽象,把编程课从重复、规定性练习转向绘画、音乐、数据可视化、滤镜、游戏等创作场景。核心观点是:当任务能产出真实、有个人表达的作品时,学生更愿意亲手写代码;学习编程的价值不在于比 AI 更快生成代码,而在于建立自我效能感、创造力和对作品的归属感。
No.28
Voltair (YC W26) Is Hiring a Test Flight Engineer
Voltair 招聘试飞工程师,负责长航程电力巡检无人机
1 分
0 条评论
作者: wweissbluth
Voltair 正在建设面向地球观测的分布式无人机网络,首个市场是电力公用事业。公司计划用约 5000 个地面站覆盖美国本土,让客户在风暴后快速调度无人机,识别电网风险并把结果传给地面维修队。该岗位是第 7 位全职员工,职责横跨硬件测试、线束焊接、54 磅固定翼无人机外场操作、制造交接和客户部署,预计每两个月出差约一周。公司强调其无人机可通过电力线充电实现「无限航程」,目标是在山火发生前发现设备故障。
No.29
SugarTrack – an offline Android logbook for blood sugar (no account, no cloud)
SugarTrack:离线 Android 血糖记录本
43 分
15 条评论
作者: hunzaboy
SugarTrack 是一款免费的 Android 血糖记录应用,主打无需账号、无需联网、无云端和无服务器,所有数据保存在手机本地。它可记录读数、时间、场景、备注和餐食照片,显示趋势图,记录用药和 A1C,设置提醒,并导出 PDF 或 CSV 给医生。作者强调它不是血糖仪或医疗建议,而是替代纸质表格、帮助就诊沟通的日志工具。评论争议集中在是否需要额外应用:有人认为血糖仪已有历史和导出功能,也有人指出并非所有设备支持导出,且饮食、备注等上下文对医生判断很重要。
No.30
Government sponsored study on alcohol doesn't stand up to scrutiny
塔勒布质疑美国政府资助的饮酒风险研究
40 分
26 条评论
作者: scoofy
塔勒布批评一篇受美国政府委托、声称低剂量饮酒无保护作用且每周 14 杯死亡归因风险达约 4% 的研究。他认为论文标题和结论具有误导性,表格数据反而显示低剂量可能存在收益且误差很大;其置信区间不对称、总风险与分年龄段风险的合并方式不透明,疑似使用未说明相关结构的蒙特卡洛传播不确定性。塔勒布还指出,70 岁以上组在结果中权重过大,但该组死亡原因归因、幸存者偏差和暴露回忆都最不可靠。文章结论是,这篇论文不足以推翻既有饮酒建议。
评论精华