No.01
Claude Fable 5.1 and Claude Mythos 5.1
Claude Fable 5.1 与 Mythos 5.1 发布
1180 分
1097 条评论
作者: denysvitali
Anthropic 发布 Claude Fable 5.1 与更宽松安全策略的 Mythos 5.1,称其在编码、知识工作和长任务上显著领先,并通过降低缓存读取价格让典型 token 计费工作负载约便宜 25%,代理型任务最高约省 45%。文章强调企业隐私方案 EFS、较少误拦截的安全护栏,以及在蛋白质结合物设计、金星高程图重建、计算生物学 GPU 优化等科学任务上的早期成果。争议集中在真实可用性、价格和限额、过度安全拒答、数据留存、基准可信度以及所谓科学突破是否可复现。
No.02
The Emergent Symbolic Structure of Artificial Neural Networks
神经网络中涌现的符号结构
94 分
29 条评论
作者: schmuhblaster
论文试图解释为何以连续向量为核心的神经网络能处理语言、逻辑、算术和代码等传统上依赖符号结构的任务。作者提出,网络内部表征可能隐含实现了符号结构,并声称可用闭式符号方程近似替代网络的表征生成过程,而行为大体保持不变。该现象在小型列表操作网络和大型语言模型中均被观察到;作者还通过定向干预表征来改变 LLM 行为,说明这些结构与行为相关。争议集中在引言是否把向量能力说得过弱,以及所谓符号近似是否足够强、是否只是函数近似的自然结果。
No.03
How accurate have Ed Zitron's AI skeptic predictions been?
Ed Zitron 的 AI 怀疑论预测到底准不准
656 分
711 条评论
作者: jatins
Dan Luu 逐条检视 AI 怀疑论者 Ed Zitron 的预测,认为其常用数字制造可信感,但论证链条并不成立。文章以 Zitron 称 Meta、Google、微软等大公司「正在死去」、因增长乏力才押注 AI 为例,指出这些公司的收入和利润仍在快速增长,所谓 Facebook MAU 下滑、Google 搜索被管理层毁掉等证据要么来自不可靠第三方数据,要么不足以推出公司生态衰退。作者强调,Zitron 的愤怒风格和反 AI 立场容易获得传播,但许多具体判断和时间点经不起事实核查。争议在于:批评者认为文章过度按字面理解并挑错预测,支持者则认为它揭示了反炒作内容同样可能依赖夸张叙事。
No.04
Salad Theory
沙拉理论
49 分
36 条评论
作者: colinprince
作者以办公室里关于三明治、披萨和沙拉的玩笑式辩论为起点,试图用极端严谨的定义推导食物分类。文章逐一否定「必须有绿叶」「必须混合均匀」「不能有面包」「主要是固体」等标准,认为它们要么排除日常公认的沙拉,要么过于任意。最终作者提出,凡含有多个可食成分的食物都可视为沙拉;汤、饮料与沙拉之间也不存在严格边界,只能用「汤度」这样的连续系数描述。文章的价值不在结论本身,而在用荒诞题材讽刺本体论、语言定义和形式化推理的局限。
No.05
WebFPGA
WebFPGA:在浏览器中编程 FPGA 开发板
56 分
27 条评论
作者: gurjeet
WebFPGA 试图把 FPGA 入门流程搬到网页端:用户购买配套开发板后,可通过 Web IDE 直接编程 FPGA,项目说明和范围主要放在 Kickstarter 页面。它的价值在于降低本地工具链安装门槛,适合教学、快速实验和初学者入门;争议则集中在云端综合与网页 IDE 是否只适合「hello world」和闪灯示例,真正开发很快仍会需要完整本地工具链。评论还延伸讨论了低价 FPGA 开发板、开源工具链成熟度,以及小型 FPGA 的实际用途。
No.06
Fine, I'll build my own text editor
好吧,我自己写一个文本编辑器
76 分
64 条评论
作者: Alephinitesimal
作者受「如今软件不如 Sublime Text 那样轻快」的讨论刺激,尝试在浏览器里自制文本编辑器。他先用「canvas」逐帧绘制,实现光标、输入和行高亮,但很快发现选择、撤销、滚动和可访问性都要重造。随后转向「contenteditable=plaintext-only」,获得浏览器原生选择与撤销,却遇到字符量增长后的性能波动。最后发现传统「textarea」在长文本上更稳,并叠加语法高亮层。文章的结论是:文本编辑看似简单,真正难点在性能、可访问性、Unicode 文本边界和无数细节;从「textarea」起步比纯 canvas 更不容易走入死路。
No.07
My local model setup on an M4 Pro Mac Mini
M4 Pro Mac Mini 上的本地大模型配置
173 分
89 条评论
作者: raybb
作者介绍如何用 48GB 内存的 M4 Pro Mac mini 搭建本地 LLM 服务:以 Qwen3.6-35B-A3B-OptiQ-4bit 处理推理任务,Gemma-4-E4B-it-OptiQ-4bit 处理轻量聊天,借助 oMLX 提供推理服务,Tailscale 连接手机、MacBook 与 Mac mini,并让 Hermes、Apollo、Raycast、Pi 共用同一端点。文章强调本地模型的价值在于成本可预测、隐私、离线、低延迟、无速率限制和避免云模型政策或产品变化;同时解释 MoE、量化、统一内存与 KV cache 对可用性的影响。争议点主要在性能:评论者认为不能只看内存,还要看带宽、prefill 延迟和真实 tok/s,部分人质疑 Apple 设备性价比,也有人分享 M 系列芯片上可接受的速度数据。
No.08
FBI Probes Service Selling 153M+ Drivers Licenses
FBI 调查暗网出售 1.53 亿张驾照扫描件
179 分
67 条评论
作者: tatersolid
KrebsOnSecurity 披露,暗网身份盗窃服务 Nexus 正出售逾 1.53 亿份美国和加拿大驾照扫描件,另含身份证、旅行证件和医疗卡。样本包括正反面、红外和紫外图像,记录仍在持续增加。作者通过自己及亲友的时间戳交叉核对,发现多人与 Hertz 租车、赌场酒店或大麻药房等场景有关,线索指向新奥尔良身份验证商 idscan.net;该公司客户包括 Hertz、Target、FedEx、Caesars 等,并称每月处理 2100 万次验证。FBI 新奥尔良办公室已启动调查,idscan.net 表示正在调查但未给出实质回应。事件凸显身份验证外包、长期留存敏感证件和数据最小化缺失带来的系统性风险。
No.09
Introducing Ad Blocker for Firefox on iOS
Firefox iOS 内置可选广告拦截器
429 分
141 条评论
作者: HieronymusBosch
Mozilla 宣布在 iOS 版 Firefox 中加入内置广告拦截器,用户可在设置中手动开启,默认关闭。该功能基于 Apple 的 WebKit Content Blocker 技术和 EasyList 规则,主要拦截第三方广告及相关追踪器,并与 Firefox 既有的增强型跟踪保护并行工作。Mozilla 强调 iOS 扩展能力受限,因此需直接集成到浏览器中,同时广告仍是开放网络的重要资金来源,所以保留用户选择权。限制也很明确:站点自有广告、搜索结果广告、Firefox 新标签页赞助内容不会被拦截。社区争议集中在推出太晚、覆盖有限、分阶段实验发布不透明,以及是否受 Google 收入依赖影响。
No.10
Show HN: Weedout – Safari extension that hides YouTube AI-labeled videos
展示:Weedout,隐藏 YouTube AI 标记视频的 Safari 扩展
125 分
53 条评论
作者: masteranza
Weedout 是一款 macOS Safari 扩展,用来在 YouTube 首页、搜索、相关推荐、播放列表和 Shorts 中移除被平台标为「Made with AI」的视频,也可选择在 Shorts 播放器中自动跳过相关内容。它不做自有识别,不使用启发式判断,只依赖 YouTube 的披露徽章,因此优点是本地运行、无账号、无追踪、误伤责任清晰;局限也很明显:未标记的 AI 垃圾内容无法处理,而被标记的视频未必全是低质内容。评论区主要争议集中在 YouTube 标签过于粗糙、平台是否应内建过滤选项,以及 Safari 优先和付费扩展是否合理。
No.11
Sonic Pi
Sonic Pi:用代码创作和现场表演音乐
127 分
21 条评论
作者: Bluestein
Sonic Pi 是一款免费的代码化音乐创作与演出工具,面向专业音乐人、DJ、教育者、初学编程者以及视障用户。它强调用编程方式作曲和即兴表演,覆盖古典、爵士、嘻哈、EDM 等风格,并提供友好的教程,试图把编程学习与音乐表达结合起来。社区讨论总体积极,许多人称赞其现场编码演示的观赏性和上手乐趣;争议点主要集中在语法偏 Ruby、是否有替代语法,以及 Linux 发行版安装体验不一致。
No.12
The efficient frontier of LLM inference
LLM 推理效率前沿:延迟、吞吐与成本的取舍
108 分
26 条评论
作者: philipkiely
文章用「有效前沿」框架梳理 LLM 推理工程:一类技术是在延迟、吞吐、成本、质量之间选点,如批大小、并行策略和量化;另一类技术则整体外推前沿,带来系统性效率提升,如内核优化、运行时改进、推测解码和预填充/解码分离。作者强调生产优化往往不是单一新招,而是针对流量形态做实验扫描,因为前沿并不平滑。评论区有人认为分类近似同义反复,也有人补充质量和智能应作为第三维度,并讨论这些技术是否多年未变。
No.13
True Rate of Unemployment
真实失业率
193 分
154 条评论
作者: ptrhvns
LISEP 提出的「真实失业率」使用美国劳工统计局数据,衡量劳动人口中没有全职工作但想要全职、没有工作,或年收入低于 2025 年税前 2.6 万美元生活工资的人群比例。文章主张,官方失业率过窄,难以反映兼职、低薪和就业质量问题,因此需要更接近财务处境的指标来辅助政策制定。争议在于该指标把失业、低工资和非全职合并,可能制造夸大的绝对数字;但也揭示传统头条失业率之外的经济压力。
No.14
Launch HN: Nori Robotics (YC S26) – A low-cost humanoid robot for development
Launch HN:Nori Robotics 的低成本开发用人形机器人
153 分
44 条评论
作者: AntonioLi
Nori Robotics 推出一款面向开发者的低成本轮式人形机器人,主打家庭日常任务、开放 SDK、远程操作与示教工具,以及可在本地训练并分享技能的「Skills Marketplace」。官网正文展示的能力包括整理、辅助家务和技能复用,但信息量有限。HN 讨论的焦点集中在真实性与工程取舍:视频是否加速、是否自主运行、能力是否经过精心挑选;低价是否意味着使用廉价舵机、缺乏力反馈和精度;树莓派 5 是否足以承担传感与控制;以及它究竟是消费品、研究平台还是黑客玩具。社区总体觉得价格和形态有吸引力,但对可靠家务能力、可持续商业模式和售后依赖保持怀疑。
No.15
The ChatGPT/Codex app bundles a full copy of LibreOffice
ChatGPT/Codex 应用内置完整 LibreOffice
376 分
171 条评论
作者: timpera
Simon Willison 在清理本地缓存时发现,OpenAI Codex 桌面应用(现更名为 ChatGPT)在「codex-primary-runtime」目录中占用约 1.7GB,包含完整 Python、Node.js、Poppler、git 以及 LibreOffice 套件;相关「documents」技能说明了如何调用这些二进制文件。文章本身更像一条观察记录,但引发社区对应用膨胀、Office 文档处理、按需下载、安全边界和开源许可证合规的讨论。也有人指出这可能并非安装包预置,而是在首次处理文档任务时下载。
No.16
Movie Scene Map – 13,312 films, series, games, anime and manga
电影场景地图:覆盖 1.5 万个真实取景地与故事地点
230 分
34 条评论
作者: Flightmussy
Movie Scene Map 是一个免费交互式地图,汇集 166 个国家 15,565 个真实影视取景地,并为电影、剧集、游戏、动漫和漫画建立页面;游戏与动漫因并非实拍,按故事发生地标注。数据主要来自 Wikidata 的取景地声明、坐标、 Wikimedia Commons 图片与维基百科条目,另把作品条目正文或分类中的地点作为较弱证据单独标注,不抓取榜单也不生成内容。项目承认覆盖不完整且依赖 Wikidata 质量,鼓励用户补充带来源的取景地声明;全量数据以 CC0 提供 GeoJSON、CSV 和只读 MCP 接口。争议集中在地点粒度、错误解析、年代偏向和证据可靠性。
No.17
Ambient CSS v3 – Blender meets CSS
Ambient CSS v3:把 3D 质感带进 CSS 组件
250 分
77 条评论
作者: kikkupico
Ambient CSS v3 看起来是一个强调光照、阴影、旋钮、凸起按钮等拟物 3D 效果的 CSS/组件实验,试图让网页控件像真实物体一样有材质和触感,并以类似「Blender meets CSS」的说法包装其设计系统。评论区普遍认可概念新鲜、视觉上接近 VST 插件或 Teenage Engineering 风格,但质疑它与 Blender 的关系并不明确,更像重度 3D/拟物组件库。主要争议集中在可用性:页面滚动和性能卡顿、移动端体验差、旋钮交互不直观、可访问性和原生表单语义不足、深色主题下阴影失效、按钮状态和可读性不清。也有人认为这是新一轮拟物或 neumorphism 回潮,适合小众创意界面,但不一定适合通用产品。
No.18
Path to Astra: critical capabilities and frontier safeguards
OpenAI 通往 Astra:关键能力与前沿安全防护
141 分
59 条评论
作者: jithinraj
OpenAI 文章介绍即将发布的 Astra,强调其在网络安全任务、漏洞利用生成、代理协作和工程效率上的显著提升;评论提到它在 ExploitBench 等评测中达到很高分数,并可能以更少 token 完成复杂任务。文章同时把重点放在「前沿安全防护」:部分训练曾暂停,最强网络安全能力将先限制给受信任研究者和机构。争议集中在三点:强攻击能力是否应开放、此前 Hugging Face 相关事件是否说明模型训练史不可逆、以及所谓客观准入标准是否会扩大前沿 AI 使用不平等。社区也把 Astra 发布与 Anthropic、Google 等竞争联系起来。
No.19
The creator of Jujutsu has joined ERSC
Jujutsu 创建者加入 ERSC 出任 CTO
227 分
168 条评论
作者: steveklabnik
Jujutsu 版本控制系统创建者 Martin von Zweigbergk 加入 East River Source Control,担任 CTO,负责下一代版本控制平台工程。ERSC 认为,AI 正在改变软件协作方式,代码管理与远端存储层面临新的规模压力;Jujutsu 已改善本地版本控制体验,但远端仍依赖 Git,企业级场景需要新的存储层。Martin 将继续作为 Apache 2.0 开源项目 JJ 的核心维护者。社区讨论集中在 JJ 相比 Git 的价值、企业版商业模式、与 GitHub 或 Perforce 的关系,以及项目独立性是否会受影响。
No.20
Refurbishing a Tektronix TDS7104 Oscilloscope
翻新 Tektronix TDS7104 示波器
118 分
53 条评论
作者: jwise0
作者以 300 美元购入一台 2000 年代初的 Tektronix TDS7104:4 通道、1GHz 带宽、最高 10GS/s,性能至今仍强于不少爱好者级新机,但体积重且依赖老式 PC 架构。文章详述修复流程:先抢救并镜像濒死的 6GB IDE 硬盘,更换主板 CR2032 电池,修正显卡色彩模式和 Windows 伽马导致的暗屏问题,并提醒不要轻易拆前面板。作者还记录了 SSD 替换失败、用虚拟机和 Plop 从 USB 安装 Windows 2000、安装 Tek 专用驱动、固件、字体与恢复许可证的过程。价值在于提供一份可复现的老仪器抢救手册,也呈现这类高端旧设备的诱惑与维护风险。
No.21
Show HN: HN Match Maker – Matching "Who Wants to Be Hired?" With "Who's Hiring?"
展示:HN Match Maker,将求职帖与招聘帖自动配对
81 分
35 条评论
作者: all2
HN Match Maker 面向 Hacker News 每月「Who is Hiring」和「Who Wants to Be Hired」线程,尝试用 AI 自动匹配招聘岗位与求职者,并为每组匹配给出预评分和信号拆解,目标是减少双方在超长评论串中手动筛选的成本。评论区认可这种工具能节省时间,也提出改进方向,如统一标签体系、显示远程岗位背后的公司所在地、用历史数据评估排序质量。但争议集中在隐私、版权和社区规则:有人认为公开求职帖被再聚合、按用户名展示匹配结果令人不适,可能偏离原线程只用于工作机会联系的语境。作者回应称内容来自公开论坛,是否构成合理使用和如何定义匹配质量仍需探索。
No.22
The Starfish and the Spider [pdf]
海星与蜘蛛:去中心化组织的力量
3 分
1 条评论
作者: rzk
这篇 PDF 应是 Ori Brafman 关于「海星与蜘蛛」一书的概要,核心对比中心化组织与去中心化网络:蜘蛛失去头部即死亡,海星被切开反而可能再生。文章可能借阿帕奇等案例说明,缺乏单一首领和固定中枢的群体更难被征服、复制和压制;相反,阿兹特克这类高度集中、资源明确的帝国更容易被外来力量斩首式击败。争议焦点在于历史成败不能只归因于组织形态,还与殖民者的经济动机、地理条件、疾病、军事技术和可掠夺价值相关。
No.23
Forgotten History of Small Nuclear Reactors (2015)
小型核反应堆被遗忘的历史
35 分
8 条评论
作者: derriz
文章回顾小型模块化反应堆并非新概念:从美国军方在轰炸机、潜艇、偏远基地到民用示范堆,早期小型核电多因成本、复杂性、维护和安全问题失败。作者认为,核电衰退的核心仍是经济性,新建核电单位造价高,SMR虽宣称可借工厂制造、标准化和分批投资降低风险,但历史显示小堆失去规模经济,且并不必然更便宜、更易建造或运行。支持者可能认为技术已进步,但文章提醒今天的商业宣传与过去相似,需警惕重复旧错误。
No.24
How bicycle coaster brakes work (2018)
自行车倒踩刹车的工作原理
58 分
45 条评论
作者: Vedor
文章以一辆 1960 年代常见的 Bendix Model 70 花鼓为例,解释倒踩刹车为何能在前进、滑行和制动间切换:脚踏带动后齿盘和驱动螺杆,离合件前移时咬住花鼓内缘推动车轮,停止踩踏时脱开实现滑行,反踩时推动扩张件撑开刹车蹄,使其摩擦花鼓内壁减速。作者也梳理其百年流行原因:结构封闭、少维护、不怕雨、无线缆、对手力弱者友好。但缺点包括难微控制动力、易锁死后轮、无法倒转脚踏调位置、不适合长下坡,且最好配前刹作备份。
No.25
Ask HN: Who is hiring? (September 2026)
HN 问答:谁在招聘?2026年9月
210 分
233 条评论
作者: whoishiring
这是 Hacker News 每月招聘帖的 2026 年 9 月版,评论区主要由公司直接发布岗位信息组成。岗位覆盖 AI、机器人、基础设施、网络安全、搜索、生命科学、航天、核能、教育、政府科技和开源基金会等方向;招聘形态从创始工程师、全栈、后端、平台、DevOps、机器学习到产品与数据分析不等。地域上远程机会仍多,但不少硬科技、机器人、航天和欧洲公司强调现场或混合办公;薪资披露集中在美国和部分欧洲岗位,范围从初级 8 万美元到资深 30 万美元以上。整体反映出 AI 应用、RAG、agent、机器人和行业软件仍是招聘热点,争议不明显,评论更像岗位公告集合。
No.26
Show HN: Running 104GB Qwen3.8-Flash-Next on 48GB Mac with at ~12 tok/s
展示:在 48GB Mac 上以约 12 tok/s 运行 104GB Qwen3.8-Flash-Next
199 分
95 条评论
作者: carloslfu
Slotstream 展示了在无法完整装下模型权重的 48GB Mac 上运行 104GB 级 Qwen3.8-Flash-Next,并达到约 12 tok/s 的实验性方案。评论推测其核心价值在于 MoE 权重常驻与流式加载、内存优化和推测解码,让更大模型在消费级统一内存设备上可用。社区普遍看好低成本本地推理的方向,认为未来突破可能来自更高效的内存与权重流式机制;但也有人质疑 16GB/32GB 设备的实际可用性、散热、上下文长度和与 Claude 等云模型的体验差距。争议还集中在项目 README 像实验日志、同类 MLX/offload 项目重复较多,以及 32GB N-gram 表替代 draft model 的设计选择。
No.27
Building an interactive instrument for a one-of-a-kind festival
为独特音乐节打造可互动的半月钟琴
45 分
5 条评论
作者: tjwds
作者为 2026 年回归的 Eaux Claires 音乐艺术节打造了「Halfmoon Chimes」:一件由 37 根铝管、螺线管、MIDI 键盘、树莓派和热敏打印机构成的互动乐器。它能让观众演奏、录制,并打印带有抽象音符图案和条码的收据;其他人可扫码回放这些表演,使纸质记录逐渐成为装置的一部分。文章详细记录了从选材、调音、支架、半月形布局到软件控制的制作过程。最终装置两天吸引数千人参与,录下 447 段演奏,打印 716 英尺收据纸,体现了手工制造、音乐互动与社区艺术的结合。
No.28
Top Web Design Styles of 1993
1993 年网页设计风格考古
33 分
3 条评论
作者: luu
文章以「Prof. Dr.」个人主页为线索,回顾 1993 年前后万维网的真实设计风格:早期网页多由大学研究者用少量 HTML 标签手写,外观朴素、相似,却体现了浏览器既是阅读器也是编辑器的时代特征。作者强调这不是复古,而是一种仍在更新、可被 Mosaic 打开的「永恒」样式。其核心价值在于揭示早期网络相信视觉应由用户浏览器偏好决定,即「终端用户即设计师」。随着 Web 走出学术圈,用户希望页面个性不被浏览器覆盖,Netscape 等开始加入控制外观的 HTML 扩展,网页设计由开放、简陋的共享范式转向更强作者控制的视觉表达。
No.29
Atlas: A World Model for Spatial Intelligence
Atlas:面向空间智能的世界模型
209 分
49 条评论
作者: johnsutor
World Labs 发布新一代世界模型 Atlas,称其从头预训练,可原生处理文本、图像、视频和 3D,将多模态输入放入共享空间上下文中,生成保持三维一致的新视角、长视频和显式 3D 输出。它支持精确相机控制、稀疏图像重建、点云和 3D Gaussian splats,并可从视频模拟 RGB 与深度数据,面向创作、VFX、游戏和机器人。文章强调随训练算力扩展性能提升,并称少量图片即可超过专用 3D 重建模型。争议集中在「世界模型」定义过宽、幻觉与真实性边界、速度成本、法律滥用及与 Genie 3 等模型的差异。
No.30
Solving the Flat Cube
解开扁平魔方
30 分
4 条评论
作者: surprisetalk
文章介绍一种由菱形拼片组成、外观类似立方体投影的「扁平魔方」。规则是在任意小六边形处旋转三片菱形,目标是用最少步数复原。作者借用「上帝数」概念,虽未求出彩色版本的精确最坏步数,但证明至少需要 27 步:一种证明把菱形镶嵌视为 3×3×3 托盘中的立方体堆叠,每次操作只增减一个小立方体;另一种降维为算盘珠滑动,9 个水平菱形各需上移 3 格。作者还指出无色版本最坏步数恰为 27,并提示 60 度与 180 度计步口径会影响彩色谜题的讨论。
评论精华