No.01
GPT-6 Astra
GPT-6 Astra 发布
1697 分
1496 条评论
作者: kibae
OpenAI 发布 GPT-6 Astra,并称其在多项推理、编码、生命科学、数学与智能体任务上显著超过 GPT-5.6 Sol、Claude Fable/Opus 等模型,尤其宣称 ARC-AGI-3 接近饱和,引发「AGI 是否已到来」的讨论。评论区焦点集中在基准可信度:有人指出 ARC 官方榜单和自定义 harness 分数差异巨大,成本也极高;Artificial Analysis 等综合榜单却显示 Astra 只与 Sol 接近甚至在部分智能体指标回退。用户同时关注定价、Token 效率、编码体验、自动购物和税表等演示场景,以及模型快速迭代带来的职业焦虑和疲劳感。
No.02
.name Termination
.name 三级域名将被终止
1720 分
426 条评论
作者: pavel_lishin
作者称自己近 25 年前注册 neil.fraser.name,用作网站、邮箱和 API 服务,并为女儿注册了类似域名。Verisign 今年 4 月提议为简化管理,终止 .name 下整个第三级域名体系,ICANN 于 7 月批准,作者直到注册商通知才得知。他强调 .name 当初就是正规三级域名注册体系,不同于私人转售的可疑三级域名。影响包括网站和邮箱在 2027 年 2 月失效、IoT 服务中断,即便域名已付费到 2040 年。更严重的是二级域名释放后,第三方若抢注 fraser.name,可能重建 neil.fraser.name,劫持旧邮箱关联账户、代码身份和设备控制权。作者认为约 2.2 万人受影响,准备诉诸法律。
No.03
Qwen 3.8 27B available on Cerebras at 1500 tokens/s
Qwen 3.8 27B 登陆 Cerebras,速度达 1500 tokens/s
532 分
171 条评论
作者: altertable
Cerebras 文档显示,其公共推理端点已提供 Qwen 3.8 27B,并强调所有公开模型均为原始未剪枝版本;平台只在存储环节使用选择性权重量化,敏感层保持全精度,推理时激活、注意力和 KV cache 不量化,以尽量维持质量。争议集中在高速推理的实际价值:1500 tokens/s 带来近实时交互体验,尤其吸引代码代理和产品 UX 场景,但用户担心 128k 上下文、TPM/RPM 限制、成本、可靠性、账户支持和 OpenRouter 可用性削弱了它在真实编码任务中的优势。
No.04
The largest electric aircraft just flew [video]
最大电动飞机完成首飞
294 分
209 条评论
作者: feb
Heart Aerospace 展示其大型电动飞机原型首飞:约 100 英尺翼展、2.5 万磅起飞重量,目标产品 ES-30 面向短途支线航空。评论指出,已飞的 X1 原型为纯电,规划中的 ES-30 则是电动推进加涡桨发电的混合方案:纯电航程约 125 英里,混合航程约 500 英里。支持者认为这是美国多年少见的全新客机平台,电机轻、噪音和地面污染可能更低,未来电池进步会提升价值;质疑者则集中在航程、备降安全、真实电费成本、混合定位、乘坐舒适性、远程驾驶以及相比铁路或合成燃料的实用性。
No.05
How an MIT research project became the Julia programming language
Julia 从 MIT 研究项目到全球科学计算语言的历程
81 分
22 条评论
作者: theanonymousone
文章回顾 Julia 的起源:2009 年 MIT 研究者因科学计算语言既慢又僵化而开始设计一种像 Python/MATLAB 易用、又接近 C 性能的语言。Julia 通过按数据类型进行即时编译,服务科研、工程建模和数值仿真,如疫苗开发、飞机防撞、气候模型、黑洞成像等,用户已超百万。其团队后来成立 JuliaHub,并推出 Dyad 3.0,试图用遵守物理定律的 AI 代理加速飞机、火箭等复杂系统设计。争议主要在于文章是否过度突出 MIT 和 JuliaHub 的功劳,以及 Julia 的开发体验、启动与缓存、1 基索引等问题仍影响采用。
No.06
Project Xanadu: Even More Hindsight (2025)
Project Xanadu:更多事后反思
73 分
10 条评论
作者: andsoitis
Gwern 回顾 Project Xanadu 半个世纪的成败:硬件贫乏和开发工具落后确实拖慢了 Autodesk 时代的实现,但更根本的问题是缺少设计迭代、真实使用场景和实用取舍。作者在现场看到旧版 Xanadu 演示后认为,其标志性的并排范围转引与连线界面几乎不可读,而且主要适合圣经注释、文本校勘等少数场景,并非普通文档协作的核心需求。文章将 Xanadu 与 Cyc 类比,批评其魅力型领导、封闭路线和多年不修正愿景,使有价值的超文本理想没能长成可用产品。
No.07
Artificial beaver dams saw juvenile coho salmon survival rates go from 8% to 60%
人工海狸坝让幼年银鲑存活率从 8% 升至 60%
238 分
68 条评论
作者: speckx
北加州斯科特河谷曾因海狸坝形成大片湿地,后来捕猎导致海狸锐减,银鲑幼鱼赖以生存的冷水、缓流栖息地消失。当地流域组织自 2015 年起在支流建造仿海狸坝,用木桩、枝条、砾石和泥土拦水,形成约 9000 平方米新栖息地,可支持 8500 多条幼鱼。研究称修复区水温更低,幼年银鲑存活率在 French Creek 从 8% 升至 60%,斯科特河鲑鱼回流在干旱中仍保持较好。文章认为这是低成本生态修复的强证据,但真正长期恢复仍取决于土地所有者是否允许海狸回归。
No.08
Porting my 1993 Amiga game to Godot, with an LLM reading the 68000 assembly
用 LLM 读 68000 汇编,将 1993 年 Amiga 游戏移植到 Godot
272 分
83 条评论
作者: rabahs
作者回顾自己 1993 年在巴格达用 Amiga 500、512KB 内存和纯 68000 汇编制作《Babylonian Twins》的经历,并描述这次借助 Claude Code 将旧作移植到 Godot。LLM 先把 2010 年 3.4 万行 C++ iPhone 版快速迁移,再尝试读取 7.2 万行原始汇编、重建文件格式和行为,并用 vasm、FS-UAE、命令行驱动和状态探针做自动验证。文章强调移植游戏不只是翻译代码,固定 tick、碰撞细节、手感常数和旧注释都可能是事实上的规格。争议点在于验证仍不完美:现代版缺少图像对比,手感主要靠作者试玩,且文章本身部分由 AI 起草,引发社区对可信度、署名和复现性的讨论。
No.09
Hackers Had a Live Feed of Every ID Verification Company Scanned for over a Year
身份验证公司疑似长期泄露上亿驾照扫描件
45 分
12 条评论
作者: beardyw
Techdirt 借 Krebs 报道批评各州推动的「年龄验证」实质会演变为高风险的身份验证。暗网服务 Nexus 声称从一家大型身份验证公司持续窃取数据一年多,已售卖逾 1.53 亿份美国和加拿大驾照扫描件,并仍在实时增加;线索指向服务 Hertz、药房、FedEx、Target 等客户的 IDScan.net。文章强调,即便公司宣称符合 GDPR、CCPA 并展示安全认证,集中收集政府证件仍会成为攻击目标,受害者可能面临信贷欺诈、跟踪、家暴逃离者和证人保护身份暴露等风险。因此作者认为,以儿童安全为名强制年龄验证的人必须回应这些系统性隐私代价。
No.10
Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out
Claude、Codex、Cursor 会选择哪些开发工具?一次 1.7 万次实验的观察
194 分
87 条评论
作者: screm
Armature 用 75 个仿真实仓库、1163 类任务变体和 3 个沙箱平台,跑了 16893 次编码代理实验,并发布首批 5292 个有效会话结果。研究发现,代理选型高度受模型习惯、搜索方式、语言栈和提示语影响:Codex 几乎总会联网且偏向限定站点搜索,Claude Code 更多依赖先验,也更常自研,Cursor 较依赖网页。三者只有 42% 场景选同一工具;同一需求在不同语言仓库中会导向不同邮件、部署或数据库服务。文章还指出,被频繁提及不等于胜出,定价页措辞、功能打包和管理成本描述会明显改变代理判断。评论区则担心这会演变成面向 AI 代理的 SEO、广告和推荐操纵。
No.11
Go grandmaster Shin defeats AI KataGo with a two-stone handicap
申真谞让二子战胜 KataGo,人类围棋再获标志性胜利
283 分
88 条评论
作者: gmays
韩国九段申真谞在与顶级围棋引擎 KataGo 的三番棋中以 2:1 逆转取胜,并在决胜局执黑让二子以 11.5 目获胜,成为首位在正式系列赛中以二子让先击败现代顶级围棋 AI 的人类棋手。文章强调,他放弃模仿 AI,转向防守、守地和克制的布局,在第 80 手后建立大模样并稳定保持胜率。赛事被包装为 AI 时代人类智慧的鼓舞,但评论区普遍提醒:二子优势很大,且 KataGo 有时间限制,这不是人类总体强于 AI 的证据,而是让子制度下的边界测试。
No.12
K2 Horizon: A connected fleet of six open models
K2 Horizon:六款全开放模型组成的互联模型舰队
291 分
96 条评论
作者: karimf
IFM 发布 K2 Horizon,包含 375B-A23B、36B-A4B、32B、7B、3.7B、0.9B 六个开放模型,覆盖从边缘设备到企业部署。官方称小模型在数学、推理、编码、工具使用和智能体任务上刷新同规模表现,36B-A4B 通过「MoVA」稀疏注意力以约 4B 激活参数接近 32B dense 能力。发布重点不只是权重,而是开放预训练到智能体后训练的检查点、数据或构造配方、代码、配置、日志和评测,并采用 Apache 2.0。争议集中在跑分对比是否选择性、部分仓库或模型尚未完整可用,以及「完全开放」是否真的包含可再分发训练数据。
No.13
From Hookswitch to Grave
从电话交换钩到坟墓:西电与贝尔系统的设备一生
22 分
2 条评论
作者: Sniffnoy
文章追溯西电如何从早期电话专利竞争、Western Union 与贝尔之争中被 AT&T 收购,最终成为贝尔系统的制造、采购、研发与回收核心。AT&T 通过西电和贝尔实验室形成高度垂直整合:电话、线缆、交换机、电话杆乃至 Teletype 都在体系内设计、制造、租赁、维护和报废。文章重点呈现西电服务中心的大规模翻新机制:用户退回的电话会被清洁、修理、测试后重新投放,无法修复的设备则进入拆解和材料回收。作者借此展示旧式垄断体系在效率、耐用性和闭环管理上的优势,也暗含对竞争不足与企业支配力的复杂评价。
No.14
GPS glitched across the US by as much as 33 feet
太阳风暴让美国 GPS 误差最高达 10 米
171 分
99 条评论
作者: thread_id
2025 年 11 月一次强烈太阳风暴不仅带来低纬极光,还在美国本土上空造成罕见的大范围电离层扰动。研究团队通过北美极光相机和地面 GNSS 接收器发现,增强电子密度带横贯东西,其边缘形成小尺度不规则结构,引发「振幅闪烁」,使卫星定位信号失真,部分地区水平误差超过 10 米。文章强调,这类中纬度、横跨美国的大范围闪烁此前未见,足以影响精准农业、自动驾驶和射频应用;评论则质疑损失估算、标题时间表达和 GPS 与其他 GNSS 系统的区分。
No.15
The phrase that ruins every eCommerce project: "Just connect it to our ERP."
毁掉电商项目的一句话:把它接到 ERP 就行
8 分
1 条评论
作者: taubek
文章指出,电商项目中「把它接到 ERP 就行」常被低估:新店面是可规划的绿地开发,而连接既有 ERP、CRM、支付、税务、仓储等系统是棕地考古,真正脆弱的是无人负责的系统交接处。支付需同步返回,但建单、库存、仓储往往只能异步处理,若缺少重试、补偿、监控和人工恢复流程,就可能出现已收款却无订单。作者主张先构建新平台,同时审计旧系统真实行为,等新数据模型稳定后再单独评估集成;还应质疑旧流程是否值得自动化,而非照搬历史包袱。唯一评论质疑文章像由提示词生成,认为文风本身削弱可信度。
No.16
Ask HN: Who is using MCP in production?
问 HN:谁在生产环境使用 MCP?
51 分
74 条评论
作者: sukit
这则 Ask HN 询问 MCP 是否已进入真实生产场景。评论显示,许多团队已在客户服务、运动分析、监控、企业聊天、CMS 管理、工单、Figma/Jira/GitHub/GitLab/Datadog 等系统中使用 MCP,常见价值是把内部 API 抽象成 agent 可调用的标准工具层,并通过 OAuth、审计和细粒度权限隔离降低风险。也有人把它用于个人自动化、学习、购物、社交备份和产品测试。争议集中在成本与复杂度:不少人认为 CLI 或直接 API 更快更便宜,MCP 服务器生态质量参差、规范排列组合过多,但在浏览器内 agent、企业权限边界和用户可安装式集成场景中仍有明显吸引力。
No.17
Show HN: Reactor Atlas
展示:Reactor Atlas 核反应堆地图
22 分
11 条评论
作者: fedecaccia
Reactor Atlas 是一个展示全球核设施、反应堆与发电相关信息的可视化网站。原文正文几乎只有站点入口,主要价值来自产品本身:用地图和图层呈现核能设施、研究反应堆、能源生产及监测信号等数据。HN 讨论集中在数据完整性和交互体验:有人认为球形地图导航不如传统二维地图直观,聚类标签跳动影响浏览;也有人指出澳大利亚 Lucas Heights 的 OPAL、EPFL 的 CROCUS 等研究反应堆缺失。作者回应称二维模式已可切换,缺失条目会加入待办,并解释监测页中的水电内容属于电网信号层,并非翻译错误。
No.18
Xanadu was waiting for agents
Xanadu 等来了 AI 代理
115 分
47 条评论
作者: nsm
文章借 Ted Nelson 的「Xanadu」与「xanalogical」理念,论证 AI 代理让永久版本、可追溯引用、稳定文本片段锚点重新变得有价值。作者认为过去 Web 为了简单牺牲双向链接、来源保持与完整历史,而 DeltaDB 依托 Lamport 时间戳、Merkle 树、CRDT、廉价存储、Tree-sitter 等条件,可把代码、对话、 provenance 和代理注意力记录成可遍历历史,并兼容 Git,避免 Xanadu 不互通的失败。争议在于评论区普遍质疑文章像 AI 生成的营销话术,认为它把 DeltaDB 包装成宏大隐喻,却未充分说明实际价值、复杂度成本与遗忘权问题。
No.19
In defense of two-state theme toggles
为两态主题切换辩护
5 分
7 条评论
作者: surprisetalk
作者介入前端社区关于主题切换应采用「浅色/深色」两态还是加上「系统」的三态争论,支持在主界面多数场景使用两态。其核心理由是:Lea Verou 的实现并不会永久锁定用户,而是在用户选择与系统一致时删除本地偏好、回到系统默认;三态虽更清晰,但会增加选择和理解成本,且任一时刻总有两个选项效果相同。作者认为动态系统主题用户占比很低,真正因两态受困还需经过多重条件,最坏也只是多点一次;而「系统」概念对普通用户未必清楚。因此应按场景取舍:设置页可三态,主 UI 更适合简单开关。
No.20
Authorization Terminology Is a Mess: Let's Fix It
授权术语混乱:用六个维度重新分类
3 分
0 条评论
作者: andychiare
作者认为,授权领域长期把不同层面的概念都称为模型,导致「RBAC」「ABAC」「PBAC」「MAC」「DAC」「ACL」「ReBAC」被错误地放在同一赛道比较。文章提出用更细的分类轴来拆解授权系统:谁制定规则、规则以什么形式存在、决策依赖哪些数据、由哪里计算决策、由哪里执行结果等。核心观点是,授权本质上是在主体、动作、对象之间判断允许或拒绝;而现有术语分别回答管理权、数据形态、策略表达、决策架构等不同问题。例如 PBAC 关注集中策略引擎,MAC/DAC 关注规则管理者,RBAC/ABAC 关注决策数据。把术语放回各自轴线上,才能避免把食谱和厨房混为一谈。
No.21
Virtual Threads for a scripting language in Java 8 without Loom
在 Java 8 中为脚本语言实现类虚拟线程
27 分
2 条评论
作者: jaccomo
作者介绍 Jactl 这个可嵌入、可控权限、编译成 JVM 字节码的脚本语言,如何在 Java 8/11、没有 Loom 和虚拟线程的环境中,避免脚本的长耗时操作阻塞事件循环。核心做法是用不生成栈追踪的「Continuation」异常在异步函数开始处中断执行,沿 Jactl 调用栈逐层捕获并保存方法句柄、恢复位置、本地变量和临时栈值,形成可恢复的延续链;操作完成后再以保存状态重新进入函数并跳转到暂停点。编译器会向上传播异步标记,只在可能挂起的调用处生成保存与恢复代码。文章价值在于展示了在旧版 Java 上用编译器转换模拟协程/虚拟线程的工程路径,也指出新 Java 可直接关闭 Jactl 内置异步机制改用虚拟线程。
No.22
Any Human Ever – One life, drawn at random from all who have ever lived
随机抽取一个曾经活过的人生
564 分
268 条评论
作者: thinkingemote
Any Human Ever 是一个交互式项目:从超过一千亿个曾经出生的人中按真实人口数据随机抽取一生,逐步生成出生年代、地区、家庭、婚育、迁徙、寿命与死因等统计化叙事。它强调随机出生更可能落在近现代,也用地图和人口分布展示人类历史的尺度。评论普遍认为项目有强烈的沉浸感,能凸显现代医学和生活条件的幸运;但大量用户指出抽样分布、儿童死亡率、婚育概率、历史经济换算和死因推断可能不严谨,LLM 生成叙事也容易制造看似具体但误导的细节。
No.23
A mysterious kidney disease has arrived in Texas
神秘肾病正在抵达得克萨斯
75 分
54 条评论
作者: johntfella
得州休斯敦安全网医院近年接诊大量来自墨西哥和中美洲的年轻男性劳工,他们无糖尿病、高血压等典型病史,却因肾衰竭需要终身透析。医生怀疑这可能是中美洲甘蔗工人中流行的「不明原因慢性肾病」首次在美国显现。研究者认为,高温下重体力劳动、脱水、受污染饮水、止痛药、农药、感染或土壤环境等都可能参与发病,但病因仍未确定。文章把它视为气候变暖、移民劳工处境和职业保护不足交汇下的公共卫生警讯,也指出休斯敦医学资源或能帮助破解病因。
No.24
Unusual Suspects
不寻常嫌疑人:按描述画角色的猜谜游戏
152 分
27 条评论
作者: beeperboy95
Neal Agarwal 的新网页游戏「Unusual Suspects」把玩家放进类似目击者画像的场景:根据文字描述画出一个知名角色或人物,最后揭晓真实答案,并给出相似度评分。评论普遍认为它非常有趣,尤其是自己拙劣手绘与原图并列展示时的反差感;也有人更享受根据描述猜角色而不是作画。评分机制引发好奇,社区猜测可能使用 CLIP 之类的图像嵌入相似度,而非简单像素匹配。不过也有人指出评分标准不透明,错误角色也能拿高分。争议主要集中在隐私追踪弹窗、移动端和 Firefox/Linux 上的绘图卡顿,以及希望回看目击描述等体验细节。
No.25
A PCB business card with a batteryless LED, powered by the phone that taps it
用手机 NFC 点亮的无电池 PCB 名片
78 分
21 条评论
作者: thekevintang
作者制作了一张信用卡大小的 PCB 名片:手机轻触时,NFC 芯片打开个人网站,同时借手机 13.56 MHz 射频场的能量点亮喷火龙尾巴上的红色 LED。文章解释了被动 NFC 标签如何靠负载调制回应、能量采集引脚如何提供约 2V/5mA,并介绍用 KiCad Python API 生成整板、JLCPCB 低价贴装的过程。最大波折在于选用 NTAG I²C Plus 后,普通 iPhone NFC 应用无法格式化空白芯片,备用 Android 又没有 NFC;作者最后写了 Core NFC 小应用直接发送底层命令完成写入。评论区一方面觉得这类硬件名片正在流行,另一方面质疑项目缺少开源文件、甚至猜测由 AI 生成。
No.26
Tasklet (YC P26) Is Hiring a Customer Success Engineer
Tasklet 招聘客户成功工程师
1 分
0 条评论
作者: mayop100
Tasklet 是一家面向企业的 AI Agent 平台创业公司,主打让用户用自然语言描述目标,由代理跨工具和系统执行工作。该岗位负责客户支持与客户成功:处理邮件和电话中的复杂问题,维护高价值客户关系,做 onboarding、培训和演示,并把用户反馈系统化传回产品和工程团队。公司强调不靠堆人处理工单,而是通过产品改进、自助文档、AI 自动化支持流程、内部工具和仪表盘降低支持负担。目标候选人有 1–5 年经验,擅长沟通、懂技术、重度使用 AI、喜欢把重复工作自动化。薪资 14 万至 18.5 万美元,股权 0.075% 至 0.15%。
No.27
New type of dice guarantees no tie when deciding who goes first
五人先手骰:一次掷出且永不平局的新骰子
104 分
81 条评论
作者: colinprince
数学家 Eric Harshbarger 自 2012 年起研究「Go First Dice」:让每名玩家各掷一枚骰子,在任意参与人数下公平决定谁先手,并保证一次掷骰不会平局。二至四人方案很快完成,五人则因既要数学公平又要可制造而卡住多年;早期可行方案需要 1440 面,后降至 120 面。加拿大软件工程师 Paul Meyer 通过模式筛选和暴力搜索找到五枚 60 面骰方案,现已商品化。争议集中在文章解释不足、物理骰是否真能接近数学公平,以及 30 面五人方案是否存在。
No.28
The asteroid currently hitting front end web development
正在撞击前端开发的小行星
142 分
161 条评论
作者: codechicago277
作者观察到多位前端教育者正在淡出,原因是大模型已能回答复杂的浏览器性能、CSS 与框架问题,甚至可直接分析 Chrome trace 并给出优化建议。他认为前端尤其容易被代理接管:风险相对低、代码更可替换,且「代理体验」开始压过「开发者体验」,训练数据中占优的 React 因此进一步赢家通吃。文章担忧前端知识投入、教育与多样化框架生态会被削弱,但也承认 AI 在实际工作中已能显著提升效率。争议焦点在于:前端是否真低风险、AI 生成界面是否会带来质量、安全与审美退化。
No.29
GLP-1s are being linked to fewer serious infections, including TB
GLP-1 药物或与严重感染风险降低有关,包括结核病
104 分
55 条评论
作者: gumby
文章介绍两项近期观察性研究:用于糖尿病和减重的 GLP-1 类药物,如 semaglutide、tirzepatide,可能与更低的严重感染风险相关。一项 Nature Communications 研究基于去标识化病历,发现 2 型糖尿病患者使用 GLP-1 后,最长五年内结核病诊断率低于使用其他降糖药者;另一项 BMJ 研究显示 tirzepatide 除降低心血管事件外,也与较少需住院感染、感染死亡和总体死亡相关。文章强调这些研究只能说明相关性,不能证明因果;潜在机制可能是体重下降、血糖控制改善、代谢和炎症状态改善,也可能存在药物的额外免疫调节作用,仍需前瞻性和实验研究验证。
No.30
The true horror of Edgar Allan Poe’s stories lies in their confessions
爱伦·坡恐怖故事的真正恐怖在于忏悔
67 分
33 条评论
作者: lermontov
文章从爱伦·坡1840年代在费城办刊与求职失败写起,描绘他在贫困、酗酒和自我破坏中追求职业作家身份的处境。作者认为,坡在「黑猫」和「反常之魔」中提出的「反常」并非普通恶意,而是一种明知会毁掉自己仍无法停止的冲动;其恐怖核心不在谋杀本身,而在叙述者被迫坦白自身失控。文章把坡的生平挫败与作品中的忏悔机制相连,强调他对自毁欲望的洞察。评论区则对这种心理化解读、传记批评和19世纪写作生计提出质疑与补充。
评论精华