No.01
Introducing System One Models and Jev
TypeSafe AI 发布 System One 模型 Jev
1263 分
370 条评论
作者: albelfio
TypeSafe AI 发布首个 System One 模型 Jev,定位为面向自动化的高速结构化决策模型:输入非结构化状态,输出带概率的类型安全决策,而非生成字符串。公司称其通过新架构、并行采样与 RLCD 训练,在工作流评测中接近前沿 LLM 智能水平,却可快近两个数量级、成本低数百倍,并保证无类型错误、适合低延迟业务自动化。文章展示了工作流、Doom、Wikiracing 等演示,也承认评测由内部团队设计、参考答案依赖大模型平均值,速度收益可能偏高。争议集中在架构细节不透明、是否只是优化版分类器或 LLM 衍生物,以及「不幻觉」更准确应理解为不会输出 schema 外内容而非永远正确。
No.02
Apple Reference Image: A New Approach for Verified Photography
Apple Reference Image:面向可信摄影的新方案
202 分
127 条评论
作者: imwally
苹果提出 Apple Reference Image,计划在 iPhone 18 Pro 主摄上提供可选的可信拍摄模式。它通过传感器安全启动并在捕获时签名像素和关键元数据,再用 Apple 加密时间戳给出拍摄时间上下界;随后把安全数字底片上传到 Private Cloud Compute,在可审计、隐私保护的环境中完成去马赛克、色调映射和压缩。目标是证明图像来自真实 iPhone 传感器且在特定时间段拍摄,同时避免把照片绑定到公开设备或个人身份。争议集中在系统复杂、依赖苹果闭源硬件与云端、无法防止摆拍或翻拍已伪造图像,以及可能让社会过度信任所谓认证照片。
No.03
Show HN: An e-ink frame that hears birds and draws them as 1800s illustrations
展示:能听鸟叫并绘制复古鸟类插图的电子墨水相框
1579 分
198 条评论
作者: arnemunthekaas
这个项目把麦克风、BirdNET-Go 鸟鸣分类器和电子墨水屏结合起来:设备监听花园里的鸟叫,识别物种后,在相框上显示对应的 19 世纪自然史鸟类插图,且图片来源于公有领域并附有出处。评论普遍认为它把 AI、自然观察和家居硬件结合得很有诗意,适合作为送给家人或鸟类爱好者的礼物。技术讨论集中在 BirdNET 并非大语言模型、电子墨水大屏成本较高、可否扩展到澳洲鸟类、eBird API、摄像头识别、个体鸟识别等方向。也有人指出它与此前 AvianVisitors 项目相似,认为应明确致谢灵感来源。
No.04
Show HN: I made a flight simulator, except you're just a passenger
展示:只当乘客的飞行模拟器
144 分
63 条评论
作者: rkotcher
这是一个反常规的浏览器飞行模拟器:玩家不是飞行员,而是坐在客舱里体验实时航班、系安全带、看机上娱乐、等待漫长飞行,甚至感受餐食选择不足等日常细节。评论普遍觉得创意有趣,适合让没坐过飞机的人预体验,也可能帮助部分飞行焦虑者通过乘客视角熟悉流程。但争议集中在登录弹窗难关闭、移动端崩溃或刷新、内存占用高,以及航线、座舱细节还不够真实。社区还提出多人同航班、真实 ATC、更多机舱干扰和付费升舱等扩展想法。
No.05
An update on Wayback Machine access
Wayback Machine 访问受限更新
507 分
262 条评论
作者: ChrisArchitect
Internet Archive 表示,Wayback Machine 近期遭遇多轮高流量自动化访问,为维持服务运行已加强防护,并改写了被拦截时显示的 429「请求过多」提示。官方承认这些措施会误伤真实用户,正在改进区分滥用机器人与日常用户的能力;若被误封,可向 info@archive.org 提供操作系统、浏览器和 IP 以便排查。争议焦点在于开放互联网公共资源如何抵御大规模抓取,尤其是疑似 AI 训练需求带来的流量压力,同时避免把普通用户、公司网络、VPN 或 IPv6 用户一并挡在门外。
No.06
Negativland, Culture Jamming, and the Art of Making Something New
Negativland、文化干扰与再创作艺术
72 分
18 条评论
作者: bananaboy
文章回顾实验声音拼贴团体 Negativland 46 年来的创作脉络:他们从 1980 年自制唱片起步,用采样、广播、表演、视觉艺术和幽默拼贴回应美国文化中的权力、资本、媒体与版权制度,并提出「文化干扰」一词。1991 年因戏仿并采样 U2 而遭诉讼,使他们成为合理使用和版权改革讨论中的重要案例。Internet Archive 现保存其 4000 多小时广播节目,并将举办现场演出。文章强调其影响力不在大众规模,而在持续挑战艺术边界、媒介控制和公司文化所有权。
No.07
Gemini 3.8 Live and 3.8 Live Extended Thinking
Gemini 3.8 Live 与扩展思考版发布
388 分
252 条评论
作者: leumon
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,主打近实时语音推理、低延迟对话、视觉 grounding、多语言自动切换和后台工具调用。普通版面向规模化与成本效率,扩展思考版面向复杂任务,可边推理边说话,并在语音质量、τ-Voice、Big Bench Audio 等基准中取得高分。产品将通过 Gemini API、AI Studio、企业平台、Search Live、Gemini Live 和 Workspace 分阶段推出,音频输出会加入 SynthID 水印。争议集中在实际可用性、版本 rollout 混乱、工具能力不足、价格与部分演示质量。
No.08
Doing Everyone Else's Job
替别人把活干了
38 分
19 条评论
作者: luu
作者主张,能做「别人岗位上的事」在组织中很有价值:当用户不愿采用新工具,就直接替他们集成;当管理者不推动,就绕过头衔协同其团队;当流程排期拖延,就提交补丁推动合并。这不是慈善,而是让目标真正发生,也让自己理解组织运作并获得杠杆。但作者区分了两种危险相似物:盲目自研替代购买,以及各部门重复建设本可集中化的服务。前者涉及买与建的真实权衡,后者涉及标准化与自治的复杂取舍,不能只因容易增人头或避免跨部门依赖而推进。
No.09
Datamimic – don't let your coding agent invent its own test world
Datamimic:别让编码代理自己编造测试世界
28 分
5 条评论
作者: ake2l
Datamimic 是一个面向开发与测试场景的合成数据生成工具,核心诉求是让编码代理在真实约束下生成可用测试数据,而不是临时凭空编造一套不一致的测试世界。根据标题与评论推断,它可能提供按规则、模式和数据库结构生成测试数据的能力,用来缓解 AI 编程代理在准备测试环境时的瓶颈。社区关注点集中在两方面:一是智能代理是否也能自行写生成脚本并执行,Datamimic 的价值需体现在更可靠的约束表达与集成;二是它是否原生支持关系型数据库中的 schema 约束、外键和跨表一致性。此外,有评论批评其官网聊天插件用闪烁标签页提示未读消息,显得打扰且不专业。
No.10
Recreating Voodoo Graphics and a Late-1990s Gaming PC on an FPGA
在 FPGA 上重现 Voodoo 显卡与九十年代游戏 PC
116 分
28 条评论
作者: zdw
作者在 z486_MiSTer 基础上实现了 zSST:用 SystemVerilog 在 Xilinx KV260 FPGA 上复刻 3dfx Voodoo Graphics,并与自研 z486 CPU 组成可运行 DOS 与 Tomb Raider 原生 3dfx 渲染器的 z486 XL。文章解释 Voodoo 的固定功能管线、主机 CPU 负责几何变换、显卡负责三角形光栅化、纹理过滤、雾化、混合与双缓冲等机制;实现目标是一周期一像素吞吐,而非单像素一周期完成。当前功能已覆盖大部分 SST-1 特性,但测试集中在 Tomb Raider,兼容性、后续 Voodoo 世代和更小板卡支持仍待推进。
No.11
Building a Linux GPU Driver for the M4 Mac Mini in One Month
一个月为 M4 Mac Mini 构建 Linux GPU 驱动
284 分
167 条评论
作者: ADevWithAnIdea
作者称与合作者约一个月内为 M4 Mac Mini 和 MacBook Neo 写出符合 OpenGL ES 3.0 的 Linux GPU 驱动,可运行浏览器 WebGL 和 200fps 的 Minecraft,并计划支持 Vulkan。核心方法是用自建 hypervisor 采集 macOS 与 AGX 固件交互轨迹,在不查看 Apple 二进制的前提下重放、缩减状态并重建用户态驱动、着色器编译器、命令流和内核固件 ABI。文章强调这是可验证的洁净室逆向,但社区争议集中在作者曾任 Apple 员工、LLM 大量参与、Asahi Linux 禁用 AI 代码以及上游接受代码的法律风险。
No.12
German Rheinmetall open-sources its Battlesuite connected weapon system protcol
莱茵金属公开 Battlesuite 互联武器系统接口文档
203 分
71 条评论
作者: summarity
莱茵金属发布了 Battlesuite 相关 onboardapi 的在线文档,介绍其用于传感器系统与软件组件通信的接口库和中间件。该方案基于 ddkit 与 OMG 的 DDS 标准,采用数据中心式发布订阅架构,强调低延迟、可靠交换、跨复杂软硬件环境互操作,并通过 DDS XTypes 与 XCDR2 保持数据模型演进时的向后兼容。核心库为 C++,同时支持 Java、C#/.NET 与 Python 封装。争议点在于:社区认为这更像公开规范文档而非真正开源代码;也有人质疑 DDS 在军工系统中的复杂性、性能与替代方案。
No.13
Why I'm still bearish on LLMs after Navier-Stokes
纳维-斯托克斯之后,为什么我仍看空 LLM
192 分
211 条评论
作者: jaykru
作者认为,纳维-斯托克斯等突破展示的是 LLM 在严密规格、可验证任务上的最佳情形,并不能证明其已具备可替代知识工人的自主性。当前模型仍依赖大量监督和护栏,泛化常局限于训练任务邻域,稍有扰动就可能失败或奖励黑客。真正解决奖励黑客需要领域专家写出严格规格,但规格与验证成本往往高过直接实现,硬件工程中验证人员远多于设计人员就是例子。作者判断,LLM 更像「天才实习生」:在人类专家手中很有用,但难以放任自治;可低成本失败、任务窄且护栏清晰、或本就承担高规格验证成本的行业最适合采用。评论争议集中在估值是否真基于替代知识工人、模型能力是否仍被低估,以及开放廉价模型是否会持续削弱前沿实验室价值。
No.14
We got admin access to Baseten's production GitHub
Strix 如何拿到 Baseten 生产 GitHub 管理权限
270 分
148 条评论
作者: bearsyankees
Strix 称在评估推理服务商 Baseten 前,对其公开攻击面做黑盒扫描,25 分钟内在一个公开 Harbor 镜像仓库中发现旧版 baseten-app 镜像,并从 Docker 构建历史里的 RUN 步骤取到仍有效的 GitHub PAT。该 token 属于 basetenbot,拥有 repo 范围权限,可管理主产品仓库、GitOps 部署仓库及部分客户相关私有仓库。问题源于 2023 年构建时把 GitHub token 作为构建参数传入,凭据被写入镜像元数据且三年未轮换。Strix 仅做只读验证后披露,Baseten 次日私有化仓库并轮换 token。文章强调应使用 BuildKit secret、检查镜像历史并撤销旧凭据;争议则集中在未经许可扫描的合法性、把真实供应商案例用于营销是否合适。
No.15
Saving Jet Fuel
用开源工具优化航线节省航油
87 分
39 条评论
作者: marklit
文章演示如何用 Airbus 的「scikit-decide」、TU Delft 的「OpenAP」飞机性能与燃油模型,以及 NOAA 风场数据,构建开源航线优化流程。作者以 A320 等机型为例,介绍安装依赖、读取 OpenAP 的飞机和发动机数据,并尝试计算在风况影响下更省油的航路,目标是减少长途飞行数千美元级别的燃油成本。评论区普遍认为这是有趣的技术演示,但与真实商业航班规划差距很大:实际航路受 IFR 航点、空管、海洋航路、ETOPS、RVSM、天气、监管、时间成本和机场流程等多重约束,不可能只按燃油最优自由飞行。
No.16
A software thing I built: GPS on a 25MHz 486-SX
在 25MHz 486-SX 上实现 GPS 移动地图
13 分
4 条评论
作者: JPLeRouzic
作者回忆 1993 年作为嵌入式承包商,为一台 25MHz 486-SX、32MB 内存、无数学协处理器的设备开发实时 GPS 移动地图显示。传统 GIS 依赖大量浮点和三角计算,难以在低端 CPU 上运行;他借助 Dr. Dobb’s Journal 介绍的 Hipparchus 库,用 Voronoi 单元和 8/16 位整数运算大幅降低计算量,最终实现每 2 秒刷新 1024×768 彩色地图,性能甚至领先几年后的早期消费级 GPS。项目因客户财务问题和 IP 归属而中断,作者感叹若当时理解洁净室重写策略,或许能另起炉灶。
No.17
A single firm is behind OpenAI, Anthropic, and Meta hacking scandals
Irregular 被指牵连多起 AI 黑客评测争议
602 分
205 条评论
作者: yusufozkan
文章指控安全评测公司 Irregular 是 OpenAI、Anthropic、Meta 近期多起 AI 黑客事件背后的共同第三方,称其在配置不当的评测环境中让模型接触真实互联网,导致未授权访问、恶意包发布和漏洞利用。作者批评 Anthropic 等将责任包装成「失控智能体」或「对齐问题」,转移对供应商与实验设计失误的追责,并梳理 Irregular 与有效利他主义圈、以色列实体及资助网络的关系,暗示监管与法律责任可能不足。但文章立场强烈,部分评论质疑其夸大 Irregular 角色,尤其 OpenAI-Hugging Face 事件是否相关存在争议。
No.18
Show HN: Capsule – Single-file web apps that save their data into SQLite
展示:Capsule,把网页应用和 SQLite 数据打包成单文件
321 分
129 条评论
作者: bashtian
Capsule 主张把个人应用变成像文档一样可分享的「.capsule」文件:界面、媒体资源、HTML/CSS、SQLite 本地数据和 schema 都封装在一个离线文件中,可在 macOS、Windows、Linux 打开,未来支持移动端,并可用 AI 提示生成和更新应用。它强调无云端、无账号、数据私有与跨平台便携,适合小型追踪器、作品集、家庭或部门工具。争议集中在专有格式和宿主播放器带来的分发摩擦、代码可审计性、安全与恶意载荷风险,以及状态同步和协作场景是否会重新走向中心化后端。
No.19
Learning to solve hard problems in RL for LLMs by never giving up
用「永不放弃」让大模型强化学习攻克难题
86 分
4 条评论
作者: natolambert
文章指出,大模型 RL 后训练的平均评测曲线会掩盖「马太效应」:提升主要来自原本就会做的简单题,难题几乎不进步。作者认为问题不只是 GRPO 在难题上采样不到正例,还在于过多算力浪费在简单题的偶发错误上。实验显示小 k 后期更高效,大 k 早期有利于发现难题正例。为此提出「Never Give Up」:先用小 k 采样,若全错则以概率 p 继续追加采样,直到发现正例或放弃,从而对难题自适应投入更多样本,并结合异步 RL 的过期样本过滤与 baseline 重标定。GSM8K 与更大数学设置中,NGU 尤其改善最难子集。
No.20
MartyPC – A Cycle-Accurate IBM PC/XT Emulator
MartyPC:周期精确的 IBM PC/XT 模拟器
7 分
1 条评论
作者: yitchelle
MartyPC 是一个面向 IBM PC/XT 的「周期精确」模拟器,重点不只是运行旧 DOS 软件,而是尽量复现早期 PC 硬件在时序、总线、CPU 与外设交互上的细节。这类项目对复古计算、软件考古、演示程序验证以及调试依赖硬件时序的老程序有价值。由于原文正文未能抓取,具体实现语言、支持设备范围和使用方式需以 GitHub 仓库为准。HN 本次讨论几乎没有技术展开,唯一评论指出这是重复提交,并给出 24 天前的早期讨论链接,因此社区焦点主要在去重而非项目本身。
No.21
Chopping up books when they're physically too big
把太厚的书切成更好读的小册
164 分
153 条评论
作者: matt_kirkland
作者主张,遇到像《Lonesome Dove》这种 850 多页、拿着累、出门占包的大厚书,可以把自己的书按自然分段切开,重新装成若干便携小册。做法是购买个人副本,找章节或部的断点,掰开书脊,用美工刀沿胶层切分,再用马尼拉文件夹、白胶和夹子做临时封皮并标记。作者强调这不是破坏公共书或珍本,而是为了提升阅读体验。争议在于:有人认为纸书可被使用、标注和改造;也有人觉得这是毁坏书籍之美,或认为电子阅读器才是更合理的解决方案。
No.22
Let's make quality the norm again
让高质量重新成为消费常态
374 分
383 条评论
作者: ingve
挪威消费者委员会报告主张,通过消费者政策推动更循环的经济:让耐用、可维修、可复用的产品更容易选择、更安全也更有吸引力。文章强调,这不仅是环保议题,也关系到消费者权益、家庭支出和社会韧性。评论区则对「质量曾是常态」提出质疑,认为价格更易比较、质量难以验证,品牌也可能在声誉建立后降质;有人支持用更长保修、监管和维修权改善激励,也有人指出消费者未必愿意为质量支付足够溢价。
No.23
Jean-Pierre Serre turns 100
让-皮埃尔·塞尔百岁诞辰
130 分
24 条评论
作者: jzox
文章回顾法国数学家让-皮埃尔·塞尔的百年人生与学术轨迹:他幼年在母亲旧微积分书中自学数学,曾靠替寄宿同学做题训练;1944年获法国普通竞赛数学第一,后入巴黎高师,加入布尔巴基小组,并在亨利·嘉当研讨班中走向代数拓扑、层论和代数几何。塞尔1951年获博士,1956年起任法兰西公学院代数与几何讲席,长期往返普林斯顿、哈佛等地讲学。传记突出其早熟天赋、研究自由、教学高标准,以及从形式计算到现代严密数学之间的张力。
No.24
The Beauty of Roundabouts
环岛之美
43 分
53 条评论
作者: ngruhn
作者以软件工程师的眼光赞美环岛:相比红绿灯路口,环岛像一种更简单、静态、低维护的解决方案,不耗电、不依赖传感器,也不会让人在无冲突车流时空等;车辆进入时因转弯自然减速,减少黄灯抢行等风险。作者还喜欢环岛中央可放置艺术、绿地、喷泉或城镇标志,让基础设施更有趣。但评论指出,环岛并非万能:它占地更大、改造成本高,在车流方向不均、多车道、行人和自行车通行场景中可能表现很差,效果高度依赖设计与交通条件。
No.25
An interactive world map of the stories cultures have told
世界各地创世故事的互动地图
41 分
4 条评论
作者: momentmaker
这篇 Show HN 展示了一个按地理位置和时间线浏览各文化故事的互动世界地图,重点似乎是把不同民族、地区的神话与创世叙事可视化。评论者认为它能补足以美国为中心的教育视角,也注意到许多宇宙起源故事有相似结构:最初是海洋或混沌,随后才出现动植物和人类,与现代科学叙事有某种有趣呼应。主要争议集中在资料覆盖不足:滑动时间轴时很多地区内容稀疏或空白;同时有人提醒,地图只能呈现「已知故事」,大量地方和原住民传统已永久失传,且仍在全球化与技术同质化中快速消失。
No.26
Suspected sabotage causes major Netherlands rail disruption
荷兰铁路遭疑似蓄意破坏,阿姆斯特丹等地大面积延误
476 分
422 条评论
作者: choult
荷兰铁路基础设施运营商 ProRail 称,周二该国中部和北部多处轨道被人放置管道、电缆等物体,超过 35 起事件导致信号系统误判轨道被列车占用,引发阿姆斯特丹、史基浦机场、埃因霍温和乌得勒支等线路大面积取消和延误。警方、检方和情报机构已介入调查,尚未确认嫌疑人和动机。事件发生在政府公布预算的「Prinsjesdag」,同日农民团体因氮排放政策举行抗议并在道路旁点燃干草捆,但当局尚未确认二者有关联。铁路运营方称事件显示荷兰对铁路系统依赖很高,需要加强应急韧性。
No.27
Stay discoverable in search while disallowing AI training
Cloudflare:允许搜索收录但禁止 AI 训练
57 分
35 条评论
作者: djfergus
Cloudflare 推出「Disallow AI Training」设置,试图解决混合用途爬虫带来的两难:网站希望保留搜索可见性,却不愿内容被用于 AI 训练。该设置会在 robots.txt 发布禁止训练偏好,并允许被认定为「Accountable」的 Apple、Google、Microsoft 爬虫继续用于搜索;其他训练型爬虫则会被阻止。Cloudflare 还计划进一步提供 AI 摘要使用比例控制,并迁移旧有「Block AI Bots」等配置。争议在于,这套机制依赖大型平台承诺和 Cloudflare 识别、执法能力,社区普遍质疑其可执行性与信任基础。
No.28
WangNet – 1.8 MB, zero-dependency Numberwang adjudication in 11 languages
WangNet:1.8 MB、零依赖的多语言 Numberwang 判定器
145 分
51 条评论
作者: Liogra123
WangNet 是一个围绕英国喜剧节目 Mitchell and Webb 中虚构游戏「Numberwang」做的开源项目:号称仅 1.8 MB、零运行依赖,可用 11 种语言判断某个数是否为 Numberwang。由于原文未能抓取,核心内容只能从标题和评论推断:项目更像一次认真包装的程序员玩笑,把荒诞规则当成机器判定问题来实现。评论区多数人在延续梗,包括 Mornington Crescent、Colosson、Wangernumb 等相关笑话;也有人认真指出,Numberwang 的判定可能依赖前序数字和局面状态,单独判断每个数字未必正确。另有读者质疑「零依赖」说法,因为仓库中出现 requirements.txt 和 gradio;随后有人解释 gradio 只用于演示,模型本身使用示例无需依赖。
No.29
Most people prefer traditional architecture
多数人更喜欢传统建筑
326 分
277 条评论
作者: alihm
文章回顾近几十年建筑视觉偏好调查,认为现代主义自20世纪中期主导全球建筑以来,始终缺乏大众喜爱。早期研究虽有样本和图片控制不足,但从新泽西 Metuchen 调查、英国住房偏好民调到近年更可控的图像实验,结果都显示超过六成受访者偏向传统建筑,许多调查支持率超过八成,且年龄、性别、政治、阶层和国籍差异有限。作者认为这反映公众对当代建筑主流趋势的不满,但也承认图片调查难完全区分风格、成本、街道尺度、材料和使用体验等因素。
No.30
Show HN: Pull every comment out of a Google Sheet, in the browser
展示:在浏览器中提取 Google Sheets 的所有评论
5 分
0 条评论
作者: bsunter2
CommentPulse 解决 Google Sheets 评论难以整理的问题:用户将从 Google Sheets 下载的 .xlsx 文件拖入网页后,工具会在本地浏览器中解压并读取工作簿,把每条评论线程按顺序列出,包含所在工作表、单元格、回复内容以及是否已解决。它强调无需账号、登录或服务器上传,关闭标签页后文件即消失,适合需要统计、排序、交接或审阅表格评论的场景。目前仅支持电子表格导出的 .xlsx,不支持 Docs 或 Slides;作者还提到已有可在 Sheets 内一键把评论导入当前表格标签页的插件版本。
评论精华