No.01
Developers don't understand CORS (2019)
为何开发者搞不懂 CORS
152 分
67 条评论
作者: toilet
作者是一位全栈顾问,指出大量Web开发者不理解CORS原理,以2019年Zoom漏洞为典型案例:Zoom在localhost:19421运行本地Web服务器,用「图片尺寸传递状态码」的土法绕过CORS,导致任何网站都能触发Zoom客户端并获取响应,存在严重安全漏洞。作者认为正确做法是设置Access-Control-Allow-Origin头限定为zoom.us域名,并配置CSP阻止iframe渲染。但评论区有人反驳:TFA自己对CORS的理解也有误——CORS本质是浏览器对自己的限制,而非服务器对客户端的授权;还有人指出CORS错误信息被刻意削弱、文档从不解释「为什么存在」,以及威胁模型不清晰(保护的是用户而非服务器),这些都是理解困难的根本原因。许多开发者不问原理直接设Access-Control-Allow-Origin: *,AI工具更是加剧了这一趋势。
No.02
Zigzag Decoding with AVX-512
AVX-512 加速 Zigzag 解码
55 分
3 条评论
作者: luu
meshoptimizer 作者 Zeux 探索了 AVX-512 环境下 zigzag 整数解码的两种替代优化。Zigzag 编码将带符号整数转为无符号:正值存为 2*v,负值存为 2*(~v)+1,解码公式为 (v >> 1) ^ -(v & 1)。常规 SSE2/AVX2 实现需 4 条指令(vpsrld、vpandq、vpsubd、vpxorq),延迟 3 周期。作者尝试用 AVX-512 掩码机制重写:先通过 vptestmd 生成条件掩码,再用 vpxord{k1} 做条件 xor,最终压缩到 3 条指令,但 vptestmd 本身需 3 周期延迟,总延迟反增 1 周期。对于 16 位整数,因 AVX-512 不支持掩码 xor,改用 _mm_mask_sub_epi16 做条件减法同样可行。作者坦承这类优化「取决于场景」,延迟绑定场景下反而不如原版。评论聚焦编译器自动化的可能性,有用户指出编译器可借助 GFNI 指令实现类似优化,但需显式声明支持。
No.03
Loupe – A iOS app that raises awareness about what native apps can see
Loupe:揭示iOS原生应用数据收集能力的隐私教育工具
241 分
66 条评论
作者: Cider9986
Loupe是一款由研究人员开发的iOS应用,旨在通过可视化方式向普通用户展示已安装应用无需特殊权限即可收集的各类数据,包括设备首次设置或擦除日期、键盘语言列表、区域设置、音量创建时间、粘贴板内容访问次数等敏感信息。这些信息结合后可形成唯一设备指纹,用于跨应用追踪用户行为。开发者通过此工具揭露iOS生态中普遍存在的数据收集现状,引发社区对移动隐私保护的强烈担忧。有评论指出苹果未向用户充分披露这些数据访问能力,部分API设计过于激进。唯一有效防护措施是减少应用安装数量、优先使用网页版本,或借助GrapheneOS等隐私强化系统限制应用网络访问。
No.04
Renting a sewing machine from the library
芬兰图书馆新形态:从借书到借缝纫机,如何成为民主基础设施
207 分
105 条评论
作者: sohkamyung
芬兰正重新定义图书馆的角色——不再是单纯的书籍借阅场所,而是共享工具、社区聚会与数字支援的公共服务中心。赫尔辛基中央图书馆Oodi每日早8点便有读者涌入,借用物品除书籍外,空间预约、桌游、游戏机最为热门,甚至可借缝纫机、3D打印机、录音室等。芬兰有700余座图书馆,55%国民每月到访,人均年访问9.1次,远高于英美的约2.5次。图书馆被写入芬兰《图书馆法》,明确承担促进民主、言论自由与公民参与的使命。研究者发现,图书馆每投入1美元可产生3至5美元社会价值。然而英美等国同期大量关闭图书馆——2008至2019年美国关闭766座、英国2016至2023年削减180座——学者警告削减图书馆反而造成使用率下降的自我实现预言,引发关于图书馆核心价值的国际讨论。
No.05
The 100k Whys of AI
AI 的十万个「为什么」:模式坍缩与同质化危机
74 分
27 条评论
作者: surprisetalk
安全博主 lcamtuf 探讨 AI 生成文本是否可被识别。核心论点:LLM 输出的不是「不像人类」,而是面对任何提示都反复使用相同的复杂习惯模式——即「模式坍缩」。作者以亚马逊上约 150 本「100,000 Whys」儿童书为例:封面几乎相同(同一只恐龙图标、同样的火箭或金毛犬图案),标题高度重复,印证了 quasi-deterministic 特性。模式坍缩的信号模糊,不足以作为铁证,但在日常场景可信任直觉。警示:当生产内容比消费更容易时,网络互动模式将彻底瓦解——若用 LLM 自动化博客,「你的网站可能也会变成 100,000 Whys」。评论补充:mode collapse 本质是 LLM 反复生成同一小部分「最像人类」的回复;编程中同质性反而是优点;亚马逊那些书的内容比封面更劣质、充满错误;人类创作天然具有多样性,而 LLM 总是在问同一颗脑袋。
No.06
Building reliable agentic AI systems
构建可靠的Agentic AI系统: Bayer PRINCE平台案例研究
75 分
14 条评论
作者: sarangk90
Bayer与Thoughtworks合作开发了PRINCE(临床前信息中心)平台,旨在解决制药行业药物研发中的数据获取难题。该系统经历了Search(搜索)、Ask(问答)到Do(执行)三阶段演进,从关键词搜索演变为支持自然语言问答的智能助手,进而成为能执行复杂任务的多Agent系统。核心技术采用Agentic RAG与Text-to-SQL融合架构,由LangGraph编排工作流,协调Researcher、Writer、Reflection等专业化Agent。系统通过上下文工程(决定模型看到什么、如何在步骤间传递信息)和马具工程(编排、恢复、可观测性、人类审查)双重视角指导工程决策。平台优先考虑信任建设,包括透明度、可解释性与人类在环整合,确保治理与合规。评论焦点集中在:Agent分解缺乏系统评估、多Agent循环工作流的非确定性挑战、底层数据质量对系统可靠性至关重要、以及上下文纪律(而非单纯扩大上下文窗口)被低估。
No.07
Epoll vs. io_uring in Linux
Linux 异步 I/O:Epoll 与 io_uring 对比
135 分
36 条评论
作者: Sibexico
作者记录了 TinyGate 反向代理从 worker 架构 → epoll → io_uring 的演进历程。epoll 采用「就绪通知」模型,每次 I/O 需 epoll_ctl + epoll_wait + read/write 共 2 次 syscal,语境切换开销大。io_uring(Linux 5.1+ 2019 年引入)采用「完成通知」模型,用户与内核通过共享内存 ring buffer 交互,批量提交/收割完成事件,大幅减少 syscal 次数。文章提供了两种方案的 C 代码示例,并提及零拷贝(io_uring_register_buffers / IORING_OP_SEND_ZC)、SQPOLL 消耗 CPU、异步错误处理等注意事项。作者认为现代服务器应优先选 io_uring,但社区评论补充了其他视角:io_uring 在部分环境因安全原因(seccomp 绕过、审计子系统问题)仍被禁用;切换后 CPU 利用率可能上升(取决于使用模式);RHEL 9/10 已默认支持;性能提升程度因场景而异。
No.08
Slow breathing modulates brain function and risk behavior
慢呼吸调节大脑功能与冒险行为:延长呼气为何反而增加风险承担?
168 分
36 条评论
作者: croes
该研究来自《Neuron》期刊,探讨慢呼吸(specifically prolonged exhalation breathing,即延长呼气的呼吸模式)如何调节大脑功能并影响风险承担行为。研究意外发现,通过副交感神经激活,慢呼吸反而会提升冒险倾向——这与「深呼吸镇静」的直觉认知相反。评论者指出,研究结论特指延长呼气而非泛泛的慢呼吸;也有网友联系到瑜伽修行者数百年来提倡的呼吸法,认为科学终于佐证了传统智慧。同时引发争议的是:恐惧本身有时是好的防御机制,慢呼吸削弱恐惧是否只在明知恐惧不合理时才适用?
No.09
Show HN: TownSquare, a tiny presence layer for websites
展示: TownSquare,为网站添加实时访客共在感的轻量工具
156 分
79 条评论
作者: cauenapier
TownSquare 是一款极简的网站访客「共在感」工具,只需在页面底部嵌入一行 script 标签,访客便能看到彼此、以虚拟形象在虚拟空间中移动、交流,无需注册账号。其设计理念是让网络内容背后重新出现「人」的存在感——像街头广场一样自然相遇。但该演示页面自身已暴露出致命缺陷:大量访客涌入后恶意刷屏「dick and balls」等骚扰内容,完全失控。社区评论几乎一边倒地指出内容审核机制缺失是最大痛点,有人建议接入 OpenAI 免费审核 API,有人怀念 90 年代类似的 Third Voice 项目,也有人建议向 Nintendo 学习预设词表或只保留「消息数秒后自动消失」等低成本方案。核心争议在于:无审核的匿名公共空间注定沦为混乱,但强审核又会破坏简约原则。
No.10
15-minute at-home Lyme disease tick test
15分钟居家莱姆病蜱虫检测产品八月上市,创始人MIT背景引争议
98 分
40 条评论
作者: bookofjoe
一款名为 LymeAlert 的15分钟居家蜱虫检测仪将于今年八月上市,定价40美元。它由麻省理工斯隆管理学院 MBA 学生 Erin Dawicki 创办,灵感来自她作为儿科骨科医师助理接到的无数患者电话——被蜱虫叮咬后该怎么办。传统实验室检测需一周以上、费用50至450美元,而 LymeAlert 使用时将最多五只蜱虫放入自带研磨器的塑料容器中磨碎,再插入化学处理试纸,若检出莱姆病细菌则变色。创始人表示阳性结果可让人在72小时黄金窗口期内及时服用抗生素;但医学专家提醒该检测仅针对莱姆病、无法发现其他蜱媒病原体(如导致Alpha-gal综合征的介质),且假阳性可能引起不必要恐慌。LymeAlert 还计划通过手机应用匿名收集感染蜱虫地理位置,结合NASA卫星数据与动物迁徙数据训练AI预测模型。评论中有人质疑「发现阴性蜱虫不等于没有其他蜱虫叮咬过你」,也有用户指出蜱虫附着时间、鹿群数量管理对疾病传播的影响。
No.11
Public Service Announcement: Don't Say You Use AI for Writing
公开警告:别说你在用 AI 写作
17 分
5 条评论
作者: satisfice
软件测试专家 James Bach 在其博客发文,公开反对将 AI 用于署名写作。他宣称自己从不让 AI 起草任何署名内容,将此比作「蹬固定自行车装锻炼」或「坐直升机登珠峰」。他区分了深度协作(双方共同投入大量时间精力)与 AI 代写的本质差异:前者可追溯验证,后者无从判断。核心论点是:若用 AI 帮助写作却不披露,等于撒谎;即便声称「只是帮助」,旁观者也会默认你可能全由 AI 完成。他引用类比——只有说谎者才会主动声明「我经常撒谎」,同样,只有用 AI 辅助写作的人才需要澄清。结论是:专业社区将对此类行为「一票否决」,你的声誉将因此崩塌。文章还配有其官方 AI 写作政策下载链接,呼吁读者悬崖勒马。
No.12
Guide to the TD4 4-bit DIY CPU
TD4 4位DIY CPU组装与编程指南
28 分
3 条评论
作者: andrewstuart
本文介绍一款来自AliExpress的TD4 4位CPU套件,包含2个寄存器、LED和16字节程序ROM。作者花费两个焊接时段完成组装,遇到USB接口和贴片二极管方向等挑战。文章深入解析其工作原理:程序存储器为16组DIP开关,通过组合逻辑芯片将开关位转换为操作码,控制加法器、数据选择器和寄存器。A、B、Out、PC四个寄存器中仅PC具备计数功能,JNC指令依赖进位触发器实现跳转条件。作者还编写了Python模拟器和汇编器,并演示了LED闪烁、数字计数(递增、递减)等基础程序,展示了该套件作为计算机架构教学工具的价值。
No.13
SMPTE Makes Its Standards Freely Accessible
SMPTE 宣布免费开放所有标准,拥抱开源工作流
250 分
76 条评论
作者: zdw
SMPTE(电影电视工程师协会)宣布将其全部标准库免费开放给全球媒体技术社区,这是该组织推动标准开发与发布流程现代化的重要举措。此举结束了长期以来工程师需要支付数百美元才能获取关键标准的状况。评论区对此普遍叫好,但也引发更广泛讨论:有人指出建筑规范如 NEC(电气规范)和 IPC(管道规范)仍要收费 130-170 美元;有人批评标准机构通过维持付费墙来保护会员公司的商业利益;还有人指出某些标准被故意写得晦涩复杂、缺乏测试套件,以维护行业壁垒。关于使用 GitHub 托管标准,有评论指出 GitHub issues 等功能并不跨平台可迁移,git clone 只能拿到 HTML,真正的协作功能仍受制于平台。
No.14
Excessive nil pointer checks in Go
Go 语言中过度 nil 检查的问题
16 分
10 条评论
作者: ingve
文章批判 Go 代码中过度使用 nil 指针检查的现象。作者认为,当 nil 检查出现在错误位置时,非但不是防御性编程,反而暴露了代码已失去对对象来源和不变量的清晰追踪。以 RateLimiter 为例,若 Redis 客户端为 nil,问题早在构造时就已发生,在使用处检查只是将无效状态合法化,违背了「快速失败」原则。正确的做法是在初始化站点立即处理错误,不让 nil 指针继续传播;若系统需容忍暂时不可用,应显式建模而非隐式传 nil,将复杂性封装在内部。静默失败(swallowed error)比显式错误危害更大——它延迟了问题的发现,使根因更难追溯。请求数据同样应在入口边界层验证,而非在深层函数中重复检查。
No.15
UHF X11: X11 Built for VisionOS and Apple Vision Pro
UHF X11:为 visionOS 和 Apple Vision Pro 构建的 X11 显示服务器
195 分
37 条评论
作者: zdw
UHF X11 是一个将 Apple Vision Pro 变成完整 X11 显示服务器的项目,允许用户把 Xlib 客户端发送到 visionOS 的空间窗口中,每个 X11 顶级窗口独立呈现为 visionOS 窗口。支持标准 X11 TCP 连接、GLX/OpenGL 渲染、CRT 扫描线与辉光等复古滤镜,以及位图字体导入。项目还提供 X authority cookie 设备端生成,确保认证安全。评论者普遍认为这是一个有趣的技术玩物,「3D in 2D in 3D」的描述引发怀旧共鸣——OpenGL 兼容性问题像极了 2000 年代。同时引发关于 X11 生命力的讨论,有人认为 X11 会比 visionOS 和 Wayland 存活更久;也有人指出 $3500 的定价让它更像开发玩具,Steam Frame 等 Linux 友好型头盔或许是更务实的选择。
No.16
DOS Game "F-15 Strike Eagle II" reversing project needs DOS test pilots
DOS游戏《F-15 Strike Eagle II》逆向工程公开招募测试飞行员
236 分
63 条评论
作者: LowLevelMahn
一位开发者正在通过逆向工程重建1989年经典DOS飞行射击游戏《F-15 Strike Eagle II》的C源代码。项目进展惊人,原本预计还需数年工作,但仅一个月就完成了所有可执行文件的C代码重建、汇编数据迁移至C、以及大部分汇编代码的C替代实现。游戏现已达到可用状态,开发者公开招募测试飞行员来帮助发现潜在bug。测试版本v0.9.1需要配合原版451.03及沙漠风暴资料包使用。由于采用逐bug还原的重建方式,原版游戏的任何遗留问题也会被保留。评论中社区成员高度评价此项工作,指出移植老DOS游戏现在已非常容易(有人不到一天就完成了某个游戏的移植),开源逆向的核心价值在于获得可修改的源代码而非仅能运行模拟器。此外AI在辅助理解反汇编代码方面展现出惊人能力,多位社区成员分享了童年与朋友们分坐键盘两侧合作操控战机的美好回忆。
No.17
Unauthorized alert sent to cell phones across Brazil
巴西多州手机遭黑客入侵:收到「misantropi4」未经授权极端警报
123 分
87 条评论
作者: zdw
周六上午,巴西多个州的手机用户收到一条未经授权的「极端」警报,信息内容为「misantropi4」——这是「misanthropy(厌世)」一词用leetspeak的变体写法。警报首先在巴西南部巴拉那州触发,随后蔓延至圣保罗和里约热内卢等大城市。巴西国家民防局表示,预警平台疑遭黑客入侵已被紧急关停,相关部门正在调查攻击源头。民防局声明称该信息属于「极端警报」类型且包含「对人类的仇恨」之含义。圣保罗、里约及巴拉那州民防部门均确认未曾发出此警报,并已联系国家电信管理局(Anatel)介入调查。类似系统在美国被称为WEA(无线紧急警报),常用于AMBER警报等紧急广播。
No.18
When I reject AI code even if it works
即使AI代码能跑,我也会拒绝的五个理由
158 分
87 条评论
作者: vnbrs
作者指出AI编程代理虽然加速了实现,但审查AI生成的代码成为新瓶颈。即使遵循良好实践(计划模式、分阶段、小改动),作者仍感到认知过载——因为没有亲自思考过这些改动。他坦白用AI完成大任务仍需数天,且经常否决AI的所有改动重新开始,因为「人」比模型更重要:给自己更多时间消化问题,才能引导代理找到更好的方案而非被它牵着走。作者列出拒绝AI代码的五个标准:无法用自己的话解释方案、diff比问题本身大、在证明需要之前引入抽象、代码能跑但让系统更难理解、以及信任输出胜过自己的理解。他强调「能跑且CI变绿」不等于好方案,工程从来追求的是「恰当、可扩展、可扩展」的解决。
No.19
The Lost Story of Alan Turing's "Delilah" Project
艾伦·图灵「Delilah」秘密语音加密项目失落始末
10 分
1 条评论
作者: asdefghyk
二战期间,艾伦·图灵在英国汉斯洛普公园秘密研发便携式语音加密系统「Delilah」。该项目始于1943年,旨在将美国贝尔实验室笨重的SIGSALY系统小型化——Delilah仅重39公斤,由三个鞋盒大小的单元组成,可装入卡车、战壕或大型背包。图灵与助手唐纳德·贝利历时近两年,于1945年欧洲胜利日来临前完成原型机,采用了基于严谨密码学原理的设计。然而随着战争结束,Delilah未能正式服役。2023年11月,贝利保存的这批档案在伦敦拍卖,以近50万美元成交,英国政府随即禁止出口,称之为「国家故事的重要组成部分」。档案揭示了图灵从数学逻辑学家转变为电子工程师的历程:他在布雷斯内克的昵称是「教授」,战时骑自行车往返布莱切利公园10英里外的密码破译总部,而贝利初到时发现图灵的电路布线如同「蜘蛛网」,不得不手把手教他面包板实验基础。
No.20
Running MicroVMs in Proxmox VE, the Easy Way
在 Proxmox VE 中便捷运行 MicroVM
6 分
1 条评论
作者: zdw
作者开发了 pve-microvm,让 QEMU 的 microvm 机器类型成为 Proxmox VE 的一等公民。LXC 容器启动快但缺乏硬件隔离,完整 VM 有 KVM 隔离但需经历 BIOS/GRUB 引导、模拟 legacy 设备,Boot 耗时 5-10 秒。microvm 去掉所有固件和传统设备,采用直接内核引导(virtio 环境),实现 300ms 内启动并拥有完整硬件隔离边界。该 .deb 包包含自定义 12MB Linux 6.12.22 内核、极简 1MB initrd、Web UI 集成,并支持 21 种客户机 OS(含 NetBSD、Plan9)。内核与根文件系统解耦——所有 Linux microVM 共用同一 vmlinuz,既保证容器式内核一致性,又维持 VM 式安全隔离。作者已在生产环境运行 Gitea、Caddy 反向代理等四台 microVM。注意 QEMU 10.x 中 MMIO 路径对 Linux 有设备探测 bug,已通过 PCIe non-transitional virtio 规避。
No.21
Whole cross-sectional human ultrasound tomography
全身人体超声断层成像技术
65 分
11 条评论
作者: lnyan
本研究展示了一种新型全身超声断层成像系统,可在反射和透射两种模式下对人体进行完整横截面成像。该系统采用定制512元环形超声接收阵列配合旋转发射器,实现了腹部和大腿的完整在体二维成像,分辨率均匀,且与临床MRI对比显示高度一致性。研究重点探索了两大临床应用方向:一是利用图像观察腹部脂肪分布,实现无电离辐射、无机械变形的脂肪厚度评估;二是演示视频速率活检针定位能力,追踪其与内部组织的关系。这项技术弥补了传统手持超声视野局限、操作者依赖、接触变形等短板,为目前其他成像模态无法满足的临床需求提供了潜在解决方案。
No.22
Armstrong Effect
阿姆斯特朗效应:蒸汽摩擦生电的物理奇闻
24 分
1 条评论
作者: userbinator
阿姆斯特朗效应是流体摩擦产生静电的物理现象,1840年由英国工程师William Armstrong(后来的阿姆斯特朗男爵)系统研究并命名。实际上此前Volta和Patterson等人均曾独立观察到此现象——蒸汽从锅炉安全阀喷出时会产生电火花。Armstrong通过实验确认火花发生在蒸汽排入大气的出口处,而非锅炉内部,并进一步发现压缩空气同样能产生此效应。他发明的「hydroelectric generator」虽名为水电机器,实为静电发生器,46个蒸汽喷口可产生22英寸长火花,噪音震耳,当时堪称最强静电发生器且完全无运动部件。1846年Armstrong因此入选皇家学会,后成为液压工程、军事炮兵和发电领域的工业巨擘。现代该效应应用于喷漆极化以节省油漆并改善附着性,但也造成过油轮清洗时爆炸事故。
No.23
Your brain was never designed for this much bad news
人类大脑从未被设计来处理如此多的负面新闻
135 分
94 条评论
作者: colinprince
人类大脑在进化中形成了「负面偏好」——对威胁的注意力远比正面信息更强烈、更快速、更持久。这一机制在远古时代是适应的:漏看危险意味着死亡,而过度警惕只是浪费几分钟。然而在2026年,同一套神经系统被要求在一天之内吸收全球多个地区的战争、金融震荡、气候灾难和暴力犯罪。调查显示,全球40%、加拿大69%的人至少偶尔回避新闻,主因是心情糟糕、感到无力。文章将这种状态定义为「问题性新闻消费」(PNC),美国约17%成年人达到严重程度,其中61%感到相当不适。研究者强调,回避新闻并非解药,民主需要知情公民;真正有效的做法是:限定每日获取新闻的时间窗口、选择深度报道而非算法推送的碎片信息、区分「知晓」与「可行动」的差距,并为可操作的事项采取小步行动。简言之,新闻本身不会变轻,但我们可以让大脑与它的关系变得更从容。
No.24
Linux eliminates the strncpy API after six years of work, 360 patches
Linux 7.2 正式移除 strncpy:历时六年、360 补丁的漫长告别
183 分
155 条评论
作者: simonpure
Linux内核在7.2版本中正式移除了strncpy函数。该函数因NUL终止符语义反直觉、行为易产生bug,以及冗余零填充带来的性能问题,长期被视为「持续性bug来源」。过去六年,开发者用strscpy()、strscpy_pad()、strtomem_pad()、memcpy_and_pad()等更安全的替代函数,逐一替换了内核中所有strncpy调用点,共提交约362个补丁。值得注意的是,「360补丁」指的是移除的调用点数量,并非修复的bug数量。社区评论围绕多个议题展开:有观点认为C语言的null终止字符串是「计算机界最大的错误」,Pascal风格字符串更安全;有人吐槽strlcpy存在近30年却始终未获Linux青睐;也有人认为这种长期项目正是系统工程中「无聊的苦活累活」,正是这类工作让大型基础设施保持可靠运转。部分评论探讨了LLM辅助代码重构的可能性,以及为何一个看似简单的替换工作实际上需要如此漫长的时间。
No.25
Project Fetch: Phase Two
Project Fetch 第二阶段:Claude Opus 4.7 操控机器狗速度是人类 20 倍
55 分
20 条评论
作者: stopachka
Anthropic 发布 Project Fetch 第二阶段实验结果:AI 模型操控机器狗完成任务的速度已大幅超越人类团队。Opus 4.7 在无人工辅助的情况下,比去年最快的人类团队快约 20 倍;在四项两类团队均完成的任务上,比无 Claude 团队快 37 倍、比有 Claude 团队快 18 倍,且代码产量仅为后者的十分之一。实验仍暴露局限:精确「取回」沙滩球这类需要实时闭环反馈的任务,模型与人类均未成功。Anthropic 认为这一轨迹与 AI 编程能力演变类似——从辅助人类到人类辅助模型,最终模型自主完成任务——预示「物理 agentic AI」时代临近。不过社区争议集中于实验设计(未让人类使用新版模型对比)、结果可复用性(代码质量与可维护性存疑)以及此类公司博客的营销属性。
No.26
Alice is impatient
用户感知延迟与服务报告为何总是不匹配
87 分
26 条评论
作者: birdculture
本文用「检查悖论」解释服务提供商与用户之间对延迟感知的巨大差异。服务商按「请求数」统计平均延迟,而用户按「时间」感知——一次耗时 10 秒的请求在用户生命中所占的时间权重远大于一次 1 秒的请求。数学上,用户感知均值 E_a[X] = E[X²]/E[X] = E[X] + Var(X)/E[X],即原均值加上方差除以均值。举例:若中位恢复时间 30 分钟、p99 恢复时间 10 小时,服务商报告 MTTR 仅 1 小时出头,但用户实际平均感知恢复时间接近 6 小时——相差数倍。作者指出 timeout-and-retry 无法掩盖恢复时间的尾部延迟,这正是为什么他不赞成使用截尾均值(trimmed means)来评估服务质量,因为截断会丢失右尾分布的关键信息,而这部分信息恰恰主导用户体验。
No.27
Temporary Cloudflare accounts for AI agents
Cloudflare推出AI代理专用临时账户:60分钟无认证部署
204 分
107 条评论
作者: farhadhf
Cloudflare推出面向AI代理的临时账户功能,解决agent无法完成人类注册流程的核心痛点。代理现在可直接运行「wrangler deploy --temporary」命令在Cloudflare Workers上部署代码,无需注册账户,整个过程无人工介入。临时部署有效期60分钟,期间用户可认领账户将其永久化,超时则自动删除。Cloudflare还通过与Stripe、WorkOS合作,尝试实现代理代表用户自动完成订阅、域名注册和API token获取。评论社区对此反应不一:部分开发者测试成功并给予肯定,但更多人担忧被滥用于恶意内容托管和僵尸网络;也有人吐槽Cloudflare自身Turnstile验证对真人同样造成困扰,以及缺乏billing上限导致无法安心使用。
No.28
Show HN: StartupWiki – A Free Alternative to Crunchbase
展示: StartupWiki – Crunchbase 免费替代品
192 分
59 条评论
作者: shpran
StartupWiki 是一个新兴的初创公司数据库,声称要成为 Crunchbase 的免费替代品,通过 AI 代理自动抓取和聚合初创公司信息,并引入社区提交机制。然而评论区的反馈以质疑为主:多位用户验证自己熟悉的知名公司(包括 YC 校友)均未收录,数据严重滞后(如将 Anthropic 估值标注为 180 亿而非真实的 9650 亿);「Verified」徽章缺乏来源链接,形同虚设;社区对数据真实性无法建立信任。创始人 shpran 多次回应称正在修复来源链接 bug、引入事实核查代理、逐步批量导入 YC 5000 家公司,并开放了人工提交入口。核心矛盾在于:AI 抓取的数据准确性存疑,而社区贡献机制尚未成熟,整体仍处于早期阶段。
No.29
Proportional-Integral-Derivative Controllers
比例积分微分控制器
20 分
8 条评论
作者: dhorthy
PID控制器是一种基于反馈的闭环控制机制,广泛用于工业控制系统及需要持续自动控制的场景。它通过比较设定值(SP)与过程变量(PV)之间的误差,自动计算并输出控制信号,使系统稳定维持在目标状态。PID的三个控制分量各司其职:比例(P)根据当前误差大小即时响应;积分(I)累积历史误差,消除稳态偏移;微分(D)根据误差变化率预测未来趋势,抑制超调。该控制器可追溯至1920年代船舶自动舵系统,如今已应用于温度调节、电机速度控制、巡航定速等多个领域。调参(K_p、K_i、K_d)需根据具体物理系统特性确定,是实现最优控制的关键。尽管PID应用广泛,但它不能保证所有系统的最优控制——当时滞过大时需引入超前-滞后补偿。部分应用仅需PI或PD组合即可。
No.30
PostgresBench: A Reproducible Benchmark for Postgres Services
PostgresBench:ClickHouse 推出的可复现托管 Postgres 基准测试
100 分
22 条评论
作者: saisrirampur
ClickHouse 团队在推出托管 Postgres 服务后,参考广受引用的 ClickBench 方法论,构建了 PostgresBench——一个公开透明的事务型 Postgres 托管服务基准测试。测试基于 pgbench 的 TPC-B 类工作负载,使用 256 客户端 / 16 线程运行 10 分钟,分别在约 100 GB 和 500 GB 两个数据规模下评估 TPS、平均延迟、P95/P99 延迟等指标。测试覆盖 5 个托管服务商,每家均采用相同区域(us-east-2)、相同硬件配置比(1:4 CPU/RAM),并使用默认 Postgres 配置以反映真实用户行为。公平性方面采用统一客户端机器、Graviton NVMe 实例,并明确标注未纳入 HA 配置。评论指出 10 分钟时长可能无法体现 checkpoint 影响,裸金属/VPS 原生 Postgres 对比缺失,PlanetScale 未纳入首批评测,且有人提出用 AI 自动优化配置参数的想象。
评论精华