2026年06月03日 · 星期三 第 160040 期

The Hacker Daily

丙午年(马)四月十八

30 篇文章 · 2087 条评论 ·聚焦:安全漏洞 · 显卡硬件 · 开源项目
No.01 1-Click GitHub Token Stealing via a VSCode Bug
单击链接即可窃取 GitHub Token 的 VSCode 漏洞
332 分 47 条评论 作者: ammar2
文章披露 vscode.dev 和 github.dev 浏览器版 VSCode 存在安全漏洞,攻击者可通过点击链接在网页中模拟键盘事件,利用「did-keydown」消息机制触发 Ctrl+Shift+A 快捷键安装恶意扩展,从而获取具有读写所有仓库权限的 GitHub OAuth Token。这是因为 Webview 沙盒机制存在设计缺陷,允许跨域 iframe 中的脚本冒充用户输入。作者因 MSRC 处理安全报告不佳而进行完全披露,引发社区对 VSCode 安全响应和替代编辑器(Zed、Neovim)的讨论。

评论精华

  • 用户称赞文章质量,认为微软全面披露是合理的
  • 有用户确认真的遭遇 GitHub 和 Cloudflare Token 被盗
  • 评论建议 vscode.dev 应采用 Codespaces 那样的临时单仓库权限范围
  • 讨论替代编辑器:Zed、VsCodium、Neovim 等轻量方案
  • 批评 MSRC 多次无故黙默修复漏洞不公开发布
No.02 Show HN: I reverse-engineered the world maps of Test Drive III (1990 DOS game)
展示: 逆向工程 1990 年 DOS 游戏《Test Drive III》世界地图
59 分 11 条评论 作者: s-macke
开发者对 1990 年经典 DOS 游戏《Test Drive III》的世界地图进行了逆向工程分析,揭示了游戏早期「真3D」引擎的实现方式。文章展示了如何技术破解这些复古游戏地图,让玩家能重新探索熟悉的场景。社区评论回顾了游戏的音乐、沙盒玩法和不同平台版本,特别提到了其独特的地图设计和和「Stunts」等同类竞速游戏的比较。

评论精华

  • 玩家回忆 PC Speaker 和 AdLib 音乐版本, nostalgia 暴增
  • 沙盒模式让玩家随意驾驶探索,记得追随铁轨外景
  • Amiga 500 平台也有移植,但可能是《Test Drive 2》
  • 技术分析:TD3 使用真3D 引擎,TD1/2 用 pseudo-3D,硬件要求不同
  • 游戏地图有彩蛋和技巧,如开桥跳过快完成,但常迷路转圈
No.03 Use your Nvidia GPU's VRAM as swap space on Linux
在 Linux 上将 NVIDIA GPU 显存用作 swap 空间
276 分 73 条评论 作者: tanelpoder
展示了一项目「nbd-vram」,通过 NBD(网络块设备)将 NVIDIA GPU 的显存作为系统 swap 使用,主要针对内存不可升级的笔记本用户。评论指出性能问题:RTX 3070 在 PCIe 4.0 x16 上理论带宽 64GB/s,但实际只达 1.3GB/s,远低于 SSD swap 的水平。社区讨论聚焦于实现方式的低效、动态切换 swap 的可能性,以及类似项目(OpenCL 版、Windows 版)的存在。支持者认为在运行 AI 模型时显存空闲可充分利用,但批评者质疑其实际价值和速度表现,建议使用 Vulkan 或 CUDA 直接映射可能更高效。

评论精华

  • 类似项目使用 OpenCL 实现,支持 AMD 显卡但驱动稳定性欠佳
  • 性能严重低于理论 PCIe 带宽,1.3 GB/s 远逊于 NVMe SSD
  • 适用于内存不可升级的笔记本,但动态切换 swap 空间有难度
  • Windows 上也有此类显存 ramdisk 实现,但存在稳定性问题
  • Vulkan 可直接映射 GPU 内存,或许是更高效的实现方式
No.04 The Unreasonable Redundancy of Nature's Protein Folds
自然蛋白质「折叠」的骇人冗余性
77 分 13 条评论 作者: ray__
文章探讨了深度学习在蛋白质结构预测上的应用,但发现当试图通过「折更多」天然蛋白质序列来增加训练数据时,遇到了序列数量与结构多样性之间严重的错配。研究发现,尽管天然蛋白质序列数量庞大,但它们「折」出来的3D结构却高度冗余:例如三个蛋白质序列相似度仅23.9%-28.3%,却共享相同「折」(TM-score > 0.75)。作者认为进化倾向于重复使用稳定、可表达、易适应的「折」结构,而非在序列空间均匀分布。预测结构的质量也影响聚类效果,可能真正可重复使用的结构邻域数在数万而非「Foldseek」报告的230万。

评论精华

  • 进化反复使用能量上有利、易折叠、适应性强的「折」结构模式层次
  • 蛋白质序列的高维空间实际收敛到低维「折」空间
  • 参照「TED」方法,发现也没有太多「折」多样性
  • 预测的「折」数量增长后新聚类不多,元基因组预测结果验证了这一点
  • 进化遥远的序列可能采用相同「折」,因为稳定可及性「折」数量有限
No.05 MAI-Code-1-Flash
微软发布 MAI-Code-1-Flash 编码模型,目标效率优先
454 分 201 条评论 作者: EvanZhouDev
微软推出 MAI-Code-1-Flash,一个专为日常开发工作流程设计的快速高效编码模型。该模型由微软端到端训练,使用干净且许可合适的数据,专门针对 GitHub Copilot 生产环境优化。其关键特性包括自适应推理(简单请求简洁回复,复杂任务深入分析)和强大的指令跟随能力。在核心编码基准测试中,MAI-Code-1-Flash 优于 Claude Haiku 4.5,SWE-Bench Pro 上领先 16 分(51.2% vs 35.2%),且能用更少 token(最多 60%)解决同样问题。然社区对比对象选择寥富(Haiku 是最小旧模型)和模型透明度(训练数据未披露)表示质疑。

评论精华

  • 微软选择与 Claude Haiku 4.5 对比,这是最小且旧的模型,社区认为对比不公平
  • 模型卡显示 137B 参数,51% 的 SWE-bench Pro 分数被认为不够出色
  • 评论质疑微软是否公布训练数据,且称网页滚动效果在 Safari 上卡顿
  • 一些用户表示小模型效率不错,但用于实际编码时会浪费昂贵时间
  • 讨论指出小模型路线可能是用重模型规划设计,由轻模型执行具体任务
No.06 CT scans of BYD car parts
展示: BYD 汽车零件 CT 扫描
355 分 180 条评论 作者: viasfo
Lumafield 对 BYD 汽车零部件进行 CT 扫描,展示了这家中国电动汽车制造商的工程设计和制造工艺。文章通过 CT 断层图像,展示了控制臂、子帧、电池包等关键部件的内部结构,突出了 BYD 在垂直整合方面的努力——从 lithium 矿到港口。评论者们对比分析了 BYD 与特斯拉、福特的技术路线,讨论了「中国制造」质量的提升、集成电子轴的维修难度,以及美国保护主义政策对中国 EV 的影响。

评论精华

  • BYD 实现从 lithium 矿到港口的全垂直整合,这是自早期福特以来少见规模
  • 评论者指出 CT 扫描文章更像是内容营销,缺乏深度技术分析或新证据
  • 中国制造质量已大幅提升,一位评论者称「日本工具」在 70 年代也被视为劣质
  • 集成电机、差分、轴和轮毂的 E-axle 设计简化了整车结构但增加维修成本
  • 美国保贸政策阻挠 BYD 进入美市,但评论者认为这是保护主义打击消费者选择
No.07 AI outperforms law professors in Stanford Law study
斯坦福法学院研究:AI 在合同法答疑中击败教授
199 分 160 条评论 作者: berlianta
斯坦福法学院教授 Julian Nyarko 领导的研究发现,16位美国法学教授在近3000次盲评比较中,75%认为 AI 生成的合同法答疑优于同行教授编写的答案,仅3.5%的 AI 回答被认为有教学害处,而人文回答为12%。研究使用 Gemini 2.5 Pro 和 NotebookLM,旨在评估大语言模型在需要判断力和模糊推理的法律教育中的辅导效果。Nyarko 强调研究挑战了人们对 AI 在法律领域能力的假设,但也承认责任归属和落地部署仍需谨慎。评论对样本量小、盲评可行性、利益相关性以及误答后果表示质疑。

评论精华

  • tipsytoad 质疑盲评的可行性,认为教授们肯定能分辨 AI 和人文答案。
  • mchl-mumo 指出16人样本太小,不足以支撑如此重要的结论。
  • runarberg 指出研究由Google捐赠的HAI institute进行,疑似利益相关。
  • esquivalience 解释3000 comparisons 来自每个教授约200次比较的统计。
  • stult 认为 LLM 误答率与程序员相似,但法律错误后果更严重。
No.08 Roku LT Operating System open source distribution
展示: Roku LT 操作系统开源
70 分 22 条评论 作者: dpmdpm
Roku 开源了其 LT 操作系统,代码主要使用 C 语言托管在 GitHub 上。然而社区对此反应复杂:一方面称赟在「不是用 Brightscript」编写;另一方面担忧「Automatic Content Recognition」技术仍会监控屏幕内容,隐私问题未解决。开发者们质疑为何不直接使用 FreeRTOS 或 Zephyr 等成熟 RTOS,同时也讨论了刷写修改版系统的可行性及遥控器功能(蓝牙、Wi-Fi、语音等)对 RTOS 的需求。文档仅提供视频形式也遭到批评。

评论精华

  • 开源不改变隐私问题,ACR 技术仍会监控屏幕内容
  • 代码在 GitHub 上,主要是 C 语言,有一定文档说明
  • 质疑为何不用 FreeRTOS 或 Zephyr 等成熟开源 RTOS
  • 讨论刷写修改版系统到个人设备的可行性和难度
  • 希望遥控器能有物理键盘,或通过蓝牙/手机解决输入问题
No.09 Microsoft Doubles Down on Controversial Quantum Computing Claims
微软继续推进「有争议」的量子计算声称
15 分 9 条评论 作者: igortru
微软在量子计算领域继续推进之前的「有争议」声称。根据评论反映,外界对微软观察到的效应持怀疑态度,认为可能只是电子的简简单来解释。同时社区讨论量子计算是否会成为主流,以及主流编程语言的构想。微软提供了 Q# 语言用于量子编程开发。

评论精华

  • 评论质疑微软观察到的效应可能只是电子「hop」的常规现象
  • 有用户认为量子计算不会成为主流,需要复杂物理实验
  • 另一观点认为量子计算机是高度专用的硬件,适用任务有限
  • 推荐 Q# 作为微软的量子编程语言
  • 幽默预测未来仍可在量子计算机上运行 Fortran
No.10 Capstone – multi-platform, multi-architecture disassembly framework
展示: Capstone 多平台多架构反汇编框架
43 分 1 条评论 作者: gregsadetsky
Capstone 是一个轻量级的多平台多架构反汇编框架,支持 ARM、ARM64、x86、RISC-V、PowerPC 等 20 余种架构。其核心优势包括架构中立的简洁 API、提供详细的指令「decomposer」信息和隐式寄存器语义,同时具有线程安全、高性能、支持内核嵌入等特性。文章展示了最新的 6.0.0 Alpha9 和 5.0.9 稳定版发布,修复多个安全漏洞和添加新架构支持。来自安全社区专家的高度评价,认为其可能成为反向工程领域的「黄金标准」和「行业标准」。

评论精华

  • saagarjha 询问 Keystone 项目当前状态,这表明两者在逆向工程领域有一定用户重叠关注。
No.11 Pluto.jl 1.0 release – reactive notebook for Julia
展示: Pluto.jl 1.0 发布——Julia 的反应式 notebook
103 分 8 条评论 作者: fons-p
Pluto.jl 1.0 版本发布,一个致力于让科学计算更易用、有趣的 Julia 交互式编程环境。核心特性包括「反应式单元格」(类似电子表格)、「可重现性」(自动包管理和版本控制)、「易用性」(专为教学设计,支持 16 种语言)。1.0 版本本身变化不大,但整体可靠性大幅提升,拥有约 2500 个自动化测试。新增单元格禁用功能、长运行计算确认、PlutoUI.jl 的丰富输入组件,以及直接导出为 Julia/PDF/HTML 的能力。Pluto 自 2021 年起长期霸占 Julia 包中 GitHub star 数榜首,并被 MIT 等机构用于教学课程开发。

评论精华

  • 用户不喜欢 Pluto 的输出显示在命令上面,希望能有切换选项
  • 有人认为现在用 React 构建交互网站更容易,不再使用语言特定 UI
  • 另一用户认为反应式 notebook 更像「可视化 REPL」,与 dashboard 软件竞争
  • Pluto 曾因 MIT 的「Computational Thinking」课程走红,帮助 Julia 扩大影响
  • 一些用户已在使用 SliderServer 托管 Pluto 笔记本,分享分析和示例
No.12 Gmail thinks I'm stupid, so I left
Gmail 认为我不行,所以我选择离开
884 分 538 条评论 作者: speckx
作者 JP 使用 Gmail 16 年后因受够了「语言模型」强制推送的 AI 功能而决定迁移到 Fastmail。他 complains Gmail 网页界面在未经要求的情况下自动生成邮件摘要、回复草稿,并反复弹出 Press / for Help me write 和 Tab to improve 提示,让他感到被质疑能力和不尊重。这些 AI 功能有的无法关闭,或关闭后会连带关闭其他有用功能,作者认为这是故意设计来人为推高 AI 使用率。目前正在体验 Fastmail,准备「正规」地绑定自有域名邮箱,与 Google 说再见。评论中有人表示同样问题存在于 Google Docs,建议关闭「smart features」设置,也有人称 Gmail AI 摘要毫无意义,还有用户建议使用 IMAP 客户端避免这些问题。

评论精华

  • Fastmail 被推荐为 Gmail 替代品,拥有 app passwords、hide my email、iOS 集成等功能
  • Google Docs 也有同样问题,每次回车后都会弹出「Help me write」提示
  • 可通过 Google 设置关闭全局「smart features」选项,一次性移除大量 AI 提示
  • Gmail AI 摘要「毫无意义」,实际使用体验不佳
  • 问题主要在网页界面,使用 IMAP 客户端(如 Thunderbird)可避这些困扰
No.13 My thoughts after using Clojure for about a month
使用 Clojure 约一个月后的感想
199 分 102 条评论 作者: speckx
作者用 Clojure 重写静态站点生成器进行学习,发现 Clojure 比 Common Lisp 更加内聚(避免了 mapcar、remove-if-not 等不一致命名),seq 抽象统一了序列操作,标准库也更完备。然而习惯「everything is a list」的作者花较长时间接受向量、哈希表、集合等四种数据结构的平等地位。语法方面,作者认为 Clojure 比 Scheme 复杂(多了 [] {} #{}),但逐渐适应并欣赹其设计。由于不了解 Java,作者感觉对 JVM 生态仍是未知。最终决定继续使用 Clojure 并用 Project Euler 练习,认为其 REPL 和 babashka 使其适合脚本编写。

评论精华

  • Jeaye 指出 Clojure 不只限于 JVM,还有 ClojureScript、ClojureCLR、jank 等多种方言可选。
  • meken 问及括号编辑难题,acdw 解释重构时难以定位闭合端,而 paredit 是理想解决方案。
  • HiPhish 调侃『写静态站点生成器』是 Lisp 学习传统,作者回复已用多种语言实现过。
  • gertlabs 提到函数式范式初期不适,但 gleenn 认为 Clojure 在大型系统修改时优势明显。
  • chamomeal 强调 Clojure 的 REPL 和 nREPL 生态是其他语言缺失的超能力。
No.14 Words of Type
展示: Words of Type 字体设计术语百科
54 分 6 条评论 作者: tobr
Words of Type 是一个字体设计术语 wiki,系统介绍各类「字母」「字符变体」「字体解剖学」等专业术语。文章解释了拉丁字母系统的演变、 OpenType 特征代码(如 calt、case、ss01 等)如何实现「上下文变体」「样式集」等效果,详细解析了「&」符号的历史由来(源自拉丁「et」)及设计原则。还涵盖「字体解剖学」概念,包括「出头高度」「下沉部」「顶点」「弓」等解剖部位命名,旨在为设计师和字体爱好者提供参考。评论者对内容有所质疑,认为部分术语关联度不高;但多数赞赏其清晰的设计和信息密度。

评论精华

  • riffraff 指出部分术语(binding, EULA)与字体类型关联度不高,疑似 LLM 生成填充内容
  • nine_k 称赞网站设计风格像儿童书或技术绘图,清晰易懂
  • ashm1104 在网站停留 5 分钟感觉注意力恢复正常,认为内容很棒
  • navigate8310 认为虽有些「vibed」感但信息内容很有趣
  • GaggiX 询问「vibed」指何处,要求具体说明
No.15 U of T researchers demonstrate AI worm could target any online device
多伦多大学研究人员演示 AI 蠕虫可攻击任意在线设备
21 分 5 条评论 作者: shscs911
多伦多大学「CleverHans Lab」研究团队演示了一种新型「AI 蠕虫」,可利用开放权重的免费 AI 模型构建。该蠕虫能够在网络中传播时自适应调整攻击策略,利用每个设备的漏洞逐步侵入并劫持计算资源以继续蔓延,使每一次感染的边际成本趋近于零。研究人员强调,即使是简单的模型也能对设备从笔记本到HVAC系统乃至能源电网造成威胁,目前的网络防御机制尚未做好准备。他们在封闭实验室中构建原型并已向相关机构披露,旨在提前引发学界、产业及政策制定者的警觉和应对措施。

评论精华

  • academic paper 链接:https://arxiv.org/abs/2606.03811,但原文中没有完整描述技术细节
  • 问「边际成本 per new infection is zero」究竟是什么意思
  • 评论指出:若感染的机器拥有足够 GPU 运行本地 LLM,攻击者就可以免费烧掉 token,因为电力成本由被感染机器的主人承担
No.16 DIY Bipedal Robot Used Pneumatic "Air-Muscles" Instead of Motors
DIY 两足机器人采用「空肌肉」替代电机
6 分 1 条评论 作者: sohkamyung
1987年,英国摄影师 Richard Greenhill 在他的阁楼里,联集志友们建立了「Shadow Group」,共同开发了两足人形机器人 Shadow Walker。该机器人采用压缩空气驱动的28根「空肌肉」(仿仿 McKibben 肌肉)来实现12个自由度的关节运动,而非传统电机。骨架由枫木制成,简化设计包含单根腿骨和宽大脚趾,机器人身高168厘米、重38千克。Shadow Walker 能靠稳定站立并保持平衡,甚至在推拨下能恢复重心,但行走能力有限。1990年参加了举办于格拉斯哥的第一届国际机器人奥运会,这一 DIY 项目最终没能完成步行。尽管未能大展风采,该项目促成了 Shadow Robot 公司的成立,成为英国最老的机器人公司之一。文章回顾了20世纪后期机器人发展史,以及 Shadow Walker 在当时极具突破性的 DIY 方法和空气肌肉控制技术。

评论精华

  • 「Walker」开发足式机器人软件这名字真是太贴切了,堪比 Karpathy 开发自动驾驶软件。
No.17 HP re-releases classic computer science calculator: The HP-16C
HP 重新发布经典计算机科学计算器: HP-16C 收藏版
157 分 103 条评论 作者: dm319
HP 推出 HP-16C 「收藏版」复刻机,保留经典外观设计但运行速度提升 100 倍,支持在「HEX」「DEC」「OCT」「BIN」之间无缝切换,具备位运算、逻辑测试和 1–64 位可定制字长的数学功能。最大程度保留原机可编程特性,支持条件分支、子程序、标签、标志,程序内存 203 字节加 99 个数据寄存器,并新增存储/载入程序功能。评论反映对制造质量、按键手感、价格和目标用户的质疑,同时也有玩家推荐瑞士品牌 SwissMicros 的替代产品,以及对 RPN 运算模式的喜爱和批评两方面声音。

评论精华

  • jamesgill 质疑收藏版制造质量,其 15c 收藏版「had some issues」,担心 HP-16C 也可能如此
  • eschaton 指出这是 HP 授权商产品,不是 HP 自身生产,但仍希望能有原厂质量
  • rustcleaner 已拥有 SwissMicros DM41X、DM42、DM15L、DM16L,称质量「built like absolute tanks」
  • layer8 警告称如果与 2023 年 15C 收藏版类似,「display, key feel, key label」质量不如原版
  • system2 认为 $116.96 偏贵,质疑「There is no RAM in this thing; why so expensive?!」
No.18 4K years ago, Mohenjo-daro grew more equal over time
墨亨若城 4000 年前出现「随时间增益更加平等」现象
87 分 41 条评论 作者: marojejian
约克大学生物学研究团队分析「墨亨若城」住房尺寸和 «Gini 系数» 发现,这一印度河流文明古城(公元前 2600-1900 年)的不平等程度低于美索不达米亚和青铜时期希腊城邑,城内豪富住宅与普通住宅的差距随时间反而在缩小。该城没有王宫、宗教雕像或豪葬,反而以街道规划和先进排水系统闻名,其中「印度印章」在普通民宅中广泛发现,标准化「重量衡器」也遍布地区。这挑战传统观点:城市成长必然导致贫富差距扩大,墨亨若城证明了「公共基础设施」与分布式治理可能塑造了平等的大型城市社会。

评论精华

  • 不少网友指出印度河谷考古始终未发现任何战争武器或战争痕迹,与文章结论相符
  • 有评论质疑这是「土著美化」说法,指出实际已发现许多哈拉帕战亇物证
  • 讨论集中于「标准化权衡」是否意味着政府管控,争议未有定论
  • 一些人联想到大卫·格雷伯《The Dawn of Everything》书籍,认为这印证另一种治理模式
  • 作者补充指出墨亨若「印度印章」重量衡器在「Dilmun 贸易」中被美索不达米亚商人使用,显示其信誉度
No.19 Open Repair Data Standard
开放维修数据标准
125 分 4 条评论 作者: cassepipe
开放维修数据标准(ORDS)旨在统一各组织和社区收集电子产品维修数据的方式,便于全球范围内数据聚合分析。该标准 v0.3 版本聚焦小型电器和电子产品,收集「产品信息」「维修信息」「活动信息」三大模块数据。通过标准化格式整合各地社区维修事件数据,可以识别全球或区域内常见故障和维修模式。数据采用开放「Creative Commons」许可发布,每六个月更新一次联合数据集。一些讨论质疑产品信息模块过于简略(如移除了「model」字段),也有人担心项目近期缺乏更新。

评论精华

  • 用户认为产品相关信息字段太少,惊讶「model」字段被移除
  • 有人质问该项目是否已停更,近两年无重大更新
  • 补充说明实际规范文档位于 standard.openrepair.org/standard.html
No.20 How we index images for RAG
如何为 RAG 索引图片
122 分 17 条评论 作者: mooreds
Kapa 团队在「RAG 管道」中如何处理技术文档中的图片(截图、架构图、表格):他们采用的是在索引时用廉价视觉模型描述图片,存储文本描述,查询时检索这些描述。这种做法将图片处理成本前置,查询时仅 1-6% 的额外开销;相比之下,直接在查询时发送图片给多模态模型则会显著增加成本(GPT 多 27%,Claude 多 51%)并遇及 payload 限制。文章指出图片分为「illustrative」(说明性,帮助操作)和「load-bearing」(承载关键信息)两类。他们还解决了过滤噪声图片、小模型足够好的问题,以及独立存储 caption 比内联存储更高效的问题。

评论精华

  • 有用户吐槽这是产品广告,认为这种方法并无特别
  • 有人提供开源框架实现链接,分享了实践经验
  • 有用户提出使用 ColPali 处理 PDF 和 PowerPoint 中的图片
  • 有人询问图片描述的详细程度,包括颜色和形状等
  • 有技术讨论指出很多图表本质是「框和箭头」,Mermaid 流程图足以表达
No.21 Writing Portable ARM64 Assembly
编写可移植的 ARM64 汇编
3 分 0 条评论 作者: luu
由于 Apple ARM 电脑普及,开发者写 ARM64 汇编时常忽略其他平台(Linux/BSD 服务器、单板计算机),导致可移植性问题。文章指出,跨 Mach-O 和 ELF ABI 只需注意两点:一是 Darwin 符号需加下划线前缀(如 _unmask),二是避开苹果定制的 NEON 指令语法(如 eor.16b),应使用官方「eor v2.16b, v2.16b, v0.16b」格式。还提醒 x18 寄存器在 Darwin 和 Android 上保留,但 GNU/Linux 不保留。通过简单宏定义可抽象 ABI 差异,实现 UNIX 环境下 ARM64 汇编的广泛兼容。
No.22 OpenFOV – Webcam head tracking for iRacing
OpenFOV:基于网络摄像头的 iRacing 头部追踪 FOV 控制工具
115 分 55 条评论 作者: mwit2023
OpenFOV 是一款使用网络摄像头实现头部追踪的工具,用于控制 iRacing 游戏的视场角(FOV)。它让玩家通过头部微动作在游戏内「看」向不同方向,模拟 VR 般的体验,无需佩戴专用头显或额外屏幕。据介绍,这种方式可以解锁传统显示器的新功能,但其实用体验存在争议。评论中既有对比 OpenTrack 和 TrackIR 的讨论,也有质疑其有效性的用户,认为头追踪会让人偏离屏幕方向。同时也有玩家提到,这种技术在模拟飞行等游戏中已有实践,「极小头部动作映射大角度」的设计理念是有意义的。

评论精华

  • OpenTrack 是成熟的开源替代方案,支持多种输入设备,不需额外佩戴装备就能替代 TrackIR 5。
  • VR 头显才是更自然的解决方案,因为它是直接戴在头上且提供立体视图。
  • 许多模拟飞行玩家通过 TrackIR 或类似设备玩 DCS,「小动作大映射」的设计思路是有效的。
  • 头部追踪效果取决于距离和屏幕尺寸,普通显示器距离用户看「窗口」体验受限。
  • 颜面识别可能受耳机、帽子、眼镜等遮挡影响,不同肤色和面部特征识别效果存疑。
No.23 Trump signs downsized AI order after weeks of reversals
特朗普签署「缩水」AI行政命令 要求企业提交模型供审查
205 分 150 条评论 作者: _alternator_
特朗普签署了新的AI行政命令,经过多次修改后大幅缩水。该命令要求部分AI企业在发布强大模型前「自愿」提交给政府审查30天,给联邦机构准备时间。评论认为该命令内容空泛,缺乏实质性规定,行政命令本身不可强制企业遵守。争议集中于:此举是否真为安全考虑,还是为政府创造模型垄断机会;开源模型和中国双用模型释放的监管困境;以及与2025年「防止撰写AI」命令的连续性。

评论精华

  • 行政命令内容空泛,多数条款无实质规定,仅要求自愿提交模型审查
  • 此举可能为政府获取模型零日漏洞或创造模型垄断机会
  • 开源和中国模型频繁释放双用模型,难以实施有效监管
  • 科技公司缺乏勇气抵制特朗普,为避免冲突选择合作
  • 与英国AISI多年前就已开展的AI安全评估相比落后
No.24 Preparing for KDE Plasma's Last X11-Supported Release
KDE Plasma 的最后一个 X11 支持版本筹备中
179 分 217 条评论 作者: jandeboevrie
KDE 官方博客宣布 Plasma 6.8 将正式移除 X11 会话支持,「It's done when it's done」的滑稽时隔 15 年终于实现。此版本约五个月后发布,登录界面将仅保留 Wayland 会话,所有 Plasma Shell、System Settings 和设备配置中的 X11 代码路径将被清除。XWayland 将保留,用户可继续使用 X11 应用程序;KDE 应用程序在其他桌面环境中仍可正常工作;KDM 也能继续登录其他桌面的 X11 会话。KDE 内部数据显示 Plasma 6.6 95% 以上用户已使用 Wayland,确认了其稳定性和普及率。不过,评论区反映 Wayland 在无障碍访问、NVIDIA 驱动兼容性、旧游戏支持、窗口管理等方面仍存在问题,部分用户对此变更表示担忧。

评论精华

  • 无障碍访问软件在 Wayland 下存在回归问题,KDE 大市场份额的放弃对 Linux 无障碍支持是重大打击
  • NVIDIA 旧款 GPU(Pascal 及更早)在 Wayland 下体验不佳,闭源驱动支持不完善
  • 旧游戏和某些游戏在 Wayland 下无法正常运行,XWayland 虽保留但已破坏 KDE 游戏生态
  • 窗口位置保存/恢复、虚拟桌面记忆、窗口卷起等基本功能 Wayland 缺失或不完善
  • 远程桢务和多显示器场景下 Wayland 相比 X11 缺乏成熟稳定解决方案
No.25 Multicore suppport for DOS is real – partly
DOS 多核支持成为现实 —— 部分实现
83 分 15 条评论 作者: beebix
本文讨论了在 DOS 环境下实现多核支持的可能性和历史背景。作者指出,DOS 本身没有多核概念,早期多核系统出现时 DOS 已经过时,因此没有开发动力。真正的阻碍是「鸡生蛋蛋生鸡」问题:消费者无兴趣采用多核是因为缺少杀手级应用,而开发商又因用户基础小而不投入开发。文章还提及如果 1998 年 Mhz 竞赛停滞,或 Win98/DirectX 游戏失败,DOS 多核支持可能会出现。社区评论指出实际实现需要手动操作 APIC,核心间通信主要通过共享内存,DOS 进程由「PSP」结构管理但缺乏多任务支持。

评论精华

  • fao_ 提到 2024 年的「Pits」DOS 汇编演示已实现多线程,使用所有超线程/ CPU 核心
  • vintagedave 描述这是在公司 DVD 上发现的神秘二进制,DOS 运行在核心 0,另一核心运行代码但无中断
  • userbinator 指出 DOS 本身不支持或阻止多核,仅需「激活 APIC」即可让其他核心运行
  • pjmlp 补充称 MS-DOS 4.x 尝试多任务改写是其失败的主要原因,开源链接指向维基百科
  • fredoralive 强调 DOS 几乎没有进程概念,核心间通信需通过共享内存方式自行实现
No.26 Fidonet: Technology, Use, Tools, and History (1993)
展示:Fidonet 技术、用途、工具与历史(1993)
162 分 66 条评论 作者: BruceEel
Fidonet 是 1980-90 年代中期的全球 BBS 网络系统,通过拨号电话连接各地 BBS 节点传递邮件和信息。评论者回忆了个人经历:许多人在八九十年代通过 Fidonet 接触互联网,节点地址如「5:7211/1」「2:463/1161」让人依然记忆犹新。Turkey 还有克隆版 HitNet 与兼容软件 Wolverine。当时需要配置门址并提供服务才能加入,这门技术让用户觉得传输速度快且纯净,没有今日的垃圾邮件和算法内容。许多人怀念 BBS 时代的「sysop」和社群聚会文化。

评论精华

  • Fidonet 在土耳其有克隆版 HitNet,用户开发了 HitBase 邮件服务器和 Wolverine 离线阅读器
  • 许多人在八九十年代通过 Fidonet 接入网络,称那时传输速度甚至快过现在的 IMAP
  • 加入 Fidonet 需要配置并证明技术能力,有人称那是「完全免费、没有垃圾邮件」的时代
  • Zmodem 双向传输取代 Ymodem 让人印象深刻,一些工具如 Kermit 仍在维护
  • Fidonet 让人认识到早期计算机文化开放平等,但也因电话费等原因有一定准入门槛
No.27 Show HN: Live breath detection and biofeedback from a phone microphone
展示: 用手机麦克风进行实时呼吸检测和生物反馈
46 分 15 条评论 作者: felixzeller
本文介绍了一个开源项目 shiihaa-breath-detection,利用手机麦克风捕捉呼吸音信号,实现实时呼吸检测和生物反馈。项目支持 Android 和 iOS 两个平台,Android 版本原先仅在德语区(DACH)发布,现已扩展至全球 Play Store(除中国大陆)。用户可通过呼吸数据进行冥想辅助或健康监测。社区对技术创意表示认可,但也注意到应用分发的区域限制问题。

评论精华

  • esquire_900 表示对该呼吸检测创意感兴趣,之前曾尝试开发类似冥想辅助应用
  • maartenh 表示应用在荷兰 Play Store 不可用,希望注意区域限制
  • felixzeller 补充 Android 版已可在除中国大陆外所有 Play Store 国家下载
  • felixzeller 承认 Android 初始仅在德语区发布,有暴露焦虑,但 iOS 版本可用性更广
  • ncr100 讨论 GitHub 默认字体变化,与文章无关
No.28 SaySynth: A Brief History of Speaking Machines
展示: SaySynth — 用 macOS say 命令打造语音合成器
10 分 1 条评论 作者: evakhoury
作者 Brian Abelson 在 composition.codes 的演讲中介绍了 SaySynth,这是基于 macOS 系统「say」命令构建的合成器。文章回顾了四种 speaking machines 类型:机械式、共振式、采样式和生成式。从1773年的 Von Kempelen 到现代 AI 语音,语音合成历史上有两大模式:经常通过唱歌展示能力,以及反映制作者文化偏见(如 Euphonia 的女性面孔、Voderettes 女性操作员被忽略、AI 助理女性化)。作者发现 macOS say 命令有隐藏的底层 DSL 可控制音素级别的时长和音高曲线,基于此开发了 YAML 序列表制,通过并行 say 子进程产生失调效果,系统本身的同步失败反而创造出更具有机感的声音。

评论精华

  • 评论者 totetsu 指出 Hideyuki Sawada 的研究是这篇文章历史列表中极为「不可思议」的补充,提供了一个 YouTube 链接供参考。
No.29 Bringing Up DeepSeek-V4-Flash on AMD MI300X
在 AMD MI300X 上部署 DeepSeek-V4-Flash
107 分 17 条评论 作者: kkm
Doubleword分享了在 AMD MI300X 上部署 DeepSeek-V4-Flash 的踩坑经验。MI300X 拥有 192GB HBM3 和一半的 H100 租金,但软件支持滞后。主要问题包括:FP8「fnuz」与 OCP 标准的指数偏差差异导致数值错误,AITER 内核库在 gfx942 平台支持不完整,sparse MLA 等内核需要专门实现;HIP graphs 和 Triton 内核的兼容性问题;MoE 路由 bug 等。经过优化后,单卡性能提升约 8.6%,使 MI300X 在性价比上具有竞争优势。

评论精华

  • [kkm] 提供了官方的 vLLM 补丁链接:https://github.com/doublewordai/vllm-amd-blog-doubleword
  • [mezark] 表示 Doubleword 对 AMD 在低交互推理场景持乐观态度,但软件支持需要更多工作
  • [benlm] 询问 DeepSeek V4 Pro 在 8xMI300X 的配置是否适用这些补丁
  • [latchkey] 表示感谢成为 Hot Aisle 客户
  • [edg5000] 表示惊讶公司现在能支持 GLM-fp8/Kimi 和 DeepSeek V4 Pro 这些大模型
No.30 Loading Sega Games Off a Vinyl Record [video]
展示: 用 Vinyl 记录加载 Sega 游戏
32 分 9 条评论 作者: zdw
本文展示了如何将 Sega 游戏数据存储在乙烯基唱片上并通过音频方式加载,复现 80 年代的创意存储方式。社区评论回忆了当年在 Commodore 64、Sinclair ZX-Spectrum 等计算机上加载「Frogger」 cassette、杂志附送「绿色乙烯基单曲」及「Robot Karel」教育编程环境的经历。一些用户称这是「纯粹因为很傻才去做」的极致尝试,但也有人补充了当年不同计算机的音频接口差异和杂志配赠软盘的历史背景。

评论精华

  • Commodore 64 加载 cassette 上的游戏令人印象深刻
  • 捷克游戏档案馆有 IQ 151 电脑的「Robot Karel」 vinyl 版
  • Sinclair 支持模拟音频输入,可接 turntable;Commodore 64 使用专有接口
  • 1983 年 Pete Shelley 专辑附 ZX-Spectrum 程序
  • 80 年代杂志印有 cassette 和短暂的 vinyl 时期,但唱片质量太差容易损坏