0%

今日 Hacker News 热榜前五落在生成图片的署名、一份尚未放出权重的开放模型、旧金山的缓坡路线、example.com 的改版,以及不用反向传播来预训练 Transformer。排第一的是 Nieman Lab 的报道:ChatGPT 会在仿《纽约客》漫画的角落签上真人漫画家的笔名。第二是 Reflection 的 Beam,501B 总参数、23B 激活的稀疏 MoE,博文写权重计划本月以 Apache 2.0 放出。后面是在浏览器里计算旧金山步行或骑行的「最平」路线,DebugBear 梳理 example.com 二十多年的版面变化,以及 QLabs 的 Dust:用激活扰动估计梯度。以下按 Firebase topstories 当前顺序整理,分数与评论数为抓取时快照。

1. ChatGPT is adding real cartoonists’ signatures to fake New Yorker cartoons

背景介绍
Andrew Deck 在 Nieman Lab 报道,ChatGPT 生成仿《纽约客》单格漫画时,会在角落签上杂志真人作者的笔名。文章以一张流传很广的图为例:Dolly Parton 与扮成 Dr. Frank-N-Furter 的 Tim Curry 站在天堂门口。文章写,这是 8 月下旬两人去世后几天里先在网上传开的图,右下角笔名是 “BLOPER”,也就是《纽约客》漫画家 Brendan Loper 的署名,但 Loper 没有画这张图,也没有签名。图是一位 Dolly Parton 的歌迷发到 Facebook 的,她在评论里写,自己只是让 ChatGPT 画 “a New Yorker-style cartoon”。Loper 告诉作者,先是双胞胎兄弟发来短信,随后陌生人也来问这是不是他的作品。

文章写,这不是第一次。5 月就有人在 Instagram 上提醒 Loper;夏天他又在 Reddit 的 ChatGPT 论坛里看到更多例子。作者自己的测试里,ChatGPT 签过 Harry Bliss、Emily Flake、Joe Dator、Pat Byrnes、Peter Vey、Jason Adam Katzenstein,以及 George Booth、Liza Donnelly、Ellis Rosen、Saul Steinberg 等人的名字;作者统计,至少记下了 15 位以上《纽约客》漫画家的署名被未经许可、也未付费地用上。不是每张图都有签名,有的笔名是乱码,但能认出来的经常是真人。Flake 说能看见自己画风的痕迹,整体却更像好几位作者的拼合;签名本身则是她的 “e. flake”。Byrnes 从少年时代就在 “P.Byrnes” 末尾加句点,作者找到的十多张签了他名字的生成图,每一张句点都在。

OpenAI 发言人的声明写,他们相信创造力的未来根本上属于人,并感谢社区指出模型的意外行为。作者通知 OpenAI 之后,再要求生成《纽约客》风格漫画时,ChatGPT 会回一句提示可能违反「与第三方内容相似」的护栏;但到文章发表时,一些普通漫画仍会被签上真人笔名。

版权关系在文中写得很具体。2024 年 Condé Nast(杂志母公司)与 OpenAI 签了多年授权,条款未公开;《纽约客》发言人告诉作者,Condé Nast 从未允许任何大模型开发者用其漫画训练,协议里也不允许把杂志标志放进模型输出。作者看过几份漫画家模板合同:稿件是投稿、录用才付费,不是 work for hire,版权留在作者手里,合同也没有把作品许可能用于 AI 训练。OpenAI 没有回答模型是怎样吃进这些签名的。文章引用纽约时报诉 OpenAI 案上月公开的文件,以及微软备忘录里把训练数据称作 “the largest theft of labor in human history” 的说法;另一份备忘录里,时任 OpenAI 政策负责人的 Jack Clark 写,他们在 AI 与创造力上的工作会越来越做出替代文化劳动者的系统。Clark 后来参与创立 Anthropic。

Katzenstein 把这件事说成比版权更接近假冒:模型把他的名字安在他不认可的作品上。他参加过 2024 年作家协会对 Anthropic 的集体诉讼,因为自己的漫画收进过一本 HarperCollins 选集,而这批盗版书被用来训练 Claude。文章写,法官于去年认定用作者作品训练属于合理使用,但下载并保存盗版书构成大规模侵权;文中接着说,7 月联邦法院批准和解,向作者和出版商支付 15 亿美元。Dator 的对比是:信用卡被盗时,对方至少没有打扮成他。

康奈尔大学法学院的 James Grimmelmann 在文中说,签名表示真实性,但署名只占合理使用分析的很小一部分;这类输出通常不是在复制某一张具体漫画,而是在模仿一种风格,这才是版权诉讼的难点。他提到另一种可能是州法上的公开权(right of publicity),那需要证明生成图被用于商业目的,而不只是玩笑。作者写,自己没有看到这些图被买卖的证据,但已经看到编辑漫画岗位被替换:去年《巴尔的摩太阳报》解雇了在该报画了三十多年的普利策决赛入围者 Kevin Kallaugher,今年意见版开始经常刊登 AI 漫画;用 OpenAI 的水印识别工具核对,这些插图来自 OpenAI 的产品。美国社论漫画家协会主席 Marc Murphy 在公开信里谴责用 AI 替代原创。文章也写,《纽约客》本身没有改去刊登 AI 漫画,但受访者说单靠杂志稿费养不活自己,杂志署名是接到商业稿和书籍插画的名片。

主要讨论方向与观点
讨论分成「该不该告」和「这到底是什么错误」。Insimwytim 认为问题不是模型会这么做,而是事后没有被诉讼压垮。MarkusQ 把它叫成 “Plagiarism as a Service”。回复里,jrflo 说这是一句适合社交网站的嘲讽,并不是 OpenAI 的商业模式;walrus01 则把矛头转回实验室之间互相指责「蒸馏」:被蒸馏的模型本身就建立在大规模版权争议上。GolfPopper 引用了与文章相同的那句微软备忘录。

gwern 写,自己用 Nano Banana Pro 和各代 ChatGPT 画漫画时,假签名是老问题,常常要再编辑一次擦掉,多数用户懒得做。WD-42 说,公司工程经理把一张签着 “bloper” 的漫画放进冲刺演示,并不好笑,问过之后确认是 ChatGPT,对方没注意到签名。dyauspitr 认为这说得通,因为训练样本里几乎都有签名。userbinator 补充,写实生成也会带上变形但仍能认出的水印,因为训练数据里就有;并认为年轻学画的人一开始也是在抄自己见过的东西。cm2012 主张,除非用户要求,模型默认不该在作品上签名。

ThrowawayR2 认为这拆掉了「大模型会推理」和「人也犯这种错」两种说法。antonvs 回复说,这是把图像生成模型和语言模型混为一谈,没有人声称图像模型会推理。baubino 把文章里 Katzenstein 和 Dator 的话收成「冒充」,AnimalMuppet 认为这已经够得上起诉的门槛。SchemaLoad 写,艺术家应能在每次伪造签名时亲自告 OpenAI 诽谤。

专有名词解释

  • BLOPER / e. flake / P.Byrnes:文章里的笔名,分别对应 Brendan Loper、Emily Flake 和 Pat Byrnes。Byrnes 的署名以句点结束,作者看到的生成图保留了这个习惯。
  • work for hire:受雇作品。文章写《纽约客》漫画家合同不是这种安排,版权仍归作者。
  • 合理使用(fair use):美国版权法里的抗辩。Grimmelmann 在文中说,署名只是其中很小的一部分;风格模仿通常拷不到「某一幅具体作品」。
  • 公开权(right of publicity):各州保护姓名和身份不被擅自商用的法律。文章写,要走这条路,需要商业使用的证据。
  • Cartoon Bank:文章用来对照授权原作的《纽约客》漫画授权库。

HN 讨论:thread · 183 分 · 79 评

2. Beam: Reflection’s 501B open-weight model

背景介绍
Reflection 于 2026 年 10 月 5 日发布 Introducing Beam。博文称 Beam 是该公司第一个开放权重模型:稀疏 Mixture-of-Experts,总参数 501B,激活 23B,面向编程、推理和 agent 工作负载。预训练用了 23.8 万亿 token,来源包括网页和专有授权数据。博文写,高算力强化学习在 10,500 张 NVIDIA GB300 上跑了 4 周,产生超过 1 亿次 rollout,RL 阶段最大上下文 256K token;训练和评分大约用了 13 亿个 sandbox,环境大约 100 万个。预训练则写在 6,144 张 GB300 NVL72 上、不到 4 周跑完,接近结束时 goodput 为 92.3%,中途有 9 次半自动回退。

能力表述是他们自己的定位:Beam「推进西方开放权重前沿」,在编程和 agent 任务上与更大的 GLM 5.2 有竞争力,并接近 Qwen 3.8-Max;Kimi K3 在原始能力上仍然领先,Beam 自称的优势是推理时的效率。高级推理基准上,博文写分数与 GLM-5.2 相当,推理计算约少 3–4 倍。模型是纯文本的。图注还写到推理专家约占全部 1 亿多次 rollout 里的 8,000 万次,并用来对比 Inkling 的 3,000 万次和 MiMo 的 75.3 万次。这些对比数字出自该博文,本文没有另找第三方榜单核对。

权重现在还不在公开仓库里。博文写 Beam 正在做最后的红队测试和评估,可以登记早期访问;本月将以 Apache 2.0 放出权重、技术报告、模型卡,以及运行、评估和微调所需的材料,并接入一批分发伙伴和开源工具。架构段落还写了交错的局部/全局注意力、细粒度路由专家、52 层上残差流保持有界,以及预训练结束时最忙专家的负载约为均匀值的 1.04 倍。中期训练把有效上下文拉到 100 万 token。

第二张演示图的图注是一次陆地/海洋实验:让 Beam 画固定的 180×90 网格,经度 −179° 到 179°、纬度 −89° 到 89°,共 16,200 个点;图注写覆盖正确率为 95.5%,介于 Opus 5 的 92.5% 和 Fable 5 的 97.8% 之间,并称之为对新任务的泛化。抓取当天的这段 figcaption 没有写「谜题只有几天、因此不可能在训练数据里」。

主要讨论方向与观点
主线是「数字不错,但权重呢」。htrp 摘了参数量和 RL 规模之后说,现在只有早期访问登记。wronglebowski 认为没有 Hugging Face 仓库的发布没有意义。wren6991 列了一张和 DeepSeek V4.1 Flash 的对照表,并引用 Linus 的 “Talk is cheap, show me the weights.” 这张表把 Beam 的预训练 token 写成 28T,和博文里的 23.8 万亿不一致;表中「无视觉、Apache 2.0、权重本月放出、激活参数 23B」几格与博文一致。表里 DeepSeek 一列的数字是评论者写的,不是这篇博文的内容。onlyrealcuzzo 觉得它比 DeepSeek v4.1 Flash 更大、更贵,而且每项指标都更差。aeetes 认为性能图把更强的开源模型折到视线之外,读起来像 Beam 赢了,其实没有。brumbelow 说这条链接只让自己更想去看 DeepSeek 4.1 Flash。

也有人接受「先入场、再迭代」。michaelkdev 承认它不如顶尖的中国开放权重模型,但把「西方也加入」本身当成事情。dotancohen 认为每个新进入者不需要首发就破纪录。swiftcoder 指出博文原句 “Western open-weight frontier”,猜测卖点是给不能用外国模型的政府合同,而不是给个人用户。vanuatu 把它说成面向美国公司和西方政府的「美国版 DeepSeek」。eaf7e281 则肯定博文承认 Kimi K3 仍然更强,而不是把图表说满。

Ariarule 引用的图注比当前页面多出一句:谜题只有几天,所以不可能出现在训练数据里。评论认为这句不成立,并链到 LessWrong 的 How Does A Blind Model See The Earth?。该页数据里的 postedAt 为 2025-08-11。extr 记得原始讨论更早,但觉得「没有专门对这个任务做 RL」这一点仍然成立。charlieyu1 认为谜题的年龄也许不重要,因为现在的模型都会搜索。

astrostl 希望更多 90B–133B、能把一部分专家放到磁盘上的 MoE,好放进 64–128 GB 内存的 Mac。minimaxa 写自己会等权重和 GGUF。drubs 说自己预训练第一天就在现场看着任务启动;这是评论者的自述。

专有名词解释

  • MoE:Mixture-of-Experts。博文写总参数 501B、每步激活 23B,所以推理成本按激活参数而不是总参数计。
  • rollout:强化学习里模型在一个环境中走出的一整段轨迹。博文的 1 亿次是这次 RL 的规模,不是下载量。
  • GB300 / NVL72:NVIDIA 的 GPU 以及按机柜交付的形态。预训练和 RL 用的卡数在博文里是分开写的:6,144 与 10,500。
  • goodput:博文定义为最终模型里保留下来的训练步,占墙上时钟的比例;接近结束时写成 92.3%。
  • Apache 2.0:博文承诺的权重许可证。到抓取时,权重、技术报告和模型卡都还没发布。
  • GGUF:评论里等待的本地量化格式。博文没有写 GGUF。

HN 讨论:thread · 296 分 · 77 评

3. Find the flattest route between any two points in SF

背景介绍
Flatten SF 页面署名为 Drew Edwards,仓库在 almostimplemented/flattensf。页面说明:路线在浏览器里、对大约 16 万条街段求解,高程用 USGS 1 米激光雷达,路网来自 Overture / OpenStreetMap。滑块从最短走到「还值得走的最平」:最平那一端,1 英尺爬升按 200 英尺步行计;再往右,路线就不再像路线。往右滑不会让路程变短,也不会增加爬升。爬升是沿途累计升高,不是起点和终点的海拔差。步行允许台阶,骑行排除台阶。地点搜索是离线的,路口、地址和地名打进页面,不调用地理编码接口。

README 把全市分析收成一句:在全部 1,260 对有序社区组合上,最少爬升的步行路线平均只比最短路线长 14%,却少爬 39% 的升幅,典型最陡坡度从 27% 降到 17%。资源管理器示例写,从 Bayview 到金门公园,最平步行是 7.67 英里、爬升 353 英尺,最短是 7.01 英里、爬升 1,076 英尺。分析代码是 MIT;街道几何来自 OpenStreetMap(经 Overture,ODbL),USGS 3DEP 高程为公有领域。README 还写,页面为了把图压小,会把长度量化到 5 厘米、爬升到 1 厘米,所以浏览器里的总数可能和 Python 差几十厘米。

主要讨论方向与观点
有人拿它和旧工具比。andalinmicphew 推荐自己和朋友维护了约五年的 Bike Hopper:湾区骑行会同时看坡度、自行车设施和公交,旧金山用 1 米 DTM,郊外用 50 米;并认为在旧金山做坡度路由必须用 DTM,因为建筑和树会让别的高程模型失效。verst 希望把同样的 1 米 DTM 扩到西雅图或 Puget Sound。cheeaun 贴了自己 2014 年的 steepless。pokpokpok 和 wmichelin 都把它连到 “the Wiggle”,也就是市场街一带骑去金门公园时故意绕开陡坡的那条走廊。

目标函数也有人觉得还不够。jez 希望有一个同时加长距离和总爬升、但压低坡度的选项:从 SOMA 到 Nob Hill,按累计爬升,「最平」可以是从 Market 顺着 Taylor 直上,骑起来却不如绕到 Polk 再上 California,或从 Embarcadero 转 Broadway。cowthulhu 担心如果真去最小化坡度,上山会变成无休止的之字形。scaredginger 描述自己以前的启发式:不远离目的地,能不下山就不下山,必须上坡时选更缓的那条,只用局部信息。ziofill 问爬升是不是跟路线无关;页面写明爬升是累计升高,所以跟路线有关。nerdtalker 希望加上驾车,给还在开手动挡的人用,并说自行车模式的结果已经比较合理。

具体路线有人报错。askjdfksdbfhk 写,在 Mission 的 22nd 与 San Jose 一带,工具不让人沿 22nd 直走,而是拐上 San Jose 再折返;同一条评论还把配色、连续滑块和海拔图上的高度标签叫成 “Claude UI”。danserfaty 写,从外里士满 Cabrillo 街的住处到 4th Avenue,工具让人去爬 25th Avenue 再走 Geary,而不是走完全平坦的 23rd Avenue。仓库在 2026 年 10 月 5 日有一条提交,说明 Overture 里 Slow Streets(包括 Page、Shotwell、Cabrillo、12th Avenue)的通行规则按文档顺序读时,最后一条「所有方式仅限目的地交通」盖过了前面的步行允许,于是 Cabrillo 在 23 号大街以西完全不能走;修好之后,点名某种交通方式的规则后生效,252 条边、共 9.9 公里恢复步行。HN 上 almstimplmntd 的回复与此相符,并写已经部署。这条提交的作者栏是 Claude,并带有 Co-Authored-By: Claude Fable 5.1。jeffbee 则从数据分辨率说起,认为换 USGS 3DEP 的 25 厘米 DTM 会更好,并补了一句该数据在 AWS S3 上免费。

专有名词解释

  • 累计爬升:沿路线把每一段上升加起来,下坡不抵消上坡。起点和终点海拔可以差不多,中间翻一道脊,累计爬升仍然很大。
  • 帕累托路线:页面说滑块上的每一步都是「没有另一条路在距离和爬升上同时更好」的路线。最短和最平是这条折中曲线的两端。
  • DTM:数字地形模型,表示地面。Bike Hopper 作者强调要把它和含建筑、树冠的模型分开;本站页面写的是 USGS 1 米激光雷达,仓库许可证段落写高程来自 USGS 3DEP。
  • Overture / OpenStreetMap:页面使用的路网。仓库写街道几何经 Overture 取自 OSM,再分发要遵守 ODbL。
  • Slow Streets:旧金山把一些住宅街道限制为低速、以本地出行为主的计划。上面的提交写,解析器曾把这类街道对步行也关掉。
  • The Wiggle:旧金山骑行者对一条低爬升走廊的叫法,从市场街附近绕到金门公园,专门躲开陡坡。评论是在用这个名字认路,不是网站的功能名。

HN 讨论:thread · 100 分 · 30 评

4. Example.com Just Launched the Biggest Redesign in Decades

背景介绍
DebugBear 的 Conor McCarthy 在 2026 年 9 月 30 日发文(10 月 2 日更新),回顾 example.com 的版面史。example.com 是 IANA 保留给文档示例的域名,从上世纪九十年代末就可以当例子用。文章写,到 2026 年 9 月 28 日为止,页面还是一份静态英文;改版用 JavaScript 加入阿拉伯语、中文、法语、俄语和西班牙语,并每 5 秒换一种语言,每个字符包在自己的 span 里、用递增的 transition-delay 做透明度过渡,JS 还会插入一个书本 SVG。英文句子是:这个域名用于文档示例,不需要许可;它不是一项服务,不要把它当成测试或监控的依赖。

文章引用了 IANA 的说明:改动通常要么是为了降低带宽,要么是为了让页面更有用;本周把内容拆成一个更小的基本页,再加上单独的 JavaScript。多数访问是自动化的,往往不取 JS,因此总流量下降。域名的用途是文档里的示例。有人会把示例配置粘贴出去后忘记替换,从而带来附带流量;但它不是用来做可用性探测的通用端点。履行保留域名的用途并不要求主机上一定有 HTTP 服务,网站只是 courtesy。

文章按 Wayback Machine 排了时间线。它引用维基百科,称网站在 1999 年 1 月 1 日上线;能看到的最早快照是 2002 年 1 月 20 日,当时是 ICANN/IANA 保留域名列表,Apache 1.3.22。大约 67 天后出现今天还能认出的那句「你输入了 example.com」。2003 年 2 月加上 RFC 2606 的链接,服务器换成 Apache 1.3.27。此后七年几乎没动;2010 年 7 月 30 日 example.edu 也指向这个落地页。2011 年 1 月起改为跳转到 IANA 网站;2013 年 7 月 29 日取消跳转,改由 EdgeCast 直接提供 “Example Domain” 卡片页。文章接着写 EdgeCast 被 Limelight 收购、改名 Edgio,Edgio 于 2024 年末申请破产,Akamai 接收了部分客户合同;2025 年页面再次改版并压缩 HTML;随后响应头出现 Cloudflare。2026 年 6 月 9 日加上空的 <link rel="icon" href="data:,">,避免浏览器再去要 /favicon.ico。「不要用于运维」这句话是 2025 年加上的。DebugBear 用自己的可用性监控看到,example.com 偶尔会不正常响应。

同一主题还有 Kim Davies 的 Being Exemplary。文中写,2026 年 9 月某一周这项服务大约收到 500 亿次请求,合每秒 8 万次以上;软件用它测网络、跑发布前测试、大学演示、触发酒店和机上 Wi-Fi 的强制门户,作者也怀疑自动系统和会浏览网页的 AI agent 在添流量。Cloudflare 通过 Project Galileo 支援带宽之后,他们才把说明做成联合国六种语言,并把页面拆成小的首包加一份 JavaScript:只检查「页在不在」的程序拿到更小的响应,浏览器用户才看到全文。

抓取当天(HTTP Last-Modified 为 2026 年 10 月 2 日)的首页本身只有英文段落和 <script src=/s.js>。s.js 把另外五种语言插进页面,按 navigator.languages 把匹配的段落挪到最前,没有匹配则保留英文,并用脚本插入书本 SVG。这里没有 DebugBear 所写的每 5 秒轮播。

主要讨论方向与观点
不少人在对「依赖一个声明自己不是服务的域名」开玩笑,也在认真讲后果。selcuka 问这次改版弄坏了多少自动化测试,并引用 Hyrum 定律:观察得到的行为都会有人依赖。chews 回复说,如果测试只对响应做哈希,而后续请求仍然稳定,测试可以继续过。lifeisloving 写自己已经改用 example1.com 做可用性测试。zahrevsky 读到「并不必须提供 HTTP」之后,猜这也是为了减少有人原样粘贴示例配置。zamadatix 把更底层的依赖放在 DNS 和 DNSSEC:有没有 HTTP 服务器,并不决定这些记录会不会被指到别处。

版面描述和当天页面不完全一致,评论已经先指出来。jamdav16 写,渐进透明度看起来被拿掉了,现在是把各种语言一起显示、没有 CSS 动画。johnnyanmac 对此表示失望,但觉得动画本身就会带出意外的测量流量。Gualdrapo 问,动态内容用 JS 说得通,为什么连静态 SVG 也用脚本插入。worg 的解释与 IANA 的带宽说法一致:不跑 JS 的客户端可以少下这些字节。afavour 则说文章写错了,自己关掉 JS 仍能看到 SVG,并怀疑整篇文章是用 AI 拼的。与之对照,抓取到的 HTML 里没有内联 SVG,图标在 /s.js 里。dangoodmanUT 觉得现在的文案看起来像模型生成的。adithyassekhar 数了一下,DebugBear 正文里 example.com 出现 14 次,没有一次是链接。

slipfold 和 ChrisArchitect、sea-gold 都把讨论指回几天前的线程,以及 Kim Davies 那篇说明。cute_boi 开玩笑说,IANA 这种事实上的单一供应者,连一个简单 HTML 页都托管得有点滑稽。

专有名词解释

  • example.com / RFC 2606:IANA 保留的文档用域名。RFC 2606 规定 example.com、example.net、example.org 以及 .example 等名字用于示例,避免作者编一个可能真的有人注册的域名。example.edu 是后来一并指向说明页的名字,文章和 Kim Davies 的帖子都提到了。
  • Hyrum 定律:接口只要有足够多的使用者,所有能观察到的行为都会被某人依赖,包括你没承诺的行为。评论用它解释为什么改一行示例页会弄坏测试。
  • Project Galileo:Cloudflare 为公共利益网站提供支援的计划。Kim Davies 写,example 域名的带宽是在这个计划下得到支援的。
  • courtesy 页面:IANA 的用词。保留域名本身不要求开网站;页面只是告诉访客这个名字为什么存在。

HN 讨论:thread · 68 分 · 44 评

5. Dust: Pretraining Transformers Without Backpropagation

背景介绍
Samip Dahal、Bishwas Mandal、Serdar Gülbahar 和 Akshay Vegesna 在 2026 年 10 月发表 Dust: Pretraining Transformers Without Backpropagation,代码在 qlabs-eng/dust。论文把 Dust 写成第一种在预训练 Transformer 语言模型上能与反向传播相比的零阶方法。做法是对每一层线性层的输出、在每个 token 上独立加上高斯噪声,看这个扰动让该 token 的损失降了多少,再把「奖励乘以噪声」在一组采样上平均,得到输出端的误差估计;误差和这一层已经算好的输入做外积,就是权重梯度。注意力内部不直接用 token 损失,而用注意力输出上的估计误差。他们把每个 token 叫成一个虚拟种群成员:一次前向同时评估整段序列上的成员,而不必像在权重空间里做进化策略那样,为每个成员准备一份扰动后的权重。

论文的基线是 EGGROLL 的 Transformer 实现,也就是在权重上做低秩扰动的进化策略。作者写,从 100 万 token 往上,按他们的外推,Dust 比这种实现大约高效 10³ 到 10⁴ 倍;在同样种群规模下,16k 的 EGGROLL 仍到不了 Dust 在 64 次采样时的损失。实验是 GPT 式网络、FineWeb、4096 token 的 BPE、每批 16k token、带动量的 SGD。在 10 万和 100 万 token 上,Dust 从几百到大约一千次采样起,测试损失可以低于调过参的反向传播。到 1,000 万和 2,000 万 token,差距随种群缩小;2,000 万 token 上幂律外推的极限是 4.431(95% 区间 3.89 到 4.58),低于反向传播的 4.633,但阶梯在 16k 采样时还在下降,作者把这看成「差距还会随种群缩小」,而不是已经测到的极限。

另一项结果写在摘要里:更大的网络更省种群,而不是更费。固定 1,000 万 token,2M、7M、38M、243M 四个尺寸里,243M 在大多数种群规模上优于大约小 120 倍的模型。论文同时把边界写清楚:现在并不打算把计算效率做到可以替换反向传播;也不在本文训练那些反向传播不好训的结构,例如回路里夹外程序、或要在时间上展开的循环 Transformer。作者写,还要再有几个数量级的效率,Dust 才可能在当前算力水平上成为实用替代。

主要讨论方向与观点
评论很少,而且贴着论文自己的两句结论。eriwang915 认为令人意外的是 243M 在大多数种群上胜过小 120 倍的网络:网络变大之后,种群效率更高,而不是更低。polyomino 问,既然这比反向传播贵,能不能拿一个已经用反向传播训好的检查点,再用 Dust 微调,看学习轨迹会不会不同。这条下面没有展开的回复。

api 问:是不是计算效率更低,但更容易并行。vatsachak 回答说不一定。反向传播本身就是一批矩阵乘法,并行度已经很高;Dust 省掉的是反向那一趟。真正可以各干各的是另一类方法,例如神经预测编码,远处的权重不必同步。回复还写,即便如此,行业已经把钱押在前向加反向上,除非有人做出合适的硬件并证明能扩到数十亿参数,否则后继算法很难赢。论文自己的并行点更窄:虚拟种群是沿 token 维一次前向评估很多成员,而不是声称整个训练比反向传播更省。

专有名词解释

  • 反向传播(backprop):用链式法则把损失对每一层输出的导数传回去。Dust 仍要算权重更新,但输出端的误差来自种群,不来自这条链。
  • 零阶优化:只看函数值、不看解析梯度。这里的函数值是每个 token 的损失变化。
  • 进化策略(ES)/ EGGROLL:在参数上加扰动、用整次评估的好坏来估计更新方向。论文用 EGGROLL 代表「每个种群成员一次前向」的权重空间做法。
  • 节点扰动 / 虚拟种群:噪声加在激活上,而不是加在权重上。一个 token 算一个成员,所以一段几千 token 的序列,一次前向就评估几千个成员。
  • 种群:Dust 里是每次更新的采样次数(draws)。论文写,头部分类层和注意力内部的采样另计,占一次更新 FLOPs 的一小部分。

HN 讨论:thread · 87 分 · 13 评

今日 Product Hunt 热榜对应太平洋时间 2026-10-05 日榜(上海时间 10 月 6 日上午抓取,太平洋时间当日尚未收盘)。前半段集中在把脚本做成可发布的社媒视频、给模型请求做路由,以及把单据抽成结构化数据;后半段是 Agent 运行时、隔夜经营体检、给 Agent 接实时搜索,以及桌面上的视频编辑、编程 Agent 控制室、简历和就地改写。按日榜页的名次,前五是 Spira Maxima、FastRouter.ai、Invofox Self Serve、Opengeni 与 DailyHelm,后五是 Web Search API、HyperFrames Studio (Desktop)、devpit、Reactive Resume v6 与 Jarq。票数与评论数取自该日榜页抓取快照,收盘前仍可能变化。

1. Spira Maxima · 官网

标语:Video model that turns script into viral social media videos

背景
Spira Maxima 日榜第 1,发布页标为 Free Options,挂在 Spira AI 名下。Spira AI 的公司介绍写自己做能自行发帖的 AI Influencer;这次发布的是其中的视频模型。CEO Long Ma 在帖里写,自己曾是 Creatify AI 的创始成员和产品负责人,也是 TikTok Creative、CapCut 和 Meta Video Ads 的创始成员。模型把纯文本收成一条竖屏成片:出镜人、跟词走的 B-roll、动效、字幕和音乐一次生成,导出为 9:16 的 MP4,并附带文案和话题标签。输入可以是口播稿、稿加一张照片和可选的声音样本、稿加产品图,或已有的手机录像。不上传出镜人时,它会按稿子配一个社媒上常见的形象。官网写它在社媒趋势和表现数据上做了后训练(post-training,在基础模型之上用特定数据再训一轮),用来跟着当前更常见的视觉处理走。Long 在讨论里说明分身规则:上传者须确认自己有权使用这张脸和这段声音;分身只在该账号内可用;可在设置里删除分身及原始照片和声音样本;这些材料不拿去给其他用户训练。有人升级后仍下不了去水印的旧视频,团队回复 Chris Kang 表示会补「升级后去掉已生成视频水印」,目前要重新生成。抓取时约 331 票、约 47 评。

产品要解决的问题
生成一段画面已经很快,但要发到 TikTok、Reels 或 Shorts 上,还得选人、切 B-roll、改字幕、配乐。成品停在这一步时,很多稿子就不再发出去。

产品市场分析
官网写给要经常发产品介绍、购买说明、系列上新和创始人讲解的品牌、服务商、创始人和营销团队。对照表把 Creatify Aurora、HeyGen Avatar IV Premium、Veo 3.1 Standard 和 Seedance 2.5 放在旁边,并注明竞品数字来自对方公开页面和 fal 标价,核对日期为 2026-10-03;「—」表示那一步仍要自己进剪辑软件。标价是成品视频每秒 0.15 美元,动效、字幕和音乐含在内;首月五折,页面上的启动价写作每秒 0.075 美元。生成前按钮会显示当次价格。长度上限:免费 20 秒、400 字;Creator 60 秒、1,200 字;Growth 90 秒、1,800 字。视频编辑、给 Claude Code 和 Codex 的原生 MCP 与 CLI,以及 API,页面写为仍在开发、分阶段放出。MCP(Model Context Protocol,模型上下文协议)是让模型调用外部工具的接口。

产品上下游
上游是口播稿、照片、声音样本、产品图或已有录像,以及官网所说的社媒趋势数据。下游是竖屏 MP4 和配套文案。分身材料按讨论里的说法留在该账号,并可删除。

2. FastRouter.ai · 官网

标语:Route requests to the right LLM for cost, latency & quality

背景
FastRouter.ai 日榜第 2,发布页标为 Free Options。讨论里以团队身份回复的是 Ritesh Prasad;猎人 Rohan Chaubey 提到 Andrej 曾来演示产品。它是一个 OpenAI 兼容的网关:应用把原来打向 OpenAI SDK 的地址改到 FastRouter,同一套请求可以落到 200 多个模型上,并按费用、延迟、吞吐或优先级选择上游。虚拟模型别名可以配随机、最低延迟、最高吞吐、最低用量、最低价格、优先级和按类别路由。失败切换目前只发生在第一个 token 发出之前;流已经开始后再出错,会把错误写回流并结束,不会从半截续写。内容日志可以按 API key 关掉,关掉后那些请求不能再拿去做评估、洞察和提示词优化。企业版可以放到客户自己的环境。讨论里有人注册后找不到「两个月免费」的领取入口,Ritesh 回复该方案的限额已在后台打开,并请对方写信到 support@fastrouter.ai。定价页上的「两个月免费」指年付相对月付少付两个月,相当于约 16%。抓取时约 308 票、约 54 评。

产品要解决的问题
生产环境里的模型调用往往同时挂着多家供应商。换模型、做失败回退、看清哪一次请求打到了哪家,以及发现账单上可以省的部分,常常要自己再做一层。

产品市场分析
官网写给要在多个模型之间做费用、延迟和质量取舍的开发者和企业团队。定价页(美元,模型用量零加价,方案费另计):Starter 永久 0 美元,3 个组织、最多 5 个别名、1 把自带密钥且每月 100 万次请求、每月 20 万条日志、保留 7 天;Pro 每月 199 美元,10 个组织、20 名成员、60 天日志、响应缓存、追踪和护栏;Business 每月 799 美元,100 个组织、服务账号密钥、日志保留 120 天;Enterprise 另询,含自托管。年付 Pro 为 1,990 美元、Business 为 7,990 美元。替代方案是直接对接各家 API,或使用其他模型网关;Ritesh 在帖里把差异写成周期性的费用建议、按请求的告警、提示词版本、跨文本和图像视频的评估,以及多模态响应缓存。自述有客户经这些建议识别出每月超过 1 万美元的节省,这是帖文说法。

产品上下游
上游是应用发出的文本、图像、视频、嵌入和语音请求,以及可选的自带供应商密钥。下游是选定的模型供应商、统一日志和告警(Slack、PagerDuty 等)。自托管只写在 Enterprise。零数据保留取决于所路由的供应商是否提供该选项。

3. Invofox Self Serve · 官网

标语:99% accurate document extraction, SLA guaranteed

背景
这是 Invofox 的第 3 次发布,日榜第 3,发布页标为 Free Options。产品页公司信息标有 Y Combinator。讨论里回复的有 Alberto Gimeno 和 Nacho Gabaldón。它是文档解析 API:上传 PDF 或图片,返回按 schema(目标字段结构)整理的 JSON,覆盖分类、抽取、校验和反馈。预置类型包括发票、收据、账单、工资单、采购单、身份证件、合同、税表和美国抵押贷款文件;也可以交自定义 schema。官网 FAQ 写准确率门槛按文档类型和字段写进 SLA(服务等级协议);稳定用例达到 99.2%。报错的文档会自动退回该页费用。默认在欧盟处理,美国处理需另行申请。零保留(交付后删除文档)写为 Scale 和 Enterprise 可选;本地或 VPC 部署写为 Enterprise。Alberto 在讨论里对「能否本地处理敏感文件」回复:支持零数据保留和本地部署,并请对方联系团队。有人转述免费额度为 500 页且无需信用卡,他回复本次发布期间是 1,500 页。定价页仍写新账号 500 页、无需信用卡、也没有持续的免费额度。两处数字本次没有再向团队核对。抓取时约 273 票、约 24 评。

产品要解决的问题
发票、收据和合同的版式差很多。只做 OCR(把图像转成文字)之后,表格、手写和字段校验仍要人看;用通用模型搭一个周末原型,也还没覆盖模型升级后的回归和按客户文档持续改规则。

产品市场分析
目标是把单据解析嵌进自己产品的软件团队,定价页提到金融、物流、借贷、保险和医疗运营。定价页(美元):Free 为 0,500 页,含发票、收据、水电账单、票据和工资单的预训练模型与 REST API;Starter 起价每月 500 美元、按年计费,每月最多 5,000 页,并列出 99.9% 可用性 SLA;Scale 与 Enterprise 另询。页脚又写 SLA 档面向每年处理 100 万页以上的方案。按页计费,量越大单价越低;Enterprise 也可按文档或业务对象计价。定价页写平均处理时间不到 3 秒,OCR 说明页写典型文档大约 10 秒,两处没有互相解释。官网写生产中约 150 家公司、每月处理超过 1,000 万份文档,这是站上自述。

产品上下游
上游是 PDF、图片、目标 schema 和客户通过反馈接口标出的错误。下游是 webhook 或轮询取回的 JSON,以及记入账单前被退回的错误页。零保留和本地部署不在自助免费档的功能列表里。

4. Opengeni · 官网

标语:Ship AI agents within minutes. Infrastructure for Agents

背景
Opengeni 日榜第 4,发布页标为 Free Options,并写有 100 美元额度。产品页 2 条评价、5.0 分。协议为 Apache-2.0,仓库在 Cloudgeni-ai/opengeni。讨论里回复的有 Davlet Dzhakishev、Jørgen Sandhaug,以及被点名的 Benny。它提供可恢复的会话、隔离沙箱、工具和 MCP、人工审批、记忆、按租户隔离,以及按步骤和金额查看花费。连接断开后运行继续:消息返回 202,Agent 在后台工人上接着做,子 Agent 经 Postgres 回报,不依赖浏览器一直连着。空闲会话只是数据库里的一行,不轮询。流式 token 每 33 毫秒或每 50 个事件批量写入,不锁主会话行;在线观看方经 NATS 收到通知后再读 Postgres。核心目前不能缩到零,工人是长驻进程,部署在 Kubernetes 或云主机上;调用方自己的后端可以是无服务器函数,但不建议用函数去代理 SSE 长连接。MCP 端点已用可流式的 HTTP。发布说明写前 100 名云用户可用码 PRODUCTHUNT100 领取 100 美元额度;抓取官网时页面写还剩 49 个码。抓取时约 265 票、约 45 评。

产品要解决的问题
把 Agent 放进已有的 SaaS,要自己处理断线后续跑、沙箱、每个用户的 OAuth 令牌、多租户隔离和花费账本。这些部分在演示里看不出来,一进生产就占掉做产品本身的时间。

产品市场分析
Davlet 写,目前更常帮到已经有 SaaS、又要在不打破用户和组织边界的前提下加上 Agent 的团队。定价页:自托管软件许可为 0 美元,计算、存储和模型费自付;云上按模型供应商费用加 5%,无席位费、无平台费、无最低消费;Enterprise 另询,含私有部署、SSO 和商业支持。替代方案是用 LangGraph 一类框架或云厂商自己搭。发布码的剩余数量会变,以官网当时显示为准。

产品上下游
上游是应用通过 SDK 发来的会话、用户自己的 OAuth 连接(讨论和官网举例有 Stripe、GitHub、Google Drive)、OpenAPI 描述的工具,以及 OpenAI、Azure OpenAI、OpenRouter 或自备的兼容端点。下游是沙箱里的工具调用、待人批准的动作、webhook(如一轮结束、需要人工),以及按用户和会话的费用记录。有人问能否给 Agent 或会话设硬预算、用尽即停;Davlet 回复已经在记费用并有限额和护栏,把两者合成硬停止「会比较简单」,没有说这个开关今天已经打开。

5. DailyHelm · 官网

标语:Turn analytics into daily revenue-boosting fixes

背景
DailyHelm 由 Brandon 发布,日榜第 5,发布页标为 Free Options。猎人 Rohan Chaubey 写自己参与了发布前的表述。它是给创始人和增长团队的隔夜审阅:连上分析、广告、商店和支付数据,第二天给出按影响排序的发现,并带证据、置信度和建议动作。定价页写包含 6 个专科 Agent 和编排者 Aria。专科角色在产品脚本里写为 Iris(分析与增长)、Pitch(广告)、Echo(SEO)、Ada(代码)、Penny(费用)、Sage(站点体验)。Brandon 在讨论里说:不是用来替换 GA4 的明细报表;Iris 读 GA4,标出值得看的变化。连接器用各平台自己的授权页,页面写为只读、不保存密码。PostHog 的接入说明是粘贴个人 API key。Google Ads 今天可以接;Meta Ads 在连接器列表里标为即将推出,Brandon 说 Facebook 计划下个月上线。一个登录可以加多个业务,每个业务单独订阅,第二家按全价、不做成折扣加购。7 天试用为完整产品,无需信用卡。抓取时约 206 票、约 65 评。

产品要解决的问题
仪表盘和表格已经很多,但转化断了、广告空耗或结账异常,仍要人每天去各处对。对完之后,先改哪一件往往没有排序。

产品市场分析
讨论里 Rohan 把它推荐给 DTC、SaaS、代理商和小型线上生意。定价页方案(美元,月付;年付按月折算更低):Solo 每月 99 美元,1 个席位、Aria 每月 30 条消息、邮件日报、发现保留 60 天;Growth 每月 199 美元,3 个席位、每月 75 条消息、Slack 投递、保留 1 年、每周摘要;Scale 每月 349 美元,席位和历史不限、API 与 webhook、PDF 导出。年付折算月价分别为 79、159 和 279 美元。官网对照文把 Databox、AgencyAnalytics、Triple Whale 和 Baremetrics 写成不同侧重点的替代:对方更偏看板、客户报告、Shopify 广告归因或订阅指标。对照文里另有一句把 Growth 写成每月 149 美元,与定价组件里的 199 美元不一致,本文采用定价组件。

产品上下游
上游是 GA4、Search Console、站点爬虫、PostHog、Google Ads、Shopify、Stripe、Square、GitHub、HubSpot、Zendesk 等已连接的数据;Meta Ads 仍标为即将推出。下游是邮件或 Slack 里的日报、可分享链接,以及 Scale 上的 webhook 和 PDF。发现是否值得做,取决于人是否核对它附上的证据。

6. Web Search API · 官网

标语:Give AI Agents Access to Live Internet Data

背景
Web Search API 是 Cloudflare 的第 54 次发布,日榜第 6,发布页标为 Free Options。公司主页仍是 cloudflare.com;这次发布的说明在 2026-10-02 的更新日志,状态为 beta。它让 Agent 和应用搜索互联网,用来给回答加上当前信息,而不是猜 URL 或停在模型的训练截止日期。上线可选三家:Ceramic.ai(默认)、Exa、Linkup。三家都写明经 Cloudflare 的请求支持零数据保留,并承诺遵守 Cloudflare 的已验证爬虫标准。调用走 AI Gateway:用账号 API token 打 REST,或在 Worker 里用 AI 绑定的 websearch()。不指定供应商时用 Ceramic。自带密钥时,密钥存在网关的 Secrets Store,请求体里只传别名;未配置该别名则返回 400,不会悄悄改用额度。讨论里有人问更适合哪类查询、是抓取还是知识工作;抓取到的帖文里没有团队答复。抓取时约 158 票、约 2 评。

产品要解决的问题
模型回答停在训练截止日期之后的事情时,要么猜,要么由应用自己再接一家搜索 API,并单独处理密钥、日志和账单。

产品市场分析
目标是已经在用 Cloudflare 账号和 AI Gateway、要给 Agent 加实时检索的开发者。供应商文档上的标价(经额度支付、无加价;自带密钥则由该供应商按原协议计费):Ceramic 每 1,000 次 0.25 美元,Linkup 每 1,000 次 5 美元,Exa 每 1,000 次 7 美元。Ceramic 文档写它维护面向 Agent 的独立索引,规模超过 400 亿页。替代方案是直接购买 Exa、Linkup 或其他搜索 API,或使用模型供应商自带的联网工具。AI Gateway 文档里另有一条「把某家模型的联网工具原样代理过去」,那是另一条路径,不是这次的 Web Search API。

产品上下游
上游是查询语句、可选的供应商和条数上限,以及 AI Gateway 额度或自带密钥。下游是带回摘要或片段的搜索结果,以及网关日志。Linkup 在这条 API 里用 fast 深度并返回原始结果,不由 Linkup 再生成一篇答案。索引覆盖和时效仍取决于所选供应商。

7. HyperFrames Studio (Desktop) · 官网

标语:The First Video Editor built for Agents

背景
HyperFrames Studio 是 HeyGen 的第 19 次发布,日榜第 7,发布页标为免费。发帖人 Bin Liu 写自己在 HeyGen 负责 Agent 视频产品与工程。核心库 HyperFrames 已开源:Agent 用 HTML 写视频,再渲染成 MP4。抓取 GitHub 仓库 heygen-com/hyperframes 时约 57,338 star;Bin 在帖里写超过 56,000,并称 HyperFrames 技能在 skills.sh 上排历史第 13,后一数字本次没有从 skills.sh 再核对。Studio 是放在这套渲染前面的桌面编辑器:用 Claude Code 或 Codex 生成初稿,然后在画面上圈选、留言,把一批批注一次交给 Agent。也可以动手改时间线、片段速度,并导出 MP4、WebM 或 MOV,最高 4K。Bin 写它更适合动效、发布片和口播再剪。系统为 macOS 和 Linux,Windows 写为即将推出;同事 Miguel Ángel 对「何时有 Windows」回复很快会有。有人问开源部分和 Studio 如何分界,抓取到的帖文里没有直接答复。抓取时约 144 票、约 10 评。

产品要解决的问题
用对话改视频时,「某一秒的某个词再早一点」很难指清楚。每一轮文字说明都可能改到别的地方。

产品市场分析
Bin 写给被剪辑卡住的创始人、营销和讲故事的人,以及已经在用编程 Agent 的人。变现信号是发布页的免费;Studio 与开源核心的收费边界,本次没有从官网核对到价目。替代方案是传统时间线编辑器,或只生成成片、不能在画面上批注的视频 Agent。HeyGen 主产品仍是头像视频平台,产品页上的历史评价多数针对那一条产品,不是这次的 Studio。

产品上下游
上游是描述、画面上的圈选和批注,以及编程 Agent(帖里点名 Claude Code 和 Codex)。下游是 HTML 时间线渲染出的成片。开源仓库继续作为 Agent 写视频的那一层;Studio 的下载页在抓取时返回错误,安装包以 hyperframes.dev 当时提供的入口为准。

8. devpit · 官网

标语:A native control room for your Claude Code agents

背景
devpit 由 Jhol Hewres 发布,日榜第 8,发布页标为免费。官网写它是桌面应用:每个项目一个终端,一块看板,每次调用的费用,以及能看见多个项目的编排器。技术栈在 FAQ 里写为 Rust 和 Tauri,终端是真正的 pty,后面是 tmux;Windows 用自带的 psmux。构建列出 Linux(x86_64 与 arm64)、macOS 通用包和 Windows x64 安装包,Linux 构建也可在 WSL 2 里跑。协议为 Apache-2.0,仓库为 jholhewres/devpit。它使用用户已有的 Claude Code 方案,不另发 API 密钥。数据放在 ~/.devpit,不往项目仓库里写文件。手机查看走 Tailscale(组私人网络的工具):用一次性码配对,并选择手机能做哪些事。今天的账号只用于登录;FAQ 写将来的同步会保留工作区、不上传工作内容本身。驱动的 Agent 目前是 Claude Code,其余写为还在路上。Jhol 回复费用可以按日、模型、项目和会话查看。有人追问一轮还在生成时数字会不会往上跳、以便中途停掉;回复说可以在编排器里看进行中的会话、每次调用的费用和 token,没有单独说明数字是否在该轮返回之前就更新。抓取时约 101 票、约 6 评。

产品要解决的问题
多个 Claude Code 会话同时跑时,哪一个终端还在烧 token、哪一张任务卡真正触发了工作,很容易对不上。

产品市场分析
目标是已经在本机用 Claude Code、又要同时看几个项目的人。变现信号是免费和 Apache-2.0;模型费用仍走用户自己的 Claude 方案。替代方案是继续用多个终端,或使用 Claude 自己的桌面界面。其他编程 Agent 的支持还没写进当前驱动说明。

产品上下游
上游是本机项目、看板上的卡片,以及已登录的 Claude Code。下游是 tmux 或 psmux 里的会话、按会话记下的费用,以及可选的 Tailscale 查看。编排器可以按卡片开一场会话再回报;仓库本身不被写入。

9. Reactive Resume v6 · 官网

标语:A free and open-source resume builder

背景
这是 Reactive Resume 的第 5 次发布,日榜第 9,发布页标为免费。作者 Amruth Pillai 写这个项目已经做了 6 年,v6 把简历、配套求职信和求职进度放进同一套流程。界面分成写作、设计和检查,简历始终可见;检查意见指到对应行。AI 修改并排显示原文、建议和理由,逐条接受或拒绝。预览就是 PDF,由浏览器里的 pdf.js 画出,下载与预览用同一引擎。可导入 PDF、Word、JSON 或 LinkedIn 数据导出,LinkedIn 导入不经过 AI。文档站写有 17 套模板、55 种语言,导出 PDF、Word、Markdown 或 JSON,分享链接可以加密码。求职跟踪有列表、看板和日历。自托管是一个 Docker 镜像,Amruth 回复即使没有 Docker 经验,也可以把文档交给 Agent,并写树莓派也能跑。协议为 MIT。没有广告、没有追踪、没有付费档;AI 可选,密钥连到用户自己的供应商,费用由该供应商收取。项目靠 Open Collective 捐赠维持。有人问跟踪器能否在面试前发提醒,抓取到的帖文在问题之后没有团队答复。抓取时约 100 票、约 4 评。

产品要解决的问题
改简历时,写经历、调版式和决定能不能投,常常混在同一屏里。预览和导出若不是同一套渲染,投出去的 PDF 会和屏幕上看到的不一致。

产品市场分析
文档写给正在求职、不想先学设计的人。托管版在 rxresu.me 注册即用;组织也可以自己托管,功能与托管版相同。替代方案是按模板收费的简历网站,或文字处理器。变现信号是永久免费加上捐赠;AI 不在 Reactive Resume 的价目里。

产品上下游
上游是用户写下的经历、导入的文件,以及可选的自备模型。下游是 PDF 和其他导出、可加密码的分享链接,以及求职进度板。账号数据可以导出 JSON 或整包下载,也可以删除账号。

10. Jarq · 官网

标语:Translate, shorten, fix or rewrite any text near your cursor

背景
Jarq 日榜第 10,发布页标为免费,并写有 1 个月免费。官网要求 Apple Silicon(M1 或更新)和 macOS 13 及以上。在任意应用里选中文字后,翻译、缩短、修正或改写会出现在选区旁边,结果可以原地替换或复制。自定义指令会变成一颗按钮;选中的文字只当作待处理的材料,不当作命令。口授快捷键是 Option 加反引号,再说一次结束,整理后的文字落在光标处。可以说一种语言、打出另一种,官网写支持 13 种,页上点名英、俄、西、葡、法、德等。选区被应用挡住时,Option-T 仍会取字,官网点名 Figma 和终端。可选的本机语音模型让口授不上云,且不计入次数。云端处理的文字和声音,官网写不在服务器上保存、也不用于训练;历史留在本机。隐私政策页为 jarq.app/privacy。讨论里有人问口译是等停顿再提交,还是边说边改;抓取到的帖文里没有团队答复。抓取时约 95 票、约 4 评。

产品要解决的问题
把一段话交给翻译或聊天窗口再贴回来,要切换应用。正在写的句子会因此断掉。

产品市场分析
官网把它和 Grammarly、ChatGPT 的差别写成:那些工具在自己的窗口里,Jarq 在当前应用里改完。和 macOS 自带听写的差别写成:它交出带标点和指定语言的成句,并覆盖系统听写容易失败的应用。每次安装先给 14 天 Pro,无需信用卡、无需账号。之后免费档每天 5 次口授或翻译,不过期。付费为每月 4.99 美元、每年 39 美元,或一次 179 美元。本机语音模型在各档都不限次数。发布页写的「1 个月免费」和官网的 14 天 Pro,本次没有再核对是否为同一优惠。Windows 或其他平台不在系统要求里。

产品上下游
上游是选中的文字、自定义指令,或麦克风。云端模型处理需要出网的翻译和改写;本机模型只处理口授。下游是原地替换或复制到剪贴板的文本。官网提醒模型会出错,重要文字需要再看一遍。

引言

开发过程中经常会碰到相同的逻辑,一般为了代码的整洁性,都会进行复用。
但是是不是所有相同的逻辑都需要复用呢?

实际场景

有两个商品卡片需要实现,其中一个是热点商品,一个是普通商品
两个在长相上有一些区别,大概在30%左右
热点商品多了标签,背景色,按钮等功能

  • 复用型写法I
1
2
3
4
5
6
7
8
9
10
11
12
function ProductCard({isHot, price, productImage, productUrl}) {

return (
<div style={isHot ? styles.cardWithBg : {}}>
{isHot && <Tag />}
<span>{price}</span>
{isHot && <Button />}
<img src={productImage} onClick={() => Navigate.push(productUrl)} />
</div>
)

}
  • 复用型写法Ⅱ
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
function CommonProductCard({price, productImage, productUrl}) {
return (
<div>
<Price price={price} />
<ProductImage image={productImage} url={productUrl} />
</div>
)
}

function HotProductCard({price, productImage, productUrl}) {
return (
<div style={styles.cardWithBg}>
<Tag />
<Price price={price} />
<Button />
<ProductImage image={productImage} url={productUrl} />
</div>
)
}

function Price({price}) {
return <span>{price}</span>
}

function ProductImage({image, url}) {
return <img src={productImage} onClick={() => Navigate.push(productUrl)} />
}

复用型I的代码说不上来的别扭,绝对的垃圾代码
复用型Ⅱ是经常能见到的,看起来解耦非常不错,也容易理解,但是细想:
热点商品为什么要跟普通商品的UI复用?两者本来就应该长得不一样。现在只是恰巧有某些地方是一样的,后来我说不定就改了。

技术层面复用逻辑没有问题,但是回到需求本身,这种复用是没有必要的,本来这两个东西就应该是分开的。
所以不如复制粘贴再写一遍更好:

  • 分离型写法
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
function CommonProductCard({price, productImage, productUrl}) {
return (
<div>
<span>{price}</span>
<img src={productImage} onClick={() => Navigate.push(productUrl)} />
</div>
)
}

function HotProductCard({price, productImage, productUrl}) {
return (
<div style={styles.cardWithBg}>
<Tag />
<span>{price}</span>
<Button />
<img src={productImage} onClick={() => Navigate.push(productUrl)} />
</div>
)
}

总结

不要盲目的复用代码,即使他们在逻辑上有相同之处,也要看这种逻辑相同是否是需求所期望的,可能只是偶发性的相同。

In React Native, logical AND may cause crash as below.

Conditional rendering in React Native may crash your app

This babel plugin here can replace all logical AND with ternary operators, with a little more configuration.

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
// .babelrc.js
module.exports = function (api) {
api.cache(true);

const presets = [];
const plugins = [
'./ternary-jsx.js',
// this two plugins below only parse but not transform code
['@babel/plugin-syntax-decorators', { decoratorsBeforeExport: true }],
['@babel/plugin-syntax-class-properties', { loose: true }],
];

return {
parserOpts: {
plugins: ['jsx', 'typescript'],
},
presets,
plugins,
generatorOpts: {
retainLines: true,
compact: false,
minified: false,
concise: false,
},
};
};

However, Babel will lose some code formatting in the process, as it works based on the AST..

How to add Category and Tag page

If you want one page list all categories, just create source/categories/index.md, and then write type: categories in it, which tells Hexo to create public/categories/index.html. “Tags”, “About” are the same.

1
2
3
4
cd source
mkdir categories
cd categories
vi index.md
1
2
3
4
5
6
<!-- index.md -->
---
title: categories
type: "categories"
---

今日 Hacker News 热榜前五落在本地大模型、上世纪文字冒险、系统自带 AI 占掉的磁盘、动画工作室档案,以及用现成 SSH 做临时外网入口。排第一的是 Strata:它把 Qwen3.8-Flash-Next 拆到消费级显卡、内存和硬盘上跑,热帖标题写的是 RTX 4090 上约 100 token/秒。后面是 Andrew Plotkin 用调试器挖出 Infocom 游戏 Infidel 里一个出厂就在的内存写坏,以及一个关掉 macOS 27 上 Apple Intelligence 并删掉模型文件的开源工具。后两条是 Tippett Studios 关停后有人把光盘镜像放上 Internet Archive,以及 Vincent Bernat 只用 OpenSSH 和 nginx 做带过期链接的自建 HTTP 隧道。以下按 Firebase topstories 当前顺序整理,分数与评论数为抓取时快照。

1. Run Qwen 3.8 Flash Next (125B) on consumer hardware (RTX 4090) at 100T/s

背景介绍
Strata 的 README 说,它在普通 PC 上跑 Qwen3.8-Flash-Next,聊天、写代码、读图,并给本机上的应用和编程 agent 用;README 写「数据不离开这台 PC」。Hugging Face 模型卡把这款模型写成实验性预览,是日后 Qwen4 架构的一次公开权重发布:因果语言模型加视觉编码器,许可证名为 qwen-community-1.0。模型卡的参数量是 125B、其中约 6B 激活,另外还有 51B 的 n-gram embedding 和 4B 的 MTP;原生上下文 262,144 token,并写可延伸到 1,000,000。MoE 是 512 个专家,每步激活 10 个路由专家加 1 个共享专家,共 48 层。

Strata 的硬件要求是 12 GB 及以上显存(列出了多款 NVIDIA RTX 与部分 AMD Radeon)、32 GB 及以上内存、大约 80 GB 磁盘,系统为 Windows 10/11 或 Linux。README 自己的速度表测的不是 4090:RTX 5070(12 GB)配 64 GB 内存时,Q2_0 写回复约 94 token/秒、读 32K prompt 约 2,650 token/秒;同一张卡上 IQ3_S 约 53 token/秒。RX 9070 XT 上 Q2_0 约 60 token/秒。文中估计显存更大的 RTX 3090(24 GB)「应该」能到大约 100–140 token/秒,这是估计,不是表里的实测行。HN 标题里的「100T/s」和「RTX 4090」对得上提交者 snehesht 的跟帖:4090、128 GB DDR5、Ryzen 7950X3D,测到 124 token/秒。

README 把加速说成两件事。一是把工作拆开:显卡留下最常用的专家,内存放下全部,CPU 同时算其余部分,SSD 放一张大查找表。它写模型是「24,576 个小专家、每个词只用其中 10 个」。官方模型卡是每层 512 个专家、48 层;512×48=24,576,和这两个数字对得上,但 README 没有把这步乘法写出来,也没有单独提到模型卡里的那个共享专家。二是「先猜再核对」:小模型先猜接下来几个词,大模型一次核对,README 写同样的答案可以早 1.6–1.8 倍出来。安装器按内存推荐量化:32 GB 用删掉一半专家的 Coder 版,48 GB 用 IQ2_XS 或 Q2_0,64 GB 推荐 IQ2_XS、也可以上 IQ3。Coder 版 README 写,其作者测得 SWE-bench Verified 达到完整模型的 91%,代码以外(包括中日韩文本)更弱。服务开在 http://127.0.0.1:8080,并提供 OpenAI 兼容的 /v1。

主要讨论方向与观点
速度有人复现,质量有人存疑。mrinterweb 用一张 RTX 4090(24 GB)加 128 GB DDR4,写自己看到超过 110 token/秒(评论里称为 3 token MTP),上下文用到 60K/260K,并觉得目前不差于自己约 60 token/秒的 Qwen 3.8 q5 27B。jacquesm 承认速度在,但自己试下来准确度并不特别打动人,并说这类链接在各处 LLM 帖子里很多,蜜月期过后还要再看。a11r 不愿意用到 4-bit 以下,怕质量掉得厉害;对方自己的栈是租来的 RTX Pro 6000、大约每小时 1 美元,用 4-bit 做范围明确的编程任务。Tepix 直接写 Q2 量化不感兴趣。mmaunder 把 Coder 版说成丢掉一半 MoE 专家,认为「有总比没有强」,但离够用还有距离。

Jackson__ 用一个 50 张图的坐标任务做了对比:同一套 GGUF 和视觉适配权重,Strata 的中位误差 154.8 像素、平均 168.8;llama.cpp 是中位 46.5、平均 81.4,温度都是 0。评论把这个差距比作从 9B 跳到 35B,并写没有再做别的测试。也有人拿别的引擎比较:kamranjon 说 ds4 已经支持这个模型,自己每天用 q4;AntiRush 则在 RTX 6000 Pro 上用 另一份 ds4 的 Q4,写下代码场景 prefill 1,251 token/秒、decode 255.26 token/秒,以及可以同时开 4 路、速度在 400 token/秒以上。lxe 问这种专家缓存为什么还不进 llama.cpp。回复里一种说法是 GGML 要求贡献者自己看得懂代码,完全由模型生成、作者也不打算整理的内核就留在下游;另一种说法是主流引擎要同时守数值精度和很宽的硬件、模型矩阵,所以合入慢。

专有名词解释

  • Qwen3.8-Flash-Next:阿里云 Qwen 团队在 Hugging Face 上的开放权重预览。模型卡写 125B 总参数、约 6B 激活,并带视觉编码器。HN 标题把它写成 “Qwen 3.8 Flash Next”。
  • MoE / 专家:Mixture-of-Experts。模型卡写 512 个专家,每步走 10 个路由专家加 1 个共享专家。Strata README 的 24,576 与「512 专家 × 48 层」数值相同。
  • Q2 / IQ3 等量化:把权重压到大约 2-bit 或 3-bit 的格式名,README 的速度表按这些尺寸分行。评论里的担心是:更小更快,但低于 4-bit 时质量可能明显变差。
  • MTP:模型卡里的 4B multi-token prediction 模块。mrinterweb 用 “3 token MTP” 描述自己的测速;README 则把同类加速写成小模型先猜、大模型再核对。
  • GGUF:Jackson__ 用来对比 Strata 和 llama.cpp 的权重文件格式。评论写两边用的是同一套 GGUF 和视觉适配权重。

HN 讨论:thread · 598 分 · 280 评

2. Infidel goes wild

背景介绍
Andrew Plotkin 于 2026 年 10 月 3 日在 Zarf Updates 发表 Infidel goes wild。他写,前一天刚公开了 Planetfall,这几周则在看 Infocom 1983 年的文字冒险 Infidel,并用相当于内存级调试器的工具玩这款游戏,碰到了他见过的 Infocom 游戏里最离谱的 bug。分析对象是 Macintosh 更新版 release 22、序列号 840522;最初发行版序列号 830916 有同一个 bug,只是地址略有不同。

Infidel 的场景在埃及沙漠。营地以东是 3×3 的沙漠,再往外就走进一个叫 ENDLESS-DESERT 的房间,所有未画进地图的沙漠都由它代表,游戏另外记下经纬度。为了让「不同地点」看起来不同,丢在沙漠里的物品会被移出房间,坐标写进 DESERT-TABLE;走回同一坐标时再搬回来。丢下物品时还有三分之一的概率立刻被沙子埋掉。

Plotkin 想在调试器的 State 页显示这张表,发现表一直是空的,物品却确实会消失再出现。反汇编 DESERT-TO-TABLE 之后,他写原因是编译器:ZIL 允许参数默认值等于全局变量 DESERT-TABLE,但这张表的地址 11129 不是编译期常量。生成的 Z-machine 代码把局部变量初始化成全局变量的编号 30(十六进制 1e),而不是地址 11129。于是写入从内存地址 30 开始,把表和读回函数一起用错,表面上看物品还能回来,内存已经被踩过。Z-machine 版本 3 里地址 0–29 才是有意义的文件头,30–63 碰巧空着;地址 64 起是缩写表。他预言丢下九件物品再走开,最后一件会改写缩写表开头。文中贴出的结果是:幻觉句里的 “the” 变成了 “You”。另一次测试让解释器崩溃。他判断 1984 年的修订没有修这个 bug,也推测几乎没有人在无尽沙漠里丢过八件以上的东西。修法在文中写得很短:不要用全局变量当默认参数,改成函数开头 <SET TBL ,DESERT-TABLE>,或者多传一个参数。同文还提到另一对例程 PROP-TO-TBL / TBL-TO-PROP 有类似问题,而游戏并不允许在无尽沙漠挖坑。

主要讨论方向与观点
评论不多,多半接在那句「作为 C 程序员,我在法律上必须把内存破坏当成最严重的罪」上。Waterluvian 回了一句 “Self-flagellation considered dangerous.” kwertyoowiyop 问有哪位八十年代游戏程序员从没把内存写坏过就出过货。gertlex 说自己在读 Digital Antiquarian 的游戏史,那些文章往往要自己配磁盘镜像和模拟器;这种能直接在浏览器里看的写法,也许会让人真的去试一款解析器冒险。jdw64 问怎样才能写出这种基于亲身经历的技术文。zem 的回复把起点放得很小:在论坛里想起职业生涯中的一个瞬间并写短回复,或者学 Julia Evans 那样把「今天学到的一件事」写成博文,不要求每篇都一样重。页面底部还嵌了 Bluesky 和 Mastodon 上的转贴,其中有人问这会不会影响速通,glyph 提到有人在做以 6502 周期计时的 Zork 工具辅助速通,并链到 intfiction.org 的帖子。

专有名词解释

  • Infocom / ZIL / Z-machine:Infocom 是八十年代商业文字冒险的公司。ZIL 是它们的实现语言,编译到 Z-machine 这种虚拟机。文中的 txd 来自九十年代初的 ztools,操作码名字和 ZIL 术语并不一一对应。
  • ENDLESS-DESERT / DESERT-TABLE:游戏里代表一切未测绘沙漠的单个房间,以及记录「哪件物品落在哪个经纬度」的定长数组。文章写这张表有 100 个值、从地址 11129 开始。
  • 缩写表:Z-machine 文本压缩用的常用词表。文章写版本 3 从地址 64 开始,共 96 个词;被踩到之后,打印出来的句子会串词。
  • Visible Zorker:文章后文用来比较的名字,原句是 Infocom 没有类似它的工具。开头只把作者自己的手段写成内存级调试器,没有另起一段定义这个名字。

HN 讨论:thread · 70 分 · 10 评

3. Turn off Apple Intelligence on macOS 27 and get its disk space back

背景介绍
RemoveMacAI 的 README 写:macOS 27 不再为 Apple Intelligence 提供一个总开关,功能关掉之后模型文件仍留在磁盘上。这个工具会关掉功能、删掉模型,并阻止系统再次下载;改动可以还原。它只支持 Apple 芯片。README 的系统表写 macOS 27 受支持、在 27.0 上测试过;27.0.1 需要 0.2.3 或更新版本。macOS 26 及更早不受支持。

关掉的功能包括 Siri(含 “Hey Siri” 和菜单栏图标)、Writing Tools、Genmoji、Image Playground、ChatGPT 扩展,以及邮件、信息、Safari、备忘录和通知里的摘要,还有邮件智能回复、行内文本预测、Spatial Photos、照片的 Clean Up、Xcode 预测性代码补全。删掉的是 Apple Intelligence 基础模型,以及图像生成、Genmoji、Spatial Photos、照片 Clean Up 和 Xcode 补全各自的模型。听写是另一项设置,语音模型不删。

实现上,配置描述文件套用 Apple 的限制键,并强制那些没有限制键的设置。模型通过 Apple 的 asset 服务删除,系统完整性保护保持开启,不直接改 /System 下的文件。描述文件把已删除模型的下载指到一个关闭的本地端口,避免系统再下回来。删掉描述文件后,设置回到先前状态,功能再次需要模型时系统会重新下载。README 写这个工具本身不发起网络请求、也不收集数据。安装方式包括 Homebrew,以及一行 curl | bash:脚本下载最新发行包、核对 SHA-256,再从临时目录运行。发行包由 GitHub Actions 从标签构建,并带构建来源证明,可以用 gh attestation verify 核对。项目致谢写,它建立在 4evy 的 pared 上,后者先摸清了 asset 服务、模型集合和一部分设置键。

主要讨论方向与观点
不少评论把它看成系统「去臃肿」。ryandrake 比作装完 Windows 后一向要做的清理,并说 macOS 也到了要靠第三方脚本拿回资源和去掉不想要的软件的地步。hypfer 提到 O&O ShutUp10,问 Apple 的产品策略发生了什么。rsx88 把这件事和 iPhone 上关不掉的订阅横幅放在一起,问今年是不是该改用 Linux。1saadcodes 肯定工具开源、做了什么能看出来,同时担心为用不上的模型交出几十 GB,离开了以前把系统做瘦的做法。kristianpaul 只写自己需要拿回 12 GB。Grombobulous 已经不用 Mac,但抱怨 iOS 上不能再用一个开关关掉这类 AI,并对比微软、Firefox 提供的全局 AI 开关。

也有人站在保留本机模型一边。pdp 不理解为什么要删掉每台 Mac 都带的、体积相对小、也不上云的本地推理模型:够不上前沿,但够基本任务。Waterluvian 想起十多年前为了「即插即用」而在 OS X 里塞进数 GB 打印机驱动,好奇 Apple 怎么权衡磁盘占用和一部分用户的不满。安全问题被直接问出来:the_arun 问凭什么相信这个工具;回复是代码开源,可以自己看。pyaamb 问能不能手动做,detourdog 贴了 Apple 讨论区的一篇文档链接,本文没有再打开那篇文档核对步骤。pmarreck 问它到底做什么;一条回复用讽刺口吻描述被关掉的那些系统功能,不是在逐条解释这个仓库的代码。

专有名词解释

  • Apple Intelligence:macOS 27 上的系统级生成功能总称。README 的判断是:这一版没有单一开关,关掉功能也不会自动清掉已下载模型。
  • 配置描述文件:macOS 用来下发限制的配置。RemoveMacAI 用它套限制键,并让用户在系统设置里批准安装。
  • asset 服务:README 用来删除和拦截模型下载的系统组件。文件真正从磁盘消失的时间由系统自己排,所以「存储空间」里可能还会暂时把它们算在 Apple Intelligence 名下。
  • 系统完整性保护(SIP):macOS 阻止直接改系统目录的机制。README 写删除模型时 SIP 保持开启。
  • pared:4evy 先写的工具。RemoveMacAI 在致谢里把它当成摸清模型集合和设置键的基础。

HN 讨论:thread · 334 分 · 210 评

4. In the wake of closure, a digital archive of animated materials appears online

背景介绍
Ryan Lambie 于 2026 年 10 月 2 日在 Film Stories 发表 Tippett Studios | In the wake of its closure, a digital archive of animated materials appears online。文章说,Phil Tippett 创办的伯克利动画与特效公司 Tippett Studios 在财务困难之后关停;关门日期写的是「那个月的 28 日」,而「那个月」是文章开头的八月。以 10 月 2 日的发表日期来读,指的是当年八月二十八日,句子里没有再写一遍年份。关停的同时,Tippett 本人退休,几十年的道具、纪念品和美术在两天拍卖里卖掉。文章担心工作室里的大量资料会进私人收藏、不再公开,并提醒 Tippett 的工作出现在 Star Wars、RoboCop、Starship Troopers 等片里。

随后的消息是:一位化名 TippettFan 的人在八月拍卖上买下夹着 CD-ROM 和其他光盘的文件夹,价格未披露,并把内容数字化后上传到 Internet Archive。捐赠说明写,这里是 Tippett 档案里 90 张关键、不重复光盘的 .ISO 镜像,因为其中一些资料网上没有、以后也未必再以这么高的分辨率出现。馆藏页在 archive.org/details/tippett-archive。文章说,少量片段可以直接在线看,包括 CGI 生物测试和 2008 年对 Phil Tippett 的采访;主体仍是 ISO,文件名涉及 RoboCop、Starship Troopers 的幕后、原版 Star Wars 上的幻灯片,以及《猫女》(Catwoman)的宣传剧照。文章感谢在 Bluesky 上指出这个馆藏的 Brandon Sheffield。

主要讨论方向与观点
这条下面只有两条评论。drewbeck 认为标题里应该出现 Tippett Studios 或 Phil 的名字,否则熟悉他的读者找不到这篇。stavros 说这有 textfiles 的味道,并补了一条 discmaster.textfiles.com 上搜索 “tippet” 的链接(检索词少了一个 t)。没有人在已抓到的评论里核对 ISO 数量或拍卖价格;价格未披露这一点来自 Film Stories 的正文。

专有名词解释

  • Tippett Studios / Phil Tippett:伯克利的定格与特效公司及其创办人。文章用 Star Wars、RoboCop、Starship Troopers 举例说明其作品被用进过哪些电影。
  • ISO:整张光盘的镜像文件。捐赠说明写馆藏主体是 90 张不重复光盘的 ISO,而不是已经拆开的单张图片。
  • Internet Archive:文章所说的上传目的地。馆藏标识是 tippett-archive。
  • textfiles / discmaster:评论里用来类比的旧软件与光盘目录。那条检索链接把工作室名字拼成了 tippet。

HN 讨论:thread · 13 分 · 2 评

5. Self-hosted HTTP tunnels with SSH and Nginx

背景介绍
Vincent Bernat 于 2026 年 10 月 3 日发表 Self-hosted HTTP tunnels with SSH and nginx。场景是:朋友要看只跑在 localhost:8080 上的草稿。文章先把现成办法分成三类:ngrok、Cloudflare Quick Tunnels 这种商业服务;frp、localtunnel 这种能自己搭、但要专用客户端的;以及只要普通 SSH 客户端、却依赖特定 SSH 服务端的 sish。他要的是只用已经在服务器上的 OpenSSH 和 nginx。

步骤是:ssh -R 把远程端口转到本机服务,远程端口写 0 时由服务器分配空闲端口;nginx 再把 https://p<端口>.ssh.luffy.cx 代理到本机该端口。*.ssh.luffy.cx 需要 DNS 和 Let’s Encrypt 通配符证书。文中的 ACME DNS-01 用的是 Route 53 上的 acme.luffy.cx,证书由 NixOS 自动拿。文章接着说,端口本身熵不够:内核从本地端口范围里分配,而且更偏向奇数端口,等于再少 1 bit。于是用 nginx 的 ngx_http_secure_link_module,对过期时间、端口和一个密钥做 MD5,把 base64 哈希和过期时间放进 URL 的用户名(域名不区分大小写,放不下这个哈希)。示例形态是 https://<哈希>--<过期时间>@p41535.ssh.luffy.cx/。哈希不对返回 401,过期返回 410,因为以后的会话可能重新用到同一个端口。文章自己写,MD5 偏弱,但就这个用途够用;也警告这套配置会把监听在 127.0.0.1 或 0.0.0.0 上的任意 TCP 端口暴露给持有密钥的人,从而绕过多数防火墙规则,并建议把 server_name 收紧到临时端口范围。

因为 OpenSSH 不会把分配到的端口放进环境变量,后半篇是一个装在服务器上的 http-over-ssh 辅助脚本:沿着 sshd-session 进程找出在听的端口,再印出 URL。OpenSSH 9.8 起会话进程叫 sshd-session,更早版本要找 sshd。查端口需要 sudo,因为降权后的进程被内核标成不可转储,ss 否则看不到套接字属于谁。脚本和一份 NixOS 模块放在他的 nixops-take1 仓库。

主要讨论方向与观点
toomim 更想要跑在 iroh 上的 HTTPS:不转发端口、不需要公网 IP、也不另搭代理;两台机器经 iroh 的公共中继对上信号,再直接连。评论里提议的 URL 方案名叫 irohttps://,并贴了 iroh-webproxy 和 iroh-proxy-utils。aliasxneo 说自己在做的 DNTLS 也想覆盖这件事,并认为 Tailscale、Cloudflare 这类服务把隧道做得很方便,但「自建」的边界被抹糊了;理想是完全没有中间人。guessmyname 问:既然是自建,为什么还要 *.ssh.luffy.cx 这种第三方名字。benatkin 回复:换成你自己的域名。gonzalohm 倾向于只给装了指定客户端证书的浏览器提供内容,并指出手机浏览器常常处理不好证书。esseph 欣赏「已经有的技术就拿来用」,同时指出没有代理的自建要把端点暴露出去,防御手段往往更少。snehesht 写自己在做用户态 WireGuard 的类似东西,还没贴出代码。

专有名词解释

  • SSH 远程转发(-R):让 SSH 服务器上的一个端口接到你笔记本的 localhost。端口写 0 表示由服务器挑一个空闲端口。
  • secure_link:nginx 用来核对链接签名的模块。本文用它检查 MD5、过期时间和端口,不把「知道端口号」当成唯一秘密。
  • ngrok / Cloudflare Quick Tunnels / frp / localtunnel / sish:文章开头用来对照的现成隧道。前两个是托管服务,frp 和 localtunnel 要专用客户端,sish 则要特定的 SSH 服务端。
  • iroh:评论里提出的替代路线。说法是先经公共中继交换信号,再在两台机器之间直接加密连接,从而不用自己做端口转发。

HN 讨论:thread · 46 分 · 11 评

今日 Product Hunt 热榜对应太平洋时间 2026-10-04 日榜(上海时间 10 月 5 日上午抓取,太平洋时间当日尚未收盘)。前半段是给编程 Agent 接上应用和记忆、放出长输出的前沿模型,以及让演示和文档少做一遍手工;后半段是自托管发信、在帮助中心和 OpenAPI 上接 MCP,以及把 Wallet 通行证和 Confluence 知识库收干净。按各产品页的 Day Rank,前五是 CoreSpeed、Gemini 4 Argon、Smooth Recorder、Blume 2.0 与 ChatGPT Space,后五是 opensend.cc、DocsAlot MCP Connector、Octri.dev、Pass Designer 与 WikiFix for Confluence。票数与评论数取自当日日榜页抓取快照,收盘前仍可能变化。

1. CoreSpeed · 官网

标语:One MCP for everything your agents need: apps, memory, tools

背景
CoreSpeed 日榜第 1,发布页标为免费,并写有 30% off。讨论里回复的有 Milton Yan、Spencer Zhao 与 Benji。产品把自己称作给 Agent 用的操作系统:应用只授权一次,账号和共享或私人记忆可以带到 Claude Code、Codex、Cursor 以及其他支持 MCP 的 Agent。MCP(Model Context Protocol,模型上下文协议)是让模型调用外部工具的接口。官网写明凭证留在 CoreSpeed,Agent 不持有密钥;连接走 OAuth 2.0(由各服务自己的授权页发放限定范围的令牌),不接收密码。同一应用可接多个账号,讨论里 Spencer 说明 X 账号可以命名为 personal 和 company,Agent 没说清用哪一个时会返回选项而不是猜。Slack 与 Discord 已可作为连接器。预算、活动日志和 Smart Approval(beta)用来拦住越权动作。计划中的能力写有 Agent Drive、Mail、Pay 和沙箱。安装方式是让 Agent 读取 https://corespeed.io/SKILL.md。抓取时约 280 票、约 57 评。

产品要解决的问题
换一个编程 Agent,往往要重连一遍应用,记忆也留在原来那台机器上。Agent 一旦在云端无人值守运行,连接密钥又容易落到环境变量里,出了费用和误操作也不好追。

产品市场分析
目标是已经在多个编程 Agent 之间切换、又要动到 CRM、社媒或工单的个人和团队。替代方案是各家 Agent 自带的连接器和记忆,以及自己保管 API 密钥的 MCP 服务器。定价页(美元):Free 为 0 美元,90 天 3,000 credits、1 名成员、200 MB 记忆、30 天历史,无需信用卡;Pro 每月 20 美元,每月 10,000 credits、最多 25 名成员、2 GB 记忆、1 年历史,可加购用量;Enterprise 另询,含 SSO 选项和自定义审计保留。标准连接器标为免费,高级连接器和网页搜索、抓取、媒体生成按 credit 计。发布页的 30% off 与上述标价的对应关系,本次没有从定价页单独核对到。

产品上下游
上游是用户用 OAuth 授过权的应用账号、明文写下的审批规则,以及网页搜索和社媒数据。下游是任意已登录的 MCP Agent、按次审批的写操作(可在仪表盘、邮件或 Slack 里批准或拒绝),以及记录工具调用、费用和成败的活动账本。Spencer 说按 Agent 勾选每个应用还没做完;今天可以用单独的 Agent 身份只拿组织里的共享连接,私人账号不自动带上。

2. Gemini 4 Argon · 官网

标语:Google’s frontier model for careful reasoning & complex work

背景
Gemini 4 Argon 日榜第 2,发布页标为 Free Options。Google 博客由 Google DeepMind 高级副总裁、Google 首席 AI 架构师 Koray Kavukcuoglu 署名,文章日期为 2026-09-30。文中把它定位为面向长程专业工作的前沿模型,覆盖软件工程、法律与金融一类企业知识工作,以及防御性网络安全。输出上限写为 100 万 token,高于此前的 6.4 万。发布采取分阶段:先给 Fairwind Program 里受信任的网络防御方,并参与美国政府自愿的预发布访问流程,再逐步扩到开发者、企业和消费者,起步是付费 API 客户和 Google AI Ultra 订阅用户。入门价写为每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入按输入价的 95% 折扣;入门期结束后为每百万输入 4 美元、每百万输出 20 美元。博客里的内部例子和基准分数都是 Google 自述,不是独立审计。讨论里有人要长任务的进度视图,也有人质疑现有模型的上下文是否稳定,并出现要求退款的差评。抓取时约 235 票、约 8 评。

产品要解决的问题
多步的工程、研究和文书工作经常在一次回答的长度用完之后断掉。模型要么重新开始,要么在后半段丢掉前面定过的约束。

产品市场分析
目标是要做长程编码、研究和专业文书的开发者与企业,以及获准提前试用防御能力的安全团队。替代方案是同一时期其他实验室的前沿模型,以及仍停在较短输出上的 Gemini 前代。变现信号是博客上的按 token 标价,以及先向付费 API 和 AI Ultra 开放的说法。Product Hunt 上的 Free Options 与博客里的付费起步并不互相解释,本次没有从 Google 的订阅页再核对免费额度。

产品上下游
上游是用户的长任务、代码库和文档,以及 Google 所说的内部评测与分阶段安全措施。下游是付费 API、AI Ultra,以及目前仅对受信任防御方开放的能力。广泛可用的时间博客写为尽快,没有给出日期。

3. Smooth Recorder · 官网

标语:Mac screen recordings that look edited when you hit stop

背景
Smooth Recorder 由 Anas(讨论账号 mdanassaif)发布,日榜第 3,发布页标为需要付费,产品页有 3 条评价、5.0 分。这是原生 Mac 应用,官网写用 SwiftUI 和 AppKit,系统要求 macOS 15 及以上,不是浏览器套壳。录制时跟随点击自动放大,平滑光标,可加摄像头和麦克风;字幕在本机生成,删掉文稿里的词就会从视频里剪掉。v1.1 增加缩放时的轻微 3D 倾斜,以及菜单栏和程序坞入口。截图走同一套壁纸、阴影和标注,官网写有 76 套壁纸。Smart Redact 在本机标出邮箱、卡号、API 密钥和人脸。导出写有 MP4、给 Keynote 和 Final Cut 的 MOV,以及 GIF。Anas 在讨论里确认:录音时选择麦克风即可加旁白;字幕第一次使用会在 macOS 26 上下载苹果语音模型,之后离线,语言跟系统区域走;Windows 在路线图上,当前只做 Mac。抓取时约 205 票、约 18 评。

产品要解决的问题
产品演示录下来很快,后面要花时间把点击放大、把晃动的光标修平、补字幕,再放到一块不那么像原始屏幕的背景上。

产品市场分析
目标是在 Mac 上做演示、教程和产品图的人。官网对照表把 Screen Studio、CleanShot X 和 Loom 列在旁边,并注明竞品信息按其官网于 2026 年 9 月核对,Smooth Recorder 一行来自应用本身。变现是买断:早期 9 美元一次,官网 FAQ 写正式价为 69 美元一次,无订阅、无账号。Windows 尚未发售。

产品上下游
上游是屏幕、麦克风、系统音频,以及本机的语音和文字识别。下游是 MP4、MOV、GIF 和已打码的截图。字幕、OCR 和打码官网写明不上传。

4. Blume 2.0 · 官网

标语:The open-source docs framework for humans and agents

背景
Blume 2.0 是 Blume 的第 2 次发布,日榜第 4。发布页写明免费且开源、长期如此。它是基于 Astro 和 Vite 的文档框架:把 Markdown 或 MDX 放进目录,用 npx blume init 生成站点,自带搜索、主题和 SEO。官网还写有 OpenAPI、AsyncAPI、GraphQL 参考页,以及默认生成的 llms.txt(给助手看的文档索引)和页面的 Markdown 镜像;MCP 服务器和 Agent 技能是可选项。迁移命令可以把 Mintlify、Fumadocs、Docusaurus、Starlight 或 Nextra 交给 Codex 或 Claude Code。讨论里有人确认页面可以嵌入自己的 Astro、React 或 Vue 组件。猎人 fmerian 在帖里向 haydenbleasel 致意,并称 Neon 等产品在用、Cloudflare 与 CodeRabbit 提供支持;这是帖文说法,不是本次从这三家站点复核过的客户名单。产品页有 1 条评价、4.0 分,评价者希望先预览将要暴露给爬虫的 llms.txt。抓取时约 164 票、约 5 评。

产品要解决的问题
文档站要自己维持一套应用脚手架。页面一多,构建变慢,主题一改就要跟框架的内部结构打架;助手来读文档时,站点又没有准备好机器可读的出口。

产品市场分析
目标是想用 Markdown 发产品文档、API 参考、更新日志或博客、又不想养一套文档应用的团队。替代方案是 Docusaurus、Mintlify、Starlight、Nextra 和 Fumadocs,官网把从这些站迁出写成一条命令。变现信号是发布页的永久免费和开源;托管或商业支持的价目本次没有从官网核对到。

产品上下游
上游是本地 Markdown、MDX,以及可选的 OpenAPI 等规范和 Notion、Contentful、Sanity、GitHub Releases 一类内容源。下游是静态或带主机适配器的站点、搜索、给 Agent 的 llms.txt 和可选 MCP。评价里提到的「发布前预览 AI 摘要」本次没有在功能列表里单独看到。

5. ChatGPT Space · 官网

标语:Create, collaborate, and build together with AI in Space

背景
ChatGPT Space 日榜第 5,发布页标为 Free Options,归在 OpenAI 的 ChatGPT 下。Product Hunt 把它写成一块共享画布:放入链接、文件和想法,再让 ChatGPT 做成计划、文档和应用。功能页本次直接抓取没有返回正文,下面的范围来自该页公开摘录,并与 Product Hunt 条目对照。摘录写明:Space 取代 Pro、Business 和 Enterprise 上的 Library,可在网页、桌面和手机上找到;网页和桌面可以创建、编辑并协作页面,手机目前可以查找、阅读和分享,编辑尚未支持。页面里可以放文字、图像、图表和交互工具,同事可实时编辑、留言,并 @ ChatGPT、Codex 或自己的 dot。协作幻灯片和电子表格写为即将推出。Meetings 插件在摘录里标为 macOS 桌面端、Pro 与 Business 的 beta,用来生成私人会议笔记。工作区是否可分享取决于管理员设置。讨论里有人希望版本历史能分出哪些修改来自人、哪些来自 AI;抓取到的帖文里未见团队回复。抓取时约 143 票、约 3 评。

产品要解决的问题
在 ChatGPT 里做出的草稿,往往要再贴到另一份文档里才能交给同事。上下文、评论和下一轮修改因此拆成两处。

产品市场分析
目标是已经在用 ChatGPT Pro、Business 或 Enterprise、又要和同事改同一份材料的人。替代方案是原来的 Library、独立的云文档,以及只存在于单次对话里的 Canvas 一类界面。变现信号是限定在这三档方案;本次没有从功能页核对到单独的 Space 加价。

产品上下游
上游是对话、上传的文件,以及摘录里提到的会议插件笔记。下游是可分享的页面,以及即将推出的幻灯片和表格。手机端的创建和编辑摘录写明尚未开放。

6. opensend.cc · 官网

标语:The open source email platform that runs on your server

背景
opensend.cc 由 Kamal Panara 发布,日榜第 6,发布页标为免费。他在官网介绍自己运营 Panara Studios。产品是自托管的邮件平台:装在自己的服务器上,经自己的 AWS 账号发信,域名、数据和发信声誉留在自己这边。AWS SES(Simple Email Service)是亚马逊的邮件发送服务。官网写协议为 Apache-2.0,技术栈是 Next.js、自托管的 Convex 和 Better Auth;提供 REST API、SDK、SMTP、模板、群发、自动化、受众、webhook 和日志。一条命令用 Docker Compose 装好。已经在用 Resend 的代码,发布说明写改两行即可把 SDK 指到自己的地址。Cloud 方案写着由对方托管,状态为候补、即将开放。讨论里有读者引用发布说明中的「每 1,000 封约 0.10 美元」,Kamal 回复自托管不再向 opensend 付费,费用是自己的服务器和 AWS。抓取时约 143 票、约 9 评。

产品要解决的问题
产品几乎都要发信,但发信域名和声誉握在按封计费的托管 API 里。对方一旦出问题,发送方改不了底层。

产品市场分析
目标是想自己掌握事务邮件、又不想按封给平台付费的开发者和小团队。直接替代的是 Resend 一类托管 API;往下是直接调 SES 或 SMTP,但没有模板、受众和日志界面。变现信号是自托管标价 0 美元,Cloud 仍在候补。每千封 0.10 美元是讨论里对发布说明的转述,本次没有从 AWS 价目表再核对。

产品上下游
上游是应用通过 API 或 SMTP 提交的邮件,以及域名的 DKIM、SPF、DMARC 记录(用来证明发信方并提高进箱率)。下游是 SES 或其他 SMTP 中继、仪表盘里的日志和抑制名单。声誉仍然取决于域名和发送内容,软件本身不保证进箱。

7. DocsAlot MCP Connector · 官网

标语:Maintain your help-center by asking Claude, Cursor or Codex

背景
这是 DocsAlot 的第 4 次发布,日榜第 7,发布页标为需要付费。创始人在讨论里是 Faizan Khan。DocsAlot 托管帮助中心、知识库和开发者文档,并提供 llms.txt、skill.md 和托管 MCP。本次发布让 Claude、Codex、Cursor 或其他 MCP 客户端直接改这些文档:找到相关页面、做出修改、生成新版本并发布。Faizan 回复:MCP 改的是托管在 DocsAlot 上的帮助中心,不能改产品仓库里的源码,仓库最多只读;Zendesk 和 Intercom 可以直接连接,用来听工单并发布回去;版本是只追加的,可以回到旧版;读者在普通搜索和 AI 入口提出的问题都会记下来。早前评价担心人工大改不会反馈给 Agent,他在这次发布下回复,现在可以追问某一版为什么这样改,交互历史会留下。定价页:Startup 每月 39 美元,Team 每月 99 美元,Enterprise 另询;没有免费档。Product Hunt 发布用户可用码 PH50,前三个月五折。抓取时约 141 票、约 31 评。

产品要解决的问题
帮助中心、README 和支持工单各写各的,产品一改文档就过期。编程 Agent 如果读到旧页面,回答也会跟着旧。

产品市场分析
目标是没有专职文档团队的创始团队、支持负责人和要同时维护帮助中心与 API 文档的工程师。定价页把 Mintlify、Docusaurus 和自建文档栈写成对照:对方更适合想把站点完全放在自己代码里的团队。Team 含自定义域名、私有文档,以及每月 250 条 AI 消息;Enterprise 才写 SSO、SCIM 和自动漂移检查。讨论里 Faizan 说接上主站和 GitHub 后会抓住漂移,且不按次另收费;这和定价页把自动漂移检查放在 Enterprise 的写法并存,本次没有再向团队核实档位。变现是月费加可选的迁移和 AI 可见度服务包。

产品上下游
上游是现有帮助中心、Zendesk、Intercom、Notion、Markdown,以及只读的网站和 GitHub。下游是托管文档站、llms.txt、托管 MCP,以及要人确认后才成为线上版本的修改。有人问 MCP 密钥能否只写草稿、由人点发布;抓取到的回复里没有直接回答这一点。

8. Octri.dev · 官网

标语:Generate customizable Docs, SDKs, MCP server, and monitoring

背景
Octri.dev 日榜第 8,发布页标为 Free Options。讨论里以创始人身份回复的是 Emad Khair。上传 OpenAPI(描述 HTTP API 的规范)、Swagger、Postman 或 AsyncAPI 后,生成文档站、十种语言的客户端 SDK,以及让 Agent 调用该 API 的 MCP 服务器。十种语言是 TypeScript、Python、Go、Rust、Ruby、PHP、Java、Kotlin、Swift 和 Dart。新的一块是 SDK 把生产环境错误报回来,并关联到提交。GitHub 同步会在规格变更后重新生成,但官网 FAQ 写明不会在背后直接发布:先出草稿和差异,批准之后新版本才进注册表。监控默认关闭;请求体默认不收集,敏感字段在客户端打码一次、入库前再打一次。另有免注册的 OpenAPI 打分器。抓取时约 110 票、约 27 评。

产品要解决的问题
文档、各语言 SDK 和给 Agent 的工具列表常常从同一份规格抄出三份,规格一改就有一份过期。SDK 装到用户机器上之后,集成失败要等工单才知道。

产品市场分析
目标是已经有 OpenAPI、要同时发文档和客户端的 API 团队,包括独立开发者和开源项目。Emad 在讨论里感谢有人提到免费档和开源计划。官网标价(美元,月付):Free 为 0,1 种 SDK 语言、50 个端点、100 MB 监控流量;Starter 49,2 种语言;Growth 99,4 种语言并含版本管理;Business 249,十种语言全包;Enterprise 另询,可自托管生成器和文档渲染。额外语言在 Starter 和 Growth 为每种每月 50 美元。年付写为省 15%。替代方案是只生成 SDK 的工具,或只做文档站的框架。

产品上下游
上游是 API 规格和 GitHub 仓库。下游是文档站、各语言注册表里的 SDK、npx @octri/mcp 拉起的工具列表,以及按 SDK 版本聚合的错误。规格里排除的端点也会从 Agent 的工具列表里拿掉。自托管写在 Enterprise。

9. Pass Designer · 官网

标语:Design Apple Wallet passes and see the real card

背景
Pass Designer 是 Apple 在 Product Hunt 上的一次发布,日榜第 9,发布页标为免费。日榜页把外链放在 apple.com,产品说明实际在 Apple Developer 的 Pass Designer 页。它是设计 Apple Wallet 通行证的 Mac 应用:从苹果或自己的模板开始,放入标志、背景和条带图,编辑颜色和标准字段,预览用与 iOS、watchOS 相同的渲染,分别显示 iPhone 和 Apple Watch 上的样子。校验会标出缺少的必填项。登机牌和活动票可以编辑语义标签(给系统用的结构化字段,例如日期、场地、航班),并排看带语义和不带语义的版本,还能从语义数据生成向后兼容的结构。下载页写明 beta 需要 macOS 27 或更高,登录 Apple 账户,必要时完成免费的开发者注册并接受协议。猎人 Zac Zuo 在帖里说明:导出的是 .pkpasstemplate,真正的构建、签名和分发还在下一步。抓取时约 105 票、约 4 评。

产品要解决的问题
会员卡、门票和登机牌最后往往只是给用户看一个条码。做成 Wallet 通行证要手写 pass 文件,预览又不一定等于手机上的那一张。

产品市场分析
目标是要发会员卡、场地票、登机牌或连锁门店通行证的商家和开发者。替代方案是继续手写 pass 包,或使用第三方通行证设计工具。变现信号是开发者页面的免费 beta;签名和大规模分发是否另有服务,本次没有从该页核对到。系统要求停在 macOS 27,更早的系统装不上。

产品上下游
上游是设计工具导出的图片、通行证类型和语义字段。下游是 .pkpasstemplate,以及仍要单独完成的签名和安装到 Wallet。语义标签再往下接到 Siri 建议、日历和地图,这是开发者页对系统行为的描述。

10. WikiFix for Confluence · 官网

标语:Find and fix issues in your knowledge base

背景
WikiFix for Confluence 由 Rezgar Cadro 发布,日榜第 10,发布页标为 Free Options。它是装在 Confluence(Atlassian 的团队知识库)里的应用,扫描矛盾页面、重复内容和没人认领的页面;用户选定哪一种说法是对的之后,它再改页面。内容修改可以一键撤回。更换已离职所有者这一步不能撤回,卡片会事先说明。Rezgar 在发布说明里写:人工抽查时大约五分之一的发现是错的,具体比例看知识库;默认只展示较有把握的条目,也可以展开更不可靠的。扫描可以手动或按周、按月。它不判断谁对,而是把互相矛盾的原文做成选择题,不知道答案时可以交给页面或空间所有者。普通读者也会看到「发现了若干问题」的标记。官网写第一版只做 Confluence,v2 再考虑独立产品。抓取时约 86 票、约 10 评。

产品要解决的问题
知识库大到没人能逐页读。互相矛盾的制度和过期的操作手册会留在里面,助手再从同一批页面作答,错误会被重复说出去。

产品市场分析
目标是已经把制度、入职和运维手册放在 Confluence、又开始让 Rovo 或其他助手阅读这些页面的团队。Rovo 是 Atlassian 的助手;Rezgar 对比说,它从用户的问题出发去取少数页面,而找矛盾是从没有问题开始、把同一主题下的说法并排。计费走 Atlassian Marketplace 的按用户价,再换成只花在新页面或改过的页面上的扫描额度。官网写平均每篇新页面或变更页面约 0.10 到 0.20 美元。Standard 标为每用户每月 1.68 到 0.29 美元,Advanced 为 6.70 到 1.15 美元,后者可用自己的 Anthropic 密钥;每次安装送 50 美元额度。区间的两端对应哪种团队规模,本次没有从价目页再拆开。

产品上下游
上游是选定的 Confluence 空间。官网「今天能发现」还列出与代码不一致的页面;讨论里有人把对照代码当作下一步,Rezgar 表示这也是他们关心的方向。下游是待批准的修改、一键撤回,以及 @ 给所有者的评论。助手是否因此少答错,取决于人是否真的选了正确的那一条。

今日 Hacker News 热榜前五横跨云账单、浏览器小游戏、旧显卡驱动、文化机构信息公开和职业选择。Simon Willison 主张按量计费服务默认加上硬预算上限,因为编程 agent 让「睡着之后继续烧钱」变得更容易。靠前的还有用黑洞做引力弹弓的网页游戏 Hole Punch,以及 Valve 的 Timur Kristóf 在 XDC 2026 上讲自己如何把约十年前的 AMD GPU 迁到现代 Linux 驱动。后两条是罗丹美术馆三维扫描信息公开案的作者复盘,以及一篇把「为什么迟迟不去考 EMT」按荒唐程度排开的个人文章。以下按 Firebase topstories 当前顺序整理,分数与评论数为抓取时快照。

1. We’re going to need default hard budget caps on pretty much everything

背景介绍
Simon Willison 于 2026 年 10 月 3 日发表 We’re going to need default hard budget caps on pretty much everything。他要的产品功能是:按量计费的服务和 API 允许用户设定「这个月超过 X 美元就切断并返回错误」。他强调必须是硬上限。软上限——超了只在半夜发一封警告邮件——不够,因为人睡着时,失控的服务还可能再吃掉几百甚至几千美元。

文章把动机接到编程 agent,以及包了一层不那么吓人界面的个人 agent:它们降低了写出能做事的代码的摩擦,而这些事有时会花钱,包括付费 API、托管网站,以及会为额外存储和计算计费的系统。反对意见是,企业不希望应用因为预算用完就开始报错。Willison 的判断是,多数企业和个人宁可看到错误,也不愿收到一张意外的 1 万美元以上账单。因此硬上限应该是默认值;想冒险的人可以显式勾选,表示去掉上限后应用不会被关停,后续费用由自己承担。

他最希望看到这一点的是 AWS。文中写,有人因为担心失控服务会把自己搞破产而拒绝用 AWS 做个人项目,也有人没预料到这一点而吃了亏。接着他引用 AWS 2026 年 9 月 16 日的公告 New AWS experience helps builders get started and ship faster:升级到付费计划时,可以按用量模式为项目设置月度花费上限,达到上限后该项目在当月暂停。文档 Create a spend limit in AWS Settings 同时写着,这一新体验目前只向有限客户开放。Willison 希望它尽快对现有账户普遍可用。Google Cloud 则在 7 月推出名为 Spend Caps 的类似功能,可在项目内对特定服务设置月度财务上限。文章最后希望 agent 在推荐供应商时偏向有硬上限的服务,并警告缺少经验的人不要把应用部署到没有封顶的服务上。

主要讨论方向与观点
有人要的不只是封顶,而是月度花费走势:年合同写的是全年 X 美元,也可能半年就花完;客户成功经理的含糊提醒不够,代币和积分把钱抽象掉之后,更需要换算回金额。另一条意见更硬:没有谈好的合同,就不该存在「计算机自己控制账单、还可能失控」的计费;宁可每月固定 20 美元,用完就停,或自己再加 20 美元。有人注意到 Google Cloud 终于给单项服务加了硬花费上限,并觉得等了太多年;回复说这像是等竞争对手先做。也有人把话题扩到 AI 以外:自动扩容省下的钱,可能被不可预测的价格吃掉。

有人猜大公司现在加封顶,是因为客户已经用虚拟卡自己封住了账单。也有人觉得很多服务忽然一起加这个功能,想知道变了什么。有人说没有硬上限应该违法;回复把责任收窄为:客户只应对自己设下的硬上限以内的费用负责,服务商如果没有执行机制,就不该开出无上限账单。另一条回复则反对「应该立法」这种句式本身。还有一条与账单无关的短评,把编程 agent 的普及说成编程这一行要结束了。

专有名词解释

  • 硬预算上限 / hard budget cap:花费到达设定金额后,服务停止并返回错误,而不是只发提醒、继续计费。Willison 希望这是默认行为,取消上限要用户显式选择。
  • Spend Caps:文章对 Google Cloud 2026 年 7 月功能的称呼,指在一个项目里给特定服务设月度金额上限。
  • 编程 agent:能自己写代码、调用工具并持续运行的程序。文章认为它们让「无人看着也会产生账单」变得更常见。
  • 虚拟卡:讨论里提到的自救办法。发卡方可以给一张卡设消费上限,用来挡住没有硬上限的云账单。

HN 讨论:thread · 78 分 · 30 评

2. Hole Punch: Sling your spaceship around gravitational fields

背景介绍
Hole Punch 是一款浏览器里的益智游戏。页面的 meta 描述是:在太空里打出黑洞,让飞船绕着它们弹回家。本次抓到的 HTML 几乎全是操作界面,没有单独的说明文章:画布是场地,顶栏有 Sector、Matter 和 Holes,底栏有 Launch、Undo、Reset,以及「Hole Punch / Unit 0426 · Mk II」。手机竖屏时会要求把设备转成横屏,提示这台控制台只在 landscape 下工作。关卡列表里有一颗写着 “I give up” 的按钮。

页面加载的 physics.js 在注释里把规则和画面分开:同一套代码既在屏幕上飞飞船,也在测试里证明关卡可解。模拟用固定步长推进,所以同一组黑洞会走出同一条轨迹。飞船若进入与质量对应的半径就会被毁掉;部分天体会绕圈或沿直线来回。最小黑洞质量在代码里是 8,按住鼠标会按时间消耗 matter 把洞变大。这些是脚本注释和常量,不是一篇对外的设计文档。HN 提交者是 trwhite;页面本身没有写作者真名。

主要讨论方向与观点
有人说这和自己刚用 vibe coding 做的 gravity-assist 奇怪地像;回复把相似归到不太在意画面。玩法反馈很具体:手机上拖拽不够准;拖动黑洞时尺寸控件应该先消失;误触会不断新建黑洞,希望改成按钮或长按才新建。前几关里,有人用一颗最小(质量 8)的黑洞就过了,并喜欢第 6 关这种简单解法。桌面端被说成另一回事,有人把它比作 Seedship:规则简单,但很想再来一局。

一开始有人抱怨只能加质量、加过了不能减也不能删,只能 Undo。回复指出要点一下黑洞,会出现加质量、减质量和删除三个按钮;黑洞也可以拖走。另有人希望能把模拟加速到 1.5 倍、2 倍。概念上,有人把它叫太空高尔夫,或像台球;也有人提议改成回合制的《Scorched Earth》,用小行星对射,或延迟放置黑洞,并考虑光速。回复提到 Steam 上已有的 Interplanetary。有人拒绝为了看视频或玩游戏把手机转成横屏。另有人说电脑给出的解法比自己更刁。

专有名词解释

  • 引力弹弓 / gravity assist:借天体引力改变飞船速度和方向。这款游戏把可放置的黑洞当成玩家布置的弹弓。
  • Matter:界面上的物质预算。按住鼠标长大黑洞时会消耗它;代码里最小质量是 8,和评论里「最小尺寸 8」一致。
  • Sector:界面上的关卡。过关后可以进入下一 sector,也可以打开索引重选。
  • 视界半径:physics.js 里按黑洞质量算出的销毁半径。飞船进去就毁,不是页面上单独解释过的名词。

HN 讨论:thread · 222 分 · 57 评

3. The work by Valve’s Timur Kristóf on improving old AMD GPUs on Linux

背景介绍
Phoronix 的 Michael Larabel 发了 The Amazing Work By Valve’s Timur Kristóf On Improving Old AMD GPUs On Linux。文章说,过去一年里,Valve Linux 图形驱动团队的 Timur Kristóf 多次改进 AMDGPU 内核驱动,让大约十年前的 GCN 1.0/1.1 显卡更能承担 Linux 游戏和其他任务。本周他在多伦多的 XDC 2026 上讲了这项工作。文章写,他最初是把内核驱动开发当成练习:之前多年都在用户空间,做 Mesa 3D 驱动。

Larabel 称,对还在用老 GCN 1.0/1.1 独显和 APU 的人来说,Kristóf 的关键工作是把它们从旧的 Radeon 驱动迁到现代 AMDGPU。迁过去之后才能用 RADV Vulkan 驱动,并得到比旧驱动更好的性能和功能。过程中要修这些老卡在 AMDGPU 显示代码里的缺陷,以及各种电源管理问题;之后还有软重置和其他增强,好让这些卡在 2026 年及以后仍然能用来玩 Linux 游戏。文中用去年的评测 Linux 6.19’s Significant ~30% Performance Boost For Old AMD Radeon GPUs 说明迁移的影响,并写 AMD 多年来没在这些老卡的驱动改进上投入多少资源,是 Valve 这边把工作接上的。演讲和 PDF 幻灯片 也讲他如何进入 AMDGPU 内核开发。约 30% 是 Phoronix 那篇评测标题里的说法,不是这篇文章新测的数字。

主要讨论方向与观点
有人刚买了二手 Ayaneo 2 掌机,里面是较老的移动版 RDNA 2,觉得 Linux 下除近期 3A 以外几乎都比 Windows 更顺,因此考虑把装有 9070 XT 的主机也换到 Linux,并把功劳算到 Valve 和 Steam Deck 上。回复把范围拆开:Steam Deck 确实是 RDNA 2,但这篇文章写的是 GCN 1.0,例如 2012 年的 Radeon HD 7800/7900。另一条经验是,Linux 上更省事的往往是更老的中端硬件,因为问题和优化已经进了发行版,不用等内核更新。

有人说希望这些事是 AMD 自己做;回复问他们有没有财务动机。也有人希望同样的工作能让电子垃圾显卡跑大模型推理。回复认为这些老卡大多没有 FP8 或其他低精度所需的硬件,显存也不够跑更高精度;另一人用 2021 年的 Radeon RX 6900 XT(16 GB)举例,轻量本地模型能跑,但质量仍明显不如 OpenCode Zen 或 OpenRouter 免费档里能用的模型,而这篇文章讨论的 GPU 还要再老大约两代。评论认为,要让小模型在更老的卡上变得可用,更像是需要架构上的变化,而不是驱动上的增量改进。另有人直接贴了演讲时间戳:YouTube。

专有名词解释

  • GCN 1.0/1.1:AMD 的 Graphics Core Next 早期架构。文章用它指约十年前的老卡;评论里举的 HD 7800/7900 是 2012 年的具体例子,和 Steam Deck 的 RDNA 2 不是同一代。
  • AMDGPU / Radeon 驱动:AMDGPU 是现行开源内核驱动。文章说这些老卡原先走旧的 Radeon 驱动,迁到 AMDGPU 后才能用上 RADV。
  • RADV:Mesa 里的开源 Vulkan 驱动。文章把它写成迁移之后解锁的能力。
  • XDC:X.Org Developers Conference。文中 Kristóf 本周在多伦多场次讲了这项内核工作。

HN 讨论:thread · 104 分 · 12 评

4. Treachery in the Rodin Museum 3D scan verdict

背景介绍
Cosmo Wenman 于 2026 年 9 月 28 日发表 Treachery in the Rodin Museum 3D Scan Verdict,副题是 “Sometimes the law is not the law”。这是他作为当事人写的八年信息公开诉讼复盘,不是法院自己的新闻稿。他从 2017 年开始向罗丹美术馆写信,要求指认并公开奥古斯特·罗丹雕塑的三维扫描;文中称这些作品是世界上被复制最多的公有领域文化遗产之一。巴黎公民权利倡导者 Alexis Fitzjean Ó Cobhthaigh 正式提出申请后,馆方私下向法国政府的行政文件查阅委员会(CADA)要法律意见。Wenman 写,CADA 认为这些扫描无疑是行政文件、必须向公众提供;馆长没有反驳该分析,但在写给文化部的信里说自己打算无视信息公开法,让他去法院。

2019 年,他们在巴黎行政法庭起诉。Communia、Wikimédia France 和 La Quadrature du Net 作为共同原告加入。Wenman 称,诉讼中馆方暗示他可能是伪造者,同时声称自己即使有外部专家也用不了这些扫描文件,并对扫过哪些雕塑、以及用公共资金做扫描的申请书是否存在,作出不实陈述。他特别写到激光扫描的点云是开放的纯文本格式,馆方却对法院说它们技术上无法理解、质量太差、不完整,连可视化都几乎不可能。文中还说,馆方在一份书面意见里确认持有《三个影子》(Les Trois Ombres)的扫描,下一份又否认该雕塑被扫过;原告则提交了分包商正在扫描的照片。

巴黎法院驳回了馆方关于商业秘密、伪造、商业模式与收入、以及知识产权的论点。2023 年 12 月,法院认定多种格式的三维扫描是行政文件,必须公开,并命令馆方和文化部把扫描交给他、赔偿 1500 欧元。Wenman 写,馆方和文化部没有上诉,而是直接不执行。同时,法官在没有他能看出的法律依据的情况下,新造了一个例外:开放纯文本格式的点云可以不公开。他们就此向最高行政法院国务委员会(Conseil d’État)上诉。文中称,听证前法院自行提出馆方没有提过的论点:点云甚至不是行政文件。2025 年 12 月初的听证上,rapporteure publique 引用马格利特的《图像的背叛》(这不是一只烟斗),说「有时一份文件并不是一份文件」。

书面判决比这位报告人的建议走得更远:这些文化遗产的三维扫描在法律上与实体复制品无法区分,不是行政文件,而是馆藏中不可让与的部分,因此法国信息公开法不适用。Wenman 写,这意味着 CADA 和巴黎法院先前对他有利的分析都被视为错误,其他格式上的胜诉实际上也被推翻;既然信息公开法不适用,法官认为不必再考虑案件事实。上诉被驳回,他被命令向罗丹美术馆支付 3000 欧元,而且法院甚至没有把判决书面通知他。文章预告 2026 年 10 月 13 日的 COMMUNIA Salon 会讨论:公有领域作品的三维扫描是否应可自由再利用,包括商业利用。

主要讨论方向与观点
Simon Willison 问的是馆方为什么如此在意、为什么投入这么大的法律努力阻止点云公开。回复里有几种猜测,都标明是推测:点云可以做出极高保真复制品,威胁官方复制品和周边的垄断,馆方反复把作者说成伪造者也说明他们在意复制;或者馆方其实没下很大功夫,只是一开始做了懒决定,知道不必认真论证也能过关;或者这是为了避免开创「政府必须公开所持原始数据」的先例。也有人把动机说成艺术和学术圈里常见的把关,觉得更易获得会稀释价值。另有做 FOIA 的人说,公共机构内部邮件里「打算无视申请、让对方去起诉」并不少见,并觉得值得专门研究为什么公职人员会这样对待并不属于他们个人的数据。

另一条线是只听到了一方。有人说,从表面看这是体制内互相照应,把可能有价值的数据留在手里;但博物馆没有在这篇文章里公平表达自己的立场,法庭程序在不完整的转述里会显得荒诞。回复指出,馆长那封信已经链在文章里,而提到的法庭卷宗并不公开,所以如果馆方有不同于那封信的论点,他们也没有在公开场合提出。还有人担心,一旦高质量扫描必须公开,靠复制品收入的博物馆会干脆不做扫描、甚至以归档成本为由销毁已有数据,长期反而让文物更难留下数字副本;私人收藏则没有这种压力。也有人问罗丹的雕塑是不是早已在世界各地的博物馆里有复制品,这场仗是不是已经输了。有人甚至在考虑把自己拍的馆内 360 度素材做成雕塑的高斯泼溅并公开,会不会遭到跨境下架。

专有名词解释

  • CADA:法国行政文件查阅委员会。文章称它认定这些扫描是行政文件、应当公开。
  • 点云:三维扫描产生的大量空间点。文章强调馆方的文件是开放纯文本格式;国务委员会后来的判决把扫描整体说成与实体复制品不可区分,从而不适用信息公开法。
  • Conseil d’État:法国最高行政法院。本文的终局是在这里:上诉被驳回,扫描不被当作可用信息公开法取得的行政文件。
  • rapporteure publique:最高行政法院里向法官说明法律分析的报告人。文章写她在听证中引用了马格利特。
  • FOIA / 信息公开:评论里用美国的 FOIA 类比法国这套行政文件公开制度。两者不是同一部法律。

HN 讨论:thread · 67 分 · 31 评

5. Reasons I didn’t become an EMT, ranked

背景介绍
Ben Stolovitz 在 21 reasons I didn’t become an EMT, ranked 里写,自己的主业是软件工程,但一直对医学有兴趣;大学时一个朋友提起 EMT,这个念头转了多年。他拖到 2024 年才请了一个月假、拿到 EMT 证书。HN 标题没有写「21」,页面标题写了。提交者 citelao 在线程里以作者身份补充:他想做 EMT 很久,这些是真实用过的借口;最坏的情况是你也许会喜欢它。

文章把拖延理由按「有多荒唐」大致排序,每条先承认顾虑,再写自己后来怎么看。时间成本是真的:他上的是 NOLS 的 Wilderness EMT,连续 28 天;能去是因为当时所在的微软改成了不限带薪假、老板支持,而且他付得起飞去怀俄明的费用。文中写,普通替代方案是一学期的夜校。课程本身大约 5000 美元,还不包括机票、租车和请一个月的假;更常见的课程大约 2000 美元,也不需要 28 天假期。文化顾虑也写得很直接:他大学毕业几年后和一些急救人员有过很差的经历,一度放弃;EMS 里有很多耗竭的人,他见过的一些机构非常「兄弟会」,对女性更不友好。

他也担心融不进这群人和同学,担心证书会因为达不到 NREMT 的继续教育而过期,担心志愿岗位难找——大城市多为全职付费编制,西雅图和旧金山附近更难,但纽约对岸的 Hoboken 就有志愿 EMS。范围上,他写 EMT 用的自动体外除颤器(AED)和普通人能用的是同一类,不能用手动除颤器,但训练次数多得多,并且可以使用氧气;严重呼叫通常需要 paramedic。他明确不想把坐救护车当成天职,也曾经想改做搜救,后来觉得没有车上的经验就做不好 EMT。文中把「我可能会喜欢这份工作,喜欢到辞掉技术工作、再读两年去当全职 paramedic」当成自己最喜欢的一条借口。排在最后、也被他说成最傻也最真的理由是:做事医学、学新东西、在别人人生中最糟的一天保持冷静,以及走进一群更年轻、人生路径完全不同的同学,都让人害怕。他现在仍做软件,EMS 是志愿性质;文末感谢 NOLS 和 NHVA。

主要讨论方向与观点
有人 38 岁、刚在社区大学开始兼职课程,最担心的是全职写软件的同时,兼职志愿能不能把技术保持熟练。作者的职业路径也引出了反向故事:一位 1998 年航空航天学士后来去上 EMT 夜校,本来是为了潜水船的 dive master,接着读 paramedic,35 岁、孩子 9 个月时被县消防局录用并送去消防学校;他称这是最好的职业决定,但也看到很多人因工受伤,于是 2010 到 2015 年读了计算机硕士,疫情中因健康原因离开现场,50 岁后转去做开发,2022 年进入现在的机构,今年 5 月从 Java 转到云工程师。他仍建议别人去试试,同时说这是年轻人的工作。

另一类评论集中在心理负荷。有人的朋友做到 paramedic 后忽然辞职、不再续证,也不愿再谈。回复把这看成急救和创伤岗位的常见风险,并讲了一位新生儿重症监护室护士考虑转行、后来调去器官移植病房的例子。还有人描述一位经验极丰富的 medic,在一次「孩子骑自行车擦破膝盖」的小呼叫之后坐在街边崩溃,那是他的临界点。一位从 IT 转到大城市 911 的 EMT 列出了自己看到的两边:能直接看见工作对人有帮助、每个现场都不一样;另一面是气味、药品和操作权限很少、不能插管、不能判读心电图,以及相对原来的程序员薪水是很大的降薪。paramedic 在他那里至少还要 14 个月。有人因此建议看远程、野外、探险和海上的岗位,并链接了马耳他 College of Remote and Offshore Medicine 的 AREMT(75 小时在线加 6 天面授)及其远程 paramedic 实践理学学位的第一模块。也有人走了相反的路:私人救护车 EMT 五年,paramedic 学校读到一半退学,后来做了软件工程师。

专有名词解释

  • EMT:Emergency Medical Technician,紧急医疗技术员。文章把它放在现场医疗人员里训练较少的一层:按固定流程处理,更重的情况交给 paramedic 和医院。
  • Paramedic:比 EMT 再长一段的培训和更高的现场权限。文章和评论都把它写成更贵、更长,也更接近作者担心自己会「喜欢到辞职」的那条路。
  • NREMT:美国国家 EMT 注册体系。文章称,如果不在救护车上积累实践,很难满足它的继续教育,证书会过期。
  • NOLS WEMT:美国户外领导学校的野外 EMT 课程。作者上的是连续 28 天、在怀俄明的这一版,而不是学期制夜校。
  • AED:自动体外除颤器。文章写 EMT 训练用的是普通人也能用的那一类,不能使用手动除颤器。

HN 讨论:thread · 80 分 · 32 评

今日 Product Hunt 热榜对应太平洋时间 2026-10-03 日榜(上海时间 10 月 4 日上午抓取,太平洋时间当日尚未收盘)。前半段是把专家经验交出去、在短信里订行程,以及让品牌在 AI 回答里被点名;后半段落到硬件和桌面:Kindle 换了无边框屏幕,Meta 把个人 Agent 接到可自制的设备上,编程 Agent 则多了办公室、记忆审核和刘海提醒。按各产品页的 Day Rank,前五是 ZooWork、miso.com、Prefer、Muse Gadgets 与 Kindle 2026,后五是 Cubicle、SCMD、FeelMyMac、FoundrRadio 与 Notchware。票数与评论数取自当日首页与日榜页抓取快照,收盘前仍可能变化。

1. ZooWork · 官网

标语:The AI agent delivery platform for FDEs and domain experts

背景
ZooWork 由 David Lu 在讨论里回复,产品页标为 2026 年发布,日榜第 1。定位是面向 FDE(forward-deployed engineer,进驻客户现场把系统接上的工程师)和领域专家的 Agent 交付平台:专家在 Builder 里用自然语言描述工作方式,开发者用 Managed Agent API 发出去。官网把一个 Agent 拆成角色与目标、公司知识、作业 SOP、交付标准和工具权限;可接 Google Workspace、Microsoft 365、Slack、Lark、Jira、GitHub,并称兼容 MCP(Model Context Protocol,让模型调用外部工具的接口)。模型列表写有 OpenAI、Claude、Gemini、DeepSeek、Kimi、GLM、Seedance。ZooData 把任意 URL 收成结构化 JSON。发布页标有 Free Options。David 在讨论里确认:知识库限时免费,且不另收费;TypeScript 与 Python SDK 已有;每个客户单独一个 Agent 时沙箱互相独立,共用一个 Agent 则共用沙箱,不同会话的聊天记录分开;API 可看单次运行的轨迹,评测模式还在推出。官网另写由驻场工程师在约 7 天内把一条真实流程送进生产。页面上的「提案从 3 天到 4 小时」等数字标为基准场景示意,不是独立审计。抓取时约 289 票、约 42 评。

产品要解决的问题
领域专家能做出一个会回答的 Agent,却很难把它交给同事或客户:知识要能改而不重搭整条流程,客户之间的文件不能混,动到钱或数据前要有人点头。

产品市场分析
目标是要把自己的打法做成可复用 Agent 的专家、咨询和业务团队,以及负责把 Agent 接进现有系统的工程师。替代方案是各家模型的自建工作流、只在聊天里用的自定义机器人,以及要自己管沙箱和权限的 Agent 框架。变现信号是发布页的 Free Options,以及驻场实施的说法;公开价目本次未从官网核对到。安全页写有企业 SSO、按角色的最小权限、默认不拿客户数据训练、租户隔离和可回放的审计,这些是产品方自述。

产品上下游
上游是专家写进知识库的笔记、SOP,以及只读或可写的业务系统;模型由平台接好,不锁定单一供应商。下游是聊天工具里被 @ 出来的同事式 Agent、需要人工批准才提交的动作,以及 API 上的运行轨迹。它不替代客户自己的审批。

2. miso.com · 官网

标语:Book flights and hotels through iMessage

背景
miso.com 由 Martin Mrozowski 介绍,日榜第 2,发布页标为免费。产品是放在 iMessage(苹果「信息」)里的旅行代理:用户用文字说要去哪里,它搜索当时可订的航班和酒店,记住偏好,并在同一段对话里处理预订。发布说明写有直连航空公司,以及 24 小时支持。官网称其为苹果核准的旅行代理,并引导到 App Store 上的 Miso Intelligence;「全球首个获苹果核准的旅行代理」是官网原句,不是第三方审计结论。Martin 在讨论里说明:每条航班、酒店和行程都是提案,换、改、拒绝都可以,没有明确同意不会下单;预算、时间、舱位、座位、酒店风格和积分可以事先说清。偏好写在上手流程里。有人问能否把方案分享给同行再决定,他回复行程分享还在做、尚未上线。抓取时约 212 票、约 25 评。

产品要解决的问题
订一次行程要打开很多机票和酒店页面。计划一变,比价、改签和座位又散回各个 App,对话本身留不住上下文。

产品市场分析
目标是习惯在「信息」里把事情说完的旅客,尤其是行程经常改的人。替代方案是航司和酒店官网、在线旅行社,以及同一时期也住在短信里的通用助手。TechCrunch 在 2026-10-03 的报道里把 Miso 和其他住在 iMessage 或短信里的助手放在一起,并单独写出它只做旅行。变现信号是发布页标免费;订阅或服务费本次未从官网核对到。

产品上下游
上游是用户的文字、上手时留下的偏好,以及发布说明所称的航司直连库存。下游是同一条对话里的提案和已确认的预订,以及改签、取消。分享给同行的能力作者说尚未上线。

3. Prefer · 官网

标语:The execution layer for AEO

背景
Prefer 日榜第 3,讨论里出现 Javed Khatri 与 Mandar Sawant。AEO(answer engine optimization,答案引擎优化)指让品牌出现在 ChatGPT 一类助手的回答里,而不是只争传统搜索结果的链接;官网同时使用 GEO(generative engine optimization,生成式引擎优化)这个说法。产品跟踪买家会问的问题,记录各引擎引用了哪些页面,再把缺口排成可执行的修改:技术访问、结构化数据、对比页和内容草稿。自助方案跟踪的五个引擎是 ChatGPT、Gemini、Google AI Overviews、Google AI Mode 和 Perplexity。定价页写明 Enterprise 另加 Qwen、DeepSeek 和通过 API 的 Claude Sonnet 4。Mandar 在讨论里确认,自助档的 Claude 还在做,目前 Claude 留在企业 API,因为应用里的回答和 API 回答可能不同。Javed 说明衡量方式:先为重要问题建立基线,改完之后反复重跑,看是否被提到、引用了哪些来源、竞品份额,以及提升能否在多次运行里留下来。免费报告只需网址,约两分钟、不用注册。抓取时约 166 票、约 8 评。有用户在讨论里说账号打不开页面、支持邮箱也不通;抓取到的帖文里未见团队回复。

产品要解决的问题
品牌知道自己在 AI 回答里看不见,但多出来的是又一块仪表盘。模型每次回答都会变,单看一次结果分不清是噪声还是真的被引用了。

产品市场分析
目标是要被助手点名的市场、内容和增长团队,以及替客户出报告的代理商。官网 FAQ 写付费按被跟踪的品牌计。标价(定价页,美元):Starter 每月 24 美元,年付折合每月 21 美元(一年 252 美元),30 条提示、每月 15 篇 AI 文章、3 个竞品;Growth 每月 129 美元(年付折合 112.25 美元),150 条提示;Scale 每月 399 美元(年付折合 347 美元),500 条提示。Enterprise 另询。每个付费方案有 7 天试用,不需要信用卡,试用期内提示上限 30 条。代理商方案在 FAQ 里写为每月 99 美元底价,每个活跃客户另加 299 美元。对照表把 Peec AI、Scrunch、Sitefire、AthenaHQ、Profound、Semrush AI 列在旁边,并注明那些价格来自各工具公开页、核对日期写在表下;本次没有逐家复核。官网写可发布到 Webflow、WordPress、Shopify、Framer、Ghost、Contentful,可读 Google Search Console、Google Analytics 和 Semrush,并推到 Slack、HubSpot、Salesforce、Notion、Zapier。收款经 Dodo Payments。首页称 G2 上 4.7/5,并给出已跟踪的对话次数,两者都是产品方展示。

产品上下游
上游是品牌网址、要跟踪的问题和竞品,以及搜索分析、CMS。下游是按提示排序的修改队列、草稿,以及改完之后重新测量的引用变化。自助档的站外投放(评测站、名单文、论坛)FAQ 写在 Enterprise 和 Managed,不在自助方案里。

4. Muse Gadgets · 官网

标语:Meta’s open-source kit for building your own AI gadgets

背景
这是 Muse by Meta 在 Product Hunt 上的第 2 次发布,本次条目是 Muse Gadgets,日榜第 4,发布页标为免费。Muse 在产品页上是个人 Agent:用户给出目标或日常事务,由它处理财务、健康、购物和要联系的人。Gadgets 把这套 Agent 接到自制硬件上。官网写明:用开源 SDK 给现成的 ESP32(乐鑫的微控制器板)或 Raspberry Pi / Linux 写程序,再接显示、按钮、麦克风、扬声器、传感器和执行器。设备 SDK 与固件以 Apache 2.0 提供、按现状交付、无担保。官方自己做的 Muse Home Link 是基于 ESP32-C5 的 USB-C 设备,固件来自同一套 ESP32 SDK,但 Home Link 本身只跑官方固件、不能刷机;它把 Muse 接到家里的 Wi-Fi,以便访问已有设备或带本地 HTTP API 的自制设备。官网写:美国境内、持有有效 Muse 订阅可免费领一台,每人限一台,10 月发货,先到先得。TechCrunch 在 2026-10-02 报道 Meta 于当周周五放出该项目,并引述 Meta 超智能实验室产品负责人 Nat Friedman 在 X 上的说法:公司做了 Home Link,数量为 5,000 台。抓取时约 156 票、约 6 评。

产品要解决的问题
个人 Agent 停在手机或网页里。想要一块墨水屏晨报、口袋设备或接到家里开关上,缺少一套能自己改的固件和令牌。

产品市场分析
目标是已经在用 Muse、又愿意焊板或摆一块 Pi 的人。这不是一条面向大众的新硬件 SKU;成品侧官网只强调 Home Link 的订阅赠送。替代方案是各家封闭的智能音箱和显示屏,以及不接 Muse 的自制家庭自动化。变现信号是 SDK 发布页标免费;Home Link 绑在有效的 Muse 订阅上,订阅本身的价格本次未从 Gadgets 页核对。TechCrunch 同文还写到当周更早的 Muse for Small Business(连接 Shopify、Dropbox、Slack,有用量上限)和 Meta Enterprise Platform,那是 Muse 的商务延伸,不是这次硬件套件的标价。

产品上下游
上游是 Muse 账号、SDK 令牌,以及 ESP32、Pi、屏幕和传感器。下游是自制界面对话、社区 Discord,以及经 Home Link 或本地 HTTP 调用的灯、电视、打印机等——官网写这取决于用户自己的设备和社区技能。官方提醒 tinkering 可能刷坏板子或影响保修。

5. Kindle 2026 · 官网

标语:A smaller, faster Kindle with a flush-front display

背景
Kindle 2026 是亚马逊 6 英寸入门 Kindle 的改款,在 Product Hunt 由用户猎推,日榜第 5,发布页标为需要付费。亚马逊设备副总裁 Kevin Keith 在官方新闻稿里写:全系改用反向堆叠的屏幕结构,正面不再有一圈凸起的边框;6 英寸 Kindle 自称口袋尺寸里最小的一款,16GB、电池最长约 6 周、打开书籍比上一代快 30%,起价 149.99 美元,颜色为 Ube 和 Graphite,外壳含回收材料,电池钴为 100% 回收。铝制背板版首次出现:80% 回收铝、32GB、189.99 美元,颜色为 Alpine Sky Aluminum 和 Seaglass Green Aluminum。同文还公布 Paperwhite(16GB 起价 199.99 美元;Signature 32GB 为 249.99 美元)和 Colorsoft(16GB 起价 289.99 美元;Signature 32GB 为 319.99 美元),以及 Kids 版起价 179.99 美元。配件:蓝牙翻页遥控器 Kindle Click 34.99 美元(兼容全部新机和 2024 年及以后的 Kindle)、带实体翻页键的磁吸保护套 79.99 美元(仅 Paperwhite 与 Colorsoft 的 Signature)、充电座 59.99 美元。入门款和铝制版新闻稿写明已在美国、加拿大、墨西哥、巴西、英国、德法意西、爱尔兰、荷兰、比利时、瑞典、波兰、日本、沙特、阿联酋、埃及和澳大利亚开售;Paperwhite 与 Colorsoft 在相同地区滚动预购。新闻稿称 Kindle 全球连续三年双位数增长,2025 年阅读页数超过 7,200 亿,这是亚马逊自述。猎推评论补充:基础款仍然没有暖光和防水,并怀念带触感翻页区的 Voyage。抓取时约 139 票、约 2 评。

产品要解决的问题
上一代入门 Kindle 的屏幕缩在一圈边框里,机身也不如更高端型号好拿。想要实体翻页的人,过去往往得买更贵的机型或保护套。

产品市场分析
目标是要一台更小、无边框、仍只用来读书的读者。铝制版把存储加到 32GB 并抬价到 189.99 美元,和 199.99 美元起的 Paperwhite 重叠;Paperwhite 官方写明防水和可调暖光,基础款的暖光与防水以猎推评论为准,新闻稿没有把这两项写进入门款。替代方案是其他品牌的电子阅读器、平板,以及仍在用的旧 Kindle。变现就是硬件和保护套、翻页器的标价,外加 Kids 版附带的 12 个月 Amazon Kids+。

产品上下游
上游是 Kindle 商店里的书,以及新闻稿描述的新屏幕堆叠和回收材料。下游是读者,以及 Click、翻页保护套和充电座。基础款已开卖;更高端两款在新闻稿发布时仍是预购。

6. Cubicle · 官网

标语:A live office for your AI agents, read-only by design

背景
Cubicle 由 Çağlar Utku Güler 发布,日榜第 6,标为免费、MIT。作者说自己用 Paperclip 跑一小组 AI Agent,不读日志就不知道谁在做什么,于是做成一间办公室:正在干活的坐下来打字,需要人的举手或在桌前排队,做完的去休息区,出错时屏幕变红。Paperclip 在发布帖里是他用来派工、并在看板上留下待回答问题的系统。支持 Claude Code、Codex、Gemini CLI 和 Paperclip,或其他能写一小段 JSON 的工具。一条命令 npx @caglarutkuguler/cubicle,作者强调运行时零依赖。install-hooks 会把钩子写进 ~/.claude/settings.json(先备份);之后每个 Claude Code 会话是一个角色,按工作目录命名,子 Agent 也单独出现。只读是设计:Cubicle 不批准、不继续、也不停止运行;唯一可选的写入,是用户自己在 Telegram 里的回复,作为评论发回。Telegram 命令包括按 Agent 静音、只在有人提问时通知、只在失败时通知。手机看同一份数据,回答仍在终端或 Paperclip 的问题页。无需安装的演示在 https://caglarutkuguler.github.io/cubicle/。抓取时约 113 票、约 23 评。仓库页当时显示约 17 个 star。

产品要解决的问题
多个编程 Agent 并行时,谁在等权限、谁已经做完,都埋在各自的终端里。再做一个会替用户点「允许」的控制台,又把权限交了出去。

产品市场分析
目标是同时开着几路 Claude Code、Codex 或类似 CLI 的人,以及已经用 Paperclip 派任务的小团队。替代方案是继续看终端、系统通知,或其他 Agent 仪表盘。差异是表现层和只读:办公室和举手是状态的画法,不是另一个能下命令的调度器。变现信号是免费和 MIT;未见标价。

产品上下游
上游是各 CLI 的钩子、会话状态,或用户自己写的 JSON。下游是办公室画面、手机上的同一状态、KPI 板和 Telegram 提醒。--redact 可在共享屏幕上去掉任务标题、命令和错误正文。权限仍然在原来的工具里批。

7. SCMD · 官网

标语:Manage what Claude Remembers and Keeps as Memory.

背景
SCMD 由 Nelson John 发布,仓库为 nelsonjohnsolo/scmd,日榜第 7,标为免费、MIT,发布说明写明只针对 Claude。README 把名字展开成 “Stop Calling Me Daddy”:作者的 Claude Code 在每条回复开头这么称呼他,他的妻子先看见,他不知道原因,这句话写在持久记忆里。工具是本地的一副审核牌:记忆以卡片出现,可保留、删除、跳过、撤销或改写;决定先暂存,确认后才写入;删除进可恢复的垃圾箱。默认读取 ~/.claude/projects 下的记忆和 MEMORY.md,并用会话记录回答「为什么被记住」,能找到来源时才显示。项目级 CLAUDE.md 只读、不改。服务绑在 127.0.0.1,无遥测,运行时零 npm 依赖。需要 Node.js 18 或更新。自定义配置目录可用 --root。改写若启用,文本只走本机已登录的 Claude Code CLI。可从 Claude Code 插件 /scmd:run 或 npx 启动。抓取时约 89 票、约 5 评。

产品要解决的问题
Claude Code 会自己写下跨会话的记忆,之后默读回来。这些条目会过期,也会留下本人没打算保留的话,而用户很少回头审一遍。

产品市场分析
目标是使用 Claude Code 持久记忆的人。发布标题写 Claude only;README 也只处理这套记忆文件,讨论里有人问会不会支持别的 Agent,抓取到的可见回复没有改口。替代方案是直接编辑 MEMORY.md,或不管它。变现信号是 MIT 和免费;npm 包名为 @nelsonjohnsolo/scmd。

产品上下游
上游是本机 ~/.claude 里的记忆 Markdown 和会话 jsonl。下游是确认后的保留、改写,以及 ~/.scmd/trash/ 里可恢复或再清除的删除。会话记录和 CLAUDE.md 不会被改。在不信任的项目目录里,README 不建议用会解析到本地包的那条较短 npx 写法。

8. FeelMyMac · 官网

标语:Lets you feel different textures through your Mac’s trackpad

背景
FeelMyMac 由 Leonardo Curtone 在讨论里回复,日榜第 8,发布页标有 Free Options。它把触感纹理加到光标移动和滚动上:不只在按下时震一下,移动时也能感到模拟的表面材质,强度可调,并可另开音效;也包括键盘敲击声。发布说明写实现靠的是 Taptic Engine,也就是 Mac 触控板和 iPhone 上那颗线性马达。官网当前是一块可移动试听的表面演示,定价和材质清单本次没有从该页核对到完整价目。发布帖写早期下载「数百次」,并称反馈塑造了应用,这是产品方自述。抓取时约 85 票、约 5 评。

产品要解决的问题
Force Touch 触控板的震动几乎只发生在点击。光标划过界面时,手感是平的,和「这是什么材质」无关。

产品市场分析
目标是想改变电脑手感、而不是再要一个效率快捷键的 Mac 用户。发布帖把范围说清楚:不省点击次数。替代方案是系统自带的轻点反馈,以及只做键盘音效的工具。变现信号是 Free Options;具体哪几档收费,官网抓取时没有给出价目表。

产品上下游
上游是带 Taptic Engine 的触控板,以及用户选的材质和音量。下游是移动和滚动时的震动与可选声音。它不读取文档内容,也不接云端账号——这两点发布页没有单独写成隐私条款,本次只确认了本地触感这一路径。

9. FoundrRadio · 官网

标语:Pick a frequency, launch your radio station and go on air

背景
FoundrRadio 由 Animesh 发布,猎推人为 fmerian,日榜第 9,标为免费。这是给创始人开自己电台的网络电台:听众收他们的谈话或喜欢的音乐。作者在讨论里说一共 201 个频道,可以同时开播;每个电台页面显示听众人数,更完整的分析以后可以做,现在还不是。主题、颜色和字体定制在计划中,尚未上线。有人问能否预先排节目,他回复目前是到点把已有录音当场播出去,重点仍是实时,而不是先录好的节目单。频道扫描被问到时,他说会做,现在去 /discover 看正在直播的台。官网打开是一台 FM 面板,空频率上写着这个频率可用。抓取时约 84 票、约 14 评。

产品要解决的问题
创始人想要一小块自己的角落和实时听众,而不是再把谈话丢进一条信息流。播客和直播工具能发声,但没有「调到一个频率」这层占位。

产品市场分析
目标是想开台的创始人,以及来听特定的人的听众。替代方案是播客、语音直播间和视频直播。作者把差异放在怀旧和实时:201 个固定频道、页面上的听众数,而不是一套完整的广播后台。变现信号是发布页免费;广告或订阅本次未从官网看到。

产品上下游
上游是开播的人,以及他们拿到点再播的录音。下游是电台页面上的听众。定制皮肤、节目单和频道扫描都还在作者说的后续里;听众数已经显示在每个台的页面上。

10. Notchware · 官网

标语:Music and AI agent alerts in your MacBook notch

背景
Notchware 日榜第 10,发布页标有 Free Options。它把带刘海的 MacBook 顶部做成一块状态岛:正在播放的封面、均衡器和播放控制(Spotify、Apple Music 及其他媒体源),以及电池、音量、亮度、Focus(专注模式)和 Wi-Fi / 个人热点。Pro 在发布说明里写明一次买断 3.99 美元,加上 Codex、Claude Code 和 Cursor 的提醒:Agent 要批准或做完时出现在刘海,不必盯着终端;官网还把锁屏音乐控制和隐藏锁屏头像写进同一次买断。系统要求 macOS 14.6 或更新,Apple 芯片和 Intel 都能跑,面向有刘海的机型。无账号、无分析、无云端。Agent 提醒用本地钩子,安装前可在设置里看命令;官网写这些钩子只写很小的状态事件,不读提示词和回复。抓取时约 80 票、约 1 评。

产品要解决的问题
刘海占着视线正中,却只用来放摄像头。播放键和 Agent 是否在等批准,仍要看菜单栏或终端。

产品市场分析
目标是用带刘海的 MacBook、又经常让编码 Agent 跑着的人。免费档覆盖播放和系统状态;Pro 才是 Agent 提醒和锁屏。替代方案是菜单栏监控、其他刘海工具,以及 Agent 自己的系统通知。变现是 3.99 美元一次买断,发布说明和官网对「买断、不加订阅」的说法一致。

产品上下游
上游是系统的媒体会话、电池和网络状态,以及用户检查后才装上的本地钩子。下游是刘海上的状态岛,以及 Pro 的锁屏控制。钩子不到模型对话里取内容;全屏应用时可以自己隐藏。

今日 Hacker News 热榜前五横跨硬件、法律、天文和一则个人项目。Yureka Lilian 记录了怎样在 M4 Mac mini 上把 Linux 启动到多核 shell:这代芯片上的 WFI 会清掉通用寄存器,内核必须绕开这条指令。靠前的还有联邦法院暂时挡住犹他州要求网站识别或拦截 VPN 用户的年龄验证法,以及 Apple 面向开发者的 Pass Designer beta。后两条是一颗 133 光年外恒星的十二年望远镜成像,以及前 NFL 主教练 Mike Tomlin 用十二年搭起来的 Minecraft 城市。以下按 Firebase topstories 当前顺序整理,分数与评论数为抓取时快照。

1. The Forgetful CPU (Linux on M4)

背景介绍
Yureka Lilian 在 The forgetful CPU (Linux on M4) 里写自己如何第一次在 M4 Mac mini 上启动 Linux,并感谢 Asahi Linux 团队先前的工作。2024 年 11 月买下这台机器时,作者赌它会和 M1–M3 差不多,能较快进 Asahi。实际更难:M4 是第一代强制使用 SPTM(Secure Page Table Monitor)的 Apple Silicon,用来加固 macOS 的 XNU 内核。前几代把 Linux 带起来,很大程度上靠 m1n1 hypervisor 抓 MMIO 跟踪,看 macOS 驱动怎么跟硬件说话。有了 SPTM,要让 macOS 跑在 hypervisor 下就得大改 m1n1,作者写自己当时还做不到。于是并行做了另一条路:关掉严格启动安全、在 macOS 恢复环境里把 m1n1 装成自定义启动对象,并用串口看日志。

早期 m1n1 只能以 BRINGUP 模式起来,一初始化 GXF 就崩。GXF 在这些 M4 及更新 SoC 的 raw boot 模式里被关掉或锁住,初始化必须改成按机器跳过。每个核的 RVBAR 在 M4 上已经是正确入口,m1n1 再写一次也会崩,所以这次写入也要跳过。2024-12-01,USB 代理已经能出 shell。机器随后闲置,直到 2025 年底的 Chaos Communication Congress。作者拼了一个只有 CPU 核和 AIC 中断控制器的设备树,用 earlycon 加载内核,但在 “Vectoring to next stage” 之后没有输出。把 m1n1 的 debug_putc 插进很早的启动代码后,二分落到 arch/arm64/kernel/head.S 里的 MMU 初始化:m1n1 把 MMIO 做成虚拟地址等于物理地址的映射,Linux 没有,MMU 打开后串口访问落到未映射空间。补上这段 1:1 映射后,又卡在对 SYS_IMP_APL_VM_TMR_FIQ_ENA_EL2 的写入;注释掉之后内核进了 shell。该寄存器和虚拟化有关,作者写新版 iBoot 已经解锁,不必再注释。2026-01-23 补上 earlycon=s5l,0x3ad200000 和设备树里的 stdout-path = "serial0" 之后,早期崩溃才有完整寄存器和栈。

次级核另有问题。m1n1 缺少 smp_start_offset 时会跳过 smp_init;用上 M1–M3 的偏移后,核能起来,Linux 却再次神秘崩溃。前几代 Apple Silicon 的 WFI 受 XNU 开源代码里一个叫 ARM64_REG_CYC_OVRD_ok2pwrdn_force_mask 的 chicken bit 控制,可能在 WFI 时把 x0–x31 清零;XNU 会事先入栈再恢复。M1–M3 上 m1n1 关掉这种行为,使 CPU 更像普通 arm64,Asahi 内核后来又打开它,以便更深睡眠和同簇其他核降频时单核升频。作者判断这个 chicken bit 在 M4 上被锁住或移除,默认行为不符合 ARM64 规范里的要求:若系统配置成 WFI 可以完成,WFI 就不得造成架构状态丢失。2026 年 4 月,把内核里的 WFI 和 WFIT 全部换成 NOP 之后,所有核都能启动。

上游没有走「启动时自行给 WFI 打补丁」的 errata 框架,因为虚拟机里也很难判断何时该换成 NOP:macOS hypervisor 会截获 WFI 来调度客户机,嵌套虚拟化更难检测。Will Deacon 建议内核增加用启动参数关掉 WFI idle 的能力,再由 m1n1 在已知有问题的裸机上有条件地加上参数。睡眠暂时仍用下游的 cpuidle-apple;Sven 的 PSCI EFI conduit 被作者看成以后的上游方向。作者报告,避免在 WFI/WFIT 上崩溃的机制已经进入主线 Linux 和 m1n1,最新版本可以在 M4 Mac 上带次级核原生启动。同一套规避也适用于 M4 Pro、M4 Max 和 M5,目前能进多核 shell。摄像头、显示控制器和 GPU 仍依赖对 m1n1 hypervisor 跟踪 macOS 的后续逆向,作者说这部分慢但在推进,改动直接提交到上游项目。

主要讨论方向与观点
这条讨论很短。有人把话题转到 Apple 硬件和开放系统的反差:觉得 Mac 硬件明显好于其他机器,但 macOS 臃肿;回复把「好」收窄到整机集成和续航,而不只是零件。也有人觉得,买一家对开放不友好的公司的机器再跑开放系统,本身就别扭;回复问 Apple 是在主动封锁,还是只顾做新硬件、不去管开放系统。另有人问能不能让 AI 把这类移植做完,回复只给了一条 Phoronix 链接,标题是 Gravity Linux Aims To Provide A Nice Experience For Apple M4 & Newer。本次没有抓那篇新闻的正文,这里只记下评论里的指向。

专有名词解释

  • WFI / WFIT:Wait For Interrupt,以及带超时的 Wait For Interrupt。CPU 用它们停下来等中断以省电。这篇的「健忘」指 M4 上执行 WFI 会丢掉 x0–x31 的架构状态,不符合作者引用的 ARM 规范。
  • SPTM:Secure Page Table Monitor。作者把它写成 M4 起强制启用、用来加固 XNU 的机制,也是 m1n1 难以再像前几代那样跟踪 macOS 的原因。
  • m1n1:Asahi 用来在 Apple Silicon 上加载 Linux、并在可能时做 hypervisor 跟踪的引导程序。
  • GXF:Guarded Exception Levels。文中它在 M4+ 的 raw boot 模式里被禁用或锁定,m1n1 不能按老路径去初始化。
  • Chicken bit:厂商用来关掉某项 CPU 优化或特性的寄存器位。这里指控制 WFI 是否清寄存器的那位。

HN 讨论:thread · 81 分 · 13 评

2. Court agrees with EFF: Utah’s VPN law demands a technical impossibility

背景介绍
电子前线基金会(EFF)于 2026 年 10 月发文 Court Agrees with EFF: Utah’s VPN Law Demands a Technical Impossibility。联邦法官发出初步禁令,挡住犹他州 SB 73。该法今年早些时候签署,要求成人网站拦截 VPN 用户,或者识别使用 VPN 及类似掩盖流量工具的访客的真实物理位置;它还禁止网站提供如何用 VPN 绕过这些检查的说明。EFF 称,据他们所知,这是美国第一个针对「用 VPN 避开法定年龄验证」的州法。

犹他联邦法院上周暂停执行该法中与 VPN 有关的条款,理由是它很可能违反宪法里对「显著负担本州以外的企业和个人」的限制。法院写道,所谓实际位置条款在实践中要求网站给每一个访客做年龄验证,因为只要有一个用户在隐藏位置,网站就违法。EFF 概括为:网站要么知道每位访客的物理位置再挡住犹他州的人,要么以防对方在犹他州而对所有人验年龄。文章说,法院的意思是犹他有负担更小的办法阻止本州未成年人访问成人网站,而不是让全世界用户都服从 SB 73。Pornhub 母公司 Aylo 提起的诉讼并没有挑战「禁止被覆盖网站分享 VPN 信息」那一条。

SB 73 原定 2026 年 5 月生效。起诉之后,州和 Aylo 先同意在法院考虑初步禁令、或具体合规规则定稿之前暂停执行。犹他州商务部消费者保护处 9 月 1 日公布拟议规则 R152-78B,EFF 提交了反对意见;通知称这些规则最早可在 2026 年 10 月 8 日生效。法官 Barlow 的决定意味着,在法院进一步行动之前不能执行。判决认为修正后的法律实质上对 Aylo 这类主体施加了严格责任,要求以完美的地理定位避免责任,同时又承认完美的地理定位目前做不到。EFF 引用的法院表述是:因为没有完美工具却要求完美,Aylo 需要核验那 2800 万用户,无论他们在盐湖城、波士顿、新奥尔良、安克雷奇还是火奴鲁鲁。

拟议规则要求商业实体实施「商业上合理的地理定位混淆检测系统」。EFF 认为这仍是技术上做不到的指令,而且会把更重的监控加到本想躲开年龄验证数据收集的用户身上。文中点名的启发式方法包括连接延迟和设备时区,并称它们不可靠、容易被正常网络条件带偏,从而误分类、误封,并影响犹他州以外的隐私。文章重申 EFF 的老话:互联网总会绕过审查。也写到州议员可能在下一会期修改法律,并说其他州若考虑类似反 VPN 提案,EFF 会继续反对。

主要讨论方向与观点
最先被追问的是:能不能可靠判断一条连接来自 VPN。回复认为网站通常只看到 IP,任何人都能在廉价 VPS 上给自己搭「个人 VPN」;能做的近似是封已知商业 VPN 的地址段,而不是满足法律要求的完美。也有人说用流量形态和浏览器指纹可以相当接近,但不会完美;流媒体封的常常是云厂商地址段,连正常使用工作 VPN 或 Mozilla VPN 的人也会被误伤。有人用 DraftKings 对加州访客的拦截举例,认为这并非不可能。回复把两套法律分开:加州不要求完美,犹他要求完美;另有人说自己不在加州、用 VPN 仍被 DraftKings 挡住,说明对方并没有在分辨 VPN 用户是不是真的在加州。

另一条线是 EFF 那句「互联网总会绕过审查」还成不成立。有人举伊朗、中国和克什米尔,认为这已经是套话。回复区分了能做和不能做的事:连接可以被掐断,HTTPS 不会被魔法降级或解密;IETF 的 BCP 188 把普遍监控当成攻击。也有人说大防火墙仍可能放过大约百分之一的技术用户,只要大多数人过不去;伊朗式断网是直接切断出境,而不是去找 VPN。还有观点认为,二、三层确实会绕路,但人们使用的互联网是集中的应用层,监管直接打服务提供商即可。有人补充,自我审查和日常使用的 SNI 也是审查手段,绕路这句话盖不住。禁止网站说明如何用 VPN 绕过检查,被问是不是明显的第一修正案问题。把成人内容赶到专用域名的想法,回复提到 2000 年代国会研究过强制成人网站使用特定顶级域,法律意见认为几乎肯定会碰到第一修正案;也有人主张由站点发送标记、再在客户端做家长控制,并指出外国网站可以不遵守。另一些评论把该法看成超出成人内容的网络控制,或只是提醒给 EFF 续费。

专有名词解释

  • VPN:虚拟专用网络。流量先到中继服务器,目标网站看到的是中继的 IP,而不是用户接入点的地址。
  • SB 73:犹他州这项年龄验证法的编号。EFF 文章聚焦其中要求识别或拦截 VPN 等混淆工具的部分。
  • 初步禁令:案件审完之前,法院先暂停执行被挑战的规定。这里还不是终局判决。
  • 严格责任:EFF 转述法官的话,指网站只要没能完美判断用户位置就可能承担责任,而不取决于它是否已经合理努力。
  • SNI:Server Name Indication,TLS 握手里表明要访问哪个站点的字段。评论把它当成长期存在、实现简单的审查抓手。

HN 讨论:thread · 485 分 · 216 评

3. Apple Pass Designer

背景介绍
Apple 开发者站点上的 Pass Designer 把这款工具写成:无论是本地健身房、小音乐场地、全球航空公司还是全国连锁咖啡,都可以用它设计和预览能代表自己品牌的 pass。可以从 Apple 或自己的模板开始;标志、背景、条带图等仍用惯用的设计工具做好,再放进 Pass Designer。编辑时预览会实时更新,展示 pass 在 iPhone 和 Apple Watch 上的样子,并使用与 iOS、watchOS 相同的渲染,所以设计器里看到的就是设备上的结果。背景、前景和标签颜色可以直接调。页面还写它既支持 Apple Wallet 的最新能力,也支持向后兼容的 pass;每种 pass 有标准字段,可在设计器里改内容;编辑过程中会检查缺失的必填键和异常定义。

登机牌和活动票可以用语义标签写下结构化数据,例如活动日期、场地位置或航班信息,系统据此做 Siri Suggestions、日历集成和地图路线。设计器里可以直接编辑这些标签,并排比较带语义和不带语义的 pass,也能从语义数据自动生成一份不依赖语义标签的向后兼容结构。页面写明:Pass Designer beta 需要 macOS 27 或更高版本,下载前要用 Apple Account 登录,必要时完成免费注册并接受 Apple Developer Agreement。本次抓到的页面没有写定价,也没有写 Windows 或 Linux 版本。

主要讨论方向与观点
有人觉得这件事并不重要。回复里则有人想删掉那些「打开只为显示一条条码」的应用,只在 Wallet 里留一张 pass;也有人讨厌场地和航空公司从一张 PNG 改成 Wallet,认为这是更易出故障的锁定,并举老 iPhone 打不开西南航空登机牌为例。另有人说十几年前在 Apple 内部就推过这种设计器,当时各团队在用临时方案。也有人说 Wallet pass 很有用,但多年前文档差到自己放弃了,这工具晚了大约十年。使用范围上,有人觉得它偏旧金山;回复称墨西哥城的活动、主要巴士线路、影院和博物馆已经普遍用 Apple Wallet pass,乡村地区的条码和二维码也很常见,设计器只是多一种把条码放进手机的办法,并不取消纸质票。

功能愿望和产品页是分开的。有人希望 pass 框架能从语义上标出条码区域,让 Wallet 只把那一块提到扫码器需要的亮度,而不是整屏突然变亮;回复里有人怀疑这是否必要,因为扫不出来时可以自己调亮度。还有人希望支持更难被看一眼就复制走的 TOTP,以及让 NFC 读卡器能读 Wallet pass;该评论称 Apple 和 Google 都限制了这一点,只有少数大型零售商在用。另一条独立于设计器页面的消息是:有人说 iOS 27 的 Wallet 应用已经可以扫描现有条码和二维码来做 pass。macOS 27 这个下限被反复问到。回复里的解释包括:Apple 习惯把共享代码抽进系统库,内部又总在最新 nightly 上开发,新功能很难不依赖最新系统;也有人认为主要是 QA,新功能先不管旧系统更省事,或者就是想用最新 API。对经费少、机器旧的图书馆或小店,这种限制被看成比 Live Nation 这类公司更受影响。格式层面,有人觉得 PKPass 谁都能做编辑器,并怀疑缺的是不是签名校验;回复问这为什么能成为 Apple 不做编辑器的理由。

专有名词解释

  • Pass / Apple Wallet pass:放在 iPhone 或 Apple Watch 的 Wallet 里的票券、会员卡或登机牌。Pass Designer 是做这些版式的开发者工具,不是评论里说的系统 Wallet 扫码入口。
  • PKPass:讨论里提到的 pass 文件格式,评论链到了 Wikipedia 的 PKPASS 条目。页面本身强调的是设计和预览,没有展开包格式。
  • 语义标签:登机牌和活动票上的结构化字段。页面称系统用它们驱动 Siri 建议、日历和地图,并可以再生成一份不依赖这些标签的旧结构。
  • macOS 27:Apple 页面写明的 Pass Designer beta 最低系统版本。讨论在猜这是最新 API 和测试范围,而不是 pass 格式本身只能在 Mac 上存在。

HN 讨论:thread · 305 分 · 207 评

4. A 12-year sequence of telescope images of a star and four planets orbiting

背景介绍
这条 HN 帖指向行星科学家 Paul Byrne(Bluesky 账号 theplanetaryguy.com)在 2026-10-02 发的一段视频。帖文写:一颗 133 光年外的恒星,十二年望远镜图像序列,周围四颗行星在慢慢公转;四颗都是真实的系外行星,每一颗都比木星更重。Byrne 在跟帖里说明,视频由 2010 年到 2021 年凯克望远镜的 10 张图像组成;Jason Wang 制作视频,William Thompson 与 Christian Marois 做数据归算,观测由 Quinn Konopacky 组织,Bruce Macintosh、Travis Barman 和 Ben Zuckerman 协助。Bluesky 回复里有人指出这是 HR 8799。

英文维基的摘要与「Planetary system」一节写:HR 8799 是飞马座一颗约 4200 万年的主序星,距地球 133.3 光年,质量约为太阳的 1.4 倍,光度约为 5 倍,带有尘埃盘和至少四颗大质量行星。这些行星是第一批用直接成像确认了轨道运动的系外行星。该星同时是剑鱼座 γ 型变星、牧夫座 λ 型星和织女星型星,维基称它是已知唯一三者兼具的恒星。2008 年 11 月 13 日,加拿大国家研究委员会 Herzberg 天体物理研究所的 Christian Marois 团队宣布,用夏威夷的凯克和双子望远镜、自适应光学和红外观测,直接看到三颗行星;1998 年哈勃 NICMOS 的红外图像后来被重新处理,找到外三颗行星的更早记录。2009–2010 年的观测发现第四颗巨行星位于前三颗内侧,投影距离略小于 15 AU,并得到多项研究确认。维基还写,这是第一个被直接成像的多行星系外系统,轨道运动为逆时针;e、d、c、b 的轨道半径大约分别是木星、土星、天王星、海王星轨道的 2 到 3 倍。

HN 上的描述和 Byrne 的说明并不完全同一句。用户 wthomp 贴了自己只用凯克、同一仪器、3.5 微米近红外做成的四颗行星视频,并称上面那段用了多台望远镜、多个波长的数据。本次没有再核对原始数据论文,因此两边对数据来源的说法都只按各自帖文记录。

主要讨论方向与观点
有人强调这不是连续拍摄的实况:是 10 张静态图,中间插了几百帧。角距离上,有人按图中 20 AU 的比例尺估算,恒星约 41 秒差距,这段比例尺的张角大约是半角秒,相当于 11 公里外看一枚美国 25 美分硬币。也有人把被挡住的恒星区域本身读成大约 20 AU 宽,这是对画面的印象,不是维基给出的恒星半径。2017 年附近被遮恒星的噪声明显变小,Bluesky 和 HN 都有人问是恒星活动还是后期处理;HN 回复一边猜是更好的后处理,一边猜是恒星亮度本身在变,帖文里没有定论。还有人问是否有更小的行星被这四颗更重的天体盖过亮光,顶层回复没有给出观测答案。

往前看的评论指向南希·格雷斯·罗曼望远镜的日冕仪,并转述其设计目标:探测比恒星暗 1 亿倍的行星,比现有空间日冕仪好 100 到 1000 倍,可直接拍摄反射光、大小和温度接近木星、轨道距离也类似的行星。另一条链接是预计 2040 年代发射的宜居世界天文台对太阳系的模拟观测。这些灵敏度数字来自讨论中的转述,本次没有打开 JPL 任务页核对。也有人列出直接成像系外行星的维基名单,或把这种图和「普通人只能从科学里拿走画面」放在一起。

专有名词解释

  • 直接成像:尽量分开恒星和行星的光,直接拍到行星,而不是只看恒星被遮挡或摆动。HR 8799 的轨道运动是用多年重复成像看出来的。
  • AU:天文单位,大约是日地平均距离。比例尺上的 20 AU 是画面里的长度,不是这颗恒星的直径。
  • 角秒:一度的 1/3600。评论用它说明,133 光年外 20 AU 的横杆在天球上有多小。
  • 自适应光学:实时修正大气抖动,使地面望远镜在红外能分开靠得很近的行星和恒星。2008 年的发现公告用的就是凯克和双子上的这套办法。
  • 日冕仪:挡住恒星眩光、以便看到近旁暗天体的仪器。评论里的罗曼望远镜日冕仪是未来的空间版本,不是这段 2010–2021 年视频的设备。

HN 讨论:thread · 186 分 · 40 评

5. Mike Tomlin spent 12 years building a Minecraft city

背景介绍
HN 的链接是 The Athletic 的文章,页面返回 HTTP 403,正文没有抓到。帖文里同时给了 archive.ph 存档、YouTube 和《卫报》。下面主要依据 Alex Kirshner 2026-10-01 发表在《卫报》的文章、YouTube oEmbed,以及 HN 讨论。视频标题是 “EP 1: ROOFTOPS, PENTHOUSES, AND URBAN LIVING”,频道作者名为 Mike Tomlin。

《卫报》写,Tomlin 在执教期间用 Minecraft 建城市,起初是为了和年幼的孩子有共同话题;周三晚上公开的十二年成果让作者和做室内设计的妻子都吃了一惊。文中引用视频开头的话:“More than anything, it was therapeutic for me.” 城市名字仍不清楚。文章把建城放在钢人队一段动荡时期里:2018 年 Le’Veon Bell 拒绝签署特许球员标签、整季进攻悬着;Antonio Brown 和 Ben Roethlisberger 闹翻并最终被交易到突袭者;匹兹堡体育媒体因为他将近十年没有季后赛胜利而转向批评他。城市围着一片中心水域展开,作者把它和匹兹堡三条河在 Point State Park 汇合做对照。Tomlin 在片中说,一切从这片水开始。大约 2014 年他盖的第一栋建筑是一家带行政水疗的精品酒店,那年钢人队拿下美联北区,Antonio Brown 接球约 1700 码,Le’Veon Bell 冲球约 1300 码。他强调自己对光线很在意,会在合适的地方做玻璃天花板;镜头掠过一座虚拟 CVS,进入水族馆主题的公寓高楼,因为他在街对面建了水族馆,并说以后的一集会展示它。儿子兼制片 Dino 曾是大学外接手,告诉观众父亲为了把水都安置好花了很多时间。文中还写到他对卧室细节的执着、一座 MLS 球场、一座嵌进城市的棒球场(作者比作匹兹堡的 PNC Park),以及他在意窗景和公共洗手间数量。大学公寓楼 “The View” 用了 Dino 在马里兰大学公园城开始大学生涯时那座公寓的名字。文章称 Tomlin 54 岁,赢过超级碗,是 NFL 历史上成绩最显赫的教练之一,之后从事收入可观的转播工作。有人在网上把这爱好说成浪费抱负;作者认为这是少数意见,匹兹堡不妨请他做规划顾问。

HN 评论里另有一段 Tomlin 的话:「我在孩子还小的时候开始玩 Minecraft。我有一座创造模式里的城市,已经做了大概 12 年。」创造模式这一点来自该评论中的引语,不是《卫报》正文里的原句。

主要讨论方向与观点
最多的反应是去看视频:即使不关心 Minecraft 或橄榄球,也值得看一个人展示投入了十二年的东西。有评论把 Tomlin 介绍成匹兹堡钢人队前主教练、联盟任职第二长的教练,并称他在去年辞职前没有一个失败赛季;这些履历字句来自评论,本次没有再用名册核对。回复引用他关于「解压、不用看很多电视、从压力里抽离」的说法,也有人提醒季后赛战绩和常规赛不是一回事,并给出 Pro Football Reference 的教练页。另一则评论自己算的季后赛对照是:建城之前(2007–2013)季后赛 5 胜 3 负,开始建城之后(2014–2025)3 胜 9 负。回复把早期和后期与有没有特许经营四分卫联系起来,或说 3 胜 9 负仍然是九次季后赛,多数教练一次都没有。

建造水平被分开看。有人认为以 Minecraft 建筑圈的标准,这不是先进技术,方块粒度和有限种类限制了表达,一个熟悉技术的青少年或大模型都能生成类似城市;重点是作品在他自己的约束里、由他自己决定,生成工具并不会让他更在意。回复把产品和「劳动与过程」的沟通连起来,并对比 2020 年伯克利学生手建校园、斯坦福用地图数据自动生成、前者看起来更好。也有人说他用手柄和偏慢的灵敏度完成,会比键鼠更费时间;另有人说自己在主机上五分钟就受不了这种烦琐。Le’Veon Bell 的账号被贴出一条推文,大意是大家想赢超级碗时教练在 Minecraft 里建城市;跟帖怀疑那不是本人写的,而是下一条博彩广告的互动诱饵。本次没有打开那条推文。

专有名词解释

  • Minecraft 创造模式:评论中 Tomlin 所说的模式。资源不受生存模式限制,适合长期堆一座城市,而不是打怪或经营物资。
  • 美联北区:NFL 美国足球联合会北区。《卫报》用 2014 年钢人队拿到这个分区冠军,给第一座精品酒店标时间。
  • PNC Park:匹兹堡海盗队的棒球场。文章用它类比 Tomlin 虚拟城市里那座嵌进街区的球场,不是说游戏里复刻了真实球场。
  • The Athletic:HN 的原文链接,属《纽约时报》体育网站。本次抓取返回 403,所以正文依据是《卫报》和讨论,而不是那篇文章。

HN 讨论:thread · 248 分 · 67 评