2026-07-30 Hacker News Top Stories #
- KOReader 是一款功能强大、高度可定制但学习曲线较陡的开源电子墨水屏文档阅读器,能显著改善旧款 Kindle 或 Kobo 的阅读体验。
- 一个 Swift/Metal 写的 Apple Silicon 推理运行时通过 SSD 流式加载专家权重,让 Gemma 4 26B 模型仅需约 2GB 内存即可运行,在 8GB M2 上达 5–6 tok/s。
- 一个 OpenAI 发布的安全工具通过 CLI 和 SDK 自动发现并修复代码漏洞,支持 Node.js 和 Python,适用于交互或 CI 环境。
- 由 Mitchell Hashimoto 等创立的 Superlogical 正在构建一个跨环境的持久会话层终端多路复用器,首期将发布 Web、macOS/iOS 原生应用并支持实时共享。
- 一个用户脚本可在当前页面侧边栏加载对应 HN 讨论,支持注释、浮动按钮、折叠线程等多种功能,避免打开两个标签页。
- Amiga 时代的演示场景工具界面个性鲜明,如 FastTracker II 类似电子表格的 tracker,体现了创新与实用主义的交融。
- 越狱 Kindle 的 Tailscale 客户端新增代理模式和 SSH 功能,可让 KOReader 等应用通过 SOCKS5 或 HTTP CONNECT 访问尾网中的自托管服务。
- 一种新型 AI 蠕虫利用隐藏指令注入 Copilot for Word 自动传播篡改文档,微软至今未能完全封堵。
- 合成波代表音乐人 Kavinsky 在巴黎去世,27日发现,代表作 Nightcall 因电影 Drive 及巴黎奥运会闭幕式而影响深远。
- 《半条命》28年后移植到 Mac OS 9 PowerPC 平台,基于 Xash3D FWGS 引擎,支持完整通关、多人模式及两部资料片。
1. KOReader (KOReader) #
KOReader 是一款专为 E Ink 设备设计的文档查看器,支持 EPUB、PDF、DjVu、XPS、CBT、CBZ、FB2、TXT、HTML、RTF、CHM、DOC、MOBI 和 ZIP 等多种文件格式。
可在 Kindle、Kobo、PocketBook、Android 及桌面 Linux 上运行。页面还提供了用户指南、下载、社区论坛、Bug 报告、开发者文档以及 Logo 画廊等资源链接。
HN 热度 643 points | 评论 206 comments | 作者:Cider9986 | 13 hours ago #
https://news.ycombinator.com/item?id=49095865
- KOReader 用户界面不直观,学习曲线较陡,但功能强大且可定制。
- 对于旧款 Kindle 或 Kobo 设备,KOReader 能显著改善阅读体验,甚至让设备“复活”。
- 存在性能问题,如卡顿、手势操作不灵敏等。
- 电池电量报告比某些原生系统更准确。
- 支持丰富的插件和扩展,如 Project:Title 等,可进一步弥补功能或易用性差距。
- 开源的特性让用户拥有更多控制权和灵活性,但也因此牺牲了用户友好性。
- 相比 Kindle 等原生阅读软件,KOReader 在功能与定制性上胜出,但易用性不如后者。
- 同步功能可通过自行编写软件或借助 Readest 等第三方应用实现。
2. 展示 HN:在任意 M 系列 Mac 上以 2GB 内存运行 Gemma 4 26B 的开源引擎 (Show HN: Open-source engine running Gemma 4 26B in 2 GB RAM on any M-series Mac) #
https://github.com/drumih/turbo-fieldfare
TurboFieldfare 是一个针对 Apple Silicon Mac 的 Gemma 4 26B-A4B 模型推理运行时,采用 Swift 和 Metal 编写。它仅需约 2GB 内存即可运行 260 亿参数模型,通过 SSD 流式加载所需专家权重,无需加载完整的 14.3GB 模型。实测在 8GB M2 MacBook Air 上可达 5.1-6.3 tok/s,24GB M5 Pro 上达 31-35 tok/s。项目提供本地 Mac 应用、命令行界面和 OpenAI 兼容服务器,支持指令对话和函数调用(仅文本),要求 macOS 26、Metal 4 和 Xcode 26。安装时需下载约 15GB 模型文件。
HN 热度 608 points | 评论 214 comments | 作者:gitpusher42 | 9 hours ago #
https://news.ycombinator.com/item?id=49098510
- 不需要将整个模型加载到内存,因为每次只用到一小部分知识,可以像分块文件一样高效解析,但如何确定哪些部分必要是难点。
- 当前前沿 AI 竞赛侧重于推理能力而非成本优化,希望未来研究能更多惠及普通用户。
- 大型模型包含海量知识(如翻译、编程),体积巨大,但用户不必每次都需要所有知识。
- MoE(混合专家模型)可以一定程度上解决知识负载问题,通过激活部分权重。
- 可以通过训练仅针对特定领域(如源代码)的小模型来减少知识量,但可能牺牲通用推理能力。
- 逻辑能力可能来自于训练数据中的变体,而非独立的功能电路,因此难以分离。
- 微调和优化模型以降低内存消耗仍处于早期,技术还不成熟。
3. Codex 安全 (Codex Security) #
https://github.com/openai/codex-security
这是一个由 OpenAI 开发的代码安全工具,提供命令行界面(CLI)和 TypeScript SDK,帮助开发者发现、验证并修复代码中的安全漏洞。项目要求 Node.js 22 及以上、Python 3.10 及以上,并支持通过 npm 安装。
快速开始:运行 npx @openai/codex-security login 登录,然后使用 scan . 扫描当前目录;也可指定模型和扫描强度。支持 ChatGPT 登录或 API Key 认证,适用于交互式和 CI 场景。扫描历史会存储在专用状态目录中。
TypeScript SDK 使用示例:通过 new CodexSecurity() 创建实例,调用 run() 方法扫描并获取报告路径。项目还包含详细的 CLI 帮助、运行时默认值、环境变量、深度扫描配置等文档。
HN 热度 585 points | 评论 223 comments | 作者:bakigul | 1 day ago #
https://news.ycombinator.com/item?id=49089755
- 招聘要求太过模糊宽泛,面试问题简单却仍未被选中,决策过程显得随意。
- 公司可以把职位描述写得更具体,以更快筛选出符合条件的候选人。
- 该职位只是常规的应用开发岗位,并非安全分析岗位。
- 专业应用开发本身就需要理解安全知识。
- 现实中的普遍开发实践恰恰说明很多开发并不重视安全。
- 安全很难,因为与常规开发路径相悖,常被快速迭代所牺牲,但非业余开发确实需要安全意识。
- 大多数公司不自己处理信用卡支付,所以多数开发者不必懂得 PCI 合规;但涉及敏感数据时(如身份证、社保号)仍需要基本安全知识。
- 面试最终是否录取往往取决于主观偏好(“文化契合”),而并非完全客观的标准。
- “文化契合”可能被用来掩盖偏见或歧视,不一定是腐败,但在接受投资的公司中则可能是腐败。
- 面试体验良好,即使最后因为沟通和生病未能成功,招聘人员也很友善。
4. Superlogical (Superlogical) #
Superlogical 正在构建一个面向所有工作的多路复用器(multiplexer),旨在整合本地开发、远程访问、编码代理、后台任务、生产应用、实时调试、沙箱、共享终端、事件响应、人机协作及操作历史。
团队认为,当前工具将交互式工作、自动化工作与生产工作割裂为独立系统,而缺失的是一层持久的会话层,能够跨应用和环境,提供上下文、结构化数据、历史记录,并支持软件驱动且对人可视可控。
计划分三步:1)构建出色的终端多路复用器;2)使其全部可组合;3)确保生产环境的安全与可操作性。初期将发布一款支持 Web、macOS/iOS 原生应用、内置实时共享会话的现代终端多路复用器,并修复现有工具常见的滚动、选择等问题。
团队成员包括 Mitchell Hashimoto(Ghostty 作者、HashiCorp 联合创始人)、Jack Pearkes(HashiCorp 早期员工)、Alasdair Monk(Poolside、Vercel 设计负责人)、Hector Simpson(Poolside 界面设计师)。公司已获得 Notable Capital、Amplify Partners 等投资。
目前已开放首批发布的邮件列表注册,并正在招聘。
HN 热度 473 points | 评论 297 comments | 作者:yan | 8 hours ago #
https://news.ycombinator.com/item?id=49098965
- Mitchellh 将 Ghostty 所有权转移给非营利组织,并基于 libghostty 建立新公司,体现了良好的开源依赖和上游贡献实践。
- 与 Anthropic/Bun 的 Rust 迁移争议相比,Bun 的预发布仍然是开源的,并非独家,负面说法容易被验证为错误。
- HN 上充斥着对 AI 的负面情绪评论,无论是否与事实相符,且快速获得高赞。
- Bun 声称 AI 在 11 天内重写完成,但两个月后仍未发布稳定版,被认为是营销误导。
- AI 重写的代码如果未充分测试就发布稳定版是不负责任的;他们以 canary 形式提供给 Claude Code 用户使用,是合理的软件工程实践。
- Bun 的 Rust 重写并未宣布完成,只是集成测试通过,批评者可能基于标题而非实际内容做出判断。
- 还有其他类似工具如 pi-web、herdr、firstmate 等可供使用。
5. Show HN:我厌倦了为每个 HN 链接打开两个标签页,所以我写了一个用户脚本 (Show HN: I was tired of opening 2 tabs for every HN link, so I made a userscript) #
https://github.com/twalichiewicz/HNewhere
HNewhere 是一个轻量级用户脚本,可为任意网页自动检测对应的 Hacker News 讨论,并在侧边栏中加载评论,无需离开当前页面即可浏览。当前版本 v1.5.0 支持引用链接的文章注释、可调整大小的侧边栏、可拖动的浮动按钮、折叠线程、新评论高亮、OP 标记、多匹配混合视图等功能。需安装 Tampermonkey 等用户脚本管理器,并依赖 HN API 和 Algolia 搜索 API。项目采用 MIT 许可,拥有 174 颗星标和 3 位贡献者。
HN 热度 407 points | 评论 114 comments | 作者:twalichiewicz | 1 day ago #
https://news.ycombinator.com/item?id=49090607
- 功能 2 非常有用,当文章曾在 HN 被分享时,能找到现有讨论并显示,有时讨论甚至会反驳文章的主要观点
- 功能 1 不太有用,它只是表明人们不擅长窗口管理,多窗口查看问题应由桌面层解决,而非应用层
- 社区倾向在应用层解决问题,但浏览器强制使用标签页,不允许用户完全禁用标签功能
- 标签页组织方式应具有应用特异性,如树形标签页等,但用户应有权选择是否使用标签页
- 功能 2 作为 HN 网站内置功能实现会更好,无需浏览器扩展
- 使用窗口管理器管理大量标签页不现实,用户常需打开数百个标签页,需要树形标签页和分栏等功能
- 窗户管理器应能跨应用将窗口分组为标签页或分栏,实现统一管理
- 若由窗口管理器处理标签页,会导致 Alt+Tab 混乱,且无法支持应用各种复杂的标签页类型
- 理想是由操作系统结合 Sidebery(树形标签页)和平铺窗口管理器统一管理所有标签页
- 已有开发者创建了 Chrome 扩展实现功能 2,显示当前 URL 在 HN 的讨论和点赞数
6. 演示场景的用户界面 (User Interfaces of the Demo Scene) #
https://www.datagubbe.se/scenegui/
该网页是一篇名为《User Interfaces of the Demo Scene》的文章,副标题为“Exploring the tools of the trade”,发表于 2026 年 7 月。文章介绍了演示场景(demo scene)中各种自制工具的奇特用户界面,主要聚焦于 Amiga 平台,也涉及 Commodore 64、Atari ST 和 MS-DOS。
内容分为几个部分:
- Elite Sinus Producer:一个用于生成正弦波查找表的工具,界面有夸张的 F 键菜单和闪烁的帮助屏幕。
- 文本界面工具:包括汇编器 Seka、Asm-One 及其衍生版本,以及内存提取工具(如 Multi-Ripper 和专门恢复崩溃后源代码的工具)。
- 音乐跟踪器:从 SoundMonitor(C64)开始,到 NoiseTracker、ProTracker(Amiga),再到 Digicomposer(Atari ST)、Fasttracker II(MS-DOS)、Abyss’ Highest Experience(Amiga)、Megatizer(Atari ST)、JamCrackerPro(Amiga)等,展示了跟踪器界面的演变和多样性。
- 磁盘复制工具:如 X-Copy,用于复制非标准格式的磁盘(演示和盗版软件)。
文章强调这些工具界面反映了场景文化中的创新、对美学的追求以及实用主义,许多界面设计令人费解但充满个性。
HN 热度 393 points | 评论 69 comments | 作者:zdw | 19 hours ago #
https://news.ycombinator.com/item?id=49093434
- FastTracker II 的界面在屏幕空间有限时依然直观且富有触感,用户甚至手动复制通道来制造回声效果。
- 有人觉得 tracker 并不直观,认为 Pure Data 这类工具更接近 arcane 而非 intuitive。
- 另一位认为 tracker 在完成作品后的工作流上比 DAW 更直观,像编辑电子表格,与节点式 UI 的体会类似。
- 有限工具反而带来乐趣,例如小型合成器 Volca 系列。
- 众多 demoscener 来自欧洲,因此使用拉丁词“sinus”而非英语“sine”来称呼正弦波,挪威、瑞典、丹麦、荷兰、法语、波兰、西班牙、保加利亚、德语等语言均如此。
- FastTracker 和 ImpulseTracker 的 UI 堪称艺术与工程杰作,尤其是乐器及样本编辑器,即便在今天仍不过时。
- 现代 AI 在生成 ASCII/ANSI 艺术方面表现糟糕,需要更好的训练数据;有人曾在办公打印机网页上做 ASCII 涂鸦。
- 反对将 AI 用于 ASCII 艺术创作,认为只有 lamers 才需要,sceners 与此无关。
- 怀旧细节:咖啡机演奏“Smoke on the Water”旋律、软驱声音、打印机灯光摩尔斯码。
- “那时”的 tracker 如今仍可买到全新 Polyend Mini 这样的设备。
- X-Copy 完成复制时播放的“boing”音效使用了 Paula 芯片的 attached 模式,技术细节有趣。
- X-Copy 和 D-Copy 是早期接触磁盘碎片整理概念的来源。
- 提到 Pastor Emmanual Laphroaig 和 phRack crew 继续传承 demo 文化。
- 文中未提及的 ScreamTracker 是第一个 DOS tracker,拥有独特文本 UI,是 demo 组 dogfooding 的典范。
- 16 岁时与朋友用 AsmOne 制作了 Multi-Ripper,并因嵌入电话号导致父母被陌生人骚扰。
- 过度追求统一 UI 损失了很多可能性;自定义 UI 需要设计能力,dogfooding 是改进的有力手段,Winamp 受此影响。软件选择减少导致同质化。
- 有人是 6502/MC68000 汇编程序员,希望有类似文章介绍 demo 构建工具如 kkrieger 和 Tixl。
- FR 团队已开源其工具集源代码,包含一些概念描述和链接(如 werkkzeug、kkrunchy 等)。
7. 为你的越狱 Kindle 带来更多 Tailscale 技巧 (More Tailscale tricks for your jailbroken Kindle) #
https://tailscale.com/blog/jailbroken-kindle-proxy-tun-modes
越狱版 Kindle 上的 Tailscale 客户端迎来重要更新,由社区开发者 Mitanshu Sukhwani 和 greywolf1499 改进。新版本带来三项核心功能:默认启用 Tailscale SSH(无需 USBnetworking SSH 及默认密码);代理模式让 KOReader 等应用通过 SOCKS5 或 HTTP CONNECT 代理(127.0.0.1:1055/1056)访问尾网其他节点,如 Calibre/OPDS、Wallabag、Audiobookshelf 服务器;全 TUN 模式在部分 Kindle 上实现设备级网络路由。
代理模式的工作原理:启动 Tailscale 后,在 KOReader 中配置代理地址,应用请求会经过 tailscaled 守护进程路由到尾网。这极大扩展了越狱 Kindle 的用途:连接自托管内容服务器、同步阅读进度、使用蓝牙键盘 SSH 进入尾网设备等。
此外还有专门的 KOReader Tailscale 插件,支持 Kindle PW5/PW6、Kobo 和 PocketBook。安装方式:将插件复制到 KOReader 插件目录,从菜单触发安装,复制 Tailscale 密钥,然后在 KOReader 中开启代理并配置地址。插件还可配合 SyncThing 实现跨设备同步。
文章鼓励读者分享自己的创意用法,并提供了社区联系方式。
HN 热度 385 points | 评论 108 comments | 作者:Error6571 | 19 hours ago #
https://news.ycombinator.com/item?id=49093569
- KOReader 功能强大,可高度自定义,但 UI 设置菜单混乱,不易找到特定选项,学习成本高
- KOReader 文件浏览器视图体验差,不如默认的图书馆视图,但可通过插件改善
- Tailscale 用于远程 SSH 管理 Kindle,将其视为家庭实验室的一部分,提升了便利性
- Kindle 旧款设备体验良好,但近年产品可能有所退化,部分用户仍满足于默认功能
- KOReader 支持多设备同步进度,且在处理格式不佳的电子书和 PDF 时表现优秀
- 对于不常折腾的用户,默认阅读器已足够,抗拒额外设置和干扰
8. 文档传播的 AI 蠕虫可通过 Copilot for Word 自我复制 (Document-borne AI worms can self-propagate through Copilot for Word) #
https://enklypesalt.com/posts/context-collapse-part3-ai-worming-through-word/
该网页是一篇发布于 2026 年 7 月 28 日的博客文章,属于“Context Collapse”系列第三篇,作者为 Håkon Måløy。文章披露了一种针对 Microsoft Copilot for Word 的新型 AI 蠕虫攻击(自传播跨域提示注入攻击,XPIA),这是主流商业办公套件中首次公开演示的文档自传播 AI 蠕虫。
攻击者可将恶意隐藏指令嵌入一份外部文档,当用户将该文档作为 Copilot 的参考资料时,Copilot 可能错误地将这些指令视为用户请求的一部分,从而篡改当前正在编写或编辑的文档,并将恶意指令复制到新文档中。被感染的新文档在后续 Copilot 工作流中继续传播,即使原始恶意文档已不在场,攻击仍可自我延续。文章举了财务报告被篡改并扩散的例子。
文章详细说明了与微软安全响应中心(MSRC)的协调披露过程:2026 年 3 月 6 日提交报告,经历了 144 天的协调期,期间微软两次尝试缓解(包括 2026 年 4 月 3 日更新“Edit with Copilot”体验、2026 年 7 月 14 日升级模型至 GPT-5.5),但均未能完全封堵该漏洞类,攻击在最新模型 GPT-5.6 上仍可复现。截至发布时,微软尚无可靠的缓解措施,客户只能通过将外部文档视为不可信、仔细审查 Copilot 生成/编辑的文档来降低风险。
HN 热度 325 points | 评论 249 comments | 作者:Canopy9560 | 12 hours ago #
https://news.ycombinator.com/item?id=49096188
- 直到停止将指令与数据混为一谈,这类问题永远无法修复,Von Neumann 架构的隐患重现。
- 使用 AI 模型的人普遍不关心安全影响,让代理拥有完全不受限制的系统访问权限是自找风险。
- 可以通过在训练数据中加入指令权限级别来模糊修复,但模型本身是模糊的,不要期望更多。
- 已证明可以伪装成模型自身的“思考”来欺骗模型将用户输入视为指令,标签防护并不牢靠。
- 微软能否在用户和模型间加一层确定性解析?但解析什么?模型对任意输入有任意理解,安全的唯一方法是过滤所有内容。
- 对通用智能系统而言,将指令与数据分离在哲学上不可能,不应因此分散对 LLM 具体问题的关注。
- 这更接近“Outlook 运行不受信任的 VBA 宏”,而非“智能实体被人类语言歧义混淆”。没有关宏的按钮,主要用例就是读取文档,无法避免。
- 问题根源不是自然语言歧义,而是 LLM 对恶意文本缺乏足够安全措施。人类也会被社会工程学骗,但攻击面不同:LLM 能解析人类看不见的文本(base64、Unicode、隐写等),攻击面极大扩展。
- 提示注入不是 SQL 注入那样的软件工程问题,它本质上是社会工程学,将 LLM 当作常规软件是根本性的分类错误。
- 独立非确定性模型无法像确定性代码那样被约束,两者本质不同。
9. 法国音乐家 Kavinsky 被发现死亡 (French musician Kavinsky found dead) #
Euronews 是一个多语言欧洲新闻网站,涵盖欧洲、世界、商业、旅行、科技、文化、地球、健康等类别。当前首页突出最新新闻:数百名移民从摩洛哥游向西班牙领土、三名消防员在希腊野火中丧生、美联储维持利率不变但有三位决策者要求加息。热门话题包括美国-以色列对伊朗 2026 行动、乌克兰战争、法国、野火、西班牙、气候变化等。网站还提供多个专题节目,如《Europe Today》《The Ring》《No Comment》等,以及播客、视频和实时新闻服务。
HN 热度 319 points | 评论 73 comments | 作者:bristleworm | 12 hours ago #
https://news.ycombinator.com/item?id=49096290
- Kavinsky 是电子音乐博客时代的偶像,与 Ed Banger 团队一起成为 bloghouse 时代的标志性人物,他的去世令人悲伤。
- 那个时代的 DJ 普遍滥用药物、睡眠不足、长途飞行和时差,对身体造成巨大负担,他的去世并不令人意外。
- 他在推广合成波(Synthwave)音乐和视觉美学方面功不可没,其专辑《OutRun》甚至命名了合成波的一个子流派。
- 《Nightcall》是他的代表作,通过电影《Drive》被广泛认知,成为许多人青春时期的 anthem。
- 他在 2024 年巴黎奥运会闭幕式上表演《Nightcall》,让很多人开始接触并喜欢上合成波音乐。
- 合成波的名字可能起源于“波”类音乐流派(如暗波、冷波),或与电子游戏《Out Run》有关,卡文斯基的专辑同样致敬了这款游戏。
- 有评论提到,早期合成器便宜(如 2002 年 Juno 60 仅售 400 美元),促进了 2000 年代巴尔的摩音乐场景中合成器的流行。
- 法国音乐人 Gojira 在奥运会开幕式上的表演同样被认为极为震撼。
10. 《半条命》移植到 Mac OS 9 (Half-Life ported to Mac OS 9) #
https://mac-classic.com/news/half-life-ported-to-mac-os-9/
Half-Life 终于被移植到 Mac OS 9 的 PowerPC 平台,距离原版发布已过去 28 年。这是一款剧情驱动的第一人称射击游戏,玩家扮演科学家戈登·弗里曼在 Black Mesa 研究所中求生。Valve 曾在 1999 年计划为 Mac OS 9 发布,后取消,直到 2013 年才推出 Intel Mac 的 OS X 版本。本次移植由 GitHub 用户 doctashay 基于 Xash3D FWGS(GoldSrc 引擎的重现)完成,可完整通关,支持多人模式,并包含 Uplink 试玩版以及 Blue Shift 和 Opposing Force 的下载。支持 G3/G4 PowerPC 及 Mac OS 9.0 以上系统,性能取决于显卡显存(低于 8MB VRAM 可能卡顿)。该成果被认为是 Mac 游戏社区的重大突破。
HN 热度 298 points | 评论 153 comments | 作者:freediver | 1 day ago #
https://news.ycombinator.com/item?id=49089814
- Half-Life 移植到 Mac OS 9 令人惊讶,其实早有未授权的 Quake 移植先例。
- TIE Fighter 的 Mac 版竟意外保留了 68k 代码,让老款 Quadra 610 也能运行。
- WarCraft 1 需要 640x480 显示器,而 Mac LC 只有 512x384,只能借用父母的电脑玩。
- DOS 版 TIE Fighter 需要特定硬件配置,低配 386SX/16 只能开平面着色。
- 在弱性能的 Perfroma 560 上找 Mac 游戏非常困难,商店里大多是教育软件或劣质游戏。
- 在 Best Buy 偶然提前发现 Duke Nukem 3D 的 Mac 版,极为惊喜。
- Mac 游戏选择少,但质量往往更高,如 Marathon 是 Mac 用户的骄傲。
- Mac 版游戏画质和音质常优于 DOS 版;Command & Conquer 的 Mac 版是 640x480,DOS 版是 320x240;Mac 有 CD 音频,而 DOS 用 MIDI 或 PC 喇叭。
- Half-Life 的 Mac 移植本已完成但于 1999 年被取消,令人惋惜。
- 软件只要有时间和资源就能移植,很多现代技术本可在 90 年代实现。
- Half-Life 最终在 2000 年由 Logicware/MacPlay 正式移植到 Mac OS。
Hacker News 精彩评论及翻译 #
Claude: Elevated errors across all models – Resolv… #
https://news.ycombinator.com/item?id=49102404
I’m gonna guess it found the smoking gun and saw the full picture then it decided it was too load-bearing for its seams to continue biting the costs.
hmokiguess
我猜它找到了铁证并看清了全局,然后认为这对它的接缝来说承重过大,无法继续承担成本了。
Claude: Elevated errors across all models – Resolv… #
https://news.ycombinator.com/item?id=49102527
You’re right—and it’s worth calling out explicitly, because that completely changes the approach here.
km144
你说得对——而且这一点值得明确指出来,因为它完全改变了这里的处理方式。
Substack writers, you need a website #
https://news.ycombinator.com/item?id=49087178
Counterpoint from someone who’s been publishing on the internet for decades: no one will visit your website. It’s as simple as that. You need a push mechanism to reach readers.
RSS could be it, but it’s too niche. Social media is kinda it, but algorithmic feeds reward political clickbait and just because someone clicks “follow” or “subscribe” is not a guarantee that they will ever see your posts. Substack gives you a way to push content to your subscribers without an intermediary deciding what they get to read.
So no, there’s no special value to having a website or syndicating across the web. There’s a lot of value in backing up your Substack subscribers’ emails so that you can move somewhere else down the line, and the nice thing about Substack is that they let you do that. If they stop, that’s a trap.
skippyfish
来自一位在互联网上发布了数十年内容的人的反驳:没人会访问你的网站。就这么简单。你需要一种推送机制来触达读者。
RSS 可能是一种方式,但它过于小众。社交媒体也算一种,但算法推送会奖励政治点击诱饵,而且某人点了“关注”或“订阅”并不能保证他们能看到你的帖子。Substack 提供了一种方式,让你无需中间人决定读者能看到什么,就能将内容推送给订阅者。
所以,不,拥有一个网站或在网络上进行内容分发并没有特殊价值。备份你的 Substack 订阅者邮箱有很大的价值,这样你将来可以迁移到其他地方,而 Substack 好的一点是它允许你这么做。如果他们停止这样做,那就是一个陷阱。
Superlogical #
https://news.ycombinator.com/item?id=49100329
I really like the bit where he transferred ownership of Ghostty to a non-profit, and is now building this new company on that as an open source dependency:
We will build on libghostty exactly as it was designed to be used: as a public building block for terminal applications. Superlogical will consume the same MIT-licensed components available to everyone else, and we will continue to upstream shared terminal work so every libghostty consumer can benefit.
simonw
我非常喜欢他这部分做法:将 Ghostty 的所有权转让给一个非营利组织,然后在此基础上建立这家新公司,将其作为开源依赖:
我们将严格按照 libghostty 的设计初衷来使用它:作为终端应用的公共构建模块。Superlogical 将使用与其他所有人相同的 MIT 许可组件,并且我们将继续向上游贡献共享的终端工作,以便每个 libghostty 的使用者都能受益。
Document-borne AI worms can self-propagate through… #
https://news.ycombinator.com/item?id=49097067
“At the time of publication, no robust mitigation for the broader vulnerability class is available”
Isn’t it obvious by now that it’s never going to be possible to fix this kind of thing, at least until we stop mixing up instructions with data.
rwmj
“在发布时,针对这一更广泛漏洞类别尚无稳健的缓解措施”
到现在还不明显吗?除非我们停止将指令与数据混为一谈,否则这类问题永远无法修复。
A $500 RL fine-tune of a 9B open model beat fronti… #
https://news.ycombinator.com/item?id=49079325
The point that the major labs don’t seem to get is that the vast majority of use cases simply don’t need models that have 50 PhDs and can speak 12 languages. Most use cases are defined within constraints where costs matter a lot.
As open weight models and cheap fine tuning services become the norm the whole economic framework of these mega models the labs are in an arms race building just completely crumbles. As does the economic picture that justified the massive infrastructure building that’s now broadly funded by a complex network of debt.
This is what makes open weight models so threatening to them. The political and “it’s China” angle is mostly just a cover for the real reasons why they’re freaked out.
The fact that models are now a pure commodity is bad enough for the big labs. If small open weight models become the norm the big labs are toast.
cmiles8
大型实验室似乎没有意识到,绝大多数使用场景根本不需要拥有50个博士学位、能说12种语言的模型。大多数用例都在成本至关重要的约束范围内。随着开放权重模型和廉价微调服务成为常态,这些实验室正陷入军备竞赛的巨型模型的经济框架将完全崩塌。同样崩塌的还有支撑大规模基础设施建设的经济图景——这些建设如今正由复杂的债务网络广泛资助。这正是开放权重模型对它们构成威胁的原因。政治和“中国因素”的角度,很大程度上只是掩盖它们恐慌真实原因的幌子。模型如今已成为纯粹的商品,这对大型实验室来说已经够糟了。如果小型开放权重模型成为常态,这些大型实验室就完蛋了。
Discovering Cryptographic Weaknesses with Claude #
https://news.ycombinator.com/item?id=49088205
I find that some of my friends and acquaintances have gotten obsessed with prompting style, “prompt engineering”, which skills to use, which skills to build, “context engineering”, and a billion other variations on “how to write smart things so the model does good”.
Friends, look at the prompts that Anthropic’s own people are putting into the machine:
A few hours after the first message, we found that Claude was still searching for simple attacks and sent a message: “no again the goal is that we have highly inteligent [sic] model as good top researcher, we want to find new attacks”;
The next morning, Claude wanted to try to change the target to a different cipher; we reminded the model: “no we don’t want to change the targets […] agian [sic] we need to find something that worth [sic] publishing”;
That night, we sent one final message offering words of encouragement: “again we are not looking for low hanging fruit, we want proper research to find genuinly [sic] hard findings.”
All of that RLHF and fine-tuning effort is going toward making prompts like this, or worse, work with no fuss.
_dwt
我发现身边一些朋友和熟人已经沉迷于提示风格、“提示工程”、该用什么技巧、该构建什么技巧、“上下文工程”,以及无数种关于"如何写出聪明的东西让模型表现良好"的变体。
朋友们,看看Anthropic自家员工往机器里输入的是些什么提示:
“在第一条消息发出几小时后,我们发现Claude仍在寻找简单的攻击方式,于是发了一条消息:‘不,我们的目标是拥有一个像顶尖研究员一样高度智能的模型,我们要寻找新的攻击方式’;”
“第二天早上,Claude想尝试将目标改为另一种密码,我们提醒模型:‘不,我们不想更改目标[…] 再次说明,我们需要找到值得发表的东西’;”
“那天晚上,我们发送了最后一条鼓励的消息:‘再次强调,我们不是在找低垂的果实,我们要的是真正的研究,找到确有难度的发现。’”
所有那些RLHF和微调的努力,正在让这类(甚至更糟的)提示变得能毫无障碍地工作。
New HIV vaccine shows unprecedented success in pre… #
https://news.ycombinator.com/item?id=49084019
The most interesting point of the article for me is that this vaccine appears to be a series of shots which act as a curriculum for the immune system. Each one slightly different and targeting a different stage of B-cell development. I’ve never thought of vaccine series working like that, so it was a new and impressive idea.
iandanforth
这篇文章最有趣的点在于,这种疫苗似乎是一系列注射,为免疫系统提供课程。每一针略有不同,针对B细胞发育的不同阶段。我从未想过疫苗系列可以这样运作,所以这是一个新颖且令人印象深刻的想法。
Our position on open-weights models #
https://news.ycombinator.com/item?id=49077487
This Onion meme is perfect; you could easily replace Sam with Dario: https://theonion.com/sam-altman-if-i-dont-end-the-world-someone-far-more-dangerous-will/
rubslopes
这个洋葱新闻的梗太贴切了;你完全可以把Sam换成Dario:https://theonion.com/sam-altman-if-i-dont-end-the-world-someone-far-more-dangerous-will/
Delayed Gratification – Proud to Be ‘Last to Break… #
https://news.ycombinator.com/item?id=49087845
One thing that has really frustrated me with “mainstream media” in the last few years is that the level of effort being put into journalism seems to be on decline. I feel like half of the news articles are just a collection of quotes from officials or politicians in public statements, being regurgitated without any additional effort. Outrageous claims are just taken at face value, or at best just put alongside quotes from other officials/politicians saying the opposite. As an example, how many times has the strait of Hormuz been declared open by the US, when it turns out it really wasn’t? And every time these low-effort articles just echo that statement without even trying to evaluate if that is true. I mean, the transponder data on shipping is publicly available, there’s a dozen websites you could use to actually see passage through the strait to verify the claim. If you don’t do even the most basic follow ups, is that even a news article? Or is it just a more elaborate form of re-tweeting?
openasocket
过去几年里,“主流媒体”让我非常失望的一点是,它们在新闻上投入的努力似乎越来越少。我觉得一半的新闻文章都只是把官员或政客公开声明中的话拼凑起来,不加任何额外功夫就原样照搬。那些离谱的言论被直接当真,顶多旁边再放上其他官员或政客相反的说法。举个例子,美国宣称霍尔木兹海峡“开放”了多少次,可事实却并非如此?每次这些敷衍的文章都只是重复那些声明,甚至懒得去核实真假。要知道,船舶的应答器数据是公开的,有几十个网站可以查船只通过海峡的实际记录来验证这种说法。如果连最基本的跟进都不做,那这还能叫新闻吗?还是说这不过是一种更高级的“转发”而已?
VMs can’t boot with Network Mode set to Bridged on… #
https://news.ycombinator.com/item?id=49085648
Classic GitHub issue thread: Someone shows up and tries to explain it’s not a bug and never could have worked. Everyone else points out that it does work on other Mac hardware. Person doubles down and tries to claim that the bug was that it ever worked, and not working is the correct behavior. New Mac OS beta release fixes the bug and makes it work. Nothing related to the repo was changed.
Aurornis
经典的GitHub issue讨论串:有人出现并试图解释这不是一个bug,而且这个功能本来就不可能正常工作。其他人指出它在其他Mac硬件上确实能工作。此人加倍坚持,声称bug在于它曾经能工作,而不能工作才是正确行为。新的macOS测试版发布修复了该bug,使其恢复正常。与该仓库相关的任何内容都没有更改。
Our position on open-weights models #
https://news.ycombinator.com/item?id=49079621
I was a genetic engineer for ~20 years and have worked on frontier LLMs for the last 8. I used to engineer viral vectors and studied how to evade human immune systems for gene therapies…
The biorisk scenarios that the AI safety folks flog are fever-dreamed fantasies that have only the most tenuous connection to biological reality. As someone who cares about the real bio-risks of natural pathogens, I get pretty tired of fear-based marketing pretending that AI is a bigger threat than, say, animal agriculture.
alevskaya
我做了大约20年的基因工程师,过去8年一直在研究前沿大语言模型。我曾设计病毒载体,研究如何规避人体免疫系统以进行基因治疗……
AI安全人士鼓吹的那些生物风险场景,不过是些与生物现实仅有最微弱关联的狂热梦呓。作为一个关心自然病原体真正生物风险的人,我对那种把AI说成比畜牧业等更严重威胁的恐惧营销感到非常厌倦。
Choose DuckDB rather than SQLite #
https://news.ycombinator.com/item?id=49097996
DuckDB’s columnar engine
That is workload specific. Title should be “Choose DuckDB rather than SQLite for Analytics” IMHO
brightball
DuckDB的列式引擎,那是针对特定工作负载的。标题应该是“分析场景选DuckDB而非SQLite”,依我看。
New HIV vaccine shows unprecedented success in pre… #
https://news.ycombinator.com/item?id=49084571
You could say the same about teen pregnancy being a practically solved problem, except there is still the problem of teen pregnancy. Or even something more mundane as driving consistently safely all the time to solve the problem of accidents.
If everyone was disciplined all the time in regard to everything, many problems in the world would simply not exist. But we live in reality where for whatever reason, people don’t know to do something, or they do know and they’re just not disciplined, or they make a mistake due to extenuating circumstances. And I would expect that the vast majority of people would oppose any idea of somehow punitively “dealing with” people who get some things wrong.
So I would say that it’s very evidently not a practically solved problem, because if it were we wouldn’t be looking to solve it still.
Within this reality, a vaccine is a great additional tool at solving the problem of preventing the spread of HIV.
jonathanlydall
你可以用同样的话来评论青少年怀孕问题——它几乎是一个已解决的问题,除非青少年怀孕的问题依然存在。或者甚至更普通的事情,比如始终安全驾驶以解决事故问题。
如果每个人在所有事情上都能一直保持自律,世界上的许多问题根本就不会存在。但我们生活在现实中,出于某种原因,人们要么不知道该如何做,要么知道却缺乏自律,要么因情有可原的情况而犯错。而且我认为绝大多数人会反对任何以惩罚性方式“处理”那些做错事情的人的想法。
所以我要说,这显然不是一个几乎已解决的问题,因为如果真是这样,我们就不会仍在试图解决它。
在现实中,疫苗是预防HIV传播问题的一个极好的额外工具。
Our position on open-weights models #
https://news.ycombinator.com/item?id=49083257
Ban distillation of our outputs, but our distillation of the sum-total of civilisation’s intellectual output – proprietary or otherwise – is fair use?
Either everyone licenses, or nobody does. And if you can’t enforce licensing bans for everyone, the de-facto loser is those who you’d probably want to support the most, start-ups and universities, while your adversaries gain the upper hand.
The strongest argument for restricting distillation is arms control – but distillation is the way to defeat GPU embargoes. So, distillation goes on regardless. Only pre-training is seriously attenuated.
If we’re honest, the models are compressions of everything society has ever written. A few large corporations can’t own that, no more than they can claim copyright for a zip file of the public library.
The genie is out of the bottle, now. So open it up – inputs and outputs, forward-looking – for everyone.
tcldr
禁止对我们输出的内容进行蒸馏,但我们蒸馏整个人类文明的知识产出——无论是专有还是其他——就属于合理使用?
要么所有人都授权,要么谁都不授权。如果你无法对所有人执行许可禁令,实际上的输家就是你最想支持的那些人——初创公司和大学——而你的对手反而占了上风。
限制蒸馏最有力的理由是军备控制——但蒸馏恰恰是破解GPU禁运的方法。所以蒸馏无论如何都会继续下去。只有预训练会受到严重削弱。
诚实地说,这些模型不过是社会所有文字的压缩包。几家大公司不能独占它,就像他们不能为公共图书馆的压缩文件主张版权一样。
现在,精灵已经钻出瓶子了。所以,把它打开——输入和输出都开放,着眼未来——让所有人都能使用。