2026 07 29 HackerNews

2026-07-29 Hacker News Top Stories #

  1. Anthropic澄清不主张全面禁止开放权重模型,但担忧中国军事优势与滥用风险,并呼吁芯片管制、打击蒸馏和强制安全测试。
  2. 日本熊本发生7.1级强震,造成多人伤亡和建筑损毁,凸显地震带半导体设厂风险及燃气次生灾害问题。
  3. 新型HIV疫苗在灵长类动物中成功诱导广泛中和抗体,人类试验已启动,有望应对病毒伪装和快速突变挑战。
  4. 欧洲公民倡议呼吁数字身份与年龄验证需自愿、隐私保护、非歧视,防止强制全民监控。
  5. Netflix前高管因在团队信任练习中透露使用氯胺酮治疗抑郁症而被解雇,起诉公司歧视并质疑沉迷饮酒文化的双标。
  6. Claude模型在SlopCodeBench基准测试中仅获24%严格通过率,表明积累式编码任务仍需人类引导。
  7. 加拿大男子因警方传票中一个下划线之差被误判儿童引诱罪入狱18个月后获无罪撤销。
  8. Substack作者应建立独立网站以脱离平台控制,用POSSE策略保持内容与读者永久自主权。
  9. 法院驳回谷歌以DMCA反规避条款阻止爬取无版权搜索结果的企图,强调不能滥用法律保护公开数据。
  10. 作者体验自托管的开源代码模型后感到掌控与自由,类似于从复杂编辑器回归简洁工具的愉悦。

1. 关于开放权重模型我们的观点 (Our position on open-weights models) #

https://www.anthropic.com/news/position-open-weights-models

Anthropic CEO Dario Amodei 在 2026 年 7 月 27 日发表文章,明确澄清:Anthropic 从未主张禁止开放权重模型。他认为,不具有危险能力的开放权重模型是公共产品,能提供商业和研发价值。

但文章指出了两大担忧:

  • 一是中国可能利用比美国更强的 AI 模型实现军事优势和深度压制,这与模型是否开放权重无关。
  • 二是开放权重模型可能更易被滥用进行网络或生物攻击,且难以约束。

针对这些风险,Amodei 支持三项措施:1)禁止向中国出售先进芯片和芯片制造设备,打击走私;2)打击工业级蒸馏操作(distillation),防止中国通过蒸馏绕过芯片禁令;3)所有足够强大的模型(无论开源还是闭源)都应接受强制安全测试,尤其针对网络、生物及对齐风险。

他同时回应了支持开放权重的公开信:认同开放权重促进竞争和用户控制,但不同意“开放权重必然更易开发安全措施”的观点,认为攻击-防御不对称性(如生物武器)可能更严重,应通过实证测试而非假设来决定。最终立场:不主张全面禁止开放权重,而是聚焦芯片管控、蒸馏规制和强制安全测试。


HN 热度 1146 points | 评论 1684 comments | 作者:surprisetalk | 1 day ago #

https://news.ycombinator.com/item?id=49076057

  • Anthropic CEO 反对开源模型,实为保护自家闭源模型的高利润,一旦开源模型放开,其估值将蒸发。
  • 关于中国的威胁论,很多非美国人士也会用同样理由指控美国,国家间军备竞赛加政企勾结对用户不利。
  • Hugging Face 被攻击时,因美国模型的安全限制无法获得帮助,只得用中国开源模型;Anthropic 想给开源模型也加安全限制,只会拖延问题。
  • 这些威胁论是精心策划的宣传,因为 Anthropic 模型能力已无法再提升,Fable 和 Sol 其实很平庸。
  • AI 可能会自己创造漏洞、自己攻击、自己修复,形成自循环;在无监督基准测试中 AI 会通过利用漏洞作弊。
  • 美国情报机构可能已在利用 AI 进行公众操纵,类似《美丽新世界》的愚民控制。
  • 对未经证实的阴谋论不应默认相信,理性的人应在缺乏证据时不下结论。
  • 整个 AI 领域的信息都是被操纵的,公众被喂食刻意设计的宣传。
  • 缩写 HF(Hugging Face)造成阅读障碍,首次引用时应写全称。

2. 日本熊本县发生 7.1 级地震 (7.1 Earthquake in Japan) #

https://www.data.jma.go.jp/multi/quake/quake_detail.html?eventID=20260728163528&lang=en

2026 年 7 月 28 日 16 时 27 分,熊本县熊本地区发生震源深度 10 公里、震级 7.1 的地震(纬度 32.6N,经度 130.7E)。最大震度 7 级出现在熊本县宇城市、冰川町;震度 6+ 及 6-覆盖熊本、长崎、鹿儿岛等多地;震度 5+ 至 1 广泛波及九州、中国、四国及近畿部分地区,包括福冈、佐贺、宫崎、山口、爱媛、大分、鸟取、岛根、冈山、广岛、高知、爱知、大阪、兵库等县。


HN 热度 768 points | 评论 202 comments | 作者:krembo | 16 hours ago #

https://news.ycombinator.com/item?id=49080664

  • 至少 50 人住院,9 人失踪,12 栋房屋倒塌,多座公路桥断裂,道路受损,AEON 商场发生爆炸,工厂烟囱倒塌,多家半导体工厂疏散,熊本城石墙受损。
  • 约 46000 户断电,影响老年人居家医疗设备和空调使用。
  • 将半导体工厂建在已知地震带是否明智?日本工厂因研发和客户聚集而设,选择亚利桑那等地则出于安全考虑。
  • NERV(源自 EVA 动漫)是实际的地震信息服务,2011 年东日本大地震时从推特账号发展为正式服务,其 App 比官方更早发出警报。
  • 可通过 EarthquakesJapan 网站或 NERV App 实时追踪地震。
  • 熊本部分地区震度达到最高等级 7,极强。
  • NHK 画面显示纸厂烟囱倒塌、桥梁路面分离、道路裂缝、火灾、排水管喷水等严重破坏。
  • AEON 购物中心屋顶坍塌,疑似燃气爆炸,已发现多具遗体。
  • 燃气管道在地震中风险大,而全电化虽有更多自动安全措施,但日本因电价较高、传统炊具(如土锅、铝锅)不适配电炉、以及燃气烹饪偏好而推广缓慢。
  • 感应电磁炉电路板复杂、故障率高,建议购买便宜简单的型号;电压力锅、空气炸锅等可简化厨房设备。

3. 新型 HIV 疫苗在临床前研究中取得前所未有的成功 (New HIV vaccine shows unprecedented success in preclinical study) #

https://www.lji.org/news-events/news/post/new-hiv-vaccine-shows-unprecedented-success-in-preclinical-study/

La Jolla 免疫研究所和 Scripps 研究所的科学家开发出一种新型 HIV 疫苗,在非人灵长类动物中成功诱导出大量能广泛中和病毒的抗体,这是迄今最有效的 HIV 疫苗临床前结果,相关研究发表在《自然》杂志上,人类试验已启动。

该疫苗针对 HIV 的三大难题:伪装的糖分子外衣、快速突变、感染后改变形状。研究团队通过追踪罕见但有效的 B 细胞成熟过程,设计出能诱导 B 细胞产生针对 HIV 包膜蛋白关键位点的广泛中和抗体。这种“训练”策略使原本罕见的免疫反应成为主流,在灵长类中实现了前所未有的抗体应答。


HN 热度 539 points | 评论 233 comments | 作者:codebyaditya | 11 hours ago #

https://news.ycombinator.com/item?id=49083314

  • 这种疫苗通过一系列注射,像课程一样逐步引导免疫系统,针对 B 细胞发育的不同阶段,是一种新颖的方法。
  • HIV 通过诱骗免疫系统产生针对假目标的抗体来逃避有效抗体,而“种系靶向”多针疫苗旨在刺激那些能攻击病毒正确部位的稀有 B 细胞。
  • 需要引导 B 细胞从初始状态逐步突变到能产生有效抗体的最终状态,中间状态通常不会被自然促进,因此需要疫苗干预。
  • 这种绕过病毒诱骗策略的技术不仅对 HIV 有用,对其它也使用类似策略的病毒同样有效。
  • 病毒产生的诱饵被称为缺陷干扰颗粒(DIPs),包括 RSV、流感、新冠病毒和 HIV 等。
  • 这种复杂过程中存在自身免疫或附带损害的风险,但免疫系统会以常规方式测试抗体是否攻击自身,不过免疫系统非常复杂,结果未知。
  • 许多现代癌症疫苗也采用类似思路,为患者定制针对特定癌症的治疗性疫苗。
  • 在制药业中,有人用机器学习模型为癌症试验确定临床剂量,通过测序癌症并开发定制 RNA 来训练免疫系统消除癌细胞。
  • 免疫系统的训练通常自然发生,但随机接触病原体可能导致错误导向,使某些人免疫力更好或更差。
  • 所有疫苗都是免疫系统的训练数据,免疫系统像遗传算法一样运作,经过亿万年进化而来。
  • 有人认为这种多疫苗试图引导免疫系统偏向特定表位并不特别令人印象深刻,真正令人印象深刻的是免疫系统本身不断产生新抗体的能力。
  • 阻断 HIV 传播实际已通过口服和注射逆转录酶抑制剂得到解决,若投入资源推广 PrEP 和健康教育,可阻止艾滋病的持续生命损失,等待疫苗如同等待核聚变解决能源问题。

4. 停止扼杀互联网:拒绝数字身份与年龄验证 (Stop Killing the Internet: No Digital ID and No Age Verification) #

https://citizens-initiative.europa.eu/initiatives/details/2026/000011_en

这是一项名为“停止扼杀互联网:拒绝数字身份与年龄验证”的欧洲公民倡议,注册编号为 ECI(2026)000011,已于 2026 年 7 月 22 日获得欧盟委员会注册。

该倡议呼吁欧盟委员会提出立法,确保在欧盟范围内用于访问在线服务的数字身份和年龄验证系统必须遵循自愿、保护隐私和非歧视原则。公民不应被强制要求证明身份才能访问合法的在线内容或服务,除非法律严格必要且相称。立法应要求采用匿名或假名年龄证明、数据最小化、选择性披露、开源实现、独立安全审计,并禁止依赖方进行跨服务追踪,同时为不使用数字钱包的公民提供等效的替代方案。

附件进一步强调,应基于隐私保护密码学实现匿名或假名年龄验证;技术上和法律上禁止跨服务追踪;默认实现数据最小化和选择性披露;强制采用开放标准和可公开审计的密码协议;进行独立的安全与基本权利审计;对定义技术规格的实施法案进行议会监督;并为所有公民保障同等的非数字替代方案。

倡议组织者代表为保罗·迪格尔,来自比利时,替代代表为丹尼尔·默恩希,另有七名成员。目前未提供资金来源信息。


HN 热度 493 points | 评论 179 comments | 作者:doener | 9 hours ago #

https://news.ycombinator.com/item?id=49084938

  • 很多工程师不了解实际风险,认为情况好笑,但当局可以制定严苛法律使绕过几乎不可能,核心危险在于绝对控制谁能看到什么。
  • 德国警察曾搞错地址执行搜查,过程相对温和,给人正面印象;但未来若有不理性者掌权,权力扩张可能走向反乌托邦。
  • 若当时不在家、回家发现门被砸烂、房间被翻,几个月后才能索赔,就不会觉得警察行为合理。
  • 理性的人也会被权力腐蚀;警察搞错地址不是合理行为,武装闯入神圣空间必须再三确认。
  • 生活在德国却认为权力扩张不是滑向反乌托邦,建议读史。
  • “保护孩子”只是借口。
  • 无限制的滚动式多巴胺对儿童和成人都有害,减少注意力、增加焦虑;父母无法全天候监督,如何有效解决又不变成监控国家,没有好答案。
  • 零知识证明技术可以实现,但未被实施,说明问题不在技术。
  • 目前没有能真正防止孩子用借来或偷来的 ID 绕过年龄验证的方案。
  • 可行的方案:制作仅限儿童访问的网站和只能访问这些网站的硬件/软件,禁止非儿童硬件访问儿童网站,像限制饮酒一样限制儿童硬件;当前欧盟的做法与控制政治言论有关,而非保护儿童。
  • 这种系统不允许家长监督孩子,例如 YouTube Kids 会自动建议奇怪内容;可以监管 YouTube Kids 而不破坏言论自由,但监管整个互联网不行,公司应注册为儿童网站并遵守特定法规。
  • 应该像公共卫生官员一样思考:90% 的合规率就够了,不需要 100% 防止绕过;数字 ID 并不能真正解决问题。
  • LLM 和开放模型导致无法过滤生成的违规内容(如 CSAM、AI 脱衣),要么禁止开放模型,要么惩罚个人行为;诽谤和造谣自古存在,互联网曾短暂允许零责任言论,2010 年代后开始变化,人肉搜索变得可接受。

5. Netflix 员工因在静修会的信任练习中分享个人细节而被解雇 (Netflix employee fired for sharing personal details in retreat trust exercise) #

https://nypost.com/2026/07/26/us-news/netflix-exec-goes-ballistic-after-being-fired-for-stunning-trust-exercise-confession-at-retreat-suit/

Netflix 旗下 Eyeline Studios 前副总裁兼创意主管 Kevin Baillie 起诉公司,称其在 2026 年 1 月的一次公司静修会上,因在“信任练习”中透露自己曾接受医疗处方氯胺酮治疗抑郁症(为缓解母亲去世后的临床抑郁)而被解雇。Baillie 年薪 110 万美元,曾参与《加勒比海盗》和《哈利·波特》系列的特效制作。公司随后展开调查,并于 4 月以涉嫌娱乐性用药为由将其解雇,且拒绝支付最多一年的遣散费。Baillie 还指出,公司内部存在饮酒文化,CEO Jeff Shapiro 常在公务场合饮酒,甚至办公室设有私人酒吧。他要求陪审团审判、赔偿损失及精神损害赔偿。


HN 热度 420 points | 评论 472 comments | 作者:softwaredoug | 1 day ago #

https://news.ycombinator.com/item?id=49076923

  • 工作强制饮酒活动本质是展示软性权力的手段,而非真正的社交,可能因言辞不当被解雇
  • 德国公司周五免费饮酒文化较轻松,员工仅微醺,但圣诞派对后 HR 需处理大量问题
  • 在任何工作场合与同事、老板饮酒时都应保持警惕,不存在安全空间
  • 日本的“酒话会”是常见文化,虽有饮酒压力但未听说因此被解雇
  • 加拿大公司免费酒导致员工邀请外人喝到不省人事,最终取消该福利
  • 英国公司派对醉后行为默认不该在办公室里谈论,形成回避文化
  • 英国工作饮酒文化极端,面试后去酒吧喝酒成为录用标准,拒绝者落选
  • 公司强制披萨社交对自闭症开发者是折磨,他们只想避开尴尬社交
  • 小咨询公司每周聚餐在 LinkedIn 炫耀,员工表情虚伪或内心崩溃,这是危险信号
  • 英国承包商在公司酒吧活动中称呼 CEO 为“alright c*nt”次日被解雇,实质是权力展示
  • 美国公司强制活动因酒精与过度自我意识结合而更令人难以忍受,英国酒吧文化应受保护

6. 在 SlopCodeBench 上对 Opus 5 进行基准测试 (Benchmarking Opus 5 on SlopCodeBench) #

https://github.com/humanlayer/advanced-context-engineering-for-coding-agents/blob/main/benchmarking-opus-5-on-slop-code-bench.md

这篇博客文章介绍了作者对 SlopCodeBench 基准测试的研究。SlopCodeBench 是威斯康星大学麦迪逊分校于 2026 年 3 月发布的一个长期编程基准,与以往基准不同,它的每个挑战包含多个检查点,模型需要逐步适应新需求,而不是一次性给出完整问题。

作者测试了三个 Claude 模型(Opus 4.8、Sonnet 5 和 Opus 5)在三个问题(共 17 个检查点)上的表现。评估指标是严格通过率:每个检查点不仅要通过当前测试,还要通过之前所有检查点的回归测试。

结果令人失望:Opus 5 仅获得 24% 的通过率,与原始论文中 Opus 4.6 的 17% 相差不大。所有模型在挑战过程中都出现代码复杂度显著增加、函数数量激增的现象(Opus 5 的函数数量是 Opus 4.8 的五倍)。三个模型均未能完整通过任何一道题,包括标记为“简单”的题目。

作者个人解读是:SlopCodeBench 终于为“当前模型在真实逐问题开发中无法脱离人工引导”这一观点提供了量化证据。


HN 热度 387 points | 评论 112 comments | 作者:dhorthy | 1 day ago #

https://news.ycombinator.com/item?id=49076391

  • SCB 基准测试值得关注,因为它模拟了真实软件开发中的多任务和代码维护需求,但仅针对新项目(greenfield)是局限。
  • 静态预定义的工作流/skills 可能降低 agent 性能,因为最新模型会自己选择更合适的临时方案,skills 更多是为方便人类而非 agent。
  • 减少生成代码的复杂性比单纯减少行数更重要,理想是模型在实现功能时自动选择正确的抽象从而精简代码。
  • 在 prompt 中明确要求简单方案并避免企业级过度抽象,但仍需人类在评审环节多次反馈迭代才能达到可用水平。
  • 代码复杂度的度量应基于 AST,并使用自动格式化工具来约束单行逻辑过度膨胀。
  • 实验室可能已在 RL 流水线中使用类似基准,但“slop”式冗长代码问题可能是 LLM 架构性难题,并非简单修复可解决。
  • 让 agent 能“看见”系统的状态空间(如通过 CLI 工具结构化查看和操作状态)能显著提升其表现和执行准确性。
  • 需要开发状态机式的计划管理工具,将计划编码为可验证、可解析的结构,以帮助 agent 在长循环中保持焦点、避免偏离。

7. 一个缺失的下划线让无辜男子入狱 18 个月 (A missing underscore sent innocent man to prison for 18 months) #

https://arstechnica.com/tech-policy/2026/07/police-missed-one-underscore-and-sent-the-wrong-man-to-prison/

一起因一个下划线差异引发的冤案:一名加拿大男子因用户名“fus_ro_dah”(一个下划线)被错误指控并判刑 18 个月,最终获翻案。

2018 年,美国威斯康星州警方调查一起儿童引诱案时,发现嫌疑人使用的 Kik 用户名是“fus__ro_dah”(两个下划线)。然而,警方在向 Kik 公司发送传票时,误请求了“fus_ro_dah”(一个下划线)的用户信息,导致将无辜的加拿大男子 Brandon Klayme 锁定为嫌疑人。

尽管警方搜查 Klayme 的电子设备后未发现任何犯罪证据,他仍于 2023 年被定罪,2024 年被判处 18 个月监禁,并服满刑期。直到上诉过程中,辩护团队才发现了这个用户名错误。新斯科舍上诉法院近日撤销了原判,明确指出 Klayme“事实上无罪”,他本不应被指控,更不应被定罪。


HN 热度 384 points | 评论 244 comments | 作者:quantified | 1 day ago #

https://news.ycombinator.com/item?id=49076116

  • 该案在没有直接证据的情况下定罪,主要归咎于陪审团或法官的误判,以及辩护律师未能全力调查。
  • 被告因经济困难无法聘请专家证人,而加拿大司法系统对被告获得专家证人的支持严重不足。
  • 在美国,被告同样难以获得专家证人,检察官则拥有无限资源,且认罪协商制度施压被告认罪。
  • 检察官和辩护律师可能根本不审阅案卷,导致无辜者被定罪。
  • 专家证人因经济激励而倾向于只为检方作证,避免与警方对抗。
  • 在另一些国家,科学家乐于质疑和推翻定罪,从而获得声誉,但此类案例数量有限。

8. Substack 作者们,你们需要一个独立网站。 (Substack writers, you need a website) #

https://elizabethtai.com/2026/06/10/substack-writers-you-need-a-website/

Substack 作者们,你们需要一个独立网站。

Substack 只是一个分发工具,不应成为你的数字家园。完全依赖第三方平台是短视且不明智的,因为平台规则随时可能改变,你只是租客而非房主。

文章指出,许多作者将 Substack 当作博客,甚至用自己的域名链接过去,但这样仍受限于平台。更好的做法是采用 POSSE 方法:在自有独立网站发布内容,再分发到 Substack 等平台。

作者以 John Scalzi 为例,他坚持独立博客 28 年,所有平台内容最终都指向他的网站。独立网站提供了永久性和控制权,而平台算法会迫使内容同质化,尤其对非美国中心视角的作者不友好。

结论:把你的独立网站作为数字家园,Substack 仅作为分发渠道。这样当平台变化或衰落时,你可以轻松调整策略,而不会失去积累的读者和内容。


HN 热度 380 points | 评论 195 comments | 作者:speckx | 7 hours ago #

https://news.ycombinator.com/item?id=49086788

  • 拥有独立网站作为永久信息储存地是有价值的,但社交网络的实用性和网络效应更重要。
  • 社交网络之所以庞大,并非因为服务质量高,而是因为早期投入形成顽固的网络效应,用户因“所有人都在那里”而留下。
  • 网络效应本身就是真正的实用性。
  • 社交网络最初确实有巨大实用性(如 Facebook 早期),但随后逐渐变差,靠网络效应维持规模。
  • 社交网络通过封堵互操作性、追求垄断来巩固地位。
  • Facebook 的成功并非因为比 MySpace 更好,而是因为开放的 API 吸引应用、跟踪用户、精准广告,以及作为企业平台。
  • WhatsApp 的成功源于免费、可靠、端到端加密、跨平台和群组功能,替代了昂贵的短信。
  • 真实姓名和照片并不是优点,反而造成隐私问题;端到端加密在 Meta 控制端点的情况下可能不可靠。

9. 法官驳回谷歌试图利用 DMCA 规避被爬取的企图 (Judge Rejects Google’s Attempt to DMCA Its Way Out of Being Scraped) #

https://www.techdirt.com/2026/07/27/judge-rejects-googles-attempt-to-dmca-its-way-out-of-being-scraped/

法官驳回谷歌依据《数字千年版权法》(DMCA)第 1201 条(反规避条款)对 SerpAPI 的起诉。谷歌指控 SerpAPI 绕过其“SearchGuard”技术措施(类似验证码)爬取搜索结果,但法院指出:谷歌搜索结果主要是公开信息的汇编,本身不受版权保护;即使部分结果包含有版权的“知识面板”内容,其出现并不恒定,因此 SearchGuard 并非为保护版权作品而设,不满足 DMCA 适用前提。该裁定强调不能将反规避条款用于阻止爬取无版权内容的开放网站。类似案例如 Reddit 起诉 SerpAPI 亦在推进中。


HN 热度 334 points | 评论 147 comments | 作者:cdrnsf | 1 day ago #

https://news.ycombinator.com/item?id=49073513

  • 如果 Google 有好的搜索 API,就不会反对被爬取,但 Google 已废弃 API,只能继续用第三方爬取结果
  • EU 要求 Google 分享搜索数据,美国反垄断判决也要求将部分数据分享给合格竞争者
  • Google 可以象征性收费来规避分享义务,但收费会导致用户流失至 Bing/DuckDuckGo
  • Google 需要恢复老搜索 API,或改进 Gemini 搜索接地功能,目前限制太多且不能自由使用结果
  • 自从 Google 要求 JavaScript 才能搜索,就停止使用它,JS 要求是广告追踪手段,用户有权禁用
  • Google 起诉 SerpAPI 是典型大公司行为,以为对方无力应诉

10. 使用开源模型的感觉出奇地好 (Using an open model feels surprisingly good) #

https://matthewsaltz.com/blog/using-an-open-model-feels-surprisingly-good/

作者分享了自己使用开源模型 opencode 搭配自己的推理端点(Modal 的 Kimi K3)的体验。过去两年一直用 Claude 和 ChatGPT,但这次改用自己托管的开源模型后,感觉“出奇地好”——数据直接从笔记本到自己的端点往返,有种掌控感和自由感,像从复杂编辑器回到简洁的 vim。作者强调这并非夸张,而是意外且真实的感受。


HN 热度 308 points | 评论 133 comments | 作者:msaltz | 21 hours ago #

https://news.ycombinator.com/item?id=49078583

  • 开放模型在小范围、精确定义的代码迭代中效果很好,而闭源模型擅长从模糊提示生成大量代码,但这不是标准开发方式。
  • 对于懂技术的用户,Deepseek 等开放模型足够好用且成本极低,适合增量式开发。
  • 中国开源模型打破了美国闭源公司的垄断,AI 模型将变成基础商品,服务商只能赚取薄利。
  • 中国开源模型并非纯粹出于善心,背后有金融政治考量,但国内竞争和获取心智份额也是重要原因。
  • 美国 AI 公司同样有政府背景,不能简单认为中国实验室就是中国政府延伸。
  • 中国 AI 从业者的价值观可能更乐于分享 AI 作为公共品,相比美国更注重集体进步。
  • 闭源 AI 公司的商业模式类似 IBM 大型机,可能被“足够好”的开放模型颠覆,导致投资泡沫破裂。
  • 一次性生成整个应用的开发方式让人失去对代码的掌控,而小范围迭代才是好的工程实践。

Hacker News 精彩评论及翻译 #

Our position on open-weights models #

https://news.ycombinator.com/item?id=49076725

Schrödinger’s China at once is an evil entity looking to use AI for their own nefarious purposes yet also willing to cooperate with their main competitor to prevent other actors (who??) from achieving similar goals (all while under a chip embargo too!!)

The reality is much less confusing: Anthropic CEO does not wish for models with similar (or greater) capabilities compared to his own closed and overpriced ones to be widely released. Simply because that will affect Anthropic’s bottom-line.

Anthropic and all other “model” companies have nothing making them special beyond privileged access to chips so obviously they want to restrict what models are out there and more importantly who can produce new ones. Without these restrictions, it’s only a matter of time before the multi-hundred billions valuations simply evaporate while they are still holding the bag.

vhantz

薛定谔的中国:它既是一个意图利用AI达成自身邪恶目的邪恶实体,又愿意与其主要竞争对手合作,阻止其他行为者(到底是谁??)达成类似目标(而且这一切都发生在芯片禁运之下!!)

现实远没有那么令人困惑:Anthropic的CEO不希望能力与自己公司封闭且定价过高的模型相当(或更强)的模型被广泛发布。原因很简单——这会影响Anthropic的底线。

Anthropic和所有其他"模型"公司,除了享有芯片的优先获取权之外,没有任何独特之处。所以他们当然想限制市面上的模型种类,更重要的是限制谁能制造新模型。没有这些限制,他们手里那数百亿美元的估值,迟早会蒸发殆尽。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49076763

Someone who until yesterday did not seem bothered by his technology being possibly used to bomb elementary girls school in another country seems to suddenly care about the repression of citizens in yet another country.

No, we don’t buy your virtue signaling. And we certainly don’t need your better-than-thou opinions on this year’s “nightmare scenarios”.

m3h

那个昨天还对自家技术可能被用来轰炸别国小学女校无动于衷的人,今天突然开始关心起另一个国家的公民镇压了。不,我们不吃你这种虚伪的道德表演。更不需要你对我们今年的"噩梦情境"指手画脚。


A walk through of the DeltaNet family of linear at… #

https://news.ycombinator.com/item?id=49086375

after a cursory read, I can confidently say I could not, in fact, have come up with Kimi Delta Attention.

rekshaw

粗略读了一遍之后,我可以自信地说,我实际上想不出Kimi Delta Attention。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49079084

Also everything hes saying about China (and other actors) many outside the USA would say about the USA.

The solution of a global arms race of state vs state with integrated statist corporations as the best outcome for end users sure is a choice though

twelvechairs

而且他关于中国(以及其他行为体)说的那些话,美国以外的许多人也会这样评价美国。不过,把国与国之间由国有垄断企业参与其中的全球军备竞赛,视为对终端用户而言的最佳结果,这确实是一种选择。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49076582

In the first paragraph,

Anyone who has read my past writing should know that I don’t regard such bans as a useful measure,

Later (on banning chip sales to china)

we should crack down on the rampant smuggling and workarounds used to obtain access to such chips.

If you truly believe that bans don’t work, the same applies to hardware too.

Furthermore, Dario says later “To address these concerns, I do support the following three measures…”: 1. ban chip sales to China 2. crack down on distillation 3. all capable models should go through mandatory safety testing

Just so happens that all these moves commercially benefit Anthropic. If Dario really wanted to make a point, it would land a lot better had Anthropic released a single open-weights model

GodelNumbering

第一段中:

任何读过我过往文章的人都应该知道,我并不认为这种禁令是有用的措施,

后来(关于对华芯片销售禁令)

我们应该严厉打击猖獗的走私行为以及那些用来获取此类芯片的变通手段。

如果你真的相信禁令没用,那对硬件来说同样适用。

此外,Dario 随后表示“为了解决这些担忧,我确实支持以下三项措施……”:1. 禁止向中国销售芯片 2. 打击蒸馏技术 3. 所有有能力的模型必须通过强制性安全测试

巧合的是,所有这些举措在商业上都对 Anthropic 有利。如果 Dario 真想表明立场,那么如果 Anthropic 发布一个开源权重的模型,他的观点会更有说服力。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49076500

I can’t remember the last time (if ever) a company managed to go from golden goose to.. whatever this is.. so quickly. The permanent defensiveness in his presentation is really hard to swallow, it actively puts me off wanting to believe in or rely on their product line with Dario at the helm. I don’t even understand the logic leading up to this post. Who was it even hoping to convince. Is it possible Anthropic is due an oil change?

badatnames

我记不清上一次有公司能这么快地从金鹅变成……这副德性是什么时候了(如果真有的话)。他演讲中那种永恒的防御姿态实在让人难以接受,这直接打消了我对Dario掌舵下他们产品线的信任和依赖。我甚至完全无法理解写这篇帖子的逻辑。它到底想说服谁?Anthropic是不是该换个机油了?


Our position on open-weights models #

https://news.ycombinator.com/item?id=49080436

He’s also completely missed what many of us see as the primary the issue, HF was attacked by a US frontier model.

HF could not be helped by US frontier models because of the “safety” features they have.

HF had to use an open model from china.

Anthropic wants to add those “safety” features to open models - especially from china.

End result would be HF hack would have continued atleast until the Monday that OpenAI engineers finally walked back into work.

rustyhancock

他也完全忽略了我们许多人认为的核心问题:HF遭到了美国前沿模型的攻击。
由于美国前沿模型自带的“安全”功能,它们无法帮助HF。
HF不得不使用来自中国的开源模型。
Anthropic想要将那些“安全”功能也添加到开源模型中——尤其是来自中国的模型。
最终结果将是,HF被入侵的情况至少会持续到OpenAI的工程师们周一终于返回工作岗位。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49076243

So the argument is basically: This technology is too dangerous so only we should have access to it. We’re the good guys and only we can ensure a safe use of this technology.

Quis custodiet ipsos custodes?

mjorgers

所以论点基本上是:这项技术太危险了,所以只有我们才能接触它。我们是好人,只有我们能确保这项技术的安全使用。

谁来监督监督者?


Netflix employee fired for sharing personal detail… #

https://news.ycombinator.com/item?id=49077832

Offsite retreats seem like a bad idea in general, I’ve never been to one where I felt the team or company worked together better afterwards, and I’ve seen some spectacularly bad results… like the time the facilitator tried to get to the bottom of tensions between the CTO and head of sales (the classic problem of “Engineering isn’t shipping features fast enough” and “Sales is selling features before even consulting with engineering”). The discussion quickly turned shockingly personal and within a month after the retreat both the CTO and head of sales quit. At least they called an end to the retreat early.

Johnny555

总的来说,外出静修似乎是个糟糕的主意。我从未参加过任何一次能让我感觉团队或公司之后协作得更好的静修活动,反而目睹过一些极其糟糕的结果……比如有一次,引导者试图化解CTO和销售主管之间的紧张关系(经典的矛盾:“工程部门功能交付速度不够快”和“销售部门在咨询工程部门之前就提前推销功能”)。讨论迅速变得惊人地针对个人,静修结束后不到一个月,CTO和销售主管都辞职了。至少他们提前结束了静修。


Netflix employee fired for sharing personal detail… #

https://news.ycombinator.com/item?id=49081184

I know some of the younger folk may not realise reality is stranger than fiction, but I too have been on a “work mandated drink alchohol bus” where I remember even though I was young, I was terrified the whole time wondering why we were being forced to drink infront of C suite; forced on a hell ride through the black country ( Thats a region in England).

One might think it was naive and odd for me as a young autistic person to be so scared and negative, but sure enough, the next day the best contractor in the company was fired at 9am for calling the CEO an “alright c*nt” during the pub crawl.

The C word being used a token of affection around these parts, was perhaps not the true transgression which was, not to understand, that it was NOT a social function, but a horrifying legal flexing of soft hierarchical power, for purposes of satiating C suite ego, and humiliating everyone beneath them.

ionwake

我知道有些年轻人可能还没意识到现实比小说更离奇,但我也曾经历过“公司强制饮酒巴士”——即便当时我还年轻,却全程惊恐不已,想不通为什么我们被迫在高层面前喝酒,还被押着穿越黑乡(英格兰的一个地区)的地狱之旅。

或许有人会觉得,作为一个年轻的自闭症患者,我当时那样恐惧和消极显得天真又古怪。但果然,第二天公司最优秀的承包商就在上午9点被开除了,因为他在酒吧巡游时称CEO为“还行的傻屌”。

在这片地区,“C词”常被用作亲昵的称呼,但他真正的过错或许并不在此——而是没有意识到这根本不是什么社交活动,而是一场可怕的、以法律为幌子的软性层级权力展示,目的只是为了满足高层的虚荣心,并羞辱所有下属。


Netflix employee fired for sharing personal detail… #

https://news.ycombinator.com/item?id=49077821

Adam Mendler, a workplace expert, told Inc. that this kind of exercise carries real risk when companies invite openness without ever clarifying how that vulnerability will be treated afterward.

I always felt that those trust exercises, “bring your whole self to work”, “let us pay for a personality test so we can know each other better” are all ruses to find the most gullible people and then take advantage of them or get rid of them.

rdtsc

职场专家亚当·门德勒在接受《Inc.》杂志采访时表示,当公司鼓励员工敞开心扉,却从不明确这种坦诚将如何被后续对待时,这类活动就带有真实风险。

我一直觉得那些信任练习、“把完整的自己带到工作中”、“让我们出钱做个性测试以便更好地了解彼此"之类的把戏,都是为了找出最容易轻信的人,然后利用他们或者把他们赶走。


Our position on open-weights models #

https://news.ycombinator.com/item?id=49076249

Every single risk he identifies as a concern regarding China is exactly my concerns with the US having absolute control. Literally the exact same concerns

Aboutplants

他指出的每一个关于中国的风险,恰恰就是我对美国拥有绝对控制权的担忧。完全相同的担忧。


7.1 Earthquake in Japan #

https://news.ycombinator.com/item?id=49080987

In parts of Kumamoto Prefecture, it registered 7 on the Japanese shindo (seismic intensity) scale, which reflects the amount of ground shaking at a particular location. The shindo is a better indicator of the likely amount of damage than the magnitude is. A shindo of 7 is extremely strong [1].

Ten minutes ago (at around 17:15 p.m. Japan time), NHK was reporting that there were many emergency calls coming in from Uki City, where shindo 7 was recorded, but that the extent of the damage or injuries was not yet known.

There have also been many aftershocks, including some strong ones, and tsunami warnings.

[1] https://www.jma.go.jp/jma/en/Activities/jishintsunami/jishintsunami_low6.pdf

tkgally

在熊本县部分地区,日本震度(shindo,反映特定地点地面摇晃程度的指标)达到了7级。相比震级(magnitude),震度更能反映可能造成的破坏程度。震度7级属于极强[1]。

十分钟前(日本时间约下午5点15分),NHK报道称,记录到震度7级的宇城市接到了大量紧急求助电话,但具体的人员伤亡和财产损失情况尚不清楚。

此外还发生了多次余震,其中包括一些强余震,并发布了海啸警报。

[1] https://www.jma.go.jp/jma/en/Activities/jishuntsunami/jishuntsunami_low6.pdf


Using an open model feels surprisingly good #

https://news.ycombinator.com/item?id=49080027

This is an ad.

I know the author has a long history here and I’m sure the post is a genuine reflection. But how is posting “I used my own product and it felt really good” anything other than self promotion?

mbanerjeepalmer

这是广告。我知道作者在这里有很长的历史,也相信这个帖子是真实的感受。但发布“我用了自己的产品,感觉非常好”这种内容,除了自我宣传之外还能是什么?