一个好得令人难以置信的 AI 助手?
摘要
科技 CEO 如今已是事实上的政治行动者,但他们对明尼阿波利斯枪击事件的拿捏式回应,暴露出行业领袖对华盛顿的依赖仍有多深。 Sam Altman 表示 ICE “做得太过头了”,Dario Amodei 称明尼苏达州发生的一切是“恐怖”,Tim Cook 则呼吁“降级冲突”;Casey Newton 认为,有些表态“几乎已经是他们能做的最低限度”,而 Kevin Roose 注意到,Chris Olah 更强硬的帖子被 Katie Miller 转发,作为 AI 公司模型存在偏见的证据。
X 与政府媒体行动已把政策、执法和互动熔成一个反馈回路。 一段指控日托中心存在欺诈的病毒视频帮助触发了明尼阿波利斯行动,政府官员利用 X 为行动辩护,ICE 则动用制片人、编辑、付费工具和友好型网红,把突袭包装成内容。Newton 的直白判断是:X “基本上”已经成了国家媒体,而“在社交媒体上赢下来几乎成了全部目的”。
即使篡改显而易见,AI 操纵的证据仍能为政治行动者创造价值,因为收益在于“说谎者红利”。 图片曾错误地把 Alex Pretti 描绘成举枪,而不是拿着手机;另一张图片则把民权律师 Nakeema Levy Armstrong 描绘成被捕后哭泣。Vice President J.D. Vance 转发了后者,尽管原图早已公开。官方那句令人寒心的回应——“表情包会继续出现”——说明持久的标注和水印规则或许需要立法,而不能寄希望于平台自愿拿出勇气。
手机已成为国家叙事与公民问责彼此对抗的武器,但重复拍摄的影像仍可能守住共同现实。 DHS 将拍摄执法人员称为人肉曝光,而抗议者记录下现场接触;政府也把自己的网红和摄像机带进行动现场——这是一场“手机对手机的战斗”。Roose 担心视频已不再能自证真实性;Newton 则反驳称,多角度画面、记者核验,甚至 NRA 对政府叙事的批评都表明,“只要有足够多人看到”,真相或许仍能幸存。
Moltbot 为智能体原生电脑提供了一个引人注目的预览,但眼下仍不安全、不可靠,实际用处也很有限。 这款本地开源助手可以连接邮件、日历、消息和其他服务,以 Markdown 保存记忆,并定制每日简报——但 Newton 那套复杂系统的成功率只有约 70%,且在演示中直接失败。真正值得关注的是方向,而非产品本身:一个值得信任的操作系统级智能体可能取代许多 App 交互,但今天的版本往往只是“一个非常复杂的新小组件,在告诉我天气”。
不断扩大的 AI 采用鸿沟,正变成一场实验:前沿工具的普及究竟会带来真正的生产率 alpha,还是只会制造风险与表演。 San Francisco 用户正在安装多智能体集群,而传统组织仍在申请是否可以在 Teams 中使用 Copilot;机构控制会拖慢扩散,也可能减少遭遇提示词注入攻击和账户被攻破的风险。Andrej Karpathy 称 Claude Code 和 Codex 是他过去20年工作流中“毫无疑问最大的变化”,这强化了 Roose 的担忧:如果类似收益扩展到编程之外,不使用这些工具的人可能会变得竞争力更弱。
一连串快讯式公司新闻显示,AI 压力正外溢至运营、硬件路线图、劳动力和资本市场叙事。 Amazon 宣布裁员16,000人,此前一封关于裁员的日历邀请似乎误以“Project Dawn”的名义发出;据报道,Apple 正开发一款最早可能于2027年推出、大小类似 AirTag 的 AI 别针;Steak ’n Shake 新增500万美元的 Bitcoin 敞口;SpaceX 则考虑在6月中旬 IPO,时间点可能与 Elon Musk 的生日及木星—金星合相重合。与此同时,LinkedIn 提议推出 vibe-coding 徽章,也说明证书竞赛可能跑在实际技能之前。
精读
1. 科技掌门人开始意识到,沉默本身也是政治立场
Roose 和 Newton 从 Alex Pretti 被枪杀一事讲起:这是当月联邦执法人员第二次枪杀美国公民。科技行业之所以必须进入这场叙事,是因为科技公司提供了如今与国家权力纠缠在一起的监控基础设施、社交平台和 AI 工具。
Altman 告诉 OpenAI 员工,ICE “做得太过头了”,抵制权力越界是热爱国家的一部分。Amodei 称明尼苏达州发生的一切是“恐怖”,Cook 则告诉 Apple 员工:“现在是降级冲突的时候。”
Newton 认为 Altman 和 Cook 的信息软弱,而且明显经过设计,以免刺激白宫。Roose 不喜欢这种企业必须发表的表态,但 Newton 的反驳是结构性的:这些领导者“以各自的方式都是国家元首”,代表着规模庞大的用户和员工群体。
政治代价是真实存在的。Anthropic 联合创始人 Chris Olah 发布发自内心的谴责后,Katie Miller 认为这类观点会变成 AI 模型中的偏见;因此,Newton 甚至在那些几乎没有说什么的声明中看到了“一些骨气”。
2. X 已成为政府的新闻编辑部兼政策孵化器
Newton 将明尼阿波利斯与 Charlie Kirk 遇刺后的网络反应区分开来:两者都会奖励冲突,但只有 Trump 拥有“国家机器的力量”、数千名联邦执法人员,以及一个擅长把政治 spectacle 转化为病毒式内容的政府。
明尼阿波利斯行动本身,就是在一段指控日托中心存在欺诈的视频在 X 上走红后展开的。对 Newton 来说,这意味着社交平台不只是报道政策,而是在设定总统议程;Roose 早先关于 X 将成为国家媒体的预言,“基本上”已经实现。
据报道,ICE 维持着一套内部内容运营体系,使用付费社交工具、制片人、编辑和视频制作人员。官员们还把右翼网红带进行动现场,包括 Kristi Noem 早些时候访问 Portland 的行动,将执法与品牌营销的技巧混在了一起。
Roose 观察到,X 把一个广泛易懂的反对“执法人员向抗议者开枪”的意见,变成了近似五五开的争议,同时传播阴谋论、篡改画面和 deepfake。Newton 的结论更尖锐:政策目标看起来可能已经退居次位,因为“在社交媒体上赢下来几乎成了全部目的”。
3. 合成证据即使无法令人信服,也能带来“说谎者红利”
一张篡改后的图片让 Pretti 看起来像是在向一名执法人员举枪,而实际上他拿的是手机。另一张图片据称“增强”了模糊画面,但正如 Newton 所说,它“只是凭空编了一堆东西”,加入了虚构细节,而不是找回证据。
更严重的是,白宫发布了一张经过篡改的逮捕照片,让民权律师 Nakeema Levy Armstrong 看起来像是在哭。DHS 早已发布未经篡改的原图,但 J.D. Vance 仍然转发了这张伪造图片。
Newton 引用了“没有什么是真的,一切皆有可能”这句话:把虚构内容灌满信息环境,直到核验现实的成本变得高不可攀。“说谎者红利”随后也会作用于真实证据,因为受众知道伪造是可能的,于是可以把任何东西都斥为可能是假的。
平台标注或许有帮助,但 X 目前主要依赖 Community Notes。Newton 认为它有用,却不可预测,而且经常来得太晚。Roose 支持国会监管,理由是制度的一致性:标注或水印规则应跨越不同政府持续存在,而不是让公司在执行规则时始终暴露于报复风险之下。他还警告说,如果政府愿意撒谎并伪造证据,平台政策能发挥的作用终究有限。
4. “手机对手机的战斗”正在检验视频能否继续锚定现实
Pretti 被枪杀时手里拿着手机,Renee Good 的伴侣则拍下了她遭遇致命袭击的过程。这些视频广泛传播,并按照主持人的说法改变了公众舆论;Minnesota Governor Tim Walz 呼吁居民带上手机,记录“针对明尼苏达人的暴行”。
DHS 官员把拍摄执法人员并发布其照片称为人肉曝光,Tricia McLaughlin 还威胁要以非法骚扰罪名起诉。主持人的反驳是绝对的:拍摄公共执法行为是合法的,识别代表国家行事的执法人员也不天然构成人肉曝光。
面具让风险进一步上升。Newton 怀疑,执法人员害怕的究竟是依法携带的枪,还是能把他们的行为与身份联系起来的手机;与此同时,政府也调动自己的手机、网红、话术、照片和视频片段,把突袭行动包装成有效执法。
Roose 担心,影像本身正变得不可信,社会也不再拥有一个权威的真相来源。Newton 则更乐观:Pretti 枪击案有多个拍摄角度,记者对画面进行了核验,很少有人声称它们是假的,甚至 NRA 也批评了政府的叙述。Roose 仍在怀疑,随着 AI 工具进步,这种信任还能维持多久。
5. Moltbot 将个人智能体梦想封装进一个不安全的原型
Moltbot 前身为 Clawdbot,是 Peter Steinberger 开发的免费开源个人 AI 智能体。它最初源于一个通过 WhatsApp 使用 Claude Code 的尝试,并承诺成为“电脑里的小精灵”,能够连接各种服务、通过对话完成工作。它与 Anthropic 的 Claude 聊天机器人没有关联。
安装方式类似 Claude Code:把一行命令粘贴进终端,再按步骤完成设置。San Francisco 的科技爱好者买来 Mac mini,为智能体配备专用机器——一部分是出于热情,另一部分则是意识到把它不受限制地装在主力电脑上属于“不可理喻的行为”。
它的威胁模型非常严重。一个被攻破的 Telegram 账户理论上可能暴露整台电脑,而提示词注入则可能把恶意指令藏在网页中。Newton 关闭了 Telegram 并限制集成范围,但仍然接入了邮件和日历,承认这是一次“无可否认存在风险”的实验。
Moltbot 的实际差异化在于本地运行和持久化的 Markdown 记忆。不同于 Claude Code 的上下文窗口压缩,它可以回看昨天的项目,找到相关文件,并在之后继续修改,不必让每次会话都像从头开始。
6. 定制简报约70%有效;演示一开始,可靠性就崩溃
Newton 要求 Moltbot 把“早上好”变成一份简报,内容包括天气、重要邮件、日历事件、逾期任务、摔角付费直播、最新 RuPaul’s Drag Race 剧集,以及每周四预告本周上映的电影。运行几天后,它大约有70%的时间能够成功。
现场演示中,它花了很长时间,随后失败。Newton 每天都会遇到类似故障;这与他对 Claude Code 的体验形成对比,后者如今通常能够完成定义清晰的任务。至于 Moltbot 的内部机制,他的解释完全属于 vibe coding:“我不知道,而且永远不会知道。”
他的预期已经“向下调了非常远”。安全问题仍未解决,而花费数小时把各种服务接起来,可能制造出正在提高生产率的错觉,却没有产生有意义的产出,最后得到的只是一个复杂的天气组件,而不是一名全天候数字员工。
不过,这个原型让未来变得清晰可见。一个未经核实的例子显示,OpenTable 预订失败后,Moltbot 使用 ElevenLabs 的声音给餐厅打了电话。主持人关注它的理由在于,这项技术可能“方向正确,但出现得太早”(directionally correct, way too early):1月时勉强能用,到11月可能就会“好得离谱”(pretty freaking good by November)。
7. AI 采用正在分裂为实验、机构延迟与抵抗
Roose 描述了一道“巨大而刺眼的内外鸿沟”:San Francisco 用户把多智能体 Claude 集群交给 AI 来管理生活,而其他地方的组织还在申请是否能在 Teams 中使用 Copilot,或争论 AI 是否可以替他们做会议记录。
Newton 认为,这正是此前预期的 AI 扩散瓶颈。真正的机构有 IT 政策;充满“线人脑”的创业公司则会立即安装不安全的 GitHub 项目。尚未解决的问题是,这种自由究竟能带来 alpha,还是只会带来无效劳动、安全事故、被攻破的代码仓库和欺诈性加密货币推广。机构限制也可能减少人们暴露于这些风险之中的机会。
Roose 担心,怀疑正在固化为一种身份认同:AI 要么具有颠覆性,要么就是虚假且被过度炒作。Moltbot 可能只是生产率表演,但编程已经显示出一种可能性:手工作业者会比使用强大智能体的同事更缺乏竞争力。
Karpathy 的证据分量很重:Claude Code 和 Codex 是他过去20年基础编程工作流中“毫无疑问最大的变化”,而且在几周内就发生了。Newton 的限定同样重要:主流工具只有在能帮助人们赚到、找到或保住工作时,才会自我销售成功;如果改进等同于取代人们赖以谋生的工作,它就很难被接受。
8. 运营失误正在立即触发信任与治理问题
Amazon 宣布裁员16,000人;前一天,公司似乎误发了一封凌晨5:00的“Project Dawn”邀请给员工。主持人的判断更多关乎执行而非战略:避免使用不祥的科幻代码名,也要查清究竟是哪款 AI 工具发出了这封日历邀请。
TikTok 转移至一家由多数美国投资者组成的美国子公司,同时发生了数据中心宕机、帖子显示0次观看,以及 ICE 批评或“Epstein”一词遭到压制的说法。Newton 更倾向于认为这是故障而非审查:在搬迁过程中,“总会有些餐具被打碎”。
Amodei 发布了38页、19,000字的《The Adolescence of Technology》,系统列举 AI 的风险,用来平衡《Machines of Loving Grace》的乐观叙事。Roose 认为它受到的关注较少,是因为风险警告符合 Amodei 一贯的公众形象;此前的乐观才是出人意料的偏离。
另外两则小新闻捕捉到了 AI 日益扩大的信任赤字:一款戒色情应用暴露了用户年龄、自慰频率和情绪反应;Alaska 一名学生则因把另一名学生展览中的约57张 AI 辅助图片吃下去,作为抗议艺术而被起诉。
9. 资本、硬件与证书正在吸收 AI 时代的表演性
Caroline Ellison 在服刑约14个月、原判刑期两年后离开联邦羁押;与此同时,FTX 故事预计将在秋季被拍成 Netflix 剧集《The Altruists》。另外,Amazon 的《Melania》纪录片在白宫接受了约70名嘉宾参加的私人放映,嘉宾包括 Tim Cook、Eric Yuan、Lisa Su 和 Mike Tyson。
Steak ’n Shake 新增500万美元名义 Bitcoin 敞口,使其 Bitcoin 销售额纳入“战略 Bitcoin 储备”。主持人认为,这家连锁店的“汉堡到 Bitcoin 的转型”又是一次把运营企业改造成加密货币叙事的古怪尝试。
据报道,Apple 正在开发一款大小类似 AirTag、配备摄像头、麦克风、扬声器和无线充电功能的 AI 别针,最早可能于2027年发布,并可能与 OpenAI 的硬件产品竞争。Roose 认为这证明了 Humane 的方向判断正确;Newton 则开玩笑说,这延续了 Apple Vision Pro 的套路:硬件昂贵,用途却不确定。
SpaceX 正考虑在6月中旬 IPO,与 Musk 的生日及木星—金星合相相配合,这将是3年多来的首次。LinkedIn 则提供了相匹配的劳动力市场荒诞感:由 Replit、Lovable、Descript 和 Relay.app 评估熟练度,认证的技能竟是“在一个框里打字”。