← 返回文章

AI 动态摘要|2026-08-03

过去 24 小时值得关注的 AI 动态:Opus 5 长时生成、AI 防御争论、科研 HPC、人形机器人。

Karpathy 用 1M token 测试把“单图提示词”扩展为可运行世界

Andrej Karpathy 表示,简单的“画一只骑自行车的鹈鹕”已不足以测试当前模型。他把《指环王》首段、约 1M token 预算(称成本约 10 美元)交给 Opus 5,让模型生成可在浏览器运行、可 fork 的交互作品,并公开了源码页面。

他进一步提出一种生成媒体工作流:用 procedural code 负责 storyboard 与控制,再用 video-to-video 模型负责纹理和视觉风格。这是一种个人探索和产品方向判断,不是 Anthropic 官方 benchmark;帖子也没有可重复的评分标准,因此更适合作为“长时生成任务”案例而非模型能力排名。

来源:1M token 生成实验 · 浏览器可运行版本 · procedural code + video-to-video

标签:#Opus5 #LongContext #GenerativeMedia #ProceduralGeneration

AI 网络攻击争论转向“加速防御”而非单向减速

Hugging Face 的 Clément Delangue 针对近期 AI 驱动网络攻击讨论提出:风险需要正视,但不应因此整体减速,应加速发展防御能力,并认为 AI 长期可能让世界更安全。该帖被 Yann LeCun 转发。

这延续了前几日 Anthropic 安全事件后的分歧:一方强调模型能力外溢和监管,另一方认为事故首先暴露 harness、授权和隔离缺陷,并担心限制开放模型会削弱防守方。本轮只有观点表达,没有新的攻击技术事实或事故时间线。

来源:Clément Delangue 观点

标签:#AISecurity #OpenModels #CyberDefense #AIRegulation

Dell 与 Texas A&M 推进液冷 AI/HPC 共享基础设施

Michael Dell 再次介绍 Texas A&M 的 IGNITE 项目:面向联邦资助、产业和学术研究的共享 AI/HPC 平台,由 Dell 参与设计部署,引用材料称将使用液冷 PowerEdge 服务器和 AMD Instinct MI355X。

这是校级科研基础设施项目动态,不是新的硬件性能基准。可见内容没有节点数量、网络拓扑、存储配置、功耗或上线时间,因此日报不推断集群规模。

来源:Michael Dell / IGNITE

标签:#HPC #AIInfrastructure #LiquidCooling #MI355X

人形机器人与轮式机器人的形态争论继续

Figure 创始人 Brett Adcock 断言轮式机器人是“死路”,理由是现实环境包含楼梯和梯子,人形结构的通行范围更广。这是企业创始人的强观点,并不构成对轮式机器人经济性、稳定性和特定场景效率的全面比较。

合理的解读是:通用家庭和人类基础设施适配有利于双足形态,但仓储、配送、医院和工厂等平整环境仍可能更偏好轮式底盘。后半句属于工程推断,而非帖子原文。

来源:Brett Adcock

标签:#Humanoid #Robotics #Embodiment

其他值得关注

  • Block/Bitkey 团队展示 coin control 的早期 POC,并向用户征集反馈:原帖
  • Karpathy 讨论在仅约 25KB 用户空间的约束下,n-gram 表或决策树是否可能以更短程序和权重获得更优验证损失;这是开放问题而非结论:回复
  • Harrison Chase 回复用户反馈并表示会转交团队,但可见回复没有披露具体产品改动:原帖

今日观察

周末更新量明显较低,真正值得跟踪的不是发布数量,而是生成式模型测试范式的变化:从单轮、单资产输出,转向百万 token 预算下的长时编排、可运行代码世界和后续视频模型渲染。与此同时,AI 安全讨论正在从“能力是否危险”分叉为“限制能力”与“加速防御工具”两条政策路线,后续应继续区分事故事实、基础设施失误和参与者立场。