OpenAI 用 Private Safety Processing 协调 Zero Data Retention 与跨交互安全
OpenAI 表示将继续为前沿模型提供 Zero Data Retention,并预览 Private Safety Processing。公司给出的矛盾是:Agent 承担更长、更自主的企业任务后,安全系统需要识别相关交互之间的风险,但 ZDR 客户又不能把敏感内容留给常规持久化处理。Tibo 将该方案概括为在保持客户数据控制权的同时提升 safeguards。当前动态没有完整展示具体隔离架构、保留时长、密钥边界和审计机制,因此日报只确认产品预览与设计目标,不推断其已经满足所有合规场景。
来源:OpenAI 官方动态 · Tibo 说明
标签:#OpenAI #ZeroDataRetention #Privacy #Safety
Vera Rubin 的价值主张转向每兆瓦 token 产出
NVIDIA AI Infrastructure 称,CoreWeave 在 Vera Rubin 平台上测得每兆瓦 tokens/second 提升 10 倍,并将其解释为 AI factory 从 compute 转换为 tokens、再转换为收入的效率跃迁。这是 NVIDIA 转述的合作方测量结果,抓取文本没有完整测试配置,不能直接外推到任意模型、精度、并发或数据中心。它更重要的信号是,基础设施竞争指标正从单 GPU 性能转向功率约束下的系统吞吐和单位 token 成本。
标签:#NVIDIA #VeraRubin #PerformancePerWatt #AIFactory
LithosAI 宣称 Kimi K3 在标准 GPU 上达到每用户 800+ tok/s
Zhihao Jia 与 LithosAI 宣布 Kimi K3 的早期价格档位,计划 9 月 1 日上线 API;其动态称当前 chat 已在标准 GPU 上实现每用户 800+ tokens/s,并保持完整模型质量,可提供托管 API 或 on-prem 部署。这是服务商的发布数据,尚未给出 GPU 型号、并发、输入输出长度、低熵条件或端到端延迟,因此不能与此前 GB300、batch-size-1 等基准直接比较。值得继续追踪的是其正式 API 的硬件配置、价格、持续吞吐和多用户尾延迟。
来源:Zhihao Jia 发布 · LithosAI 产品动态
标签:#KimiK3 #LithosAI #Inference #Latency
SGLang 在 H20 上给出 DeepSeek-V4-Pro 271 tok/s 的特定场景结果
LMSYS/SGLang 发布 DeepSeek-V4-Pro 服务优化文章,称 1.6T MoE 模型在 H20、batch size 1 下达到 271 output tok/s,与 B300 结果相差 1.42 倍;H20 本身没有原生 FP4 Tensor Cores。项目方表示其与蚂蚁开源团队构建了场景特定 serving stack。这个结果说明旧一代或受限硬件仍可通过系统优化获得较高单请求速度,但它是特定模型、批量和输出指标,不能代替吞吐、首 token 延迟、并发稳定性和成本比较。
来源:SGLang/LMSYS 动态 · 技术文章入口
标签:#SGLang #DeepSeekV4Pro #H20 #Serving
Agent 抽象继续从“应用”变成可移植目录与运行时基础设施
社区把 Agent 描述为一组目录化资产:instructions、skills、tools、memory、identity、channels、schedules 和 evals,harness 与 runtime 则成为底层基础设施。Harrison Chase 认为这部分趋势来自 coding-agent 标准化,因为 AGENTS.md 和 skills 本身就是 Markdown 文件或目录;他还指出 observability 与 eval 平台很多,但真正能闭环建议修复、自动增加 eval 的平台仍少。这里是架构观点而非统一标准,但它解释了 Agent 资产为何越来越适合版本控制、跨模型迁移和自动改进。
来源:目录化 Agent 抽象 · Markdown 标准化 · 自动闭环缺口
标签:#AgentRuntime #Skills #Harness #Evals
Codex 团队汇总破坏性操作风险控制改进
Tibo 表示,Codex 团队过去数周上线了一批改动,以进一步降低工作过程中执行潜在破坏性操作的风险;起点是团队调查少量相关报告。抓取到的长帖被 X 折叠,未完整展示具体控制项,因此日报不补写尚未看到的机制名称或影响范围。可以确认的是,这属于团队成员对已上线安全改动的主动复盘,而不是单一事故公告;后续应以完整线程和产品文档核对默认权限、确认边界、沙箱范围与回滚能力。
来源:Codex 安全改进汇总
标签:#Codex #AgentSafety #DestructiveActions
其他值得关注
- Replit 推出由 OpenAI GPT-5.6 Luna 驱动的 Free Mode;当前动态确认产品上线,但没有展示配额和限速细则:原帖
- Kimi Work 展示面向金融分析师的三类工作流:实时投资者 dashboard、更新 spreadsheet 财务模型、批量处理并生成报告:原帖
- Ollama 开始向云订阅用户逐步开放 Kimi K3,并称将提高价格与性能信息透明度:原帖
- Harrison Chase 发布六集 Managed Deep Agents 教学播放列表,覆盖概览、核心概念与 quickstart:原帖
- Figure 表示因总部空间不足将退役 Figure 02,并明确旧机需销毁以避免 IP 泄露;这属于公司创始人的运营说明:原帖
- Corgi Cafe 的品牌饮品位被报道为低四位数美元月费的本地广告产品,进一步验证其“线下社区 + 获客媒体”模式:原帖
今日观察
今天的主线是单位经济性与控制边界同时前移:基础设施开始用每兆瓦 token 产出衡量,推理服务用每用户速度争夺 Agent 场景;与此同时,企业要求 ZDR、安全处理和破坏性操作控制。Agent 自身也正从封闭应用拆成可版本化目录,而真正稀缺的能力变成能否把观测、评测、修复与部署闭成一条可审计的循环。