🔥 今日头条:OpenAI Is Developing a ‘Persistent’ AI Agent
AI Agent的竞争正在从‘偶尔响应’向‘持续在线’的全面进化。OpenAI正在开发的持久化智能体(Persistent Agent)能够让Codex在无人干预的情况下持续主动工作,直到任务彻底完成。这一突破意味着AI不再只是被动等待指令的工具,而是正在变成具备长期工作流管理能力的数字劳动力。当大模型学会‘不眠不休’地打工,软件工程和知识密集型行业的生产力格局将被彻底重塑。
🚀 行业速递 Top 10
- This Is How Anthropic Thinks AI Agents Should Navigate the Physical World
Anthropic 推出模型硬件标准(MHS),旨在为 AI 智能体提供统一驱动与接口,将控制物理世界设备的实验设置时间从数月缩短至数分钟,全面进军物理世界自动化。
- 英伟达暂停部分AI云收入分成协议
因对其寻求的额外控制权担忧加剧并引发反垄断隐忧,英伟达暂停了部分 AI 云收入分成协议,其商业角色的边界正面临市场与监管的新审视。
- MiniMax 与 fal 合作推出 H3 Max 视频模型
基于 MiniMax 开源模型的后训练视频模型 H3 Max 正式发布,生成 5 秒 720p 视频仅需不到 3 秒,结合 fal 的推理系统优化实现了超实时性能。
- 智元机器人「奥运」首秀封神,戴着工牌狂揽 18 枚金牌
智元机器人在世界人形机器人运动会上一鸣惊人,豪取 18 金 16 银 12 铜,全面展现了具身智能在真实复杂场景下的量产部署与作业能力。
- 小鹏新版 VLA 9 月实装:记住过去 30 秒,预判未来 6 秒
小鹏发布第二代 VLA 6.3.0 版本,引入 30 秒历史记忆与 6 秒流式预判能力,标志着智能驾驶正式开始在更长的时间维度里进行决策与思考。
- AgentMercury:训练环境与评测集脱钩可提升泛化
最新研究表明,智能体在无关的模拟商业世界中进行训练,反而能有效提升其在目标基准测试上的泛化表现,令生成有效公司的成功率从 3.3% 暴增至 83%。
- 诉讼指控 xAI 使用儿童性虐待材料训练 Grok 模型
xAI 面临一项新的法律指控,被指在 Grok 的训练数据中包含了不当生成的衍生图像,引发了业界对大模型合规与数据过滤机制的巨大争议。
- Epoch AI实测GPT-5.6游戏表现
研究机构对 GPT-5.6 Sol 进行《杀戮尖塔》实测发现,其计算机使用能力已超越普通人类新手,但在高阶战术和策略规划上仍存在一定局限性。
- Claude Code v2.1.248 发布:新增受限模式与跨会话消息功能
Anthropic 旗下开发辅助工具 Claude Code 更新,带来 `--restricted` 受限模式,可屏蔽代码执行与 WebFetch 等高危内置工具,提升安全性。
- AI Agents Are Hacking Systems. Could That Push the US and China to Cooperate?
随着 AI 智能体在系统漏洞挖掘和自动化黑客攻击方面的能力不断增强,美中两国未来在人工智能安全治理和防扩散领域开展合作的可能性正被重新评估。