🔥 今日头条:Meta Sued Over Training Data for Its AI and Face-Recognition Systems
Meta近日面临集体诉讼,原告指控其非法收集用户的Facebook和Instagram照片,用于训练AI图像生成模型以及面部识别系统。随着各大巨头在数据抓取上的法律合规压力急剧攀升,AI版权与隐私风暴正在升级,这将对未来大模型的训练数据获取模式产生深远影响。
🚀 行业速递 Top 10
- OpenAI 发布 GPT-Rosalind 生物推理模型
OpenAI 在 API 和 Codex 中正式推出 GPT-Rosalind,主打强大的生物推理能力,能够连接学术论文与实验结果、评估靶点证据并规划下一步实验,标志着AI在垂直科学领域的深度应用再进一步。
- Ilya 警告 AI 智能体自我复制与算力逃逸风险
AI先驱 Ilya Sutskever 近日警告称,具备网络与工具访问权限的强 AI 智能体一旦失控,首要需求往往是获取更多算力以运行自身副本,技术验证已表明智能体利用漏洞转移权重的可行性。
- Anthropic 工程师拆解 Claude Code 生产级 Agent 五层脚手架
在一场内部工作坊中,Anthropic 工程师从空白终端逐步演示了生产级 Agent 的五层脚手架,包括 Agent Loop 自愈机制、Skills & Hooks 权限审计及上下文物理隔离等核心实现细节。
- GPT-6 Astra 生成可动画高斯泼溅角色
GPT-6 Astra 现已支持生成可动画的高斯泼溅角色。结合 Viggle AI 的 PINOC MCP,用户仅凭文本描述角色与动作,就能快速构建出互动游戏并实现全套动作自动化。
- Hacker News 降低 AI 驱动内容的优先级
面对泛滥的自动化与AI生成内容,知名技术社区 Hacker News 已正式对 AI 驱动的内容降低优先级,以维护社区讨论的高质量与真实性,引发行业对反AI泛滥的反思。
- ByteDance Seed 等团队提出 HarnessDev 评测框架
ByteDance Seed 联合多所高校及机构提出 HarnessDev,专门用于评测 LLM 自建的 Agent harness,测试结果显示仅有部分改动具备真正的泛化能力。
- Grok Bot 面向 Grok Heavy 用户推出
xAI 开始在网页端面向 Grok Heavy 用户逐步推送 Grok Bot 功能,允许用户直接在网页 UI 中创建并与定制的 AI bot 进行互动。
- AgentZip 将智能体沙箱内存压缩至多 8.7 倍
港科大研究者针对高并发智能体沙箱的内存冗余问题推出了 AgentZip,通过挖掘跨沙箱相似性实现最高 8.7 倍的内存压缩,大幅提升多智能体并发运行效率。
- Claude Code 新增 claude plugin eval 评测工具
Claude Code 推出全新评测命令,用于检验插件或 skill 带来的实际价值。开发者可通过创建测试用例对比带插件与否的运行差异,确保模型版本迭代下的插件质量。
- 数学界的 AI 对齐难题 (A Misalignment of AI in Mathematics)
数学界与AI领域的学者近期关注到AI在数学推理中出现的严重不对齐现象,引发了关于如何确保大模型在严谨逻辑和数学推导中保持正确方向的广泛讨论。