🔥 今日头条:突发| DeepSeek 多模态模型上新,鲸鱼终于开「天眼」了
DeepSeek 重磅发布面向 Agent 时代的多模态模型 deepseek-v4-flash-vision-exp,正式补齐视觉理解短板并配合 Files API。这意味着开源巨头在多模态与智能体协同上再度提速,不仅让大模型拥有了真正的“天眼”,也向闭源巨头发起了更具侵略性的生态攻势,Agent 开发者迎来重大利好。
🚀 行业速递 Top 10
- 微软数据中心迎来首批量产Vera Rubin
微软数据中心正式迎来首批量产版 NVIDIA Vera Rubin 硬件交付,标志着新一代算力基础设施进入落地快车道,将为后续超大规模 AI 模型训练与推理提供恐怖的底层支撑。
- Marin 535B-A23B 启动训练,全程开源
超大参数模型 Marin 535B-A23B 本周正式启动训练,计划在 11 台 GB200 NVL72 上以 18.75T tokens 耗时约 3 个月完成,全程保持开源,展现了开源社区对顶级算力的硬核追赶。
- OpenAI 降 GPT-5.6 Sol 价格逾两成
OpenAI 再次打出效率牌,将其旗舰模型 GPT-5.6 Sol 的使用价格大幅下调超过两成。这证明其在基础设施和算法优化上具备极强的护城河,让用户以更低成本享受前沿智能。
- Meta Muse Spark 1.2 上线 OpenRouter
Meta 的 Muse Spark 1.2 contributor 版本正式上线 OpenRouter,以极低的输入输出价格提供媲美高端模型的性能,但其数据回流训练的模式也引发了开发者对隐私的关注。
- 自进化也能“左脚踩右脚”?Google 最新提出 EnvHarness
Google 最新提出的 EnvHarness 框架通过让环境实现自进化,来强力倒逼 AI Agent 持续提升。该方法在 SWE-bench Verified 上展现出极佳潜力,开辟了智能体训练的新范式。
- 自我改进智能体的记忆脆弱性研究
Salesforce 最新研究测试发现,基于记忆的智能体对任务顺序极度敏感。打乱顺序不仅会导致性能下滑,还可能让智能体盲目保存错误经验,揭示了当前 AI 记忆机制的脆弱性。
- 分享一些 insights|我们为什么会做 dLLM,又能否取代 AR?
本文结合 LLaDA 系列实践,深度探讨了离散扩散语言模型(dLLM)的底层逻辑与挑战,客观评估了其在 token 效率和基础设施成本上取代传统自回归(AR)模型的可能性。
- 微信 AI 修图抢先体验:能用够用,但还不够好用
微信灰度测试 AI 修图功能,展现了腾讯将大模型能力向国民级应用渗透的路径。实测表明其功能虽满足基础日常,但在精细化体验上仍有较大打磨空间。
- 长飞光纤上半年净利润暴涨 888.88%
受全球 AI 数据中心建设爆发式需求的强力驱动,光纤线缆龙头长飞光纤上半年净利润同比暴涨近 9 倍,印证了 AI 浪潮正向传统光通信基础设施全方位传导。
- AI时代将充满矛盾:人人厌恶又人人使用
行业观察指出,未来的 AI 时代将充满社会心理矛盾:公众在舆论场上普遍对 AI 表达抗拒与批判,但在实际生活中却又高度依赖,甚至对特定模型产生强烈的情感依恋。