🔥 今日头条:OpenAI Astra 内部版攻克 10 大数学难题,AI 基础科学迎来质变
据最新消息,OpenAI 研究员 Noam Brown 透露,下一代模型家族的内部版 Astra 已成功解决数学、量子复杂性与理论计算机科学领域的 10 个重大开放问题。OpenAI 历来只在成果能彻底颠覆外界对 AI 进展认知时才选择公开。这一突破不仅意味着大模型在高级抽象推理上正超越人类经验边界,也宣告着 AI 从“语言文字游戏”向“严谨科学探索”的跨越式挺进。当 AI 开始自主攻克人类数十年未解的数学难题,新一轮科学范式的重构已然拉开帷幕。
🚀 行业速递 Top 10
- #692.Neil Movva:把 AI 推理成本降 10 倍,智能充裕时代如何绕开芯片与电力瓶颈
Sail Research 创始人 Neil Movva 分享如何通过软件优化、非主流芯片与分散式小型数据中心,将 AI 推理成本降低十倍,为智能充裕时代开辟破局之路。
- Gemini 3.8 即将发布,谷歌全力加速竞争
据 Business Insider 报道,部分谷歌员工已开始使用 Gemini 3.8 Flash 预览版,凸显了 AI 竞赛白热化阶段“每隔几周迭代新模型”的疯狂节奏。
- 长时程AI任务评测:顶尖模型仅达人类27.3%
一项为期一年的长时程任务测试显示,包括 GPT-5.6 Sol 和 Claude Opus 4.8 在内的 8 款领先模型,最终配置下仅获得人类平均收益的27.3%,凸显当前AI在长时程执行可靠性上的严重不足。
- Vercel 发布 vgpu:面向 AI 智能体的 WebGPU 库
Vercel 推出基于 WebGPU 构建的 vgpu 库,专门为 AI 智能体提供高性能、可跨平台的着色器运行环境,全面支持 TypeScript 模块化导。
- FreeToken 引擎让 8GB 游戏本跑 35B 模型
伯克利和得克萨斯大学推出 FreeToken 引擎,让 8GB 游戏本运行 35B 模型达到 39.3 tokens/秒,将专家缺失率大幅降至 16%,极大地拓宽了开源大模型的终端落地场景。
- GLM-5.3-Flash 用 16.7 倍低成本完成 Blender 建模
GLM-5.3-Flash 通过 MCP 控制 Blender 完成复杂建筑建模,成本仅 $0.0526,比标准版低 16.7 倍且耗时更短,展现了轻量化模型的惊人实用性。
- Meta "Project Hatch"超级应用曝光:浏览器与电脑操控
Meta 内部正测试“Project Hatch”超级应用,支持浏览器与电脑操控、长期目标调度及持久化云端环境,用户还可通过 Messenger 和 WhatsApp 与其交互。
- MiniMax Fast H3 v1 发布:13秒生成15秒768p视频
MiniMax 与 Hao AI Lab、NVIDIA FastGen 合作推出开源权重视频加速模型 Fast H3 v1,可在 NVIDIA Blackwell GPU 上实现最高 14 倍加速,13 秒内生成 15 秒 768p 视频。
- Grok Bot 接入 Link 支持随处购物,绑定 Stripe 卡即可代购
Grok Bot 现已与 Link 深度协作,用户为其绑定 Stripe 关联卡后,便可通过其在任意地方进行端到端的便捷购物与代购。
- Autonomous Mathematical Discovery in an Open-World Multi-Agent Environment
最新计算机科学前沿论文,探讨在开放世界多智能体环境中实现自主数学发现的技术路径,标志着多智能体协同正在向深水区迈进。