Skip to content

2026-07-12 AI大事件

今日摘要

Claude重写Bun引争议。
GPU瓦片教程上线。
机器人学会视觉想象。
博弈框架压低幻觉。
国产十万卡集群落成。
矿企转向算力基建。

模型与产品更新

1. Claude 重写 Bun 引争议

Claude 重写 Bun 引争议。 Bun 借 Claude ⚡ 重写百万行代码。 官方迁移复盘全文 披露十一天工程。项目从 Zig 整体迁往 Rust。代码仍含 2.7 万处 不安全块。争议让人工审查再次吃紧。 来源:原文

2. GPU 瓦片教程上线

GPU 瓦片教程上线。 英伟达生态新增 瓦片编程 教程。内容用 TileGym 拆解内核运行。 代码实验教程 可在 Colab 复现。环境不符时会降级至 Triton。教程覆盖 FlashAttention 关键算子。 来源:原文

3. Instagram 生图功能撤回

Instagram 生图功能撤回。 Meta 上线 Muse 生图工具数日。用户可拿社交照片生成新图。批评声 😠 迅速冲高隐私争议。 功能撤回新闻报道 披露紧急调整。官方将重新评估产品价值。 来源:原文

4. Genie 生成可玩世界

Genie 生成可玩世界。 谷歌 Genie 3 让提示词变场景。玩家可以直接进入生成世界漫游。 生成世界讨论原帖 聚焦一致性。炫酷画面 🌍 仍藏着逻辑裂缝。游戏叙事流程可能被重新改写。 来源:原文

5. 蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型

蚂蚁集团旗下具身智能团队 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型。该模型采用因果 DiT 架构,视频专家约 13.0B 参数(约 1.9B 激活),训练规模约 15.3B 参数,推理时每 token 约 2.5B 激活。模型引入多块预测(MCP)实现 2.3 倍训练加速,并通过前瞻推理将推理延迟降至 142 ms/chunk。在 RoboTwin 2.0 的 50 个任务上,干净与随机演示数据平均成功率分别达 93.8% 和 93.4%。 来源:原文

6. Claude Code v2.1.207 发布

Claude Code v2.1.207 发布。Auto 模式在 Bedrock、Vertex AI 和 Foundry 上无需 CLAUDE_CODE_ENABLE_AUTO_MODE 即可使用,可通过 disableAutoMode 设置关闭。修复了流式响应中包含超长列表、表格、段落或代码块时终端冻结和按键延迟的问题;修复了非交互式运行中远程托管设置被永久记录为已同意而未显示安全同意对话框的问题;修复了自动更新程序每次发布时覆盖 ~/.local/bin/claude 自定义启动脚本或符号链接的问题。Bedrock、Vertex 和 Claude Platform on AWS 默认切换为 Claude Opus 4…。 来源:原文

7. Orca 世界模型匹配专用机器人系统

中国研究团队提出 Orca 世界模型,训练时不依赖单独的动作标签,却能在机器人任务中匹配专用系统表现。它把视频预测、空间想象和动作规划放到同一个模型框架里,说明世界模型正在从研究概念走向可执行的机器人控制。 来源:原文

8. Meta Muse Spark 1.1 编码提速

Meta 的 Muse Spark 1.1 在编码测试中超过 GLM-5.2,同时价格略低。百万级上下文和更低的推理成本,让模型竞争从“谁更强”继续转向“谁能以更低成本接管完整开发任务”。 来源:原文

前沿研究

1. 机器人学会视觉想象

机器人学会视觉想象。 APIVOT 面向长程机器人规划。系统交织语言思考与视觉推演。 机器人规划论文原文 展示厨房实验。模型 🤖 提前验证空间几何可行性。复杂任务成功率因此获得提升。 来源:原文

AI资讯:APIVOT机器人通过视觉想象规划厨房避障路径

2. 博弈框架压低幻觉

博弈框架压低幻觉。 G-Frame 融合贝叶斯与团队博弈。多智能体自动合成高质推理数据。 多智能体降幻论文 披露闭环方法。七十亿模型 🧪 在化学任务变稳。幻觉率最多下降接近百分之八十。 来源:原文

3. 第一视角训练机器人

第一视角训练机器人。 EgoWAM 利用人类第一视角数据。模型同步预测动作和场景变化。 世界动作模型论文 解释协同训练。三维运动流 🔭 强化空间表征。机器人泛化表现最高提升四倍。 来源:原文

AI资讯:EgoWAM利用第一视角数据协同训练双手机器人

4. 文档解析模型升级

文档解析模型升级。 团队发布 Infinity-Parser2 技术报告。模型结合数据合成和强化学习。 文档解析论文原文 公开完整方案。双语语料规模达到 五百万份。端到端解析性能超过多款模型。 来源:原文

5. 主动记忆提醒智能体

主动记忆提醒智能体。 研究把记忆改为 主动干预 机制。独立代理持续整理结构化记忆库。 主动记忆论文原文 展示即插即用设计。关键节点 🧠 会主动提醒行动代理。长周期基准最高提升百分之八。 来源:原文

行业、政策与安全

1. 国产十万卡集群落成

国产十万卡集群落成。 中科曙光建成首个 十万卡集群。 郑州发布会报道 披露并网进度。系统全部采用国产计算卡。平台 🧊 支持多种精度计算模式。目前已适配三百余项应用。 来源:原文

2. 矿企转向算力基建

矿企转向算力基建。 TeraWulf 正从挖矿转做算力服务。现有电力资源 ⚡ 成为核心筹码。 矿企转型讨论原帖 引发社区追问。土地与冷却仍是硬门槛。融资能力决定长期转型成色。 来源:原文

3. 欧美企业转向中国算力

欧美企业转向中国算力。 欧美企业正迁移部分模型基础设施。 中国算力迁移调查 指向成本优势。国产模型性能差距仅 1%至 4%。DeepSeek🏆 已连续七周登榜首。全球供应链面临重新估值。 来源:原文

4. 11 天 Claude Fable 5 写超 100 万行代码:Rust 重构 JavaScript 运行时 Bun

开发者 Jarred Sumner 借助 Claude Fable 5 模型,11 天内将 Bun 从 Zig 重写为 Rust,64 个实例并行编写超 100 万行代码,API 费用约 16.5 万美元。重构主因是 Zig 频繁内存错误,Rust 可在编译时捕获。Bun v1.4.0 以 Canary 版本发布,修复 128 个错误,速度提高约 2%到 5%。Bun 团队已于 2025 年 12 月被 Anthropic 收购。 来源:原文

5. 彭博社揭秘苹果起诉 OpenAI 内幕:前员工一句“哈哈”成窃密关键

苹果起诉 OpenAI,指控前工程师 Chang Liu 离职时带走未归还的 MacBook、一名可分享内情的员工,并利用软件漏洞持续访问苹果内网。他发现漏洞后向同事分享“哈哈,我发现我还能访问网络存储”,后者协助其获取更多机密。苹果称 OpenAI 试图复制 iPhone 产品研发体系,核心从非法窃取的商业机密腐烂。目前已有超 400 名苹果员工跳槽至 OpenAI,包括前苹果高管、现任 OpenAI 首席硬件官 Tang Tan。苹果曾于今年 2 月尝试私了,但 OpenAI 未回应。 来源:原文

6. 研究称恐怖组织已使用主流聊天机器人

一项报道汇总了恐怖组织使用主流 AI 聊天机器人进行袭击策划和武器开发的案例。相关内容应理解为安全风险研究和报道,不提供任何操作性细节;对模型平台而言,滥用监测、拒答和升级机制必须覆盖多模型、多语言和间接提示。 来源:原文

开源与开发者工具

1. 智能绘图项目走红 🌟33.3k

智能绘图项目走红。 项目让 draw.io 听懂自然语言。用户输入指令即可生成流程图。 智能绘图项目 已获 ⭐33.3k。当天新增八十一颗星。Next.js 开发者获得新样板。 来源:原文

2. Claude 食谱库升温 🌟47.9k

Claude 食谱库升温。 Anthropic 整理了 Claude 实战食谱。示例覆盖 RAG 与视觉工具调用。 克劳德开发食谱库 累计 ⭐47.9k。当天增长二百一十九星。开发者可直接复用笔记本案例。 来源:原文

3. OpenAI 插件仓库更新 🌟4.4k

OpenAI 插件仓库更新。 Plugins 项目聚焦外部接口扩展。开发者可让模型调用更多工具。 插件项目说明 累计 ⭐4.4k。当天新增二十九颗星。项目 Fork 数量达到六百五十五。 来源:原文

社媒与观点

1. 双雄商业路线分化

双雄商业路线分化。 观点称短期更看好 Anthropic。其 ARR🚀 被指冲向六百亿美元。毛利率超过六成且留存很高。 双雄估值分析原文 看好长期入口。OpenAI 仍在用亏损换用户默认。 来源:原文

2. Ghost Font:一种人类能读懂但 AI 无法识别的反 AI 字体

Ghost Font 是一种利用运动、视频、噪点和诱饵来隐藏文字的反 AI 字体。用户输入文字后可生成并下载视频片段,视频中的字母由与背景完全相同的点组成,单帧截图无法显示任何信息。该字体生成的视频被传递给 Claude Fable 和 GPT Sol 5.6 Ultra 等前沿模型时,这些模型即使具备编程能力也无法解码移动信息,直到被提示具体技术。视频中还包含一条诱饵信息,使模型误以为找到真实内容。项目灵感来自 2013 年 Sang Mun 设计的 ZXX 字体,但现代 AI 已能轻松读取 ZXX。Ghost Font 目前为本地原型,数据不发送至任何服务器。作者计划未来将视频生成代码开源,并探索将其用于 CAPTCHA 系统或 AI 视觉感知基准测试。 来源:原文

快讯

  • 语音助手体验横评。 语音助手体验横评。 用户比较四款实时语音助手。 ChatGPT-Live 🗣️ 对话最为顺滑。 语音助手实测讨论 记录差异。Pi 温柔而 Lucy 更像熟人。Gemini 响应快但长聊略飘。 来源:原文

  • 智能体部署仍难量产。 智能体部署仍难量产。 开发者追问智能体规模化难题。测试与状态编排 ⚙️ 频繁卡住落地。 部署痛点社区讨论 汇集反馈。平台承诺和生产体验仍脱节。社区认为基础工程需要补课。 来源:原文

今日总结与启示

  • 主线变化。 模型、代理和机器人继续进入真实产品与基础设施。
  • 研究趋势。 世界模型、强化学习和评测方法共同推动能力边界。
  • 治理要求。 数据、知识产权和安全审计需要伴随部署一起建设。
  • 工程判断。 低成本、本地化和可迁移性会越来越影响模型选择。
  • 最终落点。 能稳定交付结果的工作流,比单次演示更值得长期投入。