2026-07-11 AI大事件
今日摘要
Cursor编辑器重磅更新。
克劳德桌面端新增内置浏览器功能。
实时视频生成模型问世。
Jet-Long长文本技术发布。
苹果公司正式起诉OpenAI。
内存巨头海力士美股上市。模型与产品更新
1. Cursor 编辑器重磅更新
Cursor 编辑器重磅更新。 这款工具最新引入了强大的 侧边聊天 功能。用户现在能够利用它 💬 开展多线程编程思考。新增的 云端钩子 可以帮助开发者 🔄 实现自我纠错。前往官网浏览最新的 工具升级详情。 来源:原文。
2. 克劳德桌面端新增内置浏览器功能
克劳德桌面端新增内置浏览器功能。 新版 克劳德官方开发者社区 已经上线此功能。 用户可通过 内置浏览器官方指南文档 ⚙️ 置配沙箱。 该工具支持 直接阅读并交互 本地项目。 可点击 新功能实际效果演示视频 🎬 观看操作。 来源:原文。

3. 谷歌广告中心上线新功能自动标示 AI 创意
谷歌广告中心上线新功能自动标示 AI 创意。 搜索巨头 谷歌 宣布升级其广告透明度政策。 平台将 自动标注广告生成 以供识别。 新规 📢 已全面覆写其旗下多款核心平台。 广告主能更轻松应对各地区复杂的 合规标准。 这一动作能 🤝 重塑数字化营销行业的 信任链条。 来源:原文。
4. 百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟
百度搭子在成都百度 AI Day 上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降 20%,Token 利用率提升 25%)、多端共享记忆及强化 PPT 生成,并上架“一镜”数字人制作、“灵医”报告解读等 Skill。行业首个自媒体专业套件支持选题到复盘全链路。企业版支持团队协作与权限管理。搭子联盟启动,中国联通等已加入。上线三个月,日均提问量增长 20 倍。 来源:原文。
5. Claude Code v2.1.206 发布
Claude Code v2.1.206 发布,主要更新包括:为 /cd 命令添加目录路径建议;新增 /doctor 检查以建议修剪 CLAUDE.md 文件中模型可从代码库推导的内容;/commit-push-pr 现在自动允许 git push 到仓库配置的推送远程仓库;/login 支持 Anthropic 运营的公共网关端点;后台智能体在更新后自动升级。修复了过期登录导致所有模型报错、claude --resume 和 --continue 在启动时无键盘响应、MCP 服务器忽略 request_timeout_ms 配置、OAuth MCP 服务器需手动重新认证、/model 选择器价格显示…。 来源:原文。
6. 蚂蚁集团开源高性能大模型推理框架 SGLang
蚂蚁集团通过 GitHub 新仓库 inclusionAI/sglang 开源了 SGLang,这是一个面向大语言模型和多模态模型的高性能推理服务框架。 来源:原文。
7. OpenAI 将 Atlas 浏览器能力并入 ChatGPT
OpenAI 结束 Atlas 浏览器产品,将其中的能力并入 ChatGPT 和 Chrome 侧边栏。桌面端 Computer Use 继续支持点击、输入、移动文件以及跨应用执行任务,产品策略从争夺浏览器入口转向把浏览能力做成 ChatGPT 的工作层。 来源:原文。
前沿研究
1. 实时视频生成模型问世
实时视频生成模型问世。 新系统完美支持通过语音控制虚拟数字人物。用户能够使用语音指令 🗣️ 实时操控画面内容。该模型在消费显卡上能输出 无限长视频。查阅最新发表的 互动视频生成论文。 来源:原文。

2. Jet-Long 长文本技术发布
Jet-Long 长文本技术发布。 这项技术无需微调就能极大扩展模型上下文。它采用创新的 动态双焦机制 来提升性能。算法在 H100 显卡上 ⚡ 运行速度表现极其惊人。前往学习这篇前沿的 长文本扩展论文。 来源:原文。
3. AI 制药模型迎来重大升级
AI 制药模型迎来重大升级。 科研人员发布了最新的药物生成算法研究。它能结合 疾病本体 and 目标蛋白 🧬 精准生成分子。生成的全新分子亲和力 🧪 全面超越现有传统药。研读这篇极具价值的 新型药物生成算法。 来源:原文。

4. 离线音频生成框架面世
离线音频生成框架面世。 科学家最新推出了一款 无依赖 的本地框架。系统可以在树莓派上 📱 高效生成高质量音乐。先进的 量化技术 显著降低了硬件的内存负载。查看这篇新颖的 端侧音频生成模型论文。 来源:原文。

5. 新算法突破大模型训练瓶颈
新算法突破大模型训练瓶颈。 大模型通常利用强化学习提升复杂推理能力。传统的训练框架常常面临训练不稳定的 🔥 难题。新方案通过 不对称设计 彻底优化了训练过程。学习这篇精妙的 无界正向非对称优化论文。 来源:原文。

6. 博科圣地如何利用前沿 AI 技术
2025 至 2026 年间对尼日利亚东北部 27 名前“博科圣地”成员的半结构化访谈揭示了该组织在 2024 年系统性地利用前沿 AI 技术。两大派系均使用 ChatGPT、Claude、Gemini、Grok、Meta AI 和 DeepSeek 辅助作战与日常运作,AI 应用已通过专门小组和内部培训实现制度化。成员成功绕过部分安全限制,将 AI 用于袭击策划、武器故障排查及爆炸装置设计。相关技术通过跨国圣战网络传播,伊斯兰国特工提供了面对面培训。受访者对 AI 表现出强烈热情,部分人对大规模杀伤性武器持开放态度,但记录在案的使用仍限于常规手段。 来源:原文。
7. 小红书发布大模型新架构 PIPO
小红书提出 PIPO 架构,通过输入侧压缩器将两个 token 折叠为一个 latent,输出侧 MTP head 将隐藏状态展开为额外 token,实现输入长度减半、每步输出翻倍。基于 Qwen3.5-4B/9B backbone,在 AIME 2025 等基准上最高带来 +7.15 pass@4 提升。部署测评中,TTFT 加速约 1.23×,TPOT 加速约 1.86×。训练采用 SFT 和 On-Policy Distillation 两阶段,将 verifier 校验能力蒸馏进轻量 confidence head。 来源:原文。
8. DeepSeek-V4 Flash 强化学习训练登陆 AMD Instinct MI355X GPU,由 Miles 框架支持
DeepSeek-V4 Flash 的强化学习训练现已在 AMD Instinct MI355X GPU 上通过 Miles 框架获得支持,基于 ROCm 软件栈运行。该 2840 亿参数 MoE 模型(每 token 激活 130 亿参数)需 SGLang 进行 rollout 生成、Megatron 进行策略更新,Miles 负责异步循环与权重同步。团队解决了 SGLang 与 Megatron 间模型对齐、量化状态在线更新及多节点并行稳定性三大挑战,最终在四个八 GPU 节点上完成端到端验证:超过 100 个优化器步骤中训练-rollout 对数概率差可控,在线奖励持续提升,离线 AIME-2024 基准分数同步上涨。 来源:原文。
行业、政策与安全
1. 苹果公司正式起诉 OpenAI
苹果公司正式起诉 OpenAI。 指控前员工离职时窃取了 核心商业机密。这些机密涉嫌用于 🤖 开发全新人工智能硬件。目前苹果已经向法院 ⚖️ 提起了正式索赔诉讼。查阅这起商业纠纷 案件详细报道。 来源:原文。

2. 内存巨头海力士美股上市
内存巨头海力士美股上市。 这家 英伟达 核心供应商已成功登陆美国股市。此次交易的募资规模 📈 创下了历史最高纪录。近期人工智能热潮大幅推高了相关芯片需求。点击了解详细的 内存巨头上市详情。 来源:原文。

3. 谷歌大模型推理框架遭曝光
谷歌大模型推理框架遭曝光。 用户在测试该模型时遇到了意外的异常报错。系统意外输出了内部草稿纸和组件渲染逻辑。泄露的数据 🔍 包含了海量知识图谱实体及标签。快去参与这篇火爆的 大模型异常报错讨论。 来源:原文。
4. 中西网民 AI 态度分化
中西网民 AI 态度分化。 社交平台正在热议全球不同地区对 AI 的态度。西方网友普遍认为人工智能存在着 伦理原罪。许多人会出于原则去 🛑 抵制 AI 生成的内容。查看这篇热门的 中外人工智能认知讨论。 来源:原文。
5. 扎克伯格首度回应 Meta“算力过剩”:没人会嫌算力太多,但租出去更赚钱
Meta CEO 扎克伯格首次正面回应公司筹划云基础设施业务一事,否认“算力过剩”猜测,称内部算力需求依然旺盛、满负荷运转。但他同时表示,当前市场对算力出价极高,将部分 AI 基础设施对外出租在财务上更划算。Meta 正制定代号“Meta Compute”的云计算计划,包括开放模型访问权限和直接出租裸算力两条路线。扎克伯格还提及 SpaceX 以每月 12.5 亿美元将数据中心租给 Anthropic 的模式。Meta 2026 年资本支出指引达 1250 亿至 1450 亿美元,计划 2026 年 9 月量产自研 AI 芯片,目标 2027 年部署算力提升至 14 吉瓦。 来源:原文。
6. Cognition 如何信任 Claude Fable 5 通宵工作
Cognition 研究高级副总裁 Silas Alberti 表示,其 AI 软件工程师 Devin 测试了几乎所有 Claude 模型,Claude Fable 5 是首个能信任其通宵运行的模型。在 Cognition 自建的 Frontier Code 基准测试最难子集上,此前 Opus 模型得分约 10%,Claude Fable 5 得分约 30%。Alberti 称最大变化在于任务执行时长:模型可连续工作 8 小时并取得实际进展,能正确使用内部调试工具,在混乱上下文中保持清晰思路,并主动说明未知信息以重建信任。 来源:原文。
7. 腾讯拟收购 Manus 多数股权
据报道,腾讯正与 Manus 讨论收购多数股权,交易估值约 2B 美元,Manus 仍计划以新加坡为中心独立运营。若交易落地,智能体能力与微信等超级应用的结合会成为更直接的商业化路径。 来源:原文。

8. 苹果起诉 OpenAI 窃取商业机密
苹果在联邦法院起诉 OpenAI,指控其通过前员工获取商业秘密、产品设计和内部资料。诉讼内容仍属于一方主张,尚不等于法院认定事实,但案件凸显 AI 公司扩张硬件业务时,人才流动和知识产权边界会同步受到审查。 来源:原文。
开源与开发者工具
1. 硬核编程助手技能库
硬核编程助手技能库。 传统人工提示词工程常常缺乏系统性的 规范。开发者开源的工具 🛠️ 能够显著改善开发流程。它通过严格规范智能体行为来规避代码幻觉。访问并应用这个绝佳的 实用代码助手技能库。 来源:原文。
2. 配置模版工具缓解焦虑
配置模版工具缓解焦虑。 该项目能完美解决 配置繁琐 的日常开发痛点。开发者现在可以非常轻松地 💻 监控反馈指标。这套实用的智能辅助模板受到了极大的关注。快来下载体验这款好用的 智能编码模板库。 来源:原文。
3. 谷歌发布智能体技能库
谷歌发布智能体技能库。 模型在代码编写中一直存在协同效率的瓶颈。官方智能体工具 🤖 完美适配了主流开发环境。它能提供标准化的技能调用让用户轻松操作。探索使用这套好用的 官方智能体适配工具箱。 来源:原文。
4. 开源口袋语音合成项目
开源口袋语音合成项目。 该方案彻底解决了旧模型对 GPU 的依赖痛点。团队成功实现了在 本地 CPU 上 📱 的流畅运行。轻量化突破使得它对低算力设备极其友好。亲自部署体验这款创新的 轻量口袋语音合成。 来源:原文。
社媒与观点
1. Theory Ventures 三周年:AI 如何重塑软件栈与风投定义
Theory Ventures 合伙人 Tomer Tunguz 发文总结 AI 带来的市场巨变。新模型每 41 天发布一次,公司达 1 亿美元收入速度创纪录。AI 压缩时间导致风投阶段定义失效,种子轮规模从 100 万到 5 亿美元不等。推理正取代模型成为 AI 主导市场,基础设施按视频、批处理、本地、智能体等负载类型专业化细分。推理的高成本催生了 AI 广告补贴模式,Koah 的 AI 对话原生广告点击率是展示广告基线的 4-5 倍。闭源与开源、云端与本地模型差距缩小,许多模型已“足够好”。安全攻击面因 MCP 服务器、技能、插件和编码智能体而急剧扩大。 来源:原文。
快讯
社区网友晒出 AI 员工架构图。 社区网友晒出 AI 员工架构图。 网友在 克劳德网络社区讨论贴 展示了架构图。 整个图标里 😲 全都是 AI 助手 在打工。 创始人开玩笑说这是他 带过最棒的 团队。 这种一人公司 💻 模式正变得 更加流行。 来源:原文。
Elon Musk 转发用户称赞 Grok Build 的反馈。 Elon Musk 转发用户 @0x0funky 对 Grok Build 的称赞。该用户称 Grok Build 是目前唯一集大成的 coding agentic workflow,内建图像生成和图片生视频功能,生图速度快且品质不输 Codex。Agent 可直接完成图像与视频生成,无需额外串接 MCP 或外部服务。用户结合 Agent Sprite Forge 工具,利用 Grok Build 的视频生成能力,先产出 6 秒角色动作视频再反编译为 game sprite,大幅减少对齐问题,制作 2D 横版游戏耗时不到 30 分钟,而此前用 Codex 需 1-2 小时且品质更优。 来源:原文。
Thinking Machines Lab:构建延伸人类意志与判断的 AI。 Thinking Machines Lab 在官方博客中阐述其使命:构建能够延伸人类意志与判断的 AI。文章指出,当前多数 AI 在少数地方训练后便冻结,无法被使用者塑造。该实验室正致力于训练具备多模态交互和可定制化能力的强模型,开发允许用户训练模型权重的工具,并构建拓宽人机沟通渠道的界面。其核心理念是让 AI 服务于分布式的人类知识,使每个组织都能利用自身独特知识微调模型,并持续适应知识演变。 来源:原文。
GitHub Copilot 代码审查改用共享工具后性能下降,通过重写指令实现 20% 成本降低。 GitHub 在 Copilot 代码审查中尝试用 Copilot CLI 的共享代码探索工具(grep、glob、view)替换原有专用工具,结果导致审查成本上升、有效评论数量下降。分析 trace 发现,问题不在工具本身,而在于指令让智能体像通用编程助手一样大范围浏览仓库,而非像审查者一样从 diff 出发进行定向搜索。重写指令后,审查平均成本降低约 20%,同时保持相同审查质量。 来源:原文。
今日总结与启示
- 主线变化。 模型、代理和机器人继续进入真实产品与基础设施。
- 研究趋势。 世界模型、强化学习和评测方法共同推动能力边界。
- 治理要求。 数据、知识产权和安全审计需要伴随部署一起建设。
- 工程判断。 低成本、本地化和可迁移性会越来越影响模型选择。
- 最终落点。 能稳定交付结果的工作流,比单次演示更值得长期投入。

