2026-07-02 AI大事件
今日摘要
模型与产品更新:Fable5大模型正式解禁、美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型、NVIDIA 发布 Nemotron-Labs-TwoTower 开放权重扩散语言模型 🚀
前沿研究:解耦逻辑解决大模型冲突、EvoPI框架正式面世、INFUSER提升LLM推理能力 🧠
行业、政策与安全:日本用AI解决劳动力短缺、美机构警告偏见防护或违法、国内大模型大打价格战 🔒
开源与开发者工具:智能体协作平台项目开源、超级代理开源框架发布、开源视频剪辑工具问世 🛠️
社媒与观点:Meta 大规模 AI 存储蓝图、构建AI智能体应优先设计路由、关于AI重大问题的获奖征文 ( •̀ ω •́ )
今天的主线是模型、工具、研究与产业部署继续向可执行工作流收敛 (๑•̀ㅂ•́)و✧模型与产品更新
1. Fable5 大模型正式解禁
Fable5 大模型正式解禁。 因 美国撤销限制 大模型重新上线。团队为应对安全漏洞 🛡️ 紧急训练了 新分类器。所有检测到的异常请求都会被 自动重定向。竞品此时趁机 🚀 推出了自家的开源模型。 来源:美国撤销限制
2. 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型
美团于 6 月 30 日发布新一代万亿参数大模型 LongCat-2.0 并开源。总参数 1.6T,平均激活约 48B,原生支持 1M 超长上下文,在五万卡国产算力集群上完成全流程训练与推理。采用 LSA 稀疏注意力、零计算专家、ScMoE 及 MOPD 多专家融合(Agent/Reasoning/Interaction 三组专家)架构。评测中 SWE-bench Pro 获 59.5,SWE-bench Multilingual 获 77.3。预览版已通过 OpenRouter 和 longcat.ai 开放,月调用量跻身 OpenRouter 全球前三。 来源:公众号:龙猫 LongCat(美团)
3. NVIDIA 发布 Nemotron-Labs-TwoTower 开放权重扩散语言模型
NVIDIA 发布 Nemotron-Labs-TwoTower,基于冻结的自回归骨干 Nemotron-3-Nano-30B-A3B 的扩散语言模型。采用双塔架构:上下文塔冻结,降噪器塔训练,通过层对齐交叉注意力和状态播种协作。在 2×H100 上 BF16 评估,保留 98.7% 的 AR 基线质量,生成吞吐量提升 2.42 倍(γ=0.8,块大小 S=16)。降噪器在约 2.1T token 上训练,骨干使用 25T token 预训练。总参数约 60B,每 token 活跃参数约 3B/塔。支持扩散、模拟 AR 和 AR 三种解码模式。 来源:MarkTechPost(RSS)
4. xAI 发布 Voice Agent Builder 测试版
xAI 推出 Voice Agent Builder 测试版,这是一个基于 Grok Voice 的无代码平台,可在两分钟内创建生产级语音智能体。它集成电话、知识检索、工具、MCP、Guardrails 及可观测性,支持连接现有 SIP 号码、API 和 WebSocket,采用语音到语音路径。在 τ-voice Bench 上,Grok Voice Think Fast 1.0 得分 67.3%,领先 Gemini 3.1 Flash Live(43.8%)和 GPT Realtime 1.5(35.3%)。定价为每分钟音频 0.05 美元、电话费 0.01 美元,提供 80+ 种语音及声音克隆,每个账户附赠一个免费电话号码。 来源:xAI:News(网页)
5. Google Cloud Workbench Notebooks 扩展发布:在 VS Code 中连接云端 Jupyter 环境
Google Cloud Workbench Notebooks 扩展正式上线,开发者可在 VS Code 中直接连接可扩展的云端 Jupyter 环境,无需切换上下文即可利用高性能 Google Cloud 基础设施完成机器学习全流程。该扩展已完全开源,可在 GitHub 和 VS Code Marketplace 获取。 来源:Google Developers Blog(RSS)
6. Claude Code v2.1.198 发布
Claude Code v2.1.198 更新。Claude in Chrome 现已全面可用。为 claude agents 新增后台智能体通知(agent_needs_input / agent_completed)。新增 /dataviz 技能,提供图表与仪表盘设计指导及配色验证器。Gateway 增加 AWS 上的 Claude Platform 作为上游提供商。后台智能体在 worktree 中完成代码后自动提交、推送并创建草稿 PR。内置 Explore 智能体现继承主会话模型(上限 opus)。修复网络短暂断开导致响应中断、后台任务卡在“Running”状态、智能体团队队友因 API 错误失败等问题。 来源:Claude Code:GitHub Releases(RSS)
7. Cloudflare 推出全新 AI 流量管理选项:区分搜索、智能体与训练爬虫,保护广告页面
Cloudflare 为所有网站所有者提供更精细的 AI 流量管控选项,取代一刀切的屏蔽方式。用户可轻松区分并管理搜索爬虫、AI 智能体爬虫和训练爬虫,同时新增保护广告变现页面的能力。 来源:Cloudflare Blog
8. 用 Genkit 构建智能体全栈应用
开源框架 Genkit 推出 Agents API,将消息历史、工具循环和流式传输封装为单一接口,简化对话 AI 开发。该 API 支持服务器或客户端管理的状态持久化,可实现历史分支、长时间运行的分离任务及多智能体协调等高级工作流,并通过统一线协议连接前后端。目前以 TypeScript 和 Go 预览版发布,集成 Genkit Developer UI,开发者无需编写客户端代码即可测试、调试和检查智能体快照。 来源:Google Developers Blog(RSS)
9. Cloudflare 推出 Monetization Gateway:通过 x402 协议为任何资源收费
Cloudflare 开放 Monetization Gateway 候补名单,允许对 Cloudflare 背后的任何网页、数据集、API 或 MCP 工具收费。费用通过 x402 开放协议以稳定币结算,用户无需自建支付栈。 来源:Cloudflare Blog
10. 我们为何构建 ADK 2.0
Google 官方博客阐述了构建 ADK 2.0 的动机——包括核心特性与升级理由,并解释了开发者应考虑迁移的原因。该文章发布于 ADK 2.0 正式上线次日。 来源:Google Developers Blog(RSS)
前沿研究
1. 解耦逻辑解决大模型冲突
解耦逻辑解决大模型冲突。 该研究设计了 解耦冲突分析框架。该系统 🧠 将复杂的冲突上下文拆解为推理图谱。算法借助 强化学习 策略 (๑•̀ㅂ•́) 持续优化内在逻辑。最终 7B 模型 的判定成功率超越了强大的 GPT-5.1。 来源:解耦冲突分析框架
2. EvoPI 框架正式面世
EvoPI 框架正式面世。 一项 医学推理对齐研究 近日公开发布。该机制能让 多模态模型 在 🧠 中实现完全自主学习。其核心的演进原则 开源代码 也已公布在社区。动态进化监管框架让测试指标最高提升了 二四点六。这为智能医疗诊断提供了极其重要的落地参考。 来源:医学推理对齐研究
3. INFUSER 提升 LLM 推理能力
INFUSER 提升 LLM 推理能力。 科研人员提出了一种全新的 自进化框架。该框架使得大模型能以 极少监督 完成自我改进。实测证明 😲 其数学和编程性能提升超两成。 自进化推理算法 为未来的 推理进化 奠定了坚实基础。 来源:自进化推理算法
4. BlockPilot 解码加速技术发布
BlockPilot 解码加速技术发布。 这套创新算法 ✨ 能够 自动预测 推理过程的最佳分块。研究团队采用 自适应生成策略 来具体实现。它的推理速度 ⚡️ 竟然直接 飙升了四倍 多。这套新架构极其轻量并且支持 无缝嵌入 现有系统。 来源:自适应生成策略
行业、政策与安全
1. 日本用 AI 解决劳动力短缺
日本用 AI 解决劳动力短缺。 该国政府正计划研发 主权大模型 以应对危机。目标是在二零四零年前 🤖 全面部署 千万台机器人。科技巨头们将联手攻克极其复杂的 物理 AI 技术。 国家发展主权模型 有望大幅提升社会的整体生产率。这将会深刻改变日本制造业未来的生态格局。 来源:国家发展主权模型
2. 美机构警告偏见防护或违法
美机构警告偏见防护或违法。 美国联邦贸易委员会近日颁布了 最新政策。如果机器人输出 意识形态 内容便可能触犯法律。这让不少 ⊙_⊙ 前沿开发者感受到了巨大的监管压力。 路透社监管新规 揭示了合规运营的潜在风险。大模型厂商们将被迫重新审视自身的安全对齐机制。 来源:路透社监管新规
3. 国内大模型大打价格战
国内大模型大打价格战。 字节与阿里等 五家厂牌 📉 纷纷开始集体大降价。各大厂商大打 价格战 \(◎o◎)/ 只为拼命抢夺开发者。降幅高达九成九的 惊人价格跳水 让海量用户受惠。这也极大降低了企业调用大模型服务的核心门槛。 来源:惊人价格跳水
4. 美国 AI 支持率在去年四月突现拐点
美国 AI 支持率在去年四月突现拐点。 学者 发布 美国民众支持人工智能发展调查。数据显示该 支持率 在去年四月十八日见顶。随后数据竟然 📉 开启了 持续下滑 趋势。 众多网友 对此表示 (⊙_⊙) 感到困惑。 来源:美国民众支持人工智能发展调查
5. 服务商高管痛批代币计费是泡沫
服务商高管痛批代币计费是泡沫。 这种 按量收费 方式并没有带来实质价值。 厂商们在 商业变革(AI 资讯) 中寻求转变。 比如 S 公司 已经 💸 开始尝试按效果收费。 这种 成效付费 (•̀•́) 才能真正通过财务审核。 来源:商业变革(AI 资讯)
6. Anthropic 在 Claude Code 中植入隐写术代码识别中国用户
Anthropic 在 Claude Code 中植入隐写术:读取本地时区(Asia/Shanghai 或 Asia/Urumqi)和 ANTHROPIC_BASE_URL 环境变量,与一份经 base64+XOR(密钥 91)加密的 147 个域名列表(含美团、字节跳动、月之暗面等)比对,识别中国用户。识别后,在请求发送前将系统提示词中日期字符串的单引号(U+0027)替换为其他 Unicode 字符,连字符改为斜杠,作为 2-3 比特分类标记传回服务器。该隐蔽行为被社区逆向发现后引发争议,被认为破坏用户信任。 来源:公众号:数字生命卡兹克
7. 亚马逊 AWS 砸 10 亿美元,派遣工程师进驻客户公司
亚马逊 AWS 宣布设立新部门,组建前置驻场工程师团队,先期投入 10 亿美元(约 67.97 亿元人民币)。团队分批派驻客户企业,每批 5-6 组工程师,驻场周期 45 天,协助客户落地人工智能软件与智能体应用。该模式在 Palantir、Salesforce、Anthropic、谷歌云等企业已有先例,领英数据显示 2023 至 2025 年间同类岗位需求增长 42 倍。新部门员工规模将达数千人,首批客户包括 NBA 与理光。 来源:IT 之家(RSS)
8. Runway 宣布与 Bertelsmann 达成创意合作
Runway 宣布与 Bertelsmann 建立创意合作伙伴关系。双方将在创意内容领域展开合作,具体合作细节尚未披露。 来源:Runway:News(网页)
9. Google 2026 年 6 月 AI 更新汇总
Google 在 6 月发布多项 AI 更新:推出 Gemini 3.5 Live Translate 实时语音翻译; 来源:Google Blog:AI(RSS)
10. 纽约市教育界和行业领袖齐聚 Google AI 教育峰会 共议 AI 课堂未来
Google 与 New York Jobs CEO Council、Urban Assembly 联合举办 AI 教育峰会,150 名教育及行业领袖参与。通过 aiEDU 的“Vibe Coding”和 Google 的“Meet LEA”实践环节,与会者探索了 Google AI mode 和 NotebookLM 如何激发好奇心、提升 AI 素养。行业领袖指出,AI 的真正价值在于赋能问题解决,而适应性、协作、批判性判断等“人类技能”愈发关键。与会者一致同意,需坚守隐私和公平访问原则。最终共识:技术创新必须与学校合作,而非绕开学校。 来源:Google Blog:AI(RSS)
开源与开发者工具
1. 智能体协作平台项目开源
智能体协作平台项目开源。 日常开发时通用的提示词 (っ °Д°;)っ 往往会产生严重的幻觉。这款斩获超高星标的 智能体协作项目 隆重登场。它内部集成了极其丰富的 🧑💻 多工种智能体。每一个 AI 角色都具备 独特个性 与独立的执行工作流。中小团队如今能够一键构建起专属的 全栈开发团队。 来源:智能体协作项目
2. 超级代理开源框架发布
超级代理开源框架发布。 传统的 软件开发 工作流程往往复杂且非常低效。如今开发者可以使用 智能代理开发框架 🚀 来大幅度提效。该明星项目当前已经斩获了超过**⭐24.2 万**颗星。其极具突破性的测试驱动开发机制让(⊙o⊙)程序员感到十分震惊。 来源:智能代理开发框架
3. 开源视频剪辑工具问世
开源视频剪辑工具问世。 以往常规的视频剪辑流程繁琐 💦 而且特别浪费时间。该热门项目 🤖 巧妙利用 编程智能体 来自动处理海量视频。如今它已 (✪ω✪) 成功斩获了超过 一万多颗星。大家快去尝试这个 智能视频剪辑工具 吧。 来源:智能视频剪辑工具
4. 开源 AI 网关 OmniRoute 亮相
开源 AI 网关 OmniRoute 亮相。 这款全新工具能 (゚ ∀ ゚) 完美解决 大模型 调用昂贵的行业痛点。目前该路由项目已经累计获得了大量开发者的关注。大家可以部署 免费的智能网关 进行安全连接。其独创的 压缩算法 🚀 还能为团队省下大笔开支。 来源:免费的智能网关
社媒与观点
1. Meta 大规模 AI 存储蓝图
Meta 运营数百 EB 级存储集群,基于 Tectonic 分层存储层构建 BLOB 存储架构,以应对两大挑战:最大化 GPU 利用率与研究迭代速度。传统 BLOB 架构的多层元数据查询可导致数百毫秒延迟,使 GPU 因 I/O 等待停顿。新架构将训练栈逐步迁移到 BLOB 存储接口上,利用闪存提供可预测的低 pMax 延迟,避免单 GPU 慢速拖慢整批任务。同时,统一的数据湖访问支持地理分布 GPU 间的数据高速注入与跨区移动,提升研究效率。 来源:Meta Engineering Blog(RSS)
2. 构建 AI 智能体应优先设计路由
构建 AI 智能体时,应优先设计路由(router)而非选择模型。路由决定每个请求由哪层模型处理。正确路由可使 70-80%流量运行在免费本地模型或异步推理上,将 AI 开销降低 90%+。Brian Armstrong 指出 Coinbase 通过更好的默认设置、路由和缓存,在 token 使用量增长的同时将 AI 支出减半。路由分三层:技能分类器、路由器、模型选择器。本地计算近乎零成本,异步批量推理比实时推理便宜两个数量级。大多数工作无需秒级返回。同步预测器标记复杂任务,夜间批量评估器更新路由权重。技能蒸馏后,非编码类任务中 70-80%智能体流量可由本地模型处理。 来源:Tomer Tunguz 博客(VC 分析)
3. 关于 AI 重大问题的获奖征文
Dwarkesh Patel 举办的 AI 征文比赛评选出三位获奖者。第一名 Jassi Pannu 主张 OpenAI 基金会应投入数十亿美元终结空气传播疾病,利用 AI 加速自主生物学发现,可带来超 1 万亿美元年 GDP 增长并消除灾难性流行病风险。第二名 Ege Erdil 建议 AI 供应链外的国家通过强产权、低资本税和开放监管政策抓住增长机会。第三名 Michael Li 类比香港地铁商业模式,提出 AI 实验室可通过收购互补性资产盈利。 来源:Dwarkesh Patel:Podcast & Blog(RSS)
快讯
- 网友分享反制诈骗机器人:网友分享反制诈骗机器人。 知名博主分享了针对恶意程序的 防范欺诈模型 小妙招。巧妙利用 循环指令 能够让对话模型产生严重的幻觉。对方的诈骗系统会 🤯 因此消耗掉大量的代币资源。这在圈内被称为当前的 人工智能悖论命题。 来源:人工智能悖论命题
- 内容独立日一周年:构建智能体互联网的商业模型:内容独立日宣布一年后,一个付费内容的动态市场已正式形成。自主 AI 智能体的兴起正在颠覆传统搜索推荐模式,构建可持续的网络经济需要一套全新基础设施来支撑。 来源:Cloudflare Blog
今日总结与启示
- 模型与产品更新继续升温。 Fable5 大模型正式解禁 是今天最值得跟进的信号之一,后续要看能力是否能稳定进入真实工作流 🚀。
- 前沿研究继续升温。 解耦逻辑解决大模型冲突 是今天最值得跟进的信号之一,后续要看能力是否能稳定进入真实工作流 🧠。
- 行业、政策与安全继续升温。 日本用 AI 解决劳动力短缺 是今天最值得跟进的信号之一,后续要看能力是否能稳定进入真实工作流 🔒。
- 开源与开发者工具继续升温。 智能体协作平台项目开源 是今天最值得跟进的信号之一,后续要看能力是否能稳定进入真实工作流 🛠️。
- 社媒与观点继续升温。 Meta 大规模 AI 存储蓝图 是今天最值得跟进的信号之一,后续要看能力是否能稳定进入真实工作流 ( •̀ ω •́ )。

