AI 日报 | 2026年07月23日
阿里开源编程模型登顶、腾讯全流程AI开发工作台内测、OpenAI甲骨文数据中心协议锁定——AI Coding基础设施竞争进入"开源+全栈+算力"三线并跑阶段;它石智航千台级集群落地人民日报专题、WAIC余波"真干活"取代"翻跟头"成为评价标准——具身智能从展台验证跨入产线交付。
阿里开源 Qwen3-Coder:480B MoE 编程模型登顶开源 SOTA
7月23日,阿里通义团队正式发布 Qwen3-Coder-480B-A35B-Instruct。该模型采用 480B 总参数、35B 激活的 MoE 架构,原生支持 256K 上下文(YaRN 可扩展至 1M token),支持 358 种编程语言。在 Agentic Coding、Browser-Use、Tool-Use 三类基准测试中多项指标达开源 SOTA,性能对标 Claude Sonnet 4。同步开源 Qwen Code CLI 工具,支持"一条命令接管整个代码仓库",可自主完成需求理解→任务拆解→代码编写→测试执行→缺陷修复全流程。训练方法采用 Agent RL 强化学习,将多轮交互与工具调用深度集成于模型本体,而非后期插件——预训练使用 7.5 万亿 token(70% 为代码),后训练引入执行驱动 RL 以百万级测试用例成功率作为奖励信号。定价每百万 Tokens 输入 4 元 / 输出 16 元,平均成本为 Claude 4 的 1/3。模型完全开源且允许免费商用。
值得关注: Qwen3-Coder 将"Agent RL"训练范式从概念验证推向工业化——2 万并发编程环境模拟真实 CI/CD 流程,SWE-Bench Verified 开源第一。成本仅为 Claude 4 的 1/3 且完全开源商用,标志着 AI 编程从"辅助工具"向"自主 Agent"跃迁的路线,开源阵营首次在编程 Agent 领域形成与闭源前沿模型的对标能力。
来源:doNews | 东方财富研报 | The Edge Malaysia
腾讯云 CodeBuddy IDE 开启内测:首个全流程 AI 一体化开发工作台
7月22日,腾讯云宣布 CodeBuddy IDE 正式开启内测。这是首个实现"产品—设计—研发部署"全流程 AI 一体化的开发工作台,主打"对话即编程"——用户仅用自然语言即可完成从产品构想到部署的全流程。以电商活动页为例,传统方式需两天完成 1 个页面,使用 CodeBuddy IDE 后全过程不到 2 小时。国际版整合 Claude、GPT、Gemini 等模型,国内版支持混元、DeepSeek。腾讯云已成为国内首个覆盖插件、IDE、CLI 三种 AI 编程形态的云厂商。同期,腾讯混元推出递归自我改进智能体 Hyra-1.0,通过自博弈、自评价和用户反馈机制持续迭代优化策略,在 55 个数学问题中的 29 个刷新纪录并已开源。腾讯开发者产品总经理刘毅表示,未来 AI 编程将分化为两种范式:简单应用走"氛围编程",复杂系统走"规约编程"团队协作。
值得关注: CodeBuddy IDE 将腾讯 AI 编程从"辅助插件"升级为"独立工作台",与微信 AI 小微、元宝、WorkBuddy、企业微信大圆形成"个人→办公→开发→企业"五产品完整 AI 矩阵。三种形态全覆盖在国内属首次,标志着 AI 编程工具从单一形态竞争进入全场景生态竞争。Hyra-1.0 递归自我改进路线则暗示腾讯正在探索"AI 用 AI 改进 AI"的 RSI(Recursive Self-Improvement)路径。
来源:腾讯云开发者社区 | 雪球 | 腾讯云开发者社区(AGI全栈)
OpenAI 与甲骨文达成 4.5GW Stargate 数据中心协议
OpenAI 与甲骨文(Oracle)正式达成协议,将在美国增加 4.5GW 的 Stargate 数据中心容量。加上已开工的 Stargate I 阿比林站点,总 Stargate 数据中心容量超过 5GW,足以运行超过 200 万个芯片。此项投资预计在美国创造超过 10 万个就业岗位(含建设、运营和间接岗位)。阿比林 Stargate I 部分设施已投入运行,甲骨文上月已开始交付首批 Nvidia GB200 机架,OpenAI 已启动早期训练和推理工作负载。此前有媒体报道阿比林站点取消 600MW 扩建计划,甲骨文公开反驳称报道"错误",确认 4.5GW 合作协议仍在推进,底特律附近站点已在规划中。Stargate 总体目标从 1 月白宫宣布的 4 年 5000 亿美元 / 10GW 基础设施投资,现在预计将超越最初承诺。
值得关注: 5GW / 200 万+芯片的规模意味着 OpenAI 算力基础设施从"实验室级"跨入"国家级"——年花费或超 300 亿美元。甲骨文公开反驳取消报道并确认多站点推进,折射出 AI 基础设施竞赛的资本密度与政治博弈正同步升级。对 AI Coding 而言,算力供给的确定性直接影响前沿编程模型的迭代节奏与成本结构。
来源:OpenAI 官方(中文) | Tom's Hardware
它石智航 AWE 3.5 + 千台级工业集群落地:人民日报专题
7月22日人民日报第14版专题报道它石智航全栈自研成果落地。它石智航正式发布新一代具身智能原生基座模型 AWE 3.5——首次实现具身原生模型"预训练+后训练"完整范式,依托超百万小时"以人为中心"真实数据及视触觉信息,让机器人在真实产线上"看得懂、摸得准、干得稳"。核心硬件层面,自研 DexHand 灵巧手采用 21 自由度准直驱方案,1:1 复刻人手骨骼构型与关节分布,接入 AWE 3.5 形成从感知到操作的完整闭环。数据层面创新采用"human-centric"采集范式。同时,它石智航与上海市嘉定区签约推动落地千台级工业具身智能机器人集群部署——从攻克"汽车线束装配"柔性制造难题,到构建"手脑一体"全栈自研技术体系,再到从百台级向千台级规模化部署。
值得关注: 人民日报专题报道标志着具身智能从行业事件升级为国家话语——"培育新质生产力、助推新型工业化"的官方定位。千台级集群部署是当前国内具身智能最大规模的产线落地数字,从"汽车线束装配"等柔性制造痛点切入而非通用搬运,意味着商业化路径选择了"最难但最有壁垒"的工程路线。AWE 3.5 "预训练+后训练"完整范式的公开,是对此前行业"只有预训练没有后训练"瓶颈的直接回应。
来源:人民日报
WAIC 2026 余波:具身智能评价标准从"炫技"转向"真干活"
WAIC 2026 闭幕后的舆论场传递出明确信号:具身智能的评价标准正在发生根本性切换。200+ 具身企业、208 款终端、300+ 真机同台,但比数量更值得关注的是——"量产、适配、场景交付"取代了"能走、能跳、能翻"成为核心关键词。60 台机器人"志愿者"在世博/张江/西岸"三地四馆"各就各位提供真实公共服务,乐聚量产级机器人连续运行冲刺 8-10 小时不间断作业(纸箱拆垛成功率超 95.8%),梅卡曼德展示"一脑多形"(Mech-GPT 支持人形/工业/移动多种构型完成感知到执行闭环),翼菲科技"鸿钧"工业机器人面对混流生产无需停线改造。行业共识正在从"谁的本体更酷"转向"谁的工程能力更强"——"能不能干满 8 小时"取代"能不能翻跟头"成为验收标准。
值得关注: 评价标准的切换是具身智能产业从"概念期"进入"交付期"的标志性事件。当验收指标从视觉冲击力转向工程可靠性(连续运行时长、综合成功率、换型响应速度),意味着客户从"好奇的观众"变成了"苛刻的采购方"。乐聚 8-10 小时不间断作业、梅卡曼德"一脑多形"多构型闭环、翼菲"鸿峻"混流不停线——这些不是炫技展示而是产线级交付验证,标志着中国具身智能正式进入"真干活"的产业验证阶段。
来源:金台资讯/头条 | 南方都市报/网易 | 澎湃新闻