咕泡科技 Logo 图标
下载图标
学习APP

AI前沿速递:告别Prompt内卷!AI编程进入声画驱动时代,智元赴港IPO!

2026/07/27

今日AI动态围绕「AI Coding交互与能力升级」与「具身智能场景化落地」两条主线展开。AI Coding方向,Anthropic发布Claude Opus 5并刷新多项编程评测纪录,同时大幅精简Claude Code系统提示词,提出“上下文减法”工程范式;OpenAI则为Codex接入基于GPT-Live的实时语音与Appshots,推动vibe coding从自然语言写代码走向声画直接驱动Agent。具身智能方向,头部企业智元机器人正式启动赴港IPO,目标估值400亿—500亿港元,与宇树科技科创板上市形成“双雄竞速”,标志具身智能赛道进入资本化冲刺期;自变量机器人作为唯一中国具身智能企业代表亮相APEC,并开源WALL-OSS-0.5与世界模型WALL-WM。


图片素材来源于网络,侵权即删除


一、Claude Opus 5发布:编程与知识工作评测刷新纪录


7月25日,Anthropic正式发布Claude Opus 5。据腾讯研究院AI速递整理,该模型智能水平接近Fable 5,定价为每百万输入5美元、输出25美元, reportedly 约为Fable 5的一半,并已成为Claude Max默认模型。评测方面,Opus 5在Frontier-Bench、ARC-AGI 3等编程与知识工作基准中刷新纪录;自主核查与迭代能力增强,可自建测试框架并修复真实漏洞。Anthropic官方称其为迄今对齐程度最高的模型,欺骗行为发生率最低,但生物研究与进攻性网络安全两类两用能力仍落后于Mythos 5。


图片素材来源于网络,侵权即删除


当然,Opus 5 也并非完全没有短板。Anthropic 刻意没有让Opus 5接受针对网络任务的训练,或许正因如此,在网络安全方面的表现,Opus 5距离Mythos 5还有差距。

在OSS-Fuzz上,评估模型在无需大量人工干预的情况下,发现并利用漏洞的能力,Mythos 5和Opus 5在漏洞识别方面的表现不相上下,但Opus 5在漏洞利用的构建能力上却远远落后于Mythos 5。


图片素材来源于网络,侵权即删除


值得关注的原因:这是Coding Agent底层模型能力的又一次显著跃升:不仅在编程基准上刷新纪录,还强调“自主核查—修复真实漏洞”的闭环能力,意味着模型从“写代码”向“端到端软件工程”再进一步。对AI培训赛道而言,Opus 5的定价策略与能力定位将直接影响学员对“是否需要掌握高级模型协作”的判断,也可能加剧Cursor、Claude Code、GitHub Copilot等工具之间的竞争。


图片素材来源于网络,侵权即删除


二、Claude Code系统提示词精简八成,倡导“上下文减法”


伴随Claude Opus 5发布,Anthropic删除Claude Code系统提示词中八成以上内容,内部编码评估显示无可测性能损失。Anthropic认为,模型越强,越不需要冗长的“保姆式”规则,并提出五条新范式:让Claude自行判断而非定死规则;设计好工具接口而非堆砌示例;渐进式披露、按需加载上下文;精简工具描述;依赖自动记忆。具体实践上,建议将CLAUDE.md控制在60行以内(一般不超300行),把特定任务上下文交给Skills,并使用/doctor命令自动精简配置。


图片素材来源于网络,侵权即删除


值得关注的原因:这一动作释放了一个重要工程信号:Coding Agent的竞争焦点正从“谁的提示词工程更精巧”转向“谁的工具接口与上下文组织更自然”。对企业与开发者而言,这意味着配置负担可能大幅下降,但也对工具链设计、项目知识管理提出了更高要求。对培训机构来说,课程设计需要同步升级——未来更稀缺的不是“Prompt技巧”,而是“如何设计可被Agent自然导航的接口与知识架构”。


图片素材来源于网络,侵权即删除


三、OpenAI Codex上线实时语音与Appshots:vibe coding进入声画驱动阶段


OpenAI为ChatGPT桌面端上线基于GPT-Live的实时语音功能,开发者可用自然语音指挥多个Agent;在Codex场景中,佩戴耳机即可离开电脑,随时查询进度、修改需求。同时新增的Appshots功能,使Codex能够直接读取当前活动窗口的画面与文字,无需手动截图即可理解报错或界面异常并直接修改。Andrej Karpathy评论称,语音输入尤其适合复杂任务,能以较低认知成本“倒出完整上下文”;vibe coding正在从“用自然语言写代码”演进为“把想法和屏幕画面直接交给Agent”。


值得关注的原因:这是AI编程交互范式的明显升级:从键盘输入→自然语言输入→语音+视觉多模态输入。它降低了复杂任务上下文的表达成本,也让非键盘场景(通勤、站立讨论、远程协同)的编程成为可能。对AI培训内容而言,这意味着需要新增“语音驱动Agent”“多模态上下文管理”等教学模块,同时也为课程营销提供了“未来编程形态”的叙事素材。


图片素材来源于网络,侵权即删除


四、智元机器人启动赴港IPO:具身智能赛道进入资本化冲刺期


7月24日,具身智能独角兽智元创新(上海)科技股份有限公司确认已启动赴港上市流程。据《财经》报道,基石投资人给出的目标估值在400亿—500亿港元(约合人民币346亿—433亿元),智元方面曾希望将目标估值提升至约800亿港元,最快将于今年8月在港股上市。财务数据方面,智元成立于2023年2月,营收从首年30万元跃升至2025年的10.5亿元,每年实现约20倍增长;2026年一季度营收已超10亿元,全年预期约45亿元,2027年目标100亿元。据Omdia统计,智元2025年通用人形机器人出货量5168台,位居全球第一,占全球市场约39%份额;据灼识咨询数据,按2025年及2026年一季度收入计,智元是全球最大的通用AI机器人公司。巧合的是,竞争对手宇树科技7月1日刚获科创板注册生效,从受理到注册全程仅104天,创下科创板预先审阅机制最快纪录——两家头部企业分别押注港交所与科创板,形成“双雄竞速”格局。


图片素材来源于网络,侵权即删除


值得关注的原因:这是具身智能赛道资本化的标志性事件。智元成立仅三年营收突破10亿元、出货量全球第一,证明人形机器人已从“展台Demo”进入“规模化交付”阶段;而400亿—500亿港元的目标估值(对应32—41倍PS),则反映了资本市场对具身智能长期空间的押注。宇树科创板、智元港股的路径分化,也意味着行业竞争正从技术验证延伸到资本运作与产能扩张。对AI培训赛道而言,具身智能产业链的人才需求(机器人算法、数据采集、场景部署、运维)将随头部企业放量而显著扩大。


图片素材来源于网络,侵权即删除


五、自变量机器人亮相APEC:开源多项核心成果并发出行业倡议


据《南方日报》2026年7月27日报道,APEC数字和人工智能部长会议及数字周活动近日在四川成都举办。深圳自变量机器人科技公司作为唯一来自具身智能行业的中国企业代表,在APEC数智赋能高级别对话上发表演讲,其“机器人进家庭”项目被列入《亚太地区数智赋能案例集》。自变量创始人王潜代表行业发出三点倡议:开放民生场景、加强开源协作、共育产业人才。业务层面,自变量机器人已在头部物流企业分拣产线实现每小时1200件以上的稳定分拣效率,回流率低至3%以内,可7×24小时不间断作业;在家庭场景,与国内家政头部企业合作推出大规模机器人进家庭服务。开源层面,自变量近期发布端到端预训练模型WALL-OSS-0.5、全球首个具备“事件级预测能力”的世界模型WALL-WM、分布式训练优化器DMuon( reportedly 训练效率提升约30%)以及跨模态具身动作分词器X-Tokenizer。


值得关注的原因:这是中国具身智能企业在国际舞台发声并开源核心能力的标志性动作,显示行业正从闭门研发转向“场景验证+生态共建”。具体的商业数据(1200件/小时、3%回流率)为“机器人能否真正干活”提供了可量化参考,而开源模型与工具则降低了行业准入门槛,也可能加速人才竞争。对培训机构而言,具身智能开发者大会、产学研合作、开源模型应用等主题都将成为内容分发与课程设计的新锚点。


【总结】

7月27日的AI动态呈现出鲜明的“工程落地”气质。AI Coding方向,Claude Opus 5刷新编程基准、Claude Code系统提示词“瘦身”八成、Codex接入实时语音与Appshots,三件事共同指向一个趋势:模型能力在向上走,而人机协作的摩擦在向下走——未来开发者比拼的不再是“会不会写Prompt”,而是“能不能设计好Agent可用的接口、知识与多模态上下文”。具身智能方向,智元机器人启动赴港IPO(目标估值400亿—500亿港元)与自变量机器人APEC发声/开源,则从资本运作和产业生态两条线,把行业从实验室Demo推向规模化交付与全球竞争。


对AI培训赛道而言,这些变化意味着课程与内容需要同步升级:既要覆盖Opus 5/Codex等最新工具的能力边界与协作范式,也要关注具身智能在数据采集、真实场景部署、安全合规、开源生态等领域的人才缺口。