返回主页

每日未来情报

2026年7月25日 · 星期六

Anthropic 发布 Claude Opus 5,半价追平 Fable 5;蚂蚁百灵发布 Ling-3.0-flash 原生混合推理模型;Black Forest Labs 发布 FLUX 3 多模态模型支持 20 秒视频与原生音频;英伟达/微软/Meta 联合警告开放权重模型过度监管;Kimi K3 登顶代码榜但网络安全测试大幅落后;国内实现全球首次千人跨地域同步脑电采集。

29
信号
5
分类
2
数据源
模型发布更新 5 产品发布更新 4 行业动态 3 论文研究 2 技巧与观点 4

🤖 AI趋势

Anthropic发布Claude Opus 5半价追平Fable 5;蚂蚁百灵Ling-3.0-flash原生混合推理模型;FLUX 3支持20秒视频与原生音频;英伟达/微软/Meta联合警告开放权重模型过度监管

🚀模型发布/更新 (5条)
#01
Anthropic 发布 Claude Opus 5
Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。
Anthropic:Newsroom(网页) 阅读原文 →
#02
蚂蚁百灵发布Ling-3.0-flash原生混合推理模型
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰Ring-2.6-1T。模型采用原生混合线性注意力架构与1/64稀疏MoE,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上。
公众号:蚂蚁百灵(Ling) 阅读原文 →
#03
FLUX 3 x mimic:新一代视频动作模型
Black Forest Labs 发布多模态基础模型 FLUX 3,联合训练图像、视频和音频,其中视频预测占训练算力的 95% 以上。该模型与机器人公司 mimic 合作推出 FLUX-mimic,已在奥迪生产线上测试部署。加入动作预测后,视频生成质量最初下降最多 10%,但经 3500 步训练后恢复原有水平。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#04
Midjourney V8.2 发布:专注美学提升与个性化理解
Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。
Midjourney:Updates(RSS) 阅读原文 →
#05
Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频
Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联合学习图像、视频和音频。该模型基于 Self-Flow 学习框架扩展,可在单次生成中输出最长 20 秒视频并附带原生音频,支持文生视频、图生视频、多镜头串联等任务。
IT之家(RSS) 阅读原文 →
🛠️产品发布/更新 (4条)
#06
Runway Agent 推出自然语言工作流功能
在 Runway Agent 中引入工作流。现在你可以通过自然语言构建、运行或编辑基于节点的工作流。工作流可大规模解锁高质量输出。 立即尝试,点击下方链接调用 / Workflow 技能。
X:Runway (@runwayml) 阅读原文 →
#07
百度搭子更新:电脑手机接力、桌面端内嵌浏览器上线,复杂任务可跨端连续执行
百度搭子在近期AI Day上推出多项升级,支持电脑与手机双端互联,同步任务上下文与执行进度,用户可跨设备接力完成复杂工作。桌面端内嵌浏览器正式上线,能自动打开多个网页执行调研、下载等操作,手机端支持云端远程操控。智能路由自动匹配任务模式,平均任务耗时降低20%,Token利用率提升25%;简单任务完成度达100%,复杂任务高交付率94%,积分消耗最高降低75%。
公众号:百度智能云(文心) 阅读原文 →
#08
OpenRouter 推出 Classifiers 测试版:自动标记 AI 请求的用途与成本归属
OpenRouter 上线 Classifiers 测试版,允许用户通过自定义分类法(最多 8 个维度)自动标记每次 AI 请求的任务类型、部门归属、合规类别等信息。分类异步运行,不增加推理延迟;支持采样率控制成本,推荐使用 Gemini 3.5 Flash Lite 作为分类模型。标记结果写入日志,并可在 Activity Explorer 中按维度聚合分析模型使用分布与成本流向。
OpenRouter:Announcements(RSS) 阅读原文 →
#09
Claude Code v2.1.219 发布:新增 Claude Opus 5,支持 1M 上下文与嵌套子智能体
Claude Code v2.1.219 新增 Claude Opus 5 作为默认 Opus 模型,支持 1M 上下文窗口,快速模式定价为 $10/$50 每百万 token。
Claude Code:GitHub Releases(RSS) 阅读原文 →
📰行业动态 (3条)
#10
英伟达、微软和Meta联合警告:应避免对开放权重模型过度监管
英伟达、微软和Meta联合签署公开信,警告对开放权重AI模型的过度监管将削弱美国在AI领域的竞争力。信中指出,开放权重模型能促进创新、降低准入门槛,并支持学术研究。OpenAI和Anthropic未签署该信函。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#11
微软阐述开源模型助力美国竞争力路径
开放权重模型对健康的 AI 生态系统至关重要。我们与行业同仁一道,正在规划一条路径,让开放权重模型在保护国家安全的同时,增强美国竞争力并扩大经济机会。
X:Satya Nadella (@satyanadella) 阅读原文 →
#12
Kimi K3 在网络安全漏洞利用测试中大幅落后美国前沿模型,知识蒸馏或为原因
英国AI安全研究所与美国AI标准与创新中心联合评估显示,月之暗面的Kimi K3在ExploitBench基准上得分32.2%,远低于美国领先模型的76.2%,但优于智谱GLM-5.2的24.4%。
The Decoder:AI News(RSS) 阅读原文 →
📑论文研究 (2条)
#13
Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力
Anthropic 与 Andon Labs 合作推出 Drone-Bench,用于测试 AI 模型自主操控四旋翼无人机在室内环境中定位并追踪指定人员的能力。该基准将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现实现快速评估。实验表明,该任务链的难度足以区分不同智能水平的模型,并揭示 AI 在物理世界操控能力上的进步轨迹。
Anthropic:Research(发表成果 · 网页) 阅读原文 →
#14
Apple 提出 LEAD 方法,破解长程推理中的“不可恢复瓶颈”
Apple 研究发现,大语言模型在长程执行中即使有高层策略也不稳定,极端分解会导致“不可恢复瓶颈”——少数“困难”步骤上的持续错误变得不可逆转。为此提出 Lookahead-Enhanced Atomic Decomposition(LEAD),通过引入短程未来验证与聚合来打破这一瓶颈。该方法在受控算法谜题上验证了有效性。
Apple Machine Learning Research(RSS) 阅读原文 →
💡技巧与观点 (4条)
#15
Claude-thermos:保持 Claude 会话缓存热度,避免重新编码费用
Claude-thermos 通过本地反向代理监控 Claude Code 会话,在主智能体因等待子智能体而空闲超过 5 分钟时,自动发送预热请求刷新提示缓存。实测约 185 次本地会话中,缓存过期导致的重新编码占账单约 22%。工具以 uvx 运行,支持自定义空闲阈值和预热间隔。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#16
Claude 5 代模型上下文工程新规则:Claude Code 系统提示词精简超 80%
Anthropic 为 Claude Opus 5 和 Claude Fable 5 等新一代模型删除了 Claude Code 超过 80% 的系统提示词,且编码评测无显著损失。
Claude:Blog(网页) 阅读原文 →
#17
Claude Design 产品设计师 Nate Parrott 分享如何用其探索视觉创意
Anthropic 产品设计师 Nate Parrott 分享了他在 Claude Design(beta 版)中利用 HTML 交互能力进行产品原型、幻灯片、动画等视觉创意探索与迭代的方法。他将 Anthropic 品牌规范提炼为提示词,使输出自动符合品牌指南。Claude Design 不包含图像模型,不适合 Logo 设计,但可与 Claude Code 协同工作,将早期创意与生产开发衔接。
Claude:Blog(网页) 阅读原文 →
#18
Claude 模型家族详解:如何为工作负载选择最佳模型
Anthropic 发布 Claude 模型选择指南,将模型分为 Mythos/Fable(最强能力,用于前沿编码与智能体任务)、Opus(推理密集型企业任务)、Sonnet(日常通用任务)和 Haiku(最低成本与最快速度)四个类别。
Claude:Blog(网页) 阅读原文 →
AI趋势数据来自 AI HOT · 共18条 · 北京时间7月25日

🥽 VR动态

多伦多大学:VR改变人体空间感知;SimX发布无代码VR医疗模拟编辑器;前Meta高管融资2100万打造AI传感器

研究 多伦多大学:VR或改变人体空间感知,摘下头显后影响仍会持续

多伦多大学运动机能与体育教育学院发布研究,发现用户在VR中会倾向于认为自己的身体比现实世界更大,且这种空间感知偏差在摘下头显后短时间内仍会持续存在。实验中受试者在VR中普遍认为自己需要更宽的通行空间才能安全通过障碍物,返回现实世界后这种认知偏差依然存在。

📎 来源 · 7月25日
医疗 SimX发布Scenario Editor,可无代码定制VR医疗模拟场景

虚拟现实医疗培训企业SimX推出Scenario Editor新工具,允许模拟教学导师通过网页浏览器直接修改VR训练场景中的各类元素,无需编写代码。用户可修改患者对话、上传电子病历截图、更换虚拟药柜药物列表,并调整学习目标和考核指标。新增对话可借助AI自动生成语音。

📎 来源 · 7月25日
传感器 前Meta AR/VR高管融资2100万美元打造AI导向型传感器Elio

前Meta AR/VR高管创立的Elio宣布完成2100万美元融资,研发允许AI实时决定捕获内容的动态光学传感器。技术将计算嵌入光学元件内部,由微镜构成的动态光学层在光线抵达传感器前直接处理,使单个模块可持续获得新能力,应用于任何需要传感的场景。

📎 来源 · 7月25日

🎮 游戏设计

AI+游戏热度达新高峰ChinaJoy主题"与AI同游";魔兽联动龙与地下城时隔20年重启桌游RPG

AI游戏 AI+游戏热度达新高峰:ChinaJoy主题"与AI同游",字节发布AI修仙游戏

2026年ChinaJoy将展会主题确定为"与AI同游",增设Next Play创新游戏体验场。字节跳动旗下朝夕光年发布AI修仙游戏《不问凡尘》,场景建模、人物形象、战斗动画、剧情素材等大量内容依托AI生成,NPC由AI驱动。Steam新品节上近20%作品标注"AI生成内容"标签,独立开发者靠AI补齐资源短板。

📎 来源 · 7月25日
联动 魔兽联动龙与地下城疑似泄露,时隔20年艾泽拉斯桌游RPG将重启

知名虚拟桌游平台Roll20短暂上线文章,指向《魔兽世界》与《龙与地下城》联动产品。这不是游戏内活动,而是一套以艾泽拉斯为主题的D&D桌面角色扮演设定产品,将提供预购。更完整消息预计将在7月30日Gen Con桌游展会期间正式公布。

📎 来源 · 7月25日

🔬 新科技

智元机器人启动赴港上市流程;国内实现全球首次千人跨地域同步脑电采集;宇树王兴兴登《时代》封面

机器人 智元机器人已启动赴港上市流程,2025年出货量全球第一

通用AI机器人公司智元创新宣布已启动赴港上市流程。成立仅三年,智元创新已完成从技术研發、产品量产到真实场景部署的快速跨越。据Omdia统计,2025年智元创新通用人形机器人出货量超5100台,位居全球第一,占据全球人形机器人市场约39%份额。

📎 来源 · 7月25日
脑机接口 国内实现全球首次千人跨地域同步脑电采集,脑机接口技术取得里程碑突破

国内顶尖科研团队完成全球首个上千人跨区域同步脑电信号规模化采集,攻克异地时钟同步、便携设备降噪两大核心技术难题,搭建起海量人脑神经数据集,可支撑通用神经大模型训练。该技术后续可落地脑卒中康复、精神疾病诊疗、人机意念交互、车载情绪监测等场景。

📎 来源 · 7月25日
机器人 宇树科技CEO王兴兴登上《时代》杂志封面,GD01载人机甲亮相

宇树科技CEO王兴兴与近2.7米高的GD01载人机甲共同登上《时代》杂志封面,标志着机器人时代来临。GD01是全球首款量产载人机甲,可双足或四足行走。王兴兴认为,未来10年每个家庭都可能拥有小型机器人处理家务或高危工作。

📎 来源 · 7月25日

📦 新产品

OpenHands发布桌面Beta及跨会话持久记忆;腾讯云CodeBuddy NPC推动AI编程交付时代;AMD联合Cerebras挑战英伟达

AI编程 OpenHands发布桌面Beta及Canvas 1.6.1更新,推出跨会话持久记忆

OpenHands本周发布Agent Canvas 1.6.1与SDK 1.37.1更新,同时推出Apple Silicon macOS和Windows的桌面Beta安装器。SDK 1.37增加可选的跨会话持久记忆功能,通过MEMORY.md保存上下文。Canvas支持将最近的提交历史和文件diff放入上下文实现逐提交审查,可直接带着已挂载的插件启动新对话。

📎 来源 · 7月25日
AI编程 腾讯云发布CodeBuddy NPC,推动AI编程迈向"交付时代"

腾讯云正式发布面向研发流程的云端智能体CodeBuddy NPC(Cloud Agent),让AI直接融入企业现有研发流程。开发者只需下达目标,NPC即可自主获取上下文、闭环完成任务并交付可验收成果,成为研发流程里的"AI原住民"。

📎 来源 · 7月25日
芯片 AMD联合Cerebras推出超低时延AI推理硬件方案,挑战英伟达

AMD与晶圆级AI芯片厂商Cerebras达成深度合作,推出面向超高并发场景的联合推理系统:由AMD Helios机架平台负责大吞吐量上下文处理,Cerebras晶圆级引擎承担Token解码。整套方案每瓦算力产出提升5倍,推理延迟降低70%,将于2026年下半年量产交付,直接对标英伟达NVL72 AI超集群。

📎 来源 · 7月25日

📝 龙大仙注记

今日观察

7月25日AI行业呈现"模型密集发布+开源监管博弈+产品工程化落地"三重主线。模型层面,Anthropic发布Claude Opus 5以半价追平Fable 5,在Frontier-Bench等编程评测中登顶;蚂蚁百灵Ling-3.0-flash用124B总参数/5.1B激活参数实现对标上一代旗舰的性能;Black Forest Labs FLUX 3支持单次生成20秒视频与原生音频,多模态能力再进一步;Midjourney V8.2专注美学提升。产品层面,Runway Agent推出自然语言工作流、百度搭子实现电脑手机跨端接力、OpenRouter上线Classifiers自动标记AI请求用途、Claude Code支持1M上下文——AI产品正从单一功能向工作流整合和工程化部署演进。行业层面,英伟达/微软/Meta联合警告开放权重模型过度监管将削弱美国竞争力,而Kimi K3在网络安全测试中大幅落后美国前沿模型,引发对知识蒸馏安全性的讨论。整体来看,今天是AI模型能力平价化(Opus 5定价仅为Fable 5一半)与 geopolitical 博弈同步加剧的一天,技术民主化与安全可控性的矛盾愈发尖锐。

AI HOT 整合说明

本次AI趋势部分数据源来自 AI HOT(aihot.virxact.com),按模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点五个版块分组,全局连续编号。VR动态、游戏设计、新科技、新产品四个分类仍按原有规则获取和生成。本次共收录 AI HOT 18条信号,模型发布/更新5条最为密集。其他分类中:VR动态3条(研究、医疗、传感器)、游戏设计2条(AI游戏、联动)、新科技3条(机器人×2、脑机接口)、新产品3条(AI编程×2、芯片)。