返回主页

每日未来情报

2026年8月5日 · 星期三

NVIDIA Alpamayo 2 Super 开放商用;商汤 SenseNova U1 开源统一推理与图像生成;蚂蚁百灵 Ling-3.0-flash 开源;工信部发布 L3/L4 自动驾驶强制性国标;Anthropic 与 Volta 签 100 亿美元算力协议;Google 发布 Gemini 3.6 Flash 等三款新模型;GPT-5.6 Luna 降价 80%;华为全场景九大新品齐发;越疆发布具身全栖人形机器人 DOBOT LUMO。

41
信号
5
分类
2
数据源
模型发布更新 6 产品发布更新 8 行业动态 7 技巧与观点 8

🤖 AI趋势

NVIDIA Alpamayo 2 Super 开放商用;商汤 SenseNova U1 开源;蚂蚁百灵 Ling-3.0-flash 开源;工信部 L3/L4 自动驾驶强制性国标发布;Anthropic 签 100 亿美元算力协议;Google 发布 Gemini 3.6 Flash;GPT-5.6 Luna 降价 80%

🚀模型发布/更新 (6条)
#01
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。
NVIDIA Blog(RSS) 阅读原文 →
#02
商汤 SenseNova U1 开源:统一推理与图像生成
商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。
X:商汤 SenseTime (@SenseTime_AI) 阅读原文 →
#03
OpenRouter 上线 FLUX 3 Video 统一多模态模型
@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。
X:OpenRouter (@OpenRouter) 阅读原文 →
#04
蚂蚁百灵发布Ling-3.0-flash开源权重
今天,我们发布了 Ling-3.0-flash 的开源权重。🎉 官方 BF16 和 FP8 量化版本现已可用,您可以根据自己的硬件、性能要求和部署需求选择最合适的版本。
X:蚂蚁百灵 (@AntLingAGI) 阅读原文 →
#05
腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别
腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。
公众号:腾讯混元 阅读原文 →
#06
FLUX 3 Video 发布:统一多模态视频生成模型
Black Forest Labs 发布 FLUX 3 Video,将图像、视频生成统一到同一多模态框架,支持文生视频与图生视频。
Black Forest Labs:Blog(网页) 阅读原文 →
🛠️产品发布/更新 (8条)
#07
Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版
Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#08
Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅
Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。
MarkTechPost(RSS) 阅读原文 →
#09
面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入
面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。
公众号:面壁智能(MiniCPM) 阅读原文 →
#10
Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型
Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#11
OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置
OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。
OpenRouter:Announcements(RSS) 阅读原文 →
#12
SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型
SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。
LMSYS:Blog(Chatbot Arena 团队) 阅读原文 →
#13
Replit 环境智能:免提示词自动生成设计
你无需提示词,也无需设计语言。 环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片都指向你的设计的一个不同方向。点击你喜欢的那张,即可看到它生成一个新的画面。 你再也不必纠结下一步该做什么。 立即在 http://replit.com/design 体验。
X:Replit (@Replit) 阅读原文 →
#14
Cloudflare 让智能体通过本地追踪调试 Workers
Cloudflare 即日起在 wrangler dev 和 vite dev 中自动为本地 Worker 调用捕获 OpenTelemetry 追踪,无需安装 SDK 或配置智能体。智能体可通过 Local Explorer API 查询追踪数据,定位失败操作、修复本地环境并验证结果。开发者也可在浏览器界面 Local Explorer 中可视化查看 spans、时序、错误及关联控制台日志。
Cloudflare Blog 阅读原文 →
📰行业动态 (7条)
#15
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。
X:Rohan Paul (@rohanpaul_ai) 阅读原文 →
#16
工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施
工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721—2024升级而来,为自动驾驶产品明确了统一的安全准入基线。
IT之家(RSS) 阅读原文 →
#17
GPT-5.6 Luna降价80%永久生效
有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。
X:Tibo (@thsottiaux) 阅读原文 →
#18
Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官
Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。
Anthropic:Newsroom(网页) 阅读原文 →
#19
OpenAI 说明第三方网络安全评估事件并公布新保障措施
OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升模型评估的安全性与可靠性,确保第三方测试在受控环境下进行。
OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 →
#20
AI 领袖提出 SAFE 指南,强化智能体网络安全透明度
Linux 基金会发布共享 AI 事件交换(SAFE)指南征求意见稿,旨在将智能体网络安全事件转化为全生态共享防护。
NVIDIA Blog(RSS) 阅读原文 →
#21
Google 发布 Gemini 3.6 Flash 等三款新模型及 Gemini Robotics ER 2
Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,面向生产级 AI 智能体,主打更高 token 效率、更低延迟和更可靠性能。
Google Blog:AI(RSS) 阅读原文 →
💡技巧与观点 (8条)
#22
在单颗 AMD MI300X 上运行 DeepSeek V4 Flash
一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#23
MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行
MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。
Simon Willison 博客 阅读原文 →
#24
用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线
本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。
MarkTechPost(RSS) 阅读原文 →
#25
Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零
Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。
Cloudflare Blog 阅读原文 →
#26
GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码
GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。
GitHub Blog 阅读原文 →
#27
如何用 LangSmith 评估语音智能体
LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段包括 LangSmith traces、代码评估器、LLM judges 和人工审查,帮助开发者系统化验证语音智能体的实际表现。
LangChain:Blog(RSS) 阅读原文 →
#28
从零开始,教你用Codex搓出属于你自己的第一个硬件
作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调“干中学”的AI开发方式。
公众号:数字生命卡兹克 阅读原文 →
#29
杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长
科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。
Tomer Tunguz 博客(VC 分析) 阅读原文 →
AI趋势数据来自 AI HOT · 共29条 · 北京时间8月5日

🥽 VR动态

Valve Steam Frame 被曝起步价超 1000 美元;V 社上线 Lepton 与 FEX 工具筑牢生态;日本 V-Nade! 装置可"摸"Vtuber 双向触觉反馈

头显定价 Valve 新 VR 头显 Steam Frame 被曝起步价超 1000 美元

Valve 爆料人 Tyler McVicker 在直播中透露,这款无线一体式 VR 头显起步价将超过 1000 美元,远超去年公布时"比上代 999 美元 Index 更低"的承诺。涨价主因是内存与固态硬盘零部件价格上涨。该头显搭载 4nm 骁龙 ARM64 芯片、16GB LPDDR5X 内存,原生运行 SteamOS,并配 6GHz 无线适配器串流整个 Steam 库。

📎 来源 · 8月5日
生态工具 V 社上线 Lepton 与 FEX 两款工具,Steam Frame 软件生态落地

Valve 在 Steam 上线 Lepton 与 FEX 两款工具:Lepton 兼容安卓 APK,FEX 实现 Arm 架构实时转换 x86 游戏,标志 V 社 Arm 游戏平台战略落地。同期《Escape Simulator 2》开放 VR 测试,7 月 Steam 硬件调查显示 Meta Quest 2 以 26.66% 份额重夺榜首,VR 头显用户占比 1.71%。

📎 来源 · 8月5日
触觉互动 日本 V-Nade! 装置可"摸"Vtuber,双向触觉反馈引爆虚拟互动

Ohtani Design Laboratory 宣布 "V-Nade!" 项目:用户无需外设,悬空做抚摸动作即可与视频通话中的 VTuber 互动,对方能实时看到抚摸位置与手法,用户同时收到实打实的触觉反馈。官方计划将其铺进粉丝见面会、主题咖啡厅、展览与主题公园,把虚拟互动经济的边界进一步拓宽。

📎 来源 · 8月5日

🎮 游戏设计

第六届中国游戏创新大赛成果交流会举行;游戏 AI 进入新共识时代(管线 AI 化+原生游戏);Netflix FIFA 世界杯游戏开发商裁员 85%

行业大赛 第六届中国游戏创新大赛成果交流会在静安举行

活动聚焦游戏产业技术革新、文化创新与全球化发展,集结海内外厂商、独立工作室与青年创作者。《明日方舟:终末地》《洛克王国:世界》《星布谷地》等七款作品主创拆解研发实战。音数协游戏工委主任张毅君提出三点方向:技术迭代不等于内容创新、坚守精品导向深挖中华优秀传统文化、坚持开放合作以游戏为跨文化交流载体。

📎 来源 · 8月5日
AI共识 管线 AI 化、原生游戏和长期主义:游戏 AI 进入新共识时代

游戏茶馆基于 ChinaJoy 观察指出,行业对 AI 的态度已从半年前的恐慌转向从容,饭局话题变成"哪家模型干活更实惠"。据《2026 中国游戏产业 AI 发展报告》,收入 TOP50 企业中 80% 已开展 AI 布局、近六成组建 AI 实验室。方向愈发清晰:管线 AI 化、AI 原生游戏、长期主义成为三大共识。

📎 来源 · 8月5日
裁员震荡 Netflix 旗下 FIFA 世界杯游戏开发商 Refactor Games 裁员 85%

据 VGC 报道,负责开发 Netflix 足球游戏《FIFA 世界杯:首发版》的 Refactor Games 被曝大规模裁员,创始人确认约 85% 员工离职,工作室或全员解散。该作 6 月 11 日上线后口碑惨淡,被质疑为赶世界杯揭幕战仓促完工,上线后投资方撤资导致团队解散。

📎 来源 · 8月5日

🔬 新科技

MIT 新制造工艺将分子无损嵌入电子器件;端侧 AI 元年手机汽车抢智能体入口;中国大模型八周五连发硅谷换底座

前沿制造 MIT 新制造工艺将分子无损嵌入电子器件

美国麻省理工学院开发出一种可扩展制造技术,将厚度不足一纳米的分子层无损嵌入芯片电子器件,制造出上千个器件,平均良率达 96%,并经受数万次电循环无退化。该技术采用解耦两步法,先预制器件骨架再引入分子并机械重塑,拓展了标准半导体工艺整合分子的能力,相关论文发表于《自然·纳米技术》。

📎 来源 · 8月5日
端侧AI 大模型迈入物理世界!端侧 AI 元年,手机汽车抢智能体入口

《科创板日报》报道,特斯拉中国部分新车机上线豆包大模型语音助手,千问进入深度测试;谷歌将 Gemini 智能体置于操作系统顶层,英伟达推出端侧处理器,荣耀 Robot Phone 发布在即。IDC 预测 2026 年中国 AI 手机出货 1.47 亿台同比增 31.6%,端侧 AI 市场规模破 8000 亿元,行业从 AI for device 转向 AI for user。

📎 来源 · 8月5日
国产模型 中国大模型八周五连发,硅谷企业悄悄换底座

21 世纪经济报道统计,截至 8 月 5 日短短 8 周内,阿里 Qwen3.8-Max、Kimi K3、DeepSeek-V4-Flash、智谱 GLM-5.2、字节 Seedance 2.5 五款重磅模型接连亮相,引发硅谷企业出于成本考量将业务流量切到中国大模型。斯坦福报告指出中美顶尖模型性能差距大幅收窄,中国开放权重模型全球接受度持续走高。

📎 来源 · 8月5日

📦 新产品

华为全场景九大新品齐发;华为折叠电脑 MateBook Fold 24999 元起;越疆发布具身全栖人形机器人 DOBOT LUMO

华为发布会 华为全场景新品发布会开幕:至少九大新品齐发

8 月 5 日下午华为"尊界时代旗舰 MPV 及全场景新品发布会"开幕,覆盖汽车、电脑、平板、手机、手表、智慧屏等多领域。汽车端尊界 V800/V680 上市、享界 G9 开启预订;PC 端首款折叠屏电脑 MateBook Fold 非凡大师亮相、MateBook Pro S 仅 798 克;nova 16 SE 内置 8500mAh 电池,MatePad Pro 2026 重 439 克并首发北斗短报文卫星通信。

📎 来源 · 8月5日
折叠电脑 华为发布全新折叠电脑 MateBook Fold 非凡大师,24999 元起

新一代 HUAWEI MateBook Fold 非凡大师售价 24999-29999 元(较上代上涨),8 月 14 日开售。展开为 18 英寸双层 OLED 柔性屏,折叠后 13 英寸、重约 1.16kg,首次原生支持手写笔,屏幕抗冲击提升 90%。AI 方面小艺任务登场,可自主拆解执行复杂任务,带来 Agent 时代的 PC 新体验。

📎 来源 · 8月5日
陪伴机器人 越疆发布全球首款具身全栖人形机器人 DOBOT LUMO

越疆科技 8 月 5 日发布 DOBOT LUMO,依托全栈自研空弈具身大模型,实现多模态情绪感知、三维空间理解与主动行动、自主学习三大突破。其"具身全栖"涵盖空间、角色、能力、周期四维,可在家庭、校园、商超无缝切换身份。该机器人近 1.3 米、步态拟人,标志中国千亿级智能陪伴市场迎来代际升级。

📎 来源 · 8月5日

📝 龙大仙注记

今日观察

8月5日 AI 行业呈现"开源模型密集上新 + 端侧落地加速 + 监管框架成形"三重主线。模型层面,NVIDIA Alpamayo 2 Super、商汤 SenseNova U1、蚂蚁百灵 Ling-3.0-flash、腾讯混元 Hy ASR 3.0、FLUX 3 Video 接连开源/发布,开源阵营在自动驾驶、多模态、语音识别等垂直赛道全面铺开,且多家选择开放权重路线。产品层面,Swiftlet 让 80B Qwen 跑在 Mac、Soup 让 8B 模型微调落在 4GB 显存笔记本,端侧推理门槛被持续压低——AI 从云端走向个人设备已成不可逆趋势。行业层面,工信部发布首部 L3/L4 自动驾驶强制性国标(2027 年 7 月实施),中国自动驾驶从推荐性标准迈入强制监管;Anthropic 与成立仅数月的云初创 Volta 签下 100 亿美元算力协议,算力军备仍在加码;Google 发布 Gemini 3.6 Flash 等三款模型及 Gemini Robotics ER 2,多模态与机器人并重;GPT-5.6 Luna 降价 80% 永久生效,价格战延续。非 AI 领域,华为全场景发布会九大新品齐发(折叠电脑、nova 16 SE、MatePad Pro 等),越疆发布全球首款具身全栖人形机器人 DOBOT LUMO,端侧智能体从手机汽车进一步延伸到家庭陪伴机器人。整体来看,今天是"模型开源化、部署端侧化、监管强制化"三者同步推进的一天,AI 基础设施与应用生态的边界正在快速外扩。

AI HOT 整合说明

本次 AI 趋势部分数据源来自 AI HOT(aihot.virxact.com),按模型发布/更新(6)、产品发布/更新(8)、行业动态(7)、技巧与观点(8)四个版块分组(今日无论文研究版块),全局连续编号。VR动态、游戏设计、新科技、新产品四个分类仍按原有规则获取。本次共收录 AI HOT 29条信号,产品发布/更新与技巧与观点各 8 条最为密集。其他分类中:VR动态3条、游戏设计3条、新科技3条、新产品3条。