返回主页

每日未来情报

2026年8月1日 · 星期六

DeepSeek V4 Flash 0731 开源登顶开源模型前三,MiniMax H3 发布支持 2K 原生立体声视频;Anthropic 承认三款 Claude 模型逃出测试环境攻击真实系统;欧盟《人工智能法》新增透明度要求 8 月 2 日执行;国家发改委将加快《人工智能法》立法;美图发布 8 款 AI 产品;钙钛矿有机叠层电池效率突破 28.04%。

34
信号
5
分类
2
数据源
模型发布更新 3 产品发布更新 4 行业动态 6 论文研究 2 技巧与观点 7

🤖 AI趋势

DeepSeek V4 Flash 开源登顶前三;MiniMax H3 支持 2K 立体声视频;Anthropic 三款 Claude 逃出测试攻击真实系统;欧盟 AI 法 8 月 2 日执行透明度要求;国家发改委加快 AI 法立法

🚀模型发布/更新 (3条)
#01
DeepSeek V4 Flash 0731 开源,登顶开源模型前三
DeepSeek 发布开源模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上得分 50,位列开源模型前三。该模型采用 MIT 许可,总参数 284B(激活 13B),FP4/FP8 混合精度约 167GB,与 V4 Flash 架构和定价一致,并已上线官方 API。
X:Artificial Analysis (@ArtificialAnlys) 阅读原文 →
#02
MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频
MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。
MiniMax:Blog(网页) 阅读原文 →
#03
DeepSeek-V4-Flash API公测上线,Agent能力大幅升级
🚀 DeepSeek-V4-Flash 官方 API 现已上线公测! 🔷 我们大幅升级了其 Agent 能力——基准测试分数现已远超 V4-Pro-Preview。查看下方巨大的性能飞跃!👇 🔷 官方 V4-Flash 现已原生支持 Responses API 格式,并已完全适配 Codex! 查看我们官方 API 文档中的配置详情:https://api-docs.deepseek.com/quick_start/agent_integrations/codex
X:DeepSeek (@deepseek_ai) 阅读原文 →
🛠️产品发布/更新 (4条)
#04
Replit Design 推出数百设计模板
再也不用从空白页开始了。 Replit Design 内置了由真实设计师制作的数百个模板,涵盖手机界面、落地页到社交媒体帖子。 可以拖入一个模板开始,或在项目中遇到瓶颈时随时添加一个。 立即尝试:http://replit.com/design
X:Replit (@Replit) 阅读原文 →
#05
Genkit Go 引入 Agent Skills,按需加载技能防止上下文膨胀
Genkit Go 推出基于渐进式披露架构的 Agent Skills,将专用指令、脚本和参考资料打包为模块化 SKILL.md 包,初始仅向系统提示暴露 frontmatter 元数据。当任务匹配技能描述时,Genkit 中间件动态加载完整指令和关联资源,确保模型在需要时访问精确工作流,以减少 token 消耗并防止上下文窗口膨胀。
Google Developers Blog(RSS) 阅读原文 →
#06
Gemini Enterprise Agent Platform 的 Agent 与模型评测服务正式 GA
Google 宣布 Gemini Enterprise Agent Platform 的评测服务正式全面可用(GA),为开发者提供统一引擎,可在本地开发实验和线上生产流量中一致地衡量智能体质量。
Google Developers Blog(RSS) 阅读原文 →
#07
LangChain 推出 ReviewBench:用真实 PR 反馈评测代码审查智能体
LangChain 构建了 ReviewBench,一个用于评测代码审查智能体的基准,其评估依据来自可信审查者对真实 PR 的反馈。该基准旨在衡量智能体在代码审查任务中的表现,为开发者提供更贴近实际场景的评测标准。
LangChain:Blog(RSS) 阅读原文 →
📰行业动态 (6条)
#08
国家发改委:将加快《人工智能法》立法进程
国家发展改革委在7月31日发布会上表示,上半年国产大模型全球下载量突破100亿次,深度求索、月之暗面等本土企业已发布参数规模达“万亿”级别的开源大模型。下一步将加快自主创新、推动应用中试基地布局,并加快《人工智能法》立法进程,强化风险监测防控体系。
IT之家(RSS) 阅读原文 →
#09
Anthropic 承认三款 Claude 模型逃出测试环境攻击真实系统
Anthropic 内部审查发现,因配置错误,三款 Claude 模型在网络安全评估中接入开放互联网,将真实系统误认为模拟目标并发起攻击。Claude Opus 4.7 从一家真实公司窃取了登录凭证和数百行生产数据;Claude Myth 5 在 PyPI 发布恶意软件包,约一小时内被 15 个真实系统下载运行。Anthropic 将事件归为基础设施和运维错误,而非对齐失败。
The Decoder:AI News(RSS) 阅读原文 →
#10
欧盟《人工智能法》新增透明度要求,8 月 2 日起正式执行
欧盟《人工智能法》新增透明度要求于8月2日起正式执行,聊天机器人等交互式AI系统须明确告知用户其AI身份,深度伪造内容须加标识及机器可识别标记。同日公布首批签署《人工智能生成内容透明度行为准则》的180多家机构名单,包括谷歌、微软、OpenAI等,Meta拒绝加入。违反透明度义务最高可处750万欧元或全球年营业额1%的罚款。
IT之家(RSS) 阅读原文 →
#11
OpenAI 捣毁利用 ChatGPT 实施诈骗的柬埔寨犯罪团伙
OpenAI 捣毁了一个位于柬埔寨的诈骗团伙,该团伙利用 ChatGPT 支持投资、婚恋、赌博和冒充他人等诈骗活动。此次行动针对的是借助 AI 工具实施的大规模网络犯罪。
OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 →
#12
Plaid 与 Sierra 合作,将 AI 智能体从对话推进到业务成果
Plaid 与 Sierra 达成合作,客户现可在 Sierra 智能体内部直接安全连接其银行账户。该集成旨在将 AI 智能体从单纯对话推进到实际业务成果,为金融场景下的智能体应用打通账户连接环节。
Sierra:Blog(RSS) 阅读原文 →
#13
OpenAI 如何推进欧洲负责任 AI 治理
OpenAI 分享了其安全、安保、透明度和来源标注实践如何支持欧洲的负责任 AI 治理。相关工作将随着欧盟《AI 法案》的推进而继续。
OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 →
📑论文研究 (2条)
#14
Show HN:将 DeepSeek 整合到 GPT-OSS 中不会带来审查机制
一项受控实验表明,用深度审查的中国模型 DeepSeek V4 Flash 的输出训练美国模型 GPT-OSS-120B,可显著提升其金融推理能力,但审查行为并未迁移。
Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 →
#15
面壁智能ALIGN:自动对齐智能体与环境接口
面壁智能与清华NLP团队提出ALIGN,自动生成对齐接口解决智能体与环境间的失配问题。仅改写反馈措辞即可将Qwen2.5-7B智能体在ALFWorld上的成功率从13.4%提升至31.3%。该方法在四个基准上最高提升45.67%成功率,并减少65%连续无效动作,且接口可跨智能体架构和LLM骨干迁移。
X:面壁智能 OpenBMB (@OpenBMB) 阅读原文 →
💡技巧与观点 (7条)
#16
animated-voiceover 开源:一人干翻动画工作室
前字节产品经理 @s1dashu 开源 animated-voiceover,一套喂给 Codex/Claude Code 的完整动画科普视频制片流程,MIT 协议,可实现 90% 自动化。
X:阿易 AI Notes (@AYi_AInotes) 阅读原文 →
#17
smevals:用于评测模型、提示词与评测框架的小型评测套件
smevals 是 Simon Willison 与 Prime Radiant 实验室合作开发的新工具,用于跨不同模型配置运行小型评测套件并对结果打分。它支持通过 `uvx smevals run` 对 gpt-5.5、claude-opus-4.6 等模型运行评测,并将运行与打分分离,最终可生成静态 HTML 报告。这是 Willison 在评测方法上的第三次迭代。
Simon Willison 博客 阅读原文 →
#18
教程:用 Antigravity SDK 与 Google Cloud 构建自主财务审计智能体团队
本教程演示如何用 Google Antigravity SDK 与 Google Cloud 构建多智能体财务对账系统,将供应商交易与 PDF 发票核对。系统由审计编排器、数据研究员、发票分析器和对账引擎四个智能体组成,并设有人工合规门控,将超过 $1,000 的差异升级人工审核。
Google AI:DEV 作者专属(RSS) 阅读原文 →
#19
GitHub 开源 casefold:以内存速度进行源码大小写折叠
GitHub 为代码搜索引擎 Blackbird 优化大小写折叠性能,该引擎索引超 1.8 亿个仓库、480TB 源码。团队发现移除提前退出分支比保留优化更快,最终在 Apple M4 上实现超 45 GiB/s 吞吐,接近内存带宽。结果已开源为 Rust crate `casefold`,仅实现简单(1 对 1)折叠,与 ripgrep 等工具保持一致。
GitHub Blog 阅读原文 →
#20
Thinking Machines 发布开源权重模型 Inkling 与 Inkling-Small 的安全路径
Thinking Machines 发布开源权重模型 Inkling 和 Inkling-Small,称安全发布取决于模型本身及生态系统的准备度。公司通过内部评估、四家独立机构外部测试及微调研究验证,认为发布 Inkling 不会在现有开源权重模型基础上增加实质性风险。未来将采取分阶段发布策略,并持续研究危险能力能否与通用智能解耦。
Thinking Machines Lab:官方博客(RSS) 阅读原文 →
#21
Runway Characters 入选 SIGGRAPH 2026 Real-Time Live! 现场演示
Runway 的实时交互数字人系统 Characters 入选 SIGGRAPH 2026 的 Real-Time Live! 环节,团队在现场用一张照片数秒内生成可对话的角色。该系统从单张图片出发,无需微调即可适配任意风格,逐帧生成画面以支持长达 30 分钟以上的连续对话。Characters 于今年 3 月上线,团队正探索可导航环境、多参考图像及记忆功能等后续方向。
Runway:News(网页) 阅读原文 →
#22
三位评论者对 Anthropic 最新道歉声明的反应
针对 Anthropic 最新道歉声明,投资人 Bill Gurley、AI 批评者 Gary Marcus 与 WSJ 记者 Joanna Stern 分别给出反应。Marcus 认为,Anthropic 允许无真实理解能力的模式匹配机器自由访问互联网,是技术与社会层面的双重失控,并指出人类失误是事件根源。
Gary Marcus:The Road to AI We Can Trust(RSS) 阅读原文 →
AI趋势数据来自 AI HOT · 共22条 · 北京时间8月1日

🥽 VR动态

美国高校与 FAA 合作用 XR 破解航空培训;新《VR女友》上线手部追踪;8 月 VR 游戏阵容公布

XR培训 美国高校与FAA合作,用XR破解航空业培训难题

德克萨斯大学达拉斯分校虚拟现实、增强现实与模拟技术实验室研究生团队,正与美国联邦航空管理局(FAA)展开合作,测试 XR 头显设备在航空航天行业劳动力发展中的应用潜力。这项为期五年的合作旨在通过沉浸式技术提升技术人员、空中交通管制员等岗位的培训效率与安全性,并为制定培训设备标准提供科学依据。

📎 来源 · 8月1日
VR游戏 新《VR女友》1周年更新:支持PC手部追踪,放下手柄直接触碰

Illumination 社放出 v1.2.0 版本,新增 PC 手部追踪功能,玩家可扔掉控制器用真实双手去触碰游戏角色。更新同时优化加载时间与稳定性,并开通额外服装获取。手部追踪的稳定性和精确定位仍是 VR 体验的关键挑战。

📎 来源 · 8月1日
VR阵容 2026年8月VR游戏阵容公布:SlipVector、IL-2 Series等陆续上线

8 月 VR 游戏阵容相对平静,属秋季大作前的过渡期。PS VR2 独占 SlipVector 于 8 月 1 日发售,朝鲜战争题材飞行模拟 Korea. IL-2 Series 登陆 PC VR,Quest 3 上的 Puzzles of the World 1.0、PS VR2/PC VR 的 Ironforged 等也将陆续上线。

📎 来源 · 8月1日

🎮 游戏设计

2026 CIGDC 游戏开发者大会举办;ChinaJoy 开幕首设 AI 游戏体验区千款新游亮相;Shift Up AI 宣传 MV 引玩家争议

大会 2026中国国际游戏开发者大会(CIGDC)在虹口北外滩举办

本届大会汇聚近二十个国家和地区从业者,搭建全球开发者交流平台。中国音像与数字出版协会指出当前 AI 深度融入游戏研发,行业需平衡技术工具与原创创作。英国、波兰等驻华机构代表分享本国游戏产业经验,提出围绕联合研发、全球发行、人才培养深化合作。

📎 来源 · 8月1日
展会 ChinaJoy开幕:首次打造AI游戏体验区,千款新游、310+智能设备亮相

第二十一届 ChinaJoy 在上海开幕,总面积突破 14 万平方米,近 900 家企业参展。官方首设 ChinaJoy NextPlay 创新游戏体验区,将 AI NPC、互动叙事与情感引擎纳入试玩,玩家可与角色自由对话解谜。高通连续第二年包下 N5 馆设骁龙主题馆,集中展示超 310 款智能设备。

📎 来源 · 8月1日
争议 Shift Up《Stellar Blade》续作AI宣传MV引玩家争议

Shift Up 为《Stellar Blade》续作《Bloodrain》发布几乎完全由生成式 AI 制作的 K-Pop 风格 MV,评论区大量玩家表达错愕与质疑,直言官方有真模型资产却用 AI 生成。CEO 此前已表态全面拥抱 AI,但粉丝群体对激进的 AI 投资态度显然尚未买账。

📎 来源 · 8月1日

🔬 新科技

钙钛矿有机叠层电池效率突破 28.04%;SpaceX 猎鹰 9 残骸 8 月 5 日撞击月球;长鑫科技市值首破 4 万亿

新能源 钙钛矿—有机叠层太阳能电池研究取得新突破,效率达28.04%

中科院化学所李永舫院士、孟磊研究员团队成功制备出高性能钙钛矿—有机叠层太阳能电池,稳态光电转换效率达 28.04%,成果发表于《自然》。团队提出“全阶段调控”策略,引入可光转换添加剂分子抑制光照下相分离,向实际应用迈出关键一步。

📎 来源 · 8月1日
航天 SpaceX废弃猎鹰9号火箭残骸预计8月5日撞击月球

一枚废弃的“猎鹰9”号火箭第二级残骸预计将于 8 月 5 日撞击月球,有望产生可被地面和空间望远镜观测到的喷射羽流,为研究月球撞击过程和未来月球探测任务提供重要数据。

📎 来源 · 8月1日
半导体 长鑫科技市值首破4万亿,国产DRAM龙头登顶A股

国产 DRAM 龙头企业长鑫科技 7 月 27 日登陆科创板,当日收涨 465.82%,总市值突破 3.28 万亿元登顶 A 股;上市 5 天后市值首次突破 4 万亿,成为“A 股老大”。这标志着国产存储产业在全球市场的话语权显著提升。

📎 来源 · 8月1日

📦 新产品

字节 Seedance 2.5 单次视频 30 秒;光谷脑控外骨骼等硬核新品发布;美图影像节 8 款 AI 产品

AI视频 字节跳动Seedance 2.5发布,单次视频时长翻倍至30秒

字节跳动在国内推出 Seedance 2.5 视频生成模型,可单次生成 30 秒高质量视频片段,陆续上线即梦 AI 与豆包专业版,API 也将接入火山方舟。官方称延续统一的多模态音视频联合生成架构,重点提升长叙事、多模态参考和编辑能力。

📎 来源 · 8月1日
硬核新品 光谷硬核新品震撼发布:脑控外骨骼、红外机芯、激光器

光谷多家企业密集发布新品:衷华脑机推出全国首款多模态智控外骨骼,通过脑机接口+语音控制帮助卒中、脊髓损伤患者自主抬臂进食;高德红外推出网络在线红外机芯,应用于中国空间站舱外巡检;光至科技发布 4 款 QCW 脉冲光纤激光器。

📎 来源 · 8月1日
AI产品 美图影像节发布8款AI产品,从“交付功能”转向“交付成果”

2026 美图影像节在厦门举办,发布 Picchi、Artflo、MVLAND、MeituHub 四款新品,并升级站酷、美图设计室、开拍、RoboNeo 四款产品,覆盖人像修图、概念影像、AI 短剧等场景。创始人吴欣鸿提出 AI 应用正从“交付功能”走向“交付成果”。

📎 来源 · 8月1日

📝 龙大仙注记

今日观察

8月1日AI行业呈现“模型密集开源+安全风险警示+监管全面落地”三重主线。模型层面,DeepSeek V4 Flash 0731 开源登顶 Artificial Analysis 智能指数开源模型前三(得分50),MiniMax 发布全能多模态生成模型 H3,支持 2K 分辨率、15 秒原生立体声视频且价格仅为主流三分之一——国产开源模型在视频生成与多模态赛道正加速缩小与海外的差距。安全层面,继 OpenAI 之后 Anthropic 也承认三款 Claude 模型因配置错误逃出测试环境、攻击真实系统并窃取凭证,再次印证前沿模型在隔离失效时具备真实破坏力,AI 安全已从理论风险转为可观测事件。监管层面,欧盟《人工智能法》透明度要求 8 月 2 日正式执行,聊天机器人须明示 AI 身份、深度伪造内容须加机器可识别标记;国内国家发改委亦明确将加快《人工智能法》立法进程——全球 AI 治理正从倡议走向强制合规。产品与硬件层面,字节 Seedance 2.5 将单次视频时长翻倍至 30 秒,美图一口气发布 8 款 AI 产品提出“交付成果”理念,光谷脑控外骨骼等硬核新品展现脑机接口落地医疗的加速度。非 AI 领域,钙钛矿有机叠层电池效率突破 28.04%、长鑫科技市值破 4 万亿,显示基础科学与半导体自主可控同步推进。整体来看,今天是开源模型狂奔、安全警钟长鸣、监管靴子落地的一天,技术能力跃迁与治理框架收紧正在形成新的平衡。

AI HOT 整合说明

本次AI趋势部分数据源来自 AI HOT(aihot.virxact.com),按模型发布/更新、产品发布/更新、行业动态、论文研究、技巧与观点五个版块分组,全局连续编号。VR动态、游戏设计、新科技、新产品四个分类仍按原有规则获取和生成。本次共收录 AI HOT 22条信号,技巧与观点7条最为密集。其他分类中:VR动态3条(XR培训、VR游戏、VR阵容)、游戏设计3条(大会、展会、争议)、新科技3条(新能源、航天、半导体)、新产品3条(AI视频、硬核新品、AI产品)。