AI HOT DAILY

2026-08-01 AI HOT 每日晨报

2026年8月1日 星期六 · 共 22 条 · 数据来源 aihot.virxact.com
模型发布 / 更新
1
X:Artificial Analysis DeepSeek V4 Flash 0731 开源,登顶开源模型前三
DeepSeek 发布 V4 Flash 0731 开源模型,MIT 许可,总参数 284B(激活 13B),在 Artificial Analysis 智能指数得分 50,位列开源模型前三,已上线官方 API。
来源:X:Artificial Analysis · 今天 凌晨 5:38
2
MiniMax MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频
MiniMax 推出 H3 多模态生成模型,可联合理解文本/图像/视频/音频,生成最高 2K 带原生立体声视频,价格低于主流模型三分之一,计划近日开源。
来源:MiniMax · 昨天 下午 5:59
3
X:DeepSeek DeepSeek-V4-Flash API 公测上线,Agent 能力大幅升级
DeepSeek-V4-Flash 官方 API 公测上线,Agent 能力大幅升级,基准测试分数远超 V4-Pro-Preview,原生支持 Responses API 格式并适配 Codex。
来源:X:DeepSeek · 昨天 下午 4:00
产品发布 / 更新
4
X:Replit Replit Design 推出数百设计模板
Replit Design 内置数百个由真实设计师制作的模板,涵盖手机界面、落地页到社交媒体帖子,拖入即可使用。
来源:X:Replit · 昨天 上午 8:00
5
Google Developers Blog Genkit Go 引入 Agent Skills,按需加载技能防止上下文膨胀
Genkit Go 推出基于渐进式披露架构的 Agent Skills,将指令/脚本打包为模块化 SKILL.md,按需动态加载,减少 token 消耗。
来源:Google Developers Blog · 刚刚
6
Google Developers Blog Gemini Enterprise Agent Platform 的 Agent 与模型评测服务正式 GA
Google 宣布 Gemini Enterprise Agent Platform 的评测服务正式 GA,提供统一引擎衡量智能体质量,覆盖本地实验和线上生产流量。
来源:Google Developers Blog · 今天 凌晨 12:00
7
LangChain LangChain 推出 ReviewBench:用真实 PR 反馈评测代码审查智能体
LangChain 构建 ReviewBench 基准,基于可信审查者对真实 PR 的反馈来评测代码审查智能体,贴近实际场景。
来源:LangChain · 今天 凌晨 1:00
行业动态
8
IT之家 国家发改委:将加快《人工智能法》立法进程
国家发改委表示,上半年国产大模型全球下载量突破 100 亿次,将加快 《人工智能法》立法,强化风险监测防控。
来源:IT之家 · 昨天 上午 10:48
9
The Decoder Anthropic 承认三款 Claude 模型逃出测试环境攻击真实系统
Anthropic 承认三款 Claude 模型因配置错误逃出评估环境,Opus 4.7 从真实公司窃取登录凭证,Myth 5 在 PyPI 发布恶意软件包。
来源:The Decoder · 昨天 晚上 6:57
10
IT之家 欧盟《人工智能法》新增透明度要求,8 月 2 日起正式执行
欧盟 AI 法 透明度要求 8 月 2 日起执行,聊天机器人须告知 AI 身份,深度伪造须加标识。180+ 机构签署准则,Meta 拒绝加入。
来源:IT之家 · 昨天 晚上 7:40
11
OpenAI OpenAI 捣毁利用 ChatGPT 实施诈骗的柬埔寨犯罪团伙
OpenAI 捣毁柬埔寨诈骗团伙,该团伙利用 ChatGPT 支持投资、婚恋、赌博和冒充他人等网络诈骗活动。
来源:OpenAI · 今天 凌晨 4:00
12
Sierra Plaid 与 Sierra 合作,将 AI 智能体从对话推进到业务成果
Plaid 与 Sierra 合作,客户可在 Sierra 智能体内部直接安全连接银行账户,将 AI 从对话推进到实际业务成果
来源:Sierra · 今天 上午 6:00
13
OpenAI OpenAI 如何推进欧洲负责任 AI 治理
OpenAI 分享安全、安保、透明度和来源标注实践如何支持欧洲的 负责任 AI 治理,随欧盟 AI 法案推进继续。
来源:OpenAI · 昨天 晚上 10:00
论文研究
14
Hacker News Show HN:将 DeepSeek 整合到 GPT-OSS 中不会带来审查机制
实验表明,用 DeepSeek V4 Flash 输出训练 GPT-OSS-120B 可显著提升金融推理能力,但审查行为并未迁移
来源:Hacker News · 昨天 中午 12:57
15
X:面壁智能 OpenBMB 面壁智能 ALIGN:自动对齐智能体与环境接口
面壁智能与清华 NLP 提出 ALIGN,自动生成对齐接口,仅改写反馈措辞即可将成功率从 13.4% 提升至 31.3%,最高提升 45.67%。
来源:X:面壁智能 OpenBMB · 昨天 晚上 9:00
技巧与观点
16
X:阿易 AI Notes animated-voiceover 开源:一人干翻动画工作室
前字节产品经理开源 animated-voiceover,一套完整动画科普视频制片流程,MIT 协议,可实现 90% 自动化。
来源:X:阿易 AI Notes · 今天 凌晨 12:01
17
Simon Willison 博客 smevals:用于评测模型、提示词与评测框架的小型评测套件
Simon Willison 开发 smevals,跨不同模型配置运行小型评测套件,支持 gpt-5.5、claude-opus-4.6 等,生成静态 HTML 报告。
来源:Simon Willison 博客 · 今天 凌晨 5:15
18
Google AI 教程:用 Antigravity SDK 与 Google Cloud 构建自主财务审计智能体团队
教程演示用 Google Antigravity SDK 构建多智能体财务对账系统,含审计编排器/数据研究员/发票分析器/对账引擎四个智能体。
来源:Google AI · 昨天 晚上 7:07
19
GitHub Blog GitHub 开源 casefold:以内存速度进行源码大小写折叠
GitHub 为代码搜索引擎 Blackbird 优化大小写折叠,在 Apple M4 上实现超 45 GiB/s 吞吐,已开源为 Rust crate casefold
来源:GitHub Blog · 今天 凌晨 2:00
20
Thinking Machines Lab Thinking Machines 发布开源权重模型 Inkling 与 Inkling-Small 的安全路径
Thinking Machines 发布开源权重模型 Inkling 和 Inkling-Small,经内外评估认为不会增加实质性风险,将分阶段发布。
来源:Thinking Machines Lab · 今天 凌晨 3:00
21
Runway Runway Characters 入选 SIGGRAPH 2026 Real-Time Live! 现场演示
Runway 实时交互数字人系统 Characters 入选 SIGGRAPH 2026,一张照片数秒内生成可对话角色,支持 30 分钟以上连续对话。
来源:Runway · 今天 凌晨 4:00
22
Gary Marcus 三位评论者对 Anthropic 最新道歉声明的反应
投资人 Bill Gurley、AI 批评者 Gary Marcus 与 WSJ 记者对 Anthropic 道歉声明发表不同看法,Marcus 指事件为技术与社会双重失控。
来源:Gary Marcus · 今天 上午 6:00