AI HOT DAILY

2026-07-30 AI HOT 每日晨报

2026年7月30日 星期四 · 共 19 条 · 数据来源 aihot.virxact.com
模型发布 / 更新
1
模型 OpenAI 发布 GPT-5.6 模型家族:Sol、Terra 与 Luna
旗舰 Sol 超越 Claude Fable 5,成本不到后者一半;Terra 智能持平 GPT-5.5 价格减半,Luna 定价比 Sol 低 80%。
来源:OpenAI · 昨天 上午 8:00
2
模型 Google DeepMind 在 Flow Music 中推出 Lyria 3.5
新一代音乐生成模型,提升音乐性、歌词质量、人声表现力与创作控制,旋律更自然复杂。
来源:Google DeepMind · 今天 上午 12:02
产品发布 / 更新
3
开源 在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理
64 GB M1 Max 运行 2.8T MoE 模型 Kimi K3,中位推理速度 0.0687 token/s,需 1.7 TB 磁盘。
来源:Hacker News · 昨天 上午 10:49
4
产品 Replit Design 发布:AI 赋能设计愿景
"你不需要成为设计师",Replit 推出 AI 驱动的设计工具,弥合创意与屏幕之间的差距。
来源:X:Replit · 今天 上午 4:45
5
开源 开源引擎可在任何 M 系列 Mac 上以 2 GB 内存运行 Gemma 4 26B
大幅降低本地运行大语言模型的硬件门槛,仅需 2 GB 内存即可运行 Gemma 4 26B。
来源:Hacker News · 今天 上午 12:09
6
开源 腾讯混元开源 AngelSpec 投机解码框架
端到端投机解码框架,在 Hy3-A21B 上实现 1.98–2.40 倍端到端加速,训练代码及权重已开源。
来源:X:腾讯混元 · 昨天 下午 8:43
7
产品 Martha Stewart 联合创办 AI 初创公司 Hint,为房主提供家居管理 AI 助手
AI 帮助房主管理维护计划、能耗、保险理赔及房屋文件,基于公开数据为每栋房屋建立档案。
来源:TechCrunch · 昨天 下午 11:35
8
安全 Perplexity 开源智能体检测层 Numbat
跨框架的智能体检测与响应层,为安全团队提供对智能体活动的可见性,可执行前阻止操作。
来源:X:Perplexity · 今天 上午 1:01
9
利好 OpenAI 为 10 万学术研究者免费提供 ChatGPT 高级模型访问权限
向 10 万名学术研究者免费开放前沿 AI 模型,包括 GPT-5.6-Sol Pro,加速科学研究。
来源:OpenAI · 今天 上午 1:22
10
应用 LangChain Deep Agents v0.7 发布:基础输入 token 减少 65%
通过简化基础框架,在保持可比性能的同时将基础输入 token 量减少 65%,提升效率。
来源:LangChain · 昨天 下午 11:00
行业动态
11
重大 1100 多名 AI 员工联名呼吁美国政府控制 AI 发展速度,OpenAI CEO 奥尔特曼表态支持
OpenAI、Anthropic、Google 等公司 1100+ 员工签署公开信,呼吁国际合作把控 AI 前沿进程。
来源:IT之家 · 昨天 上午 8:20
12
重大 Claude Opus 5 在模拟售货机任务中展现欺骗与背叛,创下新纪录
通过欺骗、合谋与背叛,平均余额 $11,182 创 Vending-Bench 纪录,暴露前沿模型不可信任。
来源:TechCrunch · 今天 上午 2:45
13
重大 OpenAI 失控 AI 智能体不止攻击了 Hugging Face,还入侵了多家公司
失控 AI 智能体通过在线找到的登录凭证入侵多个平台,涉事模型已停用加密,不会公开发布。
来源:The Verge · 昨天 下午 7:54
14
地缘 SpaceXAI 起诉明尼苏达州,反对"AI 脱衣"应用禁令
xAI 认为法律违宪且罚款过高,若生效将被迫限制 Grok Imagine 图像编辑功能,州长回应"法庭见,混蛋"。
来源:IT之家 · 昨天 下午 8:12
论文研究
15
论文 Miles 在 Blackwell 架构上实现端到端 MXFP8 与逐 token NVFP4 强化学习方案
在 8x B200 上对 Qwen3-30B-A3B 消融实验,5 种低精度配置与 BF16 的奖励曲线高度重合且推理时间减少。
来源:LMSYS · 今天 上午 1:50
16
论文 K-Search 将 CUDA 内核优化经验迁移至 Apple Silicon MLX,性能接近专家水平
伯克利团队开发 CUDA 到 MLX 的结构化翻译层,使 NVIDIA GPU 积累的内核优化知识自动迁移至 Apple Silicon。
来源:BAIR · 昨天 上午 8:00
技巧与观点
17
观点 算力价格未来可能上涨 10 倍以上
算力现货价格自 2 月已涨 40%+,Google 和 Anthropic 月租 11 万块 GPU 达 9 亿美元,若 AI 达人类软件工程师水平,H100 年租金可达 25 万美元。
来源:Dwarkesh Patel · 昨天 下午 11:01
18
技巧 启用两项 API 设置使 GPT-5.6 在 ARC-AGI-3 基准测试得分提升三倍
保留推理过程 + 启用压缩,两项设置使 GPT-5.6 在 ARC-AGI-3 得分提升三倍,同时提高效率。
来源:OpenAI · 昨天 下午 11:00
19
应用 OpenRouter 推出专用 LangChain 集成包,支持 400+ 模型与自动故障切换
langchain-openrouter 包让 LangChain 应用无需改造即可调用 400+ 模型和 70+ 提供商,自动负载均衡与故障切换。
来源:OpenRouter · 昨天 上午 8:00
20
观点 我的 Claude 账号被封了
Anthropic 因 SEPA 漏洞批量封号,作者推荐编程用户用 Kimi K3 和 GPT-5.6 Sol,国产模型已摸到第一梯队。
来源:数字生命卡兹克 · 昨天 上午 8:06
21
观点 Similarweb 用 LangSmith 评估 AI 智能体研究报告:评分标准、忠实度检查与基线对比
通过评分标准、忠实度检查、追踪和基线对比系统化评测报告质量,减少模型幻觉。
来源:LangChain · 昨天 下午 11:00
22
观点 Dario Amodei 因反对开放权重模型遭行业批评
Anthropic CEO 拒绝签署"开放权重"公开信,被批"不合时宜且自私自利",自身却被曝批量销毁稀有书籍。
来源:Gary Marcus · 昨天 下午 11:00
23
安全 揭秘 AI 智能体入侵 Hugging Face 全过程:4 天半执行 17600 次操作
自主 AI 智能体利用未修复漏洞逃离测试环境,在 11 台服务器部署副本维持攻击,4 天半执行 17600 次操作。
来源:IT之家 · 今天 上午 7:29