①模型发布 / 更新
1
小红书技术
小红书 AllSpark 开源 Search Agent 模型 Iris,35B/397B 同量级领先
小红书 AllSpark 开源 Search Agent 模型 Iris,权重与评测代码已公开,35B 与 397B 版本在同量级成绩领先,训练配方将陆续放出。
来源:小红书技术(公众号) · 昨天下午 17:59
2
SiliconFlow
硅基流动上线开源模型 Hy4 preview:770B 总参数、1M 上下文
硅基流动上线开源模型 Hy4 preview,总参数 770B、激活 49B、支持 1M 上下文,采用 Apache 2.0,可接入 Claude Code/Codex/Cursor,输入每 M token $0.834。
来源:SiliconFlow(X) · 今天凌晨 00:32
②产品发布 / 更新
3
Apple
Apple 发布新一代 Apple Intelligence,Siri AI 以测试版上线
Apple 发布重构版 Siri AI,支持个人语境、屏幕感知、系统级操作与跨设备对话,今起英文测试版随 2027 系统推送,下月扩至多语种。
来源:Apple Newsroom · 今天凌晨 01:09
③行业动态
4
The Decoder
Anthropic 计划登陆纳斯达克,连续两季盈利瞄准 2 万亿美元估值
Anthropic 告知投资者将实现连续第二季盈利,毛利率超 80%,据 FT 瞄准 2 万亿美元估值,拟登陆纳斯达克,惟盈利未计训练与分成成本。
来源:The Decoder · 昨天深夜 23:46
④论文研究
5
Arena
DeepSeek-V4.1-Flash 进入 Agent Arena 开源模型第 3 名
DeepSeek-V4.1-Flash (Max) 进入 Agent Arena 开源第 3,净提升 +4.87%、每任务中位成本 $0.07,比第 2 名 Hy4 成本低 68%、成绩仅差 0.09 点。
来源:Arena(X) · 今天凌晨 01:21
⑤技巧与观点
6
The Verge
科技巨头放缓 AI 开发的口头协议:安全共识还是卡特尔
Altman、Amodei、Hassabis、Musk 周末粗略同意放慢 AI 开发,提议第三方审计与全球协议;批评者指其压制竞争者及开源运动,形同"卡特尔"。
来源:The Verge · 今天早上 06:59
7
Hacker News
GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗
Entelligence 在 50 个 PR 上对比两模型代码评审:Luna 找到 69 个 bug(Astra 92),成本 $0.20 对 $5.66,精度 74% 对 96%,便宜模型性价比突出。
来源:Hacker News · 今天凌晨 03:56
8
Tomer Tunguz
Tomer Tunguz 解析 Amodei 放缓前沿提议的五派立场与算力监管难题
Tomer Tunguz 梳理 Dario Amodei 放缓前沿号召,归纳为可解释性、劳工、经济、地缘、监管俘获五派,并指出无人给出具体速度。
来源:Tomer Tunguz 博客 · 9/14 08:00
9
Claude Blog
Anthropic 重构测试影响分析服务以应对智能体编码的 CI 压力
Anthropic 工程师季度代码交付量为 21-25 年均值的 8 倍、80% 由 Claude 编写,半年内 CI 任务增 25 倍,遂重构测试影响分析服务。
来源:Claude Blog · 今天凌晨 03:15