🔥 AI HOT 晨报
AI HOT · 每日晨报

AI 圈今日要点

2026年8月5日 周三
覆盖时段:8月4日 周二 08:00 — 8月5日 周三 08:00(北京时间)
29
今日动态总数
模型发布/更新6产品发布/更新8行业动态7论文研究0技巧与观点8
模型发布/更新6 条
1NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
NVIDIA Blog(RSS)

NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建…

阅读原文
2商汤 SenseNova U1 开源:统一推理与图像生成
X:商汤 SenseTime (@SenseTime_AI)

商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻…

阅读原文
3OpenRouter 上线 FLUX 3 Video 统一多模态模型
X:OpenRouter (@OpenRouter)

@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像…

阅读原文
4蚂蚁百灵发布Ling-3.0-flash开源权重
X:蚂蚁百灵 (@AntLingAGI)

今天,我们发布了 Ling-3.0-flash 的开源权重。🎉 官方 BF16 和 FP8 量化版本现已可用,您可以根…

阅读原文
5腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别
公众号:腾讯混元

腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精…

阅读原文
6FLUX 3 Video, Part 1: Generation FLUX 3 Video, Part 1 August 4, 2026 Read more
Black Forest Labs:Blog(网页)

阅读原文
产品发布/更新8 条
7Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版
Hacker News 热门(buzzing.cc 中文翻译)

Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和…

阅读原文
8Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅
MarkTechPost(RSS)

Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核…

阅读原文
9面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入
公众号:面壁智能(MiniCPM)

面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeSten…

阅读原文
10Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型
Hacker News 热门(buzzing.cc 中文翻译)

Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需…

阅读原文
11OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置
OpenRouter:Announcements(RSS)

OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenC…

阅读原文
12SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型
LMSYS:Blog(Chatbot Arena 团队)

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE…

阅读原文
13Replit 环境智能:免提示词自动生成设计
X:Replit (@Replit)

你无需提示词,也无需设计语言。 环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片…

阅读原文
14Cloudflare 让智能体通过本地追踪调试 Workers
Cloudflare Blog

Cloudflare 即日起在 wrangler dev 和 vite dev 中自动为本地 Worker 调用捕获 O…

阅读原文
行业动态7 条
15Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议
X:Rohan Paul (@rohanpaul_ai)

Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volt…

阅读原文
16工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施
IT之家(RSS)

工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027…

阅读原文
17GPT-5.6 Luna降价80%永久生效
X:Tibo (@thsottiaux)

有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。

阅读原文
18Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官
Anthropic:Newsroom(网页)

Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责…

阅读原文
19OpenAI 说明第三方网络安全评估事件并公布新保障措施
OpenAI:官网动态(RSS · 排除企业/客户案例)

OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升…

阅读原文
20AI 领袖提出 SAFE 指南,强化智能体网络安全透明度
NVIDIA Blog(RSS)

Linux 基金会发布共享 AI 事件交换(SAFE)指南征求意见稿,旨在将智能体网络安全事件转化为全生态共享防护。

阅读原文
21Google 发布 Gemini 3.6 Flash 等三款新模型及 Gemini Robotics ER 2
Google Blog:AI(RSS)

Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite…

阅读原文
论文研究0 条
本期暂无相关动态
技巧与观点8 条
22在单颗 AMD MI300X 上运行 DeepSeek V4 Flash
Hacker News 热门(buzzing.cc 中文翻译)

一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补…

阅读原文
23MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行
Simon Willison 博客

MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模…

阅读原文
24用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线
MarkTechPost(RSS)

本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP…

阅读原文
25Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零
Cloudflare Blog

Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复…

阅读原文
26GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码
GitHub Blog

GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的…

阅读原文
27如何用 LangSmith 评估语音智能体
LangChain:Blog(RSS)

LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段…

阅读原文
28从零开始,教你用Codex搓出属于你自己的第一个硬件
公众号:数字生命卡兹克

作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪…

阅读原文
29杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长
Tomer Tunguz 博客(VC 分析)

科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fabl…

阅读原文