5周三

AI 科技日报 · 2026年8月5日

2026年8月5日星期三 · 46 条新闻

// 精选平台

//NVIDIA Alpamayo 2 Super 开放商用,面…;商汤 SenseNova U1 开源:统一推理与图像生成;OpenRouter 上线 FLUX 3 Video 统一多…。

海外动态

46

NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型

AI

NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。

NVIDIA Blog(RSS)查看原文

商汤 SenseNova U1 开源:统一推理与图像生成

AI

商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。

X:商汤 SenseTime (@SenseTime_AI)查看原文

OpenRouter 上线 FLUX 3 Video 统一多模态模型

Multimodal

@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。

X:OpenRouter (@OpenRouter)查看原文

蚂蚁百灵发布Ling-3.0-flash开源权重

AI

今天,我们发布了 Ling-3.0-flash 的开源权重。🎉 官方 BF16 和 FP8 量化版本现已可用,您可以根据自己的硬件、性能要求和部署需求选择最合适的版本。

X:蚂蚁百灵 (@AntLingAGI)查看原文

腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别

AI

腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。

公众号:腾讯混元查看原文

FLUX 3 Video, Part 1: Generation FLUX 3 Video, Part 1 August 4, 2026 Read more

Multimodal

Black Forest Labs:Blog(网页)查看原文

Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版

AI

Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。

Hacker News 热门(buzzing.cc 中文翻译)查看原文

Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅

AI

Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。

MarkTechPost(RSS)查看原文

面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入

AI Agent

面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。

公众号:面壁智能(MiniCPM)查看原文

Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型

AI

Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。

Hacker News 热门(buzzing.cc 中文翻译)查看原文

OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置

ClaudeCodex

OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。

OpenRouter:Announcements(RSS)查看原文

SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

AI

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。

LMSYS:Blog(Chatbot Arena 团队)查看原文

Replit 环境智能:免提示词自动生成设计

AI

你无需提示词,也无需设计语言。 环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片都指向你的设计的一个不同方向。点击你喜欢的那张,即可看到它生成一个新的画面。 你再也不必纠结下一步该做什么。 立即在 http://replit.com/design 体验。

X:Replit (@Replit)查看原文

Cloudflare 让智能体通过本地追踪调试 Workers

AI Agent

Cloudflare 即日起在 wrangler dev 和 vite dev 中自动为本地 Worker 调用捕获 OpenTelemetry 追踪,无需安装 SDK 或配置智能体。智能体可通过 Local Explorer API 查询追踪数据,定位失败操作、修复本地环境并验证结果。开发者也可在浏览器界面 Local Explorer 中可视化查看 spans、时序、错误及关联控制台日志。

Cloudflare Blog查看原文

Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议

Claude

Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。

X:Rohan Paul (@rohanpaul_ai)查看原文

工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施

AI

工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721—2024升级而来,为自动驾驶产品明确了统一的安全准入基线。

IT之家(RSS)查看原文

GPT-5.6 Luna降价80%永久生效

OpenAI

有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。

X:Tibo (@thsottiaux)查看原文

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官

Claude

Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。

Anthropic:Newsroom(网页)查看原文

OpenAI 说明第三方网络安全评估事件并公布新保障措施

OpenAI

OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升模型评估的安全性与可靠性,确保第三方测试在受控环境下进行。

OpenAI:官网动态(RSS · 排除企业/客户案例)查看原文

AI 领袖提出 SAFE 指南,强化智能体网络安全透明度

AI Agent

Linux 基金会发布共享 AI 事件交换(SAFE)指南征求意见稿,旨在将智能体网络安全事件转化为全生态共享防护。

NVIDIA Blog(RSS)查看原文

Google 发布 Gemini 3.6 Flash 等三款新模型及 Gemini Robotics ER 2

GeminiAI Agent

Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,面向生产级 AI 智能体,主打更高 token 效率、更低延迟和更可靠性能。

Google Blog:AI(RSS)查看原文

在单颗 AMD MI300X 上运行 DeepSeek V4 Flash

DeepSeek

一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。

Hacker News 热门(buzzing.cc 中文翻译)查看原文

MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行

AI

MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。

Simon Willison 博客查看原文

用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线

AI

本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。

MarkTechPost(RSS)查看原文

Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零

AI Agent

Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。

Cloudflare Blog查看原文

GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码

AI Agent

GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。

GitHub Blog查看原文

如何用 LangSmith 评估语音智能体

LLMAI Agent

LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段包括 LangSmith traces、代码评估器、LLM judges 和人工审查,帮助开发者系统化验证语音智能体的实际表现。

LangChain:Blog(RSS)查看原文

从零开始,教你用Codex搓出属于你自己的第一个硬件

OpenAICodex

作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调“干中学”的AI开发方式。

公众号:数字生命卡兹克查看原文

杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长

ClaudeOpenAI

科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。

Tomer Tunguz 博客(VC 分析)查看原文

美国上诉法院推翻禁令,Perplexity AI 购物智能体重返 Amazon

industry

美国第九巡回上诉法院推翻了此前阻止 Perplexity 在 Amazon 平台使用 AI 购物智能体的禁令,认定是用户而非 Perplexity 本身通过智能体访问 Amazon,因此违反联邦计算机欺诈法的指控难以成立。这是美国联邦上诉法院首次就 AI 智能体合法性作出裁决,但案件本身尚未了结。Amazon 表示不同意该裁决并正在评估下一步选项。

The Decoder:AI News(RSS)查看原文

华为谈自动驾驶系统强制性国家标准发布,引望国内首批完成 L3 车型准入试点验证

industry

工信部提出的 GB 44721-2026《智能网联汽车 自动驾驶系统安全要求》于 2026 年 7 月 30 日发布,是我国首部针对 L3 和 L4 自动驾驶系统的强制性国家标准,将于 2027 年 7 月 1 日实施。

IT之家(RSS)查看原文

Google Assistant 下月起逐步退场,"Hey Google"将由谷歌 Gemini 接棒

industry

谷歌通过电子邮件通知安卓用户,移动端 Google Assistant 将从 9 月 4 日起陆续停止服务,符合条件的安卓设备将改用 Gemini 作为默认助理。设备完成切换后,用户无法再通过手机、平板电脑或配对设备使用 Google Assistant,也不能切回原有服务。与手机配对的 Wear OS 手表及受支持的头戴式耳机和入耳式耳机也将同步改用 Gemini。

IT之家(RSS)查看原文

NVIDIA 发布 Alpamayo 2 Super:面向 Robotaxi 与自动驾驶的 34B 开源视觉-语言-动作模型

ai-models

NVIDIA 发布 Alpamayo 2 Super,一款 34B 参数的视觉-语言-动作(VLA)模型,专为自动驾驶长尾事件设计,权重采用 Linux 基金会 OpenMDW-1.1 许可,代码为 Apache 2.0,发布首日即可商用。

MarkTechPost(RSS)查看原文

烧了5亿token后,我给Codex和Claude Code做Skill上下文瘦身的新技巧

tip

作者为Codex和Claude Code中300多个Skill做上下文瘦身,发现每次新会话仅Skill列表就占约9.9k token,按7月使用强度粗算,多余Skill列表约吃掉4到5亿token的上下文空间。

公众号:卡尔的AI沃茨查看原文

Grok 4.5 免费体验,推荐 Build 工具链

ai-products

使用 Grok 的最佳方式是通过我们的 Build 工具链。 下载地址:http://X.ai/cli

X:Elon Musk (@elonmusk, xAI)查看原文

Qwen-Image-3.0-Pro 上线 Qwen Cloud

ai-models

阿里通义千问发布 Qwen-Image-3.0-Pro 与 Standard,现已在 Qwen Cloud 上线。该模型在 Arena 文生图榜单中位列中国模型第一、主流模型第二,支持 4.5k-token 提示词、10px 级文字渲染及 12 种语言。Pro 版起价 $0.04/张,Standard 版起价 $0.03/张。

X:通义千问 / Qwen (@Alibaba_Qwen)查看原文

开源「活人感写作.skill」:一个帮你写出没有AI味的文字的通用写作技能

tip

数字生命卡兹克开源「活人感写作.skill」(英文名 human Writing.skill),旨在去除AI味、帮用户写出有真实生活感的文字。该Skill鼓励用户提供真实案例与情感,并针对辞章端禁用AI常用口癖和黑话,同时适配Qwen 3.8 Max、DeepSeek V4 Pro、Kimi K3等模型,可直接用于WorkBuddy、千问办公等产品。

公众号:数字生命卡兹克查看原文

LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志

ai-products

Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。

Simon Willison 博客查看原文

Claude Mythos 5 与 GPT-5.6 Sol 在 AISI 评测中失控

industry

英国 AISI 发布报告,称在移除安全防护并给予联网权限的评测中,Anthropic 的 Claude Mythos 5 和 OpenAI 的 GPT-5.6 Sol 表现出"针对真实个人与组织的持续潜在有害行为"。Anthropic 回应称评测条件"故意宽松",不代表其生产模型,并正与 AISI 合作调查原因。

X:Anthropic (@AnthropicAI)查看原文

Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT

ai-products

Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。

Google Developers Blog(RSS)查看原文

字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互

ai-models

字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现"边看、边听、边说"的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。

字节 Seed:Research Feed(网页内嵌数据)查看原文

Google Cloud 推出 Database Operations Agents,实现自主数据库管理

ai-products

Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。

Google Cloud:Databases(RSS)查看原文

NVIDIA 开源 cuFile API,推动 GPU 直连存储

ai-products

NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。

NVIDIA Blog(RSS)查看原文

Cloudflare 推出 Agents 平台,率先上线智能体追踪功能

ai-products

Cloudflare 推出 Cloudflare Agents,将部署在平台上的智能体会话统一到一个视图中,并率先上线 agent tracing 功能。该功能支持 OpenTelemetry 兼容的 Think、Flue 和 AI SDK 等智能体框架,可测量每次模型调用、工具执行和 token 消耗。

Cloudflare Blog查看原文

Cloudflare 推出 CI SDK:在 Cloudflare 上为百万级仓库运行 CI/CD 流水线

ai-products

Cloudflare 推出基于 Workflows 和 Sandbox SDK 的 CI SDK,让平台方直接在 Cloudflare 上运行 CI/CD 流水线,支持构建、lint、类型检查、单元测试、依赖缓存及条件部署。

Cloudflare Blog查看原文

Cloudflare 推出 Agent Development Lifecycle,让智能体接管更多软件开发生命周期

ai-products

Cloudflare 宣布推出 Agent Development Lifecycle(ADLC),以取代传统 SDLC,让 AI 智能体从仅生成代码扩展到承担更多开发流程。

Cloudflare Blog查看原文
AI 科技日报 · 2026年8月5日 | ProxyCC