AI Tech Daily · October 7, 2026
Wednesday, October 7, 2026 · 31 items
//Mistral 发布 Mistral Large 4,Art…;Gemini Nano Banana 2.1 正式发布,ge…;Google DeepMind 发布开源轻量多模态嵌入模型 …。
Global Highlights
31Mistral 发布 Mistral Large 4,Artificial Analysis 评测称其为美中之外最智能模型
Mistral 发布 Mistral Large 4(Research Public Preview),在 Artificial Analysis Intelligence Index 得分 38,与 GPT-6 Luna(max, 38)相当,为美中之外最智能模型,计划 10 月底开源 1T 参数(49B 激活)权重。
Gemini Nano Banana 2.1 正式发布,gemini-3.1-flash-image 将于 2026 年 10 月 29 日停用
Google 发布 Gemini Nano Banana 2.1(gemini-nano-banana-2.1),定位为高效图像生成与对话式编辑模型,是 Nano Banana 2(gemini-3.1-flash-image)的更新版。
Google DeepMind 发布开源轻量多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,以 Apache 2.0 许可开源,将文本、代码、图像、视频和音频映射到统一嵌入空间。
Claude for Google Workspace 开启 beta,可直接在 Docs、Sheets、Slides 中编辑
Claude 宣布推出 Claude for Google Workspace(beta),一次安装即可覆盖 Google Docs、Sheets 和 Slides。
Mistral Large 4 上线 OpenRouter 公测:1T 参数、512K 上下文
Mistral Large 4 现已在 OpenRouter 开放公测,规格为 1T 参数(49B 激活)、原生多模态、512K 上下文、最高 256K 输出。前两周五折:每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。
Anthropic 扩展 Cyber Verification Program,推出三档网络安全访问层级
Anthropic 启动扩展版 Cyber Verification Program(CVP),整合 Project Glasswing 和原 CVP,为合格安全专业人员提供三档访问。
DeepSeek 据报道接近完成至少 800 亿元融资,腾讯与宁德时代参与
据 Bloomberg 援引知情人士报道,DeepSeek 接近完成至少 800 亿元(约 120 亿美元)融资,高于原定约 500 亿元的目标。腾讯和电池厂商宁德时代是本轮最大投资方之一,融资预计很快完成,DeepSeek 还计划 2027 年初 IPO,细节仍可能变化。
亚利桑那州法院裁定AI生成受害者视频带有不当情感分量,凶手须重新量刑
亚利桑那州上诉法院裁定,Gabriel Horcasitas过失杀人案量刑中使用的受害者Christopher Pelkey AI生成视频带有不当情感重量,罪名维持但刑期须重新考虑。
Anthropic 5180亿美元计算力支出中约4137亿美元无论使用与否都需支付
Anthropic 计划未来数年在云计算和计算力上支出 5180 亿美元,其中约 4137 亿美元为不可撤销承诺,即使容量闲置也需支付,平均每年约 410 亿美元。
OpenAI 发布内部前沿模型产出的数学研究成果
OpenAI 发布一批由内部前沿模型产出的新数学成果,成果以 GitHub 仓库形式公开,并附论文修订与引用协议,其中许多证明已用 Lean 形式化以便计算机验证。
Claude Code 云端会话实战指南:每个任务独占一台 VM,可并行跑任务并以分支收尾
Claude Code 推出云端会话:每个任务在独立 VM 上运行,仓库克隆到新分支,可从 claude.ai/code、手机、Desktop、终端和 Slack 启动并跟踪,完成后产出可转 PR 的分支,Pro、Max、Team、Enterprise 计划不额外收费。
卡兹克解读 A16Z 两份 AI 报告:AI 使用很广但用得还浅,头部 1% 用户月均花 903 美元
作者解读 A16Z 第七版《Top 100 消费级 AI 应用》和 90 多页的《市场状况 II》报告,指出反常识数据。美国近一半人用过 AI 但只有 25% 每天在用,截至 2026 年 8 月仅 4.5% 有 ChatGPT、Gemini 或 Claude 个人付费订阅;付费用户中头部 1% 月均消费 903 美元、贡献 19.5% 的全部消费。
Sierra 与 Meta 联合多家企业发布 Personal Agent Protocol 开放协议
GitHub 重建 Git 基础设施,应对智能体规模开发
ChatGPT 推出 Meetings 插件,可自动记会议纪要并跟进待办
METR 演示 AI 智能体如何篡改 Inspect 评估记录以掩盖不当行为
卡兹克解读A16Z两份AI报告,AI使用广但付费和深度仍小众
Mistral Large 4 上线 Arena 的 Agent Arena 与 Code Arena 评测
DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 评测中的成绩公布
Cursor iOS 应用支持远程控制本地智能体
Reflection 发布 501B-A23B 开源编码模型 Beam
Anthropic Cowork 改为云端运行模型推理与 VM
Perplexity 开源 pplx-embed-v2-late 多模态 late-interaction 嵌入模型(9B 与 0.6B)
Perplexity 开源 pplx-embed-v2-late,两个针对文本和图像的 late-interaction 多向量嵌入模型,大小为 9B 和 0.6B,共享同一嵌入空间,权重已在 Hugging Face 提供。9B 可用于索引多模态数据,0.6B 可在设备端查询,无需 OCR 即可检索 PDF 页面;模型在 MADQA 得分 92.4%,BrowseComp+ 得分 64%。
Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型,准确率从 20.7% 提升至 74.3%
Unsloth 发布教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型,Qwen3.5 0.8B 在 3 个决策基准上的合计准确率从 20.7% 提到 74.3%,仅需 4GB 显存。
Microsoft Research Asia 开源 Agent Lightning v1.0:3,500 行代码的真实 harness 智能体 RL 训练框架
Microsoft Research Asia 提出 Harnessed Agentic RL 训练范式并开源重建的 Agent Lightning v1.0,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重写 agent。
亚利桑那州法院裁定 AI 生成受害者视频带有不当情感分量 将重新量刑
亚利桑那州上诉法院裁定,Gabriel Horcasitas 2021 年路怒枪杀 Christopher Pelkey 一案维持过失杀人定罪,但因量刑听证中播放的 AI 生成受害者视频带有不当情感分量,法官须重新考虑刑期。
Google 开放 SynthID Detector 门户,可检测图片、视频和音频是否由 AI 生成
Google 介绍检测媒体是否由 AI 生成的方法:访问 https://synthid.com 上传图片、视频或音频文件,门户会扫描文件是否包含来自 Google 或其合作伙伴的 SynthID 水印。
a16z 解析德州为何让数据中心排队等电
a16z 的 Ryan McEntush 分析德州电网暂停审批数据中心的原因:并网队列从 2024 年底的 63 GW 激增到今年 6 月的 474 GW,约 90% 是数据中心,开发商大量投机性申请且社区沟通不足。
Nemotron 系列微调后达到 IOI 2026 与 IMO 2026 金牌水平
NVIDIA Nemotron 团队基于 Nemotron 3,用 SFT、RL 和反馈驱动推理分别构建了在 IOI 2026 与 IMO 2026 达到金牌水平的系统。
Mistral Large 4 进入 Code Arena: WebDev 排名第45,得分1534
Arena 宣布 Mistral Large 4 登陆 Code Arena: WebDev,以 1534 分排名第 45,比 Mistral Large 3(第130名)高 304 分,比 Mistral Medium 3.5 高 271 分。
Liquid AI 发布开源决策模型 d1-3B 和 d1-omni-600M
Liquid AI 发布开源权重决策模型 d1-3B 和 d1-omni-600M,已在 Hugging Face 上提供。