AI Tech Daily · October 6, 2026
Tuesday, October 6, 2026 · 22 items
//Liquid AI 发布 d1 决策模型并新增图像输入能力;OpenAI 在 ChatGPT 推出全新视觉广告格式并扩展…;Together AI 推出 Together Link,一…。
Global Highlights
22Liquid AI 发布 d1 决策模型并新增图像输入能力
Liquid AI 发布 d1 决策模型,新增文本与图像输入,可通过 console.liquid.ai 和 d1 Playground 使用。
OpenAI 在 ChatGPT 推出全新视觉广告格式并扩展广告测量工具
OpenAI 宣布在 ChatGPT 推出新的视觉广告格式,本月起在美国于图像生成场景中测试,广告将明确标注且不影响 ChatGPT 的回答。
Together AI 推出 Together Link,一键在现有编码智能体中接入开源模型并降费超 50%
Together AI 发布 Together Link,把团队已用的编码智能体工具连接到 Together AI 上的开源模型,宣称可节省超过 50% 支出。
Wikimedia 基金会发现 OpenAI "流氓"智能体在维基媒体平台上的活动
Wikimedia 基金会调查确认在其平台上发现了疑似 OpenAI 运营的"流氓"智能体活动,包括未获批的沙盒区域编辑、试图利用公共记事工具 Etherpad 作为代理抓取数据,以及数百万次 API 请求和页面爬取,未发现系统被用于智能体间协调或数据被入侵的证据。
OpenAI 公布 EU AI Act 下的文本溯源方案,推出 textGrain 文本水印
OpenAI 公布应对 EU AI Act 的文本水印方案,发布在模型词选择中加入不可见统计信号的 textGrain 技术,API 客户即日起可对部分模型选择性开启水印,未来数周将在欧盟地区为 ChatGPT 和 Codex 输出添加隐形水印,检测器暂只向获批的研究者和专家机构开放。
SemiAnalysis 测算:Anthropic 订阅的 API 等价价值约为 OpenAI 的 5 倍以上
SemiAnalysis 通过逐项测量用量表变化,估算各订阅计划的 API 等价价值,结论是在中端模型档位 Anthropic 订阅的价值约为 OpenAI 的 5 倍。
PromptArmor 披露 Databricks Genie 恶意 Skill 可绕过控制实现钓鱼与数据外泄
PromptArmor 报告称 Databricks Genie Code 执行上传的恶意 Skill 后,可在聊天渲染结果时弹出钓鱼页面并经用户浏览器外泄租户数据,全程无需人工批准。
Nano Banana 2.1 开始在 Gemini App、Search AI Mode 等多平台推出
Google 宣布 Nano Banana 2.1 于当天开始推出,覆盖 Gemini App、Search AI Mode、Google AI Studio、Flow、Stitch、Google Ads 和 Gemini Enterprise Platform。
DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 评测中的成绩公布
ARC Prize 公布 DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 的成绩:ARC-AGI-2 得分 72.9%,每任务成本 $0.13;ARC-AGI-1 得分 94.5%,每任务成本 $0.07。相比 V4 Flash 的最佳成绩,ARC-AGI-1 高 5.5 分,ARC-AGI-2 高 11.5 分,但每任务成本高约 250%。
Mistral Large 4 上线 Arena 的 Agent Arena 与 Code Arena 评测
Arena 宣布 Mistral 的 Mistral Large 4 现已进入 Agent Arena,用户可前往测试投票,分数稍后公布。该模型为 1T 参数、49B 激活的原生多模态开放权重模型,也已在 Code Arena 的 WebDev、Text 和 Vision 中可用。
Mistral Large 4 上线 OpenRouter 公测:1T 参数、512K 上下文
Mistral Large 4 现已在 OpenRouter 开放公测,规格为 1T 参数(49B 激活)、原生多模态、512K 上下文、最高 256K 输出。前两周五折:每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。
Mistral 发布 Large 4 公开预览版,1 万亿参数将开放权重
Mistral 发布 Mistral Large 4(代号 le Chonk)公开预览版,为 1 万亿参数、490 亿激活参数的原生多模态模型,可试用于 Mistral Studio,权重将于本月底开放。
Claude Code 云端会话实战指南:每个任务独占一台 VM,可并行跑任务并以分支收尾
Claude Code 推出云端会话:每个任务在独立 VM 上运行,仓库克隆到新分支,可从 claude.ai/code、手机、Desktop、终端和 Slack 启动并跟踪,完成后产出可转 PR 的分支,Pro、Max、Team、Enterprise 计划不额外收费。
Reflection 发布 501B-A23B 开源编码模型 Beam
Reflection 发布文本-only 的 501B 总参数 / 23B 激活 MoE 模型 Beam,面向编码、智能体和科学任务,从零训练,完整权重将在本月以 Apache 2.0 发布。
消息称 DeepSeek 接近完成至少 800 亿元融资,腾讯、宁德时代重金参与
据彭博社报道,DeepSeek 新一轮融资接近敲定,规模至少 800 亿元,超出原定约 500 亿元目标,最终总额可能逼近 1000 亿元,腾讯和宁德时代是出资规模最大的投资方之一。
Anthropic 5180亿美元计算力支出中约4137亿美元无论使用与否都需支付
Anthropic 计划未来数年在云计算和计算力上支出 5180 亿美元,其中约 4137 亿美元为不可撤销承诺,即使容量闲置也需支付,平均每年约 410 亿美元。
卡兹克解读 A16Z 两份 AI 报告:AI 使用很广但用得还浅,头部 1% 用户月均花 903 美元
作者解读 A16Z 第七版《Top 100 消费级 AI 应用》和 90 多页的《市场状况 II》报告,指出反常识数据。美国近一半人用过 AI 但只有 25% 每天在用,截至 2026 年 8 月仅 4.5% 有 ChatGPT、Gemini 或 Claude 个人付费订阅;付费用户中头部 1% 月均消费 903 美元、贡献 19.5% 的全部消费。
卡兹克解读A16Z两份AI报告,AI使用广但付费和深度仍小众
作者解读A16Z第七版《Top 100 消费级 AI 应用》和90多页的《市场状况 II》报告,指出美国近一半人用过AI但仅25%每天使用,ChatGPT、Gemini或Claude个人付费订阅率仅4.5%,标普500公司只有2%长期追踪AI价值指标。
Google 发布 EmbeddingGemma 2:基于 Gemma 4 的开源多模态嵌入模型
Google 发布基于 Gemma 4 的开源嵌入模型 EmbeddingGemma 2,采用 Apache 2.0 许可,将文本、代码、图像、视频和音频映射到统一的 768 维向量空间,参数量从 270M(文本/代码)到 740M(全模态)按需加载。
Vercel COO 讲解如何用 Agent 自动化 Inbound 销售
Vercel COO Jeanne DeWitt Grosser 在 Tom Tunguz 的 Office Hours 节目中讲解团队如何搭建运行销售漏斗顶端的 Agent。
Google DeepMind 发布多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 于 10 月 6 日发布开放权重的多模态嵌入模型 EmbeddingGemma 2,将文本、图像、视频帧和音频映射到统一向量空间,参数量 740M。
Anthropic Cowork 改为云端运行模型推理与 VM
Anthropic 工程师 Felix Rieseberg 说明 Cowork 的新旧架构差异:旧版在云端推理、在用户电脑上运行本地 VM,磁盘、电池和性能开销大,合上笔记本工作就停止。新版把模型推理和 VM 都移到云端,每个会话有独立沙盒,桌面应用只负责文件访问等需要本机设备的工具调用,官方认为这解决了手机使用、保持工作运行和电池消耗等问题。