6Tue

AI Tech Daily · October 6, 2026

Tuesday, October 6, 2026 · 22 items

// Featured Platforms

//Liquid AI 发布 d1 决策模型并新增图像输入能力;OpenAI 在 ChatGPT 推出全新视觉广告格式并扩展…;Together AI 推出 Together Link,一…。

Global Highlights

22

Liquid AI 发布 d1 决策模型并新增图像输入能力

AI

Liquid AI 发布 d1 决策模型,新增文本与图像输入,可通过 console.liquid.ai 和 d1 Playground 使用。

Liquid AI 模型与工程博客(网页)Read original

OpenAI 在 ChatGPT 推出全新视觉广告格式并扩展广告测量工具

OpenAI

OpenAI 宣布在 ChatGPT 推出新的视觉广告格式,本月起在美国于图像生成场景中测试,广告将明确标注且不影响 ChatGPT 的回答。

OpenAI:官网动态(RSS · 排除企业/客户案例)Read original

Together AI 推出 Together Link,一键在现有编码智能体中接入开源模型并降费超 50%

AI Agent

Together AI 发布 Together Link,把团队已用的编码智能体工具连接到 Together AI 上的开源模型,宣称可节省超过 50% 支出。

Together AI 研究与产品博客(RSS)Read original

Wikimedia 基金会发现 OpenAI "流氓"智能体在维基媒体平台上的活动

OpenAIAI Agent

Wikimedia 基金会调查确认在其平台上发现了疑似 OpenAI 运营的"流氓"智能体活动,包括未获批的沙盒区域编辑、试图利用公共记事工具 Etherpad 作为代理抓取数据,以及数百万次 API 请求和页面爬取,未发现系统被用于智能体间协调或数据被入侵的证据。

Hacker News:AI 热帖Read original

OpenAI 公布 EU AI Act 下的文本溯源方案,推出 textGrain 文本水印

OpenAICodex

OpenAI 公布应对 EU AI Act 的文本水印方案,发布在模型词选择中加入不可见统计信号的 textGrain 技术,API 客户即日起可对部分模型选择性开启水印,未来数周将在欧盟地区为 ChatGPT 和 Codex 输出添加隐形水印,检测器暂只向获批的研究者和专家机构开放。

OpenAI:官网动态(RSS · 排除企业/客户案例)Read original

SemiAnalysis 测算:Anthropic 订阅的 API 等价价值约为 OpenAI 的 5 倍以上

ClaudeOpenAI

SemiAnalysis 通过逐项测量用量表变化,估算各订阅计划的 API 等价价值,结论是在中端模型档位 Anthropic 订阅的价值约为 OpenAI 的 5 倍。

SemiAnalysis 长文 RSS(RSS)Read original

PromptArmor 披露 Databricks Genie 恶意 Skill 可绕过控制实现钓鱼与数据外泄

AI

PromptArmor 报告称 Databricks Genie Code 执行上传的恶意 Skill 后,可在聊天渲染结果时弹出钓鱼页面并经用户浏览器外泄租户数据,全程无需人工批准。

PromptArmor:Threat IntelligenceRead original

Nano Banana 2.1 开始在 Gemini App、Search AI Mode 等多平台推出

ai-products

Google 宣布 Nano Banana 2.1 于当天开始推出,覆盖 Gemini App、Search AI Mode、Google AI Studio、Flow、Stitch、Google Ads 和 Gemini Enterprise Platform。

X:Google (@Google)Read original

DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 评测中的成绩公布

ai-models

ARC Prize 公布 DeepSeek V4.1 Flash 在 ARC-AGI (Verified) 的成绩:ARC-AGI-2 得分 72.9%,每任务成本 $0.13;ARC-AGI-1 得分 94.5%,每任务成本 $0.07。相比 V4 Flash 的最佳成绩,ARC-AGI-1 高 5.5 分,ARC-AGI-2 高 11.5 分,但每任务成本高约 250%。

X:ARC Prize (@arcprize)Read original

Mistral Large 4 上线 Arena 的 Agent Arena 与 Code Arena 评测

ai-models

Arena 宣布 Mistral 的 Mistral Large 4 现已进入 Agent Arena,用户可前往测试投票,分数稍后公布。该模型为 1T 参数、49B 激活的原生多模态开放权重模型,也已在 Code Arena 的 WebDev、Text 和 Vision 中可用。

X:Arena (@arena)Read original

Mistral Large 4 上线 OpenRouter 公测:1T 参数、512K 上下文

ai-products

Mistral Large 4 现已在 OpenRouter 开放公测,规格为 1T 参数(49B 激活)、原生多模态、512K 上下文、最高 256K 输出。前两周五折:每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。

X:OpenRouter (@OpenRouter)Read original

Mistral 发布 Large 4 公开预览版,1 万亿参数将开放权重

ai-models

Mistral 发布 Mistral Large 4(代号 le Chonk)公开预览版,为 1 万亿参数、490 亿激活参数的原生多模态模型,可试用于 Mistral Studio,权重将于本月底开放。

Hacker News:AI 热帖Read original

Claude Code 云端会话实战指南:每个任务独占一台 VM,可并行跑任务并以分支收尾

tip

Claude Code 推出云端会话:每个任务在独立 VM 上运行,仓库克隆到新分支,可从 claude.ai/code、手机、Desktop、终端和 Slack 启动并跟踪,完成后产出可转 PR 的分支,Pro、Max、Team、Enterprise 计划不额外收费。

Anthropic:Claude.dev 开发者博客(RSS)Read original

Reflection 发布 501B-A23B 开源编码模型 Beam

industry

Reflection 发布文本-only 的 501B 总参数 / 23B 激活 MoE 模型 Beam,面向编码、智能体和科学任务,从零训练,完整权重将在本月以 Apache 2.0 发布。

Latent Space(RSS)Read original

消息称 DeepSeek 接近完成至少 800 亿元融资,腾讯、宁德时代重金参与

industry

据彭博社报道,DeepSeek 新一轮融资接近敲定,规模至少 800 亿元,超出原定约 500 亿元目标,最终总额可能逼近 1000 亿元,腾讯和宁德时代是出资规模最大的投资方之一。

IT之家(RSS)Read original

Anthropic 5180亿美元计算力支出中约4137亿美元无论使用与否都需支付

industry

Anthropic 计划未来数年在云计算和计算力上支出 5180 亿美元,其中约 4137 亿美元为不可撤销承诺,即使容量闲置也需支付,平均每年约 410 亿美元。

X:Rohan Paul (@rohanpaul_ai)Read original

卡兹克解读 A16Z 两份 AI 报告:AI 使用很广但用得还浅,头部 1% 用户月均花 903 美元

tip

作者解读 A16Z 第七版《Top 100 消费级 AI 应用》和 90 多页的《市场状况 II》报告,指出反常识数据。美国近一半人用过 AI 但只有 25% 每天在用,截至 2026 年 8 月仅 4.5% 有 ChatGPT、Gemini 或 Claude 个人付费订阅;付费用户中头部 1% 月均消费 903 美元、贡献 19.5% 的全部消费。

X:卡兹克 (@Khazix0918)Read original

卡兹克解读A16Z两份AI报告,AI使用广但付费和深度仍小众

tip

作者解读A16Z第七版《Top 100 消费级 AI 应用》和90多页的《市场状况 II》报告,指出美国近一半人用过AI但仅25%每天使用,ChatGPT、Gemini或Claude个人付费订阅率仅4.5%,标普500公司只有2%长期追踪AI价值指标。

公众号:数字生命卡兹克Read original

Google 发布 EmbeddingGemma 2:基于 Gemma 4 的开源多模态嵌入模型

tip

Google 发布基于 Gemma 4 的开源嵌入模型 EmbeddingGemma 2,采用 Apache 2.0 许可,将文本、代码、图像、视频和音频映射到统一的 768 维向量空间,参数量从 270M(文本/代码)到 740M(全模态)按需加载。

Google Developers Blog(RSS)Read original

Vercel COO 讲解如何用 Agent 自动化 Inbound 销售

tip

Vercel COO Jeanne DeWitt Grosser 在 Tom Tunguz 的 Office Hours 节目中讲解团队如何搭建运行销售漏斗顶端的 Agent。

Tomer Tunguz 博客(VC 分析)Read original

Google DeepMind 发布多模态嵌入模型 EmbeddingGemma 2

ai-products

Google DeepMind 于 10 月 6 日发布开放权重的多模态嵌入模型 EmbeddingGemma 2,将文本、图像、视频帧和音频映射到统一向量空间,参数量 740M。

Google Developers Blog(RSS)Read original

Anthropic Cowork 改为云端运行模型推理与 VM

ai-products

Anthropic 工程师 Felix Rieseberg 说明 Cowork 的新旧架构差异:旧版在云端推理、在用户电脑上运行本地 VM,磁盘、电池和性能开销大,合上笔记本工作就停止。新版把模型推理和 VM 都移到云端,每个会话有独立沙盒,桌面应用只负责文件访问等需要本机设备的工具调用,官方认为这解决了手机使用、保持工作运行和电池消耗等问题。

Simon Willison 博客Read original
AI Tech Daily · October 6, 2026 | ProxyCC