22Tue

AI Tech Daily · September 22, 2026

Tuesday, September 22, 2026 · 23 items

// Featured Platforms

//小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈…;xAI 发布 Grok 4.7,主打编码与知识工作;小米发布 MiMo-V2.6 Pro 与 Flash 全模态…。

Global Highlights

23

小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升

AI

Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。

公众号:小米 MiMoRead original

xAI 发布 Grok 4.7,主打编码与知识工作

AI

xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。

xAI:News(网页)Read original

小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型

ClaudeOpenAI

小米 MiMo 发布 MiMo-V2.6 Pro 与 Flash 两个全模态模型,通过规模化强化学习训练。Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高;能力覆盖编码、computer use、3D 推理和创作。

X:小米 MiMo (@XiaomiMiMo)Read original

小米发布开放权重模型 MiMo-V2.6-Pro,登顶 Artificial Analysis 开放权重模型智能指数

AI

小米(Xiaomi)发布开放权重模型 MiMo-V2.6-Pro,在 Artificial Analysis Intelligence Index 得分 46,超越前代 MiMo-V2.5-Pro 的 26,为开放权重模型中最高。

X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)Read original

通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑

LLMMultimodal

通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

X:通义千问 / Qwen (@Alibaba_Qwen)Read original

小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

AI

小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。

X:Arena (@arena)Read original

Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线

AI

Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。

公众号:月之暗面(Kimi)Read original

不列颠哥伦比亚省起诉 OpenAI,指其未在枪击案前将 flagged ChatGPT 活动转介警方

OpenAI

不列颠哥伦比亚省在加州起诉 OpenAI,指 flagged 的 ChatGPT 活动本应在 2026 年 2 月 10 日 Tumbler Ridge 枪击案前通报警方,该案致 8 人死亡(含 5 名儿童和一名教育工作者)、27 人受伤。

X:Rohan Paul (@rohanpaul_ai)Read original

亚马逊封禁 Meta Muse 智能体代用户购物,双方争端升级

AI Agent

亚马逊阻断了 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问,并指 Muse 不表明身份、会采集保存用户账号凭证,带来隐私和安全隐患。

IT之家(RSS)Read original

马斯克称 Grok 4.7 使 xAI 在智能体编码领域位列第三

ClaudeOpenAI

Elon Musk 引用 Artificial Analysis 评测称,Grok 4.7 使 xAI 在智能体编码上排名第三,仅次于 Anthropic 和 OpenAI。

X:Elon Musk (@elonmusk, xAI)Read original

Nathan Lambert 撰文分析开源模型的中美实力格局

AI

Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。

Nathan Lambert:Interconnects(RSS)Read original

Artificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56

ClaudeAI Agent

Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分,AA-Briefcase 得 1657 Elo(+111),仅次于 Claude Opus 5 和 Claude Fable 5.1。

Artificial Analysis 完整文章(网页)Read original

数字生命卡兹克访谈汉化组:AI 时代字幕组与漫画组的真实处境

AI

作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。

公众号:数字生命卡兹克Read original

Tomer Tunguz 谈 AI 优化 if-then 判断:专用决策器把分类成本降近百倍

AI Agent

Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。

Tomer Tunguz 博客(VC 分析)Read original

Linear 重构 CI 流程应对 AI 编码带来的验证瓶颈,PR 等待时间从 6 分钟降至 5 分钟

AI Agent

Linear 工程师分享如何解决 AI Agent 加速写代码后 CI 成为瓶颈的问题,PR 等待时间从 6 分钟以上降至 5 分钟出头,单测 runner 时间约减半。

Linear:Now(RSS)Read original

Apple 新款 Mac mini(M6/M5 Pro)与 Mac Studio(M5 Max/M5 Ultra)今日开售

ai-products

Apple 宣布新款 Mac mini 和 Mac Studio 于 9 月 22 日开售。Mac mini 搭载 M6 和 M5 Pro,AI 性能最高提升 4 倍。

Apple:Newsroom(RSS)Read original

Kimi 发布浏览器扩展,由 Kimi WebBridge 更名而来

ai-products

Kimi 发布新的 Kimi Browser Extension,前身为 Kimi WebBridge。用户可在浏览器侧边栏与 Kimi 对话,让它导航网页、填写表单并完成任务;对重复性任务,可录制一次操作步骤保存为 skill,下次由 Kimi 接手执行。产品现已在 kimi.com/products/kimi-browser-extension 和 Chrome Web Store 上线。

X:Kimi.ai (@Kimi_Moonshot)Read original

卡兹克实测对比 Grok 4.7 与小米 MiMo V2.6:后者成不可能三角版本答案

tip

作者实测同日凌晨发布的 Grok 4.7 与小米 MiMo V2.6,认为 Grok 4.7 低于预期,MiMo V2.6 成为性能、价格、速度三角的当前版本答案。

公众号:数字生命卡兹克Read original

Artificial Analysis 评测 Step 5 Preview: Intelligence Index 得 44 分,成本约为同级模型 1/2.8

tip

Artificial Analysis 评测阶跃星辰 Step 5 Preview,其在 Artificial Analysis Intelligence Index 得 44 分,与 Kimi K3 (max) 持平,略低于 GLM-5.3 (max) 和 Qwen3.8 Max 的 45 分,每任务成本约 $0.72,约为同级模型(约 $2.00)的 1/2.8。

X:Artificial Analysis (@ArtificialAnlys)Read original

OpenRouter 推出 Batch API,批量推理可享半价

ai-products

OpenRouter 发布 Batch API,异步批量请求由供应商在 24 小时窗口内完成,通常按正常 per-token 价格的 50% 或更低收费,目前已支持 70 多个模型。

OpenRouter:Announcements(RSS)Read original

transformers 支持直接加载 GGUF 量化模型,本地推理性能接近 llama.cpp

ai-products

Hugging Face 宣布 transformers 支持直接运行 GGUF 量化模型,通过 from_pretrained 传入 gguf_file 即可加载 Hub 上的 GGUF checkpoint,并复用 ggml 的 Metal 内核。

Hugging Face:Blog(RSS)Read original

OpenRouter 解读 NVIDIA Nemotron 3.5 Lightning 如何承担 Agent 高频执行调用

tip

OpenRouter 发文解读 NVIDIA 的 Nemotron 3.5 Lightning,这是一款 30B 总参数、约 3B 激活参数的混合专家开源权重模型,定位于工具调用、编码等高频、边界清晰的 Agent 执行步骤,与负责复杂推理的 Nemotron 3 Ultra(550B 总参数、55B 激活)形成分工。

OpenRouter:Announcements(RSS)Read original

小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

ai-models

小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。

X:Arena (@arena)Read original