AI Tech Daily · October 9, 2026
Friday, October 9, 2026 · 28 items
//Claude 推出 Dashboards 实时仪表盘与 Mo…;Anthropic 推出开源漏洞扫描服务 OSS Scann…;ts-rust 发布:由 LLM 将 TypeScript …。
Global Highlights
28Claude 推出 Dashboards 实时仪表盘与 Motion 动画讲解功能
Anthropic 发布 Claude Dashboards 和 Claude Motion 两项 beta 功能。
Anthropic 推出开源漏洞扫描服务 OSS Scanner,免费面向开源项目
Anthropic 发布 OSS Scanner,一个可选加入的开源漏洞扫描服务,用其最强模型(包括 Claude Mythos)定期免费扫描开源项目,输出为全模型生成、无人工复核的报告。
ts-rust 发布:由 LLM 将 TypeScript 编译器、检查器和 LSP 移植到 Rust
ts-rust(tsc-rs)将 microsoft/TypeScript(Go 实现)的编译器、类型检查器和语言服务器移植为 Rust,作者称全部代码由 LLM 编写,本人未读过代码。
Crowdstrike 报告疑似单人使用 AI 渗透工具攻击多家韩国银行
Crowdstrike 报告称,一名疑似中文使用者于2026年9月底至10月初利用 AI 驱动的开源渗透测试工具 ARTEX 攻击多家韩国金融机构,窃取大量数据,其中 Shinhan Bank 超过 25,000 条包含姓名、联系方式、收入和信用额度的记录泄露。
OpenAI 年化营收被曝接近 500 亿美元,与此前预期差距约 200 亿美元
据金融时报报道,OpenAI 向投资者披露截至 9 月底年化营收逼近 500 亿美元,大幅低于此前外界估算的 700 亿美元,缺口约 200 亿美元。差异源于统计口径不同,Anthropic 计入 AWS 和谷歌云等合作方销售收入,而 OpenAI 剔除该部分。报道发布后美股科技股下跌,纳斯达克 100 指数收跌 1.4%,英伟达跌 2.9%,甲骨文跌 5.5%。
部分数学家呼吁抵制 OpenAI,AI 生成的数学证明涌入数学领域
AHM 组织在 Terence Tao 主持下发表声明,呼吁抵制 OpenAI,称其一次性发布 700 多个 AI 生成证明文件是展示力量而非学术行为。此前 OpenAI 宣称内部模型一个月内解决逾 100 个开放数学问题,约 8000 个测试问题成功率约 5%,平均每个耗时 3 小时 GPT-Pro 级算力。
Anthropic 发布 2026 年使用政策更新,11 月 12 日生效
Anthropic 发布新版使用政策,将于 11 月 12 日生效,多数变化是对既有规则的澄清。更新包括新设禁止欺骗性活动章节、收窄选举条款、明确武器软件与无人机武装禁令、更精确的监控与执法限制、补充高风险用例及自主物理操作的 human in the loop 要求,并新增禁止对模型的持续无端虐待行为。
Codex 与 ChatGPT Work 活跃用户达 4000 万新高,付费账户重置已全部到账
作者确认 banked reset 已到账所有账户,并转引 Day 3 动态称 Codex 与 ChatGPT Work 合计活跃用户达到 4000 万新高,其中提到 GPT-6 已在 Chat 中上线。
OpenAI 封禁俄罗斯与伊朗两个利用 ChatGPT 开展虚假前臆影响行动的账号集群
OpenAI 封禁了两个隐蔽影响行动,俄罗斯来源的 Dark Clark 通过假 persona Mia Clark 控制拉美智库 Social Research Center,评分达 Category 5,是报告以来首个 Category 5;伊朗来源的 Bogus Bylines 用 7 个假记者身份在全球十几家中小媒体投放近 100 篇长文,评分 Category 4。
Waymo 完成 50 亿美元债务融资,加速业务扩张
Waymo 宣布完成 50 亿美元定期贷款,这是其首次债务融资。PIMCO、Blackstone 和 Sixth Street 担任牵头银团贷方,Goldman Sachs 担任独家主账簿管理人;资金将用于加速其全自动驾驶打车服务在美国及国际市场的扩张。此前今年早些时候 Waymo 完成了 160 亿美元股权融资,上个月刚在第十五个美国城市启动服务。
Goodfire 为 Kimi K3 和 GLM 5.3 训练并部署生产级网络安全监控器
Goodfire Research 为 Kimi K3 和 GLM 5.3 构建基于激活探针加 LLM judge 的监控级联,并部署到生产推理栈。
Hugging Face 工程师用 ML Intern 以约 103 美元自制 7 个小模型
Hugging Face 工程师 yuvraj sharma 用 HuggingChat 的 ML Intern 模式在几天内做出 7 个模型,包括可在 CPU 运行、99.7% 有效输出的 0.8B 提示词重写器,以及将柑橘病害识别准确率从 14.9% 提升到 52.8% 的 Qwen3.5-2B 微调模型等,全部计算成本约 103 美元。
Arena 公布 Claude Haiku 5.5 (High) 真实评测结果:Code Arena 1587 分首秀第 30 名
Zenity 研究人员发现一条提示词即可劫持 AWS 账户内全部 AgentCore 智能体
Artificial Analysis 评测 Google Nano Banana 2.1,两榜居第 4 且价格为前代一半
Google 开源 ML Drift 端侧 GPU 推理引擎,接替 TFLite GPU delegate
Arena 完成 2 亿美元 B 轮融资,估值 31 亿美元并发布 Alignment Index
GPT-6.1 Sol ultrafast 发布,Codex steering 改进为即时响应
Anthropic 用 Claude Managed Agents 构建定时智能体自动化的实践指南
Tessl 工程博客:AI 不是笨,是瞎——企业级 Agent 记忆的三个关键设计决策
Google 开源 AQuA 环境质量智能体,自动诊断生产环境中的 Agent 故障
Claude 九月回顾:Chat 与 Cowork 合一,Claude 5.5 系列模型上线
ARC Prize 2026:TUFA Labs 以 88.06% 登顶 ARC-AGI-2 高分榜
ARC Prize 公布 2026 赛季 ARC-AGI-2 高分榜,TUFA Labs 以 88.06% 排名第一。10 万美元之外另设的 15 万美元 Bonus Prize 将由所有得分超过 85% 的团队分享;榜单第 2 至第 5 名分别为 Rabbithole(80.56%)、Yi-Chia Chen(77.22%)、Nubanana(77.08%)和 _hans(67.64%)。
OpenAI 研究负责人发声明回应三名员工离职争议
OpenAI 研究负责人发声明,称上周在调查发现 Jasmine、Mikita 和 Tomek 违反敏感信息处理政策后终止其雇佣,并表示内部调查发现超出三人公开信所述的重大信任违规。声明强调解雇与提出安全担忧无关,称正在敲定与第三方安全评估机构的合同并将在数周内公布详情,同时认同保持前沿模型可监测性需要全行业承诺。
Mistral Large 4 进入 Agent Arena 前十五实验室,排名第 43
Arena 宣布 Mistral Large 4 进入 Agent Arena 前十五实验室,基于超 5000 个真实智能体会话,该预览版净改进分为 -6.6%,总排名第 43,比前代 Mistral Medium 3.5(-12.60%)高出 11 位。
如何在单张 RTX 5090 上用 MiniMax H3 生成实时视频
ComfyUI 博客作者用智能体搜集各类优化,把 MiniMax H3 实时视频生成压缩到单张 RTX 5090(32 GB 显存)上运行,生成 30 秒视频耗时 23.51 秒,达 1.28 倍实时吞吐。
Arena 获 Lightspeed 领投 2 亿美元 B 轮融资,估值 31 亿美元并推出 Alignment Index
Arena 宣布完成由 Lightspeed 领投的 2 亿美元 B 轮融资,估值 31 亿美元。引用内容称其年化收入已超 1 亿美元,数百万用户通过真实使用帮助评估前沿模型;Arena 同时推出 Alignment Index,衡量 AI 行为在真实场景中与人类价值的契合程度。
Arena 宣布 2 亿美元 B 轮融资,估值达 31 亿美元,并推出 Alignment Index
Arena 宣布完成 2 亿美元 B 轮融资,估值 31 亿美元,同时推出衡量 AI 智能体是否安全、真实且在用户要求范围内行动的 Alignment Index。引用 Felicis 的内容称 Arena 年化收入已超 1 亿美元,累计促成 3.5 亿次会话和 6200 万次投票。