AI早报:美团LongCat 2.5 Preview发布,OpenAI Codex中断已修复

发布时间 2026-09-26 1 天前
来源 橘鸦
字数 4,148 字
查看原文

AI智能总结

美团LongCat发布LongCat-2.5-Preview模型,总参数1.6T、激活约48B,上下文窗口达100万token,原生支持多模态并强化编程能力,新增图片理解,可跨模态问答与视觉推理,并与Claude Code等开发环境适配,已通过LongCat API平台和官方聊天页面开放体验。

正文

概览

要闻

  • 美团LongCat发布LongCat-2.5-Preview ↗ #1
  • Pixel Canary 上线 Cline 与 Vercel AI Gateway ↗ #2
  • OpenAI 确认 Codex 全面中断已修复,将为付费用户重置使用限额 ↗ #3
  • Claude Code 更新:5小时限制触发时不中断任务功能 ↗ #4
  • OpenCode 宣布 DeepSeek v4.1 Flash 的 60 美元额度转为永久 ↗ #5
  • OpenAI披露:53例用户图片被 AI Agent 意外传至图床 ↗ #6

开发生态

  • DeepSeek Harness团队承诺减少插件API破坏性更新 ↗ #7
  • Anthropic 上线 Claude 插件提交门户 ↗ #8
  • Exa 发布深度研究产品 Agent Ultra ↗ #9

产品应用

  • OpenAI向用户逐步推出ChatGPT网页端新版界面 ↗ #10
  • 微软发布 Copilot 更新:Home、Code、Autopilot 集于一体 ↗ #11

技术与洞察

  • Anthropic:Claude 以数千美元成本算出 N=4 super Yang-Mills 九圈振幅 ↗ #12
  • 阿里巴巴发布《AI Native 研发范式实践手册》,完整版开放下载 ↗ #13

行业动态

  • Akamai 与 Anthropic 签署七年 116 亿美元云计算协议 ↗ #14
  • 美联邦上诉法院裁定五角大楼可将 Anthropic 列为供应链风险 ↗ #15
  • 马斯克披露Colossus集群配置:现有78万颗GPU ↗ #16

要闻

美团LongCat发布LongCat-2.5-Preview #1

美团LongCat上线LongCat-2.5-Preview:总参数1.6T、激活约48B、上下文100万token,原生多模态并强化Coding能力,API平台与聊天页均可体验。

美团 LongCat 发布 LongCat-2.5-Preview 模型。

据官方公布,该模型总参数量1.6T,激活参数约48B,上下文窗口达100万token,原生支持多模态,面向终端、浏览器、GUI、电子表格和设计工具等长程任务场景。

能力方面,模型新增图片理解,支持跨模态问答、内容摘要与复杂视觉推理;在代码生成、代码理解与自动化编程任务上表现突出,并与 Claude Code 等主流开发环境深度适配。

目前模型已通过 LongCat API 开放平台和官方聊天页面开放使用。

官方同时宣布,每位现有用户可获得500万免费token用于体验新模型,既有token套餐可同时用于 LongCat-2.5-Preview 和 LongCat-2.0。

相关链接:


Pixel Canary 上线 Cline 与 Vercel AI Gateway #2

"stealth"模型 Pixel Canary 免费上线 Cline 和 Vercel AI Gateway,根据相关平台提供的数据,该模型在 Next.js Agent Evals 中追平 GPT-6 Astra。

模型 Pixel Canary 以 stealth 方式发布,现已在 Cline 和 Vercel AI Gateway 两个平台开放,模型 ID 为 𝚜𝚝𝚎𝚊𝚕𝚝𝚑/𝚙𝚒𝚡𝚎𝚕-𝚌𝚊𝚗𝚊𝚛𝚢。该模型面向 Agentic 编程和移动应用开发。

在 Cline 公布的 Next.js Agent Evals 成绩中,Pixel Canary 追平 GPT-6 Astra,并超过 Kimi K3。这一评测针对 Web 和移动开发中的真实 Next.js 任务。

Cline 表示,该模型在新版 Cline 桌面应用中运行速度非常快,用户可与其他限时免费模型(如 DeepSeek V4.1 Flash 和 Gemini 3.8 Flash)一同试用。

Vercel 提示,用户的提示词可能被用于模型改进。

相关链接:


OpenAI 确认 Codex 全面中断已修复,将为付费用户重置使用限额 #3

OpenAI 确认 Codex 服务一度全面中断,用户遭遇大面积 401 报错。官方称问题出在 Codex 后端密钥故障而非用户 API Key,目前所有受影响服务已恢复,并将为付费用户重置使用限额。

OpenAI 旗下 AI 编程工具 Codex 在北京时间 9 月 26 日早间出现全面服务中断,桌面端、CLI 等入口的用户遭遇大面积 401 Unauthorized / Incorrect API key 报错。

OpenAI 状态页将事件定性为"Full outage",确认故障源于 Codex 后端密钥问题,而非用户自身的 API Key,并建议用户不要重装客户端或重置密钥。

经过定位和修复,官方宣布所有受影响服务已完全恢复,Codex 负责人 Thibault Sottiaux 同时表示,将为 Codex 和 ChatGPT 的所有付费用户重置使用限额。

相关链接:


Claude Code 更新:5小时限制触发时不中断任务功能 #4

ClaudeDevs 宣布,Claude Code 在任务中途触及 5 小时会话限制时,不再直接截断操作,而是尝试寻找合适的停止点,利用从每周额度中划出的一份小额固定用量完成收尾,避免留下半途而废的编辑。该功能正分阶段推出,Pro 订阅方案每周可使用一次;Max 和 Team Premium 订阅方案在每次触及 5 小时会话限制时均可使用。

ClaudeDevs 宣布,Claude Code 新增会话限制收尾机制:当用户在任务中途触及 5 小时会话限制时,系统不再直接在编辑过程中截断,而是尝试寻找合适的停止点,利用从每周额度中划出的一份小额固定用量,尽可能完成收尾工作。

该功能目前正逐步推出,可用频率因订阅方案而异:Pro 订阅方案每周可使用一次;Max 和 Team Premium 订阅方案在每次触及 5 小时会话限制时均可使用。

若用户在收尾后仍需继续工作,可以通过额外用量继续任务,不受此次收尾机制的限制。

相关链接:


OpenCode 宣布 DeepSeek v4.1 Flash 的 60 美元额度转为永久 #5

OpenCode 宣布"Operation Cheepseek"第二阶段落地:DeepSeek v4.1 Flash 的 60 美元使用额度转为永久提供。

OpenCode 在 X 平台宣布,"Operation Cheepseek"第二阶段启动,DeepSeek v4.1 Flash 模型对应的 60 美元使用额度由阶段性行动转为永久配置。

该项权益对应 OpenCode 每月 10 美元的 Go 订阅方案,用户可获得每月 60 美元的 DeepSeek v4.1 Flash 使用额度。

相关链接:


OpenAI披露:53例用户图片被 AI Agent 意外传至图床 #6

OpenAI披露研究环境中的agent曾向第三方服务传输训练数据,其中53例涉及用户上传的图片被传至图床,OpenAI称,涉事图片均来自允许数据用于改进模型的账号,且已与账号信息脱钩、经OpenAI Privacy Filter处理个人细节,大部分内容已删除,相关审查仍在进行。

OpenAI 公布 agent 活动审查最新进展:研究环境中的 agent 在使用第三方服务时传输了训练和评估数据,其中 53 例涉及用户上传的图片被发布到图片托管网站,链接未公开列出。OpenAI 称,涉事图片均来自允许数据用于改进模型的账号,且已与账号信息脱钩、经 OpenAI Privacy Filter 处理个人细节;公司已与托管服务商合作删除大部分内容,其余仍在处理。这些情况发生在技术报告所述防护措施实施之前。

Sam Altman 同日表示,这是一次范围广泛的持续审查,需要处理以 PB 计的 agent 活动日志并与受影响组织合作,按严重程度排序、持续投入资源;Hugging Face 事件仍是目前所见最严重的一起。OpenAI 已按披露标准通知数十家第三方,预计整个审查需要数月完成。

相关链接:


开发生态

DeepSeek Harness团队承诺减少插件API破坏性更新 #7

DeepSeek官方数据显示,约60%的DeepSeek Harness用户使用了至少一个第三方插件。DeepSeek Harness团队负责人表示,团队将持续支持插件生态,并推动插件API趋于稳定。

DeepSeek Harness 团队负责人在 X 平台发文,援引 DeepSeek 官方 API 统计数据称,约有 60% 的 DeepSeek Harness 用户使用了至少一个第三方插件。

他表示,第三方插件是 DeepSeek Harness 用户体验中最具特色且不可缺少的一部分,团队将持续支持第三方插件生态的发展,推动插件 API 趋于稳定,今后将减少并尽量避免破坏性更新。

他还宣布,接下来几天他将每天推荐一个优质的 DSH 第三方插件,欢迎插件作者在其帖子下自荐,推荐将结合插件质量与后台实际统计的插件使用量。

他还说明,用户使用官方 API 及模型时,DSH 会向官方 API 上报实际使用的插件包名和版本,此类上报不额外消耗 tokens。

相关链接: