DeepSeek 公布最新 API 峰谷计费规则;Step 5 Preview 现身知名评测网站与官方订阅【AI 早报 2026-09-20】

本文转载自微信公众号「橘鸦Juya」(原文:https://mp.weixin.qq.com/s/wjmt_nPWwlE65C4nPh1noA),视频版见 B 站。 版权归原作者所有;原文配图请点击原文链接查看。

AI 早报 2026-09-20

概览

开发生态

  • DeepSeek API明确节假日及调休周末全天按空闲时段计费 #1
  • Tibo疑似暗示Codex banked reset #2

模型发布

  • Step 5 Preview现身Artificial Analysis网站 #3
  • 千问发布Qwen3.8-LiveTranslate #4
  • 阿里巴巴达摩院开源腹部CT诊断模型RADAR,论文发表于Science #5
  • Cua开源小型表单填写模型cua-s1-forms #6
  • 中国电信开源Xing4.0-29B-A4B模型 #7

技术与洞察

  • Android Developers推出Android Bench 2.0 #8

行业动态

  • OpenAI等四家公司遭付费用户提起反垄断诉讼 #9

前瞻与传闻

  • Anthropic 或将发布发布新模型应对Astra在企业市场的竞争 #10
  • OpenAI 或将发布 GPT-6 Sol 和 GPT-6 Luna #11
  • Google 或将发布 Gemini 4 Pro #12
  • MiniMax 或将发布 MiniMax-M3.1 #13
  • 月之暗面或将发布 Kimi K3.1 #14

DeepSeek API明确节假日及调休周末全天按空闲时段计费 #1

DeepSeekAPI平台近日发布公告横幅明确,调休上班的周末和中国法定节假日全天按空闲时段计费。该规则面向使用DeepSeek官方API的用户。

DeepSeekAPI平台近日发布公告横幅明确,调休上班的周末及中国法定节假日全天均按空闲时段计费。即使周末因调休成为工作日,也适用这一计费时段规则。该规则面向使用DeepSeek官方API的用户。

https://platform.deepseek.com/

Tibo疑似暗示Codex banked reset #2

有用户因 OpenAI 本周没有推出预期更新,向 Codex 负责人 Tibo 索要 banked reset,Tibo 回复:“OK fine. But it’s also still coming in Tuesday”。 有人认为“OK fine”是在同意提供 banked reset;也有观点认为他并未确认 reset,真正明确的只是此前预告的内容仍会在周二到来。

有用户发帖称 OpenAI 本周没有推出此前预期的更新,因此向 Codex 负责人 Tibo 喊话:“you owe us a banked reset sorry i don’t make the rules”。Tibo 随后回复:“OK fine. But it’s also still coming in Tuesday”。

这段回复随后出现两种不同解读。有用户认为“OK fine”是在同意提供 banked reset,并把这视为 Tibo 对 reset 请求的回应;也有观点认为这句话并没有确认会提供 reset,“OK fine”不足以构成明确承诺,真正明确的信息只是此前预告的内容仍会在周二到来。Tibo 的原话本身没有直接写出“banked reset”,因此是否会有 reset 仍取决于对这段回复的理解。

https://x.com/thsottiaux/status/2101352781219258527

Step 5 Preview现身Artificial Analysis网站 #3

阶跃星辰Step 5 Preview模型现身Artificial Analysis榜单,另有部分Step Plan用户称已可调用。第三方评测显示,该模型智能指数为44,支持1M上下文和视觉输入。更多信息有待官方正式发布。

Artificial Analysis收录阶跃星辰的Step 5 Preview,并完成独立评测,部分Step Plan用户也称已能看到并调用该模型。

页面显示,其智能指数为44,支持1M上下文和视觉输入。百万输入和输出token价格分别为1美元2.7美元

Step 5 Preview目前在该页面上被列为闭源模型,但阶跃星辰尚未正式发布,实际开放范围及发布时间仍不明确。

https://artificialanalysis.ai/models/step-5

千问发布Qwen3.8-LiveTranslate #4

千问发布同传模型Qwen3.8-LiveTranslate,支持60种语言实时翻译。模型采用Interleave架构和Thinker-Talker双模块设计,新增实时说话人分离、原文译文同帧输出与长上下文消歧能力,在线体验与API均已上线。

千问目前已正式发布同声传译大模型Qwen3.8-LiveTranslate,面向真实对话提供60种语言的实时翻译。

模型采用Interleave架构,将音频与文本组织为交织单流,缓存复用已听音频和已输出译文,字均延迟由上一代的2.8秒降至2.3秒

模型新增实时说话人分离、原文译文同帧输出和长上下文消歧三项能力

根据千问公布的评测结果,模型在多说话人长音频和多语言实时同传测试中均优于上一代及当前主流系统。

目前,用户可在线体验,模型API也已上线千问AI平台。

https://mp.weixin.qq.com/s/Rc3CKdHAtA_NdVRN2RLuAg

阿里巴巴达摩院开源腹部CT诊断模型RADAR,论文发表于Science #5

阿里巴巴达摩院开源了腹部CT诊断视觉语言模型``RADAR,论文发表于Science。该模型用超40万例CT和1500万图文对训练,覆盖18个解剖结构和146项影像发现,内外部诊断AUC超0.87。代码与权重已开放。

阿里巴巴达摩院GitHub 开源了腹部 CT 诊断通用视觉语言模型 RADAR(Rapid Abdominal Diagnosis with AI and Radiology),相关研究论文发表于 Science

RADAR 在包含 424,911 例增强腹部 CT 检查、1500 万解剖级图文对的 RAD-CT 数据集上训练,直接从临床报告学习,无需人工标注。

根据论文,模型覆盖 18 个解剖结构和 146 项影像发现,内部真实世界队列诊断 AUC 为 0.913,八家外部中心 AUC 为 0.8740.912

论文还报告,在 26 名放射科医生参与的阅读研究中,RADAR 协作使用使诊断敏感度提升约 10%

预训练检查点已在 HuggingFace 的 radar-generalist 页面提供,代码同步存档于 Zenodo,仓库采用 Apache 2.0 许可证,并附带训练、推理与预处理文档及演示数据。

https://github.com/alibaba-damo-academy/damo-radar

https://huggingface.co/radar-generalist/RADAR

https://zenodo.org/records/21271172

https://www.science.org/doi/10.1126/science.aec6129

https://damo.alibaba.com/events/32026091817897040537683024?language=CN

https://www.scmp.com/tech/big-tech/article/3368055/alibaba-open-sources-medical-ai-model-can-detect-cancer-and-nearly-150-conditions

Cua开源小型表单填写模型cua-s1-forms #6

Cua开源约70万参数的表单填写模型cua-s1-forms,可并行判断表单元素该填写、勾选、点击还是跳过,代码和权重均已开放,支持本地运行。

Cua开源面向表单填写的轻量模型cua-s1-forms。

它是CUA-S1小型专用计算机使用模型家族的表单研究检查点,通过单次前向计算为界面元素的候选值及勾选、点击、跳过操作评分,再由下游代码排序并交给Cua Driver执行。

模型包含706,048个可训练参数,检查点约2.8 MB;官方模型卡称其合成测试准确率为99.95%,小规模真实演示评估准确率为100%

该项目仍处于早期研究阶段,不是通用助手,也未在演示集以外的任意真实表单上得到验证;目前未由任何推理服务商部署,使用者可下载权重并在本地加载。

https://huggingface.co/cua-ai/cua-s1-forms

https://github.com/trycua/cua/tree/main/libs/cua-s1

中国电信开源Xing4.0-29B-A4B模型 #7

中国电信近期开源了星辰语义大模型Xing4.0-29B-A4B,总参数量29B,激活参数4B。该模型面向复杂工程与Agent任务优化,完全基于国产算力训练。

近日,中国电信旗下中电信人工智能科技有限公司开源星辰语义大模型Xing4.0-29B-A4B。

模型面向复杂工程和Agent任务优化,总参数量29B、激活参数4B,采用mHC、MLA和MTP架构,支持多步骤规划、工具调用与复杂推理链路,原生支持256K上下文并可扩展至512K

模型完全基于国产算力训练,面向昇腾910C集群,以MindSpore和MindFormers完成适配及训练优化,官方称整体训练吞吐较开箱性能提升约96%

目前基础版、FP8版和GGUF版均已提供,可通过Hugging Face、ModelScope和Modelers获取,并支持本地推理、服务化部署及微调。

https://github.com/XingChen-AGI/Xing4.0-29B-A4B

https://huggingface.co/XingChen-AGI/Xing4.0-29B-A4B

Android Developers推出Android Bench 2.0 #8

Android Bench 2.0现已推出,将AI评测扩展到真实多日Android工程任务,并开始评估Agent与模型组合,相关结果已可查看。

Android Developers 推出 Android Bench 2.0,用于评估 AI 处理真实、多日的 Android 工程任务的表现。

评测范围涵盖从零构建应用、开发新功能,以及将跨平台代码库迁移到 Android

评测以完成率、视觉保真度、回归问题和每个模型及任务的平均成本进行连续评分。

新版还开始评估常用 Agent 与对应模型的组合。

并新增 Gemini 3.8 Flash、Gemini 3.7 Flash、GPT-6 Astra、Fable 5.1、Kimi K3 和 Qwen 3.8 Max。

目前,更新后的评测方法和模型比较结果已可查看。

https://x.com/AndroidDev/status/2100622197253398669

https://developer.android.com/bench

OpenAI等四家公司遭付费用户提起反垄断诉讼 #9

一批付费用户在加州联邦法院起诉OpenAIAnthropicSpaceXAIGoogle,指控四家公司高管公开呼吁协调限制AI进步速度,违反反垄断法。原告称这种合谋导致用户以原价获得改进更慢的产品,正寻求集体诉讼认证及禁令,四家公司尚未回应。

一批付费订阅用户目前在加州北区联邦地区法院起诉Anthropic PBCOpenAI OPCO LLCSpaceXAIGoogle LLC,指控四家公司通过协调限制AI产品改进速度,违反《谢尔曼反托拉斯法》第1条。原告称,相关协调源于多名公司高管公开赞同一篇主张限制未经约束的AI发展速度、呼吁行业协调的文章,导致订阅者以相同价格获得改进更慢的产品。

原告正寻求集体诉讼认证、针对四家公司的禁令,以及确认其违反联邦反垄断法的宣告性判决。

四家公司尚未回应置评请求,材料也未说明相关AI服务的可用性已发生变化。

https://news.bloomberglaw.com/litigation/openai-anthropic-google-spacexai-hit-with-antitrust-lawsuit

https://www.bloomberglaw.com/public/document/BuistetalvAnthropicPBCetalDocketNo326cv10693NDCalSep182026CourtDo?doc_id=XB2DGFVVCI9HORMAMOFMINMJF4

Anthropic 或将发布发布新模型应对Astra在企业市场的竞争 #10

据报道,Anthropic正考虑发布新模型应对Astra在企业市场的竞争,安全评估仍在进行。另有爆料博主称新版Fable、Opus和Sonnet正在部分账号隐蔽测试,但相关信息尚无官方确认。

路透社援引三名消息人士称,Anthropic正考虑推出新模型,以应对OpenAIGPT-6 Astra获得的企业市场关注,但公司仍在评估下一款模型的安全性,尚未确定是否及何时发布。

与此同时,爆料博主leo称,新版Fable、Opus和Sonnet正在不同Claude界面及账号中隐蔽测试,但这一说法尚未获得Anthropic确认,也不代表三款模型已经全面开放。

路透社称,Anthropic还在权衡模型投入与盈利能力,相关讨论发生在利率上升、竞争加剧及预期IPO之前。

https://www.reuters.com/business/anthropic-considers-releasing-new-ai-model-ahead-ipo-sources-say-2026-09-19/

https://x.com/synthwavedd/status/2101072800505049241

OpenAI 或将发布 GPT-6 Sol 和 GPT-6 Luna #11

OpenAI 或将在下周推出新的 GPT-6 系列模型。Sam Altman 此前表示,原计划发布、自己最期待的内容已推迟到下周;OpenAI 团队成员 Tibo 近期称,下周会先发布“一些东西”,目前准备中的新内容甚至“可能够办 3 个 DevDay”。 当用户直接提出想要 GPT-6 Sol 和 GPT-6 Luna 时,Tibo 回复“What else do you want”,使这两款模型成为当前主要猜测对象。 不过,OpenAI 目前尚未正式透露相关信息,OpenAIDevDay 将于当地时间 9 月 29 日 举行。

OpenAI 或将在下周推出新的 GPT-6 系列模型。

Sam Altman 此前表示,原计划发布、自己最期待的内容已推迟到下周;OpenAI 团队成员 Tibo 表示,他正与 Sam Altman 等人筹备主题演讲,由于准备展示的内容较多,团队需考虑如何向用户解释这些新内容如何组合起来。

按其说法,新内容将密集出现,其中一部分会在下周率先公布,以免用户等待太久,更多内容将在未来数月陆续展示。

Tibo 还称,现有内容可能足够举办约 三场 开发者活动,随后向社区询问还想要什么。有用户回复称,希望获得并优先推出 GPT-6 Sol 和 GPT-6 Luna。

Tibo 回复“What else do you want”,使这两款模型成为当前主要猜测对象。

不过,OpenAI 目前尚未正式透露相关信息,OpenAI DevDay 将于当地时间 9 月 29 日 举行。

https://x.com/thsottiaux/status/2101157729037586694

Google 或将发布 Gemini 4 Pro #12

近期多名用户称,Arena 中的 gemini-3.8-flash 会随机路由至疑似 Gemini 4 Pro 的 Argon checkpoint,SVG3D 场景、网页和游戏生成表现优异;另有一张已被鉴定为使用 GPT-Image 生成的基准测试图流传。

多名第三方测试者和平台此前称,Gemini 4 Pro正在Arena以其他模型名称进行隐藏测试,并通过代码生成、图像任务展现出优异能力;另有一张已被鉴定为使用 GPT-Image 生成的基准测试图流传。目前Google尚未确认Gemini 4 Pro的型号、内部代号、测试成绩、价格和公开开放时间。

https://x.com/god_of_ai7/status/2101237972633063922

MiniMax 或将发布 MiniMax-M3.1 #13

MiniMax官方近期开源的CLI工具的代码中,多个文件出现了MiniMax-M3.1标识,配有多套上下文与输出参数及thinking effort档位。另有一张社区流传的截图显示官方工作人员预告该模型即将发布。目前未有更多的官方信息。

MiniMax官方开源的 MiniMax Code CLI 当前有多个文件出现字符 MiniMax-M3.1,覆盖历史模型字段恢复、managed catalog、模型列表、参数解析和队列持久化。

测试配置包含 450,000512,0001,000,000 上下文,以及 8,19216,000128,000 输出等多套数值,并涉及多个 thinking effort 档位。

另有一张社区流传的截图显示官方工作人员预告该模型即将发布。

MiniMax-M3.1 尚未进入实际内置模型,目前未有更多的官方信息。

https://github.com/search?q=repo%3AMiniMax-AI%2Fminimax-code+minimax-m3.1&type=code

月之暗面或将发布 Kimi K3.1 #14

Kimi知乎认证机构号发布了一串省略开头3.1的圆周率数字,这被解读为暗示KimiK3.1即将发布。不过帖文并未直接提及K3.1,目前该动态已被删除。

此前,Kimi知乎认证机构号发布了一串圆周率数字,内容从“4159”开始,缺少开头的“3.1”。

由于缺失部分与“K3.1”的版本编号对应,这种发布方式被解读为可能在暗示KimiK3.1即将发布。

不过,帖子本身未直接提及KimiK3.1,也没有说明发布时间、产品能力、开放范围或使用方式,相关猜测目前尚未得到进一步确认。

目前该动态已被删除。

提示:内容由AI辅助创作,可能存在幻觉错误

作者橘鸦Juya,视频版在同名哔哩哔哩。欢迎点赞、关注、分享

© 版权声明
THE END
喜欢就支持一下吧
点赞7 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容