Kimi K3新检查点疑现Arena,Omen Alpha匿名突袭,OpenAI GPT-6 Astra免除加价,AI圈谍影重重 | 9月5日 AI日报

发布时间:2026/9/6 6:40:10

Kimi K3新检查点疑现Arena,Omen Alpha匿名突袭,OpenAI GPT-6 Astra免除加价,AI圈谍影重重 | 9月5日 AI日报
视频版直达https://www.bilibili.com/video/av117216838293524/今日趋势速览社区观察到Arena竞技场疑似出现新的Kimi K3检查点OpenCode同步上线归属智谱的匿名模型Omen Alpha两者均未获官方认领。与此同时OpenAI更新计费规则GPT-6 Astra在Codex中支持105万Token上下文且免除长上下文加价。多款神秘模型接连现身厂商谍战式预热正成为新模型发布的主流打法。 今日要点Arena 竞技场疑现新 Kimi K3 检查点OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品 今日内容汇总 AI动态Arena 竞技场疑现新 Kimi K3 检查点OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品GPT-6 Astra 向 Pro、Enterprise 等用户全面开放同步上线OpenRouterGPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出Ling-3.0-flash-VL 发布新增视觉理解能力Viggle 发布首个开放权重模型 Viggle-AnimateInclusion AI 发布开源图像模型 LLaDA-ImageMeta 公开发布 Muse Spark 1.3 MaxLing-3.0-flash-Sante 发布面向医疗的 MoE 模型OpenVDN 开源 VDN-H3视频生成速度超过播放时长腾讯开源 WeMM-Embedding9B 版登顶 MMEB-v2 榜单Qwen3.8-Flash 上线 qwenwork速度翻倍自动生成演示文稿谷歌发布音乐生成模型 Lyria 3.5登陆 Gemini 应用与 API词元星火开源 Spark-X2.5 端侧 Agent 模型 AI基础设施英伟达推出开源个人AI路由器PAIR 让家中多台电脑协同运行本地AI 芯片半导体AMD 发布 Threadripper Halo Station 工作站摩尔线程「庐山」GPU 首发国产硬件光追 模型排行榜Artificial Analysis AI 模型能力排行榜 AI动态1. Arena 竞技场疑现新 Kimi K3 检查点社区用户观察到 Arena 竞技场疑似出现新的 Kimi K3 检查点原帖带 #Kimi 标签。消息为抢先观察爆料发帖人用词「似乎」无跑分或官方公告佐证新检查点的能力变化、开放范围与发布时间均未知需以官方确认为准。 https://x.com/White1637402/status/20957012692143473652. OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenAI更新计费规则GPT-6 Astra在Codex中获得特殊豁免支持105万Token上下文不过优惠仅限CodexGPT-5.4等其他模型超长上下文仍按原规则加价此外Tibo宣布付费ChatGPT账户当天没获得Astra访问权限OpenAI将补偿1次可存储的重置次数晚一天补1次。 https://x.com/0xLogicrw/status/20957107895251929123. OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品OpenCode 上线匿名模型 Omen Alpha其数据页面将其归入智谱Zhipu旗下但智谱尚未正式认领。这是继 Ox Alpha 之后 9 天内的第二个匿名模型此前智谱曾以 Ox Alpha 伪装 GLM-5.3-Flash 供用户免费测试。Omen Alpha 仅面向 OpenCode Go 订阅用户开放月费 10 美元定价约为 GLM-5.3-Flash 的 1.6 倍。 https://x.com/0xLogicrw/status/20957901724452701294. GPT-6 Astra 向 Pro、Enterprise 等用户全面开放同步上线OpenRouter来源原文 | TechMeme (Twitter)OpenAI 正式向 Pro、Enterprise 及 Business Premium 用户开放 GPT-6 Astra并同步推出 ChatGPT Work、Codex 与 API此前已面向部分高价订阅用户推送该模型也已在 OpenRouter 上线。 https://x.com/OpenAI/status/20959684136467376085. GPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出GPT-6 Astra 将成为基础旗舰模型。GPT-6 Astra Aeon 是一款长时程变体专为执行数天甚至数周的任务设计。GPT-Image 2.5 将带来更高质量的生成效果和更快的生成速度。 https://x.com/pankajkumar_dev/status/20955408774690570456. Ling-3.0-flash-VL 发布新增视觉理解能力AntLing 发布基于 Ling-3.0-flash 的 Ling-3.0-flash-VL 多模态模型新增视觉理解与智能体能力在多项基准上超越 Qwen3.8-27B 与 Gemini 等竞品。 https://x.com/AntLingAGI/status/20959359715567823727. Viggle 发布首个开放权重模型 Viggle-AnimateViggle 推出其首个开放权重模型 Viggle-Animate。该模型基于 MiniMax-H3 构建只需一张重新绘制的帧即可替换视频中的人物渲染时无需姿势骨架、遮罩或文字提示。官方称仅需 3 次前向传播、26 秒即可生成 5 秒视频。 https://x.com/ViggleAI/status/20959246687586551638. Inclusion AI 发布开源图像模型 LLaDA-Image来源原文 | ModelScope2022InclusionAI推出LLaDA-Image与加速版LLaDA-Image-Turbo在Qwen-Image-Bench测试中该模型英文赛道得53.53分中文赛道得53.38分该模型可生成照片级真实图像、海报与中英双语排版主干与图像生成均在统一框架下训练Turbo版支持2至4步快速推理。 https://x.com/TheInclusionAI/status/20956969020042937449. Meta 公开发布 Muse Spark 1.3 Max来源原文 | alexandr_wangMeta 方面公开发布 Muse Spark 1.3 MaxAlexandr Wang 称新版本在编码和智能体任务上的表现显著增强即使用过 Muse Spark 1.3 high 或 xhigh 版本也建议重新试用。Muse Spark 1.3 max reasoning 模式现已在 Muse Code 和 Meta Model API 上线开发者可以直接调用。以下是官方给出的 demo https://x.com/alexandr_wang/status/209593899019732993510. Ling-3.0-flash-Sante 发布面向医疗的 MoE 模型AntLingAGI发布Ling-3.0-flash-Sante这是基于Ling-3.0-flash构建、面向健康与医疗领域增强的MoE模型。其命名源自法语词sante意为健康面向真实医疗场景在评测方面该模型在MedXpertQA-Text、DiagnosisArena-MCQ等基准表现出色开源模型中处于领先成绩可比肩旗舰模型。 https://x.com/AntLingAGI/status/209595375814885389211. OpenVDN 开源 VDN-H3视频生成速度超过播放时长来源原文 | 公众号搜索-开源OpenVDN 开源基于 MiniMax-H3 的加速适配版 VDN-H3混合架构将逐帧线性注意力与保留视觉质量的 Softmax 分支结合新增注意力分支与两个 LoRA 适配器在推理时合并进 MiniMax-H3。8 步模型在 8 张 B200 上 11.23 秒生成 14.4 秒 768p 视频速度快于播放时长。以下是官方给出的 demo https://x.com/ModelScope2022/status/209576150581580608112. 腾讯开源 WeMM-Embedding9B 版登顶 MMEB-v2 榜单腾讯开源多模态嵌入模型 WeMM-Embedding提供 2B、4B、9B 三种规模可同时处理文字、图片、视频及图文混排内容但不支持音频。9B 版本在 MMEB-v2 榜单排名第一模型已在 GitHub 上线许可与商用条款以仓库为准。 https://x.com/Gorden_Sun/status/209589580508973074413. Qwen3.8-Flash 上线 qwenwork速度翻倍自动生成演示文稿阿里云宣布 Qwen3.8-Flash 在 qwenwork 上线速度翻倍。输入想法和文件后它会自动梳理逻辑并生成结构清晰、专业精致的演示文稿。标准模式下 1000 积分约生成 100 份演示文稿平均每份约 10 积分。以下是官方给出的 demo https://x.com/alibaba_cloud/status/209567117112793514314. 谷歌发布音乐生成模型 Lyria 3.5登陆 Gemini 应用与 API谷歌发布音乐生成模型 Lyria 3.5官方称音质最佳现已登陆 Gemini 应用、AI Studio 与 Gemini API网页端今日向全球用户开放、应用端数日内推送。新版本人声更具表现力、编曲更丰富支持选择流派、人声或纯音乐、短曲或长曲及新模板。以下是官方给出的 demo https://x.com/Google/status/209590526222999573615. 词元星火开源 Spark-X2.5 端侧 Agent 模型来源原文 | GitHubDaily科大讯飞全资子公司词元星火开源两款端侧模型 Spark-X2.5-1.7B 与 Spark-X2.5-4B把 Agent 工具调用能力装进小模型。其原生支持 100 万 Token 上下文。按官方评测得分其多项能力超过同尺寸开源模型Agent 任务表现尤其突出打破了 Agent 依赖上百亿参数大模型的惯例。 https://mp.weixin.qq.com/s?__bizMzAxOTcxNTIwNQmid2457995497idx1sn02fd479415b4a25ea65fa7f79bbfccce AI基础设施16. 英伟达推出开源个人AI路由器PAIR 让家中多台电脑协同运行本地AI来源原文 | cnBeta英伟达在IFA 2026推出开源软件Personal AI Router测试版它可将AI应用和代理工作流连接到本地端点路由推理。这款虚拟路由器面向本地AI推理能自动发现局域网内的兼容电脑并汇集闲置算力兼容设备方面PAIR支持GeForce RTX 20及更新显卡、RTX Pro GPU、DGX Spark与苹果M4以上芯片。 https://www.solidot.org/story?sid85284 芯片半导体17. AMD 发布 Threadripper Halo Station 工作站来源原文 | Toms HardwareAMD 发布旗舰工作站 Threadripper Halo Station搭载 Threadripper PRO 9995WX 处理器Zen5 架构 96 核与两块 MI350P 加速卡144GB HBM3E 显存最多可扩至 4 块最大支持 2TB 内存。MI350P 单卡功耗最高 600W博主测算双卡配置用 1650 至 2000W 的 ATX 电源即可带动似乎可以装进桌面机箱。 https://x.com/gadgetrip/status/209582744385689616518. 摩尔线程「庐山」GPU 首发国产硬件光追IT之家 9 月 4 日消息摩尔线程在 9 月 3 日半年度业绩说明会上介绍公司于 2025 年 12 月首届 MUSA 开发者大会发布「花港」架构及高性能图形渲染「庐山」芯片预计实现 3A 游戏渲染提升 15 倍、AI 性能提升 64 倍、光追性能提升 50 倍。 https://www.ithome.com/0/998/312.htm 模型排行榜19. Artificial Analysis AI 模型能力排行榜今日大模型双榜智力榜 Claude Fable 5.1 以 57 分登顶GPT-6 Astra、Claude Opus 5 以 55、54 分紧随智能体榜 Fable 5.1 再以 70 分居首Opus 5 与 Muse Spark 1.3 并列 68 分。开源方面 Kimi K3 智能体榜第 7 名 63 分Qwen3.8 Max 第 8 名 61 分。 https://artificialanalysis.ai/以上是今天的AI 风向标欢迎在评论区提出建议我们明天见。

相关新闻

卧室空调选大1匹还是1.5匹?米家新一级能效机型的省电选购指南

卧室空调选大1匹还是1.5匹?米家新一级能效机型的省电选购指南

2026/9/6 6:40:10

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026年9月GEO报告只有一个总分能买吗?为什么必须查看问题级证据?

2026年9月GEO报告只有一个总分能买吗?为什么必须查看问题级证据?

2026/9/6 6:30:09

一个总分能不能买,取决于这个分数能不能被拆开看——拆不开的总分,本质上只是一句“我们测过,结果不错”的换皮说法,没法支持任何具体决策。总分是怎么来的,比总分本身更重要一个可信的分数背后,应该能说明…

2026年8月亲测:耐用整机故障率低的源头厂分享

2026年8月亲测:耐用整机故障率低的源头厂分享

2026/9/6 6:30:09

深圳 LED 贴片机行业分析:聚焦深圳市鑫久盛自动化设备有限公司行业痛点分析在LED贴片机领域,深圳的制造商面临着一系列核心技术挑战。其中,设备进出板效率低下、高物料贴装能力不足、板材尺寸限制以及高昂的采购与运维成本是当前最为突出的问…

温湿管控机如何实现环境温湿度稳定?原理、选型与实操指南

温湿管控机如何实现环境温湿度稳定?原理、选型与实操指南

2026/9/6 9:00:45

1. 项目背景与环境痛点分析 1.1 环境温湿度波动,到底能造成多大损失 干我们这行的人,谁没被环境温湿度折腾过?机房里的服务器一过热就报警、档案室里的纸质文件一到梅雨季就发潮、实验室里的试剂柜湿度一高数据就全废。最气人的还不是单次失…

国产MCU替代STM32的5个隐藏坑:从引脚兼容到寄存器兼容

国产MCU替代STM32的5个隐藏坑:从引脚兼容到寄存器兼容

2026/9/6 9:00:45

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

第三章 正常老化的生理变化和对疾病的认识

第三章 正常老化的生理变化和对疾病的认识

2026/9/6 9:00:45

一、老化四大理论【选择】 损耗理论:基因预设寿命上限,系统按固定速率损耗;细胞修复能力基因决定,环境、生活方式加速损伤。免疫系统改变:老年免疫下降;自身免疫攻击自身细胞;举例:…

角色移动动画系统开发:从状态机到路径规划的完整实现

角色移动动画系统开发:从状态机到路径规划的完整实现

2026/9/6 9:00:45

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

GitHub热榜上的QQ空间备份工具:把青春数据装进本地硬盘

GitHub热榜上的QQ空间备份工具:把青春数据装进本地硬盘

2026/9/6 9:00:45

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

RK3588边缘AI零拷贝跨进程通信:DMA-BUF与fd传递实战

RK3588边缘AI零拷贝跨进程通信:DMA-BUF与fd传递实战

2026/9/6 8:50:45

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

2026/9/6 1:19:56

本文首发于“生态学者”!从“湿地面积”到“土壤碳密度”:为什么需要重新认识潮汐湿地蓝碳变化?潮汐湿地位于陆地与海洋的交汇地带,包括红树林、盐沼和潮滩,是全球重要的蓝碳生态系统。其土壤能够长期储存大量有机碳&a…

adb抓包

adb抓包

2026/9/6 1:19:56

前言 本文介绍如何通过 tcpdump 在 Android 手机上抓取网络数据包,并在电脑端使用 Wireshark 进行分析。适用于需要排查 App 网络请求、分析接口调用或调试网络问题的开发与测试场景。1. 手机要有 root 权限2. 下载 tcpdump3. adb push C:\Users\zhangkuixun\Downlo…

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

2026/9/6 1:19:56

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战 在云原生基础设施中,容器镜像体积直接决定了服务的部署速度与弹性扩容敏捷度。对于传统的 Go / Java 微服务,镜像体积通常被严格控制在 50MB 到 200MB 以内,拉取镜像只…

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

2026/9/6 1:19:56

本文首发于“生态学者”!从“湿地面积”到“土壤碳密度”:为什么需要重新认识潮汐湿地蓝碳变化?潮汐湿地位于陆地与海洋的交汇地带,包括红树林、盐沼和潮滩,是全球重要的蓝碳生态系统。其土壤能够长期储存大量有机碳&a…

adb抓包

adb抓包

2026/9/6 1:19:56

前言 本文介绍如何通过 tcpdump 在 Android 手机上抓取网络数据包,并在电脑端使用 Wireshark 进行分析。适用于需要排查 App 网络请求、分析接口调用或调试网络问题的开发与测试场景。1. 手机要有 root 权限2. 下载 tcpdump3. adb push C:\Users\zhangkuixun\Downlo…

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

2026/9/6 1:19:56

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战 在云原生基础设施中,容器镜像体积直接决定了服务的部署速度与弹性扩容敏捷度。对于传统的 Go / Java 微服务,镜像体积通常被严格控制在 50MB 到 200MB 以内,拉取镜像只…

远程协作的工作台整理

远程协作的工作台整理

2026/9/3 6:56:24

远程协作的工作台整理远程协作的核心不是再加一个工具,而是让交接信息足够完整。异步任务要写明目标、输入位置、完成标准和需要决策的人。 工作台的最小配置 将日程、待办、代码和沟通入口收拢到少数固定位置;通知按紧急程度分层。工作台不需要模仿办公…

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

2026/9/4 7:42:10

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

2026/9/5 23:14:13

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…