尧图精选

Kimi K3新检查点疑现Arena,Omen Alpha匿名突袭,OpenAI GPT-6 Astra免除加价,AI圈谍影重重 | 9月5日 AI日报

🕒 发布时间:2026/9/6 6:40:31 📁 来源:尧图网络
视频版直达https://www.bilibili.com/video/av117216838293524/今日趋势速览社区观察到Arena竞技场疑似出现新的Kimi K3检查点OpenCode同步上线归属智谱的匿名模型Omen Alpha两者均未获官方认领。与此同时OpenAI更新计费规则GPT-6 Astra在Codex中支持105万Token上下文且免除长上下文加价。多款神秘模型接连现身厂商谍战式预热正成为新模型发布的主流打法。 今日要点Arena 竞技场疑现新 Kimi K3 检查点OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品 今日内容汇总 AI动态Arena 竞技场疑现新 Kimi K3 检查点OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品GPT-6 Astra 向 Pro、Enterprise 等用户全面开放同步上线OpenRouterGPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出Ling-3.0-flash-VL 发布新增视觉理解能力Viggle 发布首个开放权重模型 Viggle-AnimateInclusion AI 发布开源图像模型 LLaDA-ImageMeta 公开发布 Muse Spark 1.3 MaxLing-3.0-flash-Sante 发布面向医疗的 MoE 模型OpenVDN 开源 VDN-H3视频生成速度超过播放时长腾讯开源 WeMM-Embedding9B 版登顶 MMEB-v2 榜单Qwen3.8-Flash 上线 qwenwork速度翻倍自动生成演示文稿谷歌发布音乐生成模型 Lyria 3.5登陆 Gemini 应用与 API词元星火开源 Spark-X2.5 端侧 Agent 模型 AI基础设施英伟达推出开源个人AI路由器PAIR 让家中多台电脑协同运行本地AI 芯片半导体AMD 发布 Threadripper Halo Station 工作站摩尔线程「庐山」GPU 首发国产硬件光追 模型排行榜Artificial Analysis AI 模型能力排行榜 AI动态1. Arena 竞技场疑现新 Kimi K3 检查点社区用户观察到 Arena 竞技场疑似出现新的 Kimi K3 检查点原帖带 #Kimi 标签。消息为抢先观察爆料发帖人用词「似乎」无跑分或官方公告佐证新检查点的能力变化、开放范围与发布时间均未知需以官方确认为准。 https://x.com/White1637402/status/20957012692143473652. OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价OpenAI更新计费规则GPT-6 Astra在Codex中获得特殊豁免支持105万Token上下文不过优惠仅限CodexGPT-5.4等其他模型超长上下文仍按原规则加价此外Tibo宣布付费ChatGPT账户当天没获得Astra访问权限OpenAI将补偿1次可存储的重置次数晚一天补1次。 https://x.com/0xLogicrw/status/20957107895251929123. OpenCode 上线神秘模型 Omen Alpha疑为智谱 GLM 新品OpenCode 上线匿名模型 Omen Alpha其数据页面将其归入智谱Zhipu旗下但智谱尚未正式认领。这是继 Ox Alpha 之后 9 天内的第二个匿名模型此前智谱曾以 Ox Alpha 伪装 GLM-5.3-Flash 供用户免费测试。Omen Alpha 仅面向 OpenCode Go 订阅用户开放月费 10 美元定价约为 GLM-5.3-Flash 的 1.6 倍。 https://x.com/0xLogicrw/status/20957901724452701294. GPT-6 Astra 向 Pro、Enterprise 等用户全面开放同步上线OpenRouter来源原文 | TechMeme (Twitter)OpenAI 正式向 Pro、Enterprise 及 Business Premium 用户开放 GPT-6 Astra并同步推出 ChatGPT Work、Codex 与 API此前已面向部分高价订阅用户推送该模型也已在 OpenRouter 上线。 https://x.com/OpenAI/status/20959684136467376085. GPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出GPT-6 Astra 将成为基础旗舰模型。GPT-6 Astra Aeon 是一款长时程变体专为执行数天甚至数周的任务设计。GPT-Image 2.5 将带来更高质量的生成效果和更快的生成速度。 https://x.com/pankajkumar_dev/status/20955408774690570456. Ling-3.0-flash-VL 发布新增视觉理解能力AntLing 发布基于 Ling-3.0-flash 的 Ling-3.0-flash-VL 多模态模型新增视觉理解与智能体能力在多项基准上超越 Qwen3.8-27B 与 Gemini 等竞品。 https://x.com/AntLingAGI/status/20959359715567823727. Viggle 发布首个开放权重模型 Viggle-AnimateViggle 推出其首个开放权重模型 Viggle-Animate。该模型基于 MiniMax-H3 构建只需一张重新绘制的帧即可替换视频中的人物渲染时无需姿势骨架、遮罩或文字提示。官方称仅需 3 次前向传播、26 秒即可生成 5 秒视频。 https://x.com/ViggleAI/status/20959246687586551638. Inclusion AI 发布开源图像模型 LLaDA-Image来源原文 | ModelScope2022InclusionAI推出LLaDA-Image与加速版LLaDA-Image-Turbo在Qwen-Image-Bench测试中该模型英文赛道得53.53分中文赛道得53.38分该模型可生成照片级真实图像、海报与中英双语排版主干与图像生成均在统一框架下训练Turbo版支持2至4步快速推理。 https://x.com/TheInclusionAI/status/20956969020042937449. Meta 公开发布 Muse Spark 1.3 Max来源原文 | alexandr_wangMeta 方面公开发布 Muse Spark 1.3 MaxAlexandr Wang 称新版本在编码和智能体任务上的表现显著增强即使用过 Muse Spark 1.3 high 或 xhigh 版本也建议重新试用。Muse Spark 1.3 max reasoning 模式现已在 Muse Code 和 Meta Model API 上线开发者可以直接调用。以下是官方给出的 demo https://x.com/alexandr_wang/status/209593899019732993510. Ling-3.0-flash-Sante 发布面向医疗的 MoE 模型AntLingAGI发布Ling-3.0-flash-Sante这是基于Ling-3.0-flash构建、面向健康与医疗领域增强的MoE模型。其命名源自法语词sante意为健康面向真实医疗场景在评测方面该模型在MedXpertQA-Text、DiagnosisArena-MCQ等基准表现出色开源模型中处于领先成绩可比肩旗舰模型。 https://x.com/AntLingAGI/status/209595375814885389211. OpenVDN 开源 VDN-H3视频生成速度超过播放时长来源原文 | 公众号搜索-开源OpenVDN 开源基于 MiniMax-H3 的加速适配版 VDN-H3混合架构将逐帧线性注意力与保留视觉质量的 Softmax 分支结合新增注意力分支与两个 LoRA 适配器在推理时合并进 MiniMax-H3。8 步模型在 8 张 B200 上 11.23 秒生成 14.4 秒 768p 视频速度快于播放时长。以下是官方给出的 demo https://x.com/ModelScope2022/status/209576150581580608112. 腾讯开源 WeMM-Embedding9B 版登顶 MMEB-v2 榜单腾讯开源多模态嵌入模型 WeMM-Embedding提供 2B、4B、9B 三种规模可同时处理文字、图片、视频及图文混排内容但不支持音频。9B 版本在 MMEB-v2 榜单排名第一模型已在 GitHub 上线许可与商用条款以仓库为准。 https://x.com/Gorden_Sun/status/209589580508973074413. Qwen3.8-Flash 上线 qwenwork速度翻倍自动生成演示文稿阿里云宣布 Qwen3.8-Flash 在 qwenwork 上线速度翻倍。输入想法和文件后它会自动梳理逻辑并生成结构清晰、专业精致的演示文稿。标准模式下 1000 积分约生成 100 份演示文稿平均每份约 10 积分。以下是官方给出的 demo https://x.com/alibaba_cloud/status/209567117112793514314. 谷歌发布音乐生成模型 Lyria 3.5登陆 Gemini 应用与 API谷歌发布音乐生成模型 Lyria 3.5官方称音质最佳现已登陆 Gemini 应用、AI Studio 与 Gemini API网页端今日向全球用户开放、应用端数日内推送。新版本人声更具表现力、编曲更丰富支持选择流派、人声或纯音乐、短曲或长曲及新模板。以下是官方给出的 demo https://x.com/Google/status/209590526222999573615. 词元星火开源 Spark-X2.5 端侧 Agent 模型来源原文 | GitHubDaily科大讯飞全资子公司词元星火开源两款端侧模型 Spark-X2.5-1.7B 与 Spark-X2.5-4B把 Agent 工具调用能力装进小模型。其原生支持 100 万 Token 上下文。按官方评测得分其多项能力超过同尺寸开源模型Agent 任务表现尤其突出打破了 Agent 依赖上百亿参数大模型的惯例。 https://mp.weixin.qq.com/s?__bizMzAxOTcxNTIwNQmid2457995497idx1sn02fd479415b4a25ea65fa7f79bbfccce AI基础设施16. 英伟达推出开源个人AI路由器PAIR 让家中多台电脑协同运行本地AI来源原文 | cnBeta英伟达在IFA 2026推出开源软件Personal AI Router测试版它可将AI应用和代理工作流连接到本地端点路由推理。这款虚拟路由器面向本地AI推理能自动发现局域网内的兼容电脑并汇集闲置算力兼容设备方面PAIR支持GeForce RTX 20及更新显卡、RTX Pro GPU、DGX Spark与苹果M4以上芯片。 https://www.solidot.org/story?sid85284 芯片半导体17. AMD 发布 Threadripper Halo Station 工作站来源原文 | Toms HardwareAMD 发布旗舰工作站 Threadripper Halo Station搭载 Threadripper PRO 9995WX 处理器Zen5 架构 96 核与两块 MI350P 加速卡144GB HBM3E 显存最多可扩至 4 块最大支持 2TB 内存。MI350P 单卡功耗最高 600W博主测算双卡配置用 1650 至 2000W 的 ATX 电源即可带动似乎可以装进桌面机箱。 https://x.com/gadgetrip/status/209582744385689616518. 摩尔线程「庐山」GPU 首发国产硬件光追IT之家 9 月 4 日消息摩尔线程在 9 月 3 日半年度业绩说明会上介绍公司于 2025 年 12 月首届 MUSA 开发者大会发布「花港」架构及高性能图形渲染「庐山」芯片预计实现 3A 游戏渲染提升 15 倍、AI 性能提升 64 倍、光追性能提升 50 倍。 https://www.ithome.com/0/998/312.htm 模型排行榜19. Artificial Analysis AI 模型能力排行榜今日大模型双榜智力榜 Claude Fable 5.1 以 57 分登顶GPT-6 Astra、Claude Opus 5 以 55、54 分紧随智能体榜 Fable 5.1 再以 70 分居首Opus 5 与 Muse Spark 1.3 并列 68 分。开源方面 Kimi K3 智能体榜第 7 名 63 分Qwen3.8 Max 第 8 名 61 分。 https://artificialanalysis.ai/以上是今天的AI 风向标欢迎在评论区提出建议我们明天见。
上一篇/下一篇内容由系统自动关联 返回资讯列表 →