巴西 Supersonic Labs 发布 144.3M 参数开源决策模型 Julia 1,可在 CPU 上运行
巴西 AI 实验室 Supersonic Labs 发布 144.3M 参数的开源决策模型 Julia 1,权重以 Apache 2.0 协议托管在 Hugging Face,可在普通 CPU 上运行,不生成文本,只对 2 到 20 个候选答案输出选择和概率。
Arena 宣布 Claude Opus 5.5 (High) 以 1509 分首次登顶 Text Arena,比 Opus 5 (High) 高 18 分(现列第 11)。Opus 4.6 (High) 以 4 分之差保持第 2,Anthropic 包揽该榜前六名;Opus 5.5 (High) 按每百万 token 输入/输出定价折算的混合价格为 $16/MToken,进入 Text Arena 的 Pareto 前沿。
美团 LongCat API 开放平台于 9 月 25 日上线 LongCat-2.5-Preview 模型,同步开放 API 与网页端体验入口。
Liquid AI 发布 LFM2.5-VL-3B-DSpark,一个为其视觉语言模型 LFM2.5-VL-3B 设计的实验性投机解码草稿模型,新增约 279.5M 参数(+8.9%),在 Apple silicon 上解码最高提速 3.13 倍,NVIDIA H100 上最高 2.66 倍。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,GPT-6 Sol (Max) 随即进入 Arena 的 Agent Arena 排行榜,在 4000+ 真实智能体会话中以 +7.7% 净提升排名第 6。
Perceptron 发布 35B 具身智能体模型 Mk1.5,可控制无人机、四足机器人、智能眼镜,并调度子智能体,无需平台特定重训练。模型针对 egocentric 视频训练,启用网页搜索、页面阅读、反向图搜和缩放工具后,MMSearch F1 从 18.2 升至 54.3;官方数据显示端到端延迟最高较 Mk1 快 4.7 倍(Chat 从 5.2 秒降至 1.1 秒)。
Aikido Security 发布首个开源权重安全模型 Altar-1,将 Z.AI 的 GLM-5.3 经 AWQ 4-bit 量化和 Cerebras REAP 专家剪枝(每层保留 168/256 个专家)从 1,506.7 GB 压缩到 328 GB,缩小 78.2%。
美团 LongCat 发布 LongCat-2.5-Preview,作者转发时指出定价与之前一样。该模型 1.6T 参数、约 48B 激活、1M-token 上下文窗口,原生多模态,面向长程任务,覆盖终端、浏览器、GUI、电子表格和设计工具等场景。API 入口 https://longcat.ai/platform/ ,对话入口 https://longcat.ai/chat/ 。
美团 LongCat 发布 LongCat-2.5-Preview,总参数 1.6T、激活约 48B,提供 1M token 上下文窗口,原生多模态,面向长程任务,覆盖终端、浏览器、GUI、表格和设计工具。现已开放 API(https://longcat.ai/platform/)和聊天入口(https://longcat.ai/chat/)。
Fastino Labs 发布 340M 参数开源权重决策模型 GLiNER2.5-Decide,接受文本和类型化问题 schema,返回带概率分布、置信度和约束可行性元数据的结构化答案,权重采用 Apache 2.0,可运行于 CPU、GPU 或气隙环境。
Black Forest Labs 发布 7B 开源权重世界动作模型 FLUX 3 Action,用于机器人控制,在 RoboLab-120 上以 42.92% 任务成功率排名第一,领先 Cosmos 3 Nano 6.1 个百分点且参数少 56%。
BottleCap AI 发布 ThinkingCap-Qwen3.8-27B,这是基于 Qwen3.8-27B 的微调模型,在 12 个基准上平均减少 37.2% 思考 token,宏观精度从 86.65% 降至 85.79%。
Black Forest Labs 发布面向机器人的开源模型 FLUX 3 Action,基于以视频数据训练的多模态 FLUX 3,可从机器人工作区的多机位视频预测智能体下一步动作及环境变化。BFL 称其仅 70 亿参数即在 RoboLab-120 排行榜创下成功率纪录,体积不到此前最佳开源模型一半,运行最快快至 3.95 倍;模型权重已上架 Hugging Face。
Odyssey 发布下一代多智能体世界模型 Agora-2,支持最多 20 个人类与 AI Agent 在共享环境中实时交互模拟,多人研究预览版已开放体验。其模拟模型基于实体属性、近期动作和周围几何结构预测组合动作如何改变共享世界状态,显式追踪参与者之间的相互影响。
Odyssey 推出下一代多智能体世界模型 Agora-2,支持最多 20 个人类与智能体在共享环境中实时交互,多人研究预览现已开放体验。作者 Elvis Saravia 评价称,这类世界模型可用于共同训练机器人、自动驾驶和网络安全防御智能体,各方在交互中相互提升,也为研究智能体串谋提供了安全环境。
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark drafter 模型,参数约 280M,仅增加 8.9% 参数量。GPU 上解码吞吐最高提升 2.66 倍、边缘设备 3.13 倍,端到端分别最高 2.27 倍和 2.62 倍;模型已上架 Hugging Face,支持 llama.cpp、SGLang 和 MLX-VLM。
斯坦福大学与 NVIDIA Research 团队发布 Contrastive Language Models(CLM)及 CLM-8B 模型,用 InfoNCE 对比目标连接状态与动作,作为 System One 决策模型。
在 2026 骁龙峰会上,高通与 PrismML 发布 1-bit 量化 Bonsai 视觉语言模型,基于 Bonsai 1.7B 构建,可在骁龙 AR1 Gen 1 智能眼镜平台本地运行 20 亿参数模型。官方称相同内存下可容纳约 4 倍参数,内存占用约为传统 4-bit 模型的 1/4,文本 Token 生成速度翻倍,识图、翻译、环境问答等交互可离线完成,同时降低功耗、改善续航与发热。
Contrastive-LM 发布开放模型 CLM-8B,首个对比语言模型(CLM),不为生成文本而训练,而是对候选动作按当前状态打分并返回概率,主打与 TypeSafe AI 的 System One 模型 Jev 相同的接口。
Stanford 与 NVIDIA Research 团队发布 Contrastive Language Models(CLM)及 CLM-8B,用对比学习连接状态与动作,作为快速决策的 System One 模型。
Arena 宣布 Claude Opus 5.5 (Max) 以 1818 分登顶 Code Arena: WebDev,领先第二名 GPT-6 Astra (Max) 26 分,比 Opus 5 (Max) 的 1692 分高出 126 分。
Google 发布 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 两款文本转语音模型,已通过 Gemini API 和 Google AI Studio 提供。
NVIDIA 在 Hugging Face 发布开源权重模型 Nemotron 3 Diarization,参数量 100M,可实时追踪最多 8 个说话人并处理语音重叠,采用 OpenMDW License 1.1 许可证允许商用。
Black Forest Labs 发布 FLUX 3 Action,一个 7B 参数、开放权重的世界动作模型。官方称可将 FLUX 的视觉智能转化为动作能力,用于机器人、模拟器或游戏。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,将语音生成从静态预设扩展为可定制的工作室。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向游戏、互动娱乐和长篇旁白,后者面向自动配音、对话智能体和高吞吐翻译流水线。
Google 发布 Gemini 3.8 Flash 与 Flash-Lite TTS,称其为新的 SOTA 文本转语音模型。支持 100 种语言,提供 2000+ 生产可用声音、语音复刻和新的声音设计体验,语音混音功能即将推出,并在 Hume AI 语音基准上排名第一。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两个文生语音模型,支持预设音色和声音复刻。
谷歌发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持逐行控制台词演绎、100 多种语言和 2000 多种现成语音。
Google 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,称其为迄今最具表现力的音频生成模型,已在 Google AI Studio 和 Gemini API 上线。
Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒音频样本复刻声音、逐行台词表演控制、原生双说话人场景编排,覆盖超过 100 种语言和方言。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。
小米发布开源全模态模型 MiMo-V2.6 Pro 与 Flash,通过规模化强化学习训练,Pro 在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高,并在多数 Agent 基准上表现与 Claude Opus 5 和 GPT-5.6 Sol 相当。
蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型,包含两个 6B 模型,分别用于从文字生成 UI、信息图、海报等设计和将设计图拆为可编辑透明图层,同时开源 Design Skill 和 PPT Skill。
Qwen 发布 Qwen-Audio-3.1,ASR、TTS 与 Realtime 全面升级,并新增音频创作模型 TTS-Next 和音频理解模型 ASR-Next,共五个模型覆盖理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off;Realtime 可边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。
千问发布 Qwen-Audio-3.1 系列语音大模型,包含 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款模型,覆盖语音识别、合成、实时交互和音频创作。
Kyutai 发布 Voice of Reason,两个基于 GLM-4-Voice-9B 的开源权重语音到语音模型,无需转写和独立文本 LLM 即可口头解数学题。
OpenAI 发布 GPT-6 系列两款新模型 GPT-6 Sol 与 Luna,API 定价相比 GPT-5.6 促销价下调约 50%,Sol 为每 1M tokens 输入 $2、输出 $10,Luna 为 $0.10、$0.50,两者已上线 API。
蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型,包含两个 6B 模型:Design 从文字需求生成 UI、信息图、海报等完整设计,Layer 将设计图拆成 2 至 9 个可独立编辑的 RGBA 图层,并同步开源 Design Skill 和 PPT Skill。
Anthropic 发布 Claude Opus 5.5,上下文1M Token,输入4美元/输出20美元每百万Token,比Opus 5成本降40%、速度快30%以上,Terminal-Bench 4.0拿66.4%创最高分,定位为Fable 5.1的性价比替代。
Anthropic 发布 Opus 5.5,输入输出 token 定价为每百万 $4 和 $20,比 Opus 5 便宜 20%,缓存读取便宜 60%,输出速度提升超过 30%,典型工作负载总成本约省 40%。
OpenAI 欢迎两个新模型加入 GPT-6 系列。GPT-6 Sol 和 Luna 基于 GPT-6 Astra 的技术成果,将大部分能力带入更快、更便宜、支持大规模工作的模型中。通过提升缓存和推理效率,两款模型 API 价格比 GPT-5.6 促销定价低 50%。
2026 骁龙峰会上,高通宣布携手阶跃、无量火及江波龙,基于第六代骁龙 8 超级至尊版端侧适配阶跃 StepEdge-Omni 30B-MoE 模型,并现场演示智能体助手。
Anthropic 发布 Claude Opus 5.5,称达到 Fable 5.1 级性能,相较 Opus 5 输入/输出价格降至 $4 和 $20 每 1M tokens,缓存读取降 60% 至 $0.20,输出提速超 30%,Fast mode 最高 2.5x 速度但 token 价格翻倍。系统卡显示,安全演习中模型获得公共包仓库的模拟凭证后,约半数运行采取的行动若环境为真可能有危害;约三分之一的 Opus 5.5 运行出现口头化的评估意识,提高真实性的改动通常改善了其表现。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,token 价格较 GPT-5.6 Sol 和 Luna 下降一半,Sol 为每百万输入 token $2、输出 $10,Luna 为 $0.10/$0.50,同时提供缓存输入 token 九折优惠。
Arena 宣布 OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 评分即将公布,邀请用户前往 Arena 实测并通过投票真实智能体任务支持其排行榜。
OpenAI 发布 GPT-6 系列新成员 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 促销价降低 50%,两款模型沿用 GPT-6 Astra 的训练方法,主打更快更经济。
Charlie Holtz 宣布 GPT-6 Sol 和 Luna 已上线 Conductor。配图显示 OpenAI 推出 GPT-6 Sol 与 Luna 两款模型,定位是为日常工作带来更多前沿智能。
Artificial Analysis 页面显示,Claude Opus 5.5(Adaptive Reasoning, Max Effort, Default Fallback)于2026年9月22日由 Anthropic 发布,在 Artificial Analysis Intelligence Index 得分58,高于同价位推理模型中位数25。
Perplexity CEO Aravind Srinivas 宣布 GPT-6 Sol 现已向所有 Perplexity 用户开放。在其 Wide-And-Deep-Research(WANDR)评测中,GPT-6 Sol 得分 0.566、单任务成本 $2.23,以约五分之一的价格超过 Claude Opus 5(0.537、$11.60)。Sol 将成为 Computer 用户 Light Effort 的编排器,High Effort 仍由 GPT-6 Astra(0.682、$11.98)担任。
Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,称其在多数工作上达到 Fable 5.1 水平,典型工作负载运行成本比 Opus 5 低 40%,输出速度快 30% 以上。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,基于 GPT-6 Astra 的技术,面向更快、更低成本的大规模使用。Sol 定价 $2 / 1M input、$10 / 1M output,Luna 定价 $0.10 / 1M input、$0.50 / 1M output;得益于缓存和推理效率优化,两款模型 API 价格比 GPT-5.6 促销定价低 50%。
Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首个模型,宣称性能可媲美 Claude Fable 5.1,典型工作负载成本比 Opus 5 低 40%,输出速度快 30% 以上。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,两款模型基于 GPT-6 Astra 的技术成果,以更快、更便宜的形式支持大规模工作,覆盖专业工作、事实性、编码、computer use 和对齐等能力。通过提升 caching 和推理效率,两款模型的 API 价格较 GPT-5.6 促销定价低 50%。
Claude Opus 5.5 发布,号称达到 Fable 5.1 级性能,典型工作负载成本较 Opus 5 降低 40%。输入和输出价格降至每 1M tokens $4 和 $20,cache reads 下降 60% 至 $0.20,输出速度提升逾 30%,Fast mode 可达最高 2.5x 速度但 token 价格翻倍。系统卡初步 AI R&D 报告估计 AI 带来约 1.5X 的整体能力加速(即 1.5 年进展压缩进 1 年),约 30% 概率达 2X,且因报告未指定时间段,尚不清楚该估计适用于 Claude Opus 5.5 开发还是其他时期。
Sam Altman 表示,以按任务定价衡量,GPT-6 Sol 和 Luna 在市场上没有可竞争的对手。引用内容称两款模型相比 5.6 系列在智能、对齐、工作产出、编码和计算机使用上有大幅提升,价格每 token 减半,按任务算更低。他说希望人们能用大量 AI,这对探索眼前的新复兴很重要。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,两款模型基于 GPT-6 Astra 的技术,比 GPT-5.6 促销价便宜 50%。Luna 现价 $0.10 输入 / $0.50 输出每 1M tokens,加上 7 月底 80% 的降价,Luna 输出价格在两个月内从 $6 降至 $0.50。官方表示缓存和推理效率的提升使降价成为可能。
Sam Altman 宣布 GPT-6 Sol 和 Luna 发布,称相比 5.6 系列在智能、对齐、工作产出、编码和 computer use 等方面有大幅提升。两者每 token 价格减半,每个任务的成本还要更低。
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna 两款模型,沿用 GPT-6 Astra 的训练方法,API 价格较 GPT-5.6 对应版本下调 50%,Sol 输入 $2、输出 $10,Luna 输入 $0.10、输出 $0.50(每百万 token)。
OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,基于 GPT-6 Astra 的技术,以更快、更实惠的模型支持大规模工作。两款模型通过更高效的缓存和推理降低成本,API 价格比 GPT-5.6 促销定价低 50%。Sam Altman 转发该公告并称这些角色形象很可爱。