百度发布 MeDo 3.5 直播进行中
MeDo 3.5 现已上线!立即观看 🚀 https://x.com/i/broadcasts/1NxaroaborEKj
DeepSeek 最新 Pro 模型 V4 Pro 0813 已上线,仅通过 API 提供,目前可在 OpenRouter 上访问。该模型在低、中、高三种推理强度下生成了差异明显的鹈鹕图像,作者称在其他模型中未见此类现象。官方尚未确认是否开源权重,但鉴于 4 月和 7 月版本均已发布权重,开源可能性较大。
腾讯微信团队公布自研大语言模型 WeLM,主打资源利用效率。其中 WeLM-80B 拥有 800 亿总参数、30 亿激活参数,已部署于微信原生 AI 助手"小微",支持聊天搜索、调用微信原生功能及小程序服务。WeLM-617B 为混合专家模型(MoE),总参数 6170 亿、激活参数 230 亿,正在开发中,面向智能小程序开发等复杂任务。
祝贺 @deepseek_ai 发布 DeepSeekv4 Pro 0813 1.5T🔥 它在智能体任务上大幅超越 Nemotron3 Ultra。 此外,DeepSeekv4 Flash 0731 同样大幅超越 Nemotron3 Ultra,而活跃参数少 4.2 倍,总参数也少近 2 倍! Nemotron 团队有很多优秀的人才,但根本上,委员会式的模型前沿开发是行不通的。👇️ 1/3🧵
Soniox 发布 TTS v2,单一模型支持 60+ 种语言,生成音频每小时仅 $0.70,并内置情感标签、克隆与毫秒级时间戳。该模型专为实时语音智能体设计,支持打断恢复与跨语言身份保持,已在美欧日上线,兼容 v1。
Grok 4.6 在 Fable 5 的 Intelligence Index 上取得 98.4% 的分数,输入 token 价格便宜 5 倍、输出 token 便宜 8 倍。
Grok 4.6 今日上线,价格与 4.5 完全一致($2/M input、$6/M output),约为其他前沿模型一半,但智能大幅跃升。AA智能指数达61,与GPT-5.6 Sol Max持平,仅比Fable 5低1分;GDPVal、AA-Briefcase均拿第一,法律基准15.8%断层领先。
Grok 4.6 在 ARI Bench 上夺得第一--该基准用于评测 AI 的递归式自我改进能力。🥇 它显著超越 Grok 4.5,同时排名也领先于 Claude Opus 5 和 GPT-5.6。
Grok 4.6 发布,主打专业智能体任务,在 GDPVal-AA v2 和 AA-Briefcase 上分别取得 1753 和 1577 分,均领先 GPT-5.6 Sol Max 与 Fable 5 Max。
试试用 Grok 4.6 应对棘手的现实世界任务吧! 【引用 @EMostaque】:在我看来,GDPVal 可能是最重要的基准测试,它衡量模型在现实世界任务上的表现。 性能大幅跃升,以极佳的价格登顶该基准,祝贺 @SpaceXAI 团队,期待接下来更重磅的发布!
DeepSeek V4 Pro 0813 是 DeepSeek 推出的大规模混合专家模型,为该系列的 GA 正式版本。模型输入价格 $0.435/1M tokens,输出价格 $0.87/1M tokens,上下文窗口达 1M,于 2026 年 8 月 12 日发布。该模型目前由一家提供商托管,OpenRouter 将请求直接转发至该提供商。
韩国AI实验室Upstage发布旗舰推理模型Solar Pro 4,Artificial Analysis智能指数达42分,较Solar Pro 3的14分大幅提升27分,与Inkling(xhigh,42分)持平。
你现在可以在 Grok Build 中使用 Grok 4.6。 下载 Grok Build:http://x.ai/build
DeepSeek V4 Pro 0813 已在 OpenRouter 上线。 @deepseek_ai 报告称,相比 V4 Pro Preview,智能体能力大幅提升:DeepSWE 62.7(+49.9),CyberGym 83.3(+30.6),NL2Repo 61.5(+23.0),Terminal Bench 2.1 87.9(+15.8) 更多服务商即将接入 立即使用:https://openrouter.ai/deepseek/deepseek-v4-pro-0813
非常重要的AI工作 【引用 @GoogleDeepMind】:SL2T是我们突破性的手语转文本模型,为@Android上失聪和听障用户提供全新功能。 从Pixel 11上的美国手语转英语开始,用户可以直接在Gboard和Live Transcribe中用手语输入,而无需打字。
xAI 发布 Grok 4.6 模型。该版本在 Hacker News 上获得 117 个 HN Points,引发社区关注。目前官方尚未公布具体参数规模与性能基准数据。
一天之内三款前沿模型! - Grok 4.6:达到 Fable 5 水平,但价格便宜 85%。 - Qwen3.8-Max:2.4T 参数,95B 激活参数。权重已开源。 - DeepSeek-V4-Pro-0813:权重随时可能发布。听说表现不错,不只是刷榜。 竞争对消费者和企业都是好事。
DeepSeek 4 Pro GA 评测已流出,性能扎实,与开源 SOTA(Kimi k3、GLM-5.2)持平,接近 5.6 Sol 和 Fable 5。其定价极具竞争力:$0.435/M 输入、$0.87/M 输出,支持 1M-token 上下文窗口。
在测了😂被迫加班… 都躺床上了…. #deepseekv4pro0813 #DeepSeekV4Pro正式版
开源模型 Qwen3.8-2.4T-A95B 发布,总参数量 2.4T,激活参数 95B。该模型已在 Hugging Face 上线,并登上 Hacker News 热榜。
Grok 4.6 今日上线 Cursor、grok Build 和 OpenRouter,首周双倍额度。价格与 4.5 持平($2/M input、$6/M output),约为其他前沿模型一半,AA 智能指数 61 追平 GPT-5.6 Sol Max,法律基准 15.8% 断层领先。长运行 Agent 能力全面升级,跨代码库分析与自我验证显著增强。
North Micro Vision 是我们全新的快速、智能且采用 Apache 2 许可的视觉模型,专为企业文档理解打造!
Grok 4.6 正式发布,价格与 4.5 完全一致($2/M input、$6/M output),智能大幅跃升,AA智能指数61,与 GPT-5.6 Sol Max 持平,仅比 Fable 5 低1分。模型已在 Cursor、grok Build、OpenRouter 全平台上线,首周双倍额度,并针对长运行 Agent 升级了跨代码库分析与自我验证能力。
阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至 1,010,000 Token。
今天,我们为模型家族再添新成员。欢迎 North Micro Vision。 这是我们迄今最小的视觉语言模型,非常适合复杂的文档理解。以 Apache 2.0 许可证开源发布。可在 @huggingface 上获取权重。
DeepSeek V4 Pro 正式版(DeepSeek-V4-Pro-0813)今日晚间发布并更新至 API,调用模型名不变。新版本增强 Agent 能力,支持 Responses API 和 Codex 接入,多项测试性能接近 Fable 5,较预览版大幅提升。定价为百万 tokens 输入(缓存命中)0.025 元、输入(缓存未命中)3 元、输出 6 元。
我们的首个推理模型 MAI-Thinking-1 从零开始构建,现已在 Microsoft Foundry 上线。为团队点赞!更多详情如下。
SpaceXAI 发布 Grok 4.6,强化长时间运行的智能体任务及复杂交互和视觉工作。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上,Grok 4.6 与 GPT-5.6 Sol 取得相同成绩。
Grok 4.6 来自 @SpaceXAI,现已在 OpenRouter 上线! 最新的 Grok 模型相比 Grok 4.5 有显著提升,并在 GPDVal-AA V2 上超越其他前沿模型,同时保持 $2 输入 / $6 输出的低价。 立即使用:https://openrouter.ai/x-ai/grok-4.6
BREAKING 🔥: SPACEXAI 发布 GROK 4.6,多项基准测试已与 FABLE 5 和 GPT 5.6 SOL 持平! > 同时以 1553 分位列 Frontend Arena 第 13 名。 > Grok 4.6 即日起在 Cursor 和 Grok Build 中可用,首周包含 2 倍用量。 开测!👀
你知道吗?Grok 4.6 不仅比 Opus 5 和 5.6 Sol 便宜,甚至比 Sonnet 5 还便宜。与此同时,它至少与最先进的模型持平。 *那*才是真正的护城河。
最新消息:DeepSeek V4 Pro 刚刚发布。快速一览与 V4 预览版对比的最新基准测试结果。
imo GDPVal 可能是最重要的基准,它衡量模型在真实世界任务上的表现。 性能上的一大飞跃,以极佳的价格登顶,祝贺 @SpaceXAI 团队,期待接下来更大的发布! https://openai.com/index/gdpval/
最新消息:DeepSeek V4 Pro 刚刚发布。快速浏览一下与 V4 预览版对比的最新基准测试结果。
Qwen3.8-Max 权重刚刚在 Hugging Face 上线! 总参数 2.4T,激活参数 95B。 开源 AI 的好日子。
Grok 4.6 已上线!一篇关于我使用该模型的学习心得、发现和技巧的文章!http://x.com/i/article/2087564694706106372
Grok 4.6 是一次重大升级 🚀 它在所列出的每一项基准测试中都超越了 Grok 4.5 High,目前排名如下: 🥇 #1 GDPVal-AA v2 - 1,753 🥇 #1 AA-Briefcase - 1,577 🥇 #1 Harvey LAB - 15.8% 🥈 #2 CursorBench - 69.9% 🥈 #2 FrontierCode - 61.3% 🥈 #2 APEX-Agents - 57.5% 🥈 #2 APEX-SWE - 56.4% 它在 Artificial Analysis Intelligence Index 上以 61 分的成绩与 GPT-5.6 Sol Max 持平。 Grok 4.6 即日起在 Cursor 和 Grok Build 中可用,首周使用量翻倍。
DeepSeek 官网 API 文档"模型 & 价格"页面新增 DeepSeek-V4-Pro-0813 模型,支持非思考与思考模式。截至发稿,官方尚未发布该模型的更新日志。此前 7 月 31 日 DeepSeek-V4-Flash 正式版 API 上线公测,官方曾称 V4-Pro 正式版将尽快发布。
很高兴发布 Grok 4.6。每一次发布,Grok 都在成为更有能力的数字同事。 4.6 在困难任务和知识工作方面显著更出色。它结合了 Opus 级别的智能与精细度,同时成本极低、速度很快。
Grok 4.6 在智能和持久性上实现了飞跃。从完成调试任务到从零构建应用,Grok 4.6 是一个快速、可靠且聪明的伙伴。 立即在 Grok Build、Cursor、Grok Bot 和 SpaceXAI API 中体验!
推出 Grok 4.6。 它具备前沿智能,且相较 Grok 4.5 在同等价格下实现了显著改进。
走起! https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
DeepSeek v4 Pro GA 正在推出!Grok 4.6 API 也被发现了! 非常兴奋!在最近 DeepSeek v4 Flash 的疯狂更新之后,我预计这个版本也会有一系列更新! 看来是个发布大日子!
SL2T 是我们突破性的手语转文本模型,为 @Android 上失聪和听障用户的新功能提供支持。 从 Pixel 11 上的美国手语转英语开始,人们可以直接在 Gboard 和 Live Transcribe 中打手语,而无需打字。
Google DeepMind 发布手语转文本(SL2T)模型,为聋哑及听障用户提供新的手语功能。该模型是此次发布的突破性技术核心,旨在将手语实时转化为文本,帮助用户更顺畅地沟通。目前尚未公布具体参数规模、基准测试分数或可用性细节。
Nvidia 正在开发开源权重模型 Nemotron 4,其最大版本参数至少达一万亿,为 Nemotron 3 Ultra 的两倍,最早可能于今年秋季发布。为此,Nvidia 已将内部模型训练的云支出增至 280 亿美元,持续至 2031 年。
微软发布面向 GitHub Copilot 的代码模型 MAI Code 1.1 Flash,称其代码质量更优、token 效率提升 25%、成本仅为 6 月前代的四分之一。
NVIDIA 推出 Nemotron 3.5 Lightning,一款 30B 参数、3B 活跃参数的混合 Mamba-2 + MoE + Attention 架构开源模型,上下文窗口达 1M token,采用 OpenMDW-1.1 许可,允许商用。
LTX 推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频仅需 6.8 秒。LTX-2.5 Fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用。
微软发布升级版编程模型 MAI-Code-1.1-Flash,在 Terminal-Bench 2.1 测试中表现提升 22%,.NET 相关任务提升 15%,Token 生成速度提升 25%,完成相同任务所需 Token 减少 25%。
用 Qwen-Image-3.0 发挥创意 🔗 阿里云百炼:https://click.alibabacloud.com/m/20000001218/ 🔗 Qwen Cloud:https://click.qwencloud.com/m/20000001155/
蚂蚁集团发布开源推理模型 Ling 3.0 Tiny,在 Artificial Analysis 智能指数上得 25 分,以 7.9B 总参数和 1.3B 激活参数(MoE)扩展了智能与激活参数的帕累托前沿,性能接近 gpt-oss-120b(24 分)但参数少 15 倍。
英伟达推出 300 亿参数的 MoE 开源模型 Nemotron 3.5 Lightning,专为大型多智能体系统中的特定任务打造。与同类模型相比,其输出速度提升最高达 4 倍,可将智能体任务整体完成速度加快 30%。该模型可直接运行于 NVIDIA RTX PC、DGX Spark 等本地设备,也可扩展至边缘 AI 与数据中心环境。
腾讯混元发布 WorldClaw,实现大规模智能体驱动的3D开放世界生成。该系统可自动生成包含复杂地形、建筑与交互元素的连贯开放世界场景,相关项目页面已上线。
Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行智能体与交互式视觉任务,在多项智能体编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol。
xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。