Celeris-1 登顶输出速度榜,快 13-16 倍
Celeris-1 被 Artificial Analysis 评为输出速度第一,约 2,086 tokens/秒,MMLU-Pro 得分 75.9%,且无需定制推理芯片。
腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。
解决了 10 个数学和理论计算机科学中的长期未解难题,ChatGPT 下一代版本不会是直接到 GPT-6 吧🤔
已上线,可立即构建。感谢邀请!@OpenRouter。开源权重即将发布。⚡️
MiniMax 宣布开源 H3 模型,称从 Hailuo 01 到 H3 一路与伙伴同行,开源旨在让更多人共同构建、加速进步。引用推文补充,Hailuo 01 于 2024 年 8 月发布,Hailuo 02 于 2025 年 6 月发布,MiniMax H3 于 2026 年 7 月推出。
阿里巴巴的 Qwen3.8 Max 已在 OpenRouter 上线。 这款新旗舰模型拥有 2.4T 参数(95B 激活),专为长周期编码、研究和多模态智能体任务而构建。开放权重将于下周发布,这将是 Qwen Max 级模型首次开源。
微软正测试其首款原生实时语音模型 MAI Realtime,采用双向全双工交互,可同步聆听和回应,无需严格轮次交替。该模型支持中文等 16 种语言,测试提供 Victoria 和 Grant 两种语音风格,用户可指定语言或启用自动检测。目前已在 MAI Playground 平台邀请部分合作伙伴测试,上线 Microsoft Foundry 及 Copilot 语音功能的时间尚不清楚。
MiniMax H3在Video Arena和Artificial Analysis基准中成为SOTA开源视频生成模型,在文生视频和图生视频两项均排名第一。其得分较第二名开源模型hunyuan-video-1.5高出280分,图生视频得分1476,仅比Dreamina Seedance-2.0低2分。
OpenAI 下一代主要模型的内部版本以约 2,000 美元 token 成本(按 GPT-5.6 Sol API 费率计算),解决了数学和理论计算机科学领域 10 个长期开放问题,并附有完整的 Lean 形式化证明证书。主推文指出,这一成本低于派两人参会的费用,正因如此,开放问题的求解逻辑将被彻底改变。
Markopolo AI 发布 4B 参数大型事件模型 Athena(mvrko-sim-1),在 OPeRA 基准的购物行为预测任务中以 24.50% 严格精确匹配率超越 GPT-5.6、Claude Opus 4.8 等前沿模型。Athena 是 Qwen3-4B 的 LoRA 微调模型,可自托管,能预测购物者下一步浏览器动作及目标元素,为下游系统提供实时响应机会。
我们下一代主要模型的内部版本,在数学和理论计算机科学中长期未解的开放问题上取得了 10 项新成果,按 GPT-5.6 Sol API 费率计算,所用 token 成本约为 2,000 美元。
阿里Qwen3.8-Max据称自主运行16天,产出265个提交、127个PR和151个issue,输出成本较GPT-5.6 Sol低80%、较Claude Fable 5低88%。该2.4T参数MoE模型输入/输出价格分别为$2/$6每百万token,PaperBench评分领先上述两者,开源权重下周发布。
ComfyUI 宣布对 MiniMax H3 提供 Day-0 支持,该模型采用开放权重,支持原生音频生成与 2K 视频输出。用户现可在 ComfyUI 中直接使用 MiniMax H3 的完整能力,包括文本、图像、音频与视频的多模态生成。此次集成使开源社区能够第一时间在 ComfyUI 工作流中调用 MiniMax H3。
商汤推出 SenseNova U1.5-Lite-Preview,一个基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。
MiniMax 发布 33B 视频模型 H3,可生成同步立体声音频,支持文本、图像、视频和音频多模态生成与编辑,片段最长 15 秒。ComfyUI 优化栈约 40GB,通过动态 RAM/SSD 卸载适配消费级显卡,RTX 5090 上生成 5 秒 768p 视频约需 5.5 分钟。
阿里巴巴发布了Qwen3.8-Max,这是一个拥有2.4T参数的新模型,能够运行10天以上的自主编码任务! 开放权重预计将于下周与Qwen3.8-27B版本一同发布。
Live in Command Code!🎉 Qwen 3.8 Max 现已上线 Command Code Go。 ……而且它将开放权重!! 最重要的是,下周 Qwen3.8-Max 和 Qwen3.8-27B 的开放权重版本将发布! 🔹 2.4T 参数 MoE 旗舰模型 🔹 输入:$2 输出:$6 🔹 缓存:$0.25 / M tokens 3.8 比 3.7 便宜 20%
阿里发布 Qwen3.8-Max,主打 Autonomous Coding 和 Cowork,官方展示案例中模型从空文件夹起连续16天自主完成写码、commit、提PR、修bug,全程无人干预,最终做出自进化 Agent 系统 oh-my-cli。该模型支持 1M 上下文、2.4T MoE 参数,并具备多模态规划执行自查能力;正式版一周后开源,届时连 27B 版本一并放出。
阿里将于下周发布开源权重模型 Qwen3.8-27b。此前发布的 Qwen3.8-Max(2.4T 参数 MoE)以 $2/$6 每百万 token 的输入/输出价格,较 GPT-5.6 Sol($5/$30)和 Claude Fable 5($10/$50)成本大幅降低,并自主运行 16 天完成 265 次提交、127 个 PR 和 151 个 issue。
火山引擎升级 Doubao-Seed-Evolving,聚焦 Coding 与 Agent 能力,提升复杂仓库修复、跨文件修改等工程任务稳定性,增强信息检索、缺失召回与多工具并行调用能力,并改善幻觉控制以减少基于错误检索结果的作答。该模型已上线火山 Agent Plan,单月套餐限时 9.9 元起,参与「体验奖励计划」调用成本立减 20%。
阿里发布2.4T参数MoE模型Qwen3.8-Max,输入$2/M tokens、输出$6/M tokens,输出成本较GPT-5.6 Sol低80%、较Claude Fable 5低88%。该模型自主运行16天,产出265个commits、127个PRs和151个issues,PaperBench评分领先上述两款模型。开放权重将于下周发布。
商汤科技今日开源轻量级统一多模态模型预览版 SenseNova U1.5-Lite-Preview。该模型以仅 8B-MoT 的规模,在多项主流生成/编辑质量评测基准上显著超越 U1,实现可比肩商用闭源模型的图像生成与编辑效果。相比 U1,新版本原生支持 4K 图像生成,并提升局部纹理细节、中英文文字生成与复杂版式组织,以及图像编辑和视觉指令遵循能力。
Cogent AI 发布 VR-1,一款专为网络安全后训练而非通用编码能力附带产出的推理模型,并同步推出评测基准 IntrusionBench 与安全智能体运行时 Cogent AI Harness。
字节跳动推出视频模型 Dreamina Seedance 2.5,单片段最多支持 50 个参考文件,可一次生成 30 秒连续视频,前 7 天仅在 Dreamina 平台运行。该模型支持同时输入 30 张图像、10 段视频和 10 段音频,并允许在提示词中使用时间戳(如 【0s-5s】)作为分镜脚本。
通义千问发布 Qwen3.8-Max,定位为编程与协同办公场景的新标杆。该模型在相关任务上设定了新的性能基准,具体参数规模、benchmark 分数及可用性(开源或 API)细节尚未在原文中披露。
阿里发布旗舰模型 Qwen3.8-Max,2.4T 参数,主打自主编码与多模态智能,下周开源其权重并同步开源 Qwen3.8-27B。定价为输入 $2.0/M tokens、输出 $6.0/M tokens、隐式缓存 $0.25/M tokens。
MiniMax H3 权重正式开源,并在发布当天(Day 0)原生集成到 ComfyUI,支持文本生视频、图像生视频、首尾帧控制、参考视频及就地编辑五种工作流。H3 以多模态上下文理解为核心,可同时处理图像、音频和视频,并依据提示词解析其关联。
权重已开源,@fal 已准备好供开发者使用,Day 0 🙌 这不仅仅是获取 H3 的权限。开发者可以研究它、定制它、部署它,并借助背后的生产级基础设施将其推向更远。 #MiniMaxH3 #OpenWeights
认识 Qwen3.8-Max。你的全天候工作伙伴,适用于 • 编程 • 推理 • 研究 • 写作 • AI 智能体 你过你的生活。它做它的工作。在以下平台试用及调用 API:• Model Studio:https://click.alibabacloud.com/m/20000001093/ • Qwen Cloud:https://click.qwencloud.com/m/20000001102/ #BuildWithQwen #AlibabaCloud #QwenCloud #ModelStudio
MiniMax 今日正式开源新一代通用视频模型 MiniMax H3,可统一理解文本、图像、视频和音频构成的多模态上下文,生成最高 2K 分辨率、最长 15 秒且带原生立体声音频的视频。
MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32 kHz 原生立体声音频的视频。
MiniMax-H3 现已公开发布 https://huggingface.co/MiniMaxAI/MiniMax-H3
阿里通义千问宣布 Qwen3.8-Max 将于下周开源权重,这是 Qwen 首次开源 Max 级模型,同时 Qwen3.8-27B 也将开源。该模型为 2.4T 参数,是继 Kimi K3 后第二个超 2T 参数的开源权重模型,定价输入 $2.0/M tokens、输出 $6.0/M tokens。
阿里巴巴千问 Qwen3.8-Max 今日上线,总参数量 2.4 万亿,在编程、办公、长程任务与多模态智能体等方面全面提升。API 已上线千问 AI 平台并接入"千问办公"Agent 产品,模型权重将于下周开源。国内 API 每百万 Tokens 输入 12 元、输出 36 元。
通义千问发布最强模型 Qwen3.8-Max,参数规模达 2.4T,主打自主编程与多模态能力,可完成 10 天以上自进化开发及 500+ 轮芯片设计优化。模型将于下周开源权重,同步开源的还有 Qwen3.8-27B。API 定价为输入 $2.0/M tokens、输出 $6.0/M tokens。
Qwen 正式发布 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,拥有 2.4T 参数(95B 激活),并首次开源 Qwen-Max 级权重,开放权重将于下周发布。
Onton 发布神经符号搜索模型 Ontology 1,在 90 条查询基准 Subtext-Decor-90 上平均 precision@10 达 0.630,超过 Google Shopping(0.543)和 Amazon(0.469),且索引量仅为后两者目录的约 1%。
UEmbed 是一种仅解码器的多模态嵌入模型,可在单次因果前向传播中同时生成稀疏词级和稠密表示,通过可学习特殊 token 与词汇表分区突破单 token 信息瓶颈。
Thinking Machines Lab 发布开源权重 MoE 模型 Inkling-Small,总参数 276B、激活参数 12B,约为 975B 总参数 Inkling 的四分之一,原生支持文本、图像和音频推理,上下文窗口达 1M tokens,权重以 Apache 2.0 协议在 Hugging Face 上提供。
独家爆料 🔥:微软即将推出的双向语音模型"MAI-Realtime"早期预览! 该模型比 MAI Voice 2 自然得多,可操作网络搜索及许多其他工具。 了解更多 🗞️ https://www.testingcatalog.com/exclusive-microsoft-tests-new-mai-realtime-voice-model/
MiniMax 宣布其视频生成模型 H3 即将开源(open weights)。有用户反馈,H3 生成视频的质量和数量均优于 2.5 版本,且成本更低、推理速度更快、自定义音频上传功能正常。该用户认为,在创意工具领域,成本与速度最终将决定胜负,规模化后有望实现无限生成。
两个数量级的改进相当罕见。这是件大事。
DeepSeek V4-Flash 不仅单 token 价格更低,据 @ArtificialAnlys 报告,完成相同 benchmark 任务的总成本比 Fable 5 低 105 倍。尽管单 token 价格优势可能因任务轮次增加而失真,但总成本优势显著,作者称这是 DeepSeek 2.0 时刻,将引发巨大轰动。
OpenAI 下一代模型 Astra 证明了 10 项数学新成果,包括非 sofic 群的存在性及对 Connes 刚性猜想的反驳。每个证明均附带 Lean 证书和 CoT 推理过程。主推文强调人类提问与审视、AI 大规模探索的协作模式,或将成为各专业领域的未来。
重磅消息:GPT-6 刚刚找到了 10 个 Costco Guys 难题的解决方案,其中 #24(自 2011 年起悬而未决)也在其中。另有 4 个难题取得重大进展。 DJ Khaled 今早对这一结果表示认可:"为这个感到骄傲。#24 对我个人意义重大。"
AMD 发布 Instella-MoE-16B-A3B,一个完全开源的混合专家(MoE)大语言模型,总参数 16B,每个 token 仅激活 2.8B 参数,在 Instinct MI300X 和 MI325X GPU 上从头训练。
"数学史上最重大的一天。" 数学家们正经历存在主义危机。 ……媒体零报道。
DeepSeek-V4-Flash-High 模型在前端方面表现出色得离谱。 我跑了一些测试,不得不反复确认自己没选错模型。 这个价格能有这表现,太强了。哇!
OpenAI 下一代模型 Astra 证明了非 sofic 群存在等多项新数学结果,并发布 10 项完整证明,每项均附带 Lean 证书和 CoT 逐步推演。成果涵盖 von Neumann 代数(推翻 Connes 刚性猜想)、高维球堆积、电路复杂度和多色图单色三角形等方向。
一个未发布的 OpenAI 模型解决了数学、量子复杂性和理论计算机科学领域的***10 个重大开放问题*** 如果你仍然认为时间线很长,抱歉,那只是自我安慰
大语言模型是推动人类进步的美妙引擎。我们只需主动管理向强大AI的转型,其益处将是巨大的。
看起来 Cerebras 上的 5.6 sol 已经推出了,但只面向特定客户。 我不是其中之一 :(
OpenAI 下一代模型 Astra 证明了 10 项重大数学成果,包括推翻 Connes 刚性猜想、改进高维球堆积与电路复杂度下界等。每项证明均附带 Lean 证书与 CoT 推理过程,相关细节已发布于官方博客。
字节跳动推出 AI 视频模型 Seedance 2.5,可一次性生成视频与音频,片段最长 30 秒且支持多次扩展,而 Google Gemini Omni Flash 上限约 10 秒。
OpenAI 正式确认其"下一代主要模型家族"Astra,称内部版本已解决数学与理论计算机科学领域的十道开放难题,其中一道证明建立了非 sofic 群的存在性,相关领域数学家至少十年未获进展。
OpenAI 预告新模型家族"Astra",专为多智能体协作的长期任务设计。据称,该模型以 Sol API 价格约 $2000 的成本解决了 10 个重大数学问题。据 The Information,OpenAI 尚未决定其将以 GPT-6 还是 GPT-5.7 发布,目前正处测试阶段。