AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章916
当前页1 / 23
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新普通
腾讯发布 Hy4 Preview:770B 参数开源权重文本模型,上下文窗口达 1M token
腾讯今日发布 Hy4 Preview,这是一款新的开源权重纯文本输入(无视觉)大语言模型,总参数 770B,激活参数 49B,上下文窗口 1M token,Hugging Face 上体积 1.56TB。相比 7 月的 Hy3(295B 总参数、21B 激活、256k 上下文、598GB),规模大幅提升。Hy4 的推理配置仅支持 "high"(默认)和 "no_think" 两档。
信息来源:Simon Willison 博客 · Hugging Face
模型发布 / 更新普通
腾讯发布并开源 Tencent Hy4 Preview
腾讯发布并开源下一代大语言模型 Tencent Hy4 Preview,总参数 770B、激活参数 49B,上下文窗口超 1M tokens,定位编程、办公与科研等真实生产力任务。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新普通
腾讯混元开源 Hy4 preview:1M 上下文 MoE
腾讯混元开源 Hy4 preview,旗舰 MoE 模型,支持 1M 上下文,采用 Apache 2.0 协议。模型总参数量 770B,每 token 激活 49B,原生集成 MTP 层支持投机解码。163 位内部专家在 203 项真实工程任务中的盲测中,Hy4 preview 平均分 2.99,优于 GLM 5.3(2.92)和 Kimi K3(2.94)。
信息来源:X:腾讯混元 (@TencentHunyuan) · GLM / Kimi
模型发布 / 更新普通
Hy4-preview 在 vLLM 中运行
腾讯混元 Hy4-preview 从发布首日起即支持在 vLLM 中运行,并已在 NVIDIA GPU 上完成验证。该模型总参数量 770B,激活参数 49B,采用 256 个路由专家加 1 个共享专家,支持 1M 上下文但每次查询仅关注 2048 个 token。
信息来源:X:腾讯混元 (@TencentHunyuan) · NVIDIA
模型发布 / 更新普通
OpenAI Astra 代号 ultima-alpha 测试中,或下周扩大上线
OpenAI 正以代号"ultima-alpha"向部分合作伙伴测试 Astra,若本周末反馈积极,下周将扩大早期访问,目标在下周四(3日)至随后一周内广泛上线。更新版 GPT-Image 2 也在推进,发布时间窗口相近,可能同步推出。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT
模型发布 / 更新普通
OpenAI 未发布模型 Astra 首批输出曝光
OpenAI 未发布模型 Astra(内部代号"mozaik-alpha-fdm")的首批公开输出已流出,测试显示其零样本、Max effort 下表现惊艳。OpenAI 已扩大该模型的内部测试,暗示发布可能临近。
信息来源:X:Testing Catalog (@testingcatalog) · OpenAI
模型发布 / 更新普通
GPT-Astra"mozaik-alpha-fdm"前端初体验
对疑似 GPT-Astra"mozaik-alpha-fdm"的第一印象。前端看起来相当惊艳。感谢 @Lentils80
信息来源:X:Kim (@kimmonismus) · GPT
模型发布 / 更新普通
行业首个量子增强型大模型"玄幂 Xenomi"发布:深度融合 AI 与量子计算
国光量超人工智能研究团队推出行业首个量子增强型大模型玄幂(Xenomi)家族,将量子技术引入大语言模型的决策与推理过程。该模型面向科研和学术领域,在科研科普、路由和智能体决策等任务中较主流开源模型展现出更稳定的专业理解、更清晰的判断和更短的决策路径。玄幂已应用于国光量超的量子计算智能实验平台和夸米多智能体系统。
信息来源:IT之家(RSS)
模型发布 / 更新普通
腾讯混元 Hy4-preview 压缩至 200GiB 精度几乎无损
腾讯混元将 Hy4-preview(770B 参数、49B 激活、1M 上下文)从 1.5TB 压缩至约 200GiB GGUF 格式,通过 MIX-STQ1_0 混合量化按层分配位宽(最低 1.31-bit STQ1_0,最高 2.06-bit IQ2_XXS)。
信息来源:X:腾讯混元 (@TencentHunyuan)
模型发布 / 更新精选
智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御
智谱宣布开源 GLM-5.3 模型权重,支持本地运行与个性化定制,擅长复杂编码、防御性网络安全及长程任务。该模型在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。仅年营业额超 100 亿美元的机构将其作为外部模型服务提供时才需安全审查。
信息来源:IT之家(RSS) · GPT / Claude / GLM
模型发布 / 更新普通
腾讯混元Hy4预览版登陆Cline
在 Cline 中试用 Hy4 preview 【引用 @cline】:腾讯 Hy4 Preview 在 SWE-bench Pro 上领先。770B 参数,49B 激活,1M 上下文,以及迄今测得的其最大代际跃升。 很高兴看到又一个开放权重模型与前沿模型竞争。 在 Cline 中试用:1. npm i -g cline 2. /model 3. 选择 Hy4 preview
信息来源:X:腾讯混元 (@TencentHunyuan)
模型发布 / 更新普通
FastVideo 开源 FastH3 实现 14 倍加速
Sky Computing Lab 开源 FastVideo FastH3 预览版,生成 15 秒视频仅需 13 秒,实现 14 倍加速。盲测中 45% 用户偏好 FastH3 或认为其与 MiniMax H3 持平。该预览版仅用部分数据和算力训练,权重已发布于 HuggingFace。
信息来源:X:Sky Computing Lab (@haoailab) · Hugging Face
模型发布 / 更新普通
腾讯混元 Hy4 预览版上线 OpenCode Go
Hy 4 预览版,现已在 OpenCode Go 中可用 👏 770B/49B · 1M 上下文窗口 · 专为编程智能体打造
信息来源:X:腾讯混元 (@TencentHunyuan)
模型发布 / 更新普通
FastVideo 开源 FastH3 预览版,15 秒生成仅需 13 秒
FastVideo 开源预览版 FastH3,15 秒视频生成仅需 13 秒,实现 14 倍加速,45% 用户偏好或认为其与 MiniMax H3 持平。该模型为预览检查点,仅用部分算力和数据训练。引用推文提醒,速度提升需配合质量评估,避免沦为"随机像素生成器"。
信息来源:X:Sky Computing Lab (@haoailab)
模型发布 / 更新普通
Midjourney 更新 V8.2 编辑模型以提升图像质量
Midjourney 更新了 V8.2 编辑模型,以提升图像质量。过去 24 小时内遇到问题的用户可重新尝试,官方欢迎继续反馈,并预告更多更新即将到来。
信息来源:Midjourney:Updates(RSS)
模型发布 / 更新普通
Midjourney 更新 V8.2 编辑模型提升画质
我们已更新 V8.2 编辑模型,以提升图像质量。如果你在过去 24 小时内遇到任何问题,请再试一次,并继续向我们反馈。谢谢!更多更新即将推出。
信息来源:X:Midjourney (@midjourney)
模型发布 / 更新普通
Gemini 3.8 即将发布,谷歌全力加速竞争
事情现在开始加速了:Gemini 3.8 可能即将发布。尽管 Gemini 3.7 才推出几周。 据 Business Insider 报道:"部分员工已开始使用 Gemini 3.8 Flash 的预览版,这凸显了 AI 竞赛的飞速节奏--谷歌每隔几周就推出新模型,以跟上 OpenAI 和 Anthropic 的步伐。" 据报道,Gemini 3.8 明显优于 3.7,看来谷歌正在全力加速,再次迎战竞争对手。
信息来源:X:Kim (@kimmonismus) · OpenAI / Claude / Gemini
模型发布 / 更新普通
Grok 4.6 全面上线,4.7 将至?
Grok 4.6 现已在 Grok 网页版和移动端开放普通对话使用。 > 此前,Grok 4.6 仅作为 Grok Build 的一部分提供。 > 顺带一提,Grok 网页界面也略有更新。 Grok 4.7 即将到来?👀
信息来源:X:Testing Catalog (@testingcatalog) · Grok
模型发布 / 更新普通
Fable 5.1与Opus 5.1发布推迟至下周
原本的预期是 Fable 5.1 和 Opus 5.1 昨天发布。似乎已推迟到下周。不过,看起来有些人已经能访问新模型了。
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新普通
Grok 4.6 全模式上线
Grok 4.6 现已在 Grok 应用及网页端的所有模式中可用。 Fast - 快速响应 Expert - 深度思考 Heavy - 专家团队协作 Build - 创建应用和网站 Auto - 自动为你选择 Fast 或 Expert
信息来源:X:cb_doge (@cb_doge) · Grok
模型发布 / 更新普通
GLM-5.3-Flash 与 Qwen3.8-Flash-Next 对比:两家中国 AI 实验室独立收敛于同一模型架构
Z.ai 与 Qwen 各自独立推出了近乎相同的架构:3:1 线性混合、压缩索引器、门控残差与 Muon 训练。两家中国 AI 实验室在未互通的情况下,于模型设计上实现了趋同。
信息来源:MarkTechPost(RSS) · Qwen / GLM
模型发布 / 更新普通
GLM-5.3 开源,Ethan Mollick 呼吁发布模型卡
GLM-5.3 已开源权重,可下载、运行和定制,是智谱(Z.ai)最强的智能体编程与网络防御模型。Ethan Mollick 认为,随着开源模型性能提升,发布模型卡和进行红队测试愈发重要,因为任何开源模型都可能被突破护栏,需明确风险。
信息来源:X:Ethan Mollick (@emollick) · GLM
模型发布 / 更新普通
MiniMax FastH3 v1 开源:13秒生成15秒768p视频
MiniMax 联合 NVIDIA、FastGen 发布开源模型 FastH3 v1,可在 13 秒内生成 15 秒 768p 视频,在 NVIDIA Blackwell GPU 上实现最高 14 倍加速。模型权重与加速方案完全开源,社区可自行运行和改进。团队表示,开源视频模型时代已开启,后续将分享更多关于后训练如何提升速度与质量的经验。
信息来源:X:Sky Computing Lab (@haoailab) · NVIDIA
模型发布 / 更新普通
Meta 模型 API 上线 Muse 图像生成
1/ Muse 图像已在 Meta 模型 API 上线 $0.01/张--生产级用量中性价比最高的选择之一
信息来源:X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang)
模型发布 / 更新普通
GLM-5.3 成本仅为 FABLE 5 八分之一
💸$15.51 对比 $120.93。同一提示词。同一 3D 游戏挑战。无手动代码修改。GLM-5.3 以接近 FABLE 5 八分之一的成本完成了构建!观看并排对比--然后自行判断。👇 GLM-5.3 现已上线 SiliconFlow。
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · GLM
模型发布 / 更新普通
智谱开源GLM-5.3,后训练挖出2436个真实漏洞
智谱开源GLM-5.3,零预训练改动、纯靠后训练将漏洞挖掘能力做到全球开源第一,横扫269个开源项目挖出2436个真实漏洞,其中中高危超1000个,最老的漏洞在DNS协议中潜伏超40年。同一底座Terminal-Bench从4.6飙至28.3登顶开源,漏洞挖掘能力正面咬住顶级闭源模型。智谱联合清华、绿盟、奇安信、腾讯玄武等团队,并启动开源之盾计划为维护者免费送额度。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · GLM
模型发布 / 更新普通
GLM-5.3 现已开放重量限制
GLM-5.3 现已开放权重,开发者可获取模型参数。该消息于 8 月 28 日在 Hacker News 引发关注,获得 119 个点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GLM
模型发布 / 更新普通
Krea 发布 Krea 3 与 Krea Agents 两大更新
Krea 昨日展示两大更新:Krea 3 新基础模型,在 Krea 2 的美学多样性与个性化基础上强化编辑能力;Krea Agents 是构建于 Krea 之上的全新平台,为智能体工作流优化界面,并支持通过 MCP 或 API 与客户现有工作流及智能体无缝集成。
信息来源:X:Krea AI (@krea_ai)
模型发布 / 更新普通
OpenCode Go 推出 Hy4 preview 模型
Hy4 preview 现已在 OpenCode Go 中可用 770B/49B · 1M context · 专为编码智能体打造
信息来源:X:opencode (@opencode)
模型发布 / 更新普通
GLM-5.3 开源上线硅基流动
来自 @Zai_org 的 GLM-5.3 现已开源--并已在 SiliconFlow 上线。🚀 一如既往地提供 Day-0 支持。 没有增加规模,智能却大幅提升。总计 744B / 激活 40B--与 GLM-5.2 相同的基座模型,通过后训练进一步大幅推进。在前沿编码和智能体基准测试中,与 Fable 5 和 GPT-5.6 Sol 具有竞争力。 SiliconFlow 在 @OpenRouter 上的 GLM-5.2 token 份额排名第一。现在我们将这一体验带到…
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · GPT / GLM
模型发布 / 更新普通
GLM-5.3 开源并上线 OpenRouter
来自 @Zai_org 的 GLM-5.3 现已开放权重,并上线 OpenRouter。 该模型专为复杂软件工程、长周期智能体和网络安全设计,支持 1M 上下文和可配置的推理强度。 立即体验:https://openrouter.ai/z-ai/glm-5.3
信息来源:X:OpenRouter (@OpenRouter) · GLM
模型发布 / 更新普通
GLM-5.3 登陆 Hugging Face,本地运行配置公布
GLM-5.3 已正式上线 Hugging Face,首批 GGUF 和 NVFP4 量化版本已出现。
信息来源:X:Kim (@kimmonismus) · GLM / Hugging Face
模型发布 / 更新普通
WorkBuddy Hy4 预览版实测:规划构建验证全流程
这是对 Hy4 预览版进行全方位测试的一种有趣方式。从规划到构建再到验证,全部在 WorkBuddy 内完成。很高兴看到大家用它创作出的作品。
信息来源:X:Tencent WorkBuddy (@WorkBuddy_AI)
模型发布 / 更新普通
Runway 上线 Google Omni 1.1 Flash
Google Omni 1.1 Flash 现已登陆 Runway。 最新版本现已推出,与全球顶尖的图像和视频模型一同提供。点击下方链接立即体验。
信息来源:X:Runway (@runwayml)
模型发布 / 更新普通
腾讯Hy4预览版开源,支持百万上下文
更多开源前沿成果来了。冲!!! Hy4 支持 1M-token 上下文窗口,在长周期软件工程任务上表现相当不错。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
Gemini Omni 1.1 Flash 推出,强化生成视频控制
我们正在推出 Gemini Omni 1.1 Flash,让生成式视频高度可控、迭代更快,并更适用于生产级场景。 以下是你可以在 @FlowbyGoogle 中体验它的方式,以及更多信息 → https://goo.gle/4zHEzJ2
信息来源:X:Google DeepMind (@GoogleDeepMind) · Gemini
模型发布 / 更新普通
MiniCPM-o 4.5 经 TyloQuant MFQ 量化登陆苹果芯片
面壁智能 MiniCPM-o 4.5 现可通过 TyloQuant MFQ 量化版在 Apple Silicon 上高效运行,支持本地多模态推理。TyloQuant MFQ 采用神经元感知的混合格式量化,在降低内存占用的同时保留视觉、音频与实时交互能力,并提供多种量化等级及 Metal/CUDA 内核加速。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
模型发布 / 更新普通
腾讯混元 Hy4 preview 上线 WorkBuddy 免费两周
腾讯混元 Hy4 preview 已在 WorkBuddy 上线,未来两周免费使用。实测显示其在研究、Office 任务、前端开发和游戏开发等端到端智能体工作流中表现突出,能完成多步骤生产力任务;Hy3 将免费至 9 月底。
信息来源:X:腾讯混元 (@TencentHunyuan)
模型发布 / 更新普通
GLM-5.3 本地运行需 10-12×H100
你只需要 10-12× H100 用于 FP8,或 40 万-65 万美元,就能在本地运行 GLM-5.3。
信息来源:X:Kim (@kimmonismus) · GLM
模型发布 / 更新普通
四小时后可下载运行SOTA AI模型
快速提醒:4小时后,你将能够下载并运行SOTA级AI。当然,前提是你有足够的算力。活在这个时代真不错。
信息来源:X:Kim (@kimmonismus)