开源模型 AI 资讯
筛选带有「开源模型」标签的 AI 资讯。
腾讯开源混元 Hy4 preview:1M 上下文瞄准 Agent 与复杂生产力任务
腾讯发布并开源混元 Hy4 preview。模型采用 770B 总参数、49B 激活参数的 MoE 架构,支持 1M 上下文,重点强化软件工程、办公分析、游戏开发和科研任务,并已接入腾讯产品与云端 API。
GLM-5.3-Flash 发布:智谱用原生多模态与开源权重压低 Agent 成本
智谱于 2026 年 8 月 26 日发布 GLM-5.3-Flash。这款 320B 总参数、18B 激活参数的模型首次为 GLM-5 系列加入原生多模态能力,并同步开放 MIT 权重,重点降低编程 Agent、长上下文和专业工作流的推理成本。
GLM-5.3 发布:同一底座,靠后训练把编程 Agent 再推一步
智谱于 2026 年 8 月 14 日发布 GLM-5.3。新模型沿用 GLM-5.2 的底座,把训练增量集中在后训练和长程任务环境上,编程、终端操作与网络安全能力明显提升;Coding Plan 已全量开放,模型权重计划两周内公开。
Kimi K3 正式发布:2.8 万亿参数、百万上下文,完整权重将于 7 月 27 日前开放
月之暗面正式发布 Kimi K3。新模型采用 2.8 万亿参数 MoE 架构,支持 100 万 token 上下文和原生视觉,已登陆 Kimi、Kimi Work、Kimi Code 与 API;完整权重计划在 7 月 27 日前发布。
DeepSeek 推出 DSpark:V4 变快背后是推理系统升级
DeepSeek 与北京大学团队推出 DSpark 推测解码框架,并开源 DeepSpec。它让 V4-Flash 和 V4-Pro 在线服务的生成速度提升,但重点是推理效率和系统吞吐,不是模型能力升级。