AI 资讯
过滤噪音,关注能转化为产品、运营和增长动作的 AI 趋势。
Meta 发布 Muse Glimmer:30B 开放权重 Agent 模型可在单卡本地运行
Meta 发布 30B 多模态 Agent 模型 Muse Glimmer,以 Apache 2.0 许可开放权重。官方量化版可在 24GB 或 32GB 内存区间的 Mac 与单卡 PC 本地运行,重点面向工具调用、长流程任务、编程和图文理解。
阿里 Wan 3.0 开启公测:单次生成 30 秒,文档可直接转视频
阿里云新一代视频生成模型 Wan 3.0 开启公测,单次可生成最长 30 秒视频,并支持 DOC、XLS、PPT、PDF、Markdown 等文档直接转视频。本文梳理公测入口、API 价格与小团队最值得验证的使用场景。
DeepSeek 官宣 API 将大幅涨价:新价格未公布,开发者先重算成本
DeepSeek 8 月 6 日通知开发者,计划近期整体上调 API 服务定价,且预计涨幅较大。具体价格与生效时间仍待正式通知,依赖 V4 Flash、V4 Pro 的团队需要先核算成本暴露,而不是根据猜测囤余额。
千问 Qwen3.8-Max 正式上线:2.4T 旗舰模型押注长程智能体
阿里千问 Qwen3.8-Max 于 2026 年 8 月 3 日正式上线,总参数 2.4T、激活参数 95B,重点升级自主编程、专业办公、长程任务与多模态智能体。API 已开放,模型权重与 27B 版本计划于下周发布。
MiniMax H3 发布并开放权重:15 秒 2K 原生音视频,已上线 LibTV
MiniMax 推出全模态视频生成模型 H3,可统一理解文本、图片、视频和音频,生成最长 15 秒、最高 2K、带原生双声道声音的视频。模型已上线 LibTV,开放权重也已进入 ComfyUI 原生工作流。
DeepSeek-V4-Flash 正式版 API 公测:Agent 能力升级,原生适配 Codex
DeepSeek-V4-Flash-0731 正式版 API 开启公测,模型架构与参数规模不变,重点通过后训练增强 Agent 与代码任务,并新增 Responses API 和 Codex 适配。
字节跳动正式发布 Seedance 2.5:单次生成 30 秒,支持 50 个多模态参考
字节跳动于 2026 年 7 月 31 日正式发布新一代视频生成模型 Seedance 2.5,重点升级长视频叙事、多模态参考和局部编辑能力,并开始进入汽车、工业制造与具身智能等生产场景。
Kimi K3 正式开放权重:2.8 万亿参数与三项训练基础设施同步发布
月之暗面正式发布 Kimi K3 完整模型权重与技术报告,并同步开源 MoonEP、FlashKDA、AgentEnv 三项训练基础设施。模型总参数达 2.8 万亿,支持原生视觉理解和 100 万 Token 上下文,但 1.56 TB 的权重规模也抬高了私有部署门槛。
Claude Opus 5 发布:接近 Fable 5,价格维持 Opus 4.8 水平
Anthropic 正式发布 Claude Opus 5:API 价格与 Opus 4.8 持平,提供 100 万 Token 上下文、可调 Effort 和更强的长程 Agent 能力。对开发者而言,重点是以更可控的成本处理复杂编码和知识工作。
Black Forest Labs 发布 FLUX 3:图像、视频与原生音频进入统一模型
Black Forest Labs 推出统一训练图像、视频和音频的多模态基础模型 FLUX 3。视频版已进入申请制 Early Access,可单次生成最长 20 秒原生音频视频;图像版、动作预测版与开放权重版将分阶段推出。
腾讯创意智能体 Miora 全量上线:一句话生成多模态创意方案
2026 年 7 月 22 日,腾讯设计旗下创意智能体 Miora 正式开放使用,用户无需邀请码即可登录。它能从一份 Brief 出发,在同一画布中生成并组织图像、视频、UI/UX、3D 和品牌视觉资产。
阿里发布 Qwen-Image-3.0:把复杂图文生成推向可用阶段
阿里千问发布第三代图像生成基础模型 Qwen-Image-3.0,重点提升长指令、复杂版面、小字与多语言渲染能力。目前 API 仍处于邀测阶段,实际稳定性与价格有待进一步验证。
阿里发布 Qwen-Audio-3.0-TTS:把情绪与声音动作写进合成文本
阿里发布 Qwen-Audio-3.0-TTS,提供面向实时交互的 Flash 和面向高质量生成的 Plus 两个版本。新模型覆盖 16 种语言、20 种中文方言,并把情绪、笑声、呼吸等细节控制下沉到文本标签。
Qwen3.8 官宣即将开放权重,2.4T 预览版已先行上线
千问宣布 Qwen3.8 正式版即将发布并开放权重,2.4T 参数的 Qwen3.8-Max-Preview 已在 Token Plan、Qoder 和 QoderWork 上线。现阶段可测试预览版,但尚无正式权重、发布日期或独立基准。
Kimi K3 正式发布:2.8 万亿参数、百万上下文,完整权重将于 7 月 27 日前开放
月之暗面正式发布 Kimi K3。新模型采用 2.8 万亿参数 MoE 架构,支持 100 万 token 上下文和原生视觉,已登陆 Kimi、Kimi Work、Kimi Code 与 API;完整权重计划在 7 月 27 日前发布。
OpenAI 正式推出 GPT-5.6:三档模型全面开放,Ultra 引入多智能体并行
OpenAI 将 GPT-5.6 从有限预览推进到全面可用,Sol、Terra、Luna 已进入 ChatGPT、Codex 和 API。三档定价、百万级上下文与 Ultra 多智能体模式,让小团队有了更清晰的模型路由选择。
Seedream 5.0 Pro 发布:字节把 AI 出图推进到可编辑设计流程
字节跳动 Seed 团队发布 Seedream 5.0 Pro,重点升级复杂信息可视化、交互式精准编辑、真实影像质感和多语种生成。它已经上线火山方舟体验中心,并将陆续进入豆包、即梦,适合内容、设计和产品团队优先测试可控编辑能力。
腾讯混元 Hy3 正式发布:开源 295B MoE 模型,Agent 与产品接入成为主线
腾讯混元 Hy3 于 2026 年 7 月 6 日正式发布并开源,采用 295B 总参数、21B 激活参数的 MoE 架构,支持 256K 上下文,重点提升推理、代码、长上下文和 Agent 工作流能力,并已接入腾讯元宝、WorkBuddy/CodeBuddy、ima、Marvis 等产品。
阿里全面禁用 Claude:Claude Code 风险争议让企业 AI 工具进入审查期
阿里巴巴据报要求员工从 2026 年 7 月 10 日起停止在办公环境使用 Claude Code,并下架 Anthropic 相关产品。事件背后,是围绕模型蒸馏指控、隐藏检测代码和企业研发数据安全的连锁信任危机。
美团 LongCat-2.0 发布:国产算力训练出的万亿参数模型,重点押注 Agentic Coding
美团发布 LongCat-2.0 万亿参数大模型,称其在五万卡国产算力集群上完成训练与推理闭环,支持 1M 上下文,并面向 Agentic Coding、代码迁移和复杂工具调用场景开放调用。
OpenAI 预览 GPT-5.6:Sol、Terra、Luna 先进入可信伙伴测试
OpenAI 开始有限预览 GPT-5.6 系列,包含旗舰模型 Sol、均衡模型 Terra 和低成本模型 Luna。它暂未面向普通用户全量开放,首批访问受美国政府网络安全审查流程影响。
DeepSeek 推出 DSpark:V4 变快背后是推理系统升级
DeepSeek 与北京大学团队推出 DSpark 推测解码框架,并开源 DeepSpec。它让 V4-Flash 和 V4-Pro 在线服务的生成速度提升,但重点是推理效率和系统吞吐,不是模型能力升级。
Seedance 2.5 发布:30 秒视频和 50 个参考素材,把 AI 视频推向生产流程
字节跳动 Seed 团队在 2026 火山引擎 FORCE 原动力大会上发布 Seedance 2.5,重点升级为单段最长 30 秒视频生成、最多 50 个全模态参考素材和局部视频编辑。它更适合广告、电商、短片和企业内容团队测试生产级视频工作流,但独立入口、API 价格和正式开放范围仍需等待官方补齐。
智谱 GLM-5.2 全量开放:Coding Plan 用户先用,API 与开源还要等下一步
智谱 GLM-5.2 已面向 GLM Coding Plan 全套餐开放,ZCode 3.0 同步围绕 GLM-5.2 深度优化并切换自研 Agent 内核。开发者现在可以先在编码套餐和 ZCode 中测试长程编程任务,API、开源权重、模型卡和价格仍需等待官方进一步公开。
小米开源 MiMo Code:把长程编程 Agent 做进终端
小米 MiMo 团队发布并开源 MiMo Code V0.1.0,把终端代码助手、跨会话记忆、上下文重建、Compose 编排和 Dream/Distill 经验沉淀放到同一个开源工具里。它基于 OpenCode 构建,适合小团队关注长程编程 Agent 的实际落地边界。
Anthropic 发布 Claude Fable 5 和 Mythos 5:最强 Claude 开放,但带着安全闸门
Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5。Fable 5 是面向普通用户开放的 Mythos-class 模型,价格升至每百万输入 10 美元、输出 50 美元;Mythos 5 继续限定在可信访问项目中。
MiniMax M3 发布:百万上下文、多模态和 Agent 编程能力放到同一个模型里
MiniMax 在 2026 年 6 月 1 日发布 M3,主打前沿 Coding 与 Agent 能力、最高 1M tokens 上下文和原生多模态。模型已通过 API、Token Plan 和 MiniMax Code 开放,权重和技术报告预计在 10 天内发布。
Claude Opus 4.8 发布:Anthropic 把旗舰模型推向长程 Agent 工作流
Anthropic 在 2026 年 5 月 28 日发布 Claude Opus 4.8。新模型强化复杂编码、长程 Agent、知识工作和专业任务,同时推出 Claude Code dynamic workflows、effort control 和 Messages API 中途系统消息能力。
微软 MAI-Image-2.5 冲上 Arena 文生图第三:自研图像模型进入第一梯队
微软在 2026 年 5 月 26 日发布 MAI-Image-2.5,Arena 文生图榜单显示该模型以 1254±8 的成绩位列第三。它强化文字渲染、商业视觉和空间关系理解,已可在 Arena 试用,并计划两周内进入 MAI Playground 与 Foundry。
小米 MiMo-V2.5 API 永久降价:缓存命中低至 0.02 元每百万 tokens
小米 MiMo-V2.5 系列 API 自 2026 年 5 月 27 日 0 点起永久降价,最高降幅 99%,并取消按上下文窗口长度区分价格。Token Plan 也同步升级,有效套餐用户的已用 Credits 被全量重置。
DeepSeek-V4-Pro API 降价:2.5 折从促销价变成新价格基准
DeepSeek 确认 deepseek-v4-pro API 在 2026 年 5 月 31 日 15:59 UTC 结束 75% off 活动后,价格将正式调整为原定价的 1/4。对小团队来说,这会直接影响长上下文、Agent、代码和知识库场景的成本测算。
千问接入 Qwen3.7-Max:阿里把旗舰智能体模型推向普通用户
千问 App、PC 端和网页端已接入 Qwen3.7-Max,用户更新至 6.9.7 及以上版本后可切换体验。相比一次单纯模型发布,这更像是阿里把智能体能力放进消费端入口的一步。
DeepSeek Code 即将上线?Harness 团队信号指向代码智能体产品
DeepSeek 正在组建 Harness 团队,目标是把模型能力转化为代码智能体产品,并对标 Claude Code。当前更准确的判断是产品化信号已经出现,但官方尚未公布 DeepSeek Code 的正式上线时间。