标签:AI Agent

检索墨元AI的工具、资讯和教程内容。

热门标签AI AgentAI视频生成AI 编程AI编程工具AI图像生成DeepSeekAI智能体AI聊天助手多模态模型AI办公工具AI设计AI写作工具

AI 工具 (3)

AI 资讯 (18)

DeepSeek V4 Flash Vision Exp 视觉 API 主题画面,智能体正在分析图表并连接图像输入与工具调用
模型动态

DeepSeek V4 Flash Vision Exp 上线:API 开始原生接收图片

DeepSeek 发布实验性多模态模型 V4 Flash Vision Exp,现已通过 API 提供图像理解能力,并兼容 Chat Completions、Messages 与 Responses。本文梳理接入方式、成本边界和小团队最值得先测的场景。

MiniMax Design 多模态 Agent 工作台连接分镜、视频时间线与音频素材
产品发布

MiniMax Design 上线:把 H3 变成多模态 Agent 创作工作台

2026年8月20日,MiniMax 推出桌面端多模态创作平台 MiniMax Design。它以 Agent 拆解创意任务,在同一画布中串联脚本、分镜、图像、视频、音频、剪辑和交付,并支持 Skills 与本地素材工作流。

GLM-5.3 后训练环境汇聚至智能核心的蓝紫色科技插画
模型动态

GLM-5.3 发布:同一底座,靠后训练把编程 Agent 再推一步

智谱于 2026 年 8 月 14 日发布 GLM-5.3。新模型沿用 GLM-5.2 的底座,把训练增量集中在后训练和长程任务环境上,编程、终端操作与网络安全能力明显提升;Coding Plan 已全量开放,模型权重计划两周内公开。

Gemini 3.7 Flash 光谱核心协调代码、网页、文档与工具节点的科技插画
模型动态

Gemini 3.7 Flash 发布:Google 把高频编程 Agent 推向更低成本

Google 于 2026 年 8 月 13 日发布 Gemini 3.7 Flash,重点强化编程、网页开发和多步骤 Agent 工作流。模型支持最高 100 万 Token 上下文,并以截至年底的推广价格开放给开发者、企业和部分 Gemini 订阅用户。

DeepSeek API 峰谷计价时段与 V4 模型新价格示意图
平台生态

DeepSeek API 新价格确认:8 月 17 日起峰谷计价,Pro 高峰输出涨至 27 元

DeepSeek 已公布 API 调价细则,新价格将于 2026 年 8 月 17 日 00:00 生效。V4 Flash 与 V4 Pro 均采用峰谷计价,高峰价格为空闲时段两倍;Pro 高峰输出价升至每百万 tokens 27 元。

DeepSeek Harness 插件化 Agent 运行时与可组合模块示意图
平台生态

DeepSeek Harness 开发者预览版发布:把 Agent 运行时做成可组合插件

DeepSeek 于 2026 年 8 月 13 日开放 DeepSeek Harness v0.1 开发者预览版并采用 MIT 许可证。它把模型、工具、会话、沙箱、Agent Loop 与 UI 都做成可替换插件,为开发者提供可组合、可追溯的 Agent 运行时。

Grok 4.6 编程 Agent 在多屏代码工作台上检查长任务进度
模型动态

Grok 4.6 发布:xAI 把重点转向长任务 Agent 与 AI 编程

xAI 发布 Grok 4.6,重点增强长时间运行的 Agent、软件工程和复杂知识工作能力。模型支持 50 万 Token 上下文及文本、图像输入,基础 API 价格延续 Grok 4.5,但超长上下文会触发阶梯计价。

DeepSeek V4 Pro 0813 API 上线主题画面,蓝色鲸鱼跃出海面,旁边是发光的 API 接入装置
模型动态

DeepSeek V4 Pro 0813 API 上线:调用名不变,原有接入自动升级

DeepSeek 官方 API 页面已将 deepseek-v4-pro 指向 DeepSeek-V4-Pro-0813,现有调用方式无需修改,并新增明确的 Responses API 支持。本文梳理已确认的规格、价格和小团队需要立即复测的环节。

笔记本电脑本地运行 Muse Glimmer 并连接图像、图表、代码与工具的 Agent 场景
模型动态

Meta 发布 Muse Glimmer:30B 开放权重 Agent 模型可在单卡本地运行

Meta 发布 30B 多模态 Agent 模型 Muse Glimmer,以 Apache 2.0 许可开放权重。官方量化版可在 24GB 或 32GB 内存区间的 Mac 与单卡 PC 本地运行,重点面向工具调用、长流程任务、编程和图文理解。

GPT-5.6 Sol、Terra、Luna 三档模型与多智能体工作流示意图
模型动态

OpenAI 正式推出 GPT-5.6:三档模型全面开放,Ultra 引入多智能体并行

OpenAI 将 GPT-5.6 从有限预览推进到全面可用,Sol、Terra、Luna 已进入 ChatGPT、Codex 和 API。三档定价、百万级上下文与 Ultra 多智能体模式,让小团队有了更清晰的模型路由选择。

腾讯混元 Hy3 模型连接 Agent 工作流和产品应用界面示意图
模型动态

腾讯混元 Hy3 正式发布:开源 295B MoE 模型,Agent 与产品接入成为主线

腾讯混元 Hy3 于 2026 年 7 月 6 日正式发布并开源,采用 295B 总参数、21B 激活参数的 MoE 架构,支持 256K 上下文,重点提升推理、代码、长上下文和 Agent 工作流能力,并已接入腾讯元宝、WorkBuddy/CodeBuddy、ima、Marvis 等产品。

GPT-5.6 Sol、Terra、Luna 有限预览与安全审查示意图
模型动态

OpenAI 预览 GPT-5.6:Sol、Terra、Luna 先进入可信伙伴测试

OpenAI 开始有限预览 GPT-5.6 系列,包含旗舰模型 Sol、均衡模型 Terra 和低成本模型 Luna。它暂未面向普通用户全量开放,首批访问受美国政府网络安全审查流程影响。

Claude Fable 5 与 Mythos 5 安全护栏示意图
模型动态

Anthropic 发布 Claude Fable 5 和 Mythos 5:最强 Claude 开放,但带着安全闸门

Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5。Fable 5 是面向普通用户开放的 Mythos-class 模型,价格升至每百万输入 10 美元、输出 50 美元;Mythos 5 继续限定在可信访问项目中。

MiniMax M3 长上下文多模态 Agent 工作流示意图
模型动态

MiniMax M3 发布:百万上下文、多模态和 Agent 编程能力放到同一个模型里

MiniMax 在 2026 年 6 月 1 日发布 M3,主打前沿 Coding 与 Agent 能力、最高 1M tokens 上下文和原生多模态。模型已通过 API、Token Plan 和 MiniMax Code 开放,权重和技术报告预计在 10 天内发布。

Claude Opus 4.8 与 Claude Code 长程 Agent 工作流示意图
模型动态

Claude Opus 4.8 发布:Anthropic 把旗舰模型推向长程 Agent 工作流

Anthropic 在 2026 年 5 月 28 日发布 Claude Opus 4.8。新模型强化复杂编码、长程 Agent、知识工作和专业任务,同时推出 Claude Code dynamic workflows、effort control 和 Messages API 中途系统消息能力。

DeepSeek-V4-Pro API 降价与模型调用成本示意图
模型动态

DeepSeek-V4-Pro API 降价:2.5 折从促销价变成新价格基准

DeepSeek 确认 deepseek-v4-pro API 在 2026 年 5 月 31 日 15:59 UTC 结束 75% off 活动后,价格将正式调整为原定价的 1/4。对小团队来说,这会直接影响长上下文、Agent、代码和知识库场景的成本测算。

DeepSeek Code Harness 代码智能体概念图
产品发布

DeepSeek Code 即将上线?Harness 团队信号指向代码智能体产品

DeepSeek 正在组建 Harness 团队,目标是把模型能力转化为代码智能体产品,并对标 Claude Code。当前更准确的判断是产品化信号已经出现,但官方尚未公布 DeepSeek Code 的正式上线时间。

千问接入 Qwen3.7-Max 旗舰智能体模型概念图
模型动态

千问接入 Qwen3.7-Max:阿里把旗舰智能体模型推向普通用户

千问 App、PC 端和网页端已接入 Qwen3.7-Max,用户更新至 6.9.7 及以上版本后可切换体验。相比一次单纯模型发布,这更像是阿里把智能体能力放进消费端入口的一步。