标签:AI Agent
检索墨元AI的工具、资讯和教程内容。
AI 工具 (4)
TRAE
TRAE 是面向开发者和研发团队的 AI 编程工具,提供 AI IDE、SOLO Agent、智能补全、Agent、MCP、Rules、插件和 CLI 等能力,适合把需求拆解、编码、调试和交付流程交给 AI 辅助推进。
MiniMax
MiniMax 是稀宇科技推出的通用 AI 产品与模型平台,覆盖对话助手、长任务 Agent、代码协作、文档处理、视频、语音和音乐等多模态场景。
Loomy
科大讯飞推出的桌面 AI 工作助手,可通过自然语言拆解并执行信息整理、内容创作、文件处理、网页操作、远程协作等多步骤办公任务。
MiniMax Design
MiniMax Design 是面向商业内容生产的多模态 AI 创作平台,可用 Agent 协调文案、图像、视频和音频任务,并在统一画布中推进到审核与导出。
AI 资讯 (24)
Gemini 4 Argon 发布:单次输出拉到 100 万 Token,Google 把旗舰推理砍至半价
Google 于 2026 年 9 月 30 日发布新一代旗舰模型 Gemini 4 Argon,单次输出上限提升至 100 万 Token,初始 API 价格低至输入 2 美元、输出 10 美元。模型在长程软件工程与知识密集型任务中取得新突破,但首发仅开放给受信任的网络安全防御团队。
TypeSafe 推出首个决策模型 Jev:砍掉文本生成专攻结构化判断,重构 Agent 底层调用
前 OpenAI 研究员 Diogo Almeida 创立的 TypeSafe AI 发布首个“系统一”决策模型 Jev。该模型彻底摒弃自回归文本生成,专注高频结构化选择、评分与概率输出,输入每百万 Token 仅 0.042 美元且输出免费。
MiniMax Code CLI 正式开源:终端编程 Agent 开放核心架构,支持 BYOK 与 ACP 协议
MiniMax 于 2026 年 9 月 18 日正式开源其终端编程 Agent 工具 MiniMax Code CLI (v0.4.12),采用 MIT 协议开放 TUI、无头批处理与 ACP 协议,并全面支持自带模型密钥接入。
DeepSeek V4.1 Flash 发布:原生多模态、API 降价,V4 Pro 将切换路由
DeepSeek 发布 V4.1 Flash,以 552B MoE 非对称架构降低输入与缓存成本,加入原生视觉理解,并将在 9 月 14 日起承接 V4 Pro 的 API 请求。
GPT-6 Astra 发布:更会操作软件,也把网络安全推入 Critical 门槛
OpenAI 发布 GPT-6 Astra,重点提升电脑操作、编程、科研与长任务协作,并首次把公开部署模型的网络安全能力推到 Critical 等级。本文整理开放范围、API 价格、关键评测,以及小团队在接入前应先验证的边界。
Claude Fable 5.1 与 Mythos 5.1 发布:缓存读取降价 75%,长任务成主战场
Anthropic 发布同源的 Claude Fable 5.1 与 Mythos 5.1:前者全面开放,后者继续限于受信任机构。新版强化长任务、编程和科研能力,并将缓存读取价格降至每百万词元 0.25 美元。
腾讯开源混元 Hy4 preview:1M 上下文瞄准 Agent 与复杂生产力任务
腾讯发布并开源混元 Hy4 preview。模型采用 770B 总参数、49B 激活参数的 MoE 架构,支持 1M 上下文,重点强化软件工程、办公分析、游戏开发和科研任务,并已接入腾讯产品与云端 API。
Qwen3.8-Flash 发布:阿里用 6B 激活参数重做百万 Token Agent 模型
阿里通义千问于 2026 年 8 月 26 日发布 Qwen3.8-Flash,并开放 Qwen3.8-Flash-Next 权重。新架构以 125B 主模型、51B N-gram Embedding 和每 Token 6B 激活参数,降低长上下文、编程与办公 Agent 的训练和推理成本。
GLM-5.3-Flash 发布:智谱用原生多模态与开源权重压低 Agent 成本
智谱于 2026 年 8 月 26 日发布 GLM-5.3-Flash。这款 320B 总参数、18B 激活参数的模型首次为 GLM-5 系列加入原生多模态能力,并同步开放 MIT 权重,重点降低编程 Agent、长上下文和专业工作流的推理成本。
豆包工作正式上线:从回答问题走向直接完成任务
字节跳动正式发布生产力 Agent“豆包工作”,支持拆解任务、调用工具、操作电脑与浏览器,并与飞书深度打通。它把 AI 办公的竞争焦点从内容生成推向任务交付。
DeepSeek V4 Flash Vision Exp 上线:API 开始原生接收图片
DeepSeek 发布实验性多模态模型 V4 Flash Vision Exp,现已通过 API 提供图像理解能力,并兼容 Chat Completions、Messages 与 Responses。本文梳理接入方式、成本边界和小团队最值得先测的场景。
MiniMax Design 上线:把 H3 变成多模态 Agent 创作工作台
2026年8月20日,MiniMax 推出桌面端多模态创作平台 MiniMax Design。它以 Agent 拆解创意任务,在同一画布中串联脚本、分镜、图像、视频、音频、剪辑和交付,并支持 Skills 与本地素材工作流。
GLM-5.3 发布:同一底座,靠后训练把编程 Agent 再推一步
智谱于 2026 年 8 月 14 日发布 GLM-5.3。新模型沿用 GLM-5.2 的底座,把训练增量集中在后训练和长程任务环境上,编程、终端操作与网络安全能力明显提升;Coding Plan 已全量开放,模型权重计划两周内公开。
Gemini 3.7 Flash 发布:Google 把高频编程 Agent 推向更低成本
Google 于 2026 年 8 月 13 日发布 Gemini 3.7 Flash,重点强化编程、网页开发和多步骤 Agent 工作流。模型支持最高 100 万 Token 上下文,并以截至年底的推广价格开放给开发者、企业和部分 Gemini 订阅用户。
DeepSeek API 新价格确认:8 月 17 日起峰谷计价,Pro 高峰输出涨至 27 元
DeepSeek 已公布 API 调价细则,新价格将于 2026 年 8 月 17 日 00:00 生效。V4 Flash 与 V4 Pro 均采用峰谷计价,高峰价格为空闲时段两倍;Pro 高峰输出价升至每百万 tokens 27 元。
DeepSeek Harness 开发者预览版发布:把 Agent 运行时做成可组合插件
DeepSeek 于 2026 年 8 月 13 日开放 DeepSeek Harness v0.1 开发者预览版并采用 MIT 许可证。它把模型、工具、会话、沙箱、Agent Loop 与 UI 都做成可替换插件,为开发者提供可组合、可追溯的 Agent 运行时。
Grok 4.6 发布:xAI 把重点转向长任务 Agent 与 AI 编程
xAI 发布 Grok 4.6,重点增强长时间运行的 Agent、软件工程和复杂知识工作能力。模型支持 50 万 Token 上下文及文本、图像输入,基础 API 价格延续 Grok 4.5,但超长上下文会触发阶梯计价。
DeepSeek V4 Pro 0813 API 上线:调用名不变,原有接入自动升级
DeepSeek 官方 API 页面已将 deepseek-v4-pro 指向 DeepSeek-V4-Pro-0813,现有调用方式无需修改,并新增明确的 Responses API 支持。本文梳理已确认的规格、价格和小团队需要立即复测的环节。
Meta 发布 Muse Glimmer:30B 开放权重 Agent 模型可在单卡本地运行
Meta 发布 30B 多模态 Agent 模型 Muse Glimmer,以 Apache 2.0 许可开放权重。官方量化版可在 24GB 或 32GB 内存区间的 Mac 与单卡 PC 本地运行,重点面向工具调用、长流程任务、编程和图文理解。
OpenAI 正式推出 GPT-5.6:三档模型全面开放,Ultra 引入多智能体并行
OpenAI 将 GPT-5.6 从有限预览推进到全面可用,Sol、Terra、Luna 已进入 ChatGPT、Codex 和 API。三档定价、百万级上下文与 Ultra 多智能体模式,让小团队有了更清晰的模型路由选择。
腾讯混元 Hy3 正式发布:开源 295B MoE 模型,Agent 与产品接入成为主线
腾讯混元 Hy3 于 2026 年 7 月 6 日正式发布并开源,采用 295B 总参数、21B 激活参数的 MoE 架构,支持 256K 上下文,重点提升推理、代码、长上下文和 Agent 工作流能力,并已接入腾讯元宝、WorkBuddy/CodeBuddy、ima、Marvis 等产品。
OpenAI 预览 GPT-5.6:Sol、Terra、Luna 先进入可信伙伴测试
OpenAI 开始有限预览 GPT-5.6 系列,包含旗舰模型 Sol、均衡模型 Terra 和低成本模型 Luna。它暂未面向普通用户全量开放,首批访问受美国政府网络安全审查流程影响。
Anthropic 发布 Claude Fable 5 和 Mythos 5:最强 Claude 开放,但带着安全闸门
Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5。Fable 5 是面向普通用户开放的 Mythos-class 模型,价格升至每百万输入 10 美元、输出 50 美元;Mythos 5 继续限定在可信访问项目中。
MiniMax M3 发布:百万上下文、多模态和 Agent 编程能力放到同一个模型里
MiniMax 在 2026 年 6 月 1 日发布 M3,主打前沿 Coding 与 Agent 能力、最高 1M tokens 上下文和原生多模态。模型已通过 API、Token Plan 和 MiniMax Code 开放,权重和技术报告预计在 10 天内发布。