FOR DEVELOPERS, OPC & RESEARCH

墨元AI

为独立开发者、OPC、小团队与科研用户,整理 AI 工具、资讯和实战教程。

查看全部
AutoDL AI 算力平台界面缩略图
AI算力平台

AutoDL

AutoDL 是面向 AI 开发者、科研人员和小团队的 GPU 算力租用平台,适合用于深度学习训练、模型调试、论文复现、AIGC 工作流运行和临时算力扩展。

LibTV AI 工具界面缩略图
AI视频工具

LibTV

LibTV 是 LiblibAI 推出的 AI 视频创作平台,围绕剧本、分镜、图像和视频生成搭建无限画布工作台,也提供面向 Agent 的技能包调用方式。

千音漫语 AI 工具界面缩略图
AI音频工具

千音漫语

千音漫语是声音创作智能助手,覆盖智能配音、音视频翻译配音、语音识别、声音克隆和音频处理,提供 1800+ AI 主播和 100+ 语言支持,适合短视频、有声书、广告和多语种内容制作。

Seedance AI 工具界面缩略图
AI视频工具

Seedance

Seedance 是字节跳动 Seed 推出的 AI 视频生成模型,Seedance 2.0 支持文本、图像、音频和视频作为输入,可用于生成更具运动稳定性、音画同步和镜头控制的视频素材。

晨涧云 AI 算力平台界面缩略图
AI算力平台

晨涧云

晨涧云是面向 AI 开发者、科研人员和小团队的 GPU 算力租赁平台,提供云主机、云容器、镜像环境和控制台管理能力,适合模型训练、推理测试、AIGC 工作流和科学计算任务。

MiniMax Audio AI 工具界面缩略图
AI音频工具

MiniMax Audio

MiniMax Audio 是 MiniMax 的 AI 语音与音频创作工具,支持文本转语音、声音克隆、人声提取、官方音色库和多语言语音生成,适合短视频配音、播客、有声内容和产品内语音交互。

最新工具

查看全部
CosyVoice AI 语音工具界面缩略图
AI音频工具

CosyVoice

CosyVoice 是通义推出的 AI 语音生产力平台,通过 CosyFlow、CosyCreative 和 CosyAgent 提供语音转写整理、播客与有声书制作、声音复刻及实时语音智能体能力。

Muse Code AI 编程工具界面缩略图
AI编程工具

Muse Code

Muse Code 是 Meta 推出的终端 AI 编程智能体,由 Muse Spark 1.2 驱动,可在大型代码仓库中规划修改、编写代码、运行工具、验证结果并协调多个持久后台 Agent。

切问学术 AI 工具界面缩略图
AI办公工具

切问学术

切问学术是一款面向科研人员的 AI 原生工作空间,覆盖学术检索、文献精读、跨论文综合、个人知识库、研究综述、灵感发现与实验辅助。

LongCat AI 工具界面缩略图
AI聊天助手

LongCat

LongCat 是美团 LongCat 团队推出的 AI 对话助手,提供思考、联网搜索、深度研究、图片与视频等任务入口,并面向开发者提供兼容主流格式的模型 API 和开源模型权重。

Gemini AI 工具界面缩略图
AI聊天助手

Gemini

Gemini 是 Google 推出的通用 AI 助手,可通过对话处理写作、文件分析、联网研究、代码与创意任务,并借助 Canvas、Gems 和 Google 服务连接组织可复用工作流。

Claude AI 工具界面缩略图
AI聊天助手

Claude

Claude 是 Anthropic 推出的通用 AI 助手,可通过对话完成写作、资料分析、联网研究、代码生成和数据可视化,并利用 Artifacts 在聊天旁持续迭代文档、网页与代码成果。

最新 AI 资讯

查看全部
Wan 3.0 将文档、图像与音频素材转化为连续电影画面的 AI 视频生成场景
模型动态

Wan 3.0 正式上线:30 秒视频生成扩展至八个平台,API 同步开启限时优惠

阿里云视频生成模型 Wan 3.0 在公测十余天后正式上线,现已覆盖阿里云百炼、万相、千问、堆友等八个平台。模型支持单次生成最长 30 秒视频和文档输入,API 按分辨率计费,并开启一个月限时优惠。

DeepSeek V4 Flash Vision Exp 视觉 API 主题画面,智能体正在分析图表并连接图像输入与工具调用
模型动态

DeepSeek V4 Flash Vision Exp 上线:API 开始原生接收图片

DeepSeek 发布实验性多模态模型 V4 Flash Vision Exp,现已通过 API 提供图像理解能力,并兼容 Chat Completions、Messages 与 Responses。本文梳理接入方式、成本边界和小团队最值得先测的场景。

MiniMax Design 多模态 Agent 工作台连接分镜、视频时间线与音频素材
产品发布

MiniMax Design 上线:把 H3 变成多模态 Agent 创作工作台

2026年8月20日,MiniMax 推出桌面端多模态创作平台 MiniMax Design。它以 Agent 拆解创意任务,在同一画布中串联脚本、分镜、图像、视频、音频、剪辑和交付,并支持 Skills 与本地素材工作流。

GLM-5.3 后训练环境汇聚至智能核心的蓝紫色科技插画
模型动态

GLM-5.3 发布:同一底座,靠后训练把编程 Agent 再推一步

智谱于 2026 年 8 月 14 日发布 GLM-5.3。新模型沿用 GLM-5.2 的底座,把训练增量集中在后训练和长程任务环境上,编程、终端操作与网络安全能力明显提升;Coding Plan 已全量开放,模型权重计划两周内公开。

Gemini 3.7 Flash 光谱核心协调代码、网页、文档与工具节点的科技插画
模型动态

Gemini 3.7 Flash 发布:Google 把高频编程 Agent 推向更低成本

Google 于 2026 年 8 月 13 日发布 Gemini 3.7 Flash,重点强化编程、网页开发和多步骤 Agent 工作流。模型支持最高 100 万 Token 上下文,并以截至年底的推广价格开放给开发者、企业和部分 Gemini 订阅用户。

DeepSeek API 峰谷计价时段与 V4 模型新价格示意图
平台生态

DeepSeek API 新价格确认:8 月 17 日起峰谷计价,Pro 高峰输出涨至 27 元

DeepSeek 已公布 API 调价细则,新价格将于 2026 年 8 月 17 日 00:00 生效。V4 Flash 与 V4 Pro 均采用峰谷计价,高峰价格为空闲时段两倍;Pro 高峰输出价升至每百万 tokens 27 元。