模型

每个模型都跑在同一套任务式 API 之后。按模态筛选,或按名称、供应商、能力搜索。

音频

AI Music 2.5

ElevenLabs

根据文字描述生成背景音乐和完整曲段

text-to-music
音频

Audio to MP3

Muke Labs

把常见音频上传转换成独立 MP3 文件

audio-to-mp3
视频

Auto Video Watermark Remover

Alibaba

上传视频即可自动去除水印、字幕和角标,无需手动画遮罩

video-upscale
图像

Character Concept Board

Muke Labs

为视频连贯性生成多人物三视图设定板

text-to-imageimage-to-image
文本

Claude Fable 5.1

Anthropic

Claude Fable 5.1

chat
文本

Claude Opus 4.5

Anthropic

旧 Claude Opus,适合长文审阅和分析

chat
文本

Claude Opus 4.6

Anthropic

上一代 Claude Opus,适合代码和研究对比

chat
文本

Claude Opus 4.7

Anthropic

Claude 最新 Opus,适合长期智能体和深度分析

chat
文本

Claude Opus 5.5

Anthropic

Claude Opus 5.5

chat
文本

Claude Sonnet 4.6

Anthropic

低成本 Claude Sonnet,适合写作、审阅和深度分析

chat
文本

Claude Sonnet 5.5

Anthropic

Claude Sonnet 5.5

chat
文本

DeepSeek V3.1 Terminus

DeepSeek

旧 DeepSeek V3.1 版本,方便代际输出对比

chat
文本

DeepSeek V3.2

DeepSeek

上一代 DeepSeek,适合低成本中文问答和代码协助

chat
文本

DeepSeek V4 Flash

DeepSeek

适合高频推理、中文问答和快速分析

chat
文本

DeepSeek V4 Pro

DeepSeek

DeepSeek 最新 Pro,适合高级推理、代码和中文分析

chat
文本

DeepSeek V4.1 Flash

DeepSeek

DeepSeek V4.1 Flash

chat
视频

Digital Human - HeyGen

HeyGen

用媒体素材加上传音频生成或重配数字人口型视频

image-to-videoomni-reference
视频

Digital Human - InfiniTalk

InfiniTalk

用人像图片加人声音频生成数字人说话视频

image-to-video
图像

Flux 2 Dev

Black Forest Labs

适合快速构思、草稿和提示词测试

text-to-imageimage-to-image
图像

Flux 2 Flex

Black Forest Labs

兼顾 Flux 2 质量与更灵活的图片工作流

text-to-imageimage-to-image
图像

Flux 2 Pro

Black Forest Labs

适合照片级商业图片和精准提示词执行

text-to-imageimage-to-image
图像

FLUX Inpainting

Black Forest Labs

用文字指令修改、替换或修补图片局部

image-inpaint
文本

Gemini 3 Flash Preview

Google

旧 Gemini Flash 预览,适合快速多模态问答

chat
文本

Gemini 3.1 Flash Lite

Google

低延迟 Gemini 3.1,适合高频日常任务

chat
文本

Gemini 3.1 Pro Preview

Google

Gemini 最新 Pro 推理模型,适合多模态智能体任务

chat
视频

Google Omni Flash

Google

支持原生音频的多模态视频生成、参考与编辑

text-to-videoimage-to-videoomni-reference+1
图像

GPT Image 2

OpenAI

适合营销图、产品图和高保真编辑

text-to-imageimage-to-image
图像

GPT Image 2.5

OpenAI

高细节图片生成与精准编辑

text-to-imageimage-to-image
文本

GPT-5.4

OpenAI

上一代 OpenAI 前沿模型,适合稳定高阶任务

chat
文本

GPT-5.5

OpenAI

OpenAI 最新前沿模型,适合复杂推理和代码

chat
文本

GPT-6 Astra

OpenAI

GPT-6 Astra

chat
文本

GPT-6 Luna

OpenAI

GPT-6 Luna

chat
文本

GPT-6.1 Sol

OpenAI

GPT-6.1 Sol

chat
图像

GPT-Image-1.5

OpenAI

适合透明背景、贴纸和自然语言图片编辑

text-to-imageimage-to-image
图像

Graphics Image Upscale

Muke Labs

放大海报与文字密集的图形,同时保持版面布局

image-upscale
图像

Grok Imagine 2.0

xAI

适合风格强烈的快速创意图像

text-to-imageimage-to-image
视频

Grok Video

xAI

适合快速写实视频、动作和音效画面

text-to-videoimage-to-video
视频

Grok Video v1.5

xAI

最新版 Grok 图生视频,支持原生音频

image-to-video
视频

Hailuo 2.3

MiniMax

适合电影质感短视频和图生视频

text-to-videoimage-to-video
视频

Happy Horse

Alibaba

适合带配音、音效和多语言口型同步的视频

text-to-videoimage-to-videoomni-reference+1
图像

High Fidelity Image Upscale

Muke Labs

为高要求源图进行精细细节增强

image-upscale
视频

Kling

Kling

视频创作、特效、动作迁移与对口型

text-to-videoimage-to-video
视频

Kling 2.5

Kling

适合快速视频草稿和简单图生视频

text-to-videoimage-to-video
视频

Kling O1

Kling

Kling O1 —— 首末帧、全参考、视频参考与视频编辑

image-to-videoomni-reference
视频

Kling O3

Kling

Kling O3 —— 图生视频、全参考、视频参考与视频编辑

image-to-videoomni-reference
图像

LaMa Inpainting

Muke Labs

去除图片水印、杂物并修补背景

image-inpaint
视频

LTX Video 2.5

Lightricks

适合快速迭代、有原生音频的视频草稿

text-to-videoimage-to-video
图像

Magnific Upscaler

Magnific AI

把图片放大并补充更清晰的纹理细节

image-upscale
图像

Midjourney

Midjourney

适合艺术插画、视觉概念和风格化创意图

text-to-imageimage-to-image
视频

MiniMax H3

MiniMax

从文本或图像、视频、音频参考生成高细节视频

text-to-videoimage-to-videoomni-reference
图像

Nano Banana 2

Google

适合高细节写实图、多参考合成和复杂场景

text-to-imageimage-to-image
图像

Nano Banana 2 Lite

Google

快速的 1K 图片生成与编辑

text-to-imageimage-to-image
图像

Nano Banana Pro

Google

适合专业排版、包装和文字密集型视觉设计

text-to-imageimage-to-image
图像

Outfit & Accessory Changer

Muke Labs

替换服装、包包、首饰等饰品,同时保留人物身份

image-to-image
图像

Photo Angle Changer

Muke Labs

改变照片镜头角度,同时尽量保留主体身份和细节

image-to-image
图像

Photo Background Changer

Muke Labs

替换照片背景,并自动匹配边缘、阴影和环境光

image-to-image
图像

Photo Element Replacer

Muke Labs

用参考图替换原图中的元素、商品或人物;可选框选辅助定位

image-to-image
图像

Photo Face Swap

Muke Labs

将参考人脸自然融合到目标照片,保留姿势、服装、背景和光影

image-to-image
图像

Photo Lighting Changer

Muke Labs

调整光线、阴影和氛围,不改变主体和构图

image-to-image
文本

Qwen 3.7 Flash

Alibaba

快速多模态 Qwen Flash,适合提示词改写和日常对话

chat
文本

Qwen 3.8 Flash

Alibaba Qwen

Qwen 3.8 Flash

chat
图像

Restore Image

Muke Labs

重建受损或低质量图像的清晰度

image-upscale
视频

Seedance 2.0 Fast

ByteDance

适合低延迟预览和动作方案测试

text-to-videoimage-to-videoomni-reference
视频

Seedance 2.0 Standard

ByteDance

适合最终质量更高的动作和多参考视频

text-to-videoimage-to-videoomni-reference
视频

Seedance 2.5

ByteDance

单段最长 30 秒,支持多参考控制

text-to-videoimage-to-videoomni-reference
图像

Seedream 5.0 Lite

ByteDance

适合中文文字、艺术风格和多主体创作

text-to-imageimage-to-image
图像

Seedream 5.0 Pro

ByteDance

适合精准构图、主体一致和高保真最终成片

text-to-imageimage-to-image
音频

Sound FX

ElevenLabs

根据文字描述生成环境声和短音效

text-to-audio
图像

Standard Image Upscale

Muke Labs

适合日常图像的均衡放大

image-upscale
音频

Suno Music

Suno

根据描述、歌词和 Persona 生成完整歌曲

text-to-music
音频

TTS Flash

ElevenLabs

适合自然旁白、课程配音和社媒语音

text-to-speech
视频

Veo 3.1

Google

适合真实感运动、镜头语言和原生音频视频

text-to-videoimage-to-video
视频

Video Audio Splitter

Muke Labs

从一个视频导出无声视频和独立 MP3 音轨

video-audio-split
视频

Video HD Upscaler

Topaz Labs

提升视频分辨率与清晰度,同时保留原始帧率

video-upscale
文本

Video Prompt Storyboard Reverse Engineer

Muke Labs

把参考视频拆解成可复用提示词和可视化故事板控制图

video-to-prompt
图像

Video Storyboard Control Board

Muke Labs

生成视频制作前的分镜与构图控制板

text-to-imageimage-to-image
视频

Video Watermark Remover

Alibaba

强力去水印:适合移动水印、复杂 背景和更稳的区域重绘

video-inpaint
音频

Voice Clone

ElevenLabs

用短音频样本生成一致的品牌声音

voice-clone
视频

Wan 2.7

Alibaba

适合中文语义、艺术视频和多镜头创作

text-to-videoimage-to-videoomni-reference
视频

Wan 3.0

Alibaba

支持文本、首尾帧与混合媒体参考的原生音频视频生成

text-to-videoimage-to-videoomni-reference
视频

Wan VACE

Alibaba

标准去水印:适合一般视频水印,也可做局部修改和替换

video-inpaint