模型
每个模型都跑在同一套任务式 API 之后。按模态筛选,或按名称、供应商、能力搜索。
AI Music 2.5
ElevenLabs
根据文字描述生成背景音乐和完整曲段
Audio to MP3
Muke Labs
把常见音频上传转换成独立 MP3 文件
Auto Video Watermark Remover
Alibaba
上传视频即可自动去除水印、字幕和角标,无需手动画遮罩
Character Concept Board
Muke Labs
为视频连贯性生成多人物三视图设定板
Claude Fable 5.1
Anthropic
Claude Fable 5.1
Claude Opus 4.5
Anthropic
旧 Claude Opus,适合长文审阅和分析
Claude Opus 4.6
Anthropic
上一代 Claude Opus,适合代码和研究对比
Claude Opus 4.7
Anthropic
Claude 最新 Opus,适合长期智能体和深度分析
Claude Opus 5.5
Anthropic
Claude Opus 5.5
Claude Sonnet 4.6
Anthropic
低成本 Claude Sonnet,适合写作、审阅和深度分析
Claude Sonnet 5.5
Anthropic
Claude Sonnet 5.5
DeepSeek V3.1 Terminus
DeepSeek
旧 DeepSeek V3.1 版本,方便代际输出对比
DeepSeek V3.2
DeepSeek
上一代 DeepSeek,适合低成本中文问答和代码协助
DeepSeek V4 Flash
DeepSeek
适合高频推理、中文问答和快速分析
DeepSeek V4 Pro
DeepSeek
DeepSeek 最新 Pro,适合高级推理、代码和中文分析
DeepSeek V4.1 Flash
DeepSeek
DeepSeek V4.1 Flash
Digital Human - HeyGen
HeyGen
用媒体素材加上传音频生成或重配数字人口型视频
Digital Human - InfiniTalk
InfiniTalk
用人像图片加人声音频生成数字人说话视频
Flux 2 Dev
Black Forest Labs
适合快速构思、草稿和提示词测试
Flux 2 Flex
Black Forest Labs
兼顾 Flux 2 质量与更灵活的图片工作流
Flux 2 Pro
Black Forest Labs
适合照片级商业图片和精准提示词执行
FLUX Inpainting
Black Forest Labs
用文字指令修改、替换或修补图片局部
Gemini 3 Flash Preview
旧 Gemini Flash 预览,适合快速多模态问答
Gemini 3.1 Flash Lite
低延迟 Gemini 3.1,适合高频日常任务
Gemini 3.1 Pro Preview
Gemini 最新 Pro 推理模型,适合多模态智能体任务
Google Omni Flash
支持原生音频的多模态视频生成、参考与编辑
GPT Image 2
OpenAI
适合营销图、产品图和高保真编辑
GPT Image 2.5
OpenAI
高细节图片生成与精准编辑
GPT-5.4
OpenAI
上一代 OpenAI 前沿模型,适合稳定高阶任务
GPT-5.5
OpenAI
OpenAI 最新前沿模型,适合复杂推理和代码
GPT-6 Astra
OpenAI
GPT-6 Astra
GPT-6 Luna
OpenAI
GPT-6 Luna
GPT-6.1 Sol
OpenAI
GPT-6.1 Sol
GPT-Image-1.5
OpenAI
适合透明背景、贴纸和自然语言图片编辑
Graphics Image Upscale
Muke Labs
放大海报与文字密集的图形,同时保持版面布局
Grok Imagine 2.0
xAI
适合风格强烈的快速创意图像
Grok Video
xAI
适合快速写实视频、动作和音效画面
Grok Video v1.5
xAI
最新版 Grok 图生视频,支持原生音频
Hailuo 2.3
MiniMax
适合电影质感短视频和图生视频
Happy Horse
Alibaba
适合带配音、音效和多语言口型同步的视频
High Fidelity Image Upscale
Muke Labs
为高要求源图进行精细细节增强
Kling
Kling
视频创作、特效、动作迁移与对口型
Kling 2.5
Kling
适合快速视频草稿和简单图生视频
Kling O1
Kling
Kling O1 —— 首末帧、全参考、视频参考与视频编辑
Kling O3
Kling
Kling O3 —— 图生视频、全参考、视频参考与视频编辑
LaMa Inpainting
Muke Labs
去除图片水印、杂物并修补背景
LTX Video 2.5
Lightricks
适合快速迭代、有原生音频的视频草稿
Magnific Upscaler
Magnific AI
把图片放大并补充更清晰的纹理细节
Midjourney
Midjourney
适合艺术插画、视觉概念和风格化创意图
MiniMax H3
MiniMax
从文本或图像、视频、音频参考生成高细节视频
Nano Banana 2
适合高细节写实图、多参考合成和复杂场景
Nano Banana 2 Lite
快速的 1K 图片生成与编辑
Nano Banana Pro
适合专业排版、包装和文字密集型视觉设计
Outfit & Accessory Changer
Muke Labs
替换服装、包包、首饰等饰品,同时保留人物身份
Photo Angle Changer
Muke Labs
改变照片镜头角度,同时尽量保留主体身份和细节
Photo Background Changer
Muke Labs
替换照片背景,并自动匹配边缘、阴影和环境光
Photo Element Replacer
Muke Labs
用参考图替换原图中的元素、商品或人物;可选框选辅助定位
Photo Face Swap
Muke Labs
将参考人脸自然融合到目标照片,保留姿势、服装、背景和光影
Photo Lighting Changer
Muke Labs
调整光线、阴影和氛围,不改变主体和构图
Qwen 3.7 Flash
Alibaba
快速多模态 Qwen Flash,适合提示词改写和日常对话
Qwen 3.8 Flash
Alibaba Qwen
Qwen 3.8 Flash
Restore Image
Muke Labs
重建受损或低质量图像的清晰度
Seedance 2.0 Fast
ByteDance
适合低延迟预览和动作方案测试
Seedance 2.0 Standard
ByteDance
适合最终质量更高的动作和多参考视频
Seedance 2.5
ByteDance
单段最长 30 秒,支持多参考控制
Seedream 5.0 Lite
ByteDance
适合中文文字、艺术风格和多主体创作
Seedream 5.0 Pro
ByteDance
适合精准构图、主体一致和高保真最终成片
Sound FX
ElevenLabs
根据文字描述生成环境声和短音效
Standard Image Upscale
Muke Labs
适合日常图像的均衡放大
Suno Music
Suno
根据描述、歌词和 Persona 生成完整歌曲
TTS Flash
ElevenLabs
适合自然旁白、课程配音和社媒语音
Veo 3.1
适合真实感运动、镜头语言和原生音频视频
Video Audio Splitter
Muke Labs
从一个视频导出无声视频和独立 MP3 音轨
Video HD Upscaler
Topaz Labs
提升视频分辨率与清晰度,同时保留原始帧率
Video Prompt Storyboard Reverse Engineer
Muke Labs
把参考视频拆解成可复用提示词和可视化故事板控制图
Video Storyboard Control Board
Muke Labs
生成视频制作前的分镜与构图控制板
Video Watermark Remover
Alibaba
强力去水印:适合移动水印、复杂 背景和更稳的区域重绘
Voice Clone
ElevenLabs
用短音频样本生成一致的品牌声音
Wan 2.7
Alibaba
适合中文语义、艺术视频和多镜头创作
Wan 3.0
Alibaba
支持文本、首尾帧与混合媒体参考的原生音频视频生成
Wan VACE
Alibaba
标准去水印:适合一般视频水印,也可做局部修改和替换