1. 开始使用
拍我AI 开放平台
  • 开始使用
    • API介绍
    • 模型能力地图
    • 了解计费和用量
    • 快速开始
    • 联系我们
    • 服务条款
    • 隐私政策
  • API
    • 前置准备
      • 开始使用
      • 并发规则
      • 查询任务状态说明
      • 错误码
      • FAQ
      • Webhook 回调
      • 上传图片
      • 上传资源(视频/音频)
      • 获取特效模板列表
      • 获取 TTS 音色列表
      • 获取视频重绘列表
      • 获取用量扣减情况
      • 查询任务状态
    • 基础能力
      • 文生视频
      • 图生视频 / 视频模板
      • 图片模版生成
      • 首尾帧生成视频
      • 多主体多参考图 / 视频参考
      • 智能多帧 / 多帧过渡视频
      • 视频延长 Extend
    • 解决方案
      • 超清视频
      • 视频重绘 Restyle
      • 对口型 Lipsync
      • 音效生成 Sound Effect
      • Mask 生成
      • 主体替换 Swap
      • 视频编辑 Modify
      • 动作模仿 Motion Control
      • 图片数字人 Avatar
      • 爆款复刻 Agent
      • 房产视频一键成片Agent
      • 一键音乐MV(Music Video)
  • 计费
    • PixVerse API 计费规则
  • 更新日志
    • 更新日志
  1. 开始使用

API介绍

什么是PixVerse AI#

PixVerse AI开放平台提供领先的 AI 视频生成能力,开发者可通过标准 API,将视频生成能力集成到自己的产品中,用于内容创作、生产,互动娱乐,电商、广告等场景。
平台基于PixVerse AI在生成式视频领域的技术积累,提供从文本、图片到视频的多种生成能力,支持高质量、低延迟的视频内容创作。
访问开放平台:
https://platform.pai.video

PixVerse AI 开放平台功能特性#

1.
多场景视频生成能力
PixVerse 已通过 PixVerse API 平台开放,为开发者提供覆盖文生视频、图生视频、首尾帧生成、视频参考和视频延长等场景的视频生成能力。根据具体接口与生成模式,支持最长 15 秒的视频输出,并可选择不同画幅、时长和清晰度;
2.
更真实、连贯的生成效果
进一步提升了对人物、物体运动、镜头语言、空间关系和物理规律的理解能力。人物场景能够更稳定地呈现面部表情与动作细节;在高速运动、翻滚跳跃、追逐和复杂镜头运动等场景中,也能保持更好的主体一致性和画面连贯性,减少穿模、动作干扰和结构失真。
3.
丰富的 API 控制参数
API 提供了较完整的生成控制能力。开发者可以根据不同接口配置提示词、画幅比例、生成时长、清晰度、随机种子、镜头运动及声音等参数,也可以通过上传图片、上传视频或引用已有生成任务,将素材 ID 直接用于后续生成。
4.
视频参考与创意复用
视频参考能力可以结合参考视频与多张图片,复用原视频的镜头节奏、动作设计或视觉结构,适用于商品视频复刻、创意迁移、角色替换和批量营销内容生产。
5.
标准化的异步任务流程
开发者提交生成请求后可获得视频任务 ID,并通过任务查询接口或 Webhook 持续获取处理状态。只有任务进入成功状态且生成的视频地址可以正常访问,才代表一次完整调用成功。
6.
灵活集成业务系统
统一的鉴权、素材上传、异步任务和结果查询机制,便于将 PixVerse集成到内容创作平台、营销工具、视频编辑产品及自动化内容生产流程中。

核心能力#

文生视频(Text-to-Video)通过自然语言描述生成完整视频内容。#

开发者仅需提供 Prompt,即可自动生成具有场景、人物、动作和镜头表现的视频。
适用于:
AI 创作平台
内容生产工具
营销素材生成
短视频应用

图生视频(Image-to-Video)基于参考图片生成动态视频。#

开发者可上传图片素材,通过提示词控制视频内容与运动表现。
支持:
人像动画
IP 形象动态化
商品展示动画
二次元角色演绎

视频模板(Video Templates)提供丰富的视频模板与热门特效能力。#

开发者可通过 template_id 选择模板,无需编写复杂提示词,即可快速生成变身特效、社交媒体玩法、节日主题视频和创意营销内容。

多主体生成支持多人、多角色场景生成。#

能够更准确地保持人物关系、动作交互与场景一致性,适用于剧情类和角色类内容创作。

动作与镜头控制#

帮助开发者获得更稳定、更符合预期的视频效果。
支持丰富的运动表达能力:
运镜控制
镜头推进
镜头拉远
人物动作引导
场景运动控制

音频与口型驱动#

可用于数字人、虚拟主播、互动角色等场景。
支持:
背景音乐生成
音效生成
口型同步
语音驱动角色说话

修改于 2026-09-04 06:46:31
下一页
模型能力地图
Built with