教學

PixVerse CLI:在終端中生成 AI 影片和影像

最後更新於
PixVerse CLI:在終端中生成 AI 影片和影像

PixVerse CLI 把 AI 影片、影像、語音和音樂生成直接帶入了終端工作流。你不再需要在瀏覽器介面和開發環境之間來回切換,而是可以在編寫程式碼、執行構建、管理部署的同一個命令列裡建立、管理和下載 AI 內容。

本指南將介紹安裝、身份驗證、每一種生成模式,以及讓 CLI 在生產環境中真正發揮作用的自動化模式——包括與 AI 智慧體的整合。

為什麼需要命令列工具?

基於瀏覽器的生成介面適合探索和一次性專案,但有幾種場景需要不同的處理方式:

  • 批次生成 —— 基於一個範本提示詞生成幾十個變體
  • 流水線整合 —— 將生成過程嵌入 CI/CD 或內容流水線
  • 指令碼化 —— 將生成與檔案管理、後期處理或部署結合起來
  • 可復現性 —— 把提示詞和參數儲存在受版本控制的指令碼中,而不是瀏覽器歷史記錄裡
  • 智慧體驅動的工作流 —— 讓 Claude Code、Cursor 或 Codex 代替你完成更大任務中的媒體生成部分
  • 遠端操作 —— 在無圖形介面的伺服器或雲實例上生成內容

PixVerse CLI 正是圍繞這份清單打造的,並且特別側重智慧體驅動的場景:命令返回結構化 JSON,退出碼可預測,每一步都被設計成可以由指令碼或自主智慧體組合呼叫,而不是依賴人工點選介面。

前置條件

開始之前,你需要:

  • Node.js 20 或更高版本 —— 使用 node --version 檢查
  • 一個 PixVerse 帳戶 —— 前往 pixverse.ai 註冊
  • 有效的 PixVerse 訂閱 —— CLI 使用與官網相同的積分系統,因此生成內容需要訂閱帳戶

無需手動複製貼上 API 金鑰。身份驗證通過瀏覽器完成,並將憑證儲存在本地。

快速上手

安裝

使用 npm 全域性安裝 CLI:

npm install -g pixverse

確認安裝成功:

pixverse --version

如果不想全域性安裝,也可以按需通過 npx 執行命令:

npx pixverse create video --prompt "A cat walking on Mars"

身份驗證

使用以下命令登入:

pixverse auth login

這會開啟瀏覽器視窗進行 OAuth 授權。如果你在通過 SSH 操作或使用無圖形介面的機器,登入流程也會給出一個連結,你可以在任意裝置的瀏覽器中開啟它完成授權。授權完成後,令牌會儲存到 ~/.pixverse/,有效期為 30 天。

檢查登入狀態和可用積分:

pixverse auth status
pixverse account info
pixverse account slots

account info 會顯示你的訂閱等級和工作區積分。account usage 詳細列出積分消耗情況,account slots 則告訴你可以併發執行多少個生成任務——在啟動批次任務前值得先查一下。CLI 會話與瀏覽器或應用會話互不共享狀態,因此退出 CLI 登入(pixverse auth logout)不會影響你的其他會話。

快速開始

如果你只想以最快的方式從零安裝到生成第一份成品,可以按以下順序操作:

npm install -g pixverse
pixverse auth login
pixverse create image --prompt "A photorealistic forest path at golden hour" --json
pixverse create video --prompt "A sunset over ocean waves" --model v6 --quality 720p --duration 5 --json

對於指令碼和智慧體場景,請始終開啟 --json(或其簡寫 -p),這樣標準輸出會保持乾淨、可解析,而進度資訊和錯誤則會輸出到 stderr。如果某個任務可能被重複提交——比如網路不穩定或 CI 步驟重試——可以加上 --idempotency-key <key>,避免因重複提交而被重複扣費。

生成影像

文生圖是驗證環境是否配置正確的最快方式:

pixverse create image --prompt "A photorealistic forest path at golden hour" --json

目前預設的影像模型是 GPT Image 2,但對於任何計劃反覆執行的任務,建議顯式設定 --model,而不是依賴預設值——預設模型會隨著新模型上線而變化。--json 會返回可以直接傳入下一步的響應:

{
  "image_id": 789012,
  "status": "completed",
  "image_url": "https://...",
  "prompt": "A photorealistic forest path at golden hour",
  "model": "gpt-image-2.0",
  "width": 1440,
  "height": 1440
}

如需更高解析度,可以選用支援該解析度的模型:

pixverse create image \
  --prompt "A photorealistic forest path at golden hour" \
  --model seedream-5.0-lite \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json

影像模型陣容覆蓋了多種不同的使用場景:

模型 --model 值 質量 說明
GPT Image 2 gpt-image-2.0 1080p、1440p、2160p 預設模型;支援多種寬高比
Nano Banana 2 gemini-3.1-flash 512p、1080p、1440p、2160p 支援 auto 寬高比及標準比例
Qwen Image qwen-image 720p、1080p 適合日常創作,速度快
Nano Banana Pro gemini-3.0 1080p、1440p、2160p 更大尺寸下的高質量輸出
Nano Banana gemini-2.5-flash 1080p 輕量級、快速生成
Seedream 5.0 Lite seedream-5.0-lite 1440p、1800p、2160p 高細節創意影像
Seedream 4.5 seedream-4.5 1440p、2160p 高解析度生成
Seedream 4.0 seedream-4.0 1080p、1440p、2160p 影像工作流的另一選擇
Kling Image O3 kling-image-o3 1080p、1440p、2160p 風格化輸出,取景靈活
Kling Image V3 kling-image-v3 1080p、1440p 質量與速度兼顧

你也可以把已有影像重新輸入並進行轉換:

pixverse create image \
  --prompt "Turn this product photo into a clean watercolor illustration" \
  --image ./product-photo.png \
  --model gpt-image-2.0 \
  --json

然後將檔案下載到本地:

pixverse asset download 789012

生成影片

文字轉影片的流程與影像生成類似。快速生成一段 5 秒的短片:

pixverse create video --prompt "A sunset over ocean waves" --json

或者進行完整參數配置:

pixverse create video \
  --prompt "A cinematic drone shot over a misty mountain valley at dawn" \
  --model v6 \
  --quality 1080p \
  --aspect-ratio 16:9 \
  --duration 8 \
  --audio \
  --json

--audio 會新增與畫面相匹配的 AI 生成環境音。生成完成後,JSON 響應中會包含 video_url,你可以直接傳給下載步驟或流水線的下一環節。

不同影片模型在解析度上限、時長範圍以及所支援的生成模式方面差異很大:

模型 --model 值 最高質量 時長 說明
PixVerse V6 v6 1080p 1–15 秒 預設影片模型;寬高比支援廣泛
PixVerse C1 pixverse-c1 1080p 1–15 秒 在影片、參考、轉場模式上表現強勁
Seedance 2.0 Standard seedance-2.0-standard 2160p 4–15 秒 支援影片、參考、轉場模式
Seedance 2.0 Fast seedance-2.0-fast 720p 4–15 秒 更快的 Seedance 選項
Seedance 2.0 Mini seedance-2.0-mini 720p 4–15 秒 輕量級 Seedance 選項
Happy Horse 1.0 happyhorse-1.0 1080p 3–15 秒 支援音訊感知的影片生成
Kling O3 Pro kling-o3-pro 720p 3–15 秒 支援影片、參考、轉場工作流
Kling O3 Standard kling-o3-standard 720p 3–15 秒 標準版 Kling O3
Kling 3.0 Pro kling-3.0-pro 720p 3–15 秒 支援影片和轉場工作流
Kling 3.0 Standard kling-3.0-standard 720p 3–15 秒 標準版 Kling 3.0
Grok Imagine 1.5 grok-imagine-1.5 720p 1–15 秒 僅支援圖片轉影片;輸出比例跟隨輸入影像
Grok Imagine grok-imagine 720p 1–15 秒 較早期的 Grok 選項;支援影片、延長、參考功能
Veo 3.1 Lite veo-3.1-lite 1080p 4、6 或 8 秒 支援影片及雙幀轉場
Veo 3.1 Standard veo-3.1-standard 2160p 4、6 或 8 秒 更高解析度的 Veo 版本
Veo 3.1 Fast veo-3.1-fast 2160p 4、6 或 8 秒 更快速的 Veo 版本
Sora 2 Pro sora-2-pro 1080p 4、8 或 12 秒 固定時長的 Sora 版本
Sora 2 sora-2 720p 4、8 或 12 秒 標準版 Sora
PixVerse v5.6 v5.6 1080p 1–10 秒 用於動作控制和部分生成工作流
PixVerse v5.5 v5.5 1080p 1–10 秒 用於 create modify
PixVerse v5 v5 1080p 1–10 秒 用於三幀及以上轉場

讓靜態影像動起來

傳入 --image 參數即可把一張照片或生成的影像變成影片:

pixverse create video \
  --prompt "Gentle wind moves through the scene" \
  --image ./product-photo.jpg \
  --model v6 \
  --quality 1080p \
  --json

--image 既可以指向本地檔案路徑,也可以指向遠端 URL——本地檔案會自動上傳,無需單獨的上傳步驟。任何超過 1920×1920 或 5MB 的影像都會在上傳前自動調整大小或壓縮;遠端 URL 則會按原樣由後端校驗。

Grok Imagine 1.5 是一個特殊情況:它要求必須傳入 --image,並且輸出寬高比會鎖定為源影像的比例:

pixverse create video \
  --prompt "Slow camera push-in, subtle fabric motion, clean native ambience" \
  --image ./campaign-poster.png \
  --model grok-imagine-1.5 \
  --quality 720p \
  --duration 6 \
  --json

參考、轉場、動作控制與範本

除了簡單的文字轉影片和圖片轉影片之外,CLI 還提供了幾種更專業的生成模式,適用於需要對角色、關鍵幀或特效進行更精細控制的場景:

# 在关键帧之间创建转场
pixverse create transition --images ./frame1.png ./frame2.png

# 从文本生成语音
pixverse create voice --text "Welcome to the launch" --voice-id <preset_voice_id> --output ./voiceover.mp3

# 从提示词生成音乐
pixverse create music --prompt "A cinematic synth-pop intro with bright percussion" --auto-lyrics
pixverse create music --prompt "Uplifting piano theme for a product reveal" --instrumental --duration-seconds 60

# 延长已生成的视频
pixverse create extend --video <video_id>

# 修改已有视频
pixverse create modify --video <video_id> --prompt "Change the background to a beach"

# 提升视频分辨率
pixverse create upscale --video <video_id> --quality 1080p

# 使用参考图像生成视频
pixverse create reference --images ./char1.png ./char2.png --prompt "Two friends walking in a park"

# Seedance 2.0 的参考模式可以混合图像和视频输入
pixverse create reference \
  --model seedance-2.0-standard \
  --images ./character.png \
  --videos ./motion.mp4 \
  --prompt "@image1 follows the motion in @video1"

# Seedance 2.0 模型最多支持 9 张参考图像
pixverse create reference \
  --model seedance-2.0-standard \
  --images ./char1.png ./char2.png ./char3.png ./char4.png \
  --prompt "@image1 and @image2 walk through the scene together"

# 通过角色图像和动作参考视频进行动作控制
pixverse create motion-control --image ./character.png --video ./dance.mp4

# 从模板或特效创建内容
pixverse create template --template-id 12345 --image ./photo.png

不同模式對模型的支援並不統一,在寫指令碼之前瞭解這些邊界很重要:create video 支援 v6、pixverse-c1、全部三檔 Seedance 2.0、Happy Horse 1.0、兩檔 Kling O3、兩檔 Kling 3.0、兩種 Grok Imagine 版本、全部三檔 Veo 3.1、兩檔 Sora 2 以及 v5.6。grok-imagine-1.5 只能用於圖片轉影片,並且始終需要 --image。create extend 僅限於 v6 和 grok-imagine。create reference 支援 v6、pixverse-c1、Seedance 2.0 各檔、Kling O3、grok-imagine 以及 v5.6。雙幀轉場適用於較新的影片系列,而三幀及以上轉場需要 v5。create modify 基於 v5.5 構建,create motion-control 則執行在 v5.6 上。

生成語音和音樂

獨立的音訊生成由兩個專用命令提供:create voice 用於文本轉語音,create music 用於提示詞驅動的音樂生成。二者的輸出都會儲存為音訊資產,因此可以用 task 追蹤進度,用 asset list --type audio 列出,用 asset download 下載。如果你只是想給影片加上環境音,請在支援的影片生成命令上使用 --audio / --no-audio——這與上述獨立音訊命令是完全不同的路徑。

生成一段語音:

pixverse create voice \
  --text "Welcome to the launch. Here is what changed this week." \
  --model speech-2.8-hd \
  --voice-id <preset_voice_id> \
  --output ./voiceover.mp3 \
  --json

在正式使用某個模型之前,先列出可用的語音模型和預設音色:

pixverse voice models --json
pixverse voice presets --model speech-2.8-hd --json

生成一段音樂:

pixverse create music \
  --prompt "A bright cinematic synth-pop track for a 30-second product reveal" \
  --auto-lyrics \
  --duration-seconds 30 \
  --json

新增 --instrumental 可以生成無人聲的純音樂。如果需要指定歌詞,--lyrics 支援接收字面文本、本地檔案路徑,或通過管道傳入的標準輸入:

pixverse create music \
  --prompt "Uplifting electronic pop with a confident chorus" \
  --lyrics ./lyrics.txt \
  --json

目前的語音選項涵蓋 MiniMax Speech 2.8 和 ElevenLabs 系列,音樂生成則來自 MiniMax Music、ElevenLabs Music 和 Google Lyria 3 Pro。由於這些模型陣容會隨時間變化,在編寫可複用指令碼之前,建議先執行 pixverse voice models 和 pixverse music models 檢視當前可用的模型。

互動式嚮導

如果你還在熟悉有哪些參數可用,可以不帶任何參數直接執行生成命令:

pixverse create video
pixverse create image

這會進入一個引導式嚮導,逐步引導你完成提示詞、模型、質量、寬高比、時長以及其他相關選項的設定——是在正式寫入指令碼前發現可用參數的好方法。

管理資產和工作區

生成只是整個體驗的一部分。CLI 還提供了圍繞生成流程的管理命令:

  • pixverse task status <id> 和 pixverse task wait <id> 用於輪詢單個任務
  • pixverse task status --ids 123,456,789 --type video --json 可以在一次呼叫中檢查多個任務
  • pixverse asset list、asset upload、asset info、asset download 和 asset delete 涵蓋影片、影像和音訊資產的全生命週期操作
  • pixverse saved list、saved items、saved new、saved rename、saved add、saved remove 和 saved delete 用於管理收藏資料夾
  • pixverse template categories、template list、template search 和 template info 用於瀏覽特效和範本
  • pixverse voice models、voice presets 和 music models 用於即時發現可用的音訊模型
  • pixverse workspace list、workspace status、workspace switch 和 workspace manage 用於多工作區場景
  • pixverse account info、account usage 和 account slots 用於檢查積分、用量和併發情況
  • pixverse config set、config list、config path 和 config defaults 用於設定可複用的本地預設值

有了這些命令,一個指令碼就可以處理內容建立、組織整理、範本發現、下載以及工作區路由,全程無需離開終端。如果某次呼叫需要指向預設工作區以外的其他工作區,可以加上 --workspace-id <id>(0 表示個人工作區)。

值得了解的指令碼化參數

自動化場景下,可預測的輸出比任何東西都重要。以下這些參數在指令碼和智慧體工作流中會頻繁用到:

參數 用途
--json 返回結構化 JSON 輸出
-p --json 的簡寫形式
--count <n> 從單次請求生成 1–4 個變體
--seed <number> 讓生成結果更易復現
--off-peak 在可用時使用非高峰定價
--audio / --no-audio 在支援的影片生成命令上切換音訊
--multi-shot / --no-multi-shot 切換影片的多鏡頭模式
--no-wait 提交任務後立即返回,而不阻塞等待
--timeout <sec> 設定輪詢超時時間(預設 300 秒)
--workspace-id <id> 為單次命令覆蓋當前活動工作區
--trace-id <uuid> 為請求附加呼叫方提供的 UUIDv4,便於除錯
--idempotency-key <key> 安全地重試生成請求,避免重複扣費

文本輸入類參數現在可以接受不僅僅是內聯字串。--prompt、--text 和 --lyrics 都可以接收字面字串、本地檔案路徑,或使用 - 從標準輸入讀取:

pixverse create video --prompt ./scene.txt --json
cat scene.txt | pixverse create image --prompt - --json
echo "Hello from the command line" | pixverse create voice --text - --json
pixverse create music --prompt "Bright synth-pop" --lyrics ./lyrics.txt --json

教你的 AI 智慧體生成媒體內容

這正是 CLI 從便利工具躍升為能力倍增器的地方。由於每個命令都返回結構化 JSON,並以確定性的退出碼結束,任何能夠執行 shell 命令的智慧體都可以被訓練來代替你生成影像、影片、語音和音樂。

安裝 PixVerse Skills

PixVerse Skills 是一個專門打造的技能庫,用於教智慧體掌握 CLI 的參數、模型限制、多步驟流水線以及錯誤處理模式,而不是讓智慧體自己從幫助文本里瞎猜。

對於 Claude Code 和其他支援技能格式的工具:

npx skills add https://github.com/pixverseai/skills --skill pixverse-ai-image-and-video-generator

載入完成後,智慧體就擁有了明確的約束條件,而不必靠試錯來推斷行為——這對 Cursor、Claude Code、Codex 等框架中的可靠性至關重要。

CLI 還在 dist/capabilities.json 中提供了一份緊湊的機器可讀清單,原始檔以 capabilities.json 的形式釋出在 GitHub 上。它記錄了每個命令、參數、退出碼以及預期的 JSON 結構,讓智慧體可以直接檢查 CLI 的契約,而不必抓取 --help 文本。

載入了 PixVerse Skills 之後,你可以給智慧體下達這樣的自然語言指令:

  • “根據這張截圖生成一段 10 秒的產品演示影片”
  • “為這張部落格封面圖生成四個 16:9 格式的變體”
  • “把這張圖表動畫化成一段帶環境音的 5 秒講解短片”
  • “生成三段不同運鏡方式的 8 秒 16:9 宣傳短片”

智慧體會把這些指令轉化為正確的 CLI 呼叫,解析 JSON 響應,處理輪詢並下載結果——中間不需要任何人工介入。

Claude Code

在 Claude Code 中,CLI 會成為智慧體自主使用的工具。載入 PixVerse Skills 之後,你可以把媒體生成融入任何任務中:

Generate a cover image for this blog post about machine learning,
use the seedream-5.0-lite model at 2160p in 16:9 format,
download it to ./assets/cover.webp

Claude Code 會執行正確的命令,從 JSON 中提取影像 URL,並將檔案儲存到你指定的路徑——所有這些都發生在它同時編輯你程式碼的同一個會話中。

一個典型的工作流示例:

# Claude Code 会根据你的指令自主执行以下操作
IMG=$(pixverse create image \
  --prompt "Abstract visualization of neural network layers, dark background, blue and purple tones" \
  --model seedream-5.0-lite \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json | jq -r '.image_url')

# 然后将其动画化
pixverse create video \
  --prompt "Slow pan across glowing neural connections" \
  --image "$IMG" \
  --model v6 \
  --quality 1080p \
  --duration 6 \
  --json

Cursor

在 Cursor 中,把 PixVerse Skills 放入 .cursor/ 目錄,或新增到工作區規則裡。此後,Cursor 就能瞭解每一個 CLI 命令,並可以在任何編碼任務中生成媒體內容,而無需離開編輯器——一個常見的用法是讓它為你正在構建的設計生成一張模擬圖,然後在同一會話中直接引用這張圖。

Codex 及其他智慧體

任何能夠執行 shell 命令並解析 JSON 的智慧體都可以驅動這個 CLI。一致的欄位命名、可預測的錯誤碼,以及獨立輸出在 stderr 上的錯誤資訊,意味著即便是簡單的指令碼化智慧體也能順利整合生成功能,無需做特殊處理。

退出碼為智慧體提供了清晰的決策路徑:

程式碼 含義 智慧體應採取的行動
0 成功 解析 JSON 輸出
1 一般錯誤 檢查 stderr 並使用校驗後的輸入重試
2 超時 使用更長的 --timeout 重試
3 授權過期 重新執行 pixverse auth login
4 積分不足 檢查餘額並通知使用者
5 生成失敗 嘗試不同的參數
6 校驗錯誤 檢查參數取值

自動化流水線

一旦熟悉了各個獨立命令,真正的價值就會體現在那些無需人工值守就能執行的多步驟流水線中。

文生圖再生成影片

生成一張高解析度影像,然後將其動畫化:

# 第一步:生成基础图像
IMG_RESULT=$(pixverse create image \
  --prompt "A cyberpunk cityscape at night, neon lights reflecting on wet pavement" \
  --model gemini-3.1-flash \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json)

IMAGE_URL=$(echo "$IMG_RESULT" | jq -r '.image_url')

# 第二步:将其动画化为视频
VID_RESULT=$(pixverse create video \
  --prompt "Camera slowly pans across the neon-lit streets" \
  --image "$IMAGE_URL" \
  --model v6 \
  --quality 1080p \
  --duration 8 \
  --json)

VIDEO_ID=$(echo "$VID_RESULT" | jq -r '.video_id')

# 第三步:下载最终视频
pixverse asset download "$VIDEO_ID" --json

完整影片製作流水線

如果想要更精緻的成品,可以把生成與後期處理串聯起來。當支援的影片模型自帶的原生音效已經足夠時,使用 --audio 或 --no-audio;當你需要一份獨立的音訊資產用於後續合成時,使用 create voice 或 create music:

# 第一步:创建基础视频
RESULT=$(pixverse create video \
  --prompt "A product being assembled in slow motion" \
  --model v6 \
  --quality 720p \
  --duration 5 \
  --audio \
  --json)

VID=$(echo "$RESULT" | jq -r '.video_id')

# 第二步:延长时长
EXTENDED=$(pixverse create extend \
  --video "$VID" \
  --json | jq -r '.video_id')

pixverse task wait "$EXTENDED" --json

# 第三步:升级到 1080p
FINAL=$(pixverse create upscale \
  --video "$EXTENDED" \
  --quality 1080p \
  --json | jq -r '.video_id')

pixverse task wait "$FINAL" --json

# 第四步:下载
pixverse asset download "$FINAL" --json

# 可选:单独创建一段配音资产
pixverse create voice \
  --text "The final reveal starts now." \
  --voice-id <preset_voice_id> \
  --output ./voiceover.mp3 \
  --json

批次生成

對於需要同時生成多個變體的內容流水線,可以併發執行任務,而不是逐一序列處理:

# 先检查积分和并发生成槽位
pixverse account info --json
pixverse account slots --json

# 并发提交四个生成任务
pixverse create video --prompt "Sunrise over mountains" --no-wait --json > /tmp/v1.json &
pixverse create video --prompt "Sunset over ocean" --no-wait --json > /tmp/v2.json &
pixverse create video --prompt "Stars over a desert" --no-wait --json > /tmp/v3.json &
pixverse create video --prompt "Aurora over a frozen lake" --no-wait --json > /tmp/v4.json &
wait

# 在一次批量调用中检查所有返回的任务 ID
IDS=$(jq -r '.video_id' /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json | paste -sd, -)
pixverse task status --ids "$IDS" --type video --json

# 逐个等待并下载
for f in /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json; do
  ID=$(jq -r '.video_id' "$f")
  pixverse task wait "$ID" --json
  pixverse asset download "$ID" --json
done

--no-wait 會在提交任務後立即返回任務 ID,讓你可以先排隊提交多個任務,再統一進行輪詢。記錄每次 --no-wait --json 響應中的任務 ID 和已解析的參數——這份記錄正是讓批次任務日後可復現的關鍵。當需要從單個提示詞生成多個變體時使用 --count <n>;當你希望用一次狀態查詢覆蓋多個正在執行的任務,而不是逐一輪詢時,使用批次的 task status --ids。pixverse task wait 會自動為你處理自適應輪詢。

配置預設值

如果你發現自己在每次呼叫中都在重複設定同樣的模型、質量或寬高比,不妨一次性設定好:

pixverse config defaults set video model v6
pixverse config defaults set video quality 1080p
pixverse config defaults set image model seedream-5.0-lite
pixverse config set output-dir ~/Downloads/pixverse
pixverse config defaults show
pixverse config list
pixverse config path

命令列中的參數始終優先於已配置的預設值,因此設定預設值並不會犧牲任何靈活性。如果某次執行需要針對非預設工作區,可以在預設設定之上再加上 --workspace-id <id>。

你可以構建什麼

把 CLI 接入智慧體或指令碼之後,能實現的自動化範圍相當廣泛:

  • 文件編寫 —— 在文件構建流程中自動生成產品演示影片和截圖
  • 行銷 —— 每晚執行批次任務,從一個提示詞庫生成多種社群媒體內容變體
  • 應用開發 —— 讓編碼智慧體在你構建實際介面的同時,生成佔位視覺素材、模擬動畫或載入頁面影片
  • 音訊工作流 —— 生成配音草稿、提示詞轉音樂曲目,或用於後期編輯的獨立音訊資產
  • 內容流水線 —— 將 CLI 呼叫與 ffmpeg、ImageMagick 或雲端儲存工具串聯,構建完全自動化的製作流水線
  • 原型驗證 —— 幾秒鐘內生成快速的動態概念,在投入完整製作之前先驗證想法

由於本質上只是 shell 命令,這個 CLI 可以無縫嵌入 bash、Python、Node 或 CI/CD 流程,無需任何額外的整合工作。

快速上手清單

  • 安裝 Node.js 20 或更高版本
  • 執行 npm install -g pixverse
  • 執行 pixverse auth login 並在瀏覽器中完成授權
  • 執行 pixverse account info 確認積分
  • 在併發批次任務前執行 pixverse account slots
  • 生成你的第一張影像:pixverse create image --prompt "..." --json
  • 生成你的第一段影片:pixverse create video --prompt "..." --json
  • 生成你的第一段語音資產:pixverse create voice --text "..." --json
  • 生成你的第一段音樂資產:pixverse create music --prompt "..." --json
  • 使用 pixverse template list 瀏覽範本
  • 為你的智慧體(Claude Code、Cursor 或 Codex)安裝 PixVerse Skills
  • 使用 pixverse config defaults set 設定你偏好的預設值
  • 構建你的第一條自動化流水線

保持 CLI 最新

使用內建更新命令保持本地 CLI 為最新版本:

pixverse update

也可以直接通過 npm 更新:

npm install -g pixverse@latest

模型和參數的變化速度往往比大多數文件都快,因此對於釋出級別的變更,請直接檢視官方來源:

截至本次更新,PixVerse V6 仍是預設影片模型,GPT Image 2 仍是預設影像模型,同時 Seedance 2.0 Mini、專用的 create voice/create music 命令、音訊資產管理、收藏資料夾、工作區切換、config defaults、capabilities.json 清單、pixverse update、文本輸入的標準輸入支援,以及 --trace-id 和 --idempotency-key 都已成為當前工具集的一部分。

CLI 帶來的可能性

PixVerse CLI 把 AI 媒體生成從一項手動的、基於瀏覽器的任務,轉變為一個可程式設計的生產工具——而且越來越多地,變成了你的編碼智慧體在你無需提示的情況下就能主動完成的能力。無論你是在編寫批次內容指令碼、把生成過程接入 CI/CD 流水線,還是教 Claude Code 在任務執行過程中順手抓取一張封面圖,這個 CLI 都為生產工作流提供了它們真正需要的介面。

相關資源

→ 立即開始使用 PixVerse CLI