บทช่วยสอน

PixVerse CLI: สร้างวิดีโอและภาพ AI ในเทอร์มินัล

อัปเดตล่าสุดเมื่อ
PixVerse CLI: สร้างวิดีโอและภาพ AI ในเทอร์มินัล

บทนำ

ทุกเวิร์กโฟลว์ครีเอทีฟมีคอขวด จังหวะที่คุณต้องออกจากตัวแก้ไขโค้ด เปิดเบราว์เซอร์ แล้วคลิกผ่านอินเทอร์เฟซเว็บด้วยมือเพื่อสร้างสื่อชิ้นหนึ่ง สำหรับนักพัฒนา เอเจนต์ AI และใครก็ตามที่สร้างไปป์ไลน์เนื้อหาอัตโนมัติ การสลับบริบทนั้นคือแรงเสียดทานที่สะสมเร็ว

PixVerse CLI กำจัดคอขวดนั้น เป็นอินเทอร์เฟซบรรทัดคำสั่งอย่างเป็นทางการของ PixVerse ให้คุณเข้าถึงการสร้างของ PixVerse และเวิร์กโฟลว์เวิร์กสเปซได้โดยตรงจากเทอร์มินัล ข้อความเป็นวิดีโอ ภาพเป็นวิดีโอ ข้อความเป็นภาพ ภาพเป็นภาพ ทรานซิชัน การสร้างเสียงพูด การสร้างเพลง วิดีโออ้างอิง การควบคุมการเคลื่อนไหว เทมเพลต การเพิ่มความละเอียด และการจัดการสินทรัพย์ เขียนสคริปต์ได้ ต่อท่อได้ และใช้ได้โดยไม่ต้องแตะเบราว์เซอร์ สำหรับเส้นทางติดตั้งที่สั้นที่สุดและภาพรวมการตั้งค่าเอเจนต์ เริ่มจาก หน้า PixVerse CLI อย่างเป็นทางการ

สิ่งที่ทำให้ PixVerse CLI มีประโยชน์เป็นพิเศษคือปรัชญาการออกแบบ มันถูกสร้างโดยคำนึงถึงเอเจนต์ AI คำสั่งส่งคืน JSON ที่มีโครงสร้างด้วย --json หรือ -p ได้ รหัสออกเป็นแบบกำหนดได้ และทุกขั้นของไปป์ไลน์ประกอบกันได้ นั่นหมายความว่าคุณสอน Claude Code, Cursor, Codex หรือเอเจนต์อื่นให้สร้างภาพ วิดีโอ เสียงพูด และเพลงแทนคุณได้ โดยมีการส่งต่องานที่เปราะน้อยลง

คู่มือนี้สอดคล้องกับ README บน GitHub ของ PixVerseAI/cli ฉบับปัจจุบัน รายการความสามารถ ที่เปิดสาธารณะ และหน้าผลิตภัณฑ์ PixVerse CLI ซึ่งตรวจเมื่อวันที่ 13 กรกฎาคม 2026 PixVerse CLI อัปเดตต่อเนื่องผ่านที่เก็บ GitHub ดังนั้นสคริปต์สำหรับโปรดักชันยังควรตรวจ pixverse --version, pixverse create <mode> --help และ pixverse update ก่อนรันชุดใหญ่

สิ่งที่ต้องมีก่อนเริ่ม

ก่อนเริ่ม คุณต้องมี:

  • Node.js 20 หรือสูงกว่า — ตรวจสอบด้วย node --version
  • บัญชี PixVerse — สมัครได้ที่ pixverse.ai
  • การสมัครสมาชิก PixVerse ที่ใช้งานอยู่ — CLI ใช้ระบบเครดิตเดียวกับเว็บไซต์ ผู้ใช้ที่สมัครสมาชิกเท่านั้นจึงสร้างเนื้อหาได้

PixVerse CLI ไม่ต้องคัดลอก API key ด้วยตนเอง การยืนยันตัวตนทำผ่านขั้นตอน OAuth บนเบราว์เซอร์ ซึ่งจัดเก็บโทเค็นของคุณไว้ในเครื่อง

ขั้นตอนที่ 1: ติดตั้ง CLI

ติดตั้งแบบทั่วทั้งระบบด้วย npm:

npm install -g pixverse

ตรวจสอบการติดตั้ง:

pixverse --version

หากไม่ต้องการติดตั้งแบบทั่วทั้งระบบ คุณสามารถรันคำสั่งผ่าน npx ได้เช่นกัน:

npx pixverse create video --prompt "A cat walking on Mars"

ขั้นตอนที่ 2: ยืนยันตัวตน

รันคำสั่งเข้าสู่ระบบ:

pixverse auth login

CLI จะเปิดเบราว์เซอร์เพื่อขอสิทธิ์แบบ OAuth device คุณสามารถคัดลอก URL แล้วทำการยืนยันจากเบราว์เซอร์ใดก็ได้บนอุปกรณ์ใดก็ได้ ซึ่งมีประโยชน์สำหรับ SSH และสภาพแวดล้อมแบบ headless โทเค็นของคุณจะถูกจัดเก็บอัตโนมัติใน ~/.pixverse/ และมีอายุ 30 วัน

เพื่อตรวจสอบว่าคุณเข้าสู่ระบบแล้ว และดูเครดิตที่เหลือ:

pixverse auth status
pixverse account info
pixverse account slots

คำสั่ง account info แสดงระดับการสมัครสมาชิก เครดิตของเวิร์กสเปซ และบริบทการใช้งาน pixverse account usage ช่วยให้คุณตรวจดูการใช้เครดิต ส่วน pixverse account slots แสดงช่องการสร้างภาพและวิดีโอพร้อมกันในปัจจุบัน เซสชัน CLI แยกจากเซสชันเว็บ/แอปของ PixVerse และคุณสามารถลบโทเค็น CLI ที่จัดเก็บไว้ได้ด้วย pixverse auth logout ตรวจสอบยอดคงเหลือและช่องที่ว่างอยู่เสมอก่อนรันงานแบบแบตช์

คำสั่งเริ่มต้นอย่างรวดเร็ว

หากคุณต้องการเส้นทางที่สั้นที่สุดตั้งแต่ติดตั้งจนได้ไฟล์ที่สร้างแล้ว ให้เริ่มด้วยลำดับนี้:

npm install -g pixverse
pixverse auth login
pixverse create image --prompt "A photorealistic forest path at golden hour" --json
pixverse create video --prompt "A sunset over ocean waves" --model v6 --quality 720p --duration 5 --json

สำหรับเวิร์กโฟลว์ของเอเจนต์และ CI ให้เปิด --json หรือ -p ไว้ เพื่อให้ stdout ยังอ่านด้วยเครื่องได้ ในขณะที่ความคืบหน้าและข้อผิดพลาดอยู่บน stderr สำหรับการลองใหม่ในระบบจริง ให้เพิ่ม --idempotency-key <key> ในคำสั่งสร้าง เพื่อไม่ให้การส่งซ้ำสร้างงานที่ถูกคิดเครดิตซ้ำโดยไม่ตั้งใจ

ขั้นตอนที่ 3: สร้างภาพแรกของคุณ

การสร้างภาพจากข้อความเป็นวิธีที่เร็วที่สุดในการทดสอบการตั้งค่า รัน:

pixverse create image --prompt "A photorealistic forest path at golden hour" --json

README บน GitHub ปัจจุบันระบุว่า GPT Image 2 เป็นโมเดลภาพเริ่มต้น สำหรับระบบอัตโนมัติที่ต้องทำซ้ำได้ ยังควรตั้ง --model อย่างชัดเจน และตรวจความช่วยเหลือของ CLI แบบสดหรือ capabilities.json ก่อนทำงานแบบแบตช์ แฟล็ก --json จะคืนผลลัพธ์แบบมีโครงสร้าง:

{
  "image_id": 789012,
  "status": "completed",
  "image_url": "https://...",
  "prompt": "A photorealistic forest path at golden hour",
  "model": "gpt-image-2.0",
  "width": 1440,
  "height": 1440
}

สำหรับเอาต์พุตความละเอียดสูงขึ้น ให้ระบุโมเดลที่รองรับ:

pixverse create image \
  --prompt "A photorealistic forest path at golden hour" \
  --model seedream-5.0-lite \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json

PixVerse รองรับโมเดลภาพหลายตัว แต่ละตัวมีเพดานความละเอียดและการรองรับอัตราส่วนภาพต่างกัน:

โมเดล ค่า --model คุณภาพ หมายเหตุ
GPT Image 2 gpt-image-2.0 1080p, 1440p, 2160p โมเดลภาพเริ่มต้น รองรับอัตราส่วนภาพแนวกว้างและแนวสูง
Nano Banana 2 gemini-3.1-flash 512p, 1080p, 1440p, 2160p auto ยืดหยุ่น และรองรับอัตราส่วนภาพมาตรฐาน
Nano Banana 2 Lite gemini-3.1-flash-lite 1080p ตัวเลือก Nano Banana 2 น้ำหนักเบาสำหรับเวิร์กโฟลว์ภาพที่ต้องการความเร็ว
Qwen Image qwen-image 720p, 1080p สร้างได้รวดเร็วสำหรับงานสร้างสรรค์ทั่วไป
Nano Banana Pro gemini-3.0 1080p, 1440p, 2160p สร้างภาพคุณภาพสูงในขนาดที่ใหญ่ขึ้น
Nano Banana gemini-2.5-flash 1080p สร้างภาพน้ำหนักเบาพร้อมรอบเวลาที่รวดเร็ว
Seedream 5.0 Pro seedream-5.0-pro 1080p, 1440p รองรับอัตราส่วนภาพมาตรฐานและเวิร์กโฟลว์ภาพอ้างอิงหลายภาพ
Seedream 5.0 Lite seedream-5.0-lite 1440p, 1800p, 2160p ภาพสร้างสรรค์รายละเอียดสูง
Seedream 4.5 seedream-4.5 1440p, 2160p สร้างภาพความละเอียดสูง
Seedream 4.0 seedream-4.0 1080p, 1440p, 2160p ตัวเลือก Seedream เพิ่มเติมสำหรับเวิร์กโฟลว์ภาพ
Kling Image O3 kling-image-o3 1080p, 1440p, 2160p ผลลัพธ์ภาพมีสไตล์พร้อมการจัดเฟรมที่ยืดหยุ่น
Kling Image V3 kling-image-v3 1080p, 1440p สมดุลระหว่างคุณภาพและความเร็ว

คุณยังสามารถแปลงภาพที่มีอยู่ด้วย image-to-image:

pixverse create image \
  --prompt "Turn this product photo into a clean watercolor illustration" \
  --image ./product-photo.png \
  --model gpt-image-2.0 \
  --json

หากต้องการดาวน์โหลดภาพที่สร้างแล้ว:

pixverse asset download 789012

ขั้นตอนที่ 4: สร้างวิดีโอแรกของคุณ

การสร้างวิดีโอจากข้อความทำงานในลักษณะเดียวกัน สร้างคลิปความยาว 5 วินาที:

pixverse create video --prompt "A sunset over ocean waves" --json

สำหรับการสร้างที่ปรับแต่งได้อย่างเต็มที่:

pixverse create video \
  --prompt "A cinematic drone shot over a misty mountain valley at dawn" \
  --model v6 \
  --quality 1080p \
  --aspect-ratio 16:9 \
  --duration 8 \
  --audio \
  --json

แฟล็ก --audio เปิดเสียงบรรยากาศที่ AI สร้างให้เข้ากับเนื้อหาวิดีโอ แฟล็ก --json จะคืน video_url เมื่อเสร็จสิ้น ซึ่งคุณส่งต่อไปยังคำสั่งดาวน์โหลดหรือขั้นตอนถัดไปในไปป์ไลน์ได้โดยตรง

PixVerse มีโมเดลวิดีโอหลายตัวที่รองรับคุณภาพ ระยะเวลา และโหมดต่างกัน:

โมเดล ค่า --model คุณภาพสูงสุด ระยะเวลา หมายเหตุ
PixVerse V6 v6 1080p 1–15 วินาที โมเดลวิดีโอเริ่มต้น รองรับอัตราส่วนภาพกว้าง
PixVerse C1 pixverse-c1 1080p 1–15 วินาที รองรับได้ดีทั้งเวิร์กโฟลว์วิดีโอ อ้างอิง และการเปลี่ยนฉาก
Seedance 2.0 Standard seedance-2.0-standard 2160p 4–15 วินาที รองรับโหมดวิดีโอ อ้างอิง และการเปลี่ยนฉาก
Seedance 2.0 Fast seedance-2.0-fast 720p 4–15 วินาที ตัวเลือก Seedance ที่เร็วกว่าสำหรับโหมดวิดีโอ อ้างอิง และการเปลี่ยนฉาก
Seedance 2.0 Mini seedance-2.0-mini 720p 4–15 วินาที ตัวเลือก Seedance น้ำหนักเบาสำหรับโหมดวิดีโอ อ้างอิง และการเปลี่ยนฉาก
Google Gemini Omni gemini-omni-flash 720p 3–10 วินาที รองรับเวิร์กโฟลว์วิดีโอและอ้างอิงใน 16:9 หรือ 9:16
Happy Horse 1.0 happyhorse-1.0 1080p 3–15 วินาที ตัวเลือกวิดีโอที่รับรู้เสียง ใช้ได้กับ create video
Kling O3 Pro kling-o3-pro 720p 3–15 วินาที รองรับเวิร์กโฟลว์วิดีโอ อ้างอิง และการเปลี่ยนฉาก
Kling O3 Standard kling-o3-standard 720p 3–15 วินาที ตัวเลือก Kling O3 มาตรฐาน
Kling 3.0 Pro kling-3.0-pro 720p 3–15 วินาที รองรับเวิร์กโฟลว์วิดีโอและการเปลี่ยนฉาก
Kling 3.0 Standard kling-3.0-standard 720p 3–15 วินาที ตัวเลือก Kling 3.0 มาตรฐาน
Grok Imagine 1.5 grok-imagine-1.5 720p 1–15 วินาที เฉพาะ image-to-video ต้องใช้ --image และยึดตามอัตราส่วนภาพของภาพอินพุต
Grok Imagine grok-imagine 720p 1–15 วินาที ตัวเลือก Grok รุ่นก่อนหน้า รองรับเวิร์กโฟลว์วิดีโอ การขยาย และอ้างอิง
Veo 3.1 Lite veo-3.1-lite 1080p 4, 6 หรือ 8 วินาที รองรับเวิร์กโฟลว์วิดีโอและการเปลี่ยนฉาก 2 เฟรม
Veo 3.1 Standard veo-3.1-standard 2160p 4, 6 หรือ 8 วินาที ตัวเลือก Veo ความละเอียดสูงกว่า
Veo 3.1 Fast veo-3.1-fast 2160p 4, 6 หรือ 8 วินาที ตัวเลือก Veo ที่เร็วกว่า
Sora 2 Pro sora-2-pro 1080p 4, 8 หรือ 12 วินาที ตัวเลือก Sora ระยะเวลาคงที่
Sora 2 sora-2 720p 4, 8 หรือ 12 วินาที ตัวเลือก Sora มาตรฐาน
PixVerse v5.6 v5.6 1080p 1–10 วินาที ยังใช้สำหรับ motion-control และเวิร์กโฟลว์การสร้างที่เลือกไว้
PixVerse v5.5 v5.5 1080p 1–10 วินาที ใช้สำหรับเวิร์กโฟลว์ create modify
PixVerse v5 v5 1080p 1–10 วินาที ใช้สำหรับเวิร์กโฟลว์การเปลี่ยนฉาก 3 เฟรมขึ้นไป

โมเดลพาร์ทเนอร์ เช่น Seedance, Kling, Veo, Sora, Gemini Omni, Grok Imagine และ HappyHorse เป็นตัวเลือกบน PixVerse ใช้พื้นผิว CLI เดียวกันเพื่อเปรียบเทียบกับ PixVerse V6 และ C1

ทำให้ภาพนิ่งเคลื่อนไหว

หากต้องการเปลี่ยนรูปภาพหรือภาพที่สร้างแล้วให้เป็นวิดีโอ ให้ระบุแฟล็ก --image:

pixverse create video \
  --prompt "Gentle wind moves through the scene" \
  --image ./product-photo.jpg \
  --model v6 \
  --quality 1080p \
  --json

คุณสามารถส่งพาธไฟล์ในเครื่องหรือ URL ได้ ไฟล์ในเครื่องจะถูกอัปโหลดอัตโนมัติ ไม่ต้องมีขั้นตอนอัปโหลดด้วยตนเอง ภาพอินพุตในเครื่องที่ใหญ่กว่า 1920x1920 หรือ 5MB จะถูกปรับขนาดหรือบีบอัดอัตโนมัติก่อนอัปโหลด ส่วน URL ภาพระยะไกลจะถูกตรวจสอบโดยแบ็กเอนด์ตามที่เป็น

สำหรับ Grok Imagine 1.5 จำเป็นต้องมีภาพ และอัตราส่วนภาพของเอาต์พุตจะยึดตามภาพนั้น:

pixverse create video \
  --prompt "Slow camera push-in, subtle fabric motion, clean native ambience" \
  --image ./campaign-poster.png \
  --model grok-imagine-1.5 \
  --quality 720p \
  --duration 6 \
  --json

ใช้ Reference, Transition, Motion Control และเทมเพลต

CLI ปัจจุบันรองรับมากกว่า text-to-video และ image-to-video ธรรมดา โหมดการสร้างเหล่านี้มีประโยชน์เมื่อคุณต้องการควบคุมตัวละคร คีย์เฟรม การแก้ไข หรือเอฟเฟกต์มากขึ้น:

# Create a transition between keyframes
pixverse create transition --images ./frame1.png ./frame2.png

# Generate speech audio from text
pixverse create voice --text "Welcome to the launch" --voice-id <preset_voice_id> --output ./voiceover.mp3

# Generate music from a prompt
pixverse create music --prompt "A cinematic synth-pop intro with bright percussion" --auto-lyrics
pixverse create music --prompt "Uplifting piano theme for a product reveal" --instrumental --duration-seconds 60

# Extend a generated video
pixverse create extend --video <video_id>

# Modify an existing video
pixverse create modify --video <video_id> --prompt "Change the background to a beach"

# Upscale video resolution
pixverse create upscale --video <video_id> --quality 1080p

# Generate video with reference images
pixverse create reference --images ./char1.png ./char2.png --prompt "Two friends walking in a park"

# Seedance 2.0 reference can mix image and video inputs
pixverse create reference \
  --model seedance-2.0-standard \
  --images ./character.png \
  --videos ./motion.mp4 \
  --prompt "@image1 follows the motion in @video1"

# Seedance 2.0 models support up to 9 reference images
pixverse create reference \
  --model seedance-2.0-standard \
  --images ./char1.png ./char2.png ./char3.png ./char4.png \
  --prompt "@image1 and @image2 walk through the scene together"

# Motion control with a character image and motion reference video
pixverse create motion-control --image ./character.png --video ./dance.mp4

# Create from a template or effect
pixverse create template --template-id 12345 --image ./photo.png

ไม่ใช่ทุกโมเดลจะรองรับทุกโหมดการสร้าง ในเมทริกซ์ README ปัจจุบัน create video รองรับ v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Happy Horse 1.0, Kling O3, Kling 3.0, Grok Imagine, Veo 3.1, Sora 2 และ v5.6 grok-imagine-1.5 เป็น image-to-video เท่านั้นและต้องใช้ --image create extend รองรับ v6 และ grok-imagine create reference รองรับ v6, pixverse-c1, Seedance 2.0 Standard/Fast/Mini, Google Gemini Omni, Kling O3, grok-imagine และ v5.6 การเปลี่ยนฉาก 2 เฟรมรองรับตระกูลวิดีโอรุ่นใหม่กว่า การเปลี่ยนฉาก 3 เฟรมขึ้นไปใช้ v5 create modify ใช้ v5.5 และ create motion-control ใช้ v5.6

ขั้นตอนที่ 5: สร้างเสียงพูดและดนตรี

README บน GitHub ปัจจุบันอธิบายเสียงแบบแยกผ่านคำสั่งสร้างเฉพาะ ใช้ create voice สำหรับ text-to-speech และ create music สำหรับการสร้างดนตรีจากพรอมต์ ผลลัพธ์เสียงพูดและดนตรีจะถูกบันทึกเป็นแอสเซ็ตเสียง คุณจึงติดตามด้วย task แสดงรายการด้วย asset list --type audio และดาวน์โหลดด้วย asset download --type audio สำหรับเสียงบรรยากาศในวิดีโอแบบเนทีฟ ให้ใช้ --audio หรือ --no-audio กับคำสั่งสร้างวิดีโอที่รองรับ

สร้างเสียงพูด:

pixverse create voice \
  --text "Welcome to the launch. Here is what changed this week." \
  --model speech-2.8-hd \
  --voice-id <preset_voice_id> \
  --output ./voiceover.mp3 \
  --json

เรียกดูโมเดลเสียงและเสียงพรีเซ็ต:

pixverse voice models --json
pixverse voice presets --model speech-2.8-hd --json

สร้างดนตรี:

pixverse create music \
  --prompt "A bright cinematic synth-pop track for a 30-second product reveal" \
  --auto-lyrics \
  --duration-seconds 30 \
  --json

สำหรับแทร็กบรรเลง ให้ใช้ --instrumental สำหรับโมเดลที่รองรับเนื้อร้อง ให้ส่งเนื้อร้องเป็นข้อความตรง พาธไฟล์ในเครื่อง หรือ stdin:

pixverse create music \
  --prompt "Uplifting electronic pop with a confident chorus" \
  --lyrics ./lyrics.txt \
  --json

ตระกูลโมเดลเสียงปัจจุบันประกอบด้วย MiniMax Speech 2.8 และโมเดล ElevenLabs ตระกูลโมเดลดนตรีปัจจุบันประกอบด้วย MiniMax Music, ElevenLabs Music และ Google Lyria 3 Pro ใช้ pixverse voice models และ pixverse music models เพื่อดูแคตตาล็อกแบบสดก่อนเขียนสคริปต์เวิร์กโฟลว์สำหรับระบบจริง

ขั้นตอนที่ 6: รันวิซาร์ดแบบโต้ตอบ

หากคุณกำลังสำรวจเป็นครั้งแรกและยังไม่คุ้นกับแฟล็กทั้งหมด ให้รันคำสั่งสร้างใดก็ได้โดยไม่ใส่อาร์กิวเมนต์เพื่อเข้าสู่วิซาร์ดแนะนำ:

pixverse create video
pixverse create image

วิซาร์ดจะพาคุณผ่านพรอมต์ การเลือกโมเดล คุณภาพ อัตราส่วนภาพ ระยะเวลา และตัวเลือกอื่นทีละขั้น มีประโยชน์สำหรับค้นหาว่ามีพารามิเตอร์ใดบ้างก่อนนำไปเขียนสคริปต์

นอกเหนือจากการสร้าง: จัดการแอสเซ็ตและเวิร์กสเปซของคุณ

PixVerse CLI ปัจจุบันยังมีคำสั่งจัดการที่ช่วยให้คุณสร้างเวิร์กโฟลว์บนเทอร์มินัลแบบครบวงจร:

  • pixverse task status <id> และ pixverse task wait <id> สำหรับการโพลล์งาน
  • pixverse task status --ids 123,456,789 --type video --json สำหรับตรวจสอบสถานะแบบแบตช์
  • pixverse asset list, asset upload, asset info, asset download และ asset delete สำหรับการดำเนินการวงจรชีวิตของแอสเซ็ตวิดีโอ ภาพ และเสียง
  • pixverse saved list, saved items, saved new, saved rename, saved add, saved remove และ saved delete สำหรับโฟลเดอร์ที่บันทึกไว้
  • pixverse template categories, template list, template search และ template info สำหรับค้นหาเอฟเฟกต์และเทมเพลต
  • pixverse voice models, voice presets และ music models สำหรับค้นหาโมเดลเสียงแบบสด
  • pixverse workspace list, workspace status, workspace switch และ workspace manage สำหรับการทำงานหลายเวิร์กสเปซ
  • pixverse account info, account usage และ account slots สำหรับตรวจสอบเครดิต การใช้งาน และความพร้อมกัน
  • pixverse config set, config list, config path และ config defaults สำหรับค่าเริ่มต้นในเครื่องที่ทำซ้ำได้

สิ่งนี้ทำให้การทำอัตโนมัติไม่เพียงการสร้าง แต่รวมถึงการจัดระเบียบ การค้นหาเทมเพลต การค้นหาเสียง การดาวน์โหลด การกำหนดเส้นทางเวิร์กสเปซ และการส่งมอบในสคริปต์เดียวเป็นเรื่องตรงไปตรงมา หากคุณต้องรันคำสั่งหนึ่งกับเวิร์กสเปซอื่น ให้ใช้แฟล็กระดับโกลบอล --workspace-id <id> 0 จะชี้ไปที่เวิร์กสเปซส่วนตัวของคุณ

แฟล็กที่เหมาะกับสคริปต์

ระบบอัตโนมัติส่วนใหญ่พึ่งพาเอาต์พุตที่คาดเดาได้และพฤติกรรมขณะรันที่คาดเดาได้ แฟล็กเหล่านี้มีประโยชน์เป็นพิเศษในสคริปต์และเวิร์กโฟลว์ของเอเจนต์ AI:

แฟล็ก ใช้สำหรับ
--json คืนเอาต์พุต JSON แบบมีโครงสร้าง
-p ชื่อย่อของ --json
--count <n> สร้างรูปแบบแปรผัน 1–4 แบบจากคำขอเดียว
--seed <number> ทำให้การสร้างทำซ้ำได้ง่ายขึ้น
--off-peak ใช้ราคาช่วงนอกพีคเมื่อมีให้
--audio / --no-audio เปิดหรือปิดการสร้างเสียงในคำสั่งสร้างที่รองรับ
--multi-shot / --no-multi-shot เปิดหรือปิดโหมดมัลติช็อตสำหรับวิดีโอ
--no-wait ส่งงานแล้วคืนค่าทันที
--timeout <sec> ตั้งเวลาหมดของการโพลล์ ค่าเริ่มต้นคือ 300 วินาที
--workspace-id <id> แทนที่เวิร์กสเปซที่ใช้งานอยู่สำหรับคำสั่งเดียว
--trace-id <uuid> แนบ UUIDv4 ที่ผู้เรียกกำหนดไว้กับคำขอ API เพื่อดีบักและการสังเกตการณ์
--idempotency-key <key> ลองคำขอสร้างใหม่ได้อย่างปลอดภัยโดยไม่สร้างงานที่ถูกคิดเครดิตซ้ำโดยไม่ตั้งใจ

แฟล็กอินพุตข้อความทำอัตโนมัติได้ง่ายขึ้นแล้ว --prompt, --text และ --lyrics รับได้ทั้งสตริงตรง พาธไฟล์ในเครื่อง หรือ - สำหรับ stdin:

pixverse create video --prompt ./scene.txt --json
cat scene.txt | pixverse create image --prompt - --json
echo "Hello from the command line" | pixverse create voice --text - --json
pixverse create music --prompt "Bright synth-pop" --lyrics ./lyrics.txt --json

สอนเอเจนต์ AI ของคุณให้สร้างสื่อ

สำหรับทีมที่ต้องการจุดเริ่มต้นแบบมีคำแนะนำบนแอปก่อนย้ายไปสู่การทำอัตโนมัติบนบรรทัดคำสั่ง PixVerse Agent มีเวิร์กโฟลว์การสร้างที่เน้นเอเจนต์ในแอป PixVerse

นี่คือจุดที่ PixVerse CLI เปลี่ยนวิธีทำงานได้อย่างแท้จริง เพราะคำสั่งสามารถคืน JSON แบบมีโครงสร้างและใช้รหัสออกที่กำหนดได้ เอเจนต์ AI ใดก็ตามที่รันคำสั่งเชลล์ได้สามารถถูกสอนให้สร้างภาพและวิดีโอตามต้องการ

การติดตั้ง PixVerse Skills

PixVerse Skills คือคลังสกิลที่มีโครงสร้าง ซึ่งสอนเอเจนต์ให้ใช้ CLI ได้อย่างถูกต้อง ได้แก่ แฟล็กคำสั่ง ข้อจำกัดของโมเดล ไปป์ไลน์หลายขั้นตอน และการจัดการข้อผิดพลาดที่แข็งแรง

สำหรับ Claude Code และเอเจนต์อื่นที่รองรับรูปแบบสกิล ให้เพิ่ม PixVerse skills โดยตรง:

npx skills add https://github.com/pixverseai/skills --skill pixverse-ai-image-and-video-generator

สำหรับ Cursor, Claude Code, Codex และเฟรมเวิร์กเอเจนต์อื่น สกิลนี้ช่วยเพิ่มความน่าเชื่อถือโดยให้ข้อจำกัดที่ชัดเจนแกเอเจนต์ แทนที่จะบังคับให้คาดเดาเองตั้งแต่ต้น

PixVerse CLI ยังมาพร้อมแมนิเฟสต์คำสั่งที่เครื่องอ่านได้และกระชับที่ dist/capabilities.json โดยมีซอร์สสาธารณะเป็น capabilities.json ในที่เก็บ GitHub แมนิเฟสต์นี้อธิบายคำสั่ง แฟล็ก รหัสออก ความคาดหวังของเอาต์พุต JSON และหมวดเอฟเฟกต์ เพื่อให้เอเจนต์ตรวจสอบสัญญาของ CLI ได้โดยไม่ต้องดึงข้อความช่วยเหลือ

เมื่อเอเจนต์ของคุณโหลด PixVerse skills แล้ว คุณสามารถให้คำสั่งภาษาธรรมชาติได้ เช่น:

  • “สร้างวิดีโอเดโมผลิตภัณฑ์ความยาว 10 วินาทีจากภาพหน้าจอนี้”
  • “สร้างภาพปกบล็อกนี้ 4 รูปแบบในอัตราส่วน 16:9”
  • “ทำให้ไดอะแกรมนี้เคลื่อนไหวเป็นคลิปอธิบายความยาว 5 วินาทีพร้อมเสียงบรรยากาศ”
  • “สร้างคลิปโปรโมชัน 16:9 ความยาว 8 วินาทีจำนวน 3 คลิปด้วยการเคลื่อนกล้องที่ต่างกัน”

เอเจนต์จะแปลคำสั่งเหล่านั้นเป็นคำสั่ง CLI ที่ถูกต้อง แยกวิเคราะห์เอาต์พุต JSON และจัดการการโพลล์กับการดาวน์โหลด โดยไม่ต้องแทรกแซงด้วยตนเอง

Claude Code

ใน Claude Code, PixVerse CLI จะกลายเป็นเครื่องมือเนทีฟที่เอเจนต์ใช้ได้เอง หลังจากโหลด PixVerse skills แล้ว คุณสามารถใส่การสร้างสื่อไว้ในงานใดก็ได้โดยตรง:

สร้างภาพปกสำหรับบทความบล็อกนี้เกี่ยวกับแมชชีนเลิร์นนิง ใช้โมเดล seedream-5.0-lite ที่ 2160p ในอัตราส่วน 16:9 แล้วดาวน์โหลดไปที่ ./assets/cover.webp

Claude Code จะเรียกคำสั่ง CLI ที่ถูกต้อง ดึง URL ภาพจากผลตอบกลับ JSON และดาวน์โหลดไฟล์ไปยังพาธที่คุณระบุ ทั้งหมดภายในเซสชันเดียวกับที่กำลังเขียนโค้ดของคุณ

เวิร์กโฟลว์ Claude Code ทั่วไป:

# Claude Code runs this autonomously based on your instruction
IMG=$(pixverse create image \
  --prompt "Abstract visualization of neural network layers, dark background, blue and purple tones" \
  --model seedream-5.0-lite \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json | jq -r '.image_url')

# Then animates it
pixverse create video \
  --prompt "Slow pan across glowing neural connections" \
  --image "$IMG" \
  --model v6 \
  --quality 1080p \
  --duration 6 \
  --json

Cursor

ผู้ใช้ Cursor สามารถโหลด PixVerse Skills เป็นไฟล์บริบทของโปรเจกต์ วางไฟล์สกิลที่เกี่ยวข้องในไดเรกทอรี .cursor/ หรือเพิ่มเข้ากฎของเวิร์กสเปซ เมื่อโหลดแล้ว Cursor จะรับรู้คำสั่ง PixVerse CLI ทุกคำสั่งอย่างครบถ้วน และสามารถสร้างสื่อเป็นส่วนหนึ่งของงานเขียนโค้ดใดก็ได้

เวิร์กโฟลว์ Cursor ที่พบบ่อย: ขอให้เอเจนต์สร้างภาพม็อกอัปจากดีไซน์ที่คุณกำลังทำ แล้วนำไปใช้อ้างอิงโดยตรงในเซสชัน IDE โดยไม่ต้องออกจากเอดิเตอร์

Codex และเอเจนต์อื่น

PixVerse CLI เข้ากันได้กับเอเจนต์ใดก็ตามที่รันคำสั่งเชลล์และแยกวิเคราะห์ JSON ได้ รูปแบบเอาต์พุตแบบมีโครงสร้าง ได้แก่ ชื่อฟิลด์ที่สอดคล้องกัน รหัสข้อผิดพลาดที่คาดเดาได้ และข้อความข้อผิดพลาดที่แยกไว้บน stderr ทำให้แม้แต่เอเจนต์สคริปต์ธรรมดาก็ผสานการสร้างได้อย่างน่าเชื่อถือ

สัญญารหัสออกทำให้การจัดการข้อผิดพลาดตรงไปตรงมา:

รหัส ความหมาย การดำเนินการของเอเจนต์
0 สำเร็จ แยกวิเคราะห์เอาต์พุต JSON
1 ข้อผิดพลาดทั่วไป ตรวจ stderr แล้วลองใหม่ด้วยอินพุตที่ผ่านการตรวจสอบ
2 หมดเวลา ลองใหม่ด้วย --timeout ที่นานขึ้น
3 การยืนยันตัวตนหมดอายุ รัน pixverse auth login อีกครั้ง
4 เครดิตหมด ตรวจยอดคงเหลือ แล้วแจ้งผู้ใช้
5 การสร้างล้มเหลว ลองพารามิเตอร์อื่น
6 ข้อผิดพลาดการตรวจสอบ ทบทวนค่าแฟล็ก

ไปป์ไลน์อัตโนมัติ

เมื่อคุณเข้าใจคำสั่งแต่ละตัวแล้ว PixVerse CLI จะปลดล็อกเวิร์กโฟลว์หลายขั้นตอนที่ทรงพลัง ซึ่งทำงานทั้งหมดโดยไม่ต้องมีผู้ใช้โต้ตอบ

จากข้อความสู่ภาพสู่วิดีโอ

หนึ่งในไปป์ไลน์ที่มีประโยชน์ที่สุด: สร้างภาพความละเอียดสูงจากพรอมต์ข้อความ แล้วทำให้เคลื่อนไหวเป็นวิดีโอ

# Step 1: Generate a base image
IMG_RESULT=$(pixverse create image \
  --prompt "A cyberpunk cityscape at night, neon lights reflecting on wet pavement" \
  --model gemini-3.1-flash \
  --quality 2160p \
  --aspect-ratio 16:9 \
  --json)

IMAGE_URL=$(echo "$IMG_RESULT" | jq -r '.image_url')

# Step 2: Animate it into a video
VID_RESULT=$(pixverse create video \
  --prompt "Camera slowly pans across the neon-lit streets" \
  --image "$IMAGE_URL" \
  --model v6 \
  --quality 1080p \
  --duration 8 \
  --json)

VIDEO_ID=$(echo "$VID_RESULT" | jq -r '.video_id')

# Step 3: Download the final video
pixverse asset download "$VIDEO_ID" --json

ไปป์ไลน์ผลิตวิดีโอแบบครบวงจร

สำหรับเอาต์พุตที่ขัดเกลาแล้ว ให้เชื่อมการสร้างกับขั้นตอนหลังการประมวลผล ใช้ --audio หรือ --no-audio เมื่อต้องการเสียงเนทีฟในคำสั่งสร้างวิดีโอที่รองรับ จากนั้นใช้ create voice สำหรับเสียง text-to-speech และ create music สำหรับแอสเซ็ตดนตรีแบบแยกที่คุณจะนำไปรวมในขั้นตอนถัดไป:

# Step 1: Create the base video
RESULT=$(pixverse create video \
  --prompt "A product being assembled in slow motion" \
  --model v6 \
  --quality 720p \
  --duration 5 \
  --audio \
  --json)

VID=$(echo "$RESULT" | jq -r '.video_id')

# Step 2: Extend duration
EXTENDED=$(pixverse create extend \
  --video "$VID" \
  --json | jq -r '.video_id')

pixverse task wait "$EXTENDED" --json

# Step 3: Upscale to 1080p
FINAL=$(pixverse create upscale \
  --video "$EXTENDED" \
  --quality 1080p \
  --json | jq -r '.video_id')

pixverse task wait "$FINAL" --json

# Step 4: Download
pixverse asset download "$FINAL" --json

# Optional: create a separate voiceover asset
pixverse create voice \
  --text "The final reveal starts now." \
  --voice-id <preset_voice_id> \
  --output ./voiceover.mp3 \
  --json

การสร้างแบบแบตช์

สำหรับไปป์ไลน์เนื้อหาที่ต้องมีหลายรูปแบบ ให้รันงานแบบขนาน:

# Check credits and concurrent generation slots first
pixverse account info --json
pixverse account slots --json

# Submit four parallel generations
pixverse create video --prompt "Sunrise over mountains" --no-wait --json > /tmp/v1.json &
pixverse create video --prompt "Sunset over ocean" --no-wait --json > /tmp/v2.json &
pixverse create video --prompt "Stars over a desert" --no-wait --json > /tmp/v3.json &
pixverse create video --prompt "Aurora over a frozen lake" --no-wait --json > /tmp/v4.json &
wait

# Check all returned task IDs in one batch status call
IDS=$(jq -r '.video_id' /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json | paste -sd, -)
pixverse task status --ids "$IDS" --type video --json

# Wait for each and download
for f in /tmp/v1.json /tmp/v2.json /tmp/v3.json /tmp/v4.json; do
  ID=$(jq -r '.video_id' "$f")
  pixverse task wait "$ID" --json
  pixverse asset download "$ID" --json
done

แฟล็ก --no-wait ส่งงานแล้วคืนค่าทันทีพร้อมรหัสงาน ทำให้คุณส่งหลายงานได้ก่อนเริ่มโพลล์ ด้วย --no-wait --json ให้บันทึกรหัสงานที่คืนมาและพารามิเตอร์การสร้างที่ถูกใช้จริงไว้สำหรับบันทึกและความสามารถในการทำซ้ำ ใช้ --count <n> เมื่อต้องการหลายรูปแบบจากพรอมต์เดียว และใช้ task status --ids แบบแบตช์เมื่อต้องการการตอบสถานะเดียวสำหรับหลายงานที่กำลังรัน คำสั่ง pixverse task wait จะจัดการการโพลล์แบบปรับตัวให้คุณ

การตั้งค่าเริ่มต้น

หากคุณใช้โมเดล คุณภาพ หรืออัตราส่วนภาพชุดเดิมอย่างสม่ำเสมอ ให้ตั้งเป็นค่าเริ่มต้นเพื่อไม่ต้องใส่แฟล็กซ้ำทุกครั้ง:

pixverse config defaults set video model v6
pixverse config defaults set video quality 1080p
pixverse config defaults set image model seedream-5.0-lite
pixverse config set output-dir ~/Downloads/pixverse
pixverse config defaults show
pixverse config list
pixverse config path

แฟล็กบรรทัดคำสั่งจะแทนที่ค่าเริ่มต้นที่คุณตั้งไว้เสมอ คุณจึงยังมีความยืดหยุ่นเต็มที่พร้อมลดการทำซ้ำ สำหรับระบบอัตโนมัติเฉพาะเวิร์กสเปซ ให้เพิ่ม --workspace-id <id> ในคำสั่งเมื่อต้องการแทนที่เวิร์กสเปซที่ใช้งานอยู่สำหรับการรันครั้งนั้น

สิ่งที่คุณสร้างได้

เมื่อผสาน PixVerse CLI เข้ากับเวิร์กโฟลว์เอเจนต์ของคุณ ขอบเขตของงานที่ทำอัตโนมัติได้จะขยายขึ้นมาก:

  • เอกสาร — สร้างวิดีโอเดโมผลิตภัณฑ์และภาพหน้าจออัตโนมัติเป็นส่วนหนึ่งของกระบวนการสร้างเอกสาร
  • การตลาด — รันงานแบตช์รายคืนที่ผลิตเนื้อหาโซเชียลมีเดียหลายรูปแบบจากคลังพรอมต์เดียว
  • การพัฒนาแอป — ให้เอเจนต์เขียนโค้ดสร้างภาพตัวยึด แอนิเมชันม็อกอัป หรือวิดีโอหน้าจอโหลด ขณะที่คุณสร้าง UI
  • เวิร์กโฟลว์เสียง — สร้างร่างเสียงบรรยาย แทร็กดนตรีจากพรอมต์ หรือแอสเซ็ตเสียงเพื่อแก้ไขภายหลัง
  • ไปป์ไลน์เนื้อหา — เชื่อมการเรียก CLI กับเครื่องมืออื่น (ffmpeg, ImageMagick, ที่เก็บคลาวด์) เพื่อสร้างเวิร์กโฟลว์ผลิตสื่ออัตโนมัติเต็มรูปแบบ
  • การทำต้นแบบ — สร้างแนวคิดการเคลื่อนไหวอย่างรวดเร็วในไม่กี่วินาที เพื่อตรวจสอบไอเดียก่อนลงมือผลิตเต็มรูปแบบ

CLI ถูกออกแบบให้เข้ากับเวิร์กโฟลว์บนเชลล์ได้อย่างเป็นธรรมชาติ หากระบบอัตโนมัติที่มีอยู่ของคุณรันใน bash, Python, Node หรือไปป์ไลน์ CI/CD แล้ว PixVerse CLI จะแทรกเข้าไปได้โดยไม่มีภาระการผสานเพิ่มเติม

รายการตรวจสอบก่อนเริ่มต้น

  • ติดตั้ง Node.js 20 หรือสูงกว่า
  • รัน npm install -g pixverse
  • รัน pixverse auth login แล้วยืนยันในเบราว์เซอร์
  • รัน pixverse account info เพื่อตรวจสอบเครดิต
  • รัน pixverse account slots ก่อนทำงานแบตช์แบบพร้อมกัน
  • สร้างภาพแรกของคุณ: pixverse create image --prompt "..." --json
  • สร้างวิดีโอแรกของคุณ: pixverse create video --prompt "..." --json
  • สร้างแอสเซ็ตเสียงพูดแรกของคุณ: pixverse create voice --text "..." --json
  • สร้างแอสเซ็ตดนตรีแรกของคุณ: pixverse create music --prompt "..." --json
  • สำรวจเทมเพลตด้วย pixverse template list
  • ติดตั้ง PixVerse Skills สำหรับเอเจนต์ของคุณ (Claude Code, Cursor หรือ Codex)
  • ตั้งค่าเริ่มต้นที่คุณชอบด้วย pixverse config defaults set
  • สร้างไปป์ไลน์อัตโนมัติแรกของคุณ

อัปเดต CLI ให้เป็นปัจจุบัน

ใช้ตัวอัปเดตในตัวเพื่อให้ CLI ในเครื่องของคุณเป็นปัจจุบัน:

pixverse update

คุณยังใช้ npm โดยตรงได้:

npm install -g pixverse@latest

เนื่องจาก PixVerse CLI เป็นเครื่องมือที่อัปเดตอย่างต่อเนื่อง ไม่ใช่การเปิดตัวครั้งเดียว ให้ถือว่าบทความนี้เป็นคู่มือภาคสนามที่ใช้งานได้จริง และให้แหล่งทางการเป็นชั้นอ้างอิงแบบสด หน้า PixVerse CLI อย่างเป็นทางการ เป็นเส้นทางติดตั้งและการเริ่มต้นเอเจนต์ที่สั้นที่สุด ส่วน GitHub ยังเป็นที่สำหรับติดตามการเปลี่ยนแปลงระดับรีลีสและโมเดลที่รองรับใหม่:

เอกสารปัจจุบันเน้น PixVerse V6 เป็นโมเดลวิดีโอเริ่มต้น GPT Image 2 เป็นโมเดลภาพเริ่มต้น การรองรับวิดีโอ Google Gemini Omni การรองรับภาพ Nano Banana 2 Lite และ Seedream 5.0 Pro การรองรับ Seedance 2.0 Mini เวิร์กโฟลว์ PixVerse v5 และ v5.5 ที่เฉพาะโหมด คำสั่งเฉพาะ create voice และ create music การจัดการแอสเซ็ตเสียง โฟลเดอร์ที่บันทึกไว้ การสลับเวิร์กสเปซ config defaults, capabilities.json สำหรับเอเจนต์ pixverse update การรองรับ stdin สำหรับอินพุตข้อความ --trace-id และ --idempotency-key สำหรับการลองใหม่ที่ปลอดภัยยิ่งขึ้น

ขั้นตอนถัดไป

หน้า PixVerse CLI อย่างเป็นทางการ, PixVerse CLI บน GitHub และ npm (npm install -g pixverse) ให้คุณเข้าถึงการสร้าง การโพลล์งาน การจัดการแอสเซ็ต เทมเพลต โฟลเดอร์ที่บันทึกไว้ การตรวจสอบบัญชี การค้นหาโมเดลเสียง และการควบคุมเวิร์กสเปซได้ทันทีจากอินเทอร์เฟซเดียว ที่เก็บ PixVerse Skills เพิ่มคำแนะนำที่พร้อมสำหรับเอเจนต์ เพื่อให้ Claude Code, Cursor, Codex และเครื่องมืออื่นรันเวิร์กโฟลว์เหล่านี้ได้อย่างน่าเชื่อถือยิ่งขึ้น

การรวม CLI ที่เชื่อถือได้เข้ากับคลังสกิลที่พร้อมสำหรับเอเจนต์ หมายความว่าการสร้างภาพ วิดีโอ เสียงพูด และดนตรีสามารถอยู่ในเวิร์กโฟลว์เดียวกับโค้ดของคุณ โดยเอเจนต์เดียวกันจัดการ ในเทอร์มินัลเดียวกัน โดยไม่ต้องสลับเครื่องมือ

เริ่มจากคำสั่งเดียว แล้วต่อยอดจากตรงนั้น

แหล่งข้อมูลที่เกี่ยวข้อง

สร้างวิดีโอ ภาพ เสียงพูด และดนตรีจากเทอร์มินัลของคุณด้วย PixVerse.