Chuyển đến nội dung chính
OpenClaw cung cấp sẵn provider fal để tạo hình ảnh, video và âm nhạc trên dịch vụ lưu trữ.

Bắt đầu

1

Đặt khóa API

Thiết lập không tương tác có thể truyền --fal-api-key <key> hoặc xuất FAL_KEY. Quá trình hướng dẫn ban đầu cũng đặt fal/fal-ai/flux/dev làm mô hình hình ảnh mặc định khi chưa có mô hình nào được cấu hình.
2

Đặt mô hình hình ảnh mặc định

Tạo hình ảnh

Provider tạo hình ảnh fal đi kèm mặc định sử dụng fal/fal-ai/flux/dev. Các yêu cầu chỉnh sửa (hình ảnh tham chiếu qua tham số dùng chung image / images) được định tuyến tới endpoint chỉnh sửa riêng của từng mô hình với giới hạn tham chiếu theo mô hình:
Các yêu cầu chuyển hình ảnh thành hình ảnh bằng Flux không hỗ trợ ghi đè aspectRatio. Các yêu cầu chỉnh sửa GPT Image và Nano Banana 2 sử dụng endpoint /edit của fal và chấp nhận gợi ý tỷ lệ khung hình. Nano Banana 2 cũng chấp nhận thêm các tỷ lệ ngang/dọc đặc thù như 4:1, 1:4, 8:11:8; Krea 2 xác thực tập con tỷ lệ khung hình nhỏ hơn của riêng mình. Grok Imagine có danh sách tỷ lệ riêng (bao gồm 2:1, 20:9, 19.5:9 và các tỷ lệ đảo ngược) và chỉ chấp nhận độ phân giải 1K/2K; Nano Banana cũ và Nano Banana 2 Lite từ chối ghi đè resolution.
Các mô hình Krea 2 sử dụng lược đồ payload Krea gốc của fal. OpenClaw gửi aspect_ratio, creativityimage_style_references thay cho payload image_size / endpoint chỉnh sửa dùng chung mà Flux sử dụng. Các tham chiếu mô hình là:
  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image
Dùng Medium để tạo nhanh hơn các phong cách minh họa giàu biểu cảm, anime, hội họa và nghệ thuật. Dùng Large để tạo chậm hơn các phong cách chân thực như ảnh, kết cấu thô, hạt phim và hình ảnh chi tiết. Krea mặc định dùng fal.creativity: "medium"; các giá trị được hỗ trợ là raw, low, mediumhigh. Krea 2 cung cấp tỷ lệ khung hình, không phải image_size, trong lược đồ yêu cầu của fal. Nên ưu tiên aspectRatio; OpenClaw ánh xạ size sang tỷ lệ khung hình Krea được hỗ trợ gần nhất và từ chối resolution đối với Krea thay vì bỏ qua giá trị này. Dùng outputFormat: "png" khi bạn muốn đầu ra PNG từ các mô hình fal có cung cấp output_format. fal không khai báo cơ chế điều khiển nền trong suốt rõ ràng trong OpenClaw, vì vậy background: "transparent" được báo cáo là một ghi đè bị bỏ qua đối với các mô hình fal. Các endpoint Krea 2 không cung cấp trường yêu cầu output_format thông qua fal, vì vậy OpenClaw từ chối ghi đè outputFormat cho các yêu cầu Krea. Để sử dụng Krea 2 Medium:

Tạo video

Provider tạo video fal đi kèm mặc định sử dụng fal/fal-ai/minimax/video-01-live.
MiniMax (mặc định):
  • fal/fal-ai/minimax/video-01-live
Tác nhân video HeyGen:
  • fal/fal-ai/heygen/v2/video-agent
Kling và Wan:
  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video
Các yêu cầu MiniMax Live và HeyGen chỉ gửi câu lệnh cùng một hình ảnh tham chiếu tùy chọn; các ghi đè khác không được chuyển tiếp. Các mô hình Seedance chấp nhận aspectRatio, size, resolution, thời lượng từ 4 đến 15 giây và tùy chọn bật/tắt âm thanh.
Chế độ tham chiếu thành video chấp nhận tối đa 9 hình ảnh, 3 video và 3 tham chiếu âm thanh thông qua các tham số dùng chung images, videosaudioRefs của video_generate, với tổng cộng tối đa 12 tệp tham chiếu. Tham chiếu âm thanh yêu cầu ít nhất một hình ảnh hoặc video tham chiếu trong cùng yêu cầu.

Tạo âm nhạc

Plugin fal đi kèm cũng đăng ký một provider tạo âm nhạc cho công cụ dùng chung music_generate. Dùng fal làm provider âm nhạc mặc định:
fal-ai/minimax-music/v2.6 hỗ trợ lời bài hát rõ ràng và chế độ không lời, nhưng không hỗ trợ cả hai trong cùng một yêu cầu. ACE-Step và Stable Audio là các endpoint chuyển câu lệnh thành âm thanh; chọn chúng bằng ghi đè model khi bạn muốn sử dụng các dòng mô hình đó. ACE-Step từ chối lời bài hát rõ ràng; Stable Audio từ chối cả lời bài hát lẫn chế độ không lời.
Các bảng và mục thu gọn ở trên đề cập đến những dòng mô hình mà provider fal đi kèm xử lý đặc biệt. Vẫn có thể chọn các mã định danh endpoint hình ảnh fal khác làm mô hình hình ảnh; chúng được xử lý giống Flux (payload image_size dùng chung, một hình ảnh tham chiếu qua /image-to-image).

Liên quan

Tạo hình ảnh

Các tham số công cụ hình ảnh dùng chung và lựa chọn provider.

Tạo video

Các tham số công cụ video dùng chung và lựa chọn provider.

Tạo âm nhạc

Các tham số công cụ âm nhạc dùng chung và lựa chọn provider.

Tham chiếu cấu hình

Các giá trị mặc định của tác nhân, bao gồm lựa chọn mô hình hình ảnh, video và âm nhạc.