Mô tả một đoạn video ngắn. Trả về JSON {"idea""...","prompt"...","duration"..."}: idea - ý tưởng trong một cụm từ, prompt - mô tả cảnh bằng công thức “chủ đề + một hành động + môi trường + tâm trạng”, duration - thời lượng tính bằng giây (số + “giây”).
Video AI hoạt động giống như một nhà làm phim hoạt hình rất nhanh: mạng lưới thần kinh đã xem hàng triệu video và học cách dự đoán cách các pixel thay đổi từ khung hình này sang khung hình khác. Bạn đưa ra văn bản - cô ấy hoàn thành động tác. Điều quan trọng là phải hiểu: đây không phải là dán các clip làm sẵn lại với nhau mà tạo ra từng khung hình mới, vì vậy mô tả càng rõ ràng thì hình ảnh càng ổn định. Công thức hoạt động của lời nhắc đầu tiên: chủ đề + một hành động + môi trường + tâm trạng. Không phải “một thành phố xinh đẹp”, mà là “một ngư dân lớn tuổi đang vá lưới trên bến tàu gỗ trong sương sớm”. Người trong cuộc: một video ngắn 3-5 giây hầu như luôn rõ ràng hơn một video dài - người mẫu cố gắng duy trì logic của chuyển động, tay và mặt không “nổi”. Một thủ thuật khác: một hành động cho mỗi video. Hai đội liên tiếp (“đi rồi ngồi xuống”) làm mô hình nhầm lẫn và nó trộn chúng thành bột nhão. Một sai lầm điển hình của người mới bắt đầu là bỏ ra mười chi tiết cùng một lúc: thời tiết, một loạt vật phẩm, ba ký tự. Mô hình sẽ không giữ được mọi thứ. Bắt đầu với một cảnh rõ ràng và một nhân vật, sau đó phức tạp hóa nó.