Biến yêu cầu mơ hồ “cái cốc đẹp” thành một lời nhắc có cấu trúc. CHỈ trả về JSON: {"prompt":","style"...","details"..."} - trong prompt thu thập chủ thể, môi trường và ánh sáng trong một cụm từ, trong style biểu thị phong cách trực quan, trong details thêm chất liệu, góc độ và định dạng.
Trình tạo hình ảnh không vẽ giống con người. Nó được đào tạo trên hàng triệu cặp “hình ảnh + chú thích” và ghi nhớ các vật thể, kiểu dáng và ánh sáng trông như thế nào. Khi bạn cung cấp văn bản, mô hình sẽ bắt đầu với nhiễu ngẫu nhiên và loại bỏ nó từng bước, đưa hình ảnh đến gần hơn với ý nghĩa của mô tả. Điều này có hai hậu quả. Đầu tiên: các từ càng cụ thể thì mạng nơ-ron càng ít nghĩ cho bạn - nó đáp ứng một yêu cầu mơ hồ với “người dùng Internet trung bình”. Thứ hai: sự khởi đầu luôn là tiếng ồn ngẫu nhiên, do đó, cùng một dấu nhắc sẽ cho các hình ảnh khác nhau. Đây không phải là lỗi mà là một cách để có được các tùy chọn. Đòn bẩy hoạt động: danh từ neo (chính xác là trong khung), tính từ chỉ chất liệu và ánh sáng, biểu thị phong cách và hình thức. Kỹ thuật nội bộ: viết lời nhắc theo “lớp” - chủ đề, môi trường, ánh sáng, phong cách; Mô hình phản ứng mạnh mẽ hơn với những từ đầu tiên, vì vậy hãy đặt nội dung chính vào đầu. Thủ thuật thứ hai: nếu bạn thích bức tranh, hãy sửa lại hạt giống của nó và thay đổi từng từ một. Một sai lầm điển hình của người mới bắt đầu là tải cảm xúc (“đẹp, wow”) thay vì thuộc tính. Người mẫu không biết bạn “đẹp”; cô ấy biết “ánh sáng khuếch tán mềm mại”, “gốm sứ”, “cận cảnh”.