Đọc chính tả một tin nhắn ngắn (3-5 câu), phát âm các dấu chấm câu và cấu trúc trong giọng nói của bạn, sau đó ra lệnh dọn dẹp. Trả về JSON {"raw_dictation":","cleanup_instruction"...","result"..."}: đọc chính tả thô bằng lệnh thoại, hướng dẫn chải tóc và văn bản rõ ràng cuối cùng.
Đọc chính tả là dịch giọng nói thành văn bản trong thời gian thực. Mô hình nghe âm thanh, dự đoán từ dựa trên âm thanh và ý nghĩa của các từ lân cận nên lời nói mạch lạc được nhận dạng chính xác hơn so với các đoạn lởm chởm. Cô ấy không phải lúc nào cũng tự đặt dấu câu - chúng có thể được phát âm thành tiếng: “dấu phẩy”, “dấu chấm”, “dòng mới”, “đoạn”. Đây là đòn bẩy đầu tiên: đọc to cấu trúc và đầu ra sẽ là một văn bản hoàn chỉnh chứ không phải một văn bản liên tục. Đòn bẩy thứ hai quan trọng hơn - đừng cố gắng ra lệnh một cách thuần túy. Sẽ nhanh hơn khi nói ra suy nghĩ như hiện tại, dè dặt và lặp lại, sau đó bằng một mệnh lệnh, hãy yêu cầu AI: “loại bỏ những phần lặp lại, chải tóc, để lại ý nghĩa”. Giọng nói cho âm lượng và tốc độ, kiểu mẫu cho sự thuần khiết. Người dùng nội bộ: đọc chính tả theo từng đoạn dài thay vì từng từ một—ngữ cảnh giúp tăng khả năng nhận biết và độ chính xác. Một sai lầm điển hình là đọc chính tả ở nơi ồn ào với âm lượng nhảy vọt và rồi bất ngờ vì mắc lỗi; Âm lượng đồng đều và micrô gần sẽ làm được nhiều việc hơn bất kỳ cài đặt nào. Và luôn kiểm tra kỹ các số và tên - mô hình thường nhầm lẫn chúng nhất.
Mở khóa quyền truy cập để gửi giải pháp nhằm đánh giá AI ngay lập tức.