अपनी आवाज़ में विराम चिह्न और संरचना का उच्चारण करते हुए एक संक्षिप्त संदेश (3-5 वाक्य) बोलें, और फिर साफ़ करने का आदेश दें। रिटर्न JSON {"raw_dictation":"...","cleanup_instruction":"...","result":"..."}: वॉयस कमांड के साथ कच्चा श्रुतलेख, बालों में कंघी करने के निर्देश और अंतिम साफ पाठ।
डिक्टेशन वास्तविक समय में आवाज का पाठ में अनुवाद है। मॉडल ध्वनि सुनता है, पड़ोसी शब्दों की ध्वनि और अर्थ के आधार पर शब्दों की भविष्यवाणी करता है, इसलिए सुसंगत भाषण को दांतेदार टुकड़ों की तुलना में अधिक सटीक रूप से पहचाना जाता है। वह हमेशा स्वयं विराम चिह्न नहीं लगाती - उनका उच्चारण ज़ोर से किया जा सकता है: "अल्पविराम", "पूर्ण विराम", "नई पंक्ति", "पैराग्राफ"। यह पहला लीवर है: संरचना को ज़ोर से निर्देशित करें, और आउटपुट एक पूर्ण पाठ होगा, निरंतर नहीं। दूसरा लीवर अधिक महत्वपूर्ण है - विशुद्ध रूप से निर्देशित करने का प्रयास न करें। आरक्षण और दोहराव के साथ विचार को वैसे ही कहना तेज़ है, और फिर एक आदेश के साथ एआई से पूछें: "दोहराव हटाएं, अपने बालों में कंघी करें, अर्थ छोड़ दें।" आवाज मात्रा और गति देती है, मॉडल शुद्धता देता है। अंदरूनी सूत्र: एक समय में एक शब्द के बजाय लंबे टुकड़ों में निर्देश दें—संदर्भ पहचानने में मदद करता है और सटीकता बढ़ती है। एक सामान्य गलती यह है कि किसी शोर-शराबे वाली जगह पर ऊंची आवाज में हुक्म चलाना और फिर गलतियों से आश्चर्यचकित होना; यहां तक कि वॉल्यूम और एक क्लोज माइक किसी भी सेटिंग से कहीं अधिक काम करता है। और हमेशा संख्याओं और नामों की दोबारा जांच करें - मॉडल अक्सर उन्हें भ्रमित करता है।
त्वरित एआई समीक्षा के लिए समाधान सबमिट करने के लिए एक्सेस अनलॉक करें।