Підготуй запит на транскрибацію цього запису. Поверни JSON {"glossary":["..."],"speakers":"...","output_needs":"..."}: глосарій імен/термінів для підказки моделі, як розмітити розмовляючих, і що потрібно на виході (тайм-коди, позначки невпевнених місць і т.д.).
Транскрибація — розшифровка довгого запису тексту. Під капотом модель не тільки розпізнає слова, а й намагається розділити тих, хто говорить (діаризація) і розставити час. Точність падає на трьох речах: незнайомі імена та терміни, накладення мови (перебивають один одного) та сильний акцент чи шум. Звідси важелі. Перший і недооцінений - дай моделі глосарій заздалегідь: список імен учасників, назв, абревіатур. Заздалегідь представлені слова розпізнаються помітно точніше, ніж вгадані з нуля. Другий — попроси розмітку за розмовляючим і часом, щоб потім швидко знайти потрібний момент. Прийом профі: якщо запис важливий, попроси помітити невпевнені місця дужками або знаком - так ти відразу бачиш, що перевіряти ще раз, замість того, щоб довіряти гладкому, але, можливо, помилковому тексту. Інсайд: якість розшифровки на 80% визначається якістю звуку на вході — один хороший мікрофон у центрі столу кращий за будь-яку постобробку. Типова помилка новачка - кидати двогодинний запис без єдиного імені та контексту, а потім вичищати десятки помилок вручну.
Відкрий доступ, щоб надсилати рішення на миттєву AI-перевірку.