Генерация текстов. Обработка и преобразование большого обьема текста (Дистанционная работа)

Бюджет: 747 руб.

Задание: Генерация текстов. Обработка и преобразование большого обьема текста (Дистанционная работа)

Нужна система для автоматической обработки больших объёмов информации с помощью ИИ Сейчас я использую собственный промпт в Claude. На небольших текстах он работает хорошо, но при больших объёмах нейросеть может пропускать части, останавливаться раньше конца или сообщать о завершении, хотя материал обработан не полностью. Нужна система, которая принимает сразу книгу на 200+ страниц, несколько книг, PDF, DOCX, TXT, субтитры, расшифровки аудио и видео или другой большой массив информации и автоматически обрабатывает его от начала до конца. Один из основных форматов результата для каждого смыслового предложения: English version. •••••••••••••••••••••••••••• Russian version. •••••••••••••••••••••••••••• English version. •••••••••••••••••••••••••••• English version. •••••••••••••••••••••••••••• Russian version. •••••••••••••••••••••••••••• English version. Каждая смысловая строка выводится четыре раза на английском и два раза на русском в указанной очередности. Перевод должен точно передавать смысл. Короткие предложения можно объединять, длинные — делить на законченные смысловые строки. Формат должен настраиваться: количество английских повторений и переводов, их очередность, языки, разделитель, длина строк, основной промпт и сохранение разных шаблонов. Например, вместо English–Russian–English–English–Russian–English можно выбрать любую другую последовательность. Если документ невозможно обработать одним запросом, программа должна сама разделить его на внутренние блоки, отправить их в Claude, ChatGPT, Gemini или другую модель, проверить результат, повторить проблемные части и объединить всё в один файл. Пользователь не должен вручную копировать текст по четыре страницы. Необходимо проверять, что не пропущено ни одного предложения, абзаца или смыслового фрагмента, отсутствуют дубли между блоками, а структура соответствует шаблону. Проверка не должна основываться только на утверждении нейросети. Обработка аудио Система также должна обрабатывать большие архивы аудио, например Telegram-канал с 300 эфирами примерно по одному часу. Желательно автоматически скачать аудио либо принять весь архив, распознать речь и обработать всё без ручного участия. По каждому эфиру должна создаваться структурированная выжимка: тема, главные мысли, важные факты, примеры, рекомендации и выводы. Приветствия, реклама, разговорный мусор и бессмысленные повторы удаляются, но полезная информация сохраняется. После обработки нужны не только отдельные конспекты, но и один общий читабельный документ, где информация объединена по темам. Если тема обсуждалась в разных эфирах, материалы собираются в один раздел, дубли удаляются, а ссылки на исходные записи сохраняются. В результате должны быть: — выжимка по каждому эфиру; — общий тематический документ; — поиск по словам и темам; — связь выводов с исходным аудио; — сохранение прогресса и продолжение после ошибок. Большую часть этих действий я уже могу выполнять самостоятельно, но только на небольшом объёме и вручную. Поэтому также готов рассмотреть более эффективный способ скачивания и преобразования аудио в текст, если исполнитель предложит решение лучше используемого мной. Что указать в отклике Напишите: — как будет реализована система и какой продукт я получу; — какие модели ИИ и распознавания речи будут использоваться; — как проверяется полнота и исключаются пропуски и повторы; — можно ли менять промпты, количество переводов, повторений и их очередность; — возможно ли скачивание материалов из Telegram; — стоимость разработки, API, сроки и цену дальнейших доработок. Главная цель — универсальная система, которая без ручного участия обрабатывает большие книги и сотни часов аудио, не теряет информацию и выдаёт готовый результат строго по выбранному шаблону.