Коммерческое предложение · платформа Afina · Silica Group

Предложение для Министерства культуры Республики Дагестан

Мы предлагаем внедрить ИИ-платформу Afina там, где у людей физически не хватает рук: расшифровать и проиндексировать тысячи часов фольклорных записей, ускорить каталогизацию музейных фондов в 3–5 раз и снять с работников сельских ДК часы бумажной работы в неделю. Культура тридцати народов, часть которой существует только в устной форме, получает цифровую защиту — а министерство впервые видит всю свою сеть в данных.

Артисты дагестанского ансамбля «Лезгинка» в национальных костюмах
Фото: Jose Luis Cernadas Iglesias from Coruña, España · CC BY 2.0 · Wikimedia Commons

Мы понимаем вашу специфику

Ваша подведомственная сеть не имеет аналогов в России: национальные театры восьми народов, Национальный музей им. А. Тахо-Годи с филиалами по всей республике, «Лезгинка», библиотеки, училища искусств и сотни сельских домов культуры, где нередко один работник совмещает всё — от кружков до отчётности. При этом значительная часть достояния региона нематериальна: песни, обряды и эпосы живут на 30+ языках, включая бесписьменные, носителей многих традиций остаются десятки человек, а тысячи часов записей в архивах ни разу не были расшифрованы и проиндексированы.

Мы знаем и вторую сторону вашей работы — федеральную цифровую повестку: Госкаталог Музейного фонда РФ, «PRO.Культура.РФ», «Пушкинская карта», реестр нематериального наследия. Эти обязательства создают потоки данных, которые пока лежат мёртвым грузом отчётности. Мы понимаем и то, где здесь нельзя ошибаться: обрядовые и религиозные записи — не «единицы хранения», а сакральный материал конкретных семей и джамаатов. Поэтому каждое наше решение строится с уважением к этой границе.

На что мы обопрёмся

Хорошая новость: строить с нуля не придётся. Музеи республики уже вносят предметы в Госкаталог Музейного фонда РФ (около 47 млн предметов по стране — готовый стандарт описания), учреждения ведут события на «PRO.Культура.РФ» — это афиша, продвижение и данные о посещаемости, включая «Пушкинскую карту». Формируется региональный реестр нематериального наследия, а в архивах министерства, музеев и телерадиофонда накоплено сырьё для языковых и фольклорных проектов.

Мы честно видим и ограничения: аналитика по сети собирается вручную, архивы не расшифрованы, интернет в горной зоне слабый. Именно поэтому Afina спроектирована так, чтобы давать результат на тех данных, которые у вас уже есть, — а общереспубликанский контекст благоприятен: после дизайн-сессии Сбера по ИИ культура — естественный кандидат на первые внедрения.

Что внедрит Afina

Шесть решений — от быстрой аналитики над уже существующими данными до стратегической задачи века: машиночитаемого архива культуры тридцати народов. Каждое сдаём под ключ: развёртывание, обучение сотрудников, сопровождение.

Цифровой фольклорный архив с ASR-индексацией

Технология: ASR + LLM-индексация · Эффект: тысячи часов записей становятся searchable-архивом

В фондах министерства, музеев, телерадиокомпаний и у частных собирателей лежат тысячи часов записей песен, сказаний и обрядов на аварском, даргинском, лезгинском, кумыкском, лакском и других языках. Мы выстроим этот проект поэтапно: сбор корпусов (расшифрованные записи, тексты национальных газет, краудсорсинг носителей), дообучение открытых ASR-моделей, затем сплошная индексация архива. Вы получаете поисковую систему по устной культуре: исследователь или режиссёр находит нужный вариант песни за минуты, а не за месяцы экспедиций. Это самый долгий, но и самый ценный проект ведомства: без него архивы останутся «чёрным ящиком», а с уходом носителей — исчезнут.

Уже доказано
  • Te Hiku Media (Новая Зеландия) — общинная организация маори собрала 300+ часов размеченной речи силами 2500 добровольцев за 10 дней и обучила ASR-модель с точностью 92% для языка te reo.
  • Bhashini (Индия) — государственная платформа речевых технологий и перевода для 22 официальных языков Индии, включая малоресурсные.
  • Europeana — европейская платформа культурного наследия системно применяет ИИ для обогащения и индексации оцифрованных коллекций.

ИИ-каталогизатор музейного фонда

Технология: компьютерное зрение + LLM · Эффект: ускорение оцифровки и атрибуции в 3–5 раз

Внесение предмета в Госкаталог — это фотография плюс десятки полей описания, которые хранитель заполняет вручную. Мы развернём ИИ-конвейер, который меняет процесс: компьютерное зрение по снимку предлагает тип предмета, материал, технику, датировку и близкие аналоги из уже внесённых коллекций (кубачинское серебро, балхарская керамика, табасаранские ковры имеют устойчивые визуальные признаки), а языковая модель формирует черновик учётного описания по стандарту. Хранитель проверяет и утверждает — темп оцифровки вырастает в разы без расширения штата. Побочный эффект — накопление размеченного датасета дагестанского декоративно-прикладного искусства, который затем пригодится и Минтуризму для борьбы с контрафактом промыслов.

Уже доказано
  • AI4Culture (Europeana) — европейская платформа ИИ-инструментов для культурного наследия: открытые датасеты, готовые модели атрибуции и обогащения метаданных.
  • Госкаталог Музейного фонда РФ — целевая система: около 47 млн предметов, единый стандарт описания, в который и должен «стрелять» ИИ-конвейер.

Афиша-аналитик: прогноз посещаемости и «Пушкинская карта»

Технология: предиктивная аналитика · Эффект: рост выручки учреждений и охвата молодёжи

Данные «PRO.Культура.РФ» и билетных операторов по «Пушкинской карте» — готовое сырьё для предиктивной модели, которую мы построим и передадим вам вместе с дашбордом: какие события, в каких районах, в какое время собирают молодёжную аудиторию, а какие проходят впустую. Модель подсказывает учреждениям оптимальную сетку событий, а министерству — где сеть ДК работает, а где события существуют только на бумаге. Это редкий случай, когда данные уже собраны, структурированы и лежат в федеральной системе: нужен только аналитический слой над ними.

Уже доказано
  • PRO.Культура.РФ — 22 тысячи учреждений из 89 регионов ежегодно размещают 200+ тысяч событий; платформа отдаёт статистику, пригодную для моделей спроса.
  • GigaChat (Сбер) — российская LLM, применимая для автогенерации описаний событий и анализа обратной связи аудитории.

LLM-помощник по отчётности для сельских ДК

Технология: LLM / RAG · Эффект: минус часы бюрократии в неделю у каждого клубного работника

Работник сельского ДК в Дагестане — часто один человек, который ведёт кружки, организует праздники и одновременно готовит планы, отчёты, заявки на гранты и карточки событий. Мы запустим LLM-помощника (чат-бот в Telegram, привычном канале связи в республике), который по короткому описанию события генерирует весь пакет: анонс для «PRO.Культура.РФ», пост для соцсетей, отчёт по форме, черновик заявки. Обученный на методичках министерства, он же отвечает на типовые вопросы «как оформить», снимая нагрузку с методистов республиканского центра. Это самое быстрое и доступное решение предложения — и самое благодарное: эффект почувствуют сотни конкретных людей в сёлах.

Уже доказано
  • Робот Макс (Госуслуги) — федеральный цифровой ассистент, обрабатывающий миллионы типовых обращений граждан; модель «бот первой линии + человек для сложного» проверена на госмасштабе.
  • GigaChat — русскоязычная LLM с корпоративным контуром, подходящая для генерации документов по шаблонам ведомства.

Нейроперевод и субтитры для национальных театров

Технология: NMT + генерация субтитров · Эффект: спектакли восьми народов доступны всем зрителям и туристам

Спектакль аварского или лезгинского театра сегодня понятен только носителям языка — и это сужает аудиторию до одного народа, отрезая и растущий туристический поток. Мы внедрим машинный перевод и автоматические субтитры (бегущая строка, экран, приложение на смартфоне зрителя) на русский и английский. Для пар «дагестанский язык → русский» готовых моделей пока нет — это прямая точка сцепки с проектом языковых корпусов: те же корпуса питают и ASR, и перевод. Начнём с полуавтоматики — переведённые заранее тексты пьес, синхронизируемые по таймкодам, — и результат появится уже в первый сезон.

Уже доказано
  • Bhashini — индийская государственная система перевода в реальном времени между 22 языками, включая речевой перевод для граждан, не владеющих хинди или английским.

Генеративная реставрация фото- и кинохроники

Технология: генеративные модели (super-resolution, колоризация) · Эффект: архивы XX века возвращаются в культурный оборот

В архивах республики — фотографии и киноплёнка XX века: аулы до переселений, мастера промыслов за работой, довоенные театральные постановки. Плёнка деградирует, значительная часть материалов в плохом состоянии. Мы восстановим повреждённые кадры генеративными моделями, повысим разрешение, аккуратно колоризируем — и архив превратится в выставочный и медийный продукт: цифровые экспозиции Нацмузея, документальные проекты, контент для продвижения республики. Наше правило честности: реставрированные и колоризированные материалы всегда маркируются как обработанные, оригиналы сохраняются в неизменном виде.

Уже доказано
  • Europeana — системный обзор применений ИИ в наследии: обогащение, восстановление и повторное использование оцифрованных материалов в европейских музеях и архивах.
  • Цифровой двойник Нотр-Дама (CNRS) — пример того, как оцифрованные материалы (сканы, фото) стали рабочей основой реставрации национального памятника.

Пакеты

Пилот

индивидуальный расчёт

Одно решение на реальных данных министерства: например, LLM-помощник для сельских ДК или дашборд над «PRO.Культура.РФ». Быстрый измеримый результат за 4–6 недель.

Стандарт

индивидуальный расчёт

Два-три решения в связке: помощник ДК + афиша-аналитик + старт ИИ-каталогизатора для Нацмузея. Обучение сотрудников и сопровождение включены.

Под ключ

индивидуальный расчёт

Полный контур Afina для министерства, включая фольклорный архив и нейроперевод для театров: программа сбора корпусов, интеграции, регламенты, поддержка.

Этапы работ

Как мы снимаем риски

Почему это работает

Мировой опыт подтверждает

Технологии, которые мы предлагаем, уже доказали себя на задачах того же класса. Europeana системно применяет ИИ для каталогизации миллионов объектов наследия, а AI4Culture собрала открытые датасеты и инструменты, пригодные для переиспользования. Te Hiku Media показала «языковой суверенитет» в действии: община маори сама собрала данные и обучила ASR с точностью 92% — прямой образец наших отношений с дагестанскими джамаатами. Bhashini в Индии довела ту же идею до государственного масштаба — речевые технологии для 22 языков, — а реставрация Нотр-Дама доказала, что оцифрованное наследие однажды спасает оригинал.

Пилот на ваших данных

Перед основным внедрением мы запускаем пилотный проект на реальных данных вашего ведомства: вы тестируете Afina на собственных процессах 4–6 недель и принимаете решение о масштабировании только по измеримым результатам пилота. Стоимость рассчитывается индивидуально после бесплатного обследования.

Обсудить проект

Платформа Afina · Silica Group. Проведём бесплатную встречу-обследование: покажем демо на ваших реальных процессах и составим дорожную карту под ваш бюджет.

Камиль · 8 988 432 7771