Росстандарт утвердил первую в России серию предварительных национальных стандартов по синтезу данных, которую при непосредственном участии Сбера, разработала Ассоциация больших данных. С 1 сентября 2026 года ПНСТ 1064‑2026, 1065‑2026 и 1066‑2026 переведут технологию синтетических данных из категории экспериментальных практик в статус формализованного инструмента для бизнеса, государства и разработчиков цифровых решений.
Узнайте больше в полной версии ➞Утвержденная серия документов охватывает ключевые элементы работы с синтетическими данными: закрепление базовых положений и терминологии, описание архитектуры процесса и методов синтеза, требования к описанию результатов и методике оценки качества. В совокупности это формирует единые правила и прозрачные критерии, создавая для рынка методологическую основу для внедрения синтетических данных в корпоративную и отраслевую практику.
«Качественные синтетические данные, с одной стороны — безопасны, а с другой — позволяют исследователям разрабатывать ИИ-решения благодаря тому, что в таких датасетах повторяются все свойства оригинальных данных. Эксперименты показали, что прогнозные модели, построенные на синтетике, уступают моделям на реальных данных всего 2-3 процента точности. Сбер несколько лет развивает собственный сервис SyntData — экосистему генерации и использования синтетических данных, это позволяет существенно ускорить и упростить доступ к данным. Очень важно не только разработать алгоритм синтеза, но и создать инфраструктуру работы с этим алгоритмом: от подготовки обучающей выборки до оценки качества. Доверие к качеству полученных синтетических данных — ключ к их широкому использованию. Уверен, что принятие предварительных национальных стандартов позволит распространить практики синтеза для всего рынка и повысит использование синтетических данных для развития технологий искусственного интеллекта», — отметил старший вице-президент, руководитель блока «Технологии» Сбербанка Кирилл Меньшов.
Для бизнеса работа с синтетическими данными по единым стандартам означает ускорение разработки и внедрения решений на базе ИИ, снижение затрат на подготовку данных и уменьшение рисков, связанных с использованием чувствительной информации. Компании получают удобный инструмент для тестирования продуктов, проведения пилотов, обучения моделей и масштабирования сервисов в условиях растущих требований к информационной безопасности и комплаенсу, а стандартизированная оценка качества синтетических данных обеспечивает сопоставимость решений и повышает доверие рынка.
«Развитие суверенитета России в области ИИ требует совместной работы государства, бизнеса и научного сообщества. Предварительные национальные стандарты применения технологий синтетических данных дают нам общий, понятный всем участникам рынка инструмент. Бизнес получает безопасный доступ к данным для разработки и тестирования ИИ‑решений, а государство — уверенность в том, что права граждан и требования безопасности соблюдаются в полной мере. Утверждение ПНСТ — важный шаг к формированию доверенной среды, где новые сервисы создаются в партнёрстве государства и компаний и сразу ориентированы на ответственное обращение с данными и защиту пользователей», — рассказал заместитель министра цифрового развития, связи и массовых коммуникаций РФ Александр Шойтов.