В России появился стандарт для синтетических данных нейросетей
Ассоциация больших данных совместно с АНО «Национальный технологический центр цифровой криптографии» разработала предварительный национальный стандарт для синтетических данных – искусственно созданной информации, которая имитирует реальные сведения, не раскрывая личность людей.

Единых требований к таким данным в стране раньше не было, хотя их используют для обучения ИИ, проверки моделей машинного обучения и обмена информацией между организациями. Документ описывает нейросетевые методы синтеза, способы защиты приватности и критерии оценки качества.
Над стандартом с начала 2025 года работали «Яндекс», VK, «Сбер», Т-банк, МТС и НТЦ цифровой криптографии. В ассоциации считают, что без такого документа невозможно эффективно обучать отечественные ИИ-модели: качественные синтетические данные не связаны с исходной персональной информацией и открывают доступ к массивам, ранее закрытым из-за чувствительности.
Инициативу поддержали «Ростелеком», «МегаФон» и Сбербанк – там считают, что стандарт снизит риски утечек и ускорит внедрение ИИ в госсекторе и бизнесе.
Документ будет действовать три года, после чего может стать полноценным ГОСТом. Единого международного стандарта в этой сфере пока нет: работа ведется в Международной организации по стандартизации и Международной электротехнической комиссии.








































