Минцифры совместно с представителями бизнеса обсуждает возможность выделения грантов и субсидий на создание наборов данных (датасетов) для обучения больших ИИ‑моделей. Об этом сообщает «Ъ». Предполагается, что русскоязычные и отраслевые датасеты смогут использовать несколько исследовательских команд, что позволит сократить дублирование затрат на их подготовку.
Однако, по мнению экспертов, без чётких требований к дальнейшему использованию созданных данных существует риск, что финансирование достанется крупным компаниям, а сами датасеты окажутся невостребованными. Это может привести к неэффективному расходованию средств и не решить задачу обеспечения отрасли качественными наборами данных.
Детали возможных требований и условия предоставления грантов пока не уточняются. Ожидается, что дальнейшее обсуждение определит, какие именно датасеты будут считаться приоритетными и как будет организован доступ к ним для исследовательских команд.