В Китае уже более 126 тысяч датасетов для ИИ
Национальное управление данных Китая объявило о значительном росте качественных наборов данных, доступных для разработки искусственного интеллекта. По последним данным, в стране уже создано более 126 тысяч высококачественных датасетов, общий объем которых превышает 1815 петабайтов (PB).
Эти данные были представлены на 2026 году China International Big Data Industry Expo, проходящей в городе Гуйян. Ответственный представитель Национального управления данных отметил, что это множество высококачественных датасетов является ключевой основой для развития искусственного интеллекта в стране.
Высококачественные датасеты определяются как совокупность прошедших обработку данных, включая сбор и трансформацию, и могут быть непосредственно использованы для разработки и тренировки моделей искусственного интеллекта. Эффективность таких датасетов заключается в их способности значительно улучшать производительность моделей.
По состоянию на август текущего года общее количество высококачественных датасетов превысило 126 тысяч. Это демонстрирует впечатляющий рост – более 89% по сравнению с показателями конца первого квартала этого года.
Национальная система управления данными, запущенная в апреле этого года, уже способствовала публикации более 1700 датасетов. Это свидетельствует о последовательных усилиях по наращиванию объемов и улучшению доступности данных в Китае.
Выставка Big Data Expo в этом году также впервые представила "Data Market" (Рынок данных). На этой платформе 95 компаний, работающих с данными, представили 253 своих лучших продукта. Цель такого новшества – способствовать более точному взаимодействию между поставщиками данных и их пользователями, стимулируя тем самым инновации и эффективное использование данных.
Увеличение количества и качества доступных датасетов является критически важным шагом для ускорения исследований и разработок в области искусственного интеллекта. Это позволяет создавать более мощные и более точные модели, что, в свою очередь, открывает новые возможности для применения ИИ в различных областях – от медицины и финансов до автономного транспорта и научных исследований.
Рост объема данных в 1815 г. PB также подчеркивает тенденцию к накоплению больших данных, что является необходимым условием для тренировки современных моделей глубокого обучения. Важно, что акцент делается именно на высококачественные датасети, что свидетельствует об осознании необходимости не только количества, но и релевантности и точности данных для достижения наилучших результатов в ИИ.
Источник: https://www.ithome.com/0/995/893.htm
- Последние
- Популярные
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
- Август, 31
-
Новости по дням
1 сентября 2026