Китай столкнулся с проблемой, которую не решить санкциями в…

Китай столкнулся с проблемой, которую не решить санкциями в обратную сторону: заканчиваются данные на китайском языке для обучения AI. Китайский контент составляет всего 1,3% глобального веба, английский — почти половину. WeChat и Douyin не делятся данными с разработчиками AI-моделей, а издательства начали добавлять в книги запреты на использование текстов для тренировки алгоритмов. Пекин объявил данные стратегической инфраструктурой и планирует создать национальные датасеты к 2028 году. В США компания Anthropic в рамках проекта Panama скупала и уничтожала миллионы физических книг для сканирования, китайские власти пытаются оцифровать древние рукописи, пока издатели окончательно не закрыли к ним доступ. Гонка AI упирается не только в чипы, но и в язык.
9 авг 2026, 16:00


