🤖 OpenAI и Anthropic охотятся за корпоративными данными обанкротившихся стартапов Разработчики больших языковых моделей
Разработчики больших языковых моделей столкнулись с дефицитом качественных данных для обучения нейросетей. Публичный интернет исчерпан — теперь OpenAI и Anthropic активно скупают внутренние корпоративные архивы: переписку в Slack, записи Zoom-созвонов, email-цепочки и коммиты в GitHub. Особенно ценны данные стартапов на грани банкротства или поглощения.
Брокер данных Protege за год утроил оборот — с $30 млн до $100 млн. Гендиректор Бобби Сэмюэлс подтверждает: спрос взлетел на фоне гонки за ИИ-агентами, способными выполнять реальные рабочие задачи. Стартап Warmly (недавно купленный HubSpot) получил четыре предложения по $300 тыс. за протоколы совещаний и внутреннюю переписку — все отклонил.
Главная проблема — обезличивание. Компании вроде Integral обещают «строгий процесс анонимизации», но вопрос остаётся открытым: насколько эффективно можно стереть следы людей из рабочих диалогов, сохранив ценность для обучения моделей?
Корпоративные данные — новая нефть для ИИ или мина под приватность сотрудников?
📊 GPT, Claude, Gemini, DeepSeek, GigaChat — один сервис: chatru.net