Архивный авторский материал перенесён без переписывания. Внешние утверждения отдельно не перепроверялись и относятся к дате публикации.
Google, обанкротившаяся авиакомпания и данные с 1986 года
Второго мая авиакомпания Spirit закрылась и уволила около семнадцати тысяч человек
Четырнадцатого августа с аукциона по банкротству ушло всё, что осталось внутри:
- сто миллионов писем сотрудников
- пятьсот миллионов сообщений из корпоративного мессенджера
- информация о 763 тысячи рейсов
- 1,2 миллиона топливных ведомостей
- 787 452 закупки запчастей
- 600 тысяч тикетов техподдержки
- 17 миллионов файлов из облака
- тридцать миллионов строк кода
- семь с половиной миллиардов записей о том, что покупали пассажиры начиная с 2008 года
Собирается полный слепок того, как работала большая компания: кто кому писал, как эскалировали, где согласовывали, чем кончилось
Торги выиграл Google, не большие в рамках гугла 10 миллионов долларов
Сто семьдесят шесть тысяч личных дел сотрудников Самое старое завели в 1986 году
Второй претендент, Mercor Дали 7,5 миллионов и записаны резервным покупателем
Персональные данные в сыром массиве есть, так пишет судебный документ: около ста миллионов имён пассажиров, почти 13 миллионов активных адресов Данные обезличивает назначенный судом независимый наблюдатель
Что говорят про цель
Google официально: «корпоративный набор данных», который «поможет улучшить наши продукты и модели ИИ». Всё.
Журналисты в своем стиле “источник, знакомый со сделкой, сказал Forbes анонимно”: нужны реальные рабочие данные без идентификаторов, чтобы ИИ-агенты Google работали лучше.
Forbes в апреле разбирал этот рынок отдельно: лаборатории скупают внутренние коммуникации закрывшихся компаний, чтобы модели лучше справлялись с поддержкой клиентов, финансами и календарём Там же пример компании, которая при закрытии продала свой тринадцатилетний цифровой след за «сотни тысяч долларов»
В балансе есть строчка для самолётов и для слотов Для того, как и кто в компании работал, строчки нет Оно лежит в почте, в трекере задач и в кадровых файлах, и пока бизнес идёт, активом это никто не считает
Ключевой вопрос, который я себе задаю, не про 10 млн долларов, для гугла это небольшая сумма
Мне интересно, что они собираются обучать и какой корпус данных для какой специфичной задачи хотят выкристаллизовать
Источники и след
- 01 Оригинал в канале Under the Hood Происхождение / Telegram / сообщение 835