CERN — это не просто «большой научный сервер», а конвейер, который режет поток данных почти до нуля, прежде чем что-то попадёт в архив. На выходе — больше эксабайта накопленных данных за всё время работы коллайдера, но в хранилище уезжает лишь крошечная доля: около 0,01% событий, остальное отбрасывается на лету.
Как это вообще работает? Сначала детектор видит столкновение, которое рождает тысячи сигналов за микросекунды. Дальше в бой идут три уровня фильтрации: железо и быстрые триггеры, которые за доли секунды решают «оставить/выкинуть», затем более умный софт, который уже анализирует форму события и его физическую ценность. 💾
Это очень похоже на хорошо настроенный production pipeline: сначала грубый cut на edge, потом более дорогая обработка только для нужных данных. И самое интересное — архитектуру проектируют на десятилетия: форматы, архивы, распределённое хранение, доступ физикам по всему миру. Отличный пример того, как строят систему, где ошибка фильтрации стоит не денег, а потерянной науки.
DevTools Radar
@DevToolsRadarPro
CERN — это не просто «большой научный сервер», а конвейер, который режет поток данных почти до нуля, прежде че
Этот пост опубликован в Telegram-канале DevTools Radar. Подписаться можно по ссылке: @DevToolsRadarPro.