Во всяких замерах нужно сначала посмотреть на мерятели. Алгоритм сжатия-разжатия и шифрования это проц и память, может немного IO, и там неоткуда рзятся такой разнице, если только в этом zstd нет ifdef с интересными особенностями. А то я помню как меряли производительность постгреса на zfs с воплем о том что вот всё по дефолту, а что zfs по дефолту ни разу не для БД а для файлов и там на каждый чих с дика поднимается 128к вместо 4 с соответсвующими задержками, измеряющий благоразумно умолчал. Я б на флеймграф того эксперимента посмотрел, меня терзают смутные что лапчатые уже под предпоследние процы с SIMD собираются, а во фре из коробки работает всё, что не истлело катастрофически…