Целью экспертизы являлось решение комплекса фоноскопических задач: установление дословного содержания зафиксированного на спорной фонограмме разговора, дифференциация говорящих и идентификация участников беседы по голосу и звучащей речи, а также атрибуция отдельных реплик каждому из дикторов. Работа велась комиссией экспертов, объединивших компетенции в области исследования голоса и звучащей речи, продуктов речевой деятельности и технического исследования звукозаписей, что позволило сочетать лингвистические и инструментально-акустические подходы. На подготовительном этапе эксперты осмотрели и описали поступившие носители, проверили целостность упаковки, зафиксировали технические параметры файлов (формат, размер, продолжительность) и рассчитали контрольные хеш-суммы по алгоритму MD5, обеспечив неизменность исследуемых данных. Отдельной сложностью стал отбор пригодного материала: из массива предоставленных на дисках файлов требовалось выделить именно те фонограммы, которые относились к предмету исследования, отделив дубли и записи худшего качества. Дословное содержание разговора устанавливалось методом многократного прослушивания речевого материала с последовательной фиксацией всех аудитивно различимых реплик; для неоднозначных фрагментов применялась система условных обозначений, отражавшая предположительно установленные слова, неразборчивые участки и вариативные прочтения.
Разделение говорящих проводилось путём попарного сравнения реплик по общим и частным признакам — высоте, тембральной окраске и громкости голоса. Для решения идентификационных задач эксперты предварительно оценивали пригодность спорной фонограммы и образцов, руководствуясь установленными в методической литературе критериями: частотным диапазоном полезного сигнала в пределах 0–3700 Гц, отношением сигнал/шум не менее 10–15 дБ, допустимой неравномерностью амплитудно-частотной характеристики тракта, требованиями к разборчивости на уровне слов и к достаточной длительности речевых сигналов, а также к текстуальной и эмоциональной сопоставимости образцов со спорным материалом. При исследовании последовательно применялись аудитивный (перцептивный, слуховой) анализ голоса и речи, лингвистический анализ по единицам структурных уровней звучащей речи, а также инструментальный акустический и спектральный анализ, в ходе которого оценивались форманты, характеристики основного тона и микроструктура звуков на динамических спектрограммах. Исследование опиралось на действующую нормативную и методическую базу, включая Федеральный закон от 31.05.2001 № 73-ФЗ «О государственной судебно-экспертной деятельности в Российской Федерации», ГОСТ 13699-91 «Запись и воспроизведение информации. Термины и определения», ГОСТ Р 50840-95 «Передача речи по трактам связи. Методы оценки качества, разборчивости и узнаваемости», а также на типовые методики криминалистического исследования фонограмм. Технической основой работы служили специализированные программно-аппаратные комплексы для фоноскопических исследований, компьютерная речевая лаборатория и профессиональное тракты воспроизведения звука, что обеспечило корректность инструментальных измерений.