Вы отправили голосовое, случайно включили его на громкой связи и на секунду не поняли, кто это говорит. Голос вроде ваш. Но какой-то не тот.
Свой голос в записи звучит выше и тоньше по одной причине: в записи нет костной проводимости (это когда звук от голосовых связок доходит до внутреннего уха прямо через кости черепа, а не по воздуху). Кости добавляют низкие частоты, поэтому голос «изнутри» кажется гуще и солиднее. Микрофон эту добавку не слышит: он ловит только то, что летит по воздуху. Получается, чужой звучит не запись. Чужой для вас та версия, которую всю жизнь слышат окружающие.
Это массовая история. Только в одном мессенджере люди отправляют друг другу около 7 миллиардов голосовых сообщений в день (цифру назвал сам WhatsApp в 2022 году). Мы говорим в микрофон постоянно и почти все морщимся, когда слышим результат. Самое странное в этой теме выяснилось в эксперименте, где людям не сказали, чей голос они слушают. К нему вернёмся ближе к концу.
Почему в записи голос звучит выше, чем в голове?
Потому что вы слышите себя двумя путями сразу, а микрофон - только одним.
Первый путь воздушный: звук вышел изо рта, обогнул голову и дошёл до уха обычным способом. Ровно это и записывает диктофон. Второй путь короче. Связки колеблются, вибрация идёт через кости черепа и мягкие ткани сразу во внутреннее ухо, минуя воздух. Этот второй канал и есть костная проводимость.
Шведские исследователи из Линчёпингского университета измерили обе дорожки у 38 человек, пока те произносили разные звуки; работа вышла в Journal of the Acoustical Society of America в 2010 году. Вклад костной дорожки оказался заметнее всего на низких и средних частотах, а выше начинает преобладать воздух. Отсюда и эффект: «внутренний» голос басовитее, записанный тоньше и звонче.
Проверить можно за пять секунд. Закройте уши ладонями и скажите вслух любую фразу. Голос сразу станет гуще: вы приглушили воздушный путь и оставили костный почти в одиночестве. Примерно то же делают закрытые наушники, поэтому в них собственный голос звучит непривычно громким.
Аналогия простая. Голос в голове - это трек, который играет через колонки с включённым сабвуфером. Запись - тот же трек без сабвуфера. Ноты одни и те же, ощущение разное.
Какой голос настоящий: тот, что в записи, или тот, что в голове?
Настоящие оба, но другим людям достаётся только записанный.
Костная добавка существует исключительно внутри вашей головы. Ни коллега на созвоне, ни кассир в магазине, ни человек, которому вы отправили голосовое, её никогда не слышали. Для них ваш голос всю жизнь звучит так же, как в записи, и их это не смущает.
Нейроучёные из Федеральной политехнической школы Лозанны (Швейцария) проверили, насколько эта добавка встроена в узнавание себя. В работе, опубликованной в Royal Society Open Science в 2023 году, участникам давали голосовые морфы (смеси их собственного голоса с чужим в разных пропорциях, от 15 до 85 процентов) и просили ответить, чей голос звучит. Часть звуков подавали через наушники, часть - через вибратор, прижатый к черепу. Костная подача улучшала узнавание именно себя, а на распознавание других знакомых голосов не влияла.
Что это значит на практике: мозг использует костную дорожку как метку «это я». В записи метки нет, и первая реакция честная - «говорит кто-то другой».
Ограничения стоит назвать прямо. Выборки маленькие: три эксперимента по 16, 16 и 52 человека. Условия лабораторные. Авторы сами пишут, что не смогли полностью отделить акустический эффект от ощущения вибрации на коже.
Есть и второй слой, психологический. Команда из Института эмпирической эстетики Общества Макса Планка во Франкфурте в 2025 году развела два понятия: объективная высота вашего голоса (фундаментальная частота - самая низкая частота колебаний связок, её видит любой анализатор) и субъективная, которую вы считаете своей. В эксперименте люди хуже замечали мелкие изменения высоты рядом с обеими, чем рядом с контрольной частотой. Проще говоря, мозг держит внутренний портрет вашего голоса и не придирается к деталям внутри него.
С физикой разобрались. Но если запись - это просто «вы без сабвуфера», почему от неё передёргивает?
Почему от собственного голоса становится неловко?
Потому что в записи вы впервые слышите себя со стороны и слышите заметно больше, чем ожидали.
У этого есть название: voice confrontation, столкновение с собственным голосом. Термин закрепили психологи Филип Хольцман и Клайд Роузи в 1966 году, изучая реакцию людей на собственные записи. Суть не в тембре. В записи слышно то, что вы обычно не отслеживаете: спешку, неуверенность, раздражение, паузы, которые казались короткими.
Нил Бхатт, отоларинголог из Университета Вашингтона, объясняет реакцию как несовпадение самовосприятия с реальностью и приводит показательные данные: в исследовании 2005 года пациенты оценивали качество своей записанной речи заметно строже, чем те же записи оценивали клиницисты. Разрыв был не в звуке, а в том, кто слушает.
Выглядит это так. Вы наговорили коллеге сорокасекундное голосовое, переслушали перед отправкой и услышали шесть «ну», два «короче» и странно высокий смешок в конце. Собеседник в этот момент услышит обычного человека, который объясняет задачу. Вы услышите провал.
Дальше всё решает ярлык «это я». Когда его снимают, оценки переворачиваются.
Втайне вы себе нравитесь: эксперимент, который всё переворачивает
Люди ставят своему голосу более высокие оценки, чем чужим, если не знают, что слушают себя.
Психологи Сьюзан Хьюз и Марисса Харрисон собрали 80 участников и дали им оценить привлекательность набора голосовых записей. Участникам не сказали, что в подборку тайно добавлены их собственные голоса. Результат вышел в журнале Perception в 2013 году: свой голос люди оценили выше, чем его оценили другие слушатели, и выше, чем сами оценили чужие голоса. Авторы назвали это вокальным имплицитным эгоизмом - формой самовозвышения.
Соберём картину вместе. Как звук ваш голос людям скорее нравится, и вам самим он тоже нравится - ровно до момента, когда включается опознавание. Проблема не в частотах и не в микрофоне. Проблема в ярлыке.
Значит, и работать надо не с голосом, а с привычкой его слышать.
Как перестать вздрагивать от своего голоса?
Слушать себя чаще и понемногу, а не один раз и с разбором каждой ошибки.
Работает эффект простого предъявления (mere exposure - закономерность, при которой нейтральный объект нравится тем больше, чем чаще с ним сталкиваешься). Голос в записи для вас новый объект. Первые разы он воспринимается как чужой, потом мозг перестаёт отмечать его как новость. Тот же механизм, из-за которого раздражающая песня через неделю становится нормальной.
Типичный сценарий провала выглядит иначе. Человек записывает себя один раз, ужасается, удаляет файл и следующие полгода избегает микрофона. Избегание не даёт мозгу шанса привыкнуть, и на любой созвон с включённой камерой вы приходите с тем же напряжением, что и в первый раз.
Но у честного совета «слушайте себя чаще» есть слабое место. Диктофон - скучный тренажёр. Там нет задачи, нет игры и нет причины включить его завтра снова. Поэтому люди бросают на второй день.
А вот когда у голоса появляется задача, всё меняется.
Почему озвучка видео работает лучше диктофона?
Потому что вы перестаёте оценивать себя и начинаете попадать в чужую фразу.
Дубляж (переозвучка готового видео своим голосом) давно проверяют не как развлечение, а как учебный приём в языковых классах. Логика та же, что и с вашей неловкостью: вы слушаете образец, повторяете и слышите результат.
Что показали исследования:
- Гонконг, 2024. Мин Се и Алекс Це из Университета Гонконга сравнили два подхода на пятиклассниках: 104 ребёнка занимались английским через онлайн-дубляж видео, 102 учились традиционно. После 12 занятий разница в устной речи между группами оказалась статистически значимой (F = 8,291; p = 0,004), то есть случайностью её объяснить нельзя.
- Вьетнам, 2025. Ван Туйет Тхи Фан и коллеги 10 недель занимались дубляжом с 30 одиннадцатилетними учениками. Общая оценка произношения выросла с 14,86 до 16,50 балла, сильнее всего подтянулась интонация (с 3,36 до 4,30). Почти все участники (96,67 процента) сказали, что приём помог, а 83,33 процента - что стало интереснее заниматься.
- Осторожность по вьетнамской работе. Авторы честно перечисляют ограничения: маленькая группа, отсутствие контрольной группы и короткий срок. Одна такая работа ничего не доказывает, но она сходится с гонконгским экспериментом, где контрольная группа была.
Важная оговорка, чтобы не обещать лишнего. Оба исследования измеряли речь на иностранном языке, а не уровень стеснения. Прямых данных, что дубляж лечит неприязнь к своему голосу, пока нет. Зато есть механизм, который подтверждён отдельно: регулярный контакт с записью снижает её новизну, а задача переключает внимание с самооценки на попадание в момент.
Как озвучить видео своим голосом за 5 минут
Проще всего взять короткую сцену и переозвучить в ней несколько реплик.
Мы собрали для этого Awe Voice - бесплатную игру-дубляж прямо в браузере. Логика такая:
- Берёте видео. Свой ролик с телефона, компьютера или из облака.
- Отмечаете реплики. До пяти штук, каждая до пятнадцати секунд. Слушаете оригинал, повторяете своим голосом, перезаписываете сколько угодно раз.
- Смотрите и скачиваете. Свой голос вы услышите только в самом конце, целиком поверх видео, и сохраните файл себе.
Ключевая деталь тут - именно последняя. Во время записи вы себя не слышите. Пока идёт дубль, внимание занято чужой фразой и попаданием в момент, а не разбором собственного тембра. Встреча с записью происходит один раз, в финале, и уже вместе с результатом, который вы сделали.
Про приватность отдельно, потому что вопрос про микрофон всегда первый. Ни видео, ни запись голоса не уходят на сервер: всё живёт в открытой вкладке и исчезает, когда вы её закроете. Поделиться результатом можете только вы сами, скачав файл. Это, кстати, не паранойя разработчиков: короткой записи голоса сегодня хватает, чтобы его синтезировать. Мы разбирали это в материале о том, сколько секунд нужно, чтобы подделать голос.
Пять ошибок первого дубляжа
Почти все они про технику, а не про талант.
- Записывать без наушников. Микрофон поймает оригинал вместе с вашим голосом, и в финале дорожки наложатся друг на друга.
- Говорить слишком тихо от стеснения. Смотрите на полоску громкости: она должна доходить хотя бы до середины. Тихий дубль звучит неуверенно даже там, где вы сыграли уверенно.
- Брать длинные реплики. Фразу на 15 секунд трудно удержать в голове целиком. Пять-семь секунд ловятся с первого-второго раза.
- Прижиматься к микрофону вплотную. Появляется гул и щелчки на согласных. Ладонь между ртом и телефоном - нормальное расстояние.
- Добиваться идеала на первой реплике. Смешное рождается из несовпадения между тем, что вы играли, и тем, что получилось. Идеальный дубль обычно скучный.
С чего начать сегодня
Откройте любое своё видео на минуту, отметьте одну реплику секунд на десять и озвучьте её. Это займёт меньше пяти минут и даст ровно то, чего не даёт диктофон: вы услышите себя не как объект оценки, а как часть сцены.
И то самое голосовое, от которого вы вздрогнули в начале, перестанет звучать чужим. Оно и не было чужим. Просто вы впервые услышали себя без сабвуфера.
Источники
- Reinfeldt S. и др. Hearing one's own voice during phoneme vocalization. Journal of the Acoustical Society of America (2010)
- Orepic P., Kannape O., Faivre N., Blanke O. Bone conduction facilitates self-other voice discrimination. Royal Society Open Science (2023)
- Neamaalkassis H. и др. The fundamental frequencies of our own voice. Royal Society Open Science (2025)
- Hughes S., Harrison M. I like my voice better: self-enhancement bias in perceptions of voice attractiveness. Perception (2013)
- Bhatt N. Why do we hate the sound of our own voices? The Conversation, University of Washington (2021)
- Xie M., Tse A. Impact of online video dubbing activities on grade 5 students' pronunciation, accuracy and fluency. ICCE, University of Hong Kong (2024)
- Phan V. T. T., Nguyen T. Q., Nguyen K. D. The effects of video dubbing on EFL learners' pronunciation. TESL-EJ (2025)
- TechCrunch со ссылкой на данные WhatsApp: 7 млрд голосовых сообщений в день (2022)






