声年齢診断のやり方
「録音」ボタンを押して、普段の声で文章を5秒ほど読み上げるだけです。安定した結果を出すコツは4つあります。
- 静かな場所で録る。エアコンやテレビの音は結果を老けさせます。
- 話し始める前に1秒黙る。言葉のすき間から部屋の雑音を測って補正するためです。
- 普段の話し声で文章を読む。作り声や、1つの音をのばす発声は避けます。
- 3回録って真ん中の結果を見る。1回ごとに数歳の揺れがあります。
VTuberや配信者のあいだでも声の判定は話題ですが、この診断はランダムな数字ではありません。同じ音声なら必ず同じ結果になり、発声の臨床や研究で使われる指標で計算しています。
何歳に聞こえるかはどう決まる?
声の質:推定の70%
声帯は年齢とともに弾力を失い、声の倍音の並びが少しずつぼやけます。これをいちばん素直に追えるのがケプストラムピーク(CPPS)で、声のスペクトルがきれいな倍音の櫛にどれだけ近いかを表します。声の質のうち4分の3がCPPS、残り4分の1はジッター(1周期ごとの高さの揺れ)とシマー(音量の揺れ)をまとめた粗さスコア(0〜100)です。
ジッターとシマーの比重が小さいのは、その臨床基準が「あー」とのばす持続母音向けだからです。本サイトが以前、ふつうに朗読する11人を測ったところ、ジッターは2.5〜8.2%で、臨床の目安1%を全員が超え、旧バージョンでは全員がおよそ14歳上に判定されていました。CPPSは話し声のための指標なので、この弱点がありません。
声の高さ:推定の30%
話し声の高さ(基本周波数・F0)も年齢で変わります。女性寄りの声はゆるやかに低くなり、男性寄りの声は中年ごろまで低くなってからやや高くなる傾向があります。どちらの曲線を使うかは、同じ録音の性別判定で決まります。比重が小さいのは、同年齢の人どうしの差が年齢による変化よりずっと大きいからです。高さを重く見ていた旧バージョンは、普通の140 Hzの男性の声を44歳と判定していました。
結果画面の見かた
声の質は若いのに高さが年上寄りなら、もともとの声の高さが平均から離れているだけのことが多いです。逆に高さは若いのに声の質が粗いときは、録音の雑音を疑ってください。
結果がブレる・実年齢より上に出る理由
マイクと部屋。雑音、反響、安価なマイクは、加齢と同じ方向に倍音をぼやけさせます。声帯の雑音と部屋の雑音は音響的に区別できません。そこで本サイトは言葉のすき間から雑音を測ってSN比を出し、その分を補正しています。きれいな録音とSN比10 dBの録音ではCPPSが約3.2 dB下がり、補正しないと見かけの年齢が10歳ほど上がるためです。補正を入れる前のバージョンでは、同じ合成音声が雑音なしで25歳、雑音を足しただけで32歳と判定されていました。
喉の状態。風邪、乾燥、話し疲れ、起きてすぐの時間帯は、ジッターとシマーを押し上げます。午後、水を一口飲んでから録るのがおすすめです。
話し方と文章。作り声やマイクへの近づきすぎも数値を変えます。読む文章が変わるだけでも結果は動きます。
本サイトの実測:同じ声でも年齢はどれくらい動く?
LibriVoxのパブリックドメインの朗読音声を、ブラウザと同じ解析コードで検証しました。読み手A・Bは健康な大人の声、Cは粗い声で録音品質も低めです。
実測1:20秒の朗読を5秒ずつ7回
話し手もマイクも同じでも、推定年齢は4〜7歳動きました。読み手Aの声の高さは区間ごとに206〜295 Hzと変わっています。それでも3人の順位は一度も入れ替わりませんでした。
実測2:雑音を足していくと
冒頭8秒に一定の雑音を足し、SN比約10 dBまで下げました。補正前のCPPSは読み手Aで7.02から3.68 dBへ下がりましたが、補正後の推定年齢はAが28〜31歳、Bが32〜36歳に収まりました。一方、粗い声のCは49歳から39歳へ下がりました。補正が粗さの一部まで雑音とみなすためで、騒がしい部屋ではかすれた声が若めに出ることがあります。詳細は英語版の検証記事にあります。
若く聞こえる声のコツ(根拠のあるものだけ)
- 喉を整える。水分をとる、怒鳴らない、たばこを吸わない。
- 声を日常的に使う。発声の練習は声帯の状態に実際の効果があります。
- 無理に高い声を作らない。高さは30%にすぎず、作り声は声の質の数値も変えます。
- 録音環境を整える。部屋の雑音で老けて出るのを防ぐ、いちばん確実な方法です。
年齢による構造的な変化は元に戻りません。同じ部屋・端末・文章で数か月ごとに録り、年齢の数字よりCPPSと粗さスコアの変化を見るのが役に立ちます。急な声の変化が2〜3週間以上続くときは医師に相談してください。
この診断でわからないこと
同年齢の人どうしの差は10年ごとの変化より大きく、喫煙やホルモン、声の使い方も結果を動かします。深層モデルを使った学術研究でも平均誤差は約5歳で、本ツールの正直な誤差は10歳前後です。推定は16〜56歳の範囲に収めており、上限付近は「それ以上のどこか」という意味です。上限は2026年9月に68歳から56歳へ下げました。高い数字の多くが、高齢の声ではなく雑音の多い録音から出ていたためです。結果は娯楽と自己練習のための推定で、医療的な診断ではありません。総合点や声タイプは声診断、男女どちら寄りかは声の性別判定で確認できます。
よくある質問
自分の声は何歳に聞こえますか?
5秒録音すると、推定年齢と前後9歳の幅が表示されます。推定の70%は声の質(主にCPPS、ジッター、シマー)、30%は話し声の平均の高さから計算しています。
声だけで年齢は本当にわかりますか?
広い幅の中でなら、おおまかにわかります。人が声だけで他人の年齢を当てても誤差はおよそ10歳で、音響的な方法も同じくらいです。声に表れるのは声帯の状態で、年齢だけで決まるものではありません。
実年齢より老けて出るのはなぜですか?
多くの場合、原因は部屋とマイクの雑音です。雑音は加齢と同じ方向に倍音をぼやけさせます。風邪、疲れ、起きてすぐの録音も結果を上に押し上げます。
結果はどれくらい正確ですか?
数字1つではなく、前後9歳の幅を答えとして見てください。本サイトの実測では、同じ朗読を5秒ずつ7回診断しても推定年齢は4〜7歳動きました。
若く聞こえる声にすることはできますか?
水分をとる、怒鳴らない、たばこを吸わない、声を日常的に使うことは振動を規則正しく保つ助けになります。ただし年齢による構造的な変化は元に戻りません。
録音はアップロードされますか?
いいえ。解析はすべてお使いのブラウザの中で行われ、音声が送信・保存されることはありません。