声で語り継ぐ——AIポッドキャストと、講談・口承が磨いた「語り」の技法

はじめに——文章が、ひとりでに「語り」はじめた

2024年9月、Google(Google LLC)が公開した「NotebookLM」の音声機能「Audio Overview」は、世界の知的生産のあり方を静かに揺さぶった。ユーザーが資料をアップロードすると、二人のAIホストが、まるで長年組んできたラジオパーソナリティのように、その内容を相づちと脱線を交えながら語り合う音声番組を生成する。読むはずだった文書が、聞くべき「語り」に姿を変えたのである。

この体験の核心は、要約の精度ではない。むしろ「声で語られると、文章では伝わらなかった温度や強弱が立ち上がる」という、人類がきわめて古くから知っていた事実の再発見にある。音声合成の最前線では、ElevenLabs(ElevenLabs Inc.)の音声クローン技術が、特定の話者の声色や癖まで写し取り、NotebookLMの既定の声を任意の声へ差し替えるワークフローまで定着しつつある。文章を声に変換する技術は、もはや棒読みの読み上げではなく、「誰が、どんな調子で語るか」という演者の領域に踏み込んでいる。

ここで思い起こしたいのが、日本が数百年かけて磨いてきた「語り」の芸能、すなわち講談(こうだん)と口承(こうしょう)の文化である。文字に書かれた物語を、いかに声で立体的に立ち上げ、聴き手の心に刻むか。AIが語りはじめた時代に、語りのプロたちが築いた技法は何を教えてくれるのか。本稿では、AI音声の現在地を確認したうえで、講談という話芸を補助線に、「声で語り継ぐ」という営みの本質を考える。

この記事の続きは会員限定です。