「AIで曲が作れる時代が来た」という言い方を、ここ2年でいったい何度聞いたでしょうか。でもこの言葉には、ひとつ大きな誤解が含まれています。
機械が作曲を始めたのは2023年ではなく、1956年なんです。
ただし、70年の歴史は一本の線ではありません。
「機械に作曲をさせる」という線と、「作曲家が演奏家や歌手に頼らなくても曲を完成させられる」という線が、長いあいだ別々に進んでいました。
この2本が、誰でも使える形で2023年に大きく合流したからこそ、今の衝撃があります。
この記事ではその2本の線をたどり直し、合流した先で作曲という行為がどうなるのかを、ひとりの作曲家として現場で見てきた記録と一緒に考えていきます。
目次
作曲の2本の線
1本目の線:機械が作曲する(1956年〜)
1956年、規則に従う作曲は計算で済むと分かった
最初にコンピュータで作られた本格的な作品は、1956年にイリノイ大学のレジャレン・ヒラーとレナード・アイザックソンが完成させた弦楽四重奏「イリアック組曲」です。
当時の巨大計算機ILLIACに対位法の規則(音の重ね方の決まり)を教え込み、規則に従う音の並びを機械に選ばせて楽譜にしました。
当時の音楽家たちはこれを「作曲ではなく計算だ」と退けましたが、わたしはむしろ、作曲の中に「計算で済む部分」が含まれていることを初めて暴いた作品だったと思っています。
音楽理論の授業で何年もかけて身につける規則が、計算機なら数時間でこなせると証明されたわけですから。
1981年、様式は真似できると分かった
次の転機は1981年、作曲家のデイヴィッド・コープが始めたEMI(Experiments in Musical Intelligence)です。
コープはバッハやモーツァルトの楽譜を分析して特徴的な音の動きを抜き出し、それを組み替えて「バッハ風」「モーツァルト風」の新作を生み出しました。
聴衆に本物と並べて聴かせると、しばしば区別がつかなかったという逸話で知られています。
作曲家の個性だと思われていた「誰々らしさ」が、分析と再構成で再現できてしまう。
これは今のSunoが「80年代シンセポップ風」を作れることの、40年早い予告編でした。
ただしイリアック組曲もEMIも、出てくるのは楽譜であって音ではなく、演奏して録音するのは相変わらず人間の仕事でした。
2本目の線:作曲家が、人に頼らなくてよくなる(1983年〜)
MIDIが「演奏家を探す苦労」をなくした
ここで、まったく別の線が動きはじめます。
1983年にMIDI規格が定められ、シンセサイザーやリズムマシンをパソコンから制御できるようになると、作曲家は自分の曲を演奏家に頼まなくても、打ち込みで鳴らせるようになりました。
これは作曲が小さくなった話ではありません。
曲を書いても、演奏してくれる人を探し、頼み、スタジオを押さえて録るという、作曲とは別の、しかし作曲家にとって最大級の苦労がなくなったという話です。
作曲そのものは、むしろ純粋に作曲家の手元に残りました。
VOCALOIDが「歌ってくれる人を探す苦労」をなくした
それでも最後まで残った苦労が、歌でした。
インストならひとりで完結できても、歌ものを作るなら、自分の曲を歌ってくれる人を探さなければならない。
これがどれほど大変かは、歌ものを作ったことのある人なら誰でも知っているはずです。
2004年にヤマハのVOCALOID技術を使った製品が発売され、2007年にクリプトンから初音ミクが登場して、この苦労が消えました。
当時の声はまだ明らかに機械で、「人が歌っているようだ」と言える水準ではなかったのに、日本のリスナーはそれを「歌もの」として受け入れました。
欧米の歴史ではここが抜けていて、2023年にSunoが突然歌いだして驚いたとき、日本は20年前から驚かなくなっていたんです。
作曲能力だけが、むき出しでクローズアップされた時代
MIDIが演奏家を、VOCALOIDが歌い手を不要にしたことで、2000年代後半の日本には、ある特別な時代が来ていました。
演奏の上手さも、歌の魅力も、見た目も関係ない。曲そのものの良さだけで勝負が決まる場所が、ニコニコ動画の上に出来上がったわけです。
その象徴が、ボカロP「ハチ」として曲の力だけで名を上げ、のちに米津玄師としてメジャーで活躍することになる人でした。
作曲能力が飛び抜けていれば、楽器も歌も人に頼らず、顔も出さずに、曲だけで数百万人に届く。わたしはこの時代を、作曲という行為が歴史上いちばん純粋に評価された数年間だったと思っています。
2023年、2本の線が合流した
機械が作曲し、しかも演奏も歌も人に頼らない
2020年のOpenAI Jukeboxは、楽譜を経由せず音の波形そのものを直接生成しました。
音質は粗く、1分の音声を完全に生成するのに約9時間かかりましたが、「機械が作曲する線」が、歌声まで含む長い楽曲を生の音として直接生成するところまで来た瞬間です。
そして2023年1月のGoogle MusicLM、2023年末に一般公開されたSuno、2024年のUdioで、2本の線は完全に重なりました。
機械が作曲し、その機械が演奏も歌も自分でやってしまう。
1本目の線が66年かけて積み上げた「機械の作曲」と、2本目の線が40年かけて積み上げた「人に頼らない完結」が、ひとつの画面の中で同時に起きたんです。
衝撃が大きかったのは当然です。
2026年3月のSuno v5.5は、自分の声を使う「Voices」と、自分の楽曲から専用モデルを作る「Custom Models」まで打ち出しています。
作曲は、なくなったのではなく「しなくてもよくなった」
ここで、いちばん大事な区別をしておきます。
Sunoの登場で「作曲するという行為がなくなった」のではありません。
「作曲しなくても曲が手に入るようになった」のです。この2つはまったく違います。
プロンプトを一行書く人の多くは、作曲をしていません。
一方で、Synthesizer Vのような歌声音源に歌わせるために音符を決め、構成を決め、歌詞を乗せている人は、2007年のボカロPと同じく、間違いなく作曲をしています。
今起きているのは、作曲する人と作曲しない人が同じ土俵に並んだということで、作曲の消滅ではないんです。
削られてきたのは、作曲家のプライドだった
ここで少し、現場の空気の話をさせてください。かつて作曲家の世界には、サンプリングCDに入っている数小節のリズムネタや、数小節のシンセフレーズを自分の曲の中でたくさん使うことを、あまり好まない空気がありました。
音は自分で作るもの、フレーズは自分で書くもの、、、ですね。
他人が作った数小節に頼りすぎるのは、作曲家としてどこか負けを認めるような感覚があったんです。
わたし自身、その空気の中で育ちました。だから正直に言えば、プロンプトを一行書いただけで1曲が丸ごと出てくる今の光景には、技術への驚きと同じくらい、プライドが音を立てて崩れていく感覚があります。
数小節を借りすぎることにためらいがあった世界に、「全部作ってもらう」選択肢が現れ、しかも作曲していない人の曲と自分の曲が同じ棚に並ぶわけですから。
ただ、歴史を振り返ると、プライドはいつも「頼らないこと」に向いていて、「作曲すること」の本質とは別のところに引かれていました。
演奏家に頼らない、歌手に頼らない、サンプルに頼らない。
AIが壊しているのは作曲ではなく、作曲家が自分で引いていたその線なのかもしれません。
作曲家の予想は、ずっと外れ続けた
もうひとつ、わたし自身の記録を挟ませてください。
2005年、わたしは打ち込みだけでコーラス曲を20曲ほど作りました。当時すでに人間の声と区別がつかないコーラス音源があり、聴いた人に「人が歌っているのかと思った」と言われる仕上がりになったんです。
合唱がここまでできるなら、ひとりの歌声も5年もあれば来る。そう確信していました。
ところが、わたしが「実用になる」と感じるAIボーカルが来たのは、予想より10年ほど遅かったです。
合唱は人数で粗を隠せるのに対して、ソロの歌声は息づかいや揺らぎまで再現しないと嘘がばれる、という壁の高さをわたしは読み違えていたんですね。
そして来てからの進化は、想像の10倍速かった。数年前まで「よくできた機械の声」だったものが、今では気づかないまま聴いている曲も多いはずです。
この「遅く来て、速く進む」は、1本目の線の歴史そのものでもあります。
イリアック組曲からEMIにつながる実験まで25年、EMIからJukeboxまで39年、JukeboxからSunoまではわずか3年。
次は、もっと速く来る。作曲家としては身構えますが、同時にわくわくもしています。
作曲は身近になり、プロの仕事は減っていく
ここまでの2本目の線には、もうひとつの顔があります。
人に頼らなくてよくなるたびに作曲の入口は広がり、「作曲は特別な人がする特別な行為だ」という感覚は、少しずつ薄れてきました。
わたしは専門学校で教えていますが、作曲を「難しい」と感じる生徒は、体感で9割ほどいます。
音楽が好きで入ってきた学生でさえそうなのですから、ひと昔前の一般の人にとって、作曲は手の届かない能力だったはずです。
それを変えたのがMIDIと機材の進化で、できることが増えると同時に価格が手頃になり、演奏家に頼まなくても自宅で曲が形になるようになりました。
VOCALOIDが歌い手を不要にすると、ボカロPという新しい作曲家が大量に生まれ、そこから米津玄師のような人が出てきました。
そしてAIの普及は、この流れをもう一段進めています。
作曲が「できるかどうか」を問われる能力ではなく、「やってみるかどうか」を選ぶ行為に変わりつつあります。
ただし、ここを手放しで喜べるのはアマチュアの側だけです。
プロの立場から見れば、作曲が特別な能力でなくなるということは、これまで作曲家が受けていた仕事が、作曲しない人とAIのほうへ流れていくということにほかなりません。
実際、CM曲、映像のBGM、ゲームの数百曲のうち顔にならない大半、仮歌やデモの制作。
「誰が作ったかを誰も気にしない曲」の仕事は、もう減りはじめています。
作曲する人は増え、作曲で食べていける人は減ります。
この2つが同時に起きるのが、2本の線が合流した時代の現実です。
だからこそ次の章で書く「演出の力」が、プロとアマチュアを分ける最後の線になると、わたしは考えています。
2本の線が合流しても、残っているもの
合流した先に残っているものは、、、それは”演出”です。
わたしのような作曲家は、音符を書きはじめる前に、まずこのシーンをどう彩るかを考えます。
ここで観客に何を感じてほしいのか、音楽は前に出るのか引くのか、どの瞬間に鳴りはじめてどこで消えるのか。
作曲とは、その演出を音で実現する手段であって、演出のほうが先にあるんです。
この演出の力は、プロデュース能力と呼ばれることもあります。
ゲームでも映像でも、作曲家に求められてきたのは「いい曲を書くこと」だけではなく、「この場面に何が必要かを見抜くこと」でした。
そしてここは、まだ人間の判断が強く求められる領域です。
機械も「盛り上げない曲」は作れますが、「なぜこの場面では盛り上げないほうがいいのか」を作品全体の文脈から判断するところは、まだ人間の演出力に大きく依存しています。
理由は構造的です。機械は常に「すでにある音楽」から学ぶからで、イリアック組曲は対位法の教科書から、EMIはバッハの楽譜から、Sunoは膨大な録音から学びました。
つまり機械は過去の音楽の分布を知っていても、「今日この場面にこの音が必要な理由」は知りようがありません。
70年間で技術は桁違いに進歩しましたが、この構造だけはひとつも変わっていないんです。
言い換えると、2本の線が合流して「作曲しなくても曲が手に入る」時代になったからこそ、作曲の前にある演出の力が、作曲家の価値としてむき出しになった。
MIDIとVOCALOIDの時代に作曲能力がクローズアップされたのと同じことが、今度は演出の力に起きているのだと思います。
未来:音楽は「作品」から「状態」へ
2025年8月、Google DeepMindとMagentaチームが発表した「Live Music Models」は、音楽には録音された完成品としての形と、その場で演奏される生きた形の2つがあると整理し、後者をAIで扱うLyria RealTimeを提示しました。
1本目の線は、曲という単位すら手放しはじめています。
この先の音楽を、ひとつの場面で想像してみます。
朝の通勤電車で、あなたのイヤホンからひとつのテーマが流れています。
夕方の帰り道、同じテーマが、疲れた体に合わせてテンポを落とし、音の数を減らして、別の姿で鳴っている。曲は一日中あなたに寄り添いながら、一度も同じ形にはなりません。
それでも週末になると、その曲の「完成版」を、作曲家が意図を込めて仕上げた3分の作品として買う人がいます。
これがわたしの考える未来です。音楽の主な形は「作品」から「状態」へ移っていくけれど、作品としての音楽は消えません。
写真が発明されても絵画は消えず、むしろ写実から解放されて自由になったように、流れ続ける状態の音楽を機械に任せることで、人が意図を込めて作る作品の価値がはっきり浮かび上がります。
わたしはそう思いますし、だからこそこの先の音楽が、むしろ楽しみなんです。
まとめ
AI作曲の70年は、「機械が作曲する線」と「作曲家が人に頼らなくてよくなる線」が別々に進み、2023年に合流した歴史でした。
MIDIが演奏家を、VOCALOIDが歌い手を不要にしたことで、日本には作曲能力だけが評価される時代が先に来ていて、米津玄師のような作曲家がそこから生まれています。
機材が手頃になり、AIが普及するにつれて、作曲はもはやひと昔前のような特別な能力ではなくなり、作曲する人が増える一方で、作曲で食べていける人は減っていきます。
合流した今、作曲はなくなったのではなく、しなくてもよくなっただけです。
作曲する人と作曲しない人が並ぶ時代に残るのは、曲を書く前に「この場面をどう彩るか」を決める演出の力で、ここはまだ人間にしかできません。
AIに作曲を奪われるかどうかを心配するより、自分の音楽に「なぜ」があるかを問い直すほうが、ずっと実りのある備えだと思います。
