Spotify, YouTube Music и Amazon уже тестируют плейлисты по текстовым подсказкам и разговорное управление. Компании исходят из простого наблюдения: обычные люди не мыслят категориями метаданных. Никто не скажет вслух «включи мне инструментальный контент в темпе 70–82 BPM с низкой вероятностью вокала». Скажут: «Поставь что-нибудь красивое, пока мы ужинаем». Такую фразу ИИ способен понять и сопоставить с подходящей музыкой — и это меняет всю цепочку поиска.

Главный сдвиг — переход от предполагаемого намерения к названному. Алгоритмы стримингов годами угадывали вкусы по поведению: что слушал, что пропустил, что добавил. Разговорный ИИ позволяет просто сказать, чего хочешь. Запрос вроде «длинная инструментальная музыка, просторная, но не сонная, в основном акустическая с небольшой долей электроники, под которую я смогу писать час» — это не жанр и не поисковая строка. Это описание ситуации с целью, настроением, эстетикой, инструментовкой, длительностью и контекстом сразу. Рекомендательная система может совместить такой запрос с тем, что уже знает о слушателе, и выбрать подходящую запись.

Дальше — больше. Музыка начинает подбираться вне музыкальных приложений. Разговор о поездке по Нью-Мексико, ужине, тренировке или фильме может завершиться просьбой «включи что-нибудь кинематографичное и просторное, желательно инструментальное, но не похожее на музыку для спа». ИИ способен связать такую просьбу с музыкой. Слушатель может впервые столкнуться с треком внутри общего разговора — без строки поиска Spotify, без открытия приложения. Следующий фанат артиста, возможно, никогда его не загуглит: ведь гуглить — значит уже знать о существовании.

Из-за этого меняется и роль жанра. Жанр и сейчас отчасти полезен, отчасти абсурден: «эмбиент», «джаз», «нью-эйдж», «современный инструментал» — всё это ярлыки из выпадающего меню дистрибьютора. Запрос «поставь инструментальную музыку, чтобы в незнакомом гостиничном номере было спокойно работать поздно вечером» не укладывается ни в одну из этих рамок. Слушателю всё равно, какой это жанр, — ему важны функция и эмоция. Для артистов, чьи работы не помещались в индустриальные коробки, это может стать освобождением.

Отдельный фактор — то, что модели учатся слушать. ИИ всё лучше связывает звук и язык: способен сам определить темп, инструментовку, текстуру, настроение, плотность, присутствие вокала, гармонию, энергию и структуру записи. Для артистов вопрос «как мне описать свою музыку?» дополняется новым: «как машина описывает мою музыку?». Эти описания могут не совпасть, и разрыв между ними станет одной из ключевых проблем нового поиска.

Вместе с этим придёт и новая дисциплина — по аналогии с SEO в интернете. Музыканты начнут оптимизировать биографии под фразы, которые кто-то может ввести: «глубокая расслабляющая вдохновляющая эмоциональная кинематографичная духовная спокойная фокус медитация учёба сон». Это не описание артиста, а скорее записка из раздела велнеса Spotify. ИИ со временем станет меньше реагировать на такие уловки, потому что сможет опираться на саму запись, поведение слушателей и связи между артистами. Но остановить попытки оптимизации это вряд ли сможет.

Главная опасность — не некрасивые тексты, а уродливые творческие стимулы. Когда артисты увидят, что слушатели запрашивают музыку под ситуации, они начнут писать музыку под эти ситуации. Музыка для сна, учёбы, бега, чтения, медитации, ужина, грусти и исцеления — рынок давно делит настроения на сегменты, и описательные подсказки ИИ только усилят этот процесс. Новая точка входа в музыку удобна для слушателя, но создаёт соблазн подстраивать под неё саму музыку — и это вызов, к которому индустрии ещё предстоит подготовиться.