Wir haben kürzlich über MusicGen gesprochen, ein Modell von Meta, das dazu dient, Musik mit künstlicher Intelligenz und Text zu erzeugen. Die Online-Demo funktioniert ziemlich gut, aber ich kann mir vorstellen, dass viele Nutzer da draußen eine Offline-Lösung möchten. So sind wir auf das Portal von Samplab gestoßen, das uns mit TextToSample versorgt. Dieser Client basiert auf MusicGen, besitzt eine einfache und intuitive Benutzeroberfläche und nutzt unsere Internetverbindung nur einmal, um das richtige Modell herunterzuladen.

TextToSample: So erzeugst du Musik mit künstlicher Intelligenz auf deinem PC
So generierst du mit künstlicher Intelligenz Musik auf deinem PC

Der Tanz aus Algorithmen und Modellen konzentriert sich nicht ausschließlich auf die Erstellung von Bildern. Langsam richten sich die Kanonen auf das Gebiet der Musik. Ob zum Guten oder Schlechten, Technologie hat oft einen enormen Einfluss auf sie (z. B. Auto-Tune), und die künstliche Intelligenz will keine Ausnahme sein. Alles, was für den ersten Schritt nötig ist, ist das richtige Werkzeug, und die Leute bei Meta glauben, mit ihrem Modell MusicGen eine gute Lösung zu haben. Wie können wir also darauf zugreifen? Es gibt zwei Möglichkeiten: Ihre offizielle Online-Demo und der TextToSample-Client von Samplab.

TextToSample: KI-Musik lokal erzeugen

TextToSample: So erzeugst du Musik mit künstlicher Intelligenz auf deinem PC
Bevor es losgeht, lädt das Programm das Modell herunter

Nach der Installation von TextToSample musst du den ersten Prompt eingeben, damit das Programm das MusicGen-Modell automatisch herunterlädt. Die offizielle Seite bestätigt, dass es sich um die Variante „small“ handelt, aber du solltest trotzdem Geduld haben (über zwei Gigabyte an Dateien). Sobald dieser Vorgang abgeschlossen ist, kannst du weitere Prompts eingeben, den vorherigen Sound zum „Weitermachen“ verwenden oder direkt deine eigenen Sounds per Drag and Drop laden.

TextToSample: So erzeugst du Musik mit künstlicher Intelligenz auf deinem PC
Die Wartezeit war nicht lang, aber unser Prozessor hat viel geholfen
„klassische mexikanische Gitarre, von Mariachi inspiriert, konsistenter, dynamischer Klang“
„schneller Electropunk-Sound mit hartem Bass, Cyberpunk-inspiriert“
„hoch energetischer Synthpop“

Die Hauptsteuerungen in TextToSample betreffen Dauer und Kontext. Erstere hat ein Maximum von 20 Sekunden, und Letztere hilft uns festzulegen, wie weit das Modell beim Fortsetzen einer Melodie „zurückschauen“ soll. Unabhängig von diesen Parametern wird das Endergebnis im Ordner TextToSample/generated in Dokumenten im WAV-Format gespeichert. Was die Hardware betrifft, empfiehlt TextToSample die Verwendung eines Computers, aber es nutzte die 16 Threads unseres Prozessors ohne Zögern.

TextToSample ist kostenlos. Lade dir eine Kopie herunter!

Offizielle Website und Download: Hier klicken