Anmelden

MusicGen / AudioCraft

Open Source Kostenlos
Plattform
Linux macOS Plattformagnostik Windows
Lieferform
Bibliothek/API

Open Source Music AI — Metas quelloffenes Modell zur lokalen Generierung von Musik aus Text-Prompts.

Zusammenfassung

AudioCraft ist eine PyTorch-Bibliothek, die für die Forschung im Bereich Deep Learning mit Schwerpunkt auf Audioverarbeitung und -erzeugung entwickelt wurde. Sie beinhaltet modernste Modelle für die hochwertige Audioerzeugung, darunter MusicGen für steuerbare Text-zu-Musik-Synthese.

Eigenschaften

  • Beinhaltet hochmoderne Modelle wie MusicGen (steuerbares Text-zu-Musik-Modell), AudioGen (Text-zu-Klang) und EnCodec (hochwertiger Audiocodec).
  • Bietet sowohl Inferenz- als auch Training-Code, um die Entwicklung und Reproduktion audio-generativer Modelle zu ermöglichen.
  • Unterstützt zusätzliche Modelle wie Multi Band Diffusion, MAGNeT für nicht-autoregressive Text-zu-Musik/-Sound-Generierung, AudioSeal für Audio-Wasserzeichen und JASCO für akkord-, melodie- und drum-konditionierte Text-zu-Musik-Erzeugung.
  • Die Installation erfordert Python 3.9 und PyTorch 2.1.0, mit Anleitungen zur Paketeinrichtung und Abhängigkeiten wie ffmpeg.
  • Modelle und Trainingspipelines sind Open Source und werden jeweils unter MIT- und CC-BY-NC 4.0-Lizenzen verteilt.
  • API-Dokumentation und ausführliche FAQs stehen zur Unterstützung der Nutzer bereit.

Zielgruppe

Forscher und Entwickler, die an KI-gestützter Audioerzeugung interessiert sind, einschließlich solcher, die vortrainierte Modelle für Text-zu-Musik/-Sound-Generierung nutzen sowie solche, die solche Modelle trainieren oder erweitern möchten.

Kommentare

Anmelden , um zu bewerten, zu kommentieren und zu merken.

Noch keine Kommentare für dieses Tool.