Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
2 changes: 1 addition & 1 deletion acestep15v2/Chart.yaml
Original file line number Diff line number Diff line change
Expand Up @@ -3,4 +3,4 @@ appVersion: "0.1.8"
description: A Step Towards Music Generation Foundation Model.
name: acestep15v2
type: application
version: 1.0.7
version: 1.0.15
10 changes: 9 additions & 1 deletion acestep15v2/OlaresManifest.yaml
Original file line number Diff line number Diff line change
Expand Up @@ -7,7 +7,7 @@ metadata:
description: The most powerful local music generation model that outperforms most commercial alternatives
icon: https://app.cdn.olares.com/appstore/acestep/icon2.png
appid: acestep15v2
version: '1.0.7'
version: '1.0.15'
title: ACE-Step 1.5
categories:
- Creativity
Expand Down Expand Up @@ -70,6 +70,9 @@ spec:
- Requires ≥12GB VRAM (with offload) or ≥20GB recommended; all LM models remain compatible

upgradeDescription: |

Add the Helm release revision to the download Job name so upgrades do not patch its immutable pod template.
Replace the Bitnami OpenResty proxy with official OpenResty and run it as UID/GID 1000 with writable runtime paths.
**What's new in v0.1.8** ([release notes](https://github.com/ace-step/ACE-Step-1.5/releases/tag/v0.1.8))
- Upgraded container image to beclab/ace-step-ace-step-1.5:v0.1.8
- Default preset (best quality): acestep-v15-xl-sft + acestep-5Hz-lm-4B, CPU offload enabled
Expand All @@ -83,6 +86,11 @@ spec:
locale:
- en-US
- zh-CN
- de-DE
- es-ES
- it-IT
- fr-FR
- ja-JP
doc: https://github.com/ace-step/ACE-Step-1.5
license:
- text: MIT License
Expand Down
2 changes: 1 addition & 1 deletion acestep15v2/acestep15v2/Chart.yaml
Original file line number Diff line number Diff line change
@@ -1,5 +1,5 @@
apiVersion: v2
appVersion: "1.25.3-2"
appVersion: "1.29.2.5"
description: ACE-Step 1.5 Client Proxy - Nginx reverse proxy
name: acestep15v2
type: application
Expand Down
36 changes: 26 additions & 10 deletions acestep15v2/acestep15v2/templates/clientproxy.yaml
Original file line number Diff line number Diff line change
Expand Up @@ -44,9 +44,19 @@ data:
}

server {

client_body_temp_path /tmp/client_body;

proxy_temp_path /tmp/proxy;

fastcgi_temp_path /tmp/fastcgi;

uwsgi_temp_path /tmp/uwsgi;

scgi_temp_path /tmp/scgi;
listen 8080;
access_log /opt/bitnami/openresty/nginx/logs/access.log;
error_log /opt/bitnami/openresty/nginx/logs/error.log;
access_log /dev/stdout;
error_log /dev/stderr;

set $main_backend "acestep-svc.acestep15v2server-shared.svc.cluster.local:7860";
set $download_backend "download-svc.acestep15v2server-shared.svc.cluster.local:8090";
Expand Down Expand Up @@ -161,15 +171,22 @@ spec:
items:
- key: nginx.conf
path: nginx.conf
- name: nginx-runtime
emptyDir: {}
containers:
- name: nginx
image: "docker.io/beclab/aboveos-bitnami-openresty:1.25.3-2"
image: "docker.io/openresty/openresty:1.29.2.5-bookworm-fat"
command:
- /usr/local/openresty/bin/openresty
args:
- -g
- "daemon off; pid /tmp/nginx.pid;"
securityContext:
runAsUser: 1000
runAsGroup: 1000
ports:
- containerPort: 8080
protocol: TCP
env:
- name: OPENRESTY_CONF_FILE
value: /etc/nginx/nginx.conf
readinessProbe:
exec:
command:
Expand All @@ -192,11 +209,10 @@ spec:
memory: 64Mi
volumeMounts:
- name: nginx-config
mountPath: /etc/nginx/nginx.conf
subPath: nginx.conf
- name: nginx-config
mountPath: /opt/bitnami/openresty/nginx/conf/server_blocks/nginx.conf
mountPath: /etc/nginx/conf.d/default.conf
subPath: nginx.conf
- name: nginx-runtime
mountPath: /var/run/openresty

---
apiVersion: v1
Expand Down
5 changes: 4 additions & 1 deletion acestep15v2/acestep15v2server/templates/download.yaml
Original file line number Diff line number Diff line change
Expand Up @@ -3,7 +3,7 @@
apiVersion: batch/v1
kind: Job
metadata:
name: {{ .Release.Name }}-download-models
name: {{ .Release.Name }}-download-models-{{ .Release.Revision }}
namespace: {{ .Release.Namespace }}
labels:
app: {{ .Release.Name }}-download-models
Expand All @@ -14,6 +14,9 @@ spec:
metadata:
labels:
app: {{ .Release.Name }}-download-models
gateway.olares.io/shared-caller-outbound: "false"
annotations:
linkerd.io/inject: disabled
spec:
restartPolicy: OnFailure
containers:
Expand Down
43 changes: 43 additions & 0 deletions acestep15v2/i18n/de-DE/OlaresManifest.yaml
Original file line number Diff line number Diff line change
@@ -0,0 +1,43 @@
metadata:
title: ACE-Step 1.5
description: Das leistungsstärkste lokale Musik-Generierungsmodell, das die meisten kommerziellen Alternativen übertrifft
spec:
fullDescription: |
Wir präsentieren ACE-Step v1.5, ein hocheffizientes Open-Source-Musik-Foundation-Modell, das kommerzielle Generierungsqualität auf Consumer-Hardware bringt. Bei gängigen Bewertungsmetriken erreicht ACE-Step v1.5 eine Qualität jenseits der meisten kommerziellen Musikmodelle und bleibt dabei extrem schnell — unter 2 Sekunden pro vollständigem Song auf einer A100 und unter 10 Sekunden auf einer RTX 3090. Das Modell läuft lokal mit weniger als 4 GB VRAM und unterstützt leichte Personalisierung: Nutzer können aus nur wenigen Songs ein LoRA trainieren, um ihren eigenen Stil einzufangen.

**Funktionen**
Leistung
- Ultrschnelle Generierung: Unter 2 s pro vollständigem Song auf A100, unter 10 s auf RTX 3090 (0,5 s bis 10 s auf A100 je nach Think-Modus und Diffusions-Schritten)
- Flexible Dauer: Unterstützt Audio-Generierung von 10 Sekunden bis 10 Minuten (600 s)
- Batch-Generierung: Bis zu 8 Songs gleichzeitig erzeugen

Generierungsqualität
- Kommerzielle Ausgabequalität: Qualität jenseits der meisten kommerziellen Musikmodelle (zwischen Suno v4.5 und Suno v5)
- Reiche Stilunterstützung: Über 1000 Instrumente und Stile mit feinkörniger Timbre-Beschreibung
- Mehrsprachige Lyrics: Unterstützt über 50 Sprachen mit Lyrics-Prompt für Struktur- und Stilkontrolle

Vielseitigkeit & Kontrolle
- Referenz-Audio-Eingabe: Referenz-Audio zur Steuerung des Generierungsstils nutzen
- Cover-Generierung: Covers aus vorhandenem Audio erstellen
- Neuzeichnen & Bearbeiten: Selektive lokale Audio-Bearbeitung und -Neugenerierung
- Spurentrennung: Audio in einzelne Stems aufteilen
- Mehrspur-Generierung: Ebenen hinzufügen wie die „Add Layer“-Funktion von Suno Studio
- Vocal2BGM: Automatische Begleitung für Gesangsspuren erzeugen
- Metadaten-Kontrolle: Dauer, BPM, Tonart/Skala und Taktart steuern
- Einfacher Modus: Vollständige Songs aus einfachen Beschreibungen erzeugen
- Abfrage-Umschreibung: Automatische LM-Erweiterung von Tags und Lyrics
- Audio-Verständnis: BPM, Tonart/Skala, Taktart und Caption aus Audio extrahieren
- LRC-Generierung: Lyric-Zeitstempel für erzeugte Musik automatisch erzeugen
- LoRA-Training: Ein-Klick-Annotation und Training in Gradio. 8 Songs, 1 Stunde auf 3090 (12 GB VRAM)
- Qualitätsbewertung: Automatische Qualitätsbewertung für erzeugtes Audio

**ACE-Step 1.5 XL (4B DiT)**
- acestep-v15-xl-base, acestep-v15-xl-sft, acestep-v15-xl-turbo — höhere Audioqualität mit 4B-Parameter-DiT-Decoder
- Erfordert ≥12 GB VRAM (mit Offload) oder empfohlen ≥20 GB; alle LM-Modelle bleiben kompatibel

upgradeDescription: |
**Neu in v0.1.8** ([Versionshinweise](https://github.com/ace-step/ACE-Step-1.5/releases/tag/v0.1.8))
- Container-Image auf beclab/ace-step-ace-step-1.5:v0.1.8 aktualisiert
- Standard-Preset (beste Qualität): acestep-v15-xl-sft + acestep-5Hz-lm-4B, CPU-Offload aktiviert
- Vorab-Download von Haupt-Repo + xl-sft + 4B LM (~36 GB Erstinstallation; Haupt-Repo wird übersprungen, falls vorhanden)
- Verbesserungen an Retake, Flow-Edit und Repaint sowie mehrere Fehlerbehebungen
43 changes: 43 additions & 0 deletions acestep15v2/i18n/es-ES/OlaresManifest.yaml
Original file line number Diff line number Diff line change
@@ -0,0 +1,43 @@
metadata:
title: ACE-Step 1.5
description: El modelo local de generación musical más potente, que supera a la mayoría de las alternativas comerciales
spec:
fullDescription: |
Presentamos ACE-Step v1.5, un modelo foundation musical de código abierto altamente eficiente que lleva la generación de calidad comercial al hardware de consumo. En métricas de evaluación habituales, ACE-Step v1.5 alcanza una calidad superior a la mayoría de los modelos musicales comerciales y sigue siendo extremadamente rápido: menos de 2 segundos por canción completa en una A100 y menos de 10 segundos en una RTX 3090. El modelo se ejecuta en local con menos de 4 GB de VRAM y admite personalización ligera: los usuarios pueden entrenar un LoRA a partir de solo unas pocas canciones para capturar su propio estilo.

**Funciones**
Rendimiento
- Generación ultrarrápida: Menos de 2 s por canción completa en A100, menos de 10 s en RTX 3090 (de 0,5 s a 10 s en A100 según el modo think y los pasos de difusión)
- Duración flexible: Admite generación de audio de 10 segundos a 10 minutos (600 s)
- Generación por lotes: Genera hasta 8 canciones a la vez

Calidad de generación
- Salida de calidad comercial: Calidad superior a la mayoría de los modelos musicales comerciales (entre Suno v4.5 y Suno v5)
- Amplio soporte de estilos: Más de 1000 instrumentos y estilos con descripción fina del timbre
- Letras multilingües: Admite más de 50 idiomas con prompt de letras para control de estructura y estilo

Versatilidad y control
- Entrada de audio de referencia: Usa audio de referencia para guiar el estilo de generación
- Generación de covers: Crea covers a partir de audio existente
- Repintado y edición: Edición y regeneración selectiva de audio local
- Separación de pistas: Separa el audio en stems individuales
- Generación multipista: Añade capas como la función «Add Layer» de Suno Studio
- Vocal2BGM: Genera automáticamente acompañamiento para pistas vocales
- Control de metadatos: Controla duración, BPM, tonalidad/escala y compás
- Modo simple: Genera canciones completas a partir de descripciones sencillas
- Reescritura de consultas: Expansión automática con LM de etiquetas y letras
- Comprensión de audio: Extrae BPM, tonalidad/escala, compás y descripción del audio
- Generación LRC: Genera automáticamente marcas de tiempo de letras para la música generada
- Entrenamiento LoRA: Anotación y entrenamiento en un clic en Gradio. 8 canciones, 1 hora en 3090 (12 GB VRAM)
- Puntuación de calidad: Evaluación automática de la calidad del audio generado

**ACE-Step 1.5 XL (4B DiT)**
- acestep-v15-xl-base, acestep-v15-xl-sft, acestep-v15-xl-turbo — mayor calidad de audio con decodificador DiT de 4B parámetros
- Requiere ≥12 GB VRAM (con offload) o se recomienda ≥20 GB; todos los modelos LM siguen siendo compatibles

upgradeDescription: |
**Novedades en v0.1.8** ([notas de la versión](https://github.com/ace-step/ACE-Step-1.5/releases/tag/v0.1.8))
- Imagen de contenedor actualizada a beclab/ace-step-ace-step-1.5:v0.1.8
- Preset predeterminado (mejor calidad): acestep-v15-xl-sft + acestep-5Hz-lm-4B, CPU offload activado
- Precarga del repositorio principal + xl-sft + 4B LM (~36 GB en la primera instalación; se omite el repo principal si ya existe)
- Mejoras en Retake, Flow-Edit y Repaint, y varias correcciones de errores
43 changes: 43 additions & 0 deletions acestep15v2/i18n/fr-FR/OlaresManifest.yaml
Original file line number Diff line number Diff line change
@@ -0,0 +1,43 @@
metadata:
title: ACE-Step 1.5
description: Le modèle local de génération musicale le plus puissant, qui surpasse la plupart des alternatives commerciales
spec:
fullDescription: |
Nous présentons ACE-Step v1.5, un modèle foundation musical open-source très efficace qui apporte une génération de niveau commercial au matériel grand public. Sur les métriques d'évaluation courantes, ACE-Step v1.5 atteint une qualité supérieure à la plupart des modèles musicaux commerciaux tout en restant extrêmement rapide — moins de 2 secondes par chanson complète sur A100 et moins de 10 secondes sur RTX 3090. Le modèle s'exécute localement avec moins de 4 Go de VRAM et prend en charge une personnalisation légère : les utilisateurs peuvent entraîner un LoRA à partir de quelques chansons pour capturer leur propre style.

**Fonctionnalités**
Performances
- Génération ultra-rapide : moins de 2 s par chanson complète sur A100, moins de 10 s sur RTX 3090 (0,5 s à 10 s sur A100 selon le think mode et les étapes de diffusion)
- Durée flexible : génération audio de 10 secondes à 10 minutes (600 s)
- Génération par lots : jusqu'à 8 chansons simultanément

Qualité de génération
- Sortie de niveau commercial : qualité supérieure à la plupart des modèles musicaux commerciaux (entre Suno v4.5 et Suno v5)
- Large prise en charge des styles : plus de 1000 instruments et styles avec description fine du timbre
- Paroles multilingues : plus de 50 langues avec invite de paroles pour le contrôle de structure et de style

Polyvalence et contrôle
- Entrée audio de référence : utilisez un audio de référence pour guider le style de génération
- Génération de reprises : créez des covers à partir d'un audio existant
- Peinture et édition : édition et régénération audio locale sélectives
- Séparation des pistes : séparez l'audio en stems individuels
- Génération multi-pistes : ajoutez des couches comme la fonction « Add Layer » de Suno Studio
- Vocal2BGM : génère automatiquement l'accompagnement pour les pistes vocales
- Contrôle des métadonnées : durée, BPM, tonalité/gamme, signature rythmique
- Mode simple : générez des chansons complètes à partir de descriptions simples
- Réécriture de requête : expansion LM automatique des tags et paroles
- Compréhension audio : extrait BPM, tonalité/gamme, signature rythmique et légende de l'audio
- Génération LRC : génère automatiquement les horodatages des paroles
- Entraînement LoRA : annotation et entraînement en un clic dans Gradio. 8 chansons, 1 heure sur 3090 (12 Go VRAM)
- Notation de qualité : évaluation automatique de la qualité de l'audio généré

**ACE-Step 1.5 XL (4B DiT)**
- acestep-v15-xl-base, acestep-v15-xl-sft, acestep-v15-xl-turbo — meilleure qualité audio avec décodeur DiT à 4B paramètres
- Requiert ≥12 Go VRAM (avec offload) ou ≥20 Go recommandés ; tous les modèles LM restent compatibles

upgradeDescription: |
**Nouveautés de la v0.1.8** ([notes de version](https://github.com/ace-step/ACE-Step-1.5/releases/tag/v0.1.8))
- Image de conteneur mise à niveau vers beclab/ace-step-ace-step-1.5:v0.1.8
- Préréglage par défaut (meilleure qualité) : acestep-v15-xl-sft + acestep-5Hz-lm-4B, CPU offload activé
- Pré-téléchargement du dépôt principal + xl-sft + 4B LM (~36 Go à la première installation ; dépôt principal ignoré s'il est déjà présent)
- Améliorations Retake, Flow-Edit et Repaint, ainsi que plusieurs corrections de bugs
43 changes: 43 additions & 0 deletions acestep15v2/i18n/it-IT/OlaresManifest.yaml
Original file line number Diff line number Diff line change
@@ -0,0 +1,43 @@
metadata:
title: ACE-Step 1.5
description: Il modello locale di generazione musicale più potente, che supera la maggior parte delle alternative commerciali
spec:
fullDescription: |
Presentiamo ACE-Step v1.5, un modello foundation musicale open-source altamente efficiente che porta la generazione di livello commerciale sull'hardware consumer. Sulle metriche di valutazione più comuni, ACE-Step v1.5 raggiunge una qualità superiore alla maggior parte dei modelli musicali commerciali rimanendo estremamente veloce: meno di 2 secondi per brano completo su A100 e meno di 10 secondi su RTX 3090. Il modello gira in locale con meno di 4 GB di VRAM e supporta una personalizzazione leggera: gli utenti possono addestrare un LoRA a partire da poche canzoni per catturare il proprio stile.

**Funzionalità**
Prestazioni
- Generazione ultra-rapida: Meno di 2 s per brano completo su A100, meno di 10 s su RTX 3090 (da 0,5 s a 10 s su A100 a seconda del think mode e dei passi di diffusione)
- Durata flessibile: Supporta generazione audio da 10 secondi a 10 minuti (600 s)
- Generazione in batch: Genera fino a 8 brani contemporaneamente

Qualità di generazione
- Output di livello commerciale: Qualità superiore alla maggior parte dei modelli musicali commerciali (tra Suno v4.5 e Suno v5)
- Ampio supporto di stili: Oltre 1000 strumenti e stili con descrizione fine del timbro
- Testi multilingue: Supporta oltre 50 lingue con prompt dei testi per controllo di struttura e stile

Versatilità e controllo
- Input audio di riferimento: Usa audio di riferimento per guidare lo stile di generazione
- Generazione di cover: Crea cover da audio esistente
- Ripittura e modifica: Editing e rigenerazione selettiva dell'audio locale
- Separazione tracce: Separa l'audio in stem individuali
- Generazione multi-traccia: Aggiungi layer come la funzione «Add Layer» di Suno Studio
- Vocal2BGM: Genera automaticamente l'accompagnamento per le tracce vocali
- Controllo metadati: Controlla durata, BPM, tonalità/scala e tempo
- Modalità semplice: Genera brani completi da descrizioni semplici
- Riscrittura query: Espansione automatica LM di tag e testi
- Comprensione audio: Estrae BPM, tonalità/scala, tempo e caption dall'audio
- Generazione LRC: Genera automaticamente timestamp dei testi per la musica generata
- Training LoRA: Annotazione e training con un clic in Gradio. 8 brani, 1 ora su 3090 (12 GB VRAM)
- Punteggio qualità: Valutazione automatica della qualità dell'audio generato

**ACE-Step 1.5 XL (4B DiT)**
- acestep-v15-xl-base, acestep-v15-xl-sft, acestep-v15-xl-turbo — qualità audio superiore con decoder DiT da 4B parametri
- Richiede ≥12 GB VRAM (con offload) o consigliati ≥20 GB; tutti i modelli LM restano compatibili

upgradeDescription: |
**Novità in v0.1.8** ([note di rilascio](https://github.com/ace-step/ACE-Step-1.5/releases/tag/v0.1.8))
- Immagine del container aggiornata a beclab/ace-step-ace-step-1.5:v0.1.8
- Preset predefinito (migliore qualità): acestep-v15-xl-sft + acestep-5Hz-lm-4B, CPU offload abilitato
- Pre-download del repo principale + xl-sft + 4B LM (~36 GB alla prima installazione; repo principale saltato se già presente)
- Miglioramenti a Retake, Flow-Edit e Repaint, e diverse correzioni di bug
Loading