Panoramica
LoRA (Low-Rank Adaptation) è una tecnica di fine-tuning che insegna a un modello di IA un nuovo stile visivo utilizzando un piccolo insieme di immagini di esempio. Funziona iniettando nuovi “style weights” in un modello esistente, rendendo l’addestramento veloce ed efficiente. Questa guida illustra il flusso completo:Prepara le immagini di addestramento
Cura e carica immagini di alta qualità che rappresentino lo stile desiderato
Invia il job di addestramento
Invia una richiesta POST a
/styles/train con gli URL delle tue immagini e la configurazioneMonitora i progressi
Traccia lo stato del tuo job di addestramento tramite il
job_id restituitoGenera con il tuo stile
Applica lo stile addestrato alla generazione di immagini
Prepara le immagini di addestramento
Curare il tuo dataset
La qualità delle immagini di addestramento influisce direttamente sui risultati. Tipi di addestramento diversi hanno requisiti diversi:Quante immagini?
La qualità conta molto più della quantità. Un piccolo insieme di immagini eccellenti supererà un ampio insieme di immagini mediocri.Dataset di esempio
- Addestramento di personaggi: foto di una persona con pose, espressioni e condizioni di illuminazione variate. Evita di includere altre persone nelle immagini.
- Addestramento di stile: una collezione di opere d’arte in uno stile coerente. Ad esempio, The Metropolitan Museum of Art Ukiyo-E Dataset fornisce stampe xilografiche giapponesi ideali per addestrare uno stile artistico.
Carica le immagini
Prima dell’addestramento, carica le tue immagini per ottenere URL ospitati. Usa l’endpoint/assets:
Addestra il tuo stile
Esempio di addestramento base
Invia gli URL delle tue immagini per iniziare l’addestramento:Tipi di addestramento
Il parametrotype imposta valori predefiniti intelligenti ottimizzati per il tuo caso d’uso:
Parametri
Parametri obbligatori
string
required
Un nome descrittivo per il tuo stile personalizzato.Esempio:
"Ukiyo-E Style", "Product Photos"array
required
Array di URL di immagini su cui addestrare. Includi più immagini per risultati migliori.
Parametri opzionali
string
default:"flux_dev"
Modello di base per l’addestramento:Modelli di immagini:
flux_dev- Alta qualità, versatileflux_schnell- Modello realtime di BFLqwen- Modello di Alibabaz-image- Modello di immagini efficiente di Alibabawan22- Solo generazione di immagini
wan- Modello video di Alibaba
string
default:"Default"
Categoria di addestramento:
Style, Object, Character o Defaultstring
Parola personalizzata per attivare questo stile nei prompt. Se non specificata, viene utilizzato il nome dello stile.
Parametri avanzati
Parametri avanzati
number
Controlla l’intensità dell’addestramento. Valori più alti addestrano più velocemente ma possono causare overfitting.Intervallo consigliato: 0.0001 - 0.001
integer
Iterazioni massime di addestramento. Intervallo: 1-2000
integer
Immagini elaborate simultaneamente. Batch più grandi = addestramento più veloce ma più memoria.
Ottimizzare i parametri avanzati
Inizia con i valori predefiniti impostati dal campotype: funzionano bene per la maggior parte dei casi. Modificali solo se noti problemi specifici:
Learning Rate
Learning Rate
Controlla con quanta aggressività il modello si adatta alle tue immagini di addestramento.
Segnali che indicano di regolare:
- Gli output sembrano identici alle immagini di addestramento → abbassa il valore
- L’influenza dello stile è debole dopo l’addestramento → aumenta leggermente il valore
Training Steps
Training Steps
Per quanto tempo il modello viene addestrato sulle tue immagini.
Segnali che indicano di regolare:
- Gli output sono troppo rigidi, ignorano i prompt → riduci gli step
- L’influenza dello stile è debole → aumenta gli step
- Le immagini generate somigliano esattamente ai dati di addestramento → riduci gli step (overfitting)
Formato della risposta
Monitora i progressi dell’addestramento
L’addestramento richiede tipicamente 5-15 minuti. Effettua polling sull’API Jobs per verificare lo stato:Valori di stato del job
Valori di stato del job
I job di addestramento attraversano questi stati:
- queued - In attesa in coda
- processing - Addestramento attivo
- completed - Addestramento terminato con successo
- failed - L’addestramento ha riscontrato un errore
- cancelled - Job cancellato manualmente
Usa il tuo stile addestrato
Una volta completato l’addestramento, applica il tuo stile alla generazione di immagini usando il parametrostyles:
Intensità dello stile
Il parametrostrength (0.0-1.0) controlla quanto fortemente viene applicato il tuo stile:
Combinare più stili
Applica più stili aggiungendoli all’arraystyles:
Buone pratiche
Selezione delle immagini
Selezione delle immagini
- Usa quante più immagini di alta qualità hai per risultati ottimali
- Assicura uno stile coerente in tutte le immagini di addestramento
- Includi varietà nei soggetti mantenendo coerenza stilistica
- Evita watermark, sovrapposizioni di testo o artefatti
- Usa immagini di almeno 1024x1024 di risoluzione
Configurazione dell’addestramento
Configurazione dell’addestramento
- Inizia con i parametri predefiniti usando il campo
type - Per gli stili: 500-1000 step sono di solito sufficienti
- Learning rate più bassi (0.0001-0.0003) prevengono l’overfitting
- Aumenta gli step se lo stile non è abbastanza forte
- Riduci gli step se l’output è troppo rigido
Trigger word
Trigger word
- Usa la stessa trigger word se prevedi di combinare più stili
- Le trigger word vengono iniettate automaticamente nel prompt se includi lo stile
- Evita parole comuni che compaiono nei prompt tipici
- Usa underscore per trigger di più parole:
my_custom_style