Skip to main content

Ikhtisar

LoRA (Low-Rank Adaptation) adalah teknik fine-tuning yang mengajarkan model AI sebuah gaya visual baru menggunakan sekumpulan kecil gambar contoh. Cara kerjanya adalah dengan menyuntikkan “style weights” baru ke model yang sudah ada, membuat pelatihan cepat sekaligus efisien. Panduan ini memandu Anda melalui alur lengkap:

Siapkan Gambar Pelatihan

Kurasi dan unggah gambar berkualitas tinggi yang mewakili gaya yang Anda inginkan

Kirim Job Pelatihan

Kirim POST request ke /styles/train dengan URL gambar dan konfigurasi Anda

Pantau Progres

Lacak status job pelatihan Anda menggunakan job_id yang dikembalikan

Hasilkan dengan Gaya Anda

Terapkan gaya yang telah Anda latih ke generasi gambar

Siapkan Gambar Pelatihan

Mengurasi Dataset Anda

Kualitas gambar pelatihan Anda berdampak langsung pada hasil. Jenis pelatihan yang berbeda memiliki persyaratan yang berbeda:

Berapa Banyak Gambar?

Kualitas jauh lebih penting daripada kuantitas. Sekumpulan kecil gambar yang sangat baik akan mengungguli sekumpulan besar gambar yang biasa saja.
Kualitas > Kuantitas15 gambar berkualitas tinggi akan menghasilkan hasil yang lebih baik daripada 50 gambar berkualitas rendah. Prioritaskan:
  • Resolusi tinggi (minimum 1024x1024)
  • Gaya konsisten di semua gambar
  • Tidak ada watermark, teks overlay, atau artefak kompresi
  • Subjek yang bervariasi sambil menjaga koherensi gaya
Contoh Dataset
  • Pelatihan character: Foto seseorang dengan beragam pose, ekspresi, dan kondisi pencahayaan. Hindari menyertakan orang lain di dalam gambar.
  • Pelatihan style: Kumpulan karya seni dalam gaya yang konsisten. Misalnya, The Metropolitan Museum of Art Ukiyo-E Dataset menyediakan cetakan kayu Jepang yang ideal untuk melatih gaya artistik.

Unggah Gambar

Sebelum pelatihan, unggah gambar Anda untuk mendapatkan URL yang di-hosting. Gunakan endpoint /assets:
Simpan nilai image_url yang dikembalikan—Anda akan mengirimnya ke endpoint pelatihan.

Latih Gaya Anda

Contoh Pelatihan Dasar

Kirim URL gambar Anda untuk memulai pelatihan:

Jenis Pelatihan

Parameter type menetapkan default cerdas yang dioptimalkan untuk kasus penggunaan Anda:

Parameter

Parameter Wajib

string
required
Nama deskriptif untuk gaya kustom Anda.Contoh: "Ukiyo-E Style", "Product Photos"
array
required
Array URL gambar untuk dilatih. Sertakan lebih banyak gambar untuk hasil yang lebih baik.

Parameter Opsional

string
default:"flux_dev"
Model dasar untuk pelatihan:Model gambar:
  • flux_dev - Berkualitas tinggi, serbaguna
  • flux_schnell - Model realtime dari BFL
  • qwen - Model dari Alibaba
  • z-image - Model gambar efisien dari Alibaba
  • wan22 - Hanya untuk generasi gambar
Model video:
  • wan - Model video dari Alibaba
string
default:"Default"
Kategori pelatihan: Style, Object, Character, atau Default
string
Kata kustom untuk mengaktifkan gaya ini di prompt. Jika tidak ditentukan, akan menggunakan nama gaya.
Pilih trigger word unik yang tidak akan muncul di prompt biasa. Gunakan underscore untuk trigger multi-kata: ukiyo_style
number
Mengontrol intensitas pelatihan. Nilai yang lebih tinggi melatih lebih cepat tetapi bisa overfit.Rentang yang direkomendasikan: 0.0001 - 0.001
integer
Iterasi pelatihan maksimum. Rentang: 1-2000
integer
Gambar yang diproses secara bersamaan. Batch lebih besar = pelatihan lebih cepat tetapi memori lebih banyak.

Menyesuaikan Parameter Lanjutan

Mulai dengan default yang ditetapkan oleh field type—cocok untuk sebagian besar kasus. Hanya sesuaikan ini bila Anda melihat masalah tertentu:
Mengontrol seberapa agresif model beradaptasi dengan gambar pelatihan Anda.Tanda perlu penyesuaian:
  • Output terlihat identik dengan gambar pelatihan → turunkan rate
  • Pengaruh gaya lemah setelah pelatihan → naikkan rate sedikit
Berapa lama model berlatih pada gambar Anda.Tanda perlu penyesuaian:
  • Output terlalu kaku, mengabaikan prompt → kurangi steps
  • Pengaruh gaya lemah → tambah steps
  • Gambar yang dihasilkan terlihat persis seperti data pelatihan → kurangi steps (overfitting)
Penyesuaian IteratifJika percobaan pelatihan pertama Anda tidak menghasilkan hasil yang diinginkan:
  1. Mulai dengan menyesuaikan max_train_steps (perbaikan paling umum)
  2. Kemudian coba learning_rate jika steps saja tidak membantu

Format Respons


Pantau Progres Pelatihan

Pelatihan biasanya memakan waktu 5-15 menit. Lakukan polling Jobs API untuk memeriksa status:
Job pelatihan berjalan melalui status ini:
  1. queued - Menunggu di antrean
  2. processing - Pelatihan aktif
  3. completed - Pelatihan selesai dengan sukses
  4. failed - Pelatihan mengalami kesalahan
  5. cancelled - Job dibatalkan secara manual

Gunakan Gaya Terlatih Anda

Setelah pelatihan selesai, terapkan gaya Anda ke generasi gambar menggunakan parameter styles:
Kepemilikan gaya antara aplikasi dan APIAPI dan aplikasi web Krea beroperasi sebagai identitas pengguna terpisah di dalam workspace Anda. Gaya bersifat privat bagi pengguna yang membuatnya, sehingga:
  • Gaya yang dilatih via aplikasi tidak dapat diakses via API kecuali dibagikan
  • Gaya yang dilatih via API tidak dapat diakses di aplikasi kecuali dibagikan
Untuk membagikan gaya ke workspace Anda (berlaku di kedua arah):

Kekuatan Gaya

Parameter strength (0.0-1.0) mengontrol seberapa kuat gaya Anda diterapkan:
Mulai dengan strength 0.8 dan sesuaikan berdasarkan hasil. Nilai lebih rendah memberikan kebebasan kreatif lebih; nilai lebih tinggi memaksakan kepatuhan gaya yang lebih ketat.

Menggabungkan Beberapa Gaya

Terapkan beberapa gaya dengan menambahkannya ke array styles:

Praktik Terbaik

  • Gunakan sebanyak mungkin gambar berkualitas tinggi untuk hasil optimal
  • Pastikan gaya konsisten di semua gambar pelatihan
  • Sertakan variasi subjek sambil menjaga koherensi gaya
  • Hindari watermark, teks overlay, atau artefak
  • Gunakan gambar dengan resolusi minimum 1024x1024
  • Mulai dengan parameter default menggunakan field type
  • Untuk gaya: 500-1000 steps biasanya cukup
  • Learning rate rendah (0.0001-0.0003) mencegah overfitting
  • Tambah steps jika gaya belum cukup kuat
  • Kurangi steps jika output terlalu kaku
  • Gunakan trigger word yang sama jika Anda berencana menggabungkan beberapa gaya
  • Trigger word otomatis disuntikkan ke prompt jika Anda menyertakan gaya
  • Hindari kata umum yang muncul di prompt biasa
  • Gunakan underscore untuk trigger multi-kata: my_custom_style