Sebagian besar katalog model gambar hanya mengumpulkan hasil yang bagus. Yang sebenarnya dibutuhkan—"ini tidak bisa"—justru tidak ada. Jadi saya menjalankan 561 gambar, menyisakan 475, dan juga memublikasikan 65 yang dibuang beserta alasan kegagalannya. Baik yang disimpan maupun yang dibuang semuanya dilengkapi seed, sehingga bisa direproduksi apa adanya.
Bahasa Korea bisa. Namun kata yang salah akan selalu salah dengan cara yang sama
Awalnya saya hanya melihat satu gambar dan menulis, "meski diminta menulis bahasa Korea, hasilnya salah," tetapi setelah mencoba enam kali, itu ternyata klaim yang berlebihan. Empat keluar dengan tepat. Guksu, perpustakaan, "pintu keluar nomor 3" (angka + Korea), "menu rekomendasi hari ini" (tiga kata, enam suku kata).
Panjang bukan variabelnya. Dua suku kata bisa, enam suku kata juga bisa, tetapi empat suku kata salah.
Dua yang salah menarik. "Mi yang jujur" keluar sebagai "mi yang tenang"; bahkan ketika seed diganti, hasilnya tetap sama (1167746582, 1910572019). Salah ketik yang sama dua kali. Ini bukan soal keberuntungan seed, melainkan masalah pada kata itu. "Restoran Hanbat" menjadi "Restoran Hanbbyot", suku kata yang tidak ada.
Keduanya runtuh pada konsonan akhir, tetapi guk, neul, dan cheon juga memiliki konsonan akhir dan keluar dengan baik, jadi saya tidak akan menyimpulkan penyebabnya hanya dari dua kasus ini.
Jadi jika salah, jangan putar ulang seed; ubah frasanya. Meski diputar ulang, ia salah di tempat yang sama.
Karakter yang Anda tuliskan akan digambar. Karakter yang harus dikarang sendiri tidak bisa digambar
Selama tiga batch, saya keliru mengira bahwa "jumlah string adalah batasnya." Untuk mencari batasnya, saya menaikkan hanya jumlah string pada papan nama yang sama dari 1→8, dan semua delapannya tepat.
Jumlah bukan variabelnya. Setelah meninjau ulang kegagalan sebelumnya, titik pemisahnya menjadi jelas.
- Papan menu kafe: tiga item yang ditulis di prompt tepat, sisanya CAPEME, CABIELO
- Timeline: hanya rentang tahun yang ditentukan, jadi tahun muncul tetapi label gagal
- Mockup Kanban: nama kolom tidak diberikan, jadi ketiga kolom semuanya "Kanban"
Tuliskan semua teks yang akan muncul di layar persis di prompt. Delapan bukan batas, melainkan titik tempat saya berhenti menguji.
Namun menuliskannya saja tidak selalu cukup. Ketika tiga kasus yang semula gagal dijalankan ulang hanya dengan menuliskan stringnya, papan menu benar semua sepuluh baris, punggung buku benar 10 dari 12, tetapi peta rute hanya benar 4 dari 9. Jika hurufnya kecil dan diputar pada berbagai sudut, ada batasan kedua yang muncul.
Saya sempat menulis "tangan umumnya bisa," lalu menariknya kembali tiga jam kemudian
Dengan pencahayaan dan komposisi dikunci lalu tingkat kesulitan tangan dinaikkan dalam 8 tahap, saya memperbesar 1,5–2 kali dan menulis, "7 dari 8 secara anatomi baik-baik saja." Itu kalimat yang paling mungkin menyebar karena bertentangan dengan anggapan umum.
Dua jam setelah saya mengunggahnya ke r/StableDiffusion, muncul komentar. "Yang tiga jari itu punya enam jari." Setelah diperbesar 4 kali, ternyata benar. Dua puluh menit kemudian, orang lain menunjukkan tangan yang saling bertumpuk. "Itu juga salah, hanya ada empat."
Dua orang menemukan 3 dari 8 gambar dengan melakukan satu hal yang tidak saya lakukan. Mereka menghitungnya.
Jadi saya menurunkan seluruh kategorinya. Saya tidak menilai ulang satu per satu. Alat yang gagal adalah mata saya; jika saya menilai lima sisanya dengan mata yang sama, itu berarti melakukan kesalahan yang sama untuk ketiga kalinya. Kedelapan gambar saya pindahkan ke item gagal beserta seed-nya.
Hasil pengukuran lainnya
- Ia bisa menghitung objek, tetapi tidak bisa menghitung atribut. Telur "tepat N buah" benar semua dari 2–8, tetapi "tepat dua warna" menghasilkan empat warna. Jika bisa ditunjuk satu per satu, Anda boleh meminta jumlah; jika yang dihitung adalah warna, area, atau sumber cahaya, hitung sendiri hasilnya.
- Jika Anda menyebut pencahayaan dengan nama alatnya, perangkat lampunya ikut masuk ke gambar. Pada dua prompt yang menulis "softbox", softbox muncul sebagai subjek. Tulis apa yang dilakukan cahayanya.
- Menulis "seamless" tidak membuatnya bisa di-tile. Dari 8 pola, hanya 1 yang tersambung, itu pun karena berupa garis vertikal sehingga tepinya otomatis cocok.
- "straight down" adalah permintaan, bukan instruksi. Dari 8 gambar udara, lima datang dari sudut miring. Jika ada sesuatu yang berdiri vertikal seperti crane atau rumah, kamera turun untuk memperlihatkannya.
- Perumpamaan ukuran menukar subjeknya. Saat diminta "kumbang sebesar kuda poni", yang keluar adalah kuda poni berpelana. Tidak ada kumbangnya.
- Menempatkan orang yang sama ke foto lain tidak bisa. Pada strength 0.45, wajah masih tersisa tetapi seluruh komposisi ikut terbawa; pada 0.72, ia menjadi orang lain. Tidak ada nilai di antaranya yang berhasil.
- image-to-image tidak bisa menambah atau menghapus objek. Sebaliknya, konversi medium (foto→gouache, dll.) stabil. Rentang strength 0.50–0.60.
Total biayanya $4.54 (fal.ai, $0.008 per megapiksel).
README bahasa Korea: https://github.com/sjh9714/awesome-krea-2/blob/main/README_KO.md
Lihat semua gambar: https://sjh9714.github.io/awesome-krea-2/
Resep edit yang diekstrak sebagai skill agen saja: https://github.com/sjh9714/same-frame
Belum ada komentar.