Pemenang Bounty Visualisasi ISBN $10k
(annas-archive.org)- Beberapa bulan lalu, diumumkan hadiah $10.000 bagi siapa pun yang dapat memvisualisasikan ruang ISBN dari data Anna’s Archive dengan paling baik
- Visualisasi ini menunjukkan file yang sudah diarsipkan dan yang belum diarsipkan, serta mencakup dataset yang menunjukkan jumlah perpustakaan yang memiliki ISBN tersebut
- Banyak orang berpartisipasi dan mengajukan ide-ide kreatif. Antusiasme dan energi terhadap proyek ini sangat mengesankan
- Tujuannya adalah memahami berapa banyak buku di dunia yang sudah diarsipkan, dan buku mana yang perlu menjadi fokus berikutnya
Visualisasi dasar
- Dengan gambar di bawah 300kb, ini merangkum “daftar buku” terbesar dalam sejarah manusia secara ringkas.
- Berbagai sumber data disertakan: All ISBNs, Anna’s Archive, Google Books, Internet Archive, dan lainnya.
Tantangan dan pemenang
- Diputuskan untuk memberikan hadiah juara 1 sebesar $6.000, juara 2 sebesar $3.000, dan juara 3 sebesar $1.000. Karena banyaknya partisipasi, hadiah juara 3 diputuskan diberikan kepada empat orang, masing-masing $500.
- Juara 1 $6.000: phiresky - Menonjol berkat opsi visualisasi yang fleksibel serta implementasi yang cepat dan mulus.
- Juara 2 $3.000: hypha - Visualisasi pada level makro sangat mengesankan, dan menawarkan UI yang ramah pengguna.
- Juara 3 $500 #1: maxlion - Beragam tampilan sangat mengesankan, terutama tampilan perbandingan dan penerbit.
- Juara 3 $500 #2: abetusk - Fitur perbandingannya sangat unggul.
- Juara 3 $500 #3: conundrumer0 - Mengesankan sebagai alat visualisasi yang sangat fleksibel.
- Juara 3 $500 #4: charelf - Menawarkan fitur yang sederhana tetapi efektif.
Ide yang patut diperhatikan
- BWV_1011: gedung pencakar langit untuk kelangkaan
- robingchan: statistik real-time
- reguster: anotasi dan statistik real-time
- orangereporter: tampilan peta dan filter yang unik
- joe.davis: skema warna dasar dan heatmap yang keren
- timharding: perpindahan mudah untuk perbandingan dataset yang cepat
- j1618: label yang cantik
- immartian: bilah skala yang menampilkan jumlah buku
- backrndsource: banyak slider untuk membandingkan dataset seperti seorang DJ
Kesimpulan
- Karya pemenang pertama akan diintegrasikan ke situs web utama, dan karya lainnya juga sedang dipertimbangkan.
- Sedang dipikirkan cara mengorganisasi proses untuk mengidentifikasi, memverifikasi, dan mengarsipkan buku-buku langka.
- Terima kasih kepada semua yang telah berpartisipasi, dan terima kasih karena begitu banyak orang menunjukkan minat pada proyek ini.
1 komentar
Opini Hacker News
Karya pemenangnya adalah visualisasi yang baru-baru ini juga dibahas di HN
Mengagumkan baik dari sisi pilihan teknis maupun desain grafis, dan berhasil memvisualisasikan 2 miliar buku dengan elegan sehingga tampak seperti rak buku
Diskusi HN terkait: https://news.ycombinator.com/item?id=42897120
Saya agak terkejut karya saya mendapat peringkat ke-3. Mungkin mereka menyukai kesederhanaan dan visualisasinya
Masih bisa dilihat di https://isbnviz.pages.dev
Sejujurnya, menurut saya dua karya di bawah ini lebih bagus: https://bwv-1011.github.io/isbn-viewer/, https://anna.candyland.page/map-sample.html
Khususnya karya bwv secara teknis mirip, tetapi secara keseluruhan jauh lebih baik daripada milik saya, dan lebih dekat dengan bentuk yang ingin saya buat
Namun jika membandingkan karya Anda dengan karya bwv, saya tidak setuju bahwa bwv secara teknis unggul di semua aspek
Fitur perbandingan, pemilihan ISBN, dan pembuatan tautan tidak ada, dan bwv terlihat berfokus pada satu fitur untuk menonjolkan buku langka, sementara kebutuhan lain yang diinginkan Anna’s Archive tampaknya kurang diperhatikan
Karena dari luar, itu tampak seperti tujuan utama dari upaya kali ini
Benar-benar keren. Tapi saya menemukan satu hal yang aneh
Saat mencari ‘Stubborn Attachments’, hasilnya muncul dengan baik, dan di rak yang sama ada beberapa buku Stripe Press
Di antaranya ada buku karya Stephanie Friedman berjudul “Zero to One Hundred”, tetapi ketika dicari di Amazon, judulnya muncul berbeda. Karena belum terbit, bisa saja judulnya belum final, jadi itu masih bisa dimaklumi: https://a.co/d/bQX5CNf
Yang aneh, jika dicari dengan judul yang terlihat di rak, yaitu “Zero to One Hundred”, hasilnya tidak muncul, tetapi jika dicari dengan ISBN, hasilnya muncul dan nama di hasil pencarian ditampilkan sebagai judul lain lagi
Jadi posisi rak yang sama terlihat berbeda tergantung apa yang dicari. Saya belum membaca tulisan blog tentang cara kerja visualisasi ini, jadi tidak tahu penyebabnya
Jika mencari ISBN di web, “Zero to One Hundred” muncul bersama sampul “Built to Grow”, dan sebaliknya juga begitu
Selain itu, “Experiment, Build, Scale” juga muncul dengan ISBN yang sama yang melekat pada dua judul sebelumnya, dan di visualisasi ditampilkan sebagai buku ini
Sepertinya dari buku-buku Stephanie, yang ada di Google Books hanya “Experiment, Build, Scale”, sementara di Worldcat ada “Zero to One Hundred” dengan sampul “Built to Grow”
Sebagian besar toko buku online saling tercampur seperti ini, jadi ini lebih terlihat sebagai masalah kualitas data di upstream, dan sulit menyalahkan alatnya
Menarik. Jika diperbesar di https://archive.anarchy.cool/maps/isbn.html, terlihat berbagai hal. Sayangnya sepertinya tidak ada tautan langsung berdasarkan koordinat atau tingkat zoom
Di sebelah timur bagian berbahasa Jerman, Anda bisa menemukan penerbit seperti Hueber Verlag, dengan pola seolah-olah nomor ISBN disebar pada interval sekitar 1.360.000
Saya tahu ISBN memiliki checksum sehingga ada ruang kosong di antara nomor, tetapi karena itu muncul pola berulang dengan banyak ruang kosong, dan tampaknya cukup membuang-buang blok besar yang dimiliki penerbit
Apakah tidak ada aturan tentang bagaimana penerbit harus menetapkan nomor? Akan bagus jika blok yang tidak terpakai dan tidak lagi dibutuhkan bisa dikembalikan
Kalau menerbitkan materi pembelajaran dalam 30 bahasa, saya bisa membayangkan muncul beberapa “ide” dalam alokasi ISBN: https://de.wikipedia.org/wiki/Hueber_Verlag
Untuk visualisasi dataset besar yang mengharapkan pengguna “menjelajah” sendiri, saya merasa umumnya memang cantik, tetapi tidak terlalu memberi pencerahan
Alih-alih menyampaikan pesan atau narasi tertentu, pendekatannya hanya membuat orang melihat-lihat, dan visualisasi kali ini tampaknya cukup seperti itu
Jika bukan memodelkan volume tiga dimensi nyata seperti pada pencitraan medis atau CAD, “eksplorasi paksa” yang ditambahkan 3D hanya menyembunyikan insight
Informasi yang disampaikan hanya itu, dan tidak ada struktur hierarkis yang membantu penemuan atau mengorganisasi konten
Selain itu, teks yang sama bisa muncul berkali-kali dalam penjilidan berbeda, yang dari sudut pandang ebook merupakan perbedaan yang tidak terlalu berarti
Masalah yang lebih besar adalah “Anna’s Archive” bukan repositori buku legal, melainkan situs bajakan, dan yang mereka tampilkan adalah pameran gamblang tentang kelengkapan pencurian serta ketiadaan kompensasi yang menyertainya
Akan jauh lebih menarik jika ini berupa antarmuka yang berbasis sistem hierarkis seperti LoC, dan mengakses buku legal yang benar-benar tersedia di https://www.gutenberg.org/, buku yang ada di http://onlinebooks.library.upenn.edu/, atau buku yang sedang dikerjakan di https://www.wikibooks.org/
Begitu melihat gambar paling atas, secara refleks saya jadi ingin menyalakan program defragmentasi disk
Ikut berpartisipasi sendiri sudah sangat menyenangkan, dan selamat untuk semua yang terlibat
Bagi yang penasaran, karya kiriman saya juga masih aktif: https://d199hl4t3ts6d9.cloudfront.net/
Saya mengirimkan rasa sayang yang tulus untuk semua shadow library. Mereka benar-benar melakukan pekerjaan ilahi
Saat melihat “rak buku” negara saya, saya sedih karena begitu banyak judul yang hilang
Sampai-sampai saya ingin pergi ke perpustakaan lokal dan mendigitalkan sendiri buku-buku lama yang sudah tidak dicetak dan kini tidak bisa didapatkan
Terlalu banyak pengetahuan yang sedang lenyap
Saya penasaran mengapa dalam visualisasi ISBN ini tidak terlihat wilayah berbahasa Spanyol yang jelas
Bahasa Inggris punya 2 kotak, Prancis, Jerman, Jepang, Soviet, Tiongkok, dan lainnya punya area besar, tetapi Spanyol tidak punya area besar
Apakah buku berbahasa Spanyol memang sesedikit itu? Atau distribusinya terutama condong ke dunia berbahasa Inggris?
Sebagai orang yang tumbuh di perpustakaan dan toko buku berbahasa Spanyol serta dikelilingi buku-buku berbahasa Spanyol, rasanya agak aneh melihat bagian kami di peta dunia ini tampak begitu kecil
ISBN dan judul diekstrak dari dataset di https://annas-archive.li/datasets, yang terutama mencakup majalah dan buku berbahasa Mandarin, Inggris, dan Prancis
Misalnya, Jerman menerbitkan buku 5 kali lebih banyak daripada Belanda, dan Spanyol menerbitkan 2 kali lebih banyak daripada Belanda: https://internationalpublishers.org/wp-content/uploads/2023/11/IPA-Nielsen-BookData-IPA-Full-Report-23022024.pdf
Namun dalam visualisasi, Jerman terlihat mirip dengan Belanda, dan Spanyol serta Meksiko tidak terlalu sesuai dengan label teratas: https://software.annas-archive.li/AnnaArchivist/annas-archive/-/issues/244#note_2913
Ada satu blok besar yang tampak seperti Argentina atau Peru, dan judul-judulnya berada di tepi blok besar itu
Tidak seperti blok-blok utama lainnya, bagian tengahnya tidak diberi nama dan kosong; jika seluruh blok itu adalah Argentina, saya akan agak terkejut, tetapi jika blok itu adalah wilayah berbahasa Spanyol, itu cukup masuk akal
Karya pemenangnya agak mirip dengan pengelola berkas Eagle mode, yang memperbesar untuk melihat file di dalam direktori dan terus memperbesar untuk mengakses subdirektori
https://eaglemode.sourceforge.net/emvideo.html