2 poin oleh GN⁺ 2025-02-27 | 1 komentar | Bagikan ke WhatsApp
  • Beberapa bulan lalu, diumumkan hadiah $10.000 bagi siapa pun yang dapat memvisualisasikan ruang ISBN dari data Anna’s Archive dengan paling baik
  • Visualisasi ini menunjukkan file yang sudah diarsipkan dan yang belum diarsipkan, serta mencakup dataset yang menunjukkan jumlah perpustakaan yang memiliki ISBN tersebut
  • Banyak orang berpartisipasi dan mengajukan ide-ide kreatif. Antusiasme dan energi terhadap proyek ini sangat mengesankan
  • Tujuannya adalah memahami berapa banyak buku di dunia yang sudah diarsipkan, dan buku mana yang perlu menjadi fokus berikutnya

Visualisasi dasar

  • Dengan gambar di bawah 300kb, ini merangkum “daftar buku” terbesar dalam sejarah manusia secara ringkas.
  • Berbagai sumber data disertakan: All ISBNs, Anna’s Archive, Google Books, Internet Archive, dan lainnya.

Tantangan dan pemenang

  • Diputuskan untuk memberikan hadiah juara 1 sebesar $6.000, juara 2 sebesar $3.000, dan juara 3 sebesar $1.000. Karena banyaknya partisipasi, hadiah juara 3 diputuskan diberikan kepada empat orang, masing-masing $500.
  • Juara 1 $6.000: phiresky - Menonjol berkat opsi visualisasi yang fleksibel serta implementasi yang cepat dan mulus.
  • Juara 2 $3.000: hypha - Visualisasi pada level makro sangat mengesankan, dan menawarkan UI yang ramah pengguna.
  • Juara 3 $500 #1: maxlion - Beragam tampilan sangat mengesankan, terutama tampilan perbandingan dan penerbit.
  • Juara 3 $500 #2: abetusk - Fitur perbandingannya sangat unggul.
  • Juara 3 $500 #3: conundrumer0 - Mengesankan sebagai alat visualisasi yang sangat fleksibel.
  • Juara 3 $500 #4: charelf - Menawarkan fitur yang sederhana tetapi efektif.

Ide yang patut diperhatikan

  • BWV_1011: gedung pencakar langit untuk kelangkaan
  • robingchan: statistik real-time
  • reguster: anotasi dan statistik real-time
  • orangereporter: tampilan peta dan filter yang unik
  • joe.davis: skema warna dasar dan heatmap yang keren
  • timharding: perpindahan mudah untuk perbandingan dataset yang cepat
  • j1618: label yang cantik
  • immartian: bilah skala yang menampilkan jumlah buku
  • backrndsource: banyak slider untuk membandingkan dataset seperti seorang DJ

Kesimpulan

  • Karya pemenang pertama akan diintegrasikan ke situs web utama, dan karya lainnya juga sedang dipertimbangkan.
  • Sedang dipikirkan cara mengorganisasi proses untuk mengidentifikasi, memverifikasi, dan mengarsipkan buku-buku langka.
  • Terima kasih kepada semua yang telah berpartisipasi, dan terima kasih karena begitu banyak orang menunjukkan minat pada proyek ini.

1 komentar

 
GN⁺ 2025-02-27
Opini Hacker News
  • Karya pemenangnya adalah visualisasi yang baru-baru ini juga dibahas di HN
    Mengagumkan baik dari sisi pilihan teknis maupun desain grafis, dan berhasil memvisualisasikan 2 miliar buku dengan elegan sehingga tampak seperti rak buku
    Diskusi HN terkait: https://news.ycombinator.com/item?id=42897120

  • Saya agak terkejut karya saya mendapat peringkat ke-3. Mungkin mereka menyukai kesederhanaan dan visualisasinya
    Masih bisa dilihat di https://isbnviz.pages.dev
    Sejujurnya, menurut saya dua karya di bawah ini lebih bagus: https://bwv-1011.github.io/isbn-viewer/, https://anna.candyland.page/map-sample.html
    Khususnya karya bwv secara teknis mirip, tetapi secara keseluruhan jauh lebih baik daripada milik saya, dan lebih dekat dengan bentuk yang ingin saya buat

    • Saya juga terkejut itu jadi peringkat ke-3
      Namun jika membandingkan karya Anda dengan karya bwv, saya tidak setuju bahwa bwv secara teknis unggul di semua aspek
      Fitur perbandingan, pemilihan ISBN, dan pembuatan tautan tidak ada, dan bwv terlihat berfokus pada satu fitur untuk menonjolkan buku langka, sementara kebutuhan lain yang diinginkan Anna’s Archive tampaknya kurang diperhatikan
    • Saya penasaran kenapa di karya kalian dan karya bwv, Spain/Italy dan lainnya tampak seperti pulau yang terpisah, tetapi juga muncul bersama di massa utama
    • Senang mendengar Anda mengatakan itu. Saya juga terkejut bwv-1011 hanya mendapat honorable mention meskipun menaruh fokus teknis pada visualisasi kelangkaan
      Karena dari luar, itu tampak seperti tujuan utama dari upaya kali ini
  • Benar-benar keren. Tapi saya menemukan satu hal yang aneh
    Saat mencari ‘Stubborn Attachments’, hasilnya muncul dengan baik, dan di rak yang sama ada beberapa buku Stripe Press
    Di antaranya ada buku karya Stephanie Friedman berjudul “Zero to One Hundred”, tetapi ketika dicari di Amazon, judulnya muncul berbeda. Karena belum terbit, bisa saja judulnya belum final, jadi itu masih bisa dimaklumi: https://a.co/d/bQX5CNf
    Yang aneh, jika dicari dengan judul yang terlihat di rak, yaitu “Zero to One Hundred”, hasilnya tidak muncul, tetapi jika dicari dengan ISBN, hasilnya muncul dan nama di hasil pencarian ditampilkan sebagai judul lain lagi
    Jadi posisi rak yang sama terlihat berbeda tergantung apa yang dicari. Saya belum membaca tulisan blog tentang cara kerja visualisasi ini, jadi tidak tahu penyebabnya

    • Sepertinya bukan masalah alatnya, melainkan data buku itu sendiri yang kusut
      Jika mencari ISBN di web, “Zero to One Hundred” muncul bersama sampul “Built to Grow”, dan sebaliknya juga begitu
      Selain itu, “Experiment, Build, Scale” juga muncul dengan ISBN yang sama yang melekat pada dua judul sebelumnya, dan di visualisasi ditampilkan sebagai buku ini
      Sepertinya dari buku-buku Stephanie, yang ada di Google Books hanya “Experiment, Build, Scale”, sementara di Worldcat ada “Zero to One Hundred” dengan sampul “Built to Grow”
      Sebagian besar toko buku online saling tercampur seperti ini, jadi ini lebih terlihat sebagai masalah kualitas data di upstream, dan sulit menyalahkan alatnya
  • Menarik. Jika diperbesar di https://archive.anarchy.cool/maps/isbn.html, terlihat berbagai hal. Sayangnya sepertinya tidak ada tautan langsung berdasarkan koordinat atau tingkat zoom
    Di sebelah timur bagian berbahasa Jerman, Anda bisa menemukan penerbit seperti Hueber Verlag, dengan pola seolah-olah nomor ISBN disebar pada interval sekitar 1.360.000
    Saya tahu ISBN memiliki checksum sehingga ada ruang kosong di antara nomor, tetapi karena itu muncul pola berulang dengan banyak ruang kosong, dan tampaknya cukup membuang-buang blok besar yang dimiliki penerbit
    Apakah tidak ada aturan tentang bagaimana penerbit harus menetapkan nomor? Akan bagus jika blok yang tidak terpakai dan tidak lagi dibutuhkan bisa dikembalikan
    Kalau menerbitkan materi pembelajaran dalam 30 bahasa, saya bisa membayangkan muncul beberapa “ide” dalam alokasi ISBN: https://de.wikipedia.org/wiki/Hueber_Verlag

  • Untuk visualisasi dataset besar yang mengharapkan pengguna “menjelajah” sendiri, saya merasa umumnya memang cantik, tetapi tidak terlalu memberi pencerahan
    Alih-alih menyampaikan pesan atau narasi tertentu, pendekatannya hanya membuat orang melihat-lihat, dan visualisasi kali ini tampaknya cukup seperti itu

    • Itulah persis masalah yang saya rasakan dari upaya memaksakan visualisasi menjadi 3D
      Jika bukan memodelkan volume tiga dimensi nyata seperti pada pencitraan medis atau CAD, “eksplorasi paksa” yang ditambahkan 3D hanya menyembunyikan insight
    • Yang dipetakan ISBN adalah penerbit, judul yang dialokasikan, dan kira-kira urutan penerbitan
      Informasi yang disampaikan hanya itu, dan tidak ada struktur hierarkis yang membantu penemuan atau mengorganisasi konten
      Selain itu, teks yang sama bisa muncul berkali-kali dalam penjilidan berbeda, yang dari sudut pandang ebook merupakan perbedaan yang tidak terlalu berarti
      Masalah yang lebih besar adalah “Anna’s Archive” bukan repositori buku legal, melainkan situs bajakan, dan yang mereka tampilkan adalah pameran gamblang tentang kelengkapan pencurian serta ketiadaan kompensasi yang menyertainya
      Akan jauh lebih menarik jika ini berupa antarmuka yang berbasis sistem hierarkis seperti LoC, dan mengakses buku legal yang benar-benar tersedia di https://www.gutenberg.org/, buku yang ada di http://onlinebooks.library.upenn.edu/, atau buku yang sedang dikerjakan di https://www.wikibooks.org/
  • Begitu melihat gambar paling atas, secara refleks saya jadi ingin menyalakan program defragmentasi disk

    • Animasi di Windows 98 memang yang terbaik. Setelah itu semuanya jelek, sayang sekali
  • Ikut berpartisipasi sendiri sudah sangat menyenangkan, dan selamat untuk semua yang terlibat
    Bagi yang penasaran, karya kiriman saya juga masih aktif: https://d199hl4t3ts6d9.cloudfront.net/

  • Saya mengirimkan rasa sayang yang tulus untuk semua shadow library. Mereka benar-benar melakukan pekerjaan ilahi

    • Mereka mengerjakan separuh pekerjaan, dan separuh itu saja sudah luar biasa. Separuh sisanya dikerjakan oleh para sukarelawan yang mendigitalkan buku
      Saat melihat “rak buku” negara saya, saya sedih karena begitu banyak judul yang hilang
      Sampai-sampai saya ingin pergi ke perpustakaan lokal dan mendigitalkan sendiri buku-buku lama yang sudah tidak dicetak dan kini tidak bisa didapatkan
      Terlalu banyak pengetahuan yang sedang lenyap
  • Saya penasaran mengapa dalam visualisasi ISBN ini tidak terlihat wilayah berbahasa Spanyol yang jelas
    Bahasa Inggris punya 2 kotak, Prancis, Jerman, Jepang, Soviet, Tiongkok, dan lainnya punya area besar, tetapi Spanyol tidak punya area besar
    Apakah buku berbahasa Spanyol memang sesedikit itu? Atau distribusinya terutama condong ke dunia berbahasa Inggris?
    Sebagai orang yang tumbuh di perpustakaan dan toko buku berbahasa Spanyol serta dikelilingi buku-buku berbahasa Spanyol, rasanya agak aneh melihat bagian kami di peta dunia ini tampak begitu kecil

    • Dataset terdiri dari buku-buku yang ada di Anna’s Archive, dan setiap buku diidentifikasi dengan ISBN
      ISBN dan judul diekstrak dari dataset di https://annas-archive.li/datasets, yang terutama mencakup majalah dan buku berbahasa Mandarin, Inggris, dan Prancis
      Misalnya, Jerman menerbitkan buku 5 kali lebih banyak daripada Belanda, dan Spanyol menerbitkan 2 kali lebih banyak daripada Belanda: https://internationalpublishers.org/wp-content/uploads/2023/11/IPA-Nielsen-BookData-IPA-Full-Report-23022024.pdf
      Namun dalam visualisasi, Jerman terlihat mirip dengan Belanda, dan Spanyol serta Meksiko tidak terlalu sesuai dengan label teratas: https://software.annas-archive.li/AnnaArchivist/annas-archive/-/issues/244#note_2913
    • Saya juga punya pertanyaan yang persis sama, dan meski sama sekali tidak punya dasar, saya punya satu hipotesis
      Ada satu blok besar yang tampak seperti Argentina atau Peru, dan judul-judulnya berada di tepi blok besar itu
      Tidak seperti blok-blok utama lainnya, bagian tengahnya tidak diberi nama dan kosong; jika seluruh blok itu adalah Argentina, saya akan agak terkejut, tetapi jika blok itu adalah wilayah berbahasa Spanyol, itu cukup masuk akal
  • Karya pemenangnya agak mirip dengan pengelola berkas Eagle mode, yang memperbesar untuk melihat file di dalam direktori dan terus memperbesar untuk mengakses subdirektori
    https://eaglemode.sourceforge.net/emvideo.html