1 poin oleh GN⁺ 2023-06-29 | 1 komentar | Bagikan ke WhatsApp
  • Dalam sidang dengar pendapat Komite Sains DPR AS, CEO Hugging Face Clement Delangue menekankan bahwa open science dan AI open source sangat selaras dengan nilai dan kepentingan Amerika
  • Delangue menilai alat open source asal AS seperti PyTorch, Tensorflow, Keras, transformers, dan diffusers telah menopang kemajuan AI serta posisi terdepan Amerika
  • Kesaksian ini muncul dua minggu setelah para senator mempertanyakan potensi penyalahgunaan seperti spam, penipuan, malware, pelanggaran privasi, dan perundungan setelah kebocoran LLaMA milik Meta
  • Ia menjelaskan bahwa keterbukaan yang etis memberi masyarakat sipil, organisasi nirlaba, kalangan akademik, dan pembuat kebijakan kemampuan untuk menyeimbangkan kekuatan perusahaan swasta besar serta mengurangi sistem kotak hitam
  • Hugging Face berupaya menggabungkan keterbukaan dan pengaman melalui model card, pembatasan akses, rilis bertahap, moderasi komunitas, serta dataset opt-in dan opt-out

Pembelaan AI open source dalam sidang DPR AS

  • CEO Hugging Face Clement Delangue memberikan kesaksian dalam sidang pleno Komite Sains DPR AS Artificial Intelligence: Advancing Innovation Towards the National Interest
  • Turut hadir dalam sidang yang sama CEO RAND Corporation Jason Matheny, general partner Lux Capital Shahin Farshchi, fellow Responsible AI Harvard University Rumman Chowdhury, dan direktur eksekutif Georgetown University Center for Security and Emerging Technology Dewey Murdick
  • Delangue menilai kemajuan AI belakangan ini dimungkinkan di atas fondasi open science dan open source
    • PyTorch, Tensorflow, Keras, transformers, dan diffusers disebut sebagai teknologi open source yang dibuat di Amerika
    • Ia mengatakan tanpa teknologi ini, Amerika mungkin tidak akan menjadi negara terdepan dalam AI

Keterbukaan etis yang diajukan di tengah kontroversi LLaMA

  • Kesaksian Delangue muncul dua minggu setelah para senator mengajukan pertanyaan kepada Mark Zuckerberg terkait kebocoran LLaMA, LLM open source milik Meta
    • Surat tersebut menyoroti kekhawatiran bahwa LLaMA dapat digunakan untuk spam, penipuan, malware, pelanggaran privasi, perundungan, dan tindakan salah lain yang merugikan
    • Dengan penyebaran LLaMA, tingkat kecanggihan model AI yang dapat diakses publik meningkat tajam, begitu juga kekhawatiran atas kemungkinan penyalahgunaan atau abuse
  • Hugging Face adalah startup berbasis di New York yang tahun lalu memperoleh valuasi 2 miliar dolar AS dan telah menjadi hub untuk kode serta model open source
    • Pada April, Delangue mengumpulkan lebih dari 5.000 orang di meetup teknologi open source yang diadakan di Exploratorium, San Francisco
  • Delangue mengatakan open science dan open source mendorong puluhan ribu startup yang memanfaatkan AI
  • Keterbukaan yang etis memberi masyarakat sipil, organisasi nirlaba, kalangan akademik, dan pembuat kebijakan kapasitas yang dibutuhkan untuk menyeimbangkan kekuatan perusahaan swasta besar
    • Ini mencegah sistem kotak hitam dan meningkatkan akuntabilitas perusahaan
    • Ini dapat membantu mitigasi bias, mengurangi misinformasi, memperkuat hak cipta, dan memberi kompensasi kepada pemangku kepentingan termasuk seniman dan kreator konten
  • Pendekatan Hugging Face menggabungkan kebijakan kelembagaan, pengaman teknis, dan insentif komunitas
    • Ini mencakup dokumentasi dan model card, termasuk model cards yang dipelopori Dr. Margaret Mitchell
    • Pembatasan akses ke artefak dan rilis bertahap digunakan sebagai pengaman teknis
    • Moderasi komunitas serta dataset opt-in dan opt-out juga termasuk dalam struktur insentif
  • Dalam beberapa bulan terakhir, perdebatan soal AI open source makin memanas seiring berlanjutnya rilis model bahasa besar dan munculnya penolakan dari startup, kolektif, serta kalangan akademik terhadap pergeseran ke LLM tertutup dan proprietari

1 komentar

 
GN⁺ 2023-06-29
Komentar Hacker News
  • Ini adalah miniatur sempurna yang menunjukkan cara sistem bekerja. Orang ini benar, tetapi datang terlalu terlambat, kekurangan dana, dan tidak mendapat cukup perhatian
    Sementara itu Sam Altman adalah wajah dari produk konsumen dengan tim pemasaran hebat dan bahkan pelobi, menerima miliaran dolar dari Microsoft, serta punya produk yang bisa dicoba gratis oleh siapa saja
    Tinggal masuk lebih dulu lalu mengangkat narasi bahaya AI, dan meyakinkan para anggota parlemen bahwa teknologi mutakhir itu berbahaya. OpenAI segera diterima seolah sinonim dengan teknologi terdepan, sehingga orang mengikuti pemimpin industri tanpa benar-benar melihat ke mana mereka menuju, dan akhirnya kita sampai di sini
    Saya berharap perangkat lunak sumber terbuka terwakili secara adil di pengadilan opini publik, tetapi ide tidak bisa membiayai dirinya sendiri dan suara uang terlalu keras

    • Altman datang ke Kongres bukan untuk meyakinkan mereka bahwa “AI mutakhir itu berbahaya”; Blumenthal-lah yang mengundangnya agar punya alasan yang bagus untuk ditunjukkan ke media
      Kongres merasa terbebani karena membiarkan media sosial tak terkendali, dan sangat ingin mengatur AI. Dalam sidang itu tidak ada perbedaan pendapat yang berarti, dan niat pemerintah serta industri sepenuhnya selaras. Mereka sedang menggelar karpet merah bagi kontrol terpusat, dan mengarah pada regulasi yang menghapus persaingan
    • Kepentingan pemerintah kemungkinan lebih selaras dengan pihak OpenAI, dan bisa jadi malah bodoh jika mereka tidak menyingkirkan model open-source/lokal
      Hal-hal yang berjalan secara lokal melewati batas jaringan yang bisa disadap dan diawasi. Bertanya ke Google akan tercatat, riwayat pencarian bisa diperoleh lewat surat perintah, dan catatan peminjaman perpustakaan umum juga demikian. Penjaga gerbang seperti OpenAI bisa mengambil peran itu dan menarik tarif
      Jika melakukan penyelidikan yang sama dengan sesuatu seperti Vicuna-13B-ggml, tidak ada yang bisa mengendus apa yang sedang dilakukan. Ini terdengar bagus bagi orang yang ingin dibiarkan sendiri, tetapi punya implikasi menakutkan bagi pihak yang merasa harus menghentikan pengguna yang lebih berniat jahat
      Sayangnya, pada isu seperti ini hampir tidak mungkin ada kompromi. Yang terbaik mungkin seperti hukum terbaru di Belanda, yang memungkinkan pemerintah menembus perangkat pribadi bila ada alasan yang cukup kuat, tetapi sepertinya tidak akan ke sana. Satu-satunya alternatif yang menguntungkan pemerintah adalah melarang model lokal dan pengembangan open-source-nya sendiri
    • Dalam persepsi publik, sangat buruk juga bahwa karena namanya, OpenAI keliru dikaitkan dengan open source. Akibatnya dua pendekatan yang saling berlawanan tampak tercampur bagi publik
    • Apa benar sudah terlambat? Bukankah ini masih tahap awal?
    • Alasan untuk optimistis adalah, para pelobi yang ingin menutup AI punya kelemahan berupa fakta bahwa Kongres akhir-akhir ini tidak terlalu efektif bekerja, dan status quo pada isu ini adalah “tidak melakukan apa-apa”
      Untuk melampaui resistensi status quo dibutuhkan dukungan publik yang besar, dan dukungan seperti itu tidak ada serta sangat mahal untuk dibeli dengan uang
  • Open source adalah komponen penting untuk membangun masyarakat digital yang sehat yang lebih dekat dengan nilai-nilai yang kita junjung
    AI memang penting, tetapi pada akhirnya hanya bagian kecil dari perubahan yang lebih besar ini. Perlu diingat bahwa Bitcoin, yang ingin mengguncang fondasi kehidupan ekonomi, juga bersifat open source
    Proses evolusi menanamkan kemampuan open source pada skala masyarakat tidaklah otomatis dan jelas-jelas tidak selalu baik. Contoh kripto di atas menunjukkan hal itu
    Masih banyak teknologi, institusi, dan pola perilaku yang harus dibayangkan, dikembangkan, diuji, dan disebarluaskan. Ini adalah tantangan yang bagus untuk digarap serius oleh para insinyur “masyarakat” digital masa kini dan masa depan
    Sulit membayangkan semesta selain distopia. Jika pernah ada visi monopolistik yang selaras secara moral dengan agensi individu, kebebasan, dan kontrol demokratis, sekaligus jujur secara intelektual tentang insentifnya sendiri, saya sungguh ingin tahu

  • CEO Hugging Face melakukannya dengan baik. Saya membagikan tautan YouTube berdurasi 5 menit kepada teman dan keluarga, dan itu menjelaskan keunggulan model terbuka dan open source dengan sangat baik

    • Bisa beri tautan videonya?
  • Dalam kasus ini terasa seperti contoh di mana perbedaan antara open source dan free software menjadi cukup penting

    • Untuk LLM, saya benar-benar berharap orang berhenti menyebut model dengan kode sumber atau bobot yang bocor sebagai “open source”
      Hal yang sama berlaku bahkan jika dirilis dengan sengaja tetapi lisensinya membatasi pada “penggunaan nonkomersial”, atau hanya mengizinkan penggunaan komersial bila tidak “bersaing” dengan perusahaan yang merilisnya
    • Bahkan tanpa terlalu terpaku pada semantik, yang penting di sini adalah pertukaran bebas ide, algoritma, dan sebagian kode
      Selama 20 tahun terakhir, kemajuan di bidang ini sangat dipercepat oleh pertukaran semacam itu. Alih-alih perusahaan menggenggam hasilnya dan menjaga bumbu rahasia mereka, banyak detail dibagikan, lalu diverifikasi dengan mereproduksi dan meningkatkan hasil satu sama lain
      OpenAI membuat ChatGPT, Meta membuat Llama, dan Google menjalankan Bard. Llama sampai taraf tertentu telah dilepas ke komunitas open-source, dan orang-orang sekarang menggunakannya, meningkatkannya, serta membandingkannya dengan model dan benchmark mereka sendiri
    • Open source selalu penting. Tanpa open source, sulit menciptakan jalur masuk pengembang yang baik. Bidang-bidang rekayasa lain juga seharusnya mengarah ke hal serupa. Tentu itu bukan berarti perangkat lunak tertutup tidak boleh ada
      Setidaknya dalam generasi gambar, karena pelatihan dilakukan secara crowdsourcing, model terbuka kini tampaknya menghasilkan keluaran yang jauh lebih baik
    • Jujur saja saya merasa sebaliknya. Semakin banyak perangkat lunak open source tentu lebih baik, tetapi saya tidak yakin LLM yang menjadi open source akan banyak mengurangi risiko terbesar LLM seperti yang saya lihat
  • Aneh melihat Hugging Face muncul di berita seperti ini. Saya ingat pernah menyumbang patch perbaikan sekitar musim panas 2019 saat bintangnya sekitar 4 ribu, dan bahkan waktu itu saya menganggapnya proyek yang cukup populer

    • Bayangkan 5 tahun kemudian ;)
  • Apa tujuan akhir Hugging Face? Menjadi GitHub untuk AI?

    • Ini CEO Hugging Face. Jika itu bisa membantu menopang demokratisasi AI yang baik berkat sains terbuka dan open source, saya berharap demikian. Menurut Anda apakah itu berguna?
    • Antarmukanya mirip 90% dengan GitHub, jadi itu tampak sangat jelas
      Mereka juga sedang mencoba berekspansi ke pelatihan model AI dan menjalankan inferensi. Tetapi biaya inferensinya tampak jauh kurang kompetitif dibanding penyedia GPU seperti CoreWeave
    • Apa pun jadinya, saya sungguh, sungguh, sungguh, sungguh berharap itu tidak jatuh ke tangan Microsoft atau Google. Tentu pada akhirnya itu akan terjadi juga dan enshitification akan menyusul
    • Bukankah memang sudah begitu?
    • Diakuisisi AWS?
  • Saya suka bahwa dia masih orang yang cukup mudah dijangkau di media sosial

  • Mengapa Kongres sampai ikut campur dalam hal-hal seperti perangkat lunak, open source, dan AI?

  • Penasaran apakah Anda sudah melihat proyek Bittensor dan bagaimana pendapat Anda tentangnya. Apakah layak dipertimbangkan untuk integrasi?
    Saya rasa itu bisa membantu hal-hal seperti proyek ini dan gerakan AI open-source

  • Bukankah sebagian besar model di Hugging Face berada di bawah lisensi RAIL yang aneh dan bukan open source?

    • Setidaknya di GitHub, sebagian besar proyek mereka berlisensi MIT atau Apache 2.0. Apakah ada yang saya lewatkan?