2 poin oleh GN⁺ 2025-06-04 | 1 komentar | Bagikan ke WhatsApp
  • AI generatif sudah mengubah pendidikan dan riset humaniora, sehingga pendekatan yang hanya menganggapnya sebagai sekadar hype atau sesuatu yang harus dilarang sulit dipertahankan dalam jangka panjang
  • Kemampuan LLM dalam penerjemahan, klasifikasi, dan pemrosesan bahasa bersinggungan dengan pengetahuan humaniora, dan untuk memperbaiki sistem AI pun penilaian bahasa, budaya, dan retorika menjadi penting, seperti terlihat pada masalah menjilat di GPT-4o
  • Peneliti humaniora nonteknis pun dapat membuat alat riset dan pengajaran yang disesuaikan dengan bantuan AI, dan simulator apoteker abad ke-17 serta Young Darwin sama-sama menunjukkan peluang dan sulitnya mengendalikan halusinasi
  • Chatbot seperti ChatGPT mempersulit penilaian tulisan mahasiswa, dan meningkatkan risiko mahasiswa kehilangan pengalaman berpikir yang intens dengan melewati upaya intelektual
  • Jika pendidik tidak merancang sendiri tugas dan alat berbasis AI, alat belajar AI komersial yang melemahkan hubungan guru-siswa yang personal bisa mengisi ruang pendidikan sebagai penggantinya

Mengapa sulit mengabaikan AI dalam humaniora

  • D. Graham Burnett dalam artikelnya di The New Yorker mengkritik sikap universitas yang hanya memperlakukan AI sebagai objek larangan atau berusaha bertahan dengan cara lama
  • Draf kebijakan anti-AI di salah satu departemen universitas, jika ditafsirkan secara harfiah, bahkan dapat melarang tugas yang justru berpusat pada AI, dan kemudian direvisi
  • Evaluasi eksternal merekomendasikan agar departemen sejarah segera merespons kekacauan AI yang akan datang dalam pendidikan dan riset, tetapi tanggapannya dingin
  • Intinya bukan bahwa AI generatif pada dasarnya baik, melainkan bahwa ia sudah mengubah humaniora sehingga sulit dianggap sebagai hype belaka atau diabaikan

Keterampilan humaniora yang kian penting bagi riset AI itu sendiri

  • LLM menunjukkan kekuatan dalam penerjemahan, pengurutan, dan klasifikasi seperti “kalkulator untuk kata-kata”, dan mulai memengaruhi bidang seperti filologi, data mining, dan penerjemahan bahasa kuno
  • Dalam beberapa tahun terakhir, keterampilan humaniora menjadi penting bukan hanya untuk menggunakan AI, tetapi juga bagi riset AI itu sendiri
  • Langkah pertama yang diterapkan OpenAI untuk memperbaiki kecenderungan menjilat yang aneh pada GPT-4o bukanlah kode baru, melainkan system prompt baru dalam bentuk kalimat bahasa Inggris
    • Simon Willison menganalisis perubahan system prompt yang diterapkan OpenAI
    • Prioritas umpan balik pengguna melalui tombol “thumbs up” juga disebut sebagai faktor lain, dan ini pun terkait dengan pengaruh bahasa terhadap perilaku, perbedaan budaya, retorika, genre, dan persoalan nada
  • Ketika IBM mainframe pada 1950-an atau mesin uap pada 1850-an rusak, teknisi perbaikannya tidak terlalu perlu memikirkan bahasa, budaya, dan filsafat teknologi, tetapi sistem AI dapat benar-benar bertingkah seolah rusak jika pertimbangan semacam itu kurang

Alat riset dan pengajaran yang dibuat langsung oleh humanis nonteknis

  • AI generatif memungkinkan pengguna nonteknis di bidang humaniora untuk mencoba menulis kode secara langsung
  • Generasi baru sejarawan kemungkinan akan menganggap wajar pembuatan dan distribusi alat riset serta pengajaran yang disesuaikan, nyaris tanpa biaya
  • Percobaan pertama adalah simulator apoteker abad ke-17 yang bisa dimainkan gratis
    • Mahasiswa bermain sebagai Maria de Lima, seorang apoteker perempuan semi-fiktif di Mexico City tahun 1680-an
    • Mereka harus membaca dan menggunakan resep medis awal zaman modern yang nyata untuk merawat pasien yang didasarkan pada tokoh sejarah sungguhan
    • Ada bug dan masalah kegunaan, dan halusinasi buatan LLM yang menyimpang dari realitas sejarah cepat muncul
    • Dalam satu permainan, Maria menjadi penumpang gelap di kapal dagang menuju Inggris lalu bertemu Isaac Newton di London dan dijamu minum teh
  • Percobaan kedua, Young Darwin, adalah gim mengumpulkan finch dan spesimen sebagai Darwin muda di Kepulauan Galápagos pada 1835
    • Sistem pergerakan medan yang didasarkan pada topografi nyata dari Voyage of the Beagle karya Darwin membantu AI tetap berpegang pada dasar tekstual secara harfiah
    • Sulit meninggalkan pulau, dan hewan serta medan yang ditemui diambil langsung dari tulisan asli Darwin, sehingga kecenderungan berhalusinasi berkurang
    • Ada sistem logging yang lebih kokoh, berguna untuk menambahkan lapisan evaluasi di masa depan dan mengubahnya menjadi tugas nyata
  • Desain pembelajarannya membuat mahasiswa terlebih dahulu membaca tulisan Darwin, lalu menunjukkan apa yang mereka pelajari melalui pilihan di dalam gim
    • Untuk maju, mereka harus menghayati epistemologi dan pengetahuan nyata seorang naturalis abad ke-19
    • Aktivitas ini tidak menggantikan esai di kelas dan diskusi tatap muka, melainkan melengkapinya

Realitas yang membuat keterampilan humaniora makin sulit diajarkan

  • Chatbot AI mengguncang elemen inti sistem pendidikan, dan pendidik, mahasiswa, politisi, serta frontier AI lab harus menangani masalah ini dengan serius
  • Karena ChatGPT dan alat pesaing, penilaian tulisan mahasiswa menjadi lebih sulit, dan meningkatnya pengumpulan esai buatan mesin memaksa penyusunan ulang tugas serta rencana pembelajaran
  • Dalam jangka panjang, kerugian yang lebih besar menimpa mahasiswa
    • LLM berisiko menjadikan upaya sebagai unsur opsional dalam pendidikan tinggi
    • Mahasiswa yang tidak pernah mengalami kebuntuan saat menulis juga akan sulit mengalami keadaan tenggelam penuh ketika berhasil menembusnya
    • Tanpa pengalaman berjam-jam sia-sia mencari sesuatu di perpustakaan, sulit memahami secara mendasar untuk apa ruang perpustakaan itu ada
  • Artikel New York Magazine menangkap dengan baik persoalan penggunaan ChatGPT
    • Seorang mahasiswa Columbia berkata, “sebagian besar tugas kuliah tidak relevan, bisa diretas dengan AI, dan saya tidak tertarik mengerjakannya”
    • Ketika ditanya alasan masuk universitas Ivy League, ia menjawab bahwa itu adalah “tempat terbaik untuk bertemu co-founder dan istri”
  • Cara seperti ini melemahkan kegembiraan mengajar dan makna pengalaman pendidikan

Potensi tugas AI dan kekhawatiran ketimpangan

  • Dalam kelas Burnett, mahasiswa mengerjakan tugas berdiskusi dengan ChatGPT tentang konsep attention, lalu mengedit hasilnya untuk dikumpulkan, dan ia menganggapnya sebagai pengalaman pendidikan yang kuat
  • Model bahasa adalah alat pendidikan baru, dan karena dampaknya masih belum pasti, para pendidik yang sungguh peduli pada pembelajaran harus terlibat aktif sekarang
  • Kekhawatiran terbesar adalah bahwa LLM dapat makin memperbesar polarisasi hasil pendidikan humaniora
    • Mahasiswa Princeton yang diajar Burnett tampaknya merespons tugas itu dengan sangat reflektif dan kreatif
    • Reaksi siswa mata pelajaran sosial di SMA negeri yang kekurangan dana tidak bisa diasumsikan akan sama
  • Pendidik harus belajar cara membuat dan mendistribusikan sendiri tugas serta alat berbasis AI yang sesuai dengan cara mengajar yang mereka inginkan
  • Kesadaran inilah yang menjadi dasar NEH grant yang diterima bersama Pranav Anand dan Zac Zimmer dari UCSC
    • Hibah tersebut diberikan pada Januari 2025, tetapi dibatalkan bulan lalu oleh pemerintahan Trump/DOGE
    • Pekerjaan yang direncanakan tetap berjalan

1 komentar

 
GN⁺ 2025-06-04
Pendapat Hacker News
  • Ada masalah pendidikan yang lebih mendalam yang terbentuk selama puluhan tahun. Siswa dilatih untuk melihat sekolah dan pekerjaan sebagai rangkaian target yang harus dicapai tanpa henti, dengan tujuan akhir berupa mendapat pekerjaan.
    Namun kini sulit mengatakan dengan yakin pekerjaan apa yang masih akan ada 5–10 tahun lagi. Kalau ada pengecualian, mungkin hanya pekerjaan keterampilan teknis, tetapi program semacam itu sebagian besar sudah lama menghilang dari sekolah.
    Jika mahasiswa memakai AI untuk melewati tugas dengan mudah alih-alih membaca sendiri, bertahan, dan belajar, sulit menyalahkan mereka saja atas sistem pendidikan dan karier yang kita ciptakan. Masalah ini tidak muncul dalam semalam, dan juga bukan masalah AI semata.

    • AI sempat dipakai sebagai kambing hitam yang nyaman untuk menjelaskan PHK dan pemangkasan setelah berakhirnya ZIRP, dan kini tampaknya juga dipakai untuk menyalahkan AI atas kegagalan sistem pendidikan modern.
      Pendidikan kita tidak memberi imbalan pada pemahaman, pengetahuan, atau kecerdasan, melainkan hanya nilai. Satu angka bernama GPA lebih mudah digamifikasi daripada apa pun, dan sudah menjadi indikator terpenting yang menentukan seluruh masa depan akademik dari SMP hingga universitas.
    • Saya kira pekerjaan yang sudah ada sejak lama kemungkinan besar akan tetap bertahan lama ke depan. Apa pun perubahannya, pekerjaan itu tidak akan tiba-tiba hilang, melainkan berkurang perlahan, jadi masih ada cukup waktu untuk membuat rencana yang masuk akal.
      Banyak pekerjaan yang masih akan ada 5–10 tahun lagi bisa diprediksi dengan cukup baik. Namun kebenaran yang tidak nyaman adalah bahwa cukup banyak pekerjaan berpenghasilan tinggi di bidang ekonomi baru tidak memenuhi kriteria sebagai pekerjaan yang sudah lama bertahan.
      Jadi, jika mengikuti kriteria ini, Anda bisa melewatkan peluang berpenghasilan tinggi yang sulit diprediksi, dan jika Anda tipe orang yang mudah iri saat teman tiba-tiba menghasilkan banyak uang, pekerjaan seperti itu mungkin tidak akan memberi kebahagiaan.
    • Kalau hanya 10% populasi saja berpindah ke pekerjaan keterampilan teknis, pasar itu akan runtuh. Saya tidak mengerti kenapa semua orang tidak memahami ini.
    • Ini benar-benar serius. Lulusan lokal terus berdatangan seolah memohon-mohon magang tanpa bayaran atau pekerjaan.
      Mereka mengambil mata pelajaran AP, punya GPA bagus, lulus dari sekolah bagus, “belajar coding”, bahkan menanggung utang kuliah 200 ribu dolar, tetapi akhirnya menyadari tidak ada pekerjaan yang dijanjikan di ujung sana.
      Pada saat yang sama, mereka mendengar bahwa “developer sangat kekurangan”, dan juga melihat pekerja dari luar negeri direkrut untuk pekerjaan yang sama. Bagaimana anak muda bisa percaya pada sistem ini?
      Dalam situasi seperti ini, apakah orang seperti pekerja baja akan mau mengikuti pelatihan ulang untuk belajar coding? Apalagi jika bahkan para geek yang belajar coding pun berakhir suram.
    • Dulu pun kita tidak pernah bisa mengatakan dengan yakin pekerjaan apa yang akan tersedia. Orang yang menguasai dasar-dasar dan fleksibel pada akhirnya akan menemukan sesuatu.
  • Komentar pertama di tulisan itu menarik perhatian saya:
    “Saya mahasiswa pascasarjana filsafat di SFSU dan mengajar berpikir kritis. Semester ini saya mengubah seluruh desain kelas, bukan membahas Plato, melainkan seperti menjalani obstacle course bersama AI, dan mahasiswa menyukainya.”
    Sepertinya menarik jika mahasiswa diminta merancang sendiri “tugas yang tidak bisa diselesaikan teman sekelas dengan ChatGPT”.
    Sekitar 10 tahun lalu di BarCamp, saya pernah ikut kuis tim yang dibuat sulit dipecahkan dengan Google; misalnya menebak “pulau apa ini?” hanya dari garis bentuk pulaunya. Itu sangat menyenangkan, dan merancang tugas yang ChatGPT-proof terasa seperti tantangan intelektual serupa.

    • Menurut saya merancang “kelas yang hampir sulit ditembus ChatGPT” cukup sederhana jika mengambil inspirasi dari sistem universitas Jerman.
      Setiap minggu mahasiswa harus mengerjakan soal latihan yang sulit, tetapi menyelesaikan persentase tertentu hanyalah awal dan menjadi syarat untuk berhak mengikuti ujian lisan atau tertulis yang sesungguhnya.
      Seperti yang dikatakan banyak profesor, hampir satu-satunya tujuan kuota soal latihan yang sulit adalah mencegah mahasiswa yang belum siap mengikuti ujian dan merugikan dirinya sendiri.
      Kecurangan seperti memakai ChatGPT pada soal latihan memang dilarang, tetapi biasanya tidak ditegakkan dengan keras. Sebagai gantinya, jika melakukan itu, mereka tidak akan siap menghadapi ujian yang akan datang dan akhirnya gagal, dan para mahasiswa umumnya sangat menyadari hal ini.
      Di universitas Jerman, jika biasanya gagal 3 kali pada ujian yang sama, seseorang bisa dinyatakan “gagal final (endgültig nicht bestanden)”, sehingga tidak lagi bisa mempelajari program gelar yang sama di semua universitas Jerman.
    • Yang menonjol bagi saya adalah bahwa desain soal “inovatif” yang hanya memberikan garis bentuk pulau pada dasarnya tidak dapat diakses oleh orang seperti saya yang tunanetra.
      Saya tahu saya tidak umum, tetapi tren menghindari tugas berbasis teks membuat pendidikan yang aksesibel makin mustahil. Sepertinya kita akan menghadapi generasi baru kesenjangan digital.
    • Howard Rheingold dan lainnya sudah lama aktif di bidang ini. Jika tertarik, ada baiknya melihat Peeragogy Handbook dan tulisan yang memicu gagasan tersebut.
      “Semakin banyak wewenang guru yang dialihkan kepada siswa, dan semakin siswa didorong untuk mengambil lebih banyak tanggung jawab atas pembelajaran mereka sendiri, semakin mereka menunjukkan kepada saya bagaimana saya harus merancang ulang metode mengajar saya.”
      [0]: https://clalliance.org/blog/toward-peeragogy/
    • Benar bahwa merancang tugas yang ChatGPT-proof adalah tantangan intelektual, tetapi masalahnya dosen hampir tidak diberi waktu dan pelatihan untuk itu.
      Dalam kondisi nyaris bertahan dengan beban mengajar 4/4, tidak ada cukup waktu untuk memperkenalkan metode pendidikan eksperimental dan merancang ulang kelas sepenuhnya. Universitas juga sering menyerahkannya kepada masing-masing dosen, alih-alih menyediakan pelatihan atau dukungan agar kelas diubah menjadi lebih tahan terhadap AI.
      Selain itu, perkembangan alat terlalu cepat sehingga ide bagus pun cepat usang. Beberapa orang mengganti tugas akhir dari makalah menjadi produksi podcast, tetapi tak lama kemudian muncul alat “buat podcast saya sendiri” sehingga kecurangan menjadi semudah pada makalah tradisional.
    • Jika guru benar-benar memahami topik yang diajarkannya, cukup 30 detik berbicara dengan seorang siswa untuk menilai apakah siswa itu benar-benar tahu atau tidak. Mungkin “tugas” memang bukan cara terbaik untuk membangun dan memverifikasi pengetahuan.
  • Penulis terutama berbicara tentang mengajar sejarah, tetapi pendidikan sejarah yang ia maksud lebih dekat ke apresiasi sejarah daripada sejarah untuk membantu prediksi. Lebih dekat ke mempelajari “klasik” sejak Cicero
    Para perwira militer banyak mempelajari sejarah, tetapi caranya berbeda. Mereka mencari kesalahan. Mengapa sebuah pertempuran atau perang kalah, mengapa sejak awal terseret ke pertempuran itu, mengapa situasi menjelang Perang Dunia I begitu tidak stabil secara strategis sampai pembunuhan tokoh yang relatif kecil bisa berkembang menjadi perang dunia
    Pendidikan sejarah tradisional cenderung berfokus terutama pada para pemenang yang menulis dengan baik. Membaca tulisan pihak yang kalah, atau tulisan tentang pihak yang kalah, bisa jadi lebih produktif
    Jika ingin memahami zaman Cicero, ada baiknya membaca [1]. Ini buku tentang Cicero yang ditulis oleh seorang jurnalis politik surat kabar yang sinis dan berpengalaman, dan ia menilai banyak sejarawan menerima pidato-pidato Cicero begitu saja. Penulisnya merasa lebih tahu karena ia sudah banyak mendengar politisi pada masanya
    Pendekatan seperti ini membuat kita menjauh dari bidang tempat LLM paling berguna. Sebab, untuk saat ini LLM belum pandai mendeteksi sanjungan dan sikap menjilat
    [1] https://archive.org/details/thiswasciceromod0000henr

    • “Menggunakan sejarah sebagai alat prediksi” bukanlah hal yang umumnya dilakukan sejarawan akademis. Riset sejarah menceritakan kisah umat manusia, dan ada untuk alasan yang lebih luas daripada penerapan langsung pada pengambilan keputusan hari ini
      Ini juga berlaku untuk sejarah militer. Sejarah militer adalah salah satu subbidang yang paling lambat menerima metode dan praktik baru
    • Saya tidak begitu paham bagaimana apresiasi sejarah, sejarah yang membantu prediksi, dan kajian klasik dipisahkan
      Saya selalu melihat sejarah sebagai cara menjelaskan “mengapa hal-hal sekarang menjadi seperti ini”. Semua yang baik dan buruk saat ini adalah hasil dari peristiwa-peristiwa sebelumnya
      Apakah mempelajari “klasik” dari sudut pandang sejarah itu dilakukan untuk apresiasi. Yang saya lihat dari sejarawan sungguhan umumnya lebih dekat ke cara membaca secara kritis
    • Tujuan sejarah bukanlah memprediksi masa depan, dan masa depan tidak bisa diprediksi dengan sejarah
      Selain itu, pernyataan bahwa sejarawan menerima pidato Cicero begitu saja juga tidak tepat. Ini tampak seperti contoh lain dari orang yang melihat bidang lain dari luar, mengira dirinya lebih tahu, lalu mempermalukan diri sendiri
      Lagi pula, mengapa harus membaca buku terbitan 1942 sambil mengabaikan 80 tahun riset terakhir tentang Cicero
    • Pemisahan antara sejarah sebagai analisis strategi dan sejarah sebagai apresiasi budaya itu bagus. Pendidikan saat ini umumnya condong ke yang kedua, dan itu juga lebih mudah direplikasi oleh AI
      Namun pemikiran historis yang paling bernilai biasanya muncul dari pertanyaan-pertanyaan tidak nyaman seperti kegagalan, konsekuensi yang tidak diniatkan, dan sudut pandang yang biasanya diabaikan
  • Guru fisika yang malas bisa membuat semua soal pada dasarnya menjadi soal matematika. Jika khawatir kalkulator yang lebih baik membuat ujian menjadi trivial, mungkin yang perlu dilakukan adalah tidak menguji matematika, melainkan mengajar fisika
    Guru humaniora yang malas bisa membuat semua soal pada dasarnya menjadi soal menulis. Jika pemeriksa ejaan yang lebih baik membuat evaluasi humaniora menjadi trivial, mungkin yang perlu diajarkan adalah humaniora, bukan menulis esai
    Dengan sengaja sedikit provokatif, apakah kualitas ide benar-benar berkorelasi dengan esai yang ditulis dengan baik

    • Saya rasa para dosen bisa mengembangkan evaluasi yang tahan terhadap AI
      Namun hampir tidak ada dukungan institusional untuk itu. Semua orang mengurusnya sendiri-sendiri, dan alat AI berubah dengan cepat. Tidak realistis meminta dosen non-tenure yang mengajar beban 4/4 untuk tidak malas dan merombak total metode evaluasinya
      Siklus iterasinya juga lambat. Untuk mengurangi kecurangan, harus membuat silabus baru, menjalankannya satu semester, melihat hasilnya, lalu mengubahnya lagi dalam beberapa minggu sebelum semester musim semi. Paling baik hanya sekali tiap 6 bulan, dan biasanya iterasi bermakna hanya mungkin sekitar setahun sekali
    • Pendidikan humaniora perlu kembali ke metode Sokratik
      Pusatnya semestinya proses dialektis tempat mahasiswa mendiskusikan ide dalam teks dan kuliah yang mereka baca dan dengar, bukan konsumsi dan produksi teks yang hanya dibaca sekali oleh asisten dosen atau profesor
      LLM dapat dengan mudah menghasilkan makalah tingkat sarjana, tetapi tidak bisa duduk di kelas dan melakukan percakapan intelektual dengan teman-teman sejawat
      Tentu saja, perubahan seperti ini kemungkinan besar tidak akan terjadi karena tidak mudah diskalakan secara ekonomis. Sebab ini jauh lebih padat karya
    • Ini mengingatkan pada saat kalkulator muncul. Di kelas fisika SMA, siswa-siswa kaya mulai membawa kalkulator “ilmiah”, dan ada keributan soal apakah itu harus diizinkan
      Saya tidak tahu apakah ini persis mirip dengan LLM, tetapi argumen yang saat itu meyakinkan adalah bahwa para siswa pada akhirnya tetap akan memakai kalkulator di lapangan. Masa depan seperti itu juga tampak pasti bagi mahasiswa rekayasa perangkat lunak
    • Jika insentif ekonomi untuk berbuat curang hilang, humaniora tampaknya tidak akan mengalami masalah seperti sekarang akibat LLM
    • Menganggap ChatGPT sama seperti “pemeriksa ejaan yang lebih baik” itu berlebihan. Bukankah menulis juga keterampilan yang harus diajarkan
  • Hal yang tidak diketahui kebanyakan orang tentang sejarah dan humaniora adalah bahwa masih ada sangat banyak pekerjaan yang harus dilakukan
    Orang-orang tentu saja antusias dengan upaya menguraikan gulungan Herculaneum yang hangus, tetapi mereka tidak banyak tahu bahwa kurang dari 10% teks Neo-Latin dari Renaisans hingga era modern awal telah diterjemahkan ke bahasa Inggris
    Misalnya, Marsilio Ficino adalah filsuf luar biasa yang dipekerjakan Cosimo Medici untuk menerjemahkan teks-teks Yunani seperti Plato, Plotinus, dan Hermetica ke bahasa Latin. Ini memberi pengaruh besar pada Renaisans dan Pencerahan Eropa, tetapi banyak tulisan Ficino sendiri masih belum diterjemahkan ke bahasa Inggris
    LLM tentu juga akan memberi dampak besar di sini, tetapi mahasiswa juga bisa. Jika punya kemauan, mahasiswa mana pun dapat memberi kontribusi yang bermakna. Ada begitu banyak hal untuk ditemukan dan diuraikan
    Sayangnya, humaniora di sekolah menengah sering diperlakukan seperti latihan soal, bukan penemuan nyata. Sekarang saya menilai siswa berdasarkan seberapa banyak saya belajar dari mereka. Bukankah itu boleh saja

    • Arsitektur transformer awalnya dikembangkan untuk tugas penerjemahan, tetapi model generatif raksasa yang overfit justru menerjemahkan dengan buruk
      Bahkan sistem yang sangat sederhana seperti klasifikasi kelas kata, pencarian kamus, dan pemetaan tata bahasa bekerja lebih baik, dan kita juga bisa mendapatkan throughput per bab per detik beserta interval kepercayaannya. Jika membutuhkan alat terjemahan, lebih baik memakai sesuatu seperti Project Bergamot(https://browser.mt/), bukan AI generatif
      Saya juga sangat kesal karena humaniora di sekolah menengah diperlakukan seperti latihan, bukan penemuan nyata
    • Sejarah yang kita miliki mau tidak mau melewati bottleneck. Banyak hal terlewat, diedit, dan dilebih-lebihkan
      Kita tidak bisa benar-benar mengetahui seperti apa peristiwa 500 tahun lalu, dan kisah tentang seorang sarjana brilian yang menerjemahkan teks Yunani untuk Medici juga tidak boleh diterima begitu saja
      Jika berada pada posisi yang menggerakkan dunia seperti Medici, sejarah pastilah menjadi tuas kontrol. Kisah-kisah sangat mungkin diarahkan dengan hati-hati menuju suatu tujuan tertentu
      Sejarah sebenarnya adalah aktivitas masa kini. Ia menyediakan latar bagi masa kini, dan mengubah latar itu memiliki nilai masa kini
      Saya tidak begitu tahu bagaimana AI akan membantu membuat pemahaman kita tentang masa lalu menjadi lebih baik. Namun tampaknya ia bisa memberi para Medici modern cara untuk mengubah latar itu lebih cepat
  • Bisa saja benar bahwa insinyur yang membangun sistem AI harus berpikir secara mendalam dan kritis tentang bahasa dan budaya, serta sejarah dan filsafat teknologi
    Namun mungkin bukan dalam makna semi-akademis yang dibayangkan penulis. Alasan sistem AI gagal bukanlah karena insinyurnya kurang memiliki pengetahuan akademis tentang sejarah dan filsafat
    Bagian yang lebih penting dalam tulisan itu adalah bahwa tenaga nonteknis di bidang humaniora kini bisa menulis kode sendiri. Ketika kemampuan coding dasar, atau kemampuan apa pun, menjadi komoditas, keuntungan terbesar akan diambil oleh orang-orang yang memiliki kemampuan komplementer

    • Menurut saya “kemampuan mengajukan pertanyaan yang baik” selalu merupakan keterampilan yang bernilai
    • Generasi muda tidak sedang memaksakan diri memilih salah satu dari dua hal; mereka sudah bergerak sebagai tim multidisipliner
      Sebab, berbeda dari generasi sebelumnya, mereka mengalami laju perubahan pada tingkat yang jauh berbeda. Dalam lingkungan seperti ini, terlepas dari kualitas pelatihan, orang akan jauh lebih cepat melihat batas dirinya sendiri, dan pada akhirnya harus bergantung pada orang lain
      Tantangan besarnya adalah mengoordinasikan orang-orang yang memiliki keterampilan dan minat yang sangat berbeda, dan terus berubah, agar tetap berada dalam arus yang sama dan mendayung ke arah yang sama
    • Bisa jadi benar bahwa generasi baru sejarawan akan menganggap wajar untuk membuat dan mendistribusikan alat riset dan pendidikan mereka sendiri dengan biaya nyaris nol
      Namun mereka juga bisa menghabiskan 12 jam untuk membedakan pustaka Python palsu dan kutipan palsu hasil halusinasi LLM dari yang asli. Vibe coding lebih mirip peningkatan WYSIWYG, baik dalam sisi baik maupun buruknya, dan WYSIWYG pun pada akhirnya tidak hilang
    • Historiografi sudah mengalami momen “oh, ini masalahnya” bersama Hayden White beberapa dekade lalu. Ini contoh yang baik untuk menunjukkan underlying issue
      Pernyataan Hayden White bahwa “sejarah adalah fiksi” hingga kini tetap merupakan argumen yang rumit, bukan upaya menyangkal faktualitas penulisan sejarah seperti yang sering digambarkan
      Sebaliknya, ia menekankan sifat interpretatif penulisan sejarah dan cara para sejarawan menyusun penjelasan tentang masa lalu dengan teknik sastra dan retorika. White memandang sejarawan, seperti novelis, menggunakan struktur naratif dan perangkat gaya untuk membangun makna dari peristiwa sejarah
    • Kegagalan sistem AI biasanya muncul dari pengabaian terhadap kompleksitas dunia nyata
  • Ujian disertasi doktoral di bidang humaniora mencakup tesis tertulis dan pembelaan lisan spontan. Profesor dapat melempar pertanyaan curveball yang bagi manusia tampak tidak terkait tetapi sebetulnya dapat diperbandingkan arahnya, sehingga sulit untuk lulus dengan mudah menggunakan ChatGPT
    Saat program magister, saya pernah memecahkan masalah semantik untuk analisis yang tidak dipahami para insinyur. Mereka sangat pintar secara teknis dan juga menulis dengan baik, tetapi kesulitan ketika menyangkut persoalan bahasa. Seseorang bisa berkomunikasi dengan baik tetapi tetap tidak memahami bahasa itu sendiri
    Banyak orang di bidang AI dinilai dengan standar hal-hal yang dikuasai AI. Karena itu, jika ada kandidat yang kuat dalam pemahaman bahasa, AI mungkin tidak dapat menilai kemampuan tersebut. Kita harus menyajikan secara konkret persoalan bahasa yang perlu dihadapi AI, dan membuat manusia memahami nilainya

    • Saya rasa semua program doktoral memiliki pembelaan lisan. Selain itu, ujian kualifikasi yang mengharuskan seseorang mempresentasikan riset terbaru di bidangnya dan menjawab pertanyaan lisan juga umum
      Alasannya tetap sulit meski ada ChatGPT adalah karena pertanyaannya berbentuk seperti “Mengapa XYZ melakukan ABC setelah melihat hasil 123?” Masalahnya, pernyataan itu sendiri sering kali keliru. Bisa jadi XYZ tidak melakukan ABC, atau tidak melakukannya setelah melihat 123
      Sebagian besar LLM saat ini tampaknya akan kesulitan menjawab, dalam bidang yang bernuansa seperti ini, “Tidak, hal itu tidak terjadi, dan sebenarnya yang terjadi adalah ini”
  • Prompt sistem seperti “pertahankan keahlian dan kejujuran berbasis bukti yang paling mewakili OpenAI dan nilai-nilainya” rasanya bisa langsung dijelaskan oleh lulusan humaniora: justru karena redaksi kalimatnya sendiri, ia bisa menjadi bumerang secara katastrofis
    Jika ini adalah kisah fiksi ilmiah tentang AI tak terkendali dalam waktu dekat, alasan manusia tumbang di hadapan mesin mungkin bukan semata-mata karena kesombongan. Pemicu akhirnya bisa saja satu kalimat manis-manis-mual yang memerintahkan mesin yang terhubung ke internet untuk menatap dan meniru jiwa korporat penciptanya

    • Kalau itu sistem logika, memang begitulah yang akan terjadi. Tapi LLM bukan sistem logika, dan di situlah bagian menariknya
      LLM adalah model statistik, dan memasukkan prompt seperti itu lebih mirip memberi bobot naratif daripada tuntutan logis. Jika kata-kata ini dimasukkan dalam urutan ini, model akan lebih menjelajahi narasi yang secara statistik mungkin menyusul setelahnya. Kemungkinannya ditentukan oleh data pelatihan dan bobot yang didistribusikan ulang lewat pelatihan tambahan
      Tidak perlu terlalu khawatir bahwa kita secara teknis salah menyatakan tujuan kepada LLM. LLM tidak mengikuti objektivitas. Yang perlu dikhawatirkan justru menyampaikan nuansa keseluruhan secara keliru, dan itu tugas yang jauh lebih misterius
  • Dari pengalaman beberapa tahun sebagai guru, saya melihat LLM telah membuat lubang besar dalam struktur pendidikan AS yang ada. Lubang itu adalah bahwa sebagian besar pendidikan selama ini menganggap “produk tulisan yang dibuat tanpa pengawasan” sebagai bukti kemajuan belajar
    Sekarang LLM bisa membuat produk itu, dan sebagai efek samping mungkin juga mengguncang industri jasa penulisan bayaran
    Karena itu, pendidik harus mencari kait lain untuk menggantungkan penilaian, dan pertanyaan seperti “sebenarnya apa itu belajar” serta “bagaimana mengukur pembelajaran itu secara bermakna” menjadi lebih penting. Humaniora bisa mengatakan hal yang bermakna tentang keduanya
    Kalau sedikit bercanda dalam memprediksi, rasanya hafalan, presentasi, dan ujian lisan akan kembali. Untuk saat ini lebih sulit dimanipulasi, tetapi entah berapa lama “saat ini” akan bertahan

    • Tema inti lubang itu adalah objektivitas, dan menurut saya dampaknya jauh lebih luas daripada pendidikan
      Dengan menata pendidikan secara obsesif di sekitar pengukuran, kita selama ini mengisyaratkan bahwa yang diajarkan adalah fakta objektif. Itu selalu omong kosong, tetapi secara internal umumnya cukup konsisten untuk berfungsi. Semakin ketat penyajian pengetahuan, semakin mudah ia berpura-pura sebagai objektivitas sejati
      Segala sesuatu yang ditulis di dunia nyata bersifat subjektif. Satu-satunya cara mempelajari fakta objektif adalah menelusurinya melalui berbagai ungkapan subjektif. Siapa pun yang pernah belajar matematika tahu bahwa melihat x^2+y^2=z^2 saja tidak tiba-tiba membuat orang memahami implikasi teorema Pythagoras
      Objektivitas tidak dapat dikomputasi karena tidak dapat ditulis. Kita tidak bisa memberi komputer beberapa ungkapan subjektif tentang satu konsep lalu menyuruhnya memahami. Ini seperti masalah ambiguitas: tidak ada cara yang objektif benar untuk menghitung kalimat yang ambigu
      Karena itu kita menulis dalam bahasa pemrograman. Tata bahasa setiap bahasa pemrograman “bebas konteks”, sehingga semuanya harus didefinisikan sepenuhnya secara eksplisit. Untuk menulis kalimat yang dapat dikomputasi, konsep abstrak di kepala harus ditundukkan pada tata bahasa dan lingkungan bahasa tersebut
      Sebagian besar tulisan masyarakat dibuat dengan perangkat lunak. Maka kita secara implisit diarahkan untuk membangun konteks bersama. Jika tulisan konsisten dengan konteks tulisan orang lain, ia bisa berpura-pura objektif dan menjadi lebih dapat dikomputasi
      Interaksi sosial yang dimediasi perangkat lunak juga secara implisit dibentuk oleh struktur perangkat lunak itu. Di media sosial, percakapan yang benar-benar bebas bentuk tidak mungkin ada
      Yang menarik dari LLM adalah ia tidak mengalami masalah ini. Ia menghindarinya dengan nyaman dengan sama sekali tidak melakukan logika. Sekarang perangkat lunak menundukkan Anda bukan pada lingkungan yang ketat, melainkan pada lingkungan yang akrab. Tidak ada kebenaran, hanya nuansa; tidak ada komputasi, hanya tebakan
      Ini terasa seperti objektivitas, tetapi hanya selubung baru. Bedanya, batas-batasnya muncul di tempat yang baru dan asing
      Secara umum, saya menganggap matinya objektivitas sebagai kemajuan yang baik. Itu sudah lama ditakdirkan, dan struktur yang ketat selalu dilebih-lebihkan. Cara belajar terbaik adalah menjelajahi sebanyak mungkin sudut pandang. Manusia bisa menangani nuansa dan logika sekaligus
    • Selama lama sekali, sekolah berasumsi bahwa jika siswa menyerahkan esai, itu berarti ia telah mempelajari sesuatu
      Namun sekarang AI juga bisa menulis esai itu, jadi asumsi tersebut tidak lagi berlaku
      Pertanyaan sebenarnya adalah: jika tulisan saja tidak dapat membuktikan pembelajaran, lalu apa yang dapat membuktikannya
      Ujian lisan atau diskusi waktu nyata mungkin akan kembali. Bukan karena sempurna, melainkan karena lebih sulit dicurangi
      Dalam arti tertentu, AI bukan merusak pendidikan, melainkan mengungkap masalah yang sudah ada
    • Definisi belajar tidak berubah. Dalam salah satu catatan tertua sekalipun, ada orang yang mengeluh bahwa “teknologi baru bernama tulisan akan membuat siswa malas sehingga mereka tidak lagi mengingat apa yang telah dipelajari”
      Pendidikan akan beradaptasi
    • Porsi pendidikan AS yang mengejutkan besarnya dipakai untuk mengajari anak-anak memproduksi esai omong kosong. Tidak mengherankan jika AI membuat lubang di bagian ini
  • Saya cukup skeptis terhadap penggunaan komputer dalam pendidikan secara umum. Secara pribadi, rasanya saya tidak belajar apa pun jika tidak membaca di kertas dan menulis di margin atau di buku catatan kertas
    Sebagai programmer saya memakai layar setiap hari, tetapi untuk benar-benar mengingat hal baru, saya butuh kertas. Dalam rapat fisik atau konferensi pun saya tidak membuka laptop, melainkan mencatat di kertas
    Karena itu, kalau laptop atau tablet ikut terlibat, saya jadi ragu apakah seseorang benar-benar mempelajari sesuatu. Ini bukan komentar khusus tentang AI, hanya pengamatan pribadi yang umum

    • Itu mungkin benar untuk Anda, tetapi jelas bukan kebenaran umum
      Saya hampir tidak menulis sesuatu yang bermakna di kertas selama bertahun-tahun, dan selama itu saya jelas mempelajari hal-hal baru
    • Sepertinya ini perbedaan dalam cara kita pertama kali belajar cara belajar. Jika saya menulis di aplikasi catatan, saya tidak mengingat sebaik ketika menulis tangan, tetapi itu mungkin produk sampingan dari lama bersekolah
      Orang lain mempelajari cara mereka sendiri, dan cara itu bisa sama efektifnya
    • Sebagai bukti bahwa contoh pribadi bukanlah contoh umum, ada satu generasi penuh
    • Aplikasi belajar yang digamifikasi dalam arti luas tampaknya sangat efektif untuk latihan