SODP logo

    Bagaimana untuk mengetahui sama ada anda boleh mempercayai jawapan AI untuk soalan anda

    Baru-baru ini saya menaip soalan mudah ke dalam carian Google: Berapa banyak masa skrin yang terlalu banyak untuk remaja? Daripada memaparkan pautan, seperti yang telah dilakukan oleh Google selama bertahun-tahun,…
    Dikemas kini Pada: 21 September 2026
    Leo S. Lo

    Dicipta Oleh

    Leo S. Lo

    Perbualan

    Fakta Disemak Oleh

    Perbualan

    Leo S. Lo

    Disunting Oleh

    Leo S. Lo

    Baru-baru ini saya menaip soalan mudah ke dalam carian Google: Berapa banyak masa skrin yang terlalu banyak untuk remaja? Daripada mengemukakan pautan, seperti yang telah dilakukan oleh Google selama bertahun-tahun, ia memberi saya jawapan yang dijana AI. Ejen kecerdasan buatan memetik satu nombor, kemudian merumitkan jawapan itu, dengan menyatakan bahawa kualiti dan keseimbangan masa boleh menjadi lebih penting daripada bilangan jam, dan masa "terlalu banyak" boleh bergantung pada tidur, senaman, tuntutan sekolah dan mood remaja.

    Saya cuba carian lain: Patutkah saya mengambil aspirin setiap hari? Kali ini jawapan AI memberikan saya maklumat perubatan, memberi amaran tentang risiko dan menawarkan panduan yang lebih disesuaikan jika saya memberikan umur dan sejarah perubatan saya.

    Ini adalah balasan yang baik. Apa yang menarik minat saya ialah ia adalah pelbagai jenis balasan.

    Perdebatan tentang jawapan AI telah tertumpu pada ketepatan: Adakah sistem mendapat jawapan yang betul? Itu penting, tetapi ketepatan hanyalah satu ujian. Setiap jenis jawapan memerlukan pengguna untuk menilai sesuatu yang berbeza.

    Saya mendapati ia berguna untuk menyusun jawapan AI kepada "tipografi jawapan" yang terdiri daripada empat jenis umum: fakta, interpretatif, konstruktif dan strategik. Dakwaan fakta selalunya boleh disemak terhadap sumber. Tafsiran boleh jadi tepat dan masih mencerminkan pilihan tentang bukti yang penting. Tafsiran boleh diberi alasan yang baik dan masih salah bagi orang yang menerimanya. Dokumen strategik yang ditulis dengan indah mungkin tidak benar. Namun, AI membentangkan keempat-empat jenis jawapan dalam bentuk yang sama lancar dan berwibawa; perbezaannya mudah terlepas pandang.

    Saya pustakawan universiti dan dekan perpustakaan di Universiti Virginia yang menerajui usaha kebangsaan untuk membangunkan kecekapan AI untuk profesional perpustakaan, dan saya banyak berunding tentang literasi AI. Saya mula-mula mencadangkan tipografi dalam Journal of Academic Librarianship.

    Empat kategori tersebut bukan kotak kedap udara. Respons daripada ejen AI boleh mencerminkan beberapa jenis. Walau bagaimanapun, saya menerangkan setiap jenis jawapan di bawah dan menawarkan panduan untuk menentukan sama ada balasan sedia untuk digunakan atau memerlukan lebih banyak penyiasatan.

    Jawapan manakah yang Google berikan kepada anda?

    Jawapan berdasarkan fakta membuat dakwaan yang, pada prinsipnya, boleh disemak dengan bukti. Bilakah Universiti Virginia diasaskan? Apakah simbol kimia bagi emas?

    Untuk menentukan sama ada jawapan berdasarkan fakta cukup kukuh untuk anda gunakan, sahkan dakwaan tersebut terhadap sumber yang sesuai. Jika jawapan tersebut memetik sumber, ikuti pautan tersebut dan bukannya hanya menganggap jawapan itu sendiri sebagai bukti.

    Jawapan interpretatif dibina berdasarkan bukti, tetapi tiada satu pun kesimpulan yang boleh diambil. Berapa banyak masa di hadapan skrin yang terlalu banyak untuk seorang remaja? Adakah kerja jarak jauh meningkatkan produktiviti? Jawapannya bergantung pada bukti yang disertakan, apa yang ditinggalkan dan bagaimana perselisihan faham difahami.

    Jawapan awal Google kepada soalan masa skrin saya menunjukkan bahawa dua jam adalah had untuk remaja. Kemudian ia menyatakan bahawa panduan pediatrik lebih memberi penekanan kepada kualiti dan konteks penggunaan skrin berbanding waktu biasa. Akademi Pediatrik Amerika mengatakan tiada jumlah yang disyorkan untuk remaja dan menekankan jenis penggunaan skrin dan aktiviti yang mungkin digantikannya. Soalan yang kelihatan berangka ternyata memerlukan tafsiran.

    Untuk menilai jawapan interpretatif, lakukan lebih daripada sekadar menyemak fakta. Tanyakan kepada diri sendiri bukti apa yang ditekankan oleh sistem, apa yang ditinggalkan dan sama ada wujud tafsiran lain yang boleh dipertahankan. Soalan susulan yang berguna untuk dikemukakan kepada enjin carian ialah: "Apakah bukti terkuat untuk kesimpulan yang berbeza?"

    Blok teks pada skrin telefon pintar
    Jawapan interpretatif seperti respons ini daripada Google AI menimbang bukti dan mempertimbangkan perbezaan pendapat. Jaap Arriens/NurPhoto melalui Getty Images

    Jawapan yang membina dibuat dan bukannya ditemui. Minta AI untuk mendraf surat lamaran, menulis eulogi, mencadangkan rancangan pengajaran atau menyusun semula perenggan – tiada satu pun hasil yang betul.

    Anda boleh menilai respons dengan mempertimbangkan tujuan, khalayak dan suara. Eulogi boleh jadi sempurna dari segi tatabahasa tetapi masih tidak kedengaran seperti orang yang menyampaikannya, atau ia mungkin tidak begitu jelas kepada ahli keluarga yang mendengarnya. Ia juga mungkin tidak dapat menggambarkan si mati dengan baik. Pertimbangkan kesan seperti ini semasa anda membaca.

    Soalan strategik menanyakan apa yang perlu dilakukan. Patutkah saya mengambil aspirin setiap hari? Patutkah saya membeli rumah itu? Jawapannya menggabungkan maklumat dengan pertimbangan tentang matlamat, risiko, pertimbangan dan keadaan peribadi.

    Carian aspirin saya menunjukkan mengapa konteks penting. Google memberi amaran tentang risiko, memberitahu saya untuk berunding dengan profesional perubatan dan menawarkan maklumat yang lebih disesuaikan jika saya memberikan umur, sejarah kardiovaskular dan risiko pendarahan saya. Amaran itu sepadan dengan panduan Pasukan Petugas Perkhidmatan Pencegahan AS. Ia mengatakan keputusan untuk memulakan aspirin dos rendah untuk pencegahan serangan jantung dan strok harus disesuaikan secara individu dan mempertimbangkan manfaat kardiovaskular terhadap risiko pendarahan.

    Untuk jawapan strategik, tanyakan apa yang perlu diketahui oleh sistem sebelum nasihatnya boleh digunakan secara munasabah untuk anda secara individu. Pertimbangkan kepentingannya, alternatifnya dan sama ada orang yang berkelayakan harus dilibatkan. Untuk soalan aspirin, susulan yang berguna ialah: "Butiran apakah tentang umur, sejarah perubatan atau risiko pendarahan saya yang boleh mengubah nasihat ini? Apakah yang perlu saya bincangkan dengan doktor saya sebelum membuat keputusan?" Keputusan muktamad tetap menjadi milik anda kerana anda adalah orang yang perlu menanggung hasilnya.

    Soalan pertama selepas jawapan

    Soalan saya bermula sebagai carian Google biasa. Saya tidak membuka chatbot. Respons yang dijana AI tiba begitu sahaja, dan pautan telah dilampirkan.

    Respons yang diberikan adalah berguna. Google menambah konteks, mengakui komplikasi dan menawarkan panduan yang disesuaikan jika saya memberikan maklumat tambahan. Walau bagaimanapun, dalam setiap respons, jenis jawapan boleh berubah. Melaporkan apa yang dinyatakan dalam garis panduan perubatan adalah berbeza daripada menentukan bagaimana ia terpakai kepada orang tertentu. Respons yang fasih boleh beralih antara jenis jawapan tersebut tanpa perubahan suara yang ketara.

    Sebagai pengguna, cuba kenal pasti jenis kerja intelektual yang dilakukan oleh ejen AI untuk respons yang anda terima. Pertimbangkan sama ada tafsiran itu meyakinkan atau nasihat itu sesuai dengan keadaan anda.

    Sebelum bertanya sama ada jawapan AI betul, tanya soalan yang lebih asas: Apakah jenis jawapan ini? Jenis jawapan ini akan memberitahu anda apa yang perlu dilakukan seterusnya.

    Leo S. Lo, Dekan, Universiti Virginia

    Artikel ini diterbitkan semula daripada The Conversation di bawah lesen Creative Commons. Baca artikel asal.

    0
    Saya ingin berkongsi pendapat anda, sila komen.x
    ()
    x