ຄຳຕອບສັ້ນໆ: AI ບໍ່ໜ້າເຊື່ອຖືໃນຖານະເປັນລັກສະນະ: ມັນຂຶ້ນກັບໜ້າວຽກ, ວົງຈອນການດຶງຂໍ້ມູນຄືນ, ແລະ ມະນຸດທີ່ຍັງຢູ່ໃນຈຸດເຊື່ອມຕໍ່. ເວລາເຮັດວຽກແມ່ນຂຶ້ນກັບວ່າຈຸດສຸດທ້າຍໄດ້ຮັບຄຳຕອບຫຼືບໍ່; ຄວາມຈິງ ແມ່ນກ່ຽວກັບວ່າຄຳຕອບແມ່ນແທ້ຫຼືບໍ່. ໃຊ້ມັນເມື່ອການພາດແມ່ນລາຄາຖືກ ຫຼື ສາມາດຈັບໄດ້; ຊ້າລົງເມື່ອການພາດແມ່ນແພງ.
ບົດຮຽນຫຼັກ:
ຄວາມຮັບຜິດຊອບ: ບອກຊື່ຜູ້ທີ່ທົບທວນຄືນ, ໃຜສາມາດຢຸດມັນໄດ້, ແລະໃຜທີ່ມີບັນຫາ.
ຄວາມໂປ່ງໃສ: ກວດກາຊິ້ນສ່ວນທີ່ຖືກດຶງມາ, ຫຼື ທ່ານຍັງຢູ່ໃນໝອກ.
ການກວດສອບ: ບັນທຶກການກະຕຸ້ນ, ດຶງເອົາຊິ້ນສ່ວນຕ່າງໆ, ແລະ ການສົ່ງເພື່ອໃຫ້ສາມາດຕິດຕາມການພາດໄດ້.
ການຕ້ານທານການໃຊ້ໃນທາງທີ່ຜິດ: ລົ້ມເຫລວໃນການປິດຄໍາຖາມກ່ຽວກັບເງິນ; ຢ່າປະດິດຕົວເລກ, ປ່ອງຢ້ຽມ ຫຼື ນະໂຍບາຍ.
ຜົນໄດ້ຮັບທີ່ເປັນຕົວຢ່າງ: ໃຫ້ຖືວ່າການທົດສອບທີ່ມີ 20 ຄຳຖາມເປັນຄືກັບແຜນທີ່, ບໍ່ແມ່ນຫຼັກຖານ 95%.

ບົດຄວາມທີ່ທ່ານອາດຈະຢາກອ່ານຫຼັງຈາກບົດຄວາມນີ້:
🔗 ວິທີການນຳໃຊ້ AI ໃນຊີວິດປະຈຳວັນ
ຄົ້ນພົບວິທີການທີ່ໃຊ້ໄດ້ຈິງ AI ສາມາດເຮັດໃຫ້ວຽກງານ ແລະ ກິດຈະວັດປະຈຳວັນງ່າຍຂຶ້ນ.
🔗 ວິທີການນຳໃຊ້ AI ໃນບ່ອນເຮັດວຽກ
ຮຽນຮູ້ວິທີການປະຕິບັດໄດ້ຈິງເພື່ອປັບປຸງຜົນຜະລິດ ແລະ ປະສິດທິພາບດ້ວຍ AI.
🔗 AI ສາມາດຄິດດ້ວຍຕົວມັນເອງໄດ້ບໍ?
ສຳຫຼວດວ່າປັນຍາປະດິດສາມາດຄິດຢ່າງເປັນອິດສະຫຼະ ແລະ ໃຊ້ເຫດຜົນໄດ້ແທ້ຫຼືບໍ່.
🔗 ປະເພດຂອງ AI ມີຫຍັງແດ່?
ເຂົ້າໃຈປະເພດ, ຄວາມສາມາດ ແລະ ຄວາມແຕກຕ່າງທີ່ສຳຄັນຂອງ AI.
"ໜ້າເຊື່ອຖື" ໝາຍຄວາມວ່າແນວໃດເມື່ອເຄື່ອງຈັກເປັນນົກແກ້ວທາງສະຖິຕິ
ຄວາມໜ້າເຊື່ອຖື, ໃນການປາກເວົ້າປະຈຳວັນ, ໝາຍຄວາມວ່າເຈົ້າສາມາດເພິ່ງພາອາໄສບາງສິ່ງບາງຢ່າງໄດ້.
ດ້ວຍລະບົບອັດຕະໂນມັດທີ່ເວົ້າໄດ້, ກອງຄຸນສົມບັດທີ່ແຕກຕ່າງກັນຈະຊ່ອນຢູ່ພາຍໃຕ້ຄຳດຽວ. ຄວາມຈິງ. ຄວາມສອດຄ່ອງ. ການປັບທຽບ - ບໍ່ວ່າຄວາມໝັ້ນໃຈຂອງຮູບແບບຈະກົງກັບໂອກາດທີ່ມັນຖືກຕ້ອງ, ຫຼືວ່າມັນພຽງແຕ່... ຟັງແລ້ວແນ່ນອນ. ຄວາມປອດໄພ. ເວລາເຮັດວຽກ. ຄວາມອ່ອນໄຫວທີ່ວ່ອງໄວ. ພຶດຕິກຳໃນກໍລະນີທີ່ມີຂອບ. ພຶດຕິກຳຫຼັງຈາກການປ່ຽນແປງການແຈກຢາຍ, ເມື່ອໂລກທີ່ມີຊີວິດບໍ່ແມ່ນໂລກການຝຶກອົບຮົມ. ບໍ່ມີອັນໃດລົ້ມເຫຼວຮ່ວມກັນ. ນັ້ນແມ່ນສ່ວນທີ່ຄົນເຮົາຂ້າມໄປ.
chatbot ສາມາດ "ເຮັດວຽກ" ໄດ້ຕະຫຼອດອາທິດ ແລະ ຍັງຜິດພາດໃນຕອນບ່າຍວັນອັງຄານ. ຜູ້ຮ່ວມພັດທະນາການຂຽນໂປຣແກຣມສາມາດເຮັດວຽກໄດ້ດີໃນແບບແຜນເບື້ອງຕົ້ນ ແລະ ຫຼັງຈາກນັ້ນກໍ່ຫຼອກລວງ API ທີ່ມີລັກສະນະຄ້າຍຄືກັບ API ທີ່ແທ້ຈິງ. ຄຳປຽບທຽບທີ່ຜູ້ຄົນຢາກໄດ້ຄື "ເພື່ອນຮ່ວມງານລະດັບນ້ອຍ". ມັນເປັນຄຳປຽບທຽບທີ່ບໍ່ສົມບູນແບບ - ນັກສຶກສາລະດັບນ້ອຍຮູ້ສຶກອາຍ - ແຕ່ມັນໃກ້ຄຽງກັບ "oracle".
ການທົດສອບສົດແມ່ນ ໜ້າເຊື່ອຖືໄດ້ໃນສິ່ງທີ່, ສຳລັບໃຜ, ກັບສິ່ງທີ່ວົນອ້ອມມັນ. ຖ້າບໍ່ດັ່ງນັ້ນ, ທ່ານກຳລັງໃຫ້ຄະແນນເຄື່ອງປັ່ນກ່ຽວກັບວ່າມັນສາມາດເກັບພາສີໄດ້ຫຼືບໍ່.
ເວລາເຮັດວຽກບໍ່ແມ່ນຄວາມຈິງ - ສອງປະເພດທີ່ແຕກຕ່າງກັນຂອງ "ຄວາມໜ້າເຊື່ອຖື"
ຄົນທີ່ເປັນ Ops ແລະຄົນທີ່ເປັນຄວາມຈິງໃຊ້ຄຳດຽວກັນ ແລະເວົ້າຜ່ານກັນ.
ເວລາເຮັດວຽກແມ່ນ "ຄຳຕອບຂອງຈຸດສຸດທ້າຍ" ຫຼືບໍ່. ຄວາມຈິງແມ່ນ "ຄຳຕອບແມ່ນແນວນັ້ນ". ການຄຸ້ມຄອງໃຫ້ຄວາມສຳຄັນທັງສອງຢ່າງ, ແລະຄວາມສ່ຽງຂອງແບບຈຳລອງແມ່ນຢູ່ໃນຊ່ອງຫວ່າງທີ່ບໍ່ດີ. ທ່ານສາມາດມີການບໍລິການທີ່ບໍ່ເຄີຍກະພິບຕາ ແລະຍັງສົ່ງຄຳຕົວະທີ່ຄ່ອງແຄ້ວເຂົ້າໄປໃນປີ້ຂອງລູກຄ້າ. ໜ້າເຊື່ອຖືໃນຄວາມໝາຍຂອງ SRE. ບໍ່ໜ້າເຊື່ອຖືໃນຄວາມໝາຍຂອງ "ກະລຸນາຢ່າປະດິດນະໂຍບາຍຄືນເງິນ".
ຂ້ອຍຄິດວ່າອັນນີ້ຂຽນໄວ້ຢ່າງຈະແຈ້ງແລ້ວ. ມັນບໍ່ຊັດເຈນຕອນ 4 ໂມງແລງເມື່ອຄຳຕອບໄວ ແລະ ຄິວກໍ່ໃຫຍ່ໂຕມະໂຫລານ. ຄວາມໄວຮູ້ສຶກຄືກັບຄວາມສາມາດ. ຄວາມຊ້າເຄີຍໝາຍຄວາມວ່າມີຄົນຄິດ. ດຽວນີ້ຄວາມໄວແມ່ນສັນຍານວ່າບໍ່ມີໃຜຄິດແບບນັ້ນ.
ຄວາມປອດໄພແມ່ນອີກແກນໜຶ່ງ. ຮູບແບບທີ່ປະຕິເສດການ jailbreak ທີ່ບໍ່ດີແມ່ນ "ໜ້າເຊື່ອຖື" ໃນລັກສະນະການປະເມີນຄວາມປອດໄພ ແລະ ອາດຈະຍັງເຮັດໃຫ້ບົດສະຫຼຸບຂອງບັນທຶກຂອງທ່ານເອງເສຍຫາຍໄດ້.
ການເວົ້າຄ່ອງແຄ້ວ ແລະ ຜິດພາດ ຮ້າຍແຮງກວ່າການເວົ້າບໍ່ຊັດເຈນ ແລະ ກົງໄປກົງມາ
ນີ້ແມ່ນບັນຫາຄວາມໝັ້ນໃຈ, ແລະມັນຄືບັນຫາທີ່ສຳຄັນທີ່ສຸດ.
ຄວາມຖືກຕ້ອງ ແລະ ຄວາມຄ່ອງແຄ້ວໄດ້ຖືກແຍກອອກຈາກກັນ ແລະ ຄວາມຄ່ອງແຄ້ວຮັກສາໄວ້ໄດ້. ປະລິນຍາໂທສາຂາວິສະວະກຳສາດ (LLM) ຈະໃຫ້ຈັງຫວະແກ່ເຈົ້າ, ການປ້ອງກັນຄວາມສ່ຽງໃນສະຖານທີ່ທີ່ຖືກຕ້ອງ, ບາງທີອາດເປັນຮູບແບບການອ້າງອີງປອມແຕ່ສວຍງາມ. ສະໝອງຂອງເຈົ້າອ່ານວ່າ "ຄົນຜູ້ນີ້ຮູ້". ຍົກເວັ້ນວ່າມັນບໍ່ແມ່ນຄົນ, ແລະ ການວັດແທກມັກຈະບໍ່ດີ - ຄວາມໝັ້ນໃຈສູງ, ຄວາມຈິງທີ່ປານກາງ, ສົ່ງຄືກັບຄຳປາໄສຫຼັກ.
ຄຳຕອບທີ່ຜິດ ແລະ ງຸ່ມງ່າມເຮັດໃຫ້ເຈົ້າສົງໄສ. ຄຳຕອບທີ່ຜິດຢ່າງຄ່ອງແຄ້ວເຮັດໃຫ້ເຈົ້າຢຸດກວດສອບ. ນັ້ນບໍ່ແມ່ນຄວາມແຕກຕ່າງເລັກນ້ອຍ; ມັນເປັນເລື່ອງທັງໝົດໃນປະໂຫຍກທີ່ໜ້າລັງກຽດເລັກນ້ອຍ.
ອະຄະຕິກໍ່ມີຢູ່ໃນນັ້ນຄືກັນ, ບໍ່ແມ່ນສະເໝີໄປເປັນການດູຖູກ, ແຕ່ເປັນຄ່າເລີ່ມຕົ້ນກ່ຽວກັບວ່າໃຜຢູ່ໃນຫ້ອງ ແລະ ລົດຊາດໃດຂອງພາສາອັງກິດທີ່ຖືວ່າເປັນກາງ. ຜູ້ຄົນຖືກຫຼອກລວງເພາະວ່າພາສາແມ່ນການໂຕ້ຕອບຄວາມໄວ້ວາງໃຈທີ່ເກົ່າແກ່ທີ່ສຸດຂອງພວກເຮົາ. ຖ້າມັນເວົ້າຄືກັບບົດສະຫຼຸບສັ້ນໆ, ພວກເຮົາປະຕິບັດຕໍ່ມັນຄືກັບບົດສະຫຼຸບສັ້ນໆ. ຂ້ອຍຕັ້ງໃຈທີ່ຈະເຍາະເຍີ້ຍກ່ຽວກັບເລື່ອງນັ້ນຫຼາຍຂຶ້ນ. ຫຼັງຈາກນັ້ນ, ຂ້ອຍໄດ້ອ່ານບົດສະຫຼຸບທີ່ໜ້າເບື່ອ ແລະ ບ່າໄຫລ່ຂອງຂ້ອຍກໍ່ຫຼຸດລົງ. ເມື່ອຍ່າງເຂົ້າໄປໃນກອງປະຊຸມ, ບົດສະຫຼຸບເບິ່ງຄືວ່າສຳເລັດແລ້ວ. ປະໂຫຍກນັ້ນເຮັດວຽກຫຼາຍເກີນໄປ, ແລະ ຍັງຄົງ: ນັ້ນແມ່ນວິທີທີ່ຜູ້ພາດເຂົ້າໄປໃນກະດານສົນທະນາ.
ຄວາມໜ້າເຊື່ອຖືຕາມສະຖານະການ, ບໍ່ແມ່ນຕາມຍີ່ຫໍ້
ຍີ່ຫໍ້ຕ່າງໆເປັນສິ່ງທີ່ລົບກວນຄວາມສົນໃຈ. ການປຽບທຽບທີ່ຫາມາໄດ້ຄືວຽກ. ການຜິດຖຽງກັນຈະໂຕ້ຖຽງກັນ. ນັ້ນກໍ່ບໍ່ເປັນຫຍັງ.
| ກໍລະນີການໃຊ້ | ມັນມັກຈະລົ້ມເຫຼວແນວໃດ | ເມື່ອມັນ "ດີພໍ" | ສິ່ງທີ່ມະນຸດຍັງຕ້ອງເຮັດ | ເປັນຫຍັງຄົນເຮົາຈຶ່ງຖືກຫຼອກລວງ |
|---|---|---|---|---|
| ການຮ່າງ/ສະຫຼຸບ | ຍົກເລີກຂໍ້ຍົກເວັ້ນ; ອັບເກຣດບາງທີໃຫ້ເປັນສິ່ງຈຳເປັນ | ຂໍ້ຄວາມທຳອິດທີ່ເຈົ້າຮູ້ແລ້ວ | ກວດສອບຊື່, ຕົວເລກ, ເສັ້ນທີ່ຈະເຈັບ | ຟັງຄືກັບເຈົ້າ. ສົ່ງ. |
| ຖາມ-ຕອບ ແບບຄົ້ນຫາ | ຄຳຕອບກ່ຽວກັບໝອກ; ການຄົ້ນຫາທີ່ເກືອບພາດຖືກຂຽນເປັນຄວາມຈິງ | ການວາງທິດທາງ, ບໍ່ແມ່ນຄຳສຸດທ້າຍ | ເປີດແຫຼ່ງຂໍ້ມູນ ຫຼື ເຈົ້າພຽງແຕ່ມີຄວາມຄິດເທົ່ານັ້ນ | ສຽງດຽວກັນສຳລັບສິ່ງທີ່ຖືກດຶງຄືນ ແລະ ສິ່ງທີ່ຖືກປະດິດຂຶ້ນ |
| ການຊ່ວຍເຫຼືອດ້ານລະຫັດ | APIs ທີ່ປະດິດຂຶ້ນ; ການທົດສອບທີ່ຢືນຢັນຂໍ້ບົກພ່ອງ | ແຜ່ນເຫຼັກ, ກາວ, "ອະທິບາຍຄວາມຜິດພາດນີ້" | ແລ່ນມັນ. ອ່ານຄວາມແຕກຕ່າງ. (ຂໍອະໄພ, ຂໍອະໄພ.) | ແບບເຮືອນ. ການທົດສອບທີ່ເບິ່ງຄືສີຂຽວ. |
| ການສະໜັບສະໜູນລູກຄ້າ | ນະໂຍບາຍທີ່ຖືກປະດິດຂຶ້ນ; ບໍ່ຖືກຕ້ອງທີ່ສຸພາບ | ຮ່າງພາຍໃນນະໂຍບາຍທີ່ເຂັ້ມງວດ | ເປັນເຈົ້າຂອງເງິນ ແລະ ຄວາມໄວ້ວາງໃຈ | ໄວ + ໃຈດີ. ບໍ່ມີໃຜກວດສອບຂໍ້ຄວາມທີຫ້າ. |
| ຄຳແນະນຳທາງການແພດ / ກົດໝາຍທີ່ກ່ຽວຂ້ອງ | ຄ່ອງແຄ້ວ, ມີໂຄງສ້າງ, ໝັ້ນໃຈໃນໄພພິບັດ | ເກືອບບໍ່ເຄີຍເປັນຜະລິດຕະພັນ | ຈົ່ງເປັນມືອາຊີບ. ນາງແບບແມ່ນເລື່ອງໄຮ້ສາລະ. ຖ້າມັນຟັງແລ້ວຮຸນແຮງ, ກໍ່ດີ. | ການສົນທະນາຄືກັບການເວົ້າສັ້ນໆ. |
| ການໃຫ້ຄະແນນ / ການຈັດອັນດັບ | ຄຸນສົມບັດຂອງຕົວແທນ; ການດຣິຟ; ກໍລະນີຂອບຈົມ | ການຄັດເລືອກທີ່ທ່ານຈະຍົກເລີກ | ກວດສອບຫາງຢ່າງລະມັດລະວັງ | ຕົວເລກຮູ້ສຶກວ່າເປັນຜູ້ໃຫຍ່. ແຜງຄວບຄຸມຮູ້ສຶກຄືກັບການປົກຄອງ. ພວກມັນບໍ່ໄດ້ຢູ່ດ້ວຍຕົວຂອງມັນເອງ. |
| ການສ້າງຮູບພາບ | ມື, ແຂນສອກເກີນ, ສິ່ງເສດເຫຼືອແບບແຜນ | Moodboards, ການແຂ່ງຂັນທີ່ໃຊ້ແລ້ວຖິ້ມ - ບໍ່ແມ່ນຫຼັກຖານ | ເບິ່ງສອງເທື່ອ, ບໍ່ພຽງແຕ່ມີຄວາມໝາຍເທົ່ານັ້ນ | Pretty ປິດຄວາມສົງໄສລົງ |
| ຕົວແທນເອກະລາດ | ການເອີ້ນເຄື່ອງມືທີ່ໝັ້ນໃຈ; ຄວາມຜິດພາດທີ່ເຮັດໃຫ້ເກີດຄວາມຂັດແຍ້ງກັນ | ວົງແຫວນແຄບທີ່ມີສະວິດຄວບຄຸມ | ຍຶດຕິດກັບເບັດ. ປິດຝາສິ່ງທີ່ມັນສາມາດແຕະຕ້ອງໄດ້. | ແຜນການທີ່ມີຕົວເລກເບິ່ງຄືວ່າມີຄວາມສາມາດ. ສ່ວນຫຼາຍແລ້ວມັນແມ່ນລາຍການທີ່ຕ້ອງເຮັດທີ່ມີມໍເຕີ. |
ເຖິງຢ່າງໃດກໍ່ຕາມ. ຖ້າເຄື່ອງມືທີ່ທ່ານມັກມີຄວາມຊຳນານໃນການຮັບລົມ ແລະ ທ່ານຈັບຕົວເອງໄດ້ວ່າກຳລັງຂໍຄວາມສະດວກສະບາຍທີ່ຖືກຕ້ອງຕາມກົດໝາຍໃນເວລາທ່ຽງຄືນ, ນັ້ນບໍ່ແມ່ນການຍົກລະດັບ. ນັ້ນແມ່ນແຜນທີ່ທີ່ບອກວ່າທ່ານຍ່າງໜີຈາກມັນ.
ພາບຫຼອນ, ການລ່ອງລອຍ, ແລະ ຄວາມຜິດພາດແບບງຽບໆ
ອາການຫຼອນ ໄດ້ຮັບຫົວຂໍ້ຂ່າວເພາະມັນເຜັດ: ປຶ້ມທີ່ບໍ່ມີຢູ່ຈິງ, ໜ້າທີ່ທີ່ບໍ່ເຄີຍຖືກສົ່ງອອກໄປ, ຂໍ້ກຳນົດນະໂຍບາຍທີ່ມີຕົວເລກທີ່ຮູ້ສຶກວ່າເປັນທາງການ.
ການດຣິຟບໍ່ມີຮູບແບບໜັງຫຼາຍ. ໂລກເຄື່ອນທີ່. ສິ່ງທີ່ເຫຼືອຢູ່ຂອງຕົວແບບຍັງຄົງຢູ່. ເຈົ້າຖາມຄຳຖາມທີ່ຕ້ອງການສະພາບການໃໝ່ ແລະ ເຈົ້າຈະໄດ້ຮັບຄຳຕອບທີ່ມີການຈັດລຽງຢ່າງດີຈາກສະພາບອາກາດກ່ອນໜ້ານີ້. ຂ້ອຍເກືອບຈະຂຽນວ່າ "ຈາກຍຸກອື່ນ" ຢູ່ທີ່ນັ້ນ, ເຊິ່ງເປັນການເວົ້າເກີນຈິງທີ່ຫົວຂໍ້ນີ້ເຊື້ອເຊີນ. ມັນບໍ່ແມ່ນຍຸກອື່ນ. ມັນບໍ່ແມ່ນດຽວນີ້.
ຄວາມຜິດພາດທີ່ງຽບໆແມ່ນສິ່ງທີ່ຂ້ອຍສົນໃຈຫຼາຍກວ່າ. ບົດສະຫຼຸບທີ່ຕັດຂໍ້ຍົກເວັ້ນ. ຄຳເວົ້າທີ່ຍົກລະດັບຄຳວ່າ "ອາດຈະ" ໃຫ້ກາຍເປັນ "ສິ່ງຈຳເປັນ". ຂໍ້ເທັດຈິງສາມາດ "ດີທາງດ້ານເຕັກນິກ" ໃນຂະນະທີ່ຄວາມໝາຍໄດ້ຫຼຸດລົງ.
ການມີຄວາມອ່ອນໄຫວຢ່າງວ່ອງໄວເຮັດໃຫ້ເລື່ອງນີ້ຮ້າຍແຮງຂຶ້ນ. ປ່ຽນການຫໍ່ຫຸ້ມ ແລະ "ຂໍ້ເທັດຈິງ" ທີ່ສ່ອງແສງ. ຖາມໃນຖານະຜູ້ສົງໄສ, ຮັບເອົາການປ້ອງກັນຄວາມສ່ຽງ. ຖາມໃນຖານະນາຍຈ້າງທີ່ຮີບຮ້ອນ, ຮັບເອົາການຮຽກຮ້ອງທີ່ວ່ອງໄວ. ຖ້າການປະເມີນຜົນຂອງເຈົ້າໃຊ້ພຽງແຕ່ຊຸດດຽວ, ການປະເມີນຜົນຂອງເຈົ້າກໍ່ເປັນການຕົວະໜ້ອຍໜຶ່ງ. ຂໍໂທດ.
ການ Jailbreak ຍັງຄົງຢູ່ໃນຂອບເຂດ, ແລະຂ້ອຍບໍ່ຕ້ອງການຮູບເງົາການລັກຂະໂມຍ. ຖ້າລະບົບສາມາດຖືກເວົ້າໃຫ້ປະຖິ້ມມາລະຍາດຂອງມັນໄດ້, ຄວາມໜ້າເຊື່ອຖືບໍ່ພຽງແຕ່ກ່ຽວກັບຄວາມຈິງເທົ່ານັ້ນ; ມັນຍັງຂຶ້ນກັບວ່າຮົ້ວປ້ອງກັນແມ່ນວົງແຫວນຫຼືໂປສເຕີ.
ສ່ວນທີ່ເຫຼືອຈາກການຝຶກຊ້ອມ, ຄວາມຮູ້ເກົ່າ, ແລະ ເປັນຫຍັງການຝຶກຝົນພື້ນຖານຈຶ່ງບໍ່ແມ່ນໄມ້ຄາຖາ
ຮູບແບບການສ້າງແບບຈຳລອງແມ່ນໄດ້ຮັບການຝຶກອົບຮົມຢູ່ເທິງ heap, ຈາກນັ້ນຊີ້ໄປທີ່ວັນອັງຄານຂອງເຈົ້າ. ການດຶງຂໍ້ມູນຄືນແມ່ນຄວາມພະຍາຍາມຂອງຜູ້ໃຫຍ່ທີ່ຈະເຊື່ອມຕໍ່ປະຈຸບັນໃສ່ heap ນັ້ນ. ການຕໍ່ສາຍດິນໝາຍຄວາມວ່າ "ຕອບຈາກອັນນີ້, ບໍ່ແມ່ນມາຈາກໝອກ". ເມື່ອມັນລົ້ມເຫຼວ, ມັນຈະລົ້ມເຫຼວຢ່າງສຸພາບ.
ຄວາມລົ້ມເຫຼວແບບຄລາສສິກ: ໝາຄົ້ນເອກະສານດຶງເອົາເອກະສານທີ່ເກືອບພາດ. ເຄື່ອງສ້າງຈະຂຽນຜ່ານມັນດ້ວຍຄວາມສະຫງົບທັງໝົດ. ເຈົ້າເຫັນວັດຖຸທີ່ມີຮູບຮ່າງຄ້າຍຄືແຫຼ່ງຂໍ້ມູນ ແລະ ສະຕິປັນຍາການກວດສອບຂອງເຈົ້າກໍ່ຢຸດເຮັດວຽກ. ຂ້ອຍເຮັດແບບນີ້. ເຈົ້າອາດຈະເຮັດແບບນີ້. ແນວຄວາມຄິດການອ້າງອີງຖືກຕ້ອງ; ການຈັດຕັ້ງປະຕິບັດແມ່ນດີເທົ່າກັບການຕີເທົ່ານັ້ນ.
ຄວາມຮູ້ທີ່ລ້າສະໄໝແມ່ນການຮົ່ວໄຫຼອີກຢ່າງໜຶ່ງ. ວຽກງານບາງຢ່າງຕ້ອງການສະພາບຕົວຈິງ - ລາຄາ, ສິນຄ້າຄົງຄັງ, ຖ້ອຍຄຳໃນປະຈຸບັນຂອງນະໂຍບາຍ. ວຽກງານບາງຢ່າງຕ້ອງການທັກສະທີ່ໝັ້ນຄົງ, ເຊັ່ນວິທີການຈັດໂຄງສ້າງບົດບັນທຶກ. ປະສົມປະສານສິ່ງເຫຼົ່ານັ້ນເຂົ້າກັນ ແລະ ທ່ານຈະໄດ້ຮັບຄຳຕອບທີ່ແນ່ນອນກ່ຽວກັບໂລກທີ່ໄດ້ເຄື່ອນຍ້າຍໄປແລ້ວ. ການປ່ຽນແປງການແຈກຢາຍແມ່ນຊື່ທີ່ຜູ້ໃຫຍ່ເອີ້ນວ່າ: ການແຈກຢາຍຕົວຈິງບໍ່ແມ່ນການແຈກຢາຍການຝຶກອົບຮົມ, ແລະ ກໍລະນີຂອບແມ່ນຢູ່ໃນຊ່ອງຫວ່າງ.
ອີກຢ່າງໜຶ່ງ, ເວົ້າດ້ວຍເຄື່ອງໝາຍຂີດກາງທີ່ບໍ່ຖືກຕ້ອງ ເພາະວ່ານັ້ນແມ່ນວິທີທີ່ບັນທຶກຂອງຂ້ອຍເບິ່ງ: ການຕໍ່ພື້ນດິນແມ່ນພື້ນ - ບໍ່ແມ່ນຮາໂລ. ຖ້າທ່ານບໍ່ສາມາດກວດກາຊິ້ນສ່ວນທີ່ດຶງມາໄດ້, ທ່ານຍັງຢູ່ໃນໝອກ, ພຽງແຕ່ມີແສງສະຫວ່າງທີ່ດີກວ່າ.
ລະຄອນປະເມີນຜົນ: ເປັນຫຍັງການສາທິດຈຶ່ງເປັນການທົດສອບທີ່ໜ້າຢ້ານ
ການສາທິດກຳລັງໄດ້ຮັບຄວາມນິຍົມ. ມາດຕະຖານແມ່ນເປີດເຜີຍຫຼາຍຂຶ້ນ, ແລະຍັງບໍ່ແມ່ນໜ້າທີ່ຂອງເຈົ້າ.
ການກະຕຸ້ນທີ່ສະອາດ ແລະ ໜ້າວຽກທີ່ຕົວແບບໄດ້ເຫັນພີ່ນ້ອງຫຼາຍພັນຄົນ - ແນ່ນອນວ່າມັນເບິ່ງຄືວ່າຄົມຊັດ. ການປະເມີນຜົນທີ່ວັດແທກໄດ້ພຽງແຕ່ການວັດແທກລະຄອນເວທີ. ຂັ້ນຕອນການເຮັດວຽກສົດມີການວາງທີ່ສັບສົນ, ໄຟລ໌ທີ່ຫາຍໄປ, ແລະຜູ້ໃຊ້ທີ່ຈະຍອມຮັບຄຳຕອບທຳອິດທີ່ຊ່ວຍຫຼຸດຜ່ອນຄວາມກັງວົນຂອງເຂົາເຈົ້າ.
ມາດຕະຖານມີຄວາມສຳຄັນ. ພວກມັນພຽງແຕ່ບໍ່ໄດ້ເດີນທາງໄດ້ດີເທົ່າກັບການສະແດງອອກຂອງຊຸດຄະແນນ. ຄະແນນກະດານຈັດອັນດັບບໍ່ແມ່ນການປັບທຽບໃນປີ້ຂອງທ່ານ. ຄວາມສ່ຽງຂອງແບບຈຳລອງໃນບໍລິສັດແມ່ນ "ສິ່ງທີ່ເກີດຂຶ້ນເມື່ອສິ່ງນີ້ຜິດພາດໃນລະດັບສຽງ", ບໍ່ແມ່ນ "ມັນຜ່ານຊຸດຄຳຖາມທີ່ບໍ່ສຳຄັນ". ການທົດສອບທີ່ທ່ານຕ້ອງການແມ່ນແຫ້ງ: ຢູ່ພາຍໃນຂໍ້ຄວາມທີ່ດຶງມາ; ລາຍງານຄວາມບໍ່ແນ່ນອນແທນທີ່ຈະຫຼອກລວງ; ຮັກສາຄວາມສອດຄ່ອງເມື່ອທ່ານເວົ້າຄືນໃໝ່; ລົ້ມເຫຼວໃນການປິດ (ປະຕິເສດ, ຖາມ, ເລື່ອນເວລາ) ແທນທີ່ຈະລົ້ມເຫຼວໃນການເປີດ (ປະດິດ).
ຂ້ອຍເຄີຍເຫັນຄົນຖືວ່າການສຳເລັດທີ່ໜ້າປະທັບໃຈພຽງຢ່າງດຽວເປັນຫຼັກຖານ. ນັ້ນຄືກັບການຕັດສິນໃຈວ່າຮ້ານອາຫານ "ໜ້າເຊື່ອຖື" ເພາະວ່າອາຫານເລີ່ມຕົ້ນແຊບ. ບາງທີມັນອາດຈະແຊບ. ບາງທີເຮືອນຄົວອາດຈະໃຊ້ເວລາສິບນາທີໄດ້ດີ.
ມີຂໍ້ຂັດແຍ້ງເລັກນ້ອຍເກີດຂຶ້ນ: ຂ້ອຍຍັງໃຊ້ demos ເພື່ອໃຫ້ໄດ້ຄວາມຮູ້ສຶກ. ຂ້ອຍພຽງແຕ່ບໍ່ໄດ້ຈ້າງຄວາມຮູ້ສຶກນັ້ນມາ.
AI ເຊື່ອຖືໄດ້ບໍ? ພຽງແຕ່ຖ້າຍັງມີຄົນຕິດຢູ່
Human-in-the-loop ພຽງແຕ່ກົງກັບຮູບແບບຄວາມລົ້ມເຫຼວເທົ່ານັ້ນ.
ຖ້າບໍ່ມີໃຜຮັບຜິດຊອບ, ລະບົບຈະຖືກນຳໃຊ້ຄືກັບວ່າມັນເປັນ. ການປົກຄອງແມ່ນຊື່ທີ່ບໍ່ໜ້າສົນໃຈສຳລັບ "ໃຜທົບທວນ, ໃຜສາມາດຢຸດມັນໄດ້, ສິ່ງທີ່ຖືກບັນທຶກໄວ້, ສິ່ງທີ່ເກີດຂຶ້ນຫຼັງຈາກພາດ". ຕົວແທນເຮັດໃຫ້ສິ່ງນີ້ຄົມຊັດຂຶ້ນເພາະວ່າພວກເຂົາດຳເນີນການ, ບໍ່ພຽງແຕ່ວັກເທົ່ານັ້ນ. ຮ່າງທີ່ທ່ານບໍ່ໄດ້ສົ່ງແມ່ນລາຄາຖືກ. ການໂທຫາເຄື່ອງມືທີ່ເຈົ້າບໍ່ໄດ້ໝາຍຄວາມວ່າບໍ່ແມ່ນ.
ບອກຊື່ຜູ້ທີ່ຢູ່ໃນບັນຫາ. ຖ້າຄຳຕອບແມ່ນ "ນາງແບບ", ເຈົ້າບໍ່ມີຄຳຕອບ. ນາງແບບບໍ່ໄປປະຊຸມຫຼັງຈາກເຫດການ. ມີຄົນໄປ, ຫຼື ສູນຍາກາດໄປ ແລະ ຫຼັງຈາກນັ້ນທະນາຍຄວາມໄປ.
ເລືອກການກວດສອບທີ່ກົງກັບລັດສະໝີຂອງການລະເບີດ. ການທົບທວນລະດັບການກວດສອບການສະກົດຄຳສຳລັບໂພສທາງສັງຄົມ. ການກວດສອບແຫຼ່ງຂໍ້ມູນສຳລັບສິ່ງໃດກໍ່ຕາມທີ່ອ້າງຄວາມຈິງ. ຜູ້ຊ່ຽວຊານສຳລັບສິ່ງໃດກໍ່ຕາມທີ່ກ່ຽວຂ້ອງກັບ ການແພດ, ກົດໝາຍ, ສິນເຊື່ອ, ການປະຕິບັດງານທີ່ສຳຄັນດ້ານຄວາມປອດໄພ. ສຳລັບສິ່ງເຫຼົ່ານັ້ນ, ມະນຸດບໍ່ໄດ້ "ຢູ່ໃນວົງຈອນ". ມະນຸດແມ່ນວົງຈອນ. ຮູບແບບແມ່ນປາຍແຫຼມ. ນັ້ນບໍ່ແມ່ນຄວາມສົງໄສໃນຖານະບຸກຄະລິກກະພາບ. ນັ້ນແມ່ນລົດຊາດ.
ດຽວນີ້ແຟຊັ່ນແມ່ນການເຊື່ອງເຊັກໄວ້ທາງຫຼັງປຸ່ມສົ່ງທີ່ເຫຼື້ອມເປັນເງົາ. ດຽວນີ້ນັ້ນແມ່ນວິທີທີ່ເຈົ້າເຮັດໃຫ້ຂ່າວລືເປັນອັດຕະໂນມັດໂດຍບັງເອີນ. ບໍ່ດົນມານີ້ຂ້ອຍຮູ້ສຶກບໍ່ພໍໃຈກັບເລື່ອງນີ້ຫຼາຍຂຶ້ນ, ແລະວຽກງານກໍ່ດີຂຶ້ນ.
ວິທີການຖາມເພື່ອໃຫ້ເຈົ້າຈັບຄົນພາດ
ທ່ານສາມາດສອບສວນລະບົບເຫຼົ່ານີ້ໂດຍບໍ່ຕ້ອງກາຍເປັນຜູ້ສົງໄສມືອາຊີບກ່ຽວກັບແສງແດດ.
-
ຖາມເຖິງຄວາມບໍ່ແນ່ນອນໂດຍເຈດຕະນາ. "ສິ່ງໃດຈະເຮັດໃຫ້ເລື່ອງນີ້ຜິດພາດ?" ແທນທີ່ຈະເປັນ "ເຮັດໃຫ້ມັນໝັ້ນໃຈ".
-
ແຍກການດຶງຂໍ້ມູນຈາກລຸ້ນກ່ອນເມື່ອທ່ານສາມາດເຮັດໄດ້. ເບິ່ງຂໍ້ຄວາມກ່ອນ. ຈາກນັ້ນຂໍໃຫ້ຂຽນຄືນ.
-
ປ່ຽນຊຸດ. ເວົ້າໃໝ່. ຂໍໃຫ້ມັນໂຕ້ຖຽງໃນສິ່ງທີ່ກົງກັນຂ້າມ. ຄວາມອ່ອນໄຫວທີ່ກະຕຸ້ນໃຫ້ເກີດຄວາມຮູ້ສຶກຄືກັບໄຟສາຍຖ້າເຈົ້າໃຊ້ມັນແບບນັ້ນ.
-
ຂໍ້ຈຳກັດການບັງຄັບໃຊ້: "ສະເພາະຈາກຂໍ້ຄວາມທີ່ຂ້ອຍວາງໄວ້", "ຖ້າຂາດ, ໃຫ້ບອກວ່າຂາດ". ຮູບແບບຕ່າງໆເຊື່ອຟັງສິ່ງນີ້ຢ່າງໜ້າປະຫລາດໃຈ... ຈົນກວ່າພວກມັນຈະບໍ່ເປັນ. ກວດສອບຢູ່ແລ້ວ.
-
ມັກໜ້າວຽກທີ່ມີຕົວກວດສອບ. ໂປຣແກຣມຄອມໄພເລີ, ລິນເຕີ, ການກວດສອບສະກີ, ແລະ ສາຍຕາຄູ່ທີສອງ. ຄວາມໜ້າເຊື່ອຖືມັກຕົວໃຫ້ເກຣດ.
-
ລະວັງການບອກເລົ່າ: ຄວາມເຈາະຈົງເປັນພິເສດ. ຮູບຮ່າງທີ່ເບິ່ງຄືແນ່ນອນ, ກໍລະນີທີ່ມີຊື່, ປະໂຫຍກທີ່ມີຕົວເລກທີ່ເປັນລະບຽບ - ນັ້ນແມ່ນບ່ອນທີ່ອາການຫຼອນມັກແຕ່ງຕົວ.
-
ຮັກສາບາດກ້າວຂອງມະນຸດໃຫ້ເຫັນໄດ້ຊັດເຈນ. ຖ້າ UI ເຊື່ອງການກວດສອບ, ຜູ້ຄົນຈະຂ້າມການກວດສອບ. ນັ້ນແມ່ນເຟີນີເຈີ, ບໍ່ແມ່ນຄວາມລົ້ມເຫຼວທາງດ້ານສິນລະທຳ.
ບໍ່ມີສິ່ງໃດໃນນີ້ເຮັດໃຫ້ຮູບແບບ "ເປັນຄວາມຈິງ". ມັນເຮັດໃຫ້ວົງວຽນມີຄວາມໜ້າເຊື່ອຖືໜ້ອຍລົງ. ເຊິ່ງຂ້ອຍຄິດວ່າມັນແມ່ນຜົນຜະລິດ.
ແຜນທີ່ຈະພາເຈົ້າໄປໃສ
ສະນັ້ນ. ຄຳຖາມແມ່ນ/ບໍ່ແມ່ນ ເຮັດວຽກເປັນພຽງປະຕູເທົ່ານັ້ນ.
AI ໜ້າເຊື່ອຖືບໍ? ບໍ່ແມ່ນເປັນລັກສະນະ. ເປັນຄຸນສົມບັດຂອງໜ້າວຽກ, ຊຸດຂໍ້ມູນ, ວົງວຽນການດຶງຂໍ້ມູນຄືນ, ການປະເມີນຜົນທີ່ບໍ່ແມ່ນການສາທິດ, ແລະມະນຸດທີ່ຍັງຕ້ອງໝາຍຄວາມແບບນັ້ນ. ຄວາມຄ່ອງແຄ້ວຈະສືບຕໍ່ຫຼອກລວງພວກເຮົາເພາະວ່າພວກເຮົາເປັນສັດທີ່ໃຊ້ພາສາ ແລະລະບົບເຫຼົ່ານີ້ແມ່ນເຄື່ອງຈັກພາສາ. ເວລາເຮັດວຽກຈະສັບສົນກັບຄວາມຈິງຢູ່ເລື້ອຍໆ ເພາະວ່າທັງສອງຮູ້ສຶກວ່າ "ມັນໄດ້ຜົນ". ຜູ້ຮ່ວມບິນຈະສືບຕໍ່ໄດ້ຮັບຄວາມສຳຄັນຢູ່ໃຈກາງທີ່ສັບສົນ - ຮ່າງ, ບົດສະຫຼຸບທີ່ທ່ານສາມາດອ່ານຜ່ານ, ລະຫັດທີ່ທ່ານສາມາດລວບລວມໄດ້ - ແລະບໍ່ປອດໄພເມື່ອພວກເຮົາຈ້າງການຕັດສິນໃຫ້ກັບວັກທີ່ບໍ່ສົນໃຈ.
ໃຊ້ພວກມັນບ່ອນທີ່ການພາດລາຄາຖືກ ຫຼື ຈັບໄດ້. ຊ້າລົງບ່ອນທີ່ການພາດມີລາຄາແພງ. ນັ້ນແມ່ນຄຳຕອບທີ່ຊັດເຈນ, ແລະ ມັນມີຄ່າຫຼາຍກວ່າຄຳຂວັນ.
ຖ້າເຈົ້າເອົາສິ່ງໜຶ່ງໄປ: ຢຸດຖາມຕົວແບບວ່າມັນແນ່ໃຈຫຼືບໍ່. ລອງເບິ່ງວ່າຈະເກີດຫຍັງຂຶ້ນເມື່ອເຈົ້າຖາມມັນວ່າມັນສາມາດຜິດໄດ້ແນວໃດ. ຈາກນັ້ນໄປກວດສອບເບິ່ງ.
ຕົວຢ່າງໃນໂລກຕົວຈິງ: ການສ້າງຜູ້ຊ່ວຍ AI ສຳລັບນະໂຍບາຍສະມາຊິກ
ສະຖານະການ
ປຣີຢາ ດຳເນີນງານຄວາມຮູ້ໃຫ້ກັບ Harbour Membership, ເຊິ່ງເປັນອົງການການຄ້າຂອງສະຫະລາຊະອານາຈັກທີ່ມີພະນັກງານ 70 ຄົນ ສຳລັບຫ້ອງອອກກຳລັງກາຍເອກະລາດ. ມີສາມຄົນຕອບຄຳຖາມຂອງສະມາຊິກ. ແຫຼ່ງຂໍ້ມູນຄວາມຈິງແມ່ນປື້ມຄູ່ມື 180 ໜ້າ, ອັບເດດທຸກໆໄຕມາດ, ບວກກັບ PDF ເກົ່າໆໃນໄດຣຟ໌ທີ່ແບ່ງປັນທີ່ບໍ່ມີໃຜຢາກລຶບ.
ຜູ້ນຳໄດ້ຊື້ຜູ້ຊ່ວຍຊ່ວຍເຫຼືອແລ້ວ. ການສາທິດແມ່ນດີຫຼາຍ. ເວລາເຮັດວຽກກໍ່ດີ. ໃນອາທິດທີສອງ, ຮ່າງທີ່ຄ່ອງແຄ້ວບອກສະມາຊິກວ່າພວກເຂົາສາມາດຢຸດເຮັດວຽກໄດ້ເປັນເວລາ 14 ມື້ ແລະ ໄດ້ຮັບເງິນຄືນເຕັມຈຳນວນ "ຕາມມາດຕະຖານ". ນັ້ນບໍ່ແມ່ນນະໂຍບາຍ. ຕົວແທນຈັບໄດ້ເພາະວ່າພວກເຂົາຍັງເປີດປື້ມຄູ່ມືເມື່ອມີເລື່ອງເງິນເຂົ້າມາກ່ຽວຂ້ອງ. ຄຳຖາມຂອງຜູ້ນຳ, ສົ່ງຄືກັບວ່າມັນເປັນ "ແມ່ນ ຫຼື ບໍ່," ແມ່ນ: AI ໜ້າເຊື່ອຖືບໍ?
ປຣີຢາ ປະຕິເສດຄຳຕັດສິນ. ນາງຖືວ່າມັນຄືກັບແຜນທີ່. ໜ້າທີ່ບໍ່ແມ່ນ "ໃຫ້ຄຳທຳນາຍແກ່ສະມາຊິກ". ມັນແມ່ນ "ຮ່າງຄຳຕອບຈາກປື້ມຄູ່ມືປັດຈຸບັນ, ສະແດງຂໍ້ຄວາມ, ແລະ ປິດເມື່ອຂໍ້ຄວາມຫາຍໄປ". ຖ້າຜູ້ຊ່ວຍນັກບິນບໍ່ສາມາດເຮັດແບບນັ້ນໄດ້, ມັນເປັນເຄື່ອງຫຼິ້ນຮ່າງ, ບໍ່ແມ່ນໂຕະນະໂຍບາຍ.
ສິ່ງທີ່ຜູ້ຊ່ວຍຕ້ອງການ
-
ປື້ມຄູ່ມືເດືອນເມສາ 2026 ເປັນປຶ້ມທີ່ໄດ້ຮັບອະນຸຍາດພຽງຫົວດຽວ, ໂດຍມີໝາຍເລກພາກສ່ວນຍັງຄົງຢູ່
-
PDF ເກົ່າປີ 2023 ທີ່ປະໄວ້ໃນໄດຣຟ໌ໂດຍເຈດຕະນາ, ດັ່ງນັ້ນເຂົາເຈົ້າຈຶ່ງສາມາດເຫັນໄດ້ວ່າການດຶງຂໍ້ມູນຄືນມານັ້ນຈັບເອົາສິ່ງທີ່ເກືອບພາດໄດ້ຫຼືບໍ່
-
ກົດລະບຽບເປັນລາຍລັກອັກສອນ: ຫ້າມໃຊ້ຂໍ້ມູນສ່ວນຕົວຂອງລູກຄ້າໃນເຄື່ອງມືຂອງຜູ້ບໍລິໂພກ; ຫ້າມສົ່ງໂດຍບໍ່ມີມະນຸດ; ຫ້າມປະດິດຕົວເລກ, ປ່ອງຢ້ຽມ ຫຼື ຂໍ້ກຳນົດ "ຕາມມາດຕະຖານ"
-
ການອະນຸຍາດໃຫ້ບັນທຶກການແຈ້ງເຕືອນ, ຊິ້ນສ່ວນທີ່ດຶງມາ, ແລະ ການສົ່ງສຸດທ້າຍ
-
ເຈົ້າຂອງທີ່ມີຊື່ (Priya) ຜູ້ທີ່ຈະໃຫ້ຄະແນນຊຸດທົດສອບ ແລະ ຢຸດຜູ້ຊ່ວຍຂັບຖ້າມັນລົ້ມເຫຼວ ຖ້າປິດຮ້າຍແຮງກວ່າການໂຍນຫຼຽນໃສ່ຄຳຖາມກ່ຽວກັບເງິນ
-
ຖ້າເຄື່ອງມືຮອງຮັບການດຶງຂໍ້ມູນຄືນ, ຊິ້ນສ່ວນທີ່ຖືກດຶງຂໍ້ມູນຄືນຕ້ອງເບິ່ງເຫັນໄດ້ຢູ່ຂ້າງຮ່າງ. ຖ້າມັນບໍ່ເຫັນ, ພວກເຂົາຈະຕິດສ່ວນນັ້ນດ້ວຍມື. ການຕໍ່ດິນໂດຍບໍ່ມີທາງຜ່ານທີ່ສາມາດກວດສອບໄດ້ຍັງເປັນມົວຢູ່.
ຕົວຢ່າງຄຳແນະນຳ
ປຣີຢາ ໄດ້ກ່າວສິ່ງນີ້ດ້ວຍພາສາທຳມະດາ, ບໍ່ແມ່ນໃນການສະແດງລະຄອນເວທີ:
ຕອບສະເພາະຂໍ້ຄວາມຈາກຄູ່ມືເດືອນເມສາ 2026 ທີ່ທ່ານໄດ້ຮັບ. ອ້າງອີງໝາຍເລກພາກສ່ວນ. ຖ້າຄຳຕອບບໍ່ຢູ່ໃນຂໍ້ຄວາມເຫຼົ່ານັ້ນ, ໃຫ້ເວົ້າວ່າ "ບໍ່ຢູ່ໃນຄູ່ມືປັດຈຸບັນ" ແລະຢຸດ. ຢ່າປະດິດປ່ອງຢ້ຽມແຊ່ແຂງ, ກົດລະບຽບການຄືນເງິນ, ຫຼືຄ່າທຳນຽມ. ຢ່າຍົກລະດັບ "ຕາມການຕັດສິນໃຈຂອງຫ້ອງອອກກຳລັງກາຍ" ເປັນ "ຕາມມາດຕະຖານ". ຖ້າສອງຂໍ້ຄວາມຂັດແຍ້ງກັນ, ໃຫ້ສະແດງທັງສອງ ແລະບອກວ່າຂໍ້ຄວາມໃດເປັນຂໍ້ຄວາມປັດຈຸບັນ. ທ່ານກຳລັງຮ່າງສຳລັບມະນຸດຜູ້ທີ່ຈະເປີດແຫຼ່ງຂໍ້ມູນກ່ອນທີ່ສິ່ງໃດຈະໄປຫາສະມາຊິກ.
ຫຼັງຈາກນັ້ນ, ນາງເກັບຄຳແນະນຳທີສອງໄວ້ໃຫ້ຕົວເອງ, ເພາະວ່າຈຸດປະສົງຂອງບົດຄວາມແມ່ນວົງວຽນ, ບໍ່ແມ່ນຮູບແບບ:
ກ່ອນທີ່ຈະສົ່ງ, ໃຫ້ເປີດພາກສ່ວນທີ່ອ້າງອີງ. ຖາມວ່າ "ມີຫຍັງເຮັດໃຫ້ສິ່ງນີ້ຜິດພາດ?" ຖ້າຮ່າງມີຕົວເລກທີ່ບໍ່ໄດ້ຢູ່ໃນຂໍ້ຄວາມ, ໃຫ້ປະຕິເສດມັນ. ຖ້າຂ້ອຍຖາມຄືກັບນາຍຈ້າງທີ່ຮີບຮ້ອນ, ໃຫ້ຖາມອີກຄັ້ງຄືກັບຄົນສົງໄສແລະປຽບທຽບ.
ຮ່າງທີ່ດີມີລັກສະນະແບບນີ້: "ບໍ່ມີຢູ່ໃນຄູ່ມືປັດຈຸບັນ (ເມສາ 2026, ພາກ 4.2). ການຢຸດພັກແມ່ນຂຶ້ນກັບການຕັດສິນໃຈຂອງຫ້ອງອອກກຳລັງກາຍ. ການຄືນເງິນບໍ່ແມ່ນອັດຕະໂນມັດ. ຍົກລະດັບໃຫ້ສູງຂຶ້ນ." ຮ່າງທີ່ບໍ່ດີມີລັກສະນະແບບນີ້: "ສະມາຊິກອາດຈະຢຸດພັກເປັນເວລາ 14 ມື້ ແລະ ໄດ້ຮັບເງິນຄືນເຕັມຈຳນວນຕາມມາດຕະຖານ. ຢືນຢັນແລ້ວໃນຄູ່ມື." ນ້ຳສຽງດຽວກັນ. ມີພຽງອັນດຽວເທົ່ານັ້ນທີ່ເປັນນະໂຍບາຍ.
ວິທີການທົດສອບມັນ
ປຣີຢາຂຽນຄຳຖາມ 20 ຂໍ້ກ່ອນທີ່ນາງຈະເບິ່ງຜົນໄດ້ຮັບຂອງນັກບິນຮ່ວມ. ລຳດັບນັ້ນມີຄວາມສຳຄັນ. ການສາທິດແມ່ນການໃຫ້ແສງສະຫວ່າງ. ນີ້ແມ່ນການທົດສອບແບບແຫ້ງ.
ຊຸດນີ້ບໍ່ແມ່ນເລື່ອງເລັກໆນ້ອຍໆ. ມັນແມ່ນໂຕະສະແດງສົດ:
-
ແປດຄຳຖາມທີ່ມີຄຳຕອບຢູ່ໃນພາກສ່ວນດຽວໃນປະຈຸບັນ (ຄຳຖາມງ່າຍໆ)
-
ເກືອບພາດສີ່ຢ່າງ, ບ່ອນທີ່ PDF ປີ 2023 ມີຖ້ອຍຄຳໃກ້ຄຽງກັບຂໍ້ຄວາມເດືອນເມສາ
-
ສາມຄຳຖາມ "ບໍ່ໄດ້ຢູ່ໃນປື້ມຄູ່ມື" (ຂໍ້ຂັດແຍ່ງກ່ຽວກັບການຮຽກເກັບເງິນ, ທີ່ປຶກສາທາງການແພດ "ການຝຶກອົບຮົມນີ້ປອດໄພບໍ", ການແກ້ໄຂສັນຍາທີ່ຕິດກັບກົດໝາຍ)
-
ສາມຄຳຖາມກ່ຽວກັບເງິນ (ຢຸດ, ຄືນເງິນ, ຄ່າທຳນຽມເຂົ້າຮ່ວມ)
-
ສອງຄຳຖາມສຳລັບສະມາຊິກທົ່ວໄປ (ເວລາເປີດບໍລິການ, ປະກັນໄພຄູຝຶກ)
ສອງໃນຊາວຄົນນັ້ນຍັງຖືກຖາມຄືນໃນຊຸດທີສອງ, ຄັ້ງໜຶ່ງໃນຖານະເປັນນາຍຈ້າງທີ່ຮີບຮ້ອນ ແລະ ຄັ້ງໜຶ່ງໃນຖານະເປັນຜູ້ສົງໄສ, ເພື່ອກວດສອບຄວາມອ່ອນໄຫວຕໍ່ຄວາມວ່ອງໄວ. ການຖາມຄືນເຫຼົ່ານັ້ນໄດ້ຖືກບັນທຶກໄວ້, ບໍ່ໄດ້ລວມເຂົ້າໃນຄະແນນ 20 ຂໍ້.
ຄະແນນຄະແນນ, ໂດຍ Priya ໄດ້ຄະແນນພ້ອມກັບປື້ມຄູ່ມືເປີດຢູ່: ການຜ່ານຕ້ອງການກົດລະບຽບປັດຈຸບັນທີ່ຖືກຕ້ອງ, ໝາຍເລກພາກສ່ວນທີ່ແທ້ຈິງ, ແລະບໍ່ມີປະໂຫຍກເພີ່ມເຕີມທີ່ປະດິດຂຶ້ນ. ຄວາມລົ້ມເຫຼວທີ່ງຽບສະຫງົບແມ່ນປະໂຫຍກທີ່ດີທາງດ້ານເຕັກນິກທີ່ເຮັດໃຫ້ຂໍ້ຍົກເວັ້ນຫຼຸດລົງ ຫຼື ປ່ຽນຄຳວ່າ "ອາດຈະ" ກາຍເປັນຄຳທີ່ຕ້ອງ. ຄວາມລົ້ມເຫຼວທີ່ເປີດຢູ່ແມ່ນຕົວເລກທີ່ປະດິດຂຶ້ນ ຫຼື PDF ທີ່ເກືອບພາດທີ່ຖືວ່າເປັນປະຈຸບັນ. ເວລາເຮັດວຽກຖືກນັບແຍກຕ່າງຫາກ, ເພາະວ່າ "ມັນຕອບກັບ" ບໍ່ແມ່ນ "ມັນເປັນແນວນັ້ນ".
ການຍອມຮັບສຳລັບການໄປຕໍ່: ສຳລັບບັນຫາດ້ານການເງິນ, ໃຫ້ປິດບໍ່ທັນແທນທີ່ຈະເປີດບໍ່ທັນ. ຖ້າຜູ້ຊ່ວຍສ້າງປ່ອງຢ້ຽມຄືນເງິນ, ມັນຈະບໍ່ຮ່າງປີ້ສົດ. ຖ້າບໍ່ມີໃຜເປີດແຫຼ່ງຂໍ້ມູນ, ມັນຈະບໍ່ຮ່າງປີ້ສົດເຊັ່ນກັນ.
ຜົນໄດ້ຮັບ
ຜົນໄດ້ຮັບທີ່ເປັນຕົວຢ່າງ, ຈາກການທົດສອບ 20 ຄຳຖາມທີ່ແຕ່ງຂຶ້ນ, ບໍ່ແມ່ນຕົວເລກສະມາຊິກທ່າເຮືອທີ່ເຜີຍແຜ່.
ສົມມຸດຕິຖານ: ຜູ້ຮ່ວມຊ່ວຍເຫຼືອໜຶ່ງຄົນ; ປື້ມຄູ່ມືເດືອນເມສາ 2026 ບວກກັບ PDF ປີ 2023 ທີ່ເຫຼືອ; Priya ໄດ້ຄະແນນທຽບກັບຄະແນນຂ້າງເທິງ; ເວລາແມ່ນໂມງຈັບເວລາທາງໂທລະສັບຈາກຄຳຖາມທີ່ວາງໄວ້ຈົນເຖິງ "ຂ້ອຍຈະສົ່ງອັນນີ້"; ເວລາທົບທວນຄືນຖືກລວມຢູ່ໃນເງື່ອນໄຂທີ່ວົນຊ້ຳ ແລະ ຖືກຍົກເວັ້ນໃນເງື່ອນໄຂທີ່ບໍ່ໄດ້ເລືອກ, ໂດຍເຈດຕະນາ, ດັ່ງນັ້ນການປຽບທຽບຈຶ່ງຄົງເທົ່າກັນ.
ຄຳແນະນຳແບບຕົວຢ່າງຮ່ວມທີ່ບໍ່ໄດ້ເລືອກ: 20 ໃນ 20 ຄຳຖາມໄດ້ຮັບຄຳຕອບທີ່ຄ່ອງແຄ້ວ (ເວລາເຮັດວຽກເບິ່ງຄືວ່າສົມບູນແບບ). 11 ໃນ 20 ຄຳຖາມຕອບສະໜອງຕາມມາດຕະຖານ. ຫ້າຄຳຖາມແມ່ນຄວາມລົ້ມເຫຼວທີ່ງຽບສະຫງົບ. ສີ່ຄຳຖາມແມ່ນຄວາມລົ້ມເຫຼວທີ່ຍັງເປີດຢູ່, ລວມທັງການຢຸດຊົ່ວຄາວ 14 ມື້. ສອງໃນສີ່ຄຳຖາມແມ່ນຄວາມລົ້ມເຫຼວທີ່ຍັງເປີດຢູ່ອ້າງອີງເຖິງຊິ້ນສ່ວນທີ່ມີລັກສະນະເປັນແຫຼ່ງຂໍ້ມູນຈາກ PDF ປີ 2023. ເວລາສະເລ່ຍຂອງຮ່າງທີ່ເບິ່ງຄືສາມາດສົ່ງໄດ້ແມ່ນ 1 ນາທີ.
ຄຳຖາມ 20 ຂໍ້ດຽວກັນ, ຄຳແນະນຳທີ່ຈຳກັດ, ດຶງເອົາສ່ວນທີ່ເຫັນໄດ້ຊັດເຈນ: 15 ໃນ 20 ຂໍ້ແມ່ນຖືກຕ້ອງທັງໝົດຈາກຂໍ້ຄວາມເດືອນເມສາ. ສາມຂໍ້ເວົ້າຢ່າງຖືກຕ້ອງວ່າ "ບໍ່ໄດ້ຢູ່ໃນປື້ມຄູ່ມືປັດຈຸບັນ" (ລາຍການທີ່ກ່ຽວຂ້ອງກັບການແພດ ແລະ ທາງດ້ານກົດໝາຍ, ບວກກັບຂໍ້ຂັດແຍ້ງກ່ຽວກັບການຮຽກເກັບເງິນໜຶ່ງຂໍ້), ສະນັ້ນ 18 ໃນ 20 ຂໍ້ແມ່ນຍອມຮັບໄດ້. ສອງຂໍ້ຍັງບໍ່ຜ່ານ: ໜຶ່ງໃນຂຽນຜ່ານ PDF ປີ 2023 ທີ່ເກືອບຈະພາດ, ແລະ ອີກໜຶ່ງຂໍ້ໄດ້ປະດິດຕົວເລກຄ່າທຳນຽມເຂົ້າຮ່ວມທີ່ບໍ່ມີຢູ່ໃນຂໍ້ຄວາມ. ເວລາສະເລ່ຍໃນການຮ່າງຍັງປະມານ 1 ນາທີ.
20 ດຽວກັນ, ບວກກັບ Priya ເປີດພາກສ່ວນທີ່ອ້າງອີງກ່ອນການສົ່ງແບບຈຳລອງ: 19 ໃນ 20 ອາດຈະເປັນທີ່ຍອມຮັບໄດ້. ນາງຈັບ PDF ທີ່ເກືອບພາດ. ສ່ວນທີ່ເຫຼືອແມ່ນຜູ້ທົບທວນທີ່ອ່ານຜ່ານວັກທີ່ຄ່ອງແຄ້ວ ແລະ ບໍ່ສັງເກດເຫັນຕົວເລກຄ່າທຳນຽມເຂົ້າຮ່ວມທີ່ປະດິດຂຶ້ນ. ເວລາສະເລ່ຍ, ລວມທັງການທົບທວນ, ແມ່ນ 3 ນາທີ.
ຂະບວນການເກົ່າ, ຄົ້ນຫາດ້ວຍຄູ່ມືເທົ່ານັ້ນ, ບໍ່ມີຜູ້ຊ່ວຍ: ຍອມຮັບໄດ້ 20 ຈາກ 20. ເວລາສະເລ່ຍ 9 ນາທີ.
ໃນຕົວຢ່າງນີ້, ຜູ້ຊ່ວຍບິນທີ່ວົນຊ້ຳໆແມ່ນໄວກວ່າການຄົ້ນຫາຄູ່ມື 6 ນາທີ (9 ລົບ 3), ຫຼື 120 ນາທີໃນ 20 ຄຳຖາມ, ໂດຍມີ 19 ໃນ 20 ຄຳຕອບທີ່ຍອມຮັບໄດ້ແທນທີ່ຈະເປັນ 20 ໃນ 20 ຄຳຖາມ. ຜູ້ຊ່ວຍບິນທີ່ບໍ່ໄດ້ຮັບການກວດສອບແມ່ນໄວກວ່າ 8 ນາທີ (9 ລົບ 1) ແລະຜິດ, ງຽບໆ ຫຼື ດັງ, ໃນ 9 ໃນ 20 ຄຳຕອບ. ນັ້ນບໍ່ແມ່ນການປະຫຍັດເວລາ 67% ທີ່ທ່ານເອົາໃສ່ໃນຊຸດພວງມາໄລ. ມັນເປັນການຮົ່ວໄຫຼ 9 ຄັ້ງທີ່ທ່ານຄວນຈະເຮັດໂດຍອັດຕະໂນມັດ.
ຮຸ່ນທີ່ຮີບຮ້ອນຂອງທັງສອງຄຳຖາມຊ້ຳໆ ທັງສອງໄດ້ອ້າງເກີນຄວາມຈິງ. ຮຸ່ນທີ່ສົງໄສໄດ້ຫຼີກລ່ຽງບັນຫາ. ນາງແບບດຽວກັນ, ປື້ມຄູ່ມືດຽວກັນ, ຊຸດທີ່ແຕກຕ່າງກັນ. ປຣີຢາໄດ້ບັນທຶກສິ່ງນັ້ນວ່າເປັນການຄົ້ນພົບ, ບໍ່ແມ່ນເປັນບຸກຄະລິກກະພາບ.
ຕົວເລກເຫຼົ່ານີ້ແມ່ນຕົວຢ່າງການຄາດຄະເນໂດຍອີງໃສ່ການທົດສອບທີ່ລະບຸໄວ້, ຊຸດນ້ອຍໆ, ປີ້ທີ່ງ່າຍກວ່າສະມາຊິກທີ່ໃຈຮ້າຍ, ແລະຜູ້ທົບທວນຄືນຄົນໜຶ່ງທີ່ຮູ້ຈັກປຶ້ມແລ້ວ. ພວກເຂົາບໍ່ໄດ້ສະແດງໃຫ້ເຫັນວ່າຜູ້ຊ່ວຍທົດລອງແມ່ນ "ໜ້າເຊື່ອຖື 95%", ຫຼືວ່າ Harbour ຄວນຕັດພະນັກງານໂຕະ. ພວກເຂົາສະແດງໃຫ້ເຫັນວ່າເວລາເຮັດວຽກບໍ່ແມ່ນຄຳຖາມ, ແລະການກວດສອບແມ່ນ.
ມີຫຍັງຜິດພາດໄດ້ແດ່
-
ຜູ້ນຳອ້າງອີງເວລາດຣາຟ 1 ນາທີ ແລະ ຂ້າມການພາດ 9 ຄັ້ງ. ຄວາມໄວຍັງຮູ້ສຶກຄືກັບຄວາມສາມາດໃນເວລາ 16:00 ໂມງ.
-
PDF 2023 ຍັງຄົງຢູ່ໃນດັດຊະນີ. ການດຶງຂໍ້ມູນຍັງສືບຕໍ່ດຶງມັນມາ. ການ Grounding ເບິ່ງຄືວ່າເປັນຜູ້ໃຫຍ່ແລ້ວ ແລະ ຍັງເກືອບຈະພາດໄປ.
-
UI ຈະເຊື່ອງສ່ວນທີ່ດຶງມາໄວ້ທາງຫຼັງປຸ່ມສົ່ງທີ່ເປັນເງົາ. ຜູ້ຄົນຢຸດເປີດຄູ່ມື, ຊຶ່ງເປັນວິທີທີ່ຄຳຕອບຄ້າງໄວ້ຈະໄປເຖິງສະມາຊິກ.
-
ປຣີຢາ ໄດ້ຄະແນນພຽງແຕ່ແປດຄຳຖາມງ່າຍໆເທົ່ານັ້ນ ເພາະວ່າມັນເບິ່ງງາມກວ່າໃນສະໄລ້. ການປະເມີນ, ພຽງແຕ່ໃຊ້ຕາຕະລາງຄິດໄລ່ເທົ່ານັ້ນ.
-
ຄຳຕອບທີ່ຕິດກັບທາງການແພດທີ່ວ່າ "ການຝຶກອົບຮົມນີ້ປອດໄພບໍ່" ເບິ່ງຄືວ່າເປັນຄຳຕອບສັ້ນໆ. ແຜນທີ່ເກືອບບໍ່ເຄີຍບອກເລີຍ. ນ້ຳສຽງບອກວ່າ ດຳເນີນການຕໍ່ໄປ.
-
ບັນທຶກຖືກປິດເພາະວ່າ "ມັນຮູ້ສຶກຄືກັບວ່າພິເສດ". ຫຼັງຈາກພາດໄປ, ບໍ່ມີໃຜສາມາດເຫັນໄດ້ວ່າຂໍ້ຄວາມໃດຖືກດຶງຄືນມາ.
-
ພວກເຂົາຖາມຕົວແບບວ່າມັນແນ່ໃຈຫຼືບໍ່. ມັນແມ່ນ. ນັ້ນບໍ່ເຄີຍເປັນການທົດສອບ.
ເອົາໄປໃຊ້ຕົວຈິງ
ຄວາມໜ້າເຊື່ອຖືບໍ່ແມ່ນລັກສະນະຂອງຜູ້ຊ່ວຍ Harbour ທີ່ຊື້ມາ. ມັນເປັນຄຸນສົມບັດຂອງ 20 ຄຳຖາມ, ປື້ມຄູ່ມືທີ່ທັນສະໄໝ, ຂໍ້ຄວາມທີ່ເຫັນໄດ້ຊັດເຈນ, ແລະບຸກຄົນທີ່ຍັງເປີດແຫຼ່ງຂໍ້ມູນເມື່ອມີເງິນເຂົ້າມາກ່ຽວຂ້ອງ. ຄວາມຄ່ອງແຄ້ວຈະສືບຕໍ່ຜ່ານການທົດສອບເວລາເຮັດວຽກ. ວົງວຽນແມ່ນສິ່ງດຽວທີ່ຜ່ານການທົດສອບນະໂຍບາຍ.
ຄຳຖາມທີ່ຖືກຖາມເລື້ອຍໆ
ຄວາມໜ້າເຊື່ອຖືໝາຍເຖິງຫຍັງສຳລັບ AI ທີ່ສ້າງສັນ?
ຄວາມໜ້າເຊື່ອຖືທຸກໆມື້ໝາຍຄວາມວ່າທ່ານສາມາດເພິ່ງພາອາໄສບາງສິ່ງບາງຢ່າງໄດ້. ດ້ວຍລະບົບອັດຕະໂນມັດທີ່ເວົ້າໄດ້, ກຸ່ມຄຸນສົມບັດທັງໝົດຈະຊ່ອນຢູ່ພາຍໃຕ້ຄຳດຽວ: ຄວາມຈິງ, ຄວາມສອດຄ່ອງ, ການປັບທຽບ, ຄວາມປອດໄພ, ເວລາເຮັດວຽກ, ຄວາມອ່ອນໄຫວທີ່ວ່ອງໄວ, ກໍລະນີຂອບ, ແລະ ພຶດຕິກຳຫຼັງຈາກການປ່ຽນແປງການແຈກຢາຍ. ບໍ່ມີອັນໃດທີ່ລົ້ມເຫຼວຮ່ວມກັນ. ການທົດສອບສົດແມ່ນໜ້າເຊື່ອຖືໄດ້ໃນສິ່ງທີ່, ສຳລັບໃຜ, ກັບອັນໃດ. ຖ້າບໍ່ດັ່ງນັ້ນ, ທ່ານກຳລັງໃຫ້ຄະແນນເຄື່ອງປັ່ນກ່ຽວກັບວ່າມັນສາມາດເຮັດພາສີໄດ້ຫຼືບໍ່.
AI ໜ້າເຊື່ອຖືໄດ້ບໍ?
ບໍ່ແມ່ນເປັນລັກສະນະນິໄສ. LLM ສາມາດແຂງແກ່ນໃນວຽກໜຶ່ງ ແລະ ບໍ່ຄ່ອຍເຮັດວຽກຕໍ່ໄປ, ບາງຄັ້ງກໍ່ເຮັດວຽກດຽວກັນ, ບາງຄັ້ງກໍ່ເປັນຍ້ອນເຈົ້າຍ້າຍເຄື່ອງໝາຍຈຸດ. ຄວາມໜ້າເຊື່ອຖືແມ່ນຄຸນສົມບັດຂອງໜ້າວຽກ, ຊຸດຂໍ້ມູນ, ວົງວຽນການດຶງຂໍ້ມູນຄືນ, ການປະເມີນຜົນທີ່ບໍ່ແມ່ນການສາທິດ, ແລະ ມະນຸດທີ່ຍັງຕ້ອງໝາຍຄວາມເຖິງມັນ. ໃຊ້ມັນໃນບ່ອນທີ່ການພາດແມ່ນລາຄາຖືກ ຫຼື ສາມາດຈັບໄດ້. ຊ້າລົງໃນບ່ອນທີ່ການພາດແມ່ນລາຄາແພງ.
ເວລາເຮັດວຽກຂອງ AI ຄືກັນກັບຄວາມຈິງບໍ?
ບໍ່. ເວລາເຮັດວຽກແມ່ນຂຶ້ນກັບວ່າຈຸດສຸດທ້າຍໄດ້ຮັບຄຳຕອບຫຼືບໍ່. ຄວາມຈິງແມ່ນກ່ຽວກັບວ່າຄຳຕອບແມ່ນແທ້ຫຼືບໍ່. ທ່ານສາມາດມີການບໍລິການທີ່ບໍ່ເຄີຍກະພິບຕາ ແລະຍັງສາມາດສົ່ງຄຳຕົວະທີ່ຄ່ອງແຄ້ວເຂົ້າໄປໃນປີ້ຂອງລູກຄ້າໄດ້. ຄວາມໄວຮູ້ສຶກຄືກັບຄວາມສາມາດເມື່ອຄິວເປັນສັດຕູ. ຄວາມປອດໄພແມ່ນແກນອື່ນ: ຮູບແບບທີ່ປະຕິເສດການ jailbreak ອາດຈະຍັງທຳລາຍບົດສະຫຼຸບຂອງບັນທຶກຂອງທ່ານເອງ.
ເປັນຫຍັງ AI ທີ່ຄ່ອງແຄ້ວຈຶ່ງຮູ້ສຶກໜ້າເຊື່ອຖືເຖິງແມ່ນວ່າມັນຈະຜິດພາດ?
ຄວາມຖືກຕ້ອງ ແລະ ຄວາມຄ່ອງແຄ້ວໄດ້ຖືກແຍກອອກຈາກກັນ, ແລະ ຄວາມຄ່ອງແຄ້ວຍັງຄົງຮັກສາໄວ້ໄດ້. ປະລິນຍາໂທວິທະຍາສາດ (LLM) ຈະໃຫ້ຈັງຫວະ, ການປ້ອງກັນຄວາມສ່ຽງ, ບາງທີອາດເປັນຮູບແບບການອ້າງອີງປອມແຕ່ສວຍງາມ, ແລະ ສະໝອງຂອງເຈົ້າອ່ານວ່າ "ຄົນຜູ້ນີ້ຮູ້." ການວັດແທກມັກຈະເປັນສິ່ງທີ່ໜ້າຢ້ານ: ຄວາມໝັ້ນໃຈສູງ, ຄວາມຈິງທີ່ປານກາງ, ສົ່ງຄືກັບຄຳປາໄສຫຼັກ. ຄຳຕອບທີ່ຜິດທີ່ງຸ່ມງ່າມເຮັດໃຫ້ເຈົ້າສົງໄສ. ຄຳຕອບທີ່ຜິດຢ່າງຄ່ອງແຄ້ວເຮັດໃຫ້ເຈົ້າຢຸດກວດສອບ. ຖ້າມັນເວົ້າຄືກັບຄຳເວົ້າສັ້ນໆ, ພວກເຮົາປະຕິບັດຕໍ່ມັນຄືກັບຄຳເວົ້າສັ້ນໆ, ແລະ ນັ້ນແມ່ນວິທີທີ່ຜູ້ຕອບຜິດເຂົ້າໄປໃນບົດສະຫຼຸບ.
AI ເຊື່ອຖືໄດ້ສຳລັບວຽກງານທາງການແພດ, ກົດໝາຍ ຫຼື ການສະໜັບສະໜູນລູກຄ້າບໍ?
ມັນຂຶ້ນກັບວຽກ, ບໍ່ແມ່ນຍີ່ຫໍ້. ຄຳແນະນຳທາງການແພດ ແລະ ກົດໝາຍເກືອບຈະບໍ່ດີພໍໃນຖານະຜະລິດຕະພັນ: ຮູບແບບແມ່ນຂໍ້ມູນຍ່ອຍ ແລະ ມະນຸດແມ່ນຜູ້ຊ່ຽວຊານ. ຝ່າຍຊ່ວຍເຫຼືອລູກຄ້າສາມາດຮ່າງພາຍໃນນະໂຍບາຍທີ່ເຂັ້ມງວດ, ແຕ່ບຸກຄົນຄວນເປັນເຈົ້າຂອງເງິນ ແລະ ຄວາມໄວ້ວາງໃຈ, ເພາະວ່ານະໂຍບາຍທີ່ຖືກປະດິດຂຶ້ນ ແລະ ຄວາມຜິດພາດທີ່ສຸພາບແມ່ນຄວາມລົ້ມເຫຼວຕາມປົກກະຕິ. ຮ່າງ ແລະ ບົດສະຫຼຸບແມ່ນຂໍ້ຄວາມທຳອິດທີ່ທ່ານຮູ້ແລ້ວ. ກວດສອບຊື່, ຕົວເລກ, ແລະ ປະໂຫຍກທີ່ຈະເຮັດໃຫ້ເຈັບປວດ.
ເປັນຫຍັງ AI ຈຶ່ງເຮັດໃຫ້ເກີດອາການຫຼອນ, ລ່ອງລອຍ, ຫຼື ຜິດພາດຢ່າງງຽບໆ?
ອາການຫຼອນຫຼອນແມ່ນສິ່ງທີ່ພາດໂອກາດທີ່ໜ້າຕື່ນເຕັ້ນ: ປຶ້ມທີ່ບໍ່ມີຢູ່ຈິງ, ໜ້າທີ່ທີ່ບໍ່ເຄີຍຖືກສົ່ງຂາຍ, ຂໍ້ກຳນົດນະໂຍບາຍທີ່ມີຕົວເລກທີ່ຮູ້ສຶກວ່າເປັນທາງການ. ການລ່ອງລອຍແມ່ນໜ້ອຍລົງຄືກັບໜັງ: ໂລກເຄື່ອນໄຫວ, ສິ່ງທີ່ເຫຼືອຂອງຕົວແບບຍັງຄົງຢູ່, ແລະ ເຈົ້າໄດ້ຮັບຄຳຕອບທີ່ມີການຈັດລຽງຢ່າງດີຈາກສະພາບອາກາດທີ່ຜ່ານມາ. ຄວາມຜິດພາດທີ່ງຽບສະຫງົບແມ່ນບົດສະຫຼຸບທີ່ລຶບຂໍ້ຍົກເວັ້ນ. ຫຼື ຄຳເວົ້າທີ່ຍົກລະດັບຄຳວ່າ "ບາງທີອາດ" ໃຫ້ກາຍເປັນ "ສິ່ງຈຳເປັນ". ຂໍ້ເທັດຈິງສາມາດເບິ່ງໄດ້ດີທາງດ້ານເຕັກນິກໃນຂະນະທີ່ຄວາມໝາຍໄດ້ເລື່ອນລົງ. ຄວາມອ່ອນໄຫວທີ່ວ່ອງໄວເຮັດໃຫ້ຂໍ້ເທັດຈິງສະຫວ່າງຂຶ້ນເມື່ອເຈົ້າປ່ຽນການຫໍ່.
ການຕໍ່ສາຍດິນ ຫຼື ການດຶງຂໍ້ມູນຄືນມາເຮັດໃຫ້ AI ໜ້າເຊື່ອຖືໄດ້ບໍ?
ການຕໍ່ສາຍດິນໝາຍເຖິງຄຳຕອບຈາກສິ່ງນີ້, ບໍ່ແມ່ນຈາກໝອກ. ການດຶງເອົາຂໍ້ມູນຄືນມາຈະຕິດປະຈຸບັນໃສ່ກອງຂໍ້ມູນທີ່ໄດ້ຮັບການຝຶກອົບຮົມແລ້ວ. ເມື່ອມັນລົ້ມເຫຼວ, ມັນຈະລົ້ມເຫຼວຢ່າງສຸພາບ: ເອກະສານທີ່ເກືອບພາດ, ການຂຽນທີ່ຂຽນໄວ້, ແລະສະຕິປັນຍາການກວດສອບຂອງທ່ານຈະຢຸດເຮັດວຽກ. ການຕໍ່ສາຍດິນຄືພື້ນ, ບໍ່ແມ່ນຮາໂລ. ຖ້າທ່ານບໍ່ສາມາດກວດສອບຊິ້ນສ່ວນທີ່ດຶງມາໄດ້, ທ່ານຍັງຢູ່ໃນໝອກ, ພຽງແຕ່ມີແສງສະຫວ່າງທີ່ດີກວ່າ. ປະສົມປະສານໜ້າວຽກທີ່ມີຊີວິດຊີວາເຊັ່ນ: ລາຄາ ຫຼື ຄຳເວົ້ານະໂຍບາຍກັບວຽກທີ່ໝັ້ນຄົງ, ແລະທ່ານຈະໄດ້ຮັບຄຳຕອບທີ່ແນ່ນອນກ່ຽວກັບໂລກທີ່ໄດ້ເຄື່ອນຍ້າຍໄປແລ້ວ.
ເປັນຫຍັງການສາທິດຈຶ່ງເປັນການທົດສອບທີ່ບໍ່ດີຂອງຄວາມໜ້າເຊື່ອຖືຂອງ AI?
ການກະຕຸ້ນທີ່ສະອາດ ແລະ ໜ້າວຽກທີ່ຕົວແບບໄດ້ເຫັນມາຫຼາຍພັນຄົນຈະເບິ່ງຄົມຊັດ. ຂັ້ນຕອນການເຮັດວຽກສົດມີການວາງທີ່ສັບສົນ, ໄຟລ໌ທີ່ຫາຍໄປ, ແລະ ຜູ້ໃຊ້ທີ່ຈະຍອມຮັບຄຳຕອບທຳອິດທີ່ຊ່ວຍຫຼຸດຜ່ອນຄວາມກັງວົນຂອງເຂົາເຈົ້າ. ຄະແນນກະດານຈັດອັນດັບບໍ່ແມ່ນການປັບທຽບໃນປີ້ຂອງທ່ານ. ຄວາມສ່ຽງຂອງຕົວແບບແມ່ນສິ່ງທີ່ເກີດຂຶ້ນເມື່ອສິ່ງນີ້ຜິດພາດໃນລະດັບສຽງ, ບໍ່ແມ່ນວ່າມັນຜ່ານຊຸດຄຳຖາມທີ່ສັບສົນຫຼືບໍ່. ການທົດສອບທີ່ທ່ານຕ້ອງການແມ່ນແຫ້ງ: ຢູ່ພາຍໃນຂໍ້ຄວາມທີ່ດຶງມາ, ລາຍງານຄວາມບໍ່ແນ່ນອນແທນທີ່ຈະຫຼອກລວງ, ຮັກສາຄວາມສອດຄ່ອງເມື່ອທ່ານໃຊ້ຄຳສັບໃໝ່, ແລະ ລົ້ມເຫຼວໃນການປິດແທນທີ່ຈະປະດິດ.
AI ຈະໜ້າເຊື່ອຖືໄດ້ບໍ່ ຖ້າບໍ່ມີໃຜສົນໃຈ?
ບໍ່. ຖ້າບໍ່ມີໃຜຮັບຜິດຊອບ, ລະບົບຈະຖືກນຳໃຊ້ຄືກັບວ່າມັນເປັນ. ມະນຸດໃນວົງວຽນແມ່ນການອອກແບບດຽວທີ່ກົງກັບຮູບແບບຄວາມລົ້ມເຫຼວ: ໃຜກວດສອບ, ໃຜສາມາດຢຸດມັນໄດ້, ສິ່ງທີ່ຖືກບັນທຶກໄວ້, ສິ່ງທີ່ເກີດຂຶ້ນຫຼັງຈາກເກີດຄວາມຜິດພາດ. ຖ້າຄຳຕອບແມ່ນ "ຮູບແບບ", ທ່ານບໍ່ມີຄຳຕອບ. ຮູບແບບບໍ່ໄດ້ໄປປະຊຸມຫຼັງຈາກເຫດການ. ສຳລັບການແພດ, ກົດໝາຍ, ສິນເຊື່ອ, ຫຼື ການປະຕິບັດງານທີ່ສຳຄັນຕໍ່ຄວາມປອດໄພ, ມະນຸດແມ່ນວົງວຽນ ແລະ ຮູບແບບແມ່ນໂຄງສ້າງຍ່ອຍ.
ຂ້ອຍຈະກະຕຸ້ນ AI ແນວໃດເພື່ອຂ້ອຍຈະຈັບຄວາມຜິດພາດໄດ້?
ຖາມຫາຄວາມບໍ່ແນ່ນອນໂດຍເຈດຕະນາ: "ສິ່ງໃດຈະເຮັດໃຫ້ສິ່ງນີ້ຜິດພາດ?" ແທນ "ເຮັດໃຫ້ມັນໝັ້ນໃຈ." ແຍກການຄົ້ນຫາຈາກລຸ້ນທີ່ທ່ານສາມາດເຮັດໄດ້. ເບິ່ງຂໍ້ຄວາມກ່ອນ, ຈາກນັ້ນຂໍໃຫ້ຂຽນຂຶ້ນ. ປ່ຽນຊຸດ: ເວົ້າຄືນໃໝ່, ຫຼືຂໍໃຫ້ມັນໂຕ້ຖຽງໃນສິ່ງທີ່ກົງກັນຂ້າມ. ບັງຄັບໃຊ້ຂໍ້ຈຳກັດເຊັ່ນ "ສະເພາະຈາກຂໍ້ຄວາມທີ່ຂ້ອຍວາງໄວ້" ຫຼື "ຖ້າຂາດ, ໃຫ້ບອກວ່າຂາດ," ແລະຍັງກວດສອບຢູ່. ມັກວຽກງານທີ່ມີຕົວກວດສອບ, ແລະສັງເກດເບິ່ງຄວາມເຈາະຈົງເປັນພິເສດ, ເພາະວ່ານັ້ນແມ່ນບ່ອນທີ່ອາການຫຼອນມັກແຕ່ງຕົວ.
ເອກະສານອ້າງອີງ
-
NIST - nvlpubs.nist.gov
-
NIST - airc.nist.gov
-
NIST - airc.nist.gov
-
ICO - ico.org.uk
-
NCSC - www.ncsc.gov.uk
-
NCSC - www.ncsc.gov.uk
-
OWASP - genai.owasp.org