Bakit Minsan Ginagawa Lang ng AI ang mga Bagay

Bakit Minsan Ginagawa Lang Ng AI Ang Mga Bagay [Video at Pagsusulit]

Maikling sagot: Minsan, gumagawa-gawa lang ang AI ng mga bagay-bagay dahil hinuhulaan nito ang mga kapani-paniwalang susunod na salita, hindi ang mga napatunayang katotohanan - ang kahusayan ay hindi patunay. Kapag ang paksa ay niche, may malaking pusta, o humihingi ng eksaktong mga pangalan at numero, ang mga puwang ay napupuno ng mga kumpiyansang hula maliban kung patunayan mo ang sagot at susuriin ang mga matibay na pahayag.

Mga artikulong maaaring gusto mong basahin pagkatapos nito:

🔗 Itigil ang pagtrato sa AI na parang Google.
Alamin kung bakit ang mas mahusay na mga resulta ng AI ay nangangailangan ng ibang pamamaraan.

🔗 Ang iyong unang wastong AI prompt
Bumuo ng isang malinaw at epektibong prompt gamit ang isang simpleng istruktura.

🔗 Ang 4 na bahagi ng isang mahusay na AI prompt
Tuklasin ang apat na mahahalagang elemento na nagpapabuti sa kalidad ng AI prompt.

🔗 Ano nga ba ang AI?
Unawain ang artificial intelligence sa simple, praktikal, at pang-araw-araw na termino.

Mga pangunahing punto:

Hindi alam ang hula: Ituring ang matatas na prosa bilang pagkumpleto ng padron, hindi kailanman bilang sinumpaang ebidensya.

Bitag ng kumpiyansa: Ang mapamilit na tono ay istilo; ang katumpakan ay nangangailangan ng hiwalay na pagsusuri sa labas ng usapan.

Pekeng pakete: Hanapin mismo ang mga pamagat ng sitasyon at mga sipi bago ka magtiwala sa mga maayos na listahan ng sanggunian.

I-ground ang tugon: I-paste ang mga tala ng pinagmulan at ipagbawal ang mga imbentong URL, pag-aaral, o istatistika.

Pag-audit ng tao: Suriin muna nang maaga ang mga pinakapeligrong pahayag, lalo na para sa kalusugan, batas, o pananalapi.

Bakit Minsan Ginagawa Lang Ng AI Ang Infographic

Ang Paghula ay Hindi Katulad ng Pag-alam

Narito ang prangka na bersyon: karamihan sa mga modelo ng chat ay mga pattern machine. Magtatanong ka. Bumubuo sila ng tugon na akma sa hugis ng isang mahusay na sagot. Kasama sa hugis na iyon ang mga katotohanan, tono, istruktura - ang buong kasuotan. Minsan ang kasuotan ay bumabalot ng totoong kaalaman. Minsan ay bumabalot ito ng isang kumpiyansang hula na pumuno sa isang puwang.

Sa tingin ko makakatulong ang isang maluwag na metapora, pagkatapos ay babaguhin ko ito nang kaunti. Isipin ang isang jazz pianist na nakarinig na ng milyun-milyong kanta. Hilingin sa kanila na patugtugin ang "iyong tungkol sa asul na maleta" at maaaring makaimbento sila ng isang magandang himig na hindi naman talaga umiral - dahil ang kahilingan ay parang dapat. Teka - labis na ipinagmamalaki nito ang sining. Parang autocomplete na lang na parang steroid. Kinukumpleto ng modelo ang isang kapani-paniwalang talata, hindi binubuksan ang isang filing cabinet na may label na Katotohanan.

Kaya kapag tinatanong ng mga tao kung Bakit Minsan Ginagawa ng AI ang mga Bagay-bagay, ang maikling sagot ay: ang mga puwang ay pinupunan ng anumang bagay na tila tama ayon sa istatistika. Ang pagkawala ng isang sitasyon ay humahantong sa modelo na mag-imbento ng isa na mukhang akademiko. Dahil hindi sigurado sa isang numero, nag-aalok ito ng isang maayos na numero. Kung walang panggitnang pangalan ng isang tao, gumagawa ito ng isa na akma sa panahon at kultura. Medyo nakakagulat sa una. Kapag nakita mo na ang pattern, hindi na gaanong nakakagulat. 

  • Ang matatas na teksto ang layunin ng paglikha—hindi ang napatutunayang katotohanan.
  • Ang mga kakulangan sa kaalaman ay nabubuhusan pa rin ng mga salita.
  • Maaaring talunin ng probabilidad na "tama ang tunog" ang "tama" sa ranggo ng modelo.

Kumpiyansa Laban sa Katumpakan - ang Awkward Gap

Nag-iingat ang mga tao kapag hindi sigurado. Sinasabi natin na "Sa tingin ko," "siguro," "Kailangan kong suriin." Maaari ring mag-ingat ang mga modelo - kung hihilingin mo sa kanila - ngunit ang mga default na output ay kadalasang parang isang kumpiyansang briefing. Ang pagiging matulungin ay isang katangian ng pagsasanay, hindi isang senyales na ang bawat pahayag ay may batayan.

Magkaibang dial ang kumpiyansa at katumpakan. Ang isa ay maaaring i-crank nang mataas habang ang isa ay halos zero. Naramdaman mo na rin ito sa mga tao: ang katrabaho na nagpapaliwanag ng maling proseso nang may lubos na katiyakan. Kayang gawin ng AI ang parehong sayaw, maliban sa mas mabilis at mas maayos na format.

Praktikal na aral: ituring ang mapamilit na pananalita bilang estilo, hindi ebidensya. Kung ang isang tugon ay walang mapagkukunan na maaari mong suriin, walang pag-amin ng kawalan ng katiyakan, at isang tumpok ng mga partikular na pangalan o numero - dahan-dahan lang. Ang pagiging tiyak nang walang batayan ay isang klasikong paraan ng pagpapahayag. 

  • Mapilit na tono ≠ napatunayang nilalaman.
  • Hilingin sa modelo na markahan nang may layunin ang mga kawalan ng katiyakan.
  • Mas gusto ko ang "ito ang hindi ko sigurado" kaysa sa pekeng airtight brief.

Mga Gawang-gawa na Pagbanggit at mga Detalye na Mukhang Totoo

Nakakainis ito dahil mukhang propesyonal. Pekeng pamagat ng papel. Pekeng pangalan ng journal. Pekeng URL na parang naki-click lang. Pekeng quote na iniuugnay sa mga sikat na tao. Kadalasang perpekto ang format - italic styling, sadyang iniiwasan ang mga placeholder na hugis taon, mga pangalan na parang may-akda - at ang packaging ay nanlilinlang sa mga skimmer.

Nangyayari ito sa isang hindi malinaw na dahilan. Karaniwan ang anyo ng pagbanggit sa teksto ng pagsasanay. Kapag humingi ka ng "mga sanggunian," maaaring makagawa ang modelo ng anyo ng iskolarsip nang hindi kinukuha ang isang tunay na tala. Parang paghiling sa isang tao na kumuha ng resibo mula sa memorya. Makakakuha ka ng isang bagay na mukhang resibo. Maaaring hindi kailanman umiral ang tindahan.

Minsan ay napanood ko ang isang draft na nag-imbento ng isang pag-aaral tungkol sa produktibidad ng remote work na may listahan ng mga awtor na mukhang malinis. Parang peer-reviewed lang. Wala naman talaga. Iyan ang panganib: nagrerelaks ang utak mo kapag mukhang mahal ang packaging. Huwag kang mag-relax. 

  • Humingi ng mga pamagat na maaari mong hanapin mismo - pagkatapos ay hanapin ang mga ito nang taimtim.
  • Maghinala sa mga maayos na quote-plus-attribution bundle na hindi mo naman hiniling.
  • Kung hindi agad mahanap ang isang "pinagmulan", ituring ang pahayag bilang hindi sinusuportahan.

Kapag Pinakamataas ang Panganib ng Imbensyon

Hindi lahat ng usapan ay pare-parehong mapanganib. Ang isang tula tungkol sa kape ay maaaring malayang makaimbento ng mga metapora - iyan ang punto. Ang dosis ng gamot, ang legal na deadline, ang patakaran sa pagpepresyo ng isang kakumpitensya, o ang isang makasaysayang pag-aangkin para sa isang nailathalang artikulo ay nabubuhay sa ibang planeta.

Tumataas ang panganib kapag ang paksa ay niche, bagong-bago ang dating, o lubos na espesipiko. Tumataas din ito kapag pinipilit mo ang eksaktong mga numero, mga pinangalanang dokumento, mga internal na detalye ng pribadong kumpanya, o "naglista ng sampung peer-reviewed na pag-aaral." Kung mas tumpak ang itatanong, mas tukso para sa modelo na punan ang mga patlang ng mga kapani-paniwalang mungkahi.

Ang mahaba at kahanga-hangang mga sagot ay maaaring mas mapanganib kaysa sa maiikling maingat na mga sagot. Ang haba ay parang pagsisikap. Ang pagsisikap ay parang pag-iingat. Ang pag-iingat ay parang katotohanan. Ang sunod-sunod na masasamang katotohanan ay kung paano napupunta sa mga slide deck ang masasamang katotohanan. 

  • Mataas na panganib: kalusugan, batas, pananalapi, pagsunod sa mga patakaran, kaligtasan, mga pinangalanang tao, eksaktong mga istatistika.
  • Katamtamang panganib: mga proseso ng niche sa industriya, mga setting ng tool, mga listahan ng "mga pinakamahusay na kasanayan".
  • Mas mababang panganib: brainstorming, pagbabalangkas, muling pagsusulat ng sarili mong burador, mga pag-edit ng tono.

Mapagkakatiwalaan vs. Mahinahong mga Output - Isang Mabilis na Paghahambing

Mas mainam ang isang mesa kaysa sa isa pang masiglang usapan. Kasama na ang mga kaunting kakaibang bagay, dahil ang mga ordinaryong pag-uusap ay kakaiba.

Senyales Ano ang hitsura nito Paano suriin Mabilis na solusyon
Tugon na may batayan Tinutugma ang mga dokumentong mayroon ka na; tinatanggap ang mga puwang; binabanggit ang mga pamagat na maaaring suriin Ihambing sa iyong mga source file o isang kilalang reference Hilingin dito na magsipi lamang mula sa naka-paste na teksto
Maling sagot na may kumpiyansa Maayos na prosa; mga tiyak na pangalan/numero; walang mga bakod Suriin muna nang tama ang isang hard claim "Markahan ang bawat pahayag bilang napatunayan / hindi sigurado / hindi alam"
Gawang-gawa na pagbanggit Magandang listahan ng mga sanggunian; mga pamagat na "dapat" umiiral Hanapin ang eksaktong pamagat; hanapin ang tunay na pahina ng awtor Ipagbawal ang mga imbentong sanggunian; ipatupad ang "sabihin kung hindi mo alam"
Tagapuno ng disenyo Mga pangkalahatang pinakamahusay na kasanayan na maaaring magkasya sa anumang kumpanya Itanong "ano ang maaaring magbago para sa aking mga limitasyon?" Idikit ang iyong mga konkretong limitasyon; humingi ng mga pinasadyang pag-edit
Sobrang kumpletong listahan Eksaktong sampung aytem noong humingi ka ng sampu - lahat ay maayos at maayos Hamunin ang aytem 3 at aytem 7 para sa ebidensya Payagan ang mas kaunting mga item; mas gusto ang kalidad kaysa sa bilang

Panatilihing malapit ang mental scorecard na iyan. Magsisimula kang mapansin ang mga nanginginig na resulta tulad ng paraan ng pagpansin mo sa isang medyo kakaiba na ngiti sa isang larawan - may naka-pose.

Paano Matuklasan ang mga Imbentong Sagot Nang Hindi Nagiging Paranoid

Hindi mo kailangang beripikahin ang bawat pang-uri. Kailangan mo ng murang beripikasyon para sa mga mahahalagang pahayag. Suriing mabuti ang pinakamatalas na bahagi: ang numero, ang pangalan, ang patakaran, ang sipi. Kung hindi mo mapatunayan ang mga iyon, ang natitirang bahagi ng sagot ay nasa probation.

Isa pang palatandaan: panloob na kontradiksyon. Sinasabi ng modelo na ang isang kasangkapan ay "palaging" gumagawa ng X, pagkatapos ay inilalarawan ang isang eksepsiyon na parang ito ay pamantayan. O kaya naman ay nag-iimbento ito ng isang tampok, pagkatapos ay ipinapaliwanag kung paano ito papatayin - tulad ng isang panaginip na patuloy na nag-iimbento ng mga pinto. Magtanong ng mga follow-up na tumutuklas sa mga mahihinang bahagi. Ang mga naimbentong mundo ay may posibilidad na umuga sa ilalim ng presyon.

Bantayan din ang "masyadong perpekto" na pagkakagawa. Bawat talata ay pantay na pino. Bawat rekomendasyon ay pantay na may kumpiyansa. Ang tunay na kadalubhasaan ay karaniwang may tekstura - mga babala, mga kompromiso, "depende." Ang perpektong pagkakagawa ay nararapat sa mas masusing pagsusuri. 

  • Suriin muna ang pinaka-mapanganib na pahayag, hindi ang buong sanaysay.
  • Magtanong ng "Ano ang pinaka-hindi ka sigurado?" at tingnan kung madulas ang maskara.
  • Suriin muli ang mga pangalan, titulo, at numero sa labas ng chat.
  • Mas gusto ang mga sagot na nakatali sa tekstong iyong idinikit kaysa sa mga malayang lumulutang na katotohanan.

Mga Agarang Gawi na Nagbabawas sa Imbensyon

Hindi mo maaalis ang mga halusinasyon gamit ang isang mahiwagang pangungusap - pasensya na - ngunit maaari mong paliitin ang radius ng pagsabog. Ang magagandang prompt ay nagpipigil sa laro. Ang mga hindi magagandang prompt ay nag-aanyaya ng improvisasyon.

Subukan ang mga ganitong gawi. Parang nakakabagot ang dating. Mas madalas itong epektibo kaysa sa mga tusong panlilinlang.

  • Saklaw ng kaalaman: "Gamitin lamang ang mga talang idinidikit ko. Kung may kulang, sabihin mong hindi mo alam."
  • Ipagbawal ang mga pekeng sanggunian: "Huwag mag-imbento ng mga sitasyon, sipi, o URL."
  • Mga label ng kawalan ng katiyakan ng puwersa: "Tag ang bawat bullet: alam / nahinuha / hula."
  • Humingi ng mga alternatibo: "Magbigay ng dalawang opsyon at kung bakit maaaring mali ang bawat isa."
  • Humingi ng duda na pumasa: "Ilista ang mga palagay na iyong ginawa."
  • Mas gusto ang istruktura kaysa sa kapaligiran: mga talahanayan, mga checklist, at mga kolum ng claim/ebidensya.

Nakakagulat na ang pagsasabi sa modelo na ayos lang na sabihing "Hindi ko alam" ay nakakabawas sa pressure ng lipunan na gawin ang katiyakan. Sinasalamin ng mga modelo ang takdang-aralin. Kung ang takdang-aralin ay nagbibigay ng gantimpala sa pagkakumpleto anuman ang mangyari, makakakuha ka ng kathang-isip na may formatting. Kung ang takdang-aralin ay nagbibigay ng gantimpala sa malinaw na pag-uusap tungkol sa mga kakulangan, makakakuha ka ng mas kaunting kumikinang na kasinungalingan. 

At oo - mahalaga ang mga follow-up. Ang mga unang tugon ay mga draft. "Mukhang peke ang citation na iyan - tanggalin ang anumang hindi mo ma-verify" ay isang normal na pangalawang mensahe. Ituring ang chat na parang pag-eedit, hindi parang isang vending machine na may utang na loob sa iyo ng katotohanan sa unang barya.

Pagsasandig, Mga Pagsubaybay, at Pamumuhay na May Kawalang-katiyakan

Ang grounding ay nangangahulugang pagtali ng sagot sa isang bagay na labas sa improvisasyon ng modelo: ang iyong naidikit na dokumento ng patakaran, ang iyong spreadsheet, ang iyong mga tala sa pagpupulong, isang kilalang pampublikong pahina na susuriin mo mismo. Kapag ang tugon ay dapat manatili sa loob ng bakod na iyon, mas kaunting espasyo ang maaaring patakbuhin ng imbensyon.

Ang mga follow-up ang pangalawang bakod. "Saan nanggaling ang numerong iyan?" "Aling bahagi ang hinuha?" "Isulat muli nang walang anumang pinangalanang pag-aaral." Ang bawat tanong ay isang maliit na pagsusuri. Sa palagay ko, iyan ang paraan ng matatanda sa paggamit ng mga kagamitang ito - hindi pagsamba, hindi pagkataranta, mga pagsusuri lamang.

Ang kawalan ng katiyakan ay hindi isang problema sa iyong daloy ng trabaho. Ito ay ang panahon. May mga araw na ang modelo ay gumagawa ng buod ng iyong sariling teksto. May mga araw na ito ay nag-iimbento ng isang subkomite na hindi kailanman nagpulong. Ang iyong trabaho ay magpasya kung aling mga output ang nangangailangan ng kapote. 

  • Idikit ang pinagmulang materyal kapag mahalaga ang katumpakan.
  • Humingi ng mga tag ng kumpiyansa sa antas ng pag-angkin.
  • Panatilihing updated ang isang tao sa mga mahahalagang desisyon.
  • Ilaan ang "malikhaing kalayaan" para sa mga malikhaing gawain - hindi ang pagsunod.

Ano ang Gagawin Kapag Nakaranas Ka ng Halusinasyon sa Kalagitnaan ng Daloy

Huwag mag-spiral. Huwag mong isumpa ang gamit habang-buhay na parang tinatraydor ka nito mismo - kahit na ang pagnanasa ay maaaring maging matalim. Itama ang sinulid at magpatuloy.

Isang simpleng siklo ng pagbawi:

  • Sabihin na: "Mukhang imbento lang ang pinagmulang iyan. Alisin ang mga hindi sinusuportahang pahayag."
  • Muling i-anchor: i-paste ang totoong dokumento, sipi, o datos.
  • Muling buuin nang makitid: humingi ng naitama na seksyon, hindi ng isang bagong sanaysay na walang kabuluhan.
  • Suriin muli ang mga matutulis na gilid: mga pangalan, numero, mga hakbang sa proseso.
  • Magpasya sa antas ng tiwala: brainstorming partner vs draft assistant vs "hindi para sa paksang ito."

Ang pagkahuli sa isang halusinasyon ay maaaring mapabuti ang natitirang bahagi ng pag-uusap - kung hihigpitan mo ang mga limitasyon. Ang modelo ay hindi "nakakaramdam ng pagkakasala," ngunit ang iyong mas malinaw na mga tagubilin ay nagbabago kung para saan ito ino-optimize. Ikaw ang nagmamaneho. Magmaneho nang mas mahigpit kapag lumitaw ang pagiging malikhain. 

Mga Pang-araw-araw na Senaryo Kung Saan Ito Tahimik na Mahalaga

Mga email sa trabaho: ang isang inimbentong "timeline ng pamantayan ng industriya" ay maaaring magtakda ng mga inaasahan na hindi mo matutugunan. Paaralan at pag-aaral: ang isang pekeng paliwanag ay maaaring manatili sa iyong isipan bago mo mapansin. Mga draft ng suporta sa customer: ang isang gawa-gawang patakaran sa refund ay nagiging isang pangako. Malikhaing pagsusulat: mag-imbento na lang - iyan ang palaruan.

Ang kabuuan ay bunga. Kung ang mga maling salita ay nagkakahalaga ng pera, tiwala, grado, o kaligtasan, ang pagpapatunay ay hindi opsyonal na gawain. Kung ang mga maling salita ay katumbas lamang ng pagkibit-balikat, kumalma ka. Ang pag-iingat sa bunga ay ang kasanayan ng isang nasa hustong gulang dito - higit pa sa pagsasaulo ng salitang "hallucination."

Gayundin: dapat gawing normal ng mga koponan ang "Na-verify ko ang claim na ito" sa paraang normal nila ang "napasa ang spellcheck." Kung hindi, ang isang pinakintab na talata ay magiging kaalaman sa tribo sa isang iglap. Naku.

Mga Pangunahing Puntos

Kaya - Kung Bakit Minsan Nag-iimbento ang AI ng mga Bagay-bagay ay ganito ang takbo ng isip: hinuhulaan ng mga sistemang ito ang kapani-paniwalang wika, pinupunan ang mga puwang gamit ang pagtutugma ng mga pattern, at kadalasang mukhang sigurado habang ginagawa ito. Ang kombinasyong iyon ay lumilikha ng mga kumpiyansang maling sagot, mga gawa-gawang pagbanggit, at mga maayos na detalye na hindi naman nangyari.

Hindi mo kailangang matakot sa kagamitan. Kailangan mo ng mga gawi. Suriin nang mabuti ang mga matibay na pahayag. Ipagbawal ang mga imbentong sanggunian. Idikit ang mga konkretong konteksto. Humingi ng mga kawalang-katiyakan. Gamitin ang mga follow-up bilang mga audit. Ilaan ang malayang henerasyon para sa mga gawaing malikhain na mababa ang pusta.

Ang kahusayan ay hindi isang reperensya sa karakter. Ituring ito na parang isang mahuhusay na intern na mabilis mag-type, minsan ay nag-iimbento ng meeting na hindi naman naganap, at kaya pa ring mag-excel kahit may superbisyon. Panatilihin ang superbisyon. Panatilihin ang talino. Panatilihing magaan ngunit may batayan ang pag-aalinlangan. Ganoon mo makukuha ang positibong aspeto nang hindi nagbabalatkayo sa kathang-isip bilang katotohanan.

Praktikal na halimbawa: Pagkuha ng mga imbentong sitasyon sa isang maikling pananaliksik ng isang kakumpitensya

Parang abstrak ang mga halusinasyon hanggang sa halos mapunta sa isang client deck ang isang pinakintab na talata. Narito kung paano ginamit ng isang marketing analyst sa UK ang mga nakagawian sa gabay na ito upang pigilan ang pagpapadala ng mga kathang-isip na parang pananaliksik - nang hindi tinatalikuran ang chatbot.

Senaryo

May dalawang oras si Sam para magsulat ng isang pahinang brief tungkol sa mga kakumpitensya para sa pagsisimula ng benta. Pamilyar na ang tanong: mga kalakasan, mga senyales sa pagpepresyo, at "ilang kapani-paniwalang mapagkukunan." Sa dating gawi, nag-type si Sam ng "summarize Competitor X with sources" at nakakuha ng isang maayos na brief na may tatlong akademikong sitasyon at isang tumpak na porsyento ng market-share. Parang briefed lang ito. Karamihan ay inimbento lang. Walang nakitang kahit isang pamagat. Ang bilang ng share ay hindi lumabas sa site ng kakumpitensya.

Hindi kailangan ni Sam ng mas maayos na modelo. Kailangan ni Sam ng isang maayos na daloy ng trabaho: idikit ang mga tala ng pinagmulan, ipagbawal ang mga pekeng pinagmulan, pilitin ang mga label ng kawalan ng katiyakan, suriin muna ang pinakamatalas na pahayag, pagkatapos ay muling buuin lamang ang sirang bahagi.

Ang layunin ay isang maikling pahayag na mapagkakatiwalaan ng pangkat bilang mga puntong pag-uusapan - hindi isang resibo na hango sa alaala na nagmumukhang resibo lamang.

Ang kailangan ng katulong

  • Pinagmulan ng materyal na mayroon na si Sam: kopya ng homepage, teksto ng pahina ng pagpepresyo, dalawang kamakailang tiket ng suporta, mga tala mula sa isang nawalang kasunduan
  • Isang mahigpit na tuntunin: gumamit lamang ng naka-paste na teksto para sa mga pahayag na batay sa katotohanan; sabihin ang "Hindi ko alam" kapag walang nakasulat na mga tala
  • Pagbabawal sa mga imbentong sitasyon, sipi, URL, at estadistika
  • Isang hugis ng output na naghihiwalay sa alam / nahinuha / hula
  • Panahon na para sa isang human spot-check ng mga pangalan, numero, at anumang "pinagmulan" na titulo bago ibahagi ang deck
  • Pahintulot na magtanong ng hanggang tatlong tanong na nagpapaliwanag sa halip na punan ang mga puwang

Halimbawang tagubilin

Mensahe 1 - grounded brief: Gamit lamang ang mga talang ipi-paste ko sa ibaba, bumuo ng isang pahinang one-page na competitor brief para sa mga benta. Mga Seksyon: Ang kanilang inaangkin / Ang mga reklamo ng mga customer / Mga senyales ng pagpepresyo / Mga bukas na tanong. Huwag mag-imbento ng mga sitasyon, quote, URL, o istatistika. Kung ang isang katotohanan ay wala sa mga tala, isulat ang "hindi alam" at ilista ito sa ilalim ng Mga Bukas na Tanong. Lagyan ng label ang bawat bullet: alam / nahinuha / hula. UK English. Walang paunang salita.

Mensahe 2 - pag-iwas sa pagdududa: Ilista ang bawat palagay na iyong ginawa. Alisin ang anumang may tag na hula maliban kung maituturo mo ang isang naka-paste na pangungusap na sumusuporta dito. Kung dati ka nang nag-imbento ng isang pinagmulan, burahin ito at sabihin ito.

Mensahe 3 - muling buuin nang makitid: Hindi sinusuportahan ang linya ng bahagi sa merkado. Isulat muli ang seksyong Mga senyales ng pagpepresyo nang walang mga numero maliban kung lumalabas ang mga ito sa aking mga tala. Panatilihin ang iba pang mga seksyon.

Paano ito subukan

  • Magpatakbo ng isang walang-saysay na tanong ("ibuod ang Kakumpitensya X gamit ang tatlong peer-reviewed na mapagkukunan") at ang pinagbatayang maikling pahayag sa itaas. Paghambingin ang mga imbentong pamagat at mga pekeng istatistika.
  • Suriin muna nang tama ang pinaka-mapanganib na pahayag (isang numero o pinangalanang pag-aaral), hindi ang buong pahina.
  • Itanong: "Ano ang hindi mo lubos na natitiyak?" Ang isang malakas na sagot ay tumutukoy sa mga puwang; ang isang matibay na sagot ay tumutukoy sa mga puwang.
  • Edge case: alisin ang presyo mula sa mga naka-paste na tala at kumpirmahin na ang nakasaad sa draft ay "unknown" sa halip na mag-imbento ng planong presyo.
  • Mga pagsusuri sa pagtanggap bago ibahagi: (1) bawat "kilalang" bullet ay tumutugma sa isang nakadikit na linya, (2) walang mga gawa-gawang sitasyon, (3) ang mga bukas na tanong ay naglilista ng mga tunay na puwang, (4) ikaw mismo ang naghanap ng anumang natitirang pamagat, (5) walang eksaktong istatistika na walang tala sa likod ng mga ito.

Resulta

Isang naglalarawang resulta (halimbawang pagtatantya para sa daloy ng trabaho ng isang analyst tungkol sa competitor-brief, hindi isang nailathalang pag-aaral): Sa 8 gawain sa briefing, ang oras sa orasan mula sa "mga talang bukas" hanggang sa "draft na handa na para sa human fact-check" ay bahagyang tumaas mula sa median na humigit-kumulang 12 minuto (one-shot polished fiction) hanggang sa humigit-kumulang 15 minuto gamit ang grounded prompt - ngunit nabawasan ang panganib ng paglilinis at pagkapahiya. Ang pag-verify ng mga hard claim ng tao ay bumaba mula sa median na humigit-kumulang 18 minuto (paghabol sa mga pekeng pamagat at muling pagsusulat) hanggang sa humigit-kumulang 6 na minuto nang ang mga claim ay na-pre-tag na at ang mga imbentong source ay ipinagbawal, kaya ang net time ay bumaba ng humigit-kumulang 9 na minuto bawat brief, o humigit-kumulang 72 minuto sa buong set. Sa isang checklist ng pagtanggap (walang imbentong mga citation, walang hindi sinusuportahang istatistika, may mga kilalang/hinuha/hulaan na tag, mga bukas na tanong na nagbibigay ng pangalan sa mga puwang), 7 sa 8 grounded draft ang pumasa sa unang pagsusuri kumpara sa 2 sa 8 one-shot draft. Mga Limitasyon: maliit na sample, isang analyst, isang uri ng brief; ang mga madaling kakumpitensya na may malinaw na pampublikong pagpepresyo ay nagpapaliit sa puwang; Kasama sa "oras ng pag-verify" ang mga paghahanap sa web para sa mga kahina-hinalang titulo.

Para sukatin ang sarili mong bersyon: gumawa ng 5 brief na naglalaman ng kasalukuyan mong nakagawian at 5 na naglalaman ng mga nakadikit na sanggunian + mga ipinagbawal na imbensyon at mga sitasyon + mga claim tag; itala ang median draft time, median verification time, at pass rate sa checklist gamit ang ipinapakitang denominator.

Ano ang maaaring magkamali

  • Pagkiling sa Katatasan: Ang perpektong gramatika at maayos na mga punto ay magpapalampas sa iyo ng spot-check.
  • Cosplay sa pagbanggit: Ang paghingi ng "mga sanggunian" nang walang nakadikit na materyal ay nag-aanyaya sa anyo ng iskolarsip nang walang katugmang rekord.
  • Mga listahang sobrang kumpleto: Nakakadagdag ng gantimpalang "Bigyan mo ako ng sampung pag-aaral" kapag tatlo lang ang nasa iyong mga tala.
  • Muling pagbubuo ng buong sanaysay: Pagkatapos ng isang pekeng linya, humingi ng maikling pagsulat muli ng seksyong iyon - hindi ng panibagong pagpipino.
  • Mga paksang may malaking panganib: Ang kalusugan, batas, pananalapi, at pagsunod sa mga patakaran ay nangangailangan ng mas matibay na pantaong pamamaraan kaysa sa isang maikling talakayan tungkol sa pagbebenta.
  • Walang paulit-ulit na pagbabago ng isip: Maaari pa ring magkamali sa pagbasa ng isang naka-tag na draft sa isang naka-paste na pangungusap. Si Sam pa rin ang may-ari ng share button.

Praktikal na takeaway

Gumagawa-gawa lang ang AI ng mga bagay-bagay dahil hinuhulaan nito ang mga kapani-paniwalang salita sa mga puwang -- hindi dahil gusto ka nitong linlangin. Ituring ang kahusayan bilang istilo, hindi ebidensya. Idikit ang bakod, ipagbawal ang mga pekeng sanggunian, lagyan ng label ang kawalan ng katiyakan, tiyaking suriin ang pinakamatalas na pahayag, at itama ang thread kapag may umuurong-sulong. Ganoon mo napapanatili ang bentahe ng isang mabilis na kasosyo sa pagbalangkas nang hindi nagpapadala ng isang kumpiyansang kuwento na hindi naman nangyari.

Mga Madalas Itanong

Bakit minsan nag-iimbento lang ang AI ng mga bagay-bagay?

Karamihan sa mga modelo ng chat ay mga pattern machine: bumubuo sila ng tugon na akma sa hugis ng isang mahusay na sagot, hindi isang beripikadong filing cabinet na may label na Katotohanan. Ang mga puwang ay pinupunan ng anumang tila tama sa istatistika - isang sitasyon na mukhang akademiko, isang maayos na numero, o isang detalye na akma sa panahon. Ang matatas na teksto ang layunin ng henerasyon, kaya ang "tama ang tunog" ay maaaring talunin ang "tama." Kaya naman ang mga inimbentong sagot ay kadalasang dumarating na may perpektong gramatika at maayos na mga bullet.

Pareho ba ang kumpiyansa sa AI at katumpakan?

Hindi. Magkaibang pamantayan ang kumpiyansa at katumpakan - maaaring umupo nang mataas ang isa habang ang isa ay malapit sa zero. Ang mga default na output ay kadalasang parang isang kumpiyansang briefing dahil ang pagsasanay ay nagbibigay ng gantimpala sa kapaki-pakinabang na pag-aayos, hindi dahil ang bawat pahayag ay may batayan. Ituring ang mapamilit na mga parirala bilang istilo, hindi ebidensya. Kung ang isang tugon ay walang masusuring mapagkukunan, walang kawalang-katiyakan, at maraming partikular na pangalan o numero, dahan-dahan lang.

Bakit nag-iimbento ng mga citation at pekeng source ang mga chatbot?

Karaniwan ang anyo ng pagbanggit sa mga tekstong pang-sanay, kaya ang pagtatanong ng mga "pinagmulan" ay maaaring magdulot ng anyong iskolarsip nang hindi kinukuha ang isang tunay na tala -- tulad ng pagkuha ng resibo mula sa memorya. Ang mga pekeng pamagat ng papel, pangalan ng journal, URL, at mga sipi na may kaugnayan ay kadalasang mukhang propesyonal para linlangin ang mga skimmer. Humingi ng mga pamagat na maaari mong hanapin mismo; kung hindi mahanap agad ang isang pinagmulan, ituring ang pahayag bilang hindi sinusuportahan.

Kailan pinakamataas ang panganib ng pag-imbento ng AI?

Tumataas ang panganib para sa mga paksang may espesyalidad, mga paksang may kinalaman sa mga kamakailang isyu, o mga partikular na paksa, at kapag pinipilit mo ang eksaktong mga numero, mga dokumentong may pangalan, mga pribadong internal na imbestigasyon, o mahahabang listahan ng mga pag-aaral na sinuri ng mga kapwa eksperto. Kabilang sa mga lugar na may mataas na panganib ang kalusugan, batas, pananalapi, pagsunod sa mga patakaran, kaligtasan, mga taong may pangalan, at eksaktong mga istatistika. Ang pag-brainstorm, pagbabalangkas, muling pagsusulat ng sarili mong draft, at mga pag-edit ng tono ay kadalasang mas mababa ang panganib. Ang mahahabang kahanga-hangang mga sagot ay maaari ring magmukhang mas ligtas kaysa sa kung ano talaga ang mga ito.

Paano ko matutukoy ang mga imbentong sagot sa AI nang hindi sinusuri ang bawat salita?

Suriin muna nang mabuti ang pinakamatalas na bahagi - ang numero, pangalan, patakaran, o sipi. Kung hindi, hayaang mabigyan ng probasyon ang iba. Bantayan ang mga panloob na kontradiksyon at "napakaperpektong" pagkakasulat nang walang anumang babala o kompromiso. Tanungin kung ano ang hindi gaanong sigurado sa modelo, suriin muli ang mga pangalan at titulo sa labas ng chat, at piliin ang mga sagot na nakatali sa tekstong iyong idinikit kaysa sa mga walang-saysay na katotohanan.

Anong mga gawi sa pag-iingat ang nakakabawas sa mga halusinasyon ng AI?

Hindi mo maaalis ang mga halusinasyon gamit ang isang mahiwagang pangungusap, ngunit maaari mong paliitin ang radius ng pagsabog. Gamitin ang kaalaman sa saklaw sa mga naka-paste na tala at sabihing "Hindi ko alam" kapag may kulang. Ipagbawal ang mga imbentong sitasyon, panipi, at URL. Pilitin ang mga tag tulad ng kilala / nahinuha / hula, humingi ng mga pagpapalagay, at piliin ang istruktura ng claim/ebidensya. Ang pagsasabi sa modelo na ayos lang na sabihing "Hindi ko alam" ay nakakabawas sa presyon na magsagawa ng maling katiyakan.

Ano ang ibig sabihin ng grounding kapag gumagamit ng AI para sa gawaing faktual?

Iniuugnay ng grounding ang sagot sa isang bagay na nasa labas ng improvisasyon ng modelo - ang iyong dokumento ng patakaran, spreadsheet, mga tala ng pulong, o isang pampublikong pahina na ikaw mismo ang susuri. Kapag ang mga tugon ay dapat manatili sa loob ng bakod na iyon, mas kaunting espasyo ang makukuha sa imbensyon. Ang mga follow-up ay nagsisilbing pangalawang bakod: magtanong kung saan nagmula ang isang numero, kung aling bahagi ang hinuha, o muling isulat nang walang pinangalanang mga pag-aaral. Panatilihing updated ang isang tao para sa mga desisyong may malaking pusta.

Ano ang dapat kong gawin kapag nakarinig ako ng halusinasyon sa kalagitnaan ng pag-uusap?

Ipaalam na ito, muling iugnay ang totoong dokumento o datos, at buuin muli ang sirang bahagi sa halip na humiling ng isang bagong-bagong pinakintab na sanaysay. Suriin muli ang mga matatalim na bahagi - mga pangalan, numero, mga hakbang sa proseso - pagkatapos ay magpasya kung ang tool ay isang brainstorming partner, draft assistant, o "hindi para sa paksang ito." Ang mas malinaw na mga limitasyon ay nagbabago kung para saan ino-optimize ang modelo; mas magsikap na magmaneho kapag lumitaw ang pagiging malikhain.

Paano ko mapipigilan ang mga imbensyong sitasyon sa isang research brief ng isang kakumpitensya?

I-paste ang mga tala ng pinagmulan na mayroon ka na, ipagbawal ang mga pekeng pinagmulan at mga hindi sinusuportahang istatistika, at humingi ng mga kilalang / nahinuha / mga tag ng hula kasama ang isang listahan ng mga bukas na tanong. Suriin muna nang tama ang pinaka-mapanganib na pahayag, magpatakbo ng isang doubt pass na nag-aalis ng mga hula nang walang suporta, at isulat muli lamang ang sirang seksyon kung ang isang numero ay hindi sinusuportahan. Ang pagtanggap ay nangangahulugan na ang bawat "kilalang" bullet ay tumutugma sa isang naka-paste na linya at ang anumang natitirang pamagat ay hahanapin ng isang tao.

Kailan pa ba ayos lang na hayaan ang AI na malayang mag-imbento?

Ang malikhaing pagsulat at iba pang mga gawaing mababa ang pusta ay malayang makakaimbento ng mga metapora - iyan ang palaruan. Itugma ang pag-iingat sa kahihinatnan: kung ang mga maling salita ay nagkakahalaga ng pera, tiwala, grado, o kaligtasan, ang beripikasyon ay hindi opsyonal. Kung ang mga ito ay nagkakahalaga lamang ng pagkibit-balikat, kumalma ka. Ang kahusayan ay hindi isang sanggunian sa karakter; ituring ang modelo na parang isang mabilis na intern na nangangailangan pa rin ng superbisyon sa gawaing faktual.

Mga Sanggunian

  1. OpenAIopenai.com
  2. Antropikoanthropic.com
  3. NIST - nist.gov
  4. IBM - ibm.com
  5. Google AI - ai.google.dev
  6. Google Cloud - Pag-ground - docs.cloud.google.com
Pagsusulit
1. Ayon sa artikulo, bakit minsan ay nag-iimbento lang ang AI ng mga bagay-bagay?

2. Paano mo dapat tratuhin ang matatas na prosang AI?

3. Ano ang "kumpiyansa" na inilarawan sa gabay?

4. Ano ang dapat mong gawin bago magtiwala sa maayos na mga listahan ng sanggunian ng AI?

5. Aling gawi ang nakakatulong na mabawasan ang mga imbentong sagot, ayon sa artikulo?


Balik sa blog