
Inilabas ng OpenAI ang GPT-4, isang Multi-modal AI
Ang OpenAI ay mayroon anunsyado ang pagpapalabas ng isang advanced na modelo ng AI na tinatawag na GPT-4, na nagpapakita ng mga natatanging kakayahan sa pag-unawa sa parehong mga imahe at teksto sa pamamagitan ng pinahusay na machine learning. Ang pagbabagong ito ay nagmamarka ng isang makabuluhang milestone sa paglalakbay ng kumpanya upang mapahusay ang mga teknolohiya sa malalim na pag-aaral.
Maaaring ma-access ng OpenAI ang GPT-4 Chat GPT Dagdag pa sa mga subscriber, napapailalim sa limitasyon sa paggamit, habang ang mga developer ay maaaring sumali sa waitlist para sa API access.
Ang istraktura ng pagpepresyo ay nagsasangkot ng $0.03 na bayad para sa bawat 1,000 “prompt” na token (katumbas ng humigit-kumulang 750 salita) at $0.06 para sa bawat 1,000 “pagkumpleto” na mga token (muli, humigit-kumulang 750 salita). Ang mga token ay ang mga bloke ng pagbuo ng teksto; halimbawa, ang salitang "fantastic" ay mahahati sa mga token na "fan," "tas," at "tic." Binubuo ang mga prompt token ng mga word segment na input sa GPT-4, habang ang mga completion token ay tumutukoy sa content na nabuo ng AI model.
Kapansin-pansin, ang GPT-4 ay maingat na nagpapatakbo, gaya ng inihayag ni Pagkumpirma ng Microsoft na ang Bing Chat, isang teknolohiya ng chatbot na binuo kasama ng OpenAI, ay pinapagana ng GPT-4.
Mga Maagang Nag-ampon ng GPT-4
Maraming mga naunang nag-adopt ay gumagamit na ng potensyal ng GPT-4. Ginagamit ng Stripe ang modelo ng AI upang suriin ang mga website ng negosyo at magbigay ng mga buod sa mga koponan ng suporta sa customer. Isinama ng Duolingo ang GPT-4 sa isang bagong antas ng subscription sa pag-aaral ng wika.
Si Morgan Stanley ay bumubuo ng isang GPT-4-driven na sistema upang kunin ang impormasyon mula sa mga dokumento ng kumpanya para sa mga financial analyst. Bukod pa rito, ginagamit ng Khan Academy ang GPT-4 upang lumikha ng isang awtomatikong solusyon sa pagtuturo.
Ang GPT-4 ay nagpakita ng kahanga-hangang pagganap sa iba't ibang propesyonal at pang-akademikong mga benchmark, na nakakamit ng mga resultang "antas ng tao". Halimbawa, sa isang simulate bar exam, nakapuntos ang GPT-4 sa nangungunang 10% ng mga kumuha ng pagsusulit, isang kapansin-pansing pagpapabuti sa pinakamababang 3.5% na marka ng GPT-10.
Kalahating taon ng pag-unlad
Ang OpenAI ay gumugol ng anim na buwang pagpino sa GPT-4 gamit ang mga insight mula sa isang panloob na adversarial testing program at ChatGPT. Ang resulta ay isang modelo na ipinagmamalaki ang walang kapantay na katumpakan, kakayahang makontrol, at ang kakayahang gumana sa loob ng paunang natukoy na mga hadlang.
Upang sanayin ang GPT-4, nakipagtulungan ang OpenAI sa microsoft upang lumikha ng custom na "supercomputer" sa Azure cloud. Ang modelo ay sinanay gamit ang pampublikong available na data at mga lisensyadong data source, na nagreresulta sa isang versatile at well-rounded language model.
Naiintindihan ng GTP-4 ang mga imahe, tulad ng teksto
Ang isa sa mga pinaka nakakaintriga na aspeto ng GPT-4 ay ang kakayahan nitong unawain ang mga larawan bukod sa text. Halimbawa, maaari nitong makilala at bigyang-kahulugan ang medyo kumplikadong mga larawan, tulad ng pagtukoy ng Lightning Cable adapter mula sa isang imahe ng isang naka-plug-in na iPhone.
Habang ang tampok na pag-unawa sa imahe ay hindi pa magagamit sa lahat ng mga customer ng OpenAI, ito ay sinusuri gamit ang Maging ang aking mga mata, isang single partner. Ang Be My Eyes' Virtual Volunteer feature, na pinapagana ng GPT-4, ay makakasagot sa mga tanong tungkol sa mga larawang ipinapadala dito. Sa isang post sa blog, ipinaliwanag ng kumpanya kung paano gumagana ang feature na ito:
“Kung ang isang user ay magpapadala ng larawan ng loob ng kanilang refrigerator, ang Virtual Volunteer ay hindi lamang matukoy nang tama kung ano ang nasa loob nito kundi pati na rin mag-extrapolate at magsuri kung ano ang maaaring ihanda sa mga sangkap na iyon. Ang tool ay maaari ring mag-alok ng ilang recipe para sa mga sangkap na iyon at magpadala ng sunud-sunod na gabay sa kung paano gawin ang mga ito."
Ang feature na "Steerability tooling".
Ang bagong feature na "steerability tooling" ay nagbibigay-daan sa mga developer na magreseta tiyak na mga tagubilin sa AI upang itakda ang tono at mga hangganan para sa mga pakikipag-ugnayan nito. Ang tampok na ito ay ginawang posible sa pamamagitan ng pagpapakilala ng isang bagong kakayahan ng API na tinatawag na "system" na mga mensahe.
Ang mga mensahe ng system ay mahalagang mga tagubilin na nagbibigay ng istilo at gawain na dapat sundin ng AI. Para silang mga alituntunin na nagdidikta kung paano dapat kumilos ang AI sa isang partikular na sitwasyon. Matatanggap din ng ChatGPT ang tampok na ito sa hinaharap.
Halimbawa, maaaring tukuyin ng isang mensahe ng system na ang AI ay dapat kumilos bilang isang tutor na palaging tumutugon sa istilong Socratic. Sa kasong ito, hindi kailanman direktang ibibigay ng AI sa estudyante ang sagot ngunit palaging magtatanong ng mga tamang tanong upang matulungan silang matutong mag-isip para sa kanilang sarili.
KAUGNAYAN: 12 Mga Paggamit ng AI sa Edukasyon
Bukod pa rito, palaging ia-adjust ng AI ang mga tanong nito batay sa interes at kaalaman ng mag-aaral, hinahati-hati ang mga kumplikadong problema sa mas simpleng bahagi hanggang sa maabot nila ang tamang antas.
Sa kabila ng pagpapakilala ng mga mensahe ng system at iba pang mga pag-upgrade, kinikilala ng OpenAI na ang GPT-4 may flaws pa rin. Ang AI ay maaari pa ring gumawa ng mga pagkakamali sa pangangatwiran at kahit na "hallucinate" na mga katotohanan. Halimbawa, minsang inilarawan ng GPT-4 si Elvis Presley bilang "anak ng isang artista," na hindi tama.
Ano ang mga limitasyon ng GPT-4
Ayon sa OpenAI, ang GPT-4 ay dumaranas ng kakulangan ng kaalaman tungkol sa mga kamakailang kaganapan na naganap pagkatapos ng Setyembre 2021, na kung saan ang data nito ay naputol. Bukod pa rito, hindi natututo ang GPT-4 mula sa karanasan, na kung minsan ay maaaring magresulta sa mga simpleng error sa pangangatwiran na hindi sumasalamin sa malawak nitong kaalaman sa maraming domain.
Bukod dito, ang GPT-4 ay maaaring masyadong mapagkakatiwalaan pagdating sa pagtanggap ng malinaw na maling mga pahayag mula sa mga user at maaari pa ngang mabigo sa mahihirap na gawain, tulad ng pagpasok ng mga kahinaan sa seguridad sa code na nabuo nito.
Final Words
Sa kabila ng mga limitasyong ito, inaangkin ng OpenAI na ang GPT-4 ay gumawa ng mga makabuluhang pagpapabuti sa ilang mga lugar. Halimbawa, ang GPT-4 ay mas malamang na makabuo ng mga tagubilin kung paano mag-synthesize ng mga mapanganib na kemikal. Kung ihahambing sa GPT-3.5, ang GPT-4 ay 82% na mas malamang na tumugon sa mga kahilingan para sa "hindi pinapayagan" na nilalaman.
Higit pa rito, ang GPT-4 ay mas sumusunod na ngayon sa mga patakaran ng OpenAI pagdating sa pagbibigay ng sensitibong impormasyon, tulad ng payong medikal at mga paksang nakakapinsala sa sarili, na tumutugon ito sa 29% na mas madalas kaysa sa nauna nito.














