
OpenAI, 멀티모달 AI GPT-4 출시
OpenAI는 발표 개선된 기술을 통해 이미지와 텍스트를 모두 이해하는 뛰어난 능력을 보여주는 GPT-4라는 고급 AI 모델이 출시되었습니다. 기계 학습이 혁신은 딥 러닝 기술을 향상하기 위한 회사의 여정에서 중요한 이정표를 나타냅니다.
GPT-4는 OpenAI에서 액세스할 수 있습니다. ChatGPT Plus 구독자는 사용 한도가 적용되고, 개발자는 API 액세스를 위해 대기자 명단에 가입할 수 있습니다.
가격 책정 구조에는 0.03개의 "프롬프트" 토큰(약 1,000단어에 해당)당 750달러, 0.06개의 "완료" 토큰(역시 약 1,000단어)당 750달러의 수수료가 포함됩니다. 토큰은 텍스트의 구성 요소입니다. 예를 들어, "fantastic"이라는 단어는 "fan", "tas", "tic"이라는 토큰으로 나뉩니다. 프롬프트 토큰은 GPT-4에 입력된 단어 세그먼트로 구성되는 반면, 완료 토큰은 AI 모델에서 생성된 콘텐츠를 나타냅니다.
흥미롭게도 GPT-4는 다음에서 밝혀진 바와 같이 신중하게 작동되었습니다. 마이크로소프트의 확인 OpenAI와 공동 개발한 챗봇 기술인 Bing Chat은 GPT-4를 기반으로 합니다.
GPT-4의 초기 채택자
몇몇 초기 채택자는 이미 GPT-4의 잠재력을 활용하고 있습니다. Stripe는 AI 모델을 사용합니다 비즈니스 웹사이트를 분석하고 고객 지원 팀에 요약을 제공합니다. Duolingo는 GPT-4를 새로운 언어 학습 구독 레벨에 통합했습니다.
Morgan Stanley는 GPT-4 기반 시스템을 개발하고 있습니다. 재무 분석가를 위해 기업 문서에서 정보를 추출합니다. 또한 Khan Academy는 GPT-4를 활용하여 자동화된 튜터링 솔루션을 만듭니다.
GPT-4는 다양한 전문 및 학술 벤치마크에서 놀라운 성과를 보였으며 "인간 수준"의 결과를 달성했습니다. 예를 들어, 모의 변호사 시험에서 GPT-4는 시험 응시자 상위 10%, GPT-3.5의 하위 10% 점수에 비해 눈에 띄게 개선되었습니다.
반년의 개발기간
OpenAI는 내부 적대적 테스트 프로그램과 ChatGPT의 통찰력을 사용하여 GPT-4를 미세 조정하는 데 XNUMX개월을 보냈습니다. 그 결과, 비교할 수 없는 정확성, 조종성 및 사전 정의된 제약 내에서 작동할 수 있는 능력을 자랑하는 모델이 탄생했습니다.
GPT-4를 훈련하기 위해 OpenAI는 다음과 협력했습니다. Microsoft Azure 클라우드에서 사용자 지정 "슈퍼컴퓨터"를 만듭니다. 이 모델은 공개적으로 사용 가능한 데이터와 라이선스가 있는 데이터 소스를 사용하여 학습되었으며, 다재다능하고 균형 잡힌 언어 모델이 탄생했습니다.
GTP-4는 텍스트와 마찬가지로 이미지를 이해할 수 있습니다.
GPT-4의 가장 흥미로운 측면 중 하나는 다음과 같은 기능입니다. 이미지를 이해하다 텍스트 외에도. 예를 들어, 플러그인된 iPhone 이미지에서 Lightning 케이블 어댑터를 식별하는 것과 같이 비교적 복잡한 이미지를 인식하고 해석할 수 있습니다.
이미지 이해 기능은 아직 모든 OpenAI 고객에게 제공되지 않지만 테스트 중입니다. 내 눈이 되라, 단일 파트너. GPT-4로 구동되는 Be My Eyes의 가상 자원봉사 기능은 전송된 이미지와 관련된 질문에 답할 수 있습니다. 블로그 게시물에서 회사는 이 기능의 작동 방식에 대해 자세히 설명했습니다.
"사용자가 냉장고 내부 사진을 보내면 Virtual Volunteer는 냉장고에 무엇이 들어 있는지 정확하게 식별할 수 있을 뿐만 아니라 해당 재료로 무엇을 만들 수 있는지 추론하고 분석할 수도 있습니다. 이 도구는 또한 해당 재료에 대한 여러 가지 요리법을 제공하고 이를 만드는 방법에 대한 단계별 가이드를 보낼 수도 있습니다."
"조향성 툴링" 기능
새로운 기능인 "조향성 툴링"을 사용하면 개발자가 다음을 처방할 수 있습니다. 구체적인 지시 AI가 상호작용의 톤과 경계를 설정하도록 합니다. 이 기능은 "시스템" 메시지라는 새로운 API 기능을 도입하여 가능해졌습니다.
시스템 메시지는 본질적으로 AI가 따라야 할 스타일과 작업을 제공하는 지침입니다. 이는 AI가 주어진 상황에서 어떻게 행동해야 하는지 지시하는 가이드라인과 같습니다. ChatGPT도 앞으로 이 기능을 받게 될 것입니다.
예를 들어, 시스템 메시지는 AI가 항상 소크라테스 스타일로 대답하는 튜터처럼 행동해야 한다고 명시할 수 있습니다. 이 경우 AI는 학생에게 직접 답을 주지 않고 항상 올바른 질문을 하여 학생이 스스로 생각하는 법을 배우도록 돕습니다.
또한, AI는 학생의 관심과 지식에 따라 항상 질문을 조정하고, 복잡한 문제를 더 간단한 부분으로 나누어 적절한 수준에 도달할 때까지 진행합니다.
시스템 메시지 및 기타 업그레이드가 도입되었음에도 불구하고 OpenAI는 GPT-4를 인정합니다. 아직도 결함이 있다. AI는 여전히 추론에서 오류를 범할 수 있으며, 심지어 사실을 "환각"할 수도 있습니다. 예를 들어, GPT-4는 한때 엘비스 프레슬리를 "배우의 아들"이라고 묘사했는데, 이는 잘못된 설명입니다.
GPT-4의 한계는 무엇입니까?
OpenAI에 따르면, GPT-4는 데이터가 끊어지는 2021년 4월 이후 발생한 최근 이벤트에 대한 지식이 부족하다는 문제가 있습니다. 또한 GPT-XNUMX는 경험으로부터 학습하지 않아 때로는 여러 도메인에 걸친 광범위한 지식을 반영하지 않는 간단한 추론 오류가 발생할 수 있습니다.
게다가 GPT-4는 사용자로부터 명백히 거짓된 진술을 너무 신뢰하는 경향이 있으며, 생성하는 코드에 보안 취약점을 도입하는 등 어려운 작업에서도 실패할 수 있습니다.
최종 단어
이러한 한계에도 불구하고 OpenAI는 GPT-4가 특정 분야에서 상당한 개선을 이루었다고 주장합니다. 예를 들어, GPT-4는 이제 위험한 화학 물질을 합성하는 방법에 대한 지침을 생성할 가능성이 낮아졌습니다. GPT-3.5와 비교했을 때 GPT-4는 "허용되지 않는" 콘텐츠에 대한 요청에 응답할 가능성이 82% 낮습니다.
더욱이 GPT-4는 의학적 조언, 자해 주제와 같은 민감한 정보를 제공할 때 OpenAI의 정책을 더욱 잘 준수하고 있으며, 이전 버전보다 이러한 주제에 29% 더 자주 응답합니다.














