프롬프트 엔지니어링: 실용적인 예시

텍스트 프롬프트는 LLM의 응답을 지시하는 역할을 하기 때문에 조금만 변경해도 완전히 다른 결과를 얻을 수 있습니다. 이 튜토리얼에서는 실제 사례에 여러 프롬프트 엔지니어링 기술을 적용해 보겠습니다. 이를 통해 반복적인 과정으로 진행되는 프롬프트 엔지니어링을 직접 경험하고, 다양한 기술을 적용하는 효과를 확인하며 머신 러닝 및 데이터 엔지니어링과 관련된 개념을 배울 수 있습니다.

Read More

ChatGPT Vision을 사용하여 프롬프트에 이미지를 사용할 수 있습니다

OpenAI의 제목은 인간화된 표현을 사용하지만, ChatGPT Vision은 실제로 볼 수 없습니다. 그러나 이는 이미지 입력을 처리하고 분석할 수 있어, 이런 능력이 인간의 두뇌가 할 수 있는 것과 상당히 유사하다고 느낄 수 있게 합니다. ChatGPT Vision은 OpenAI의 최신 발표로서, 생성적 AI 챗봇에 멀티모달(다양한 모드의) 능력을 부여합니다. ChatGPT Plus 구독자들은 iOS 또는 Android의 ChatGPT 앱에 이미지를 업로드할…

Read More

[논문]다중 모달 모델 GPT-4V의 탐구: 기능, 응용 및 미래 연구 방향

The Dawn of LMMs: Preliminary Explorations with GPT-4V(ision) PDF Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models 초록 대형 다중 모달 모델(LMM, Large multimodal models)은 시각적 이해와 같은 다중 감각 능력을 가진 대형 언어 모델(LLMs, large language models)을 확장하여 더욱 강력한 일반 지능을 달성합니다. 이 논문에서는 GPT-4V(ision)1과 같은 최신 모델을 분석하여 LMM에 대한…

Read More

OpenAI 어시스턴트의 작동 방식

OpenAI의 어시스턴트 API는 개발자가 다양한 작업을 수행할 수 있는 강력한 AI 어시스턴트를 구축할 수 있도록 설계되었으며, 현재 베타 단계에 있습니다. 이 API를 통해 어시스턴트는 대화 스레드를 관리하고, 실행 단계를 통해 다양한 도구를 호출하며, 메시지에 주석을 달 수 있습니다. 하지만 베타 기간 동안 스트리밍 출력, 폴링 없는 알림, DALL·E 도구 사용, 이미지를 포함한 메시지 생성 등의 기능에 대한 제한이 있으며, 이러한 기능들은 향후 지원될 예정입니다.

Read More

LLM(대규모 언어 모델)을 활용한 자율 AI 에이전트 10선

LLM(대규모 언어 모델)은 OpenAI의 GPT-4, Google의 PaLM, Meta의 LLaMa와 같은 모델을 기반으로 합니다. 이러한 에이전트들은 환경을 인식하고 목표를 달성하기 위해 행동하며, 인간이나 다른 에이전트와 의사소통할 수 있습니다. 주목할 만한 LLM 기반 자율 AI 에이전트는 다음과 같습니다

Read More

LLM 어플리케이션을 위한 Chunking Strategies

청킹은 텍스트를 작은 세그먼트로 나누는 과정으로, LLM 어플리케이션에서 중요한 최적화 기술입니다. 다양한 청킹 방법들이 있으며, 각 방법은 특정 상황에 적합할 수 있으며, 고정 크기 청킹, 재귀 청킹, 특수 청킹 등이 포함됩니다. 최적의 청킹 크기와 방법을 결정하려면 데이터 전처리, 청킹 크기 범위 선택, 그리고 각 청킹 크기의 성능 평가와 같은 여러 단계를 거쳐야 합니다.

Read More