mintbear, Deep Research on o3
안녕하세요! 민트베어 🍀🧸 입니다.
AI 이미지 및 비디오를 연구 및 강의하는 입장에서
이번주 업데이트 된 심층 리서치(DeepResearch) 기능을 "o3 모델"에서 테스트 하여,
목표 1. 실제로 얼마 만큼의 깊이 있는 서치와 분석이 진행되는지 Agent AI로서의 가치와 수행 능력을 평가하고
목표 2. 수행 결과로 도출되는 'AI 이미지 도구 분석'에 대한 자료나 인사이트를 얻고자 했습니다.
OpenAI 워크 플로우
문제의식 → ChatGPT → [ o3-mini-high ] 모델 선택 → [ 심화 리서치 ] 클릭 → 질문 프롬프트 입력 → o3의 질문에 답변 → o3 심화 리서치 수행 → 추론 과정 및 출처 자료 확인 → 추론 과정 검토, 문제점 파악 → 2차 심화 리서치 진행 → 동일 과정 반복 → 최종 답변
사례 작성 워크 플로우
문제의식 → 일단 ChatGPT 열기 → 최신 업데이트 된 o3 모델 유튜브 체크 → 심화 리서치 기능에 착안 → 4o에서 문제의식 관련 대화, 주제 선정 → o3 모델에서 위와 같이 대화 진행 → 브라우저 새 창에서 게시글 작성 페이지 열고, 작성 시작 → 이미지 캡쳐와 대화 분석하며 게시글 작성 → 재검토 → 마지막에 태그 작성 → 완료
진행 방법
ChatGPT의 'o3-mini-high 모델' 에서 심층 리서치(DeepResearch) 기능을 활용했습니다.
($200, Pro Plan 이용 중입니다. 4o, o1에서도 심층 리서치 사용 가능하나, 결과에 차이가 있습니다.)
Step 1. GPT 모델 선택 & 심층 리서치 & 프롬프팅
한국 버전의 Google Play 스토어 스크린 샷
좌상단에서 [모델]을 선택하고, 하단의 [심층 리서치] 버튼을 클릭, 아래의 프롬프트를 입력하여 수행했습니다.
🍀🧸 민트베어 : 현재, 일반 대중이 사용하기에 가장 적합한 AI 이미지 생성 도구에 대해 체크해줘. 기본 목록은 민트베어의 https://slashpage.com/mintbear/Best_Image_Generator 를 참고하되, 또 다른 다양한 도구들의 최근 변화를 체크해서 업데이트해줘.
현재 4o, o1, o3 모델의 여러 버전을 사용 할 수 있는데 (4o과 o1 모델은 필자가 계속 사용해왔기 때문에)
이번에는 o3 모델에 Deep Research 기능을 테스트해보기로 했습니다.
민트베어가 운영하는 이미지 생성 도구 사이트의 정보를 참고하여 진행할 것을 요청했습니다.
데이터에 대한 사용자의 의도와 가이드를 제공하는 것이 유용할 것이라 생각했어요.
Step 2. o3의 질문을 받다.
검은 색 화면에 한국어 앱의 스크린 샷
그냥 답을 주지 않았어요. 바로 질문을 하네요.
그래서 아래와 같이 답변했습니다.
🍀🧸 민트베어 : 모든 요소가 중요하지만, 사용자에 따라 항목에 따른 가중치가 다르니, 통합 평가로 가야 할 것 같아. 다만 일반 사용자를 설정했으니, 너무 난이도가 높은 학습곡선은 배제하고 제안해줘.
위와 같이 답변했더니 본격적인 [심층 리서치]를 수행하기 시작했습니다.
Step 3. 심층 리서치 - 추론 활동과 출처
한국 웹 사이트의 스크린 샷
약 5분 동안 19개의 출처에서 다양한 단계로 추론을 진행했습니다.
유의미한 심층리서치 과정을 잠깐 살펴보면 아래와 같습니다.
[ 서치와 추론 과정 ]
한국 텀블러 앱의 스크린 샷
제공된 URL에서 민트베어의 AI 이미지 도구 목록을 검토하네요.
ChatGPT o3-mini Deep Research _
민트베어 웹사이트의 이미지 도구를 자세히 읽음 > 슬래시 페이지를 열어 델프트의 내용을 확인 중입니다. > 슬래시 페이지에는 미드저니, 드리미나(무료 도구?), 소라 관련 항목이 포함되어 있다고 생각하고 있음. 계속 스크롤하며 찾고 있음. > AI 이미지 생성기 목록을 보고 있어. 이 목록은 다양한 항목으로 구분되고 있으니, 더 살펴보는 중이야.도구 리스트에서 '무료'라고 강조 표시된 것을 '추천'하고 있다고 이해합니다.
ChatGPT o3-mini Deep Research _
> 이 페이지는 다양한 이미지 생성기를 나열하고 있어요. 무료 옵션으로 "Dreamina"를 추천하는 중입니다. > 다양한 이미지 생성 도구를 살펴보며, Midjourney와 DALL-E 3를 포함한 훌륭한 옵션들을 고르고 있어. Stable Diffusion 기반의 도구들도 흥미롭네. > Midjourney와 DALL-E 3, Stable Diffusion 기반의 LeonardoAi, "DreamStudio"와 "Adobe Firefly"의 최신 동향을 살펴보고 있어.이후 관련 웹사이트를 서치하며 추론을 계속 합니다.
ChatGPT o3-mini Deep Research _
> 추천 도구의 특징과 장단점을 표 형식으로 비교하며, 최종 추천도를 종합적으로 제시하고 있어.> Leonardo.ai, Midjourney, Ideogram, DreamStudio, Adobe Firefly, Canva Magic Media 등을 비교하며, 일반 사용자에게 적합한 AI 이미지 생성 도구를 분석하고 있어.> 내용이 아래로 더 있을 것 같아 스크롤을 더 내려보고 있어.> DALL·E 3는 사용 용이성에 중점을 두고 있고, Midjourney는 최상의 결과를 제공합니다. Ideogram은 이미지 내 텍스트 처리를, Stable Diffusion은 사용자 맞춤화를 지원하며, Adobe Firefly는 창의적인 작업에 통합됩니다. Canva 등 다른 도구도 포함될 가능성이 있습니다.> Zapier 기사와 TechRadar 보고서 를 참고하면서, 2024년에는 DALL-E 3, Midjourney, Adobe Firefly가 주목받고 있다. 이 툴들은 각각 특별한 기능을 제공하고 있어.> 사용할 때마다 새로운 방법을 구상하며, Zapier DALL-E 3와 Midjourney의 최적화된 결과를 찾고 있어요.> 자, 해당 플랫폼에서 Zapier의 리스트를 보면, DALL·E 3는 사용이 쉽고, Midjourney는 최고의 결과를 제공하며, Ideogram은 정확한 텍스트 작성에 유익합니다. Stable Diffusion은 ... (커스터마이징과 제어 또는 오픈 소스의 가능성을 시사하며) "Leonardo for something" 또는 "Adobe Firefly for something" 또는 "Canva for quick social or integration" 등이 있습니다.> etc.o3 Deep Research 는 이후에도 아주 흥미로운 서치와 추론을 계속했습니다.
[ 출처 표기 ]
파란색 배경에 검은 색 탭의 줄
출처는 상당히 많은 19개로 표기해주었지만, 획일적인 출처로 결과를 보고는 아쉬움이 남았습니다.
따라서 이후 서치 대상을 다양하게 요청해야 할 필요성을 알게 되었고,
실제로 다양한 레퍼런스 활용하는 것을 사후 테스트 했습니다.
하지만 추론 과정 자체는 매우 리즈너블 했고,
빈약한 근거 자료에도 불구하고 대체로 유용한 결론에 도달했습니다.
Step 4. 1차 결론 도출
한국어 페이지의 스크린 샷
숫자 목록을 보여주는 컴퓨터 화면의 스크린 샷
숫자 목록을 보여주는 컴퓨터 화면의 스크린 샷
o3의 1차 심층 리서치는 다양한 출처를 활용한 추론으로, 매우 유용하고 객관적인 정보를 도출했습니다.
기존 4o, o1보다 만족스러웠으나, 일반적인 인사이트에 편향적 정보가 다루어진 경향이 보였습니다.
이건 제가 전문분야이기 때문에 보이는 것이고,