요약:
현재 대화와 사용자 요구를 기반으로 AI가 동적으로 생성하는 대화형 경험입니다. 이는 ChatGPT가 '질문에 답하는 챗봇'에서 '즉석에서 도구를 만들 수 있는 지능형 비서'로 점차 변화하고 있음을 의미합니다. 과거에는 사용자가 ChatGPT에 계산 방법을 요청한 다음 계산기를 열어 계산을 직접 완료해야 할 수도 있었습니다. 이제 AI는 작동 가능한 계산 도구를 직접 생성하고 이를 답변에 포함시킬 수 있습니다.

OpenAI는 지능형 UI의 핵심 기반은 스트리밍 가능한 기본 인터페이스 구성 요소 라이브러리 세트와 모델이 콘텐츠를 생성하는 동안 인터페이스를 처리할 수 있는 컴파일러라고 밝혔습니다. 즉, AI는 먼저 전체 텍스트 단락을 생성한 다음 단순히 ChatGPT 클라이언트로 형식을 지정하지 않습니다. 대신, 답변을 생성하는 과정에서 어떤 인터페이스 구조를 사용해야 하는지 결정합니다.
이 메커니즘을 사용하면 답변 콘텐츠와 함께 대화형 요소가 점차적으로 나타날 수도 있습니다. 사용자는 최종 결과를 보기 전에 모델이 완전히 완료될 때까지 기다릴 필요가 없습니다. 인터페이스의 일부는 생성 프로세스가 진행됨에 따라 점진적으로 표시될 수 있습니다.
GPT-6 자체도 응답 속도에 맞게 조정되었습니다. OpenAI는 모델이 생각하는 동안 답변 출력을 시작할 수 있으므로 사용자는 콘텐츠 표시를 시작하기 전에 모델이 내부 처리를 완전히 마칠 때까지 기다리지 않고도 일부 결과를 더 일찍 확인할 수 있다고 말했습니다.
이 업데이트는 또한 ChatGPT의 시각적 표현이 크게 변경되었음을 의미합니다. 과거에는 모델이 복잡한 데이터 분석을 생성할 수 있더라도 텍스트, 마크다운 테이블 또는 정적 이미지 형식으로 표시되는 경우가 많았습니다. 이제 AI는 문제를 기반으로 기존 소프트웨어에 더 가까운 차트, 버튼, 양식 및 기타 인터페이스 요소를 적극적으로 선택할 수 있습니다.
일반 사용자의 경우 단순히 몇 가지 벤치마크 점수를 향상시키는 것보다 이번 변경의 의미가 더 직관적일 수 있습니다. 사용자는 프로그램 작성 방법을 알 필요도 없고 웹 개발이나 데이터 시각화 도구를 마스터할 필요도 없습니다. 완료하고 싶은 작업이 무엇인지 ChatGPT에 알려주기만 하면 AI가 현재 대화에 사용할 수 있는 도구를 직접 만들 수 있습니다.
OpenAI도 이번에 GPT-6의 활용 범위를 확대하기 시작했습니다. GPT-6 및 지능형 UI는 처음에는 ChatGPT Plus, Pro, Business 및 Enterprise 사용자에게 공개되며 나중에 무료 및 Go 사용자에게도 출시될 예정입니다.
사용자 레벨에 따라 획득하는 GPT-6 버전이 다릅니다. 또한 Pro, Business 및 Enterprise 사용자에게는 GPT-6 Sol이 제공되고, Free 및 Go 사용자에게는 GPT-6 Luna가 제공됩니다.
현재 GPT-6은 ChatGPT의 채팅 대화 인터페이스에서 주로 사용되며 Work와 Codex의 모델은 동시에 교체되지 않았습니다. 이는 이번 릴리스가 전문 작업 및 프로그래밍 개발을 위해 OpenAI의 제품 시스템을 즉시 변경하는 것이 아니라 일반적인 채팅 및 일상 작업 시나리오를 먼저 대상으로 한다는 것을 의미합니다.
제품 형태의 관점에서 볼 때 지능형 UI는 ChatGPT의 향후 개발을 위한 중요한 방향을 나타낼 수 있습니다. 기존 소프트웨어에서는 일반적으로 개발자가 인터페이스를 미리 설계한 다음 사용자가 고정된 프로세스에 따라 이를 작동해야 합니다. AI 기반 지능형 인터페이스는 사용자의 현재 요구 사항에 따라 해당 작업 인터페이스를 즉시 생성할 수 있습니다.
예를 들어, 동일한 채팅 창은 사용자가 환율에 관해 질문할 때 통화 변환 도구로, 사용자가 여행을 계획할 때 여행 플래너로, 사용자가 비용을 계산할 때 청구서 분할 도구로, 사용자가 지식을 학습할 때 차트와 객관식 질문이 포함된 대화형 교육 인터페이스로 사용될 수 있습니다. 사용자는 다른 앱을 설치하거나 해당 웹사이트나 도구를 찾을 필요가 없습니다.
이 모델은 실제로 '채팅'과 '앱' 사이의 경계를 모호하게 만들고 있습니다. 과거에는 ChatGPT가 주로 사용자 요구 사항을 이해하고 답변을 제공하는 역할을 담당했지만 실제 작업을 실행하려면 여전히 다른 소프트웨어를 사용해야 하는 경우가 많았습니다. 지능형 UI는 ChatGPT를 직접 작업 실행 환경으로 만들려고 시도하므로 답변 자체에 특정 애플리케이션 속성이 있습니다.
물론 이 모델은 AI 시스템이 더 많은 책임을 맡아야 한다는 의미이기도 합니다. 모델이 버튼, 양식, 계산기, 심지어 작은 애플리케이션까지 직접 생성하기 시작하면 사용자와 AI 생성 인터페이스 간의 상호 작용은 더 이상 단순히 텍스트를 읽는 것이 아니라 실제 작업 및 결정이 포함될 수 있습니다. 결과적으로 생성된 콘텐츠의 정확성, 인터페이스 동작 및 보안이 모두 더욱 중요해질 것입니다.
현재 OpenAI는 ChatGPT에 지능형 UI를 최초로 적용했습니다. 향후 개발자에게 더 공개될지, API를 통해 유사한 동적 인터페이스를 생성할 수 있는지, 이러한 대화형 구성 요소를 독립적으로 저장하고 실행할 수 있는지 여부에 대한 자세한 내용은 나중에 발표해야 합니다.
어쨌든 GPT-6와 지능형 UI의 결합은 AI 비서 경쟁이 더 이상 '누구의 모델이 더 스마트한가'만의 문제가 아니라는 점을 보여줍니다. 텍스트 이해와 추론 능력에서 서로 다른 모델 간의 격차가 점차 좁아지면, 모델 역량을 어떻게 사용자가 조작할 수 있는 도구로 직접적으로 변환하는가가 다음 단계의 AI 제품 경쟁에서 중요한 방향이 될 수 있습니다.
이 모델이 더욱 성숙해지면 사용자는 앞으로 AI를 직면할 때 더 이상 '질문하기'와 '애플리케이션 사용'을 구별할 필요가 없을 수도 있습니다. 사용자는 자신이 성취하고 싶은 것을 설명하기만 하면 AI는 대화 중에 작업을 완료하는 데 필요한 인터페이스를 즉시 생성할 수 있습니다. ChatGPT 자체는 채팅 창에서 애플리케이션을 동적으로 생성할 수 있는 일반 컴퓨팅 플랫폼으로 점진적으로 발전할 수 있습니다.
자세히 알아보기:
https://openai.com/zh-Hans-CN/index/gpt-6-for-everyone/
댓글