Hacker News

GPT‑6 and Intelligent UI for everyone

모두를 위한 GPT‑6와 지능형 UI

OpenAI가 ChatGPT에 GPT‑6와 ‘Intelligent UI’를 도입합니다. 모델은 질문에 따라 텍스트, 그래픽, 버튼, 폼, 차트와 상호작용형 화면을 조합하며, 네이티브 컴포넌트 라이브러리와 생성 중 화면을 표시하는 컴파일러를 사용합니다. 웹 검색 응답 시작 시간은 GPT‑5.6 Instant보다 평균 44% 빠르다고 밝혔습니다.

AI 요약

OpenAI가 ChatGPT에 GPT‑6를 배포하면서 ‘Intelligent UI’를 함께 선보입니다. 회사는 매주 ChatGPT를 사용하는 12억 명 이상에게 새 모델을 제공한다고 밝혔습니다. Intelligent UI는 답변을 문장으로만 제시하지 않고 질문의 성격에 맞춰 그래픽, 버튼, 폼, 차트, 상호작용 요소를 함께 구성하는 기능입니다. 비교 질문에는 나란히 놓은 화면을, 복잡한 설명에는 조작 가능한 도식을 쓸 수 있으며, 텍스트가 가장 적합하면 기존처럼 문장으로 답합니다.

화면 구성과 생성 방식

사용자는 대화 중에 저축액 변화를 살펴보는 계산기, 식사 비용을 나누는 도구, 간단한 게임 같은 화면을 요청할 수 있습니다. OpenAI는 모델이 텍스트와 시각 자료, 상호작용 요소를 어떤 방식으로 배치할지 학습했다고 설명합니다. 이를 위해 네이티브 스트리밍 컴포넌트 라이브러리와 컴파일러를 만들었습니다. 컴포넌트 라이브러리가 화면의 기본 디자인과 구성 요소를 제공하고, 모델은 질문에 맞춰 요소를 선택하고 배치합니다. 컴파일러는 모델이 응답을 완성할 때까지 기다리지 않고 생성된 화면을 점진적으로 표시합니다.

학습 과정에서는 화면의 명료성, 유용성, 완성도를 평가하고 콘텐츠와 레이아웃, 시각 자료, 상호작용을 어떻게 선택할지 훈련했다고 합니다. 언제 상호작용을 넣을지, 언제 텍스트만으로 답할지도 판단하도록 했습니다. 다만 디자인 판단과 생성 가능한 화면의 범위를 개선할 과제가 남아 있다고 밝혔습니다.

응답 속도와 검색 성능

GPT‑6는 답변을 시작한 뒤에도 생각을 이어가며 내용을 보태는 방식으로 응답합니다. OpenAI는 각 부분 응답에 유용한 정보를 담고 불필요한 문장을 줄이면서, 여러 차례에 나눠 생성한 답변도 전체적으로 일관되고 사실에 맞도록 학습했다고 설명합니다.

회사 내부의 일상적 에이전트 작업 평가에서는 GPT‑6 Extra High가 GPT‑5.6 Medium과 같은 시간 안에 답변을 시작하면서 GPT‑5.6 Extra High보다 높은 종합 점수를 기록했다고 합니다. 웹 검색이 필요한 질문에서는 GPT‑6 Instant가 GPT‑5.6 Instant보다 평균 44% 일찍 답변을 시작합니다. 어려운 문제를 대상으로 한 내부 평가에서도 GPT‑6가 질문의 핵심을 더 자주 짚었다고 밝혔습니다. 다만 이 수치는 OpenAI 내부 평가 결과입니다.

안전성과 제공 범위

OpenAI는 여러 차례 대화에 걸쳐 안전장치를 우회하려는 공격에 대한 저항력을 개선하고, 사이버 공격·생물학적 위협·폭력과 관련한 고위험 악용 방지 학습을 강화했다고 설명합니다. 위험한 요청에는 안전하게 대응하면서 무해한 요청을 불필요하게 거절하지 않도록 했으며, 한 번의 문장만으로 드러나지 않는 위험도 대화 기록과 맥락을 참고해 판단하도록 훈련했다고 합니다. 기능과 안전 제한을 제대로 알지 못하거나 필요한 정보·도구가 없을 때 그 한계를 더 잘 알리는 점도 개선했다고 밝혔습니다. 자세한 평가 결과는 시스템 카드에 공개했습니다.

GPT‑6 Intelligent UI는 Plus, Pro, Business, Enterprise 요금제의 Chat 탭에서 먼저 전 세계 배포를 시작하고, 다음 날 Free와 Go 요금제로 확대합니다. Enterprise에서는 관리자의 설정에 따라 이용 여부가 달라집니다. 유료 요금제에는 GPT‑6 Sol, Free와 Go에는 GPT‑6 Luna가 제공됩니다. 이번 변경은 Chat 경험에 한정되며 Work와 Codex 모델은 바뀌지 않습니다.

Hacker News 반응

  • @throwaway7783 — Anthropic의 Artifacts를 따라잡으려는 건가요? 동시에 “텍스트, 시각 자료, 상호작용 요소로 응답하도록 GPT‑6를 훈련했다”고 하는데, 하네스가 아니라 모델을 말하는군요.
  • @hollowturtle — 모델이 인터페이스를 생성하는 동안 점진적으로 표시할 수 있다면서요. 그냥 HTML을 스트리밍하면 안 되나요?
    • @Aarostotle — 요소가 닫힐 때까지 렌더링할 수 없기 때문일 수도 있습니다.
    • @hollowturtle — 부분 HTML 스트리밍은 실제로 가능한 방식입니다.
    • @Aarostotle — 제가 틀렸을 수도 있습니다. 토큰이 들어오면 닫는 태그가 오기 전에도 굵은 글씨로 미리 표시할 수는 있습니다. 하지만 설명용 화면처럼 레이아웃과 그림을 다루는 요소는 어떻게 처리할지 상상하기 어렵습니다. 추상화 계층을 둔 것 같다는 게 제 첫 생각입니다.
  • @2sk21 — 사용자는 생성된 시각 자료가 정확한지 어떻게 알 수 있나요?
    • @hollowturtle — 모를 겁니다. 그냥 채팅 화면을 아이언맨이 자비스와 대화하는 장면처럼 보이게 하려는 겁니다.
  • @tamimio — 별로 좋지 않아 보입니다. 결과를 텍스트 위주로 받고 싶습니다. 쉽게 내보내고 후처리할 수 있으니까요. 이러면 리소스를 많이 먹는 앱이 더 무거워질 수도 있습니다.
    • @oh_no — 텍스트만 달라고 요청하면 됩니다.
  • @bogdiyan — 댓글을 읽으며 많은 사람이 놀라울 정도로 부정적이라 생각했습니다. 그림 하나가 천 마디 말보다 낫습니다. UI가 좋아지면 훨씬 나은 사용자 경험을 만들 수 있습니다. 노인이나 장애인이 개인 비서를 더 쉽게 쓰게 될 수도 있습니다. 챗봇이 답답한데, 버튼 하나로 일을 처리하거나 정보를 도식 하나로 볼 수 있다면 정말 좋겠습니다.
  • @sroussey — 저도 비슷한 걸 만들었습니다. 모델이 텍스트 대신 JSON Schema로 결과를 설명하게 하고, JSON Schema를 UI로 변환하는 방식을 썼습니다.
  • @julesrms — 좋은 모델이라면 대부분 이미 할 수 있는 일처럼 보입니다. CLI 안에 갇힌 모델이라면 모르겠지만, GUI 하네스에서는 HTML로 답하라고 하면 대화 안에 그림을 그려 줍니다. Claude, GPT, Deepseek 등으로 오래전부터 해 왔습니다.
  • @jjcm — 저는 이런 걸 ‘일회용 UI’ 또는 ‘종이 접시 UI’라고 부릅니다. 한 번 쓰고 버릴 화면이라는 뜻입니다. 필요할 때 빠르게 나오면 좋지만, 간단한 답만 원할 때도 과하게 만들어 내지는 않을지 궁금합니다. 응답 지연에 미치는 영향도 알고 싶습니다.
  • @blakeashleyjr — 모델이 프런트엔드 코딩을 잘하게 되면서 자연스럽게 이어지는 흐름 같습니다. “Svelte나 React 같은 컴포넌트 라이브러리를 주고, 설명에 도움이 되는 시각 자료를 만들어 달라”고 하는 식입니다.
  • @totallygeeky — 표준화와 접근성에 악몽 같은 일이 되지 않을까요?

원문: OpenAI / 번역·요약: Trawling