모두를 위한 GPT‑6와 Intelligent UI

GPT‑6 and Intelligent UI for everyone

openai.com ▲ 467 댓글 238 joshuawright11

요약

오픈AI가 GPT‑6를 무료 이용자까지 넓히고, 질문에 맞춰 화면을 짜 주는 Intelligent UI를 내놨습니다.

오픈AI는 지난달 유료 고객에게 첫 GPT‑6 모델을 내놓았고, 10월 7일에는 매주 12억 명 넘게 쓰는 ChatGPT에 새 GPT‑6 모델을 넣는다고 발표했습니다. 함께 선보인 Intelligent UI는 답변을 그림, 버튼, 차트, 입력 양식으로 짜서 보여 주고, 계산기 같은 도구도 대화 안에서 바로 만들어 줍니다.

왜 중요한가

  • 모든 질문을 같은 대화 형식에 담던 ChatGPT가 질문마다 비교표, 대화형 도표, 도구 같은 알맞은 화면을 직접 고르게 됩니다.
  • 오픈AI는 사람이 소프트웨어에 맞추던 방식에서 소프트웨어가 사람에 맞추는 방식으로 가는 첫걸음이라고 설명했습니다.
  • 추론 모델(답하기 전에 오래 생각하는 모델)의 기다림이 줄어, 생각하는 동안에도 답을 먼저 보여 주기 시작합니다.

핵심 내용

  • Plus, Pro, Business, Enterprise 요금제는 10월 7일부터, 무료와 Go 요금제는 다음 날부터 Chat 탭에 순차 적용됩니다.
  • 유료 요금제에는 GPT‑6 Sol이, 무료와 Go 요금제에는 GPT‑6 Luna가 쓰입니다. Work와 Codex의 모델은 바뀌지 않습니다.
  • Intelligent UI는 미리 만든 화면 부품 모음과, 모델이 생성하는 대로 화면을 차례차례 그려 주는 컴파일러로 돌아갑니다.
  • 웹 검색이 필요한 질문에서 GPT‑6 Instant는 GPT‑5.6 Instant보다 평균 44% 빨리 답을 시작합니다.
  • 여러 차례 대화에 걸쳐 안전 훈련을 우회하려는 공격에 더 잘 버티도록 안전 훈련을 보강했다고 밝혔습니다.

HN 반응

  • 양고기 구이 예시를 두고 이미지와 체크리스트가 많아 어린애 취급을 받는 느낌이라는 불만과, 대중은 그림 있는 요리책을 더 좋아한다는 반론이 맞섰습니다.
  • 일부 이용자는 예시 사진에 양고기 대신 칠면조가 나왔다며 정확성을 지적했고, 광고를 눈에 덜 띄게 섞으려는 설계라는 의심도 나왔습니다.

댓글

30개 표시 · 전체 452개
  1. revolvingthrow HN

    선데이 로스트(Sunday roast)를 5.6과 6으로 비교한 부분이 무척 흥미롭습니다. 대부분의 사람이 6을 더 좋아하리라는 데는 의심이 없지만, 저는 그 이미지들이 거의 역겨울 지경입니다. 쓸데없는 여백은 왜 그리 많고, 체크리스트는 또 뭡니까. 저를 얕보고 어린애 취급하는 느낌입니다.

    오픈AI가 업무(Work)와 채팅을 합치겠다는 말을 흘리고 있는데(제 생각엔 끔찍한 발상입니다), Work는 Codex와 아주 비슷하죠... 이런 요소가 실제 업무용 도구에 의미 있게 스며들지 않기를 간절히 바랍니다.

    채팅이 6.1이 아니라 6.0 기반이라는 점은 실망스럽습니다. "시각적이고 대화형인 설명"은 정말 쓸 만해 보이지만, 6.1이 훨씬 낫습니다. 6.1의 설명도 온전히 믿지는 않겠지만 6.0보다는 상당히 더 믿을 겁니다. 컴퓨팅 자원이 무한하지 않다는 건 이해합니다. 그래도 채팅만 쓰는 사람이 아주 많고, AI 모델을 진실의 원천으로 여기거나 학문적인 학습에까지 쓰는 사람이 갈수록 늘고 있으니, "설명해 주는 기능"을 최대한 좋게 만들어 두는 건 중요합니다.

    그래도 모델은 나아질 테니, 시각적 설명 기능은 아이디어나 MVP로서는 꽤 괜찮아 보입니다.

  2. DriverDaily HN

    저를 얕보고 어린애 취급하는 느낌입니다.

    지난 한 주 동안 제가 가장 많이 쓴 프롬프트는 아마 "이걸 아이한테 설명하듯이 간결하고 쉽게 설명해 줘"일 겁니다.

    저는 몇 년 동안 의사결정자들을 위해 내용을 쉽게 풀고 그걸 뒷받침하는 시각 자료를 만들어 왔습니다. 이제는 거꾸로 ChatGPT에게 저한테 똑같이 해 달라고 자주 부탁합니다.

  3. Terr_ HN

    이것도 쓸모가 있을지 모르겠네요.

    ASD-STE100 Simplified Technical English(STE)는 기술 문서를 단순하고 명확하게 만들기 위해 설계된 통제 자연어(controlled natural language)입니다. 1980년대에 유럽 항공 업계의 요청으로 유럽항공우주산업협회(AECMA)가 개발했으며, 영어가 모국어가 아닌 사람도 쉽게 이해할 수 있는 항공기 정비 문서용 표준 영어를 원했던 데서 출발했습니다.

    https://en.wikipedia.org/wiki/Simplified_Technical_English

  4. PokeyCat HN

    STE는 AI와 엮여 많이 회자되지만 나름의 문제가 있습니다. 항공기 정비 매뉴얼을 위해 만든 것이라 소프트웨어와는 "쉽게" 설명하는 데 쓰는 어휘가 다릅니다. 동료가 Claude에 STE를 적용해 우리 문서를 "단순화"하려 한 적이 있는데, 문서상 읽기 수준 지표는 내려갔어도 결과물은 이전의 Claude 티가 짙은 문서만큼이나 읽기 괴로웠습니다.

    저는 에이전트에게 Simple English Wikipedia의 편집 지침을 따르게 하는 방식이 마음에 들었습니다. 다만 그건 대부분 요즘 앤트로픽 모델의 부족한 점을 메우려는 용도입니다. 6.1-sol로 돌리는 Codex는 설명이 훨씬 명확해서, 출력에 스타일 가이드를 따로 강제할 필요를 못 느낍니다.

  5. spockz HN

    저는 Gemini 3.8이 늘 간결하게, 컴퓨터공학 석사 졸업자라면 누구나 이해할 수준으로 출력합니다. 명확하고 핵심만 짚고, 정말 필요할 때는 같은 수식을 산문으로 풀어 쓰는 대신 배경 설명용 수식을 조금 곁들이고요.

    GPT는 제 생각엔 너무 글에만 머물러요.

  6. super256 HN

    컴퓨터공학 석사 졸업자라면 누구나 이해할 수준

    그거 기준이 엄청 높은데요.

  7. criley2 HN

    제 경험으로는 이렇습니다.

    • Gemini 3.8은 답변이 아름답습니다. 타이포그래피, 목록 활용, 간결함, 스타일, 웹 하네스의 글꼴 선택까지 전부 A급, 아니 S급입니다. 답변의 품질이라고는 말하지 않았습니다. 내용은 늘 지극히 평범하고, 질문이 어려워질수록(혹은 답하는 데 더 많은 노력이 필요할수록) 구글은 그냥 포기해 버립니다. 답변 품질은 "C"를 줍니다.

    • ChatGPT(Chat, 6 이전이고 5.6이라고 짐작하지만 모델 선택기를 숨기는 경우가 많죠): 답변이 못생겼습니다. 불필요한 곁다리 설명을 몇 페이지씩 찍어 냅니다. 대부분 정보 설계에 대한 고민 없이 문단으로 이어진 글 덩어리예요. 그런데 그 난장판 속에 제가 찾던 답이 거의 항상 들어 있고, 잘리고 꾸며진 Gemini 답변보다 거의 언제나 훨씬 낫습니다.

    한동안은 질문을 전부 Gemini와 ChatGPT에 동시에 돌렸는데, 맞붙여 보면 거의 항상 ChatGPT 답변을 고르고 있더군요.

  8. spockz HN

    흥미롭네요. 제 경험은 그렇지 않았습니다. ChatGPT는 제 문제에 대한 해법을 자신만만하게 줄줄 늘어놓은 몇 페이지짜리 글을 자주 내놓았습니다. 곧바로 구현 세부 사항으로 파고들고요. 문제와 제품 적합성 수준에 머물라고 말해도 마찬가지였습니다. 반면 Gemini는 어째서인지 늘 제가 기대하는 수준에서 추론해 출력합니다.

    심지어 코드 구현과 버그 추적에서 한 발 물러나 "잠깐, 알고리즘이 잘못 구현된 게 아니라 목표에 맞지 않는 알고리즘이네요."라고 말할 줄도 알더군요. GPT Sol(5.6, 6, 6.1)은 문제만 계속 두들겼습니다.

  9. criley2 HN

    분명히 해 두자면, 저는 웹 하네스로 쓰는 Gemini와 ChatGPT의 비기술적 용도를 이야기하는 겁니다.

    기술 조사에 웹 하네스를 쓰는 일이 드물게 있긴 하지만, 기술 관련 질문은 거의 전부 코딩 하네스와 제 로컬 컨텍스트, 스킬 등을 겹겹이 거쳐서 처리됩니다. 그래서 제가 codex/claude code로 만들어 내는 결과물은 다른 사람들의 결과물과 비교할 수 없습니다.

    그러니 웹 하네스를 비교했다는 건 아기 돌보는 법, 새 TV 제품 비교, 방 배치를 다르게 한 모습 시각화(구글은 이게 너무 형편없었고 ChatGPT는 훌륭했습니다), 비디오 게임 도움 요청, 그 밖의 일반인(normie)다운 AI 용도로 질문했다는 뜻입니다 ㅋㅋ

    Gemini는 항공편이나 유튜브 같은 구글 서비스를 물어볼 때 가장 낫다고는 하겠습니다.

  10. Melatonic HN

    head to tail이 아니라요?

  11. recursive HN
  12. Melatonic HN

    제 생각엔 글을 수정하신 것 같아요.

  13. pdntspa HN

    저는 AI에게 구글 개발자 문서 스타일 가이드(Google's Developer Documentation Style Guide)를 따르라고 하면 STE-100의 괜찮은 대안이 된다고 봅니다.

  14. xeromal HN

    영화 Margin Call에 나오는 이 장면이 생각나네요.

    "나한테는 골든 리트리버한테 말하듯이 설명해 봐요."

    https://youtu.be/fij_ixfjiZE?t=70

  15. CPLX HN

    맞습니다.

    제가 써 보니 잘 먹히는 단골 문구는 "고등학교 수준의 영어로, 직설적인 평서문만 써서, 괄호나 이 대화의 앞선 내용을 떠올려야 하는 언급 없이 다시 써 줘"입니다.

    이걸 단축키로 지정해 뒀습니다.

  16. bombcar HN

    이 사람, GPT-7의 프롬프트를 이렇게 공짜로 뿌리네요.

  17. busssard HN

    저는 그냥 평범하게 "ELI5"를 씁니다. 학습 데이터에서 reddit이 차지하는 비중이 꽤 커서, 이거면 제가 원하는 종류의 설명이 나와요.

  18. zug_zug HN

    인터넷의 웃음거리인 그 짜증 나는 레시피/인물 소개 사이트들이 떠오르네요. 이미 레시피 단계까지 왔는데, 존재하지도 않는 로스트의 AI 이미지를 왜 보고 싶겠어요?

    구글 검색 결과를 AI에 옮겨 놓은 느낌인데, 제 생각엔 잘 정제된 정보보다 퇴보예요. ChatGPT는 이미 요청하면 차트나 시각 자료를 만들어 주잖아요.

  19. lionkor HN

    레시피 사진이 의미가 있으려면 누군가 실제로 그 레시피대로 만든 결과물이어야 합니다. 양고기 색깔이며 소스의 농도까지요.

    AI가 생성한 사진은 절대로 그런 적이 없고, 그래서 쓸모가 없습니다.

  20. dominotw HN

    모델이 이야기를 지어내도록 훈련하기만 하면 되겠네요. 이 레시피는 대공황 때 증조할머니가 만드셨다느니 하는 얘기를 하고, 먼지 쌓인 레시피 책 AI 사진까지 만들어 주는 거죠.

  21. xp84 HN

    "우리 할아버지 GPT-1은 제 서브에이전트가 4GB짜리 작은 GPU 안에서 할아버지랑 고기 요리 얘기를 나눌 때마다 이 로스트 레시피를 그리워하며 옛날얘기를 하시곤 했죠."

  22. sunaookami HN

    광고를 더 쉽게 끼워 넣고 눈에 덜 띄게 하려고 이렇게 설계한 거예요.

  23. usef- HN

    그럴 수도 있지만, 일반 대중 대부분이 사진이 있는 요리책을 더 좋아하는 게 현실이긴 합니다. 일반 소비자를 겨냥하다 보면 오픈AI도 어차피 이렇게 됐을 거라고 생각합니다. 설정으로 바꿀 수도 있고요.

    저는 오히려 사진의 정확성이 걱정됩니다. 레시피에서 사진의 장점은 보통 목표로 하는 결과물(예를 들면 재료를 얼마나 잘게 썰었는지)을 볼 수 있다는 건데, 이미지 모델이 그 정도 세부 묘사까지 되는지는 모르겠습니다.

  24. a123b456c HN

    일반 대중 대부분이 사진이 있는 요리책을 더 좋아하는 게 현실이긴 합니다

    글을 아주 잘 읽는 사람 입장에서는, 인구 중에 글을 아주 잘 읽는 사람의 비율을 과대평가하기 쉽죠.

  25. infecto HN

    흥미로운 건, 자기 기준을 과대평가하는 사람들이 정작 뻔한 걸 놓치곤 한다는 점입니다. 요리책 같은 건 사진이 있으면 정말 도움이 되는 분야일 수 있잖아요. 요리책을 휘리릭 넘겨보는데 Boeuf Bourguignon이 뭔지, 잘 된 게 어떤 모습인지 어떻게 알겠습니까.

  26. SebastianSosa HN

    글 잘 읽는 사람들도 예전 같은 우위를 잃었네요.

  27. lionkor HN

    사진이 있는 요리책을 더 선호한다

    네, 그 음식의 사진이요. 다른 레시피로 만든 전혀 상관없는 다른 양고기 로스트 사진이 아니라요.

    좋은 요리책은 그 레시피로 만든 음식을 제대로 촬영합니다. 그게 사람이 만들었든 AI가 만들었든, 쓰레기 요리책과 좋은 요리책을 가르는 점입니다.

  28. ardacinar HN

    다른 레시피라니요? 그냥 물리적으로 재현이 불가능한 양고기 로스트일 수도 있잖아요(이번 마케팅 예시에서는 아마 아니겠지만요).

  29. bluGill HN

    왜 재현이 불가능하다는 겁니까? 리처드 1세가 먹었을 법한 음식이라서 추측만 할 수 있다는 얘기입니까? (제가 아는 가장 오래된 요리책은 https://en.wikipedia.org/wiki/The_Forme_of_Cury 인데, 리처드 2세가 먹었을 식사를 다룹니다.) 아니면 오래전에 멸종한 도도새(인간이 먹었는지는 잘 모르겠습니다)나 동굴곰(인간이 사냥해 멸종시켰다는 주장을 본 적이 있지만, 더 믿을 만한 출처에서는 인간이 나타나기 전에 멸종했다고 합니다) 같은, 우리가 영영 만들 수 없는 무언가 말입니까?

    그 밖의 거의 모든 요리는 만들 수 있습니다. 적당한 실력의 요리사에게 주방과 재료만 주면 해냅니다. 사진을 찍을 때는 아티스트가 보기 좋게 손질하겠지만, 출발점은 언제나 실제 요리여야 합니다.

  30. nickludlam HN

    트루먼 쇼가 떠오르네요. 휴가 아이디어를 한창 묻고 있는데 이러는 거예요. GPT: "이 새로운 Mococoa Drink 한 잔 타 드릴까요? 니카라과 산 위쪽 비탈에서 자란 천연 코코아 열매로 만들었어요. 인공 감미료는 일절 없습니다!"

Hacker News에서 보기 ↗