안녕하세요, 노바에입니다.
최근 ChatGPT의 무료 버전이 크게 바뀌었습니다.
지금까지 무료 사용자에게 기본으로 제공되던 GPT-5.5 Instant에서 새로운 “GPT-5.6 Luna”가 사용 가능하게 되었습니다.
더불어 일반 텍스트 채팅도 무제한으로 이용할 수 있게 되었습니다.
여기만 보면 “무료 버전의 모델이 새롭게 바뀌어서 사용하기 쉬워진” 일상적인 이야기입니다.
하지만 개인적으로 신경 쓰인 건 그 점은 아니었습니다.
이 GPT-5.6 Luna는 GPT-5.6 시리즈 중에서는 비교적 작고 저렴하게 운영하는 데 중점을 둔 모델이지만, 일부 평가에서는 GPT-5.5 Instant를 능가하며, 어려운 문제에서는 “Think”를 사용하여 깊이 생각하도록 유도할 수 있다는 놀라운 모델입니다.
그러므로 이번에는 작고 저렴하게 실행 가능한 GPT-5.6 Luna의 성능 등을 상세히 설명해 드리겠습니다.
GPT 5.5 Instant에서 GPT 5.6 Luna로 전환
OpenAI는 2026년 8월, Free와 Go 사용자에게 표준 모델을 “GPT-5.6 루나”로 변경했습니다.
가장 먼저 변화가 시작된 건, 채팅이 무제한으로 되었다는 점입니다.
GPT-5.5 Instant까지는 무료 사용자는 채팅 이용에 제한이 있었습니다.
또한 한계에 도달하면, 이후부터는 GPT-5.5 Instant에서 보다 가벼운 “GPT-5.5 Instant Mini”로 자동으로 전환되는 방식이 적용됩니다.
즉, 무료로도 GPT-5.5 Instant을 사용할 수 있었지만, 계속 사용하면 어느 시점부터 성능이 다른 모델로 전환되는 경험을 하게 되었습니다.
GPT-5.6 루나에서는 크게 달라졌습니다.
일반적인 텍스트 채팅에서는 기본적으로 GPT-5.6 Luna를 그대로 계속 사용할 수 있습니다.
무료 사용자 및 Go 사용자에게는 “일상적인 텍스트 채팅”이 무제한으로 제공되며, 이전과 동일하게 이용 제한에 도달하여 Mini로 전환되는 것에 대해 더 이상 걱정할 필요가 없습니다.
이는 단순히 “사용 횟수가 늘어난” 것 이상의 큰 변화로 “고성능 AI를 무료로 사용할 수 있게” 되면서, “고성능 AI를 무료로, 그리고 사용 횟수를 신경 쓰지 않고 일상생활에 활용할 수 있게” 된 것이 핵심이라고 생각합니다.
물론, 무료 사용자에게는 부정 이용 방지를 위한 제약이 있으며, 파일 업로드, 이미지 생성, 음성, 데이터 분석 등의 기능은 제대로 제한되어 있습니다.
따라서 모든 것이 “무료 버전, 완전 무제한”으로 나타나지 않았습니다.
또한, 이번에 새롭게 무료 버전의 기준으로 도입된 GPT-5.6 루나는 GPT-5.5 인스턴트보다 작은 모델이지만, 일부 평가에서는 GPT-5.5 인스턴트보다 더 우수한 결과를 나타내고 있습니다.
또한, 어려운 문제에서는 “Think” 기능을 사용하여 같은 Luna에게 깊이 생각하도록 유도하고, 높은 품질의 답변을 생성할 수 있게 되었습니다.
GPT-5.6 루나는 무엇을 의미하는 걸까?
GPT-5.6 시리즈에는 솔, 테라, 루나처럼 다양한 용도의 모델이 있습니다.
그 중에서는 Luna는 고성능과 저렴한 비용을 중시한 모델입니다.
무료 사용자 및 Go 사용자 모두 이 루나를 평소의 ChatGPT처럼 사용하게 됩니다.
하지만 GPT-5.6 시리즈에서 가장 약한 모델입니다.
더 복잡한 조사와 고도화된 코딩, 장기적인 사고 처리에는 상위 버전의 GPT-5.6 솔루션이 있습니다.
대부분 플러스 플랜 이상의 사용자는 GPT-5.6 솔만 사용했을 거라고 생각합니다.
그러니까, 루나는 단순한 무료 사용자용 경량 모델과는 전혀 다른 것이죠…
재미있는 점은 모델 자체는 작아지고 있는데, 여러 평가에서 GPT-5.5 Instant를 능가하고 있다는 점입니다.
GPT-5.5 Instant에서 무엇이 달라졌을까?
GPT-5.5 Instant은 이전 버전의 GPT 모델과 유사한 구조를 가지고 있지만, 학습 방식과 데이터셋에 상당한 변화가 있었다. 특히, ‘Instant’이라는 이름처럼, 즉각적인 답변을 제공하는 데 초점을 맞추기 위해 모델의 크기를 줄이고, 특정 작업에 최적화된 파인튜닝을 거쳤다.
이러한 변화 덕분에 GPT-5.5 Instant은 이전 버전보다 훨씬 빠른 응답 속도를 보여준다. 또한, 특정 질문에 대해 더욱 정확하고 관련성 높은 답변을 제공할 수 있게 되었다. 예를 들어, 복잡한 문장 구조를 가진 질문이나, 여러 정보를 종합하여 답변해야 하는 질문에 대해서도 이전보다 훨씬 자연스럽고 유창하게 답변할 수 있다.
하지만 GPT-5.5 Instant은 여전히 완벽하지 않다. 때로는 잘못된 정보를 제공하거나, 논리적으로 일관성 없는 답변을 할 수도 있다. 따라서 사용자는 GPT-5.5 Instant의 답변을 비판적으로 검토하고, 필요한 경우 추가적인 정보를 검색해야 한다.
이러한 한계에도 불구하고, GPT-5.5 Instant은 자연어 처리 기술의 발전에 중요한 진전이며, 앞으로 더욱 발전된 모델의 개발을 위한 기반을 마련했다는 점에서 의미가 있다.
GPT-5.5 Instant도 좋은 모델이라 대화가 상당히 자연스럽고, 짧게 답변해 달라고 요청할 때도 편리했습니다.
이미지 이해 능력이나 웹 검색을 사용해야 할 상황 판단도 개선되었고, 일상생활에서는 충분히 편리했습니다.
한편, 루나는 무엇이 달라졌다고 생각했을까?
대략적으로 살펴보면 주요 변화는 5가지입니다.
- 모델은 작고 효율적으로 바뀌었습니다.
- 사실성(환각)이 개선되었습니다.
- 일부 전문 평가에서는 GPT-5.5 Instant을 능가했습니다.
- 무료 사용자가 심층적인 사고를 할 수 있습니다.
- 채팅이 무제한으로 이용됩니다.
무료 사용자에게만 이점이 있는 것 외에도, 목록에 포함된 것들만으로도 이미 충분한 혜택을 누릴 수 있습니다.
환각이 더욱 줄어드는 현상입니다.
GPT-5.6 Luna로 바뀌면서 가장 달라진 점은 사실 관계 개선이었다.
사실성 개선은 환각 감소와 관련이 있지만, OpenAI는 의료, 법률, 금융 등 작은 사실 오류로도 문제가 되는 질문을 사용하여 GPT-5.5 Instant와 GPT-5.6를 비교하고 있습니다.
그 평가에 따르면 GPT-5.5 Instant보다 GPT-5.6 Luna에서 “최소한 1가지 사실 오류가 포함된 답변”이 약 62% 적었다는 사실이 밝혀졌습니다.
なんと、62%입니다.
숫자만 놓고 보면 상당히 크지만, 이것을 그대로 “평상시에도 틀림이 62% 줄어든다”라고 읽는 것은 틀립니다.
そもそもこの評価、間違いが起こりやすい難しい質問を使っています
그러므로 일상 대화에서 틀린 답을 내리는 비율이 62% 감소하는 것을 의미하는 것이 아닙니다.
그렇다고 해서, 어려운 질문으로 사실 관계를 제대로 다룰 수 있게 되었다는 점은, 일상적인 대화에서도 큰 오해가 줄어들고 있다고 말할 수 있을 것입니다.
정말 고맙습니다.
의료 분야 평가에서는 GPT-5.5 Instant을 능가하고 있습니다.
전문 분야에 대한 평가는 꽤 흥미롭습니다.
OpenAI에서 공개한 HealthBench 관련 결과에 따르면 GPT-5.6 Luna는 여러 항목에서 GPT-5.5 Instant를 능가하고 있습니다.
응답의 길이를 조정된 HealthBench에서는 GPT-5.5 Instant이 51.4, Luna가 53.3을 기록했습니다.
- HealthBench Hard는 22.9(Instant)에 대해 28.7(Luna)를 나타냅니다.
- HealthBench Professional는 38.4(Instant)에 대해 44.1(Luna)입니다.
재미있는 점은, 어려운 평가일수록 차이가 더 커진다는 점입니다.
무료 버전으로도 평소처럼 사용하는 모델인데, 이전 표준 모델보다 전문적인 질문을 처리하기 쉬워진 점이 흥미롭네요.
작아졌지만 성능은 올라가고 있다.
일반적으로 AI 모델을 작게 하면 계산량이 줄어들어 더 빠르고 부드럽게 작동할 수 있지만, 그 대가로 성능이 저하될 가능성이 높습니다.
음, 대략 그런 느낌이었어요.
하지만 루나는 GPT-5.5 Instant보다 작은 모델인데도 헬스벤치 시리즈에서 우수한 성능을 보이고 있다.
그래서 이번의 진화는 ‘모델을 더 크게 해서 똑똑해졌다’라는 평범한 방식과는 다르다고 할 수 있습니다.
작은 상태로, 이전보다 능력을 더 효과적으로 발휘할 수 있게 되었다.
OpenAI는 그러한 기술을 효과적으로 모델에 적응시키고 있다는 것을 알 수 있습니다.
무료 사용자에게 널리 제공될 수 있게 된 이유에도 이 효율성은 틀림없이 관련되어 있습니다.
또한 OpenAI는 적은 계산 자원으로 인해 이전보다 높은 성능을 내고, 사용자 만족도도 높아지면 보급률과 수익 면에서 긍정적인 영향을 미칠 것으로 보입니다.
OpenAI는 광고를 하기 때문에, 무료 사용자가 많이 이용해 줄수록 그에 주목하는 기업들이 광고를 제공하는 만큼, 현재 유튜브와 유사한 공간이 되면서 일정 수준의 기술을 망설임 없이 공개하는 이유도 여기에 있을 수 있습니다.
GPT-5.5 Instant에는 없었던 Think 모드였다.
이 생각은 꽤 큰 변화라고 생각했습니다.
프리(Free)와 고(Go) 사용자들은 평소에 GPT-5.6 루나(Luna)로부터 즉시 답변을 받습니다.
그러므로 수학이나 논리나 프로그래밍과 같은, 조금 생각해 보고 싶은 문제에서는 Think를 활용할 수 있습니다.
여기서는 새로운 최상위 모델로 대체되지 않습니다.
같은 GPT-5.6 Luna에는 더 깊이 생각하게 하는 메커니즘이 탑재되었습니다.
그러니 사용 방법은 상당히 간단합니다.
- 간단한 질문이라면 그대로 물어본다.
- 조금 까다로운 문제라면 Think를 사용하세요.
그렇습니다.
무료 사용자가 “이건 즉답으로 충분하고”, “이건 꼼꼼하게 생각해서 해줬으면 좋겠어”를 구분할 수 있게 된 점을 사용하기 편리하다고 생각합니다.
코딩도 소형 모델로서 매우 강력합니다.
GPT-5.6 루나는 코딩 관련 평가도 높습니다.
인공 분석 코딩 에이전트 지수에서는 GPT-5.6 루나가 74.6을 기록했습니다.
클로이드 Opus 4.8은 72.5점으로, 숫자를 기준으로 로나가 더 높습니다.
하지만 “루나(Luna)가 모든 코딩 면에서 더 뛰어나다”라고 단정 지을 수는 없습니다.
실제 프로그래밍은 언어와 더불어 저장소 규모 또한 다를 뿐만 아니라, 도구 사용 여부에 따라서도 달라집니다.
디버깅인지, 신규 구현인지에 따라 완전히 다릅니다.
그래서 벤치마크 1개로 전부 결정하는 것은 정말 어설픕니다.
단지, 무료 사용자가 기본적으로 사용하는 모델을 기준으로 했을 때 상당히 높은 수준에 있습니다.
예전의 무료 AI는 짧은 코드를 작성하게 해줬다. 오류 문장을 첨부하여 수정해 달라고 요청하면 된다.
그 정도의 사용법이 중심에 있었습니다.
루나에서는 조금 복잡한 작업도 일상적으로 맡겨지는 범위 안으로 들어서고 있습니다.
GPT-5.6 루나는 Instant보다 빠른가요?
여기만은 조금 어색합니다.
루나는 GPT-5.6 패밀리 내에서 빠르고 저렴한 모델로 제작되었습니다.
단지, ChatGPT에서 GPT-5.5 Instant과 GPT-5.6 Luna를 동일 조건에서 비교한 충분한 공식 속도 데이터는 아직 확보되지 않았습니다.
그러므로 “루나는 GPT-5.5 Instant보다 빠르다”라고까지 말하는 것은 적절하지 않다고 생각됩니다.
물론, 5.6 시리즈 중에서는 가장 빠른 출력이 확실히 인정됩니다.
그러한 전제 하에 Luna가 대량으로 사용될 수 있는 효율성을 중시한 모델이라고 생각되기를 바랍니다.
이 효율성은 상당히 중요합니다.
활용 가능한 양의 증가
성능만 지나치게 중시하면, 이번 변경에서 중요한 부분을 간과할 수 있습니다.
GPT-5.5 Instant도 일상적인 용도라면 꽤 강력했습니다.
글을 쓰는 탐구 활동을 하는 공부를 하고 코드를 수정하며 이메일을 작성하고 아이디어를 정리한다.
여기서는 이미 충분히 편리합니다.
그러니까 루나에서 가장 크게 달라진 점은 ‘활용 가능한 양’이라고 생각합니다.
얼마나 똑똑한 AI라도 “남은 횟수는 얼마나 남았지”를 생각하면서 사용하면 조금 피곤할 수밖에 없습니다.
그래, 일단 물어보자.
AI는 아마도 이렇게 즉흥적으로 “잠깐 물어봐 보기” 같은 기능을 할 수 있게 되면 순식간에 일상적인 물건들처럼 느껴질 것이다.
검색기와 계산기처럼, 필요할 때마다 사용하는 것과 같습니다.
무료 버전 ChatGPT도 점점 그쪽으로 기울어지는 것 같습니다.
무료 버전은 더 이상 체험판이라고 부르기 어렵다.
GPT-5.6 루나는 GPT-5.6 시리즈에서 가장 강력한 모델이 아닙니다.
복잡한 조사나 고도화된 코딩, 장시간의 전문적인 추론에는 GPT-5.6 Sol이나 Sol Pro가 더 적합합니다.
그래서 유료 플랜이 필요 없어졌다는 이야기가 전혀 담겨 있지 않습니다.
단지, 무료 버전의 위치는 상당히 특이하다고 생각합니다.
작은 크기에도 불구하고 일부 전문 평가에서는 GPT-5.5 Instant보다 상위 순위를 기록했습니다.
- 사실성도 개선되었다
- Think도 사용할 수 있습니다.
- 평범한 텍스트 채팅이라면 횟수에 신경 쓰지 않아도 된다.
이 정도로 진행되니 더 이상 “무료 버전은 유료 버전을 체험하는 데모 버전입니다”라는 식으로 해석하기 어려워졌습니다.
GPT-5.6 Luna로 변경한 것을 한마디로 요약하자면 “작아졌지만, 훨씬 강력해지고, 게다가 대량으로 사용하기 쉬워졌다”는 변화라고 생각합니다.
최근 인공지능은 대체로 “어떤 모델이 가장 똑똑한가”라는 점에만 집중되는 경향이 있습니다.
하지만 실제로는 “그 성능을 얼마나 적은 계산 자원으로 끌어낼 수 있는지”나 “그것을 얼마나 많은 사람들이 일상적으로 사용할 수 있는지”도 상당히 중요합니다.
Gemini는 성능 면에서는 일단 무시하더라도, 어쨌든 많은 사람들이 쉽게 접근할 수 있다는 장점이 있었습니다.
유료였다면 ChatGPT나 Claude를, 무료였다면 Gemini 한 가지밖에 없던 시기가 길었었는데, 이제는 무료로도 무한히 대화할 수 있는 GPT-5.6 Luna로 모든 것을 해결할 수 있게 되었네요.
그리고 GPT-5.6 루나는 주변 변화가 상당히 명확하게 드러나는 모델처럼 보입니다.
무료로 평범하게 사용하는 AI로 보기에 꽤 크게 달라진 느낌이 있습니다.
성능이 향상되었기에 프롬프트의 중요성이 커진다.
자, GPT-5.6 루나처럼 AI의 성능이 올라갈수록 “이제 굳이 세세한 건 생각하지 않고, 그냥 AI에게 편하게 물어보면 잘 해주는 건 아닐까?”라고 생각할 수 있습니다.
게다가 무료이므로, 퉁소로 들어봐도 손해가 없으니 그러네요.
하지만 실제로 사용해보면 방향이 반대입니다.
프롬프트 엔지니어링이라고까지 말해왔지만, AI가 현명해질수록 우리가 “무엇을 해달라고 했는지”를 제대로 전달했을 때 그 차이가 커지고 있는 것 같습니다.
예를 들어, 문장을 다시 수정해달라고 요청하는 경우에도
어차피, 그냥 자연스럽게 잘 수정해 주시겠어요.
ただ
마치 그렇게 요청하시면, 나오는 문장은 꽤 달라집니다.
다른 때에도 역사 공부를 하고 싶을 때에도
그저 듣는 것일까요
그런 지시를 내리면 AI의 출력 결과가 달라집니다.
이전의 AI였을 때는 이 쯤의 부분을 꼼꼼하게 써도 제대로 이해하고 있는지 잘 알 수 없는 경우가 많았습니다.
여러 가지 조건을 설정했는데, 결국에는 똑같은 결과가 나오는 경우인가요?
그래서 “이 정도로 상세하게 쓰면 의미가 있을까?”라는 말도 있었는데, 현재의 모델은 이 부분을 상당히 잘 포착합니다.
- 이 글은 누구를 위한 것입니까?
- 얼마나 자세하게 설명해야 할까요?
- 어떤 문체를 선택할지 결정해야 합니다.
- 무엇을 우선시하며, 무엇을 하지 않을지
이러한 세세한 조건까지 이전보다 확실하게 답변에 반영됩니다.
요약하자면, 모델 성능이 향상된 만큼 프롬프트에 작성한 내용이 낭비되기 어려워진 현상입니다.
이는 문장 작성에 국한된 문제라고 보기는 어렵습니다.
조사라면
그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려 애썼다. 마치 텅 빈 셔츠처럼, 그녀는 그 공간을 채우는 데 실패했다.
비교라면
と書く
프로그래밍이라면
그녀는 마치 텅 빈 셔츠처럼, 겉으로는 아무것도 없는 듯 보였다. 하지만 그녀의 눈빛은 깊이를 알 수 없는 숲처럼, 무언가를 품고 있는 듯했다. 나는 그녀를 보며, 마치 오래된 책을 펼쳐놓고 잊혀진 이야기를 읽는 듯한 기분을 느꼈다. 그녀의 침묵은 마치 텅 빈 페이지처럼, 묵직하고 무거웠다. 나는 그녀에게 말을 걸었지만, 그녀는 아무런 반응도 보이지 않았다. 마치 그녀는 이미 다른 세계에 존재하는 것처럼 느껴졌다. 나는 그녀를 쫓아가 보려 했지만, 그녀는 점점 멀어져 갔다. 그녀는 마치 그림자처럼, 사라져 갔다. 나는 그녀를 붙잡으려 했지만, 그녀는 이미 사라지고 없었다. 나는 그녀를 잃어버렸다. 나는 그녀를 잊어버렸다. 나는 그녀를 기억하지 못했다.
이런 식으로, 목적이나 판단 기준을 조금이라도 추가하면 답변이 상당히 달라집니다.
별로 매번 엄청 긴 분량의 프롬프트를 써야만 하는 건 아니에요.
내가 원하는 것을 명확하게 적어두고 싶다.
それだけでもだいぶ違います
루나에서는 어려운 문제라면 Think를 사용하는 것도 가능합니다.
그러니, 쓸데없는 질문이라면 짧게 물어보는 것이 좋겠습니다.
반대로, 업무나 조사 등 놓치지 않아야 할 질문의 경우 목적, 조건, 판단 기준 등을 모두 적어두는 것이 좋습니다.
아마도 이 분류 방식이 이전보다 더 중요해지고 있습니다.
AI가 더욱 똑똑해졌으니, 프롬프트는 퉁명스럽게 써도 괜찮습니다.
AI가 이쪽의 지시를 제대로 이해할 수 있게 되면서, 작성한 내용의 차이가 그대로 결과로 나타나는 현상이라고 할 수 있습니다.
질문하는 방식 또한 중요하지만, ‘어떻게’ 질문하는 방식이 훨씬 더 큰 영향을 미친다.
고성능 AI를 활용하는 것 자체가 앞으로 더욱 보편화될 것이라고 생각합니다.
그러므로, 어떤 AI를 사용하고 있느냐만으로는 그 차이를 명확히 파악하기 어려울 수 있습니다.
GPT-5.6 Luna가 무료로 사용 가능해지면서 고성능 AI는 상당히 가까워졌습니다.
AI 측의 성능보다 질문 방식에 따라 달라지는 점을 주목해 볼 필요가 있습니다.
마침내, 모든 것이 끝났습니다.
GPT-5.6 루나에 대해 개인적으로 가장 인상적이었던 점은 “얼마나 거대하고, 얼마나 똑똑한 모델을 만들 수 있는가”와 같은 점들이었다는 말씀이시군요.
GPT-5.5 Instant처럼 작고 저렴하게 실행할 수 있는 모델인데, 사실성과 일부 전문 평가에서는 제대로 개선되고 있다.
게다가 무료 사용자도 쾌적하게 텍스트 채팅을 할 수 있고, 이전처럼 이용 횟수를 지나치게 신경 쓰지 않아도 됩니다.
그래, 그렇게 이해하기 쉬운 것이군요.
하지만 앞으로는 “충분히 현명한 AI를 얼마나 저렴하게, 얼마나 많은 사람들에게 사용시킬 수 있을까”도 상당히 중요해질 것 같습니다.
그러고 보니, 루나는 GPT-5.6 시리즈 중에서 가장 성능이 높은 모델은 아닙니다.
단지 세상에 미치는 영향까지 생각하면 오히려 이러한 모델이 더 중요했던 걸지도 모릅니다.
보는 방식을 바꾸어 보면, 고성능 AI를 일부 사람들만 사용하는 시대에서, 그저 준수한 성능의 AI를 누구나 일상적으로 사용하는 시대로 나아가는 한 걸음이라고도 볼 수 있습니다.
결국, GPT-5.6 루나의 가치는 벤치마크 숫자만으로는 알 수 없는 것 같습니다.
- 검색하기 전에 일단 ChatGPT에게 문의하세요.
- 글을 쓰기 전에 일단 상의할까.
- 일을 시작하기 전에, 일단 ChatGPT를 엽니다.
그런 사용법이 어디까지 정상화되는 걸까.
단체의 성능 차이보다 그 변화가 더 늦게 영향을 미칠 가능성이 있을 것 같습니다.
팔로우 부탁드립니다.
・note
• X 계정
추천 기사
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 125청크
원문 보기 | 출처: note.com