들어가며
“오하요 카노죠”는 AI 일러스트 여자친구가 매일 아침 7시 30분에 잘 다녀오라고 인사해 주는 X 계정이다. 생성형 AI와 개인 개발에 대해 개발 일기를 매일 쓰고 있다.
“글을 쓰지 않는 AI”가 화제가 되고 있었다.
이름은 Jev.
ChatGPT와 Claude, 이미지 생성 AI.
내가 평소에 사용하는 AI는 무언가를 '만드는' 것이 많다.
글을 쓴다. 코드를 쓴다. 이미지를 만든다. 상담해 준다.
그래서 처음에 ‘글을 쓰지 않는 AI’라는 말을 들었을 때, 당연히 이렇게 생각했다.
"그럼, 뭐 할 건데?"
옆에서 린카가 들여다본다.
린카 “……판단만 할 뿐이래”
나 “판단?”
린카 “쓰지 않아. 고르는 거야.”
짧다.
하지만 조사해 보니 정말 그런 AI였다.
그리고 설명을 읽던 중, 다른 것이 신경 쓰였다.
나는 지금 note 활동과 개인 개발을 한데 모아 볼 수 있는 앱 "NEST"를 만들고 있다.
그래서 오랫동안 갖고 싶었던 것이,
“오늘은 어떤 아이디어를 키워 볼까?” “이건 기사 소재야, 아니면 작업이야?” “이런 내용이라면 어떤 그림이 어울릴까?”
같은 사소한 판단이었다.
나 “……이거, NEST에 쓸 수 있지 않을까?”
린카 “해 보면”
그렇죠.
그날 안에 등록했다.
Playground에서 시도해 봤다.
API 키도 발급했다.
그리고 어느새 NEST에 통합하고 있었다.
이번에는 NEST의 릴리스 기사가 아니다.
“글을 쓰지 않는 AI”란 결국 무엇인가.
그날까지 Jev를 몰랐던 내가 직접 써보고 직접 만든 앱에 적용해 본 기록.
애초에 “글을 쓰지 않는다”란 무슨 뜻일까?
Jev를 엄청 대충 설명하자면,
문장을 생성해 답하는 AI가 아니라, 정해진 형식으로 판단을 반환하는 AI
이렇게 이해하면 될 것 같다.
나 “ChatGPT처럼 이유를 줄줄이 늘어놓거나 하진 않아?”
린카 “안 해”
나 “상담 상대가 아니야?”
린카 ‘심판역’
그렇군요.
Jev에는 크게 3종류의 판단이 있다.
이름만 보면 조금 기술 기사 같은 느낌이 난다.
하지만 하고 있는 일은 어렵지 않다.
Noul. “할래? 안 할래?”
첫 번째는 Noul.
예/아니오에 가까운 판정.
‘하는 편이 좋을 것 같다’가 어느 정도인지를 퍼센트로 알려준다.
내가 “오늘 이거 할래?”
린카 “할 쪽으로 기울었어. 76%”
그런 느낌.
선택. “어느 쪽?”
다음은 초이스.
여러 후보 중에서 하나를 고른다.
나 “이거, 기사 소재야? 아니면 그냥 작업이야?”
린카 “둘 중 하나만 고르면 돼”
이해하기 쉽다.
Score. “어느 정도?”
마지막은 스코어.
이것은 단계 평가이다.
할지 말지가 아니라, 그 안에서의 비중을 숫자로 나타낸다.
나 “할지 말지만 정하는 게 아니라 우선순위까지 정해준다고?”
린카 “그래”
나 “……뭔가 린카 같네”
린카 “몰라”
정말 그럴듯하게 판단하는지 시험해 봤다
설명만 읽어서는 잘 모르겠다.
그래서 먼저 Jev의 Playground에서 테스트해 보았다.
NEST에서 사용하고 싶었던 것은,
오늘, 이 아이디어를 키울 후보로 제시해야 할까?
라는 판단.
3가지 패턴을 만들었다.
A
- 공개까지 3일
- 6일간 업데이트 없음
- 작업시간 30분
- 오늘 사용 가능한 시간 45분
결과는,
오늘의 후보: 76%
B
- 공개까지 20일
- 어제 만졌다
- 작업 시간 90분
- 오늘 사용 가능한 시간 30분
결과는,
오늘의 후보: 19%
C
- 공개까지 1일 전
- 14일간 업데이트 없음
- 작업 시간 20분
- 오늘 사용 가능한 시간 60분
결과는,
오늘의 후보: 79%
나 "B만 엄청 낮아"
린카 “당연하지”
나 "공개까지 여유도 있고, 어제도 건드려봤고, 90분이 필요한데 오늘은 30분밖에 없어"
린카 “스스로 알고 있잖아”
그건 그래.
다만, 그 ‘사람이라면 왠지 알 수 있는 것’을 소프트웨어로 어떻게 표현할지가 어렵다.
전부 if문으로 만들면,
이런 식의 규칙이 점점 늘어난다.
하지만 정작 나는 그런 계산을 하면서 ‘오늘은 이걸 하자’라고 정하는 것은 아니다.
그래서 이 판단을 Jev에게 맡길 수 있다는 점이 흥미로웠다.
우선순위까지 매겨주었다
다음으로 Score도 시도했다.
같은 3가지 조건으로 다시 실행했다. 수치는 조금 달라졌지만, 경향은 같았다.
결과는 이렇게 됐다.
A … 오늘의 후보 75%/오늘의 우선도 2.62(4점 만점)
B … 오늘의 후보 22% / 오늘의 우선도 0.85 (4점 만점)
C … 오늘의 후보 79%/오늘의 우선도 3.41(4점 만점)
제대로,
C > A >> B
되었다.
Noul만으로는 A와 C가 상당히 가깝다.
하지만 점수에서는 C가 명확히 더 높다.
나 “이거라면 쓸 수 있을 것 같아”
린카 “그래서?”
나 “넣을게”
린카 "빨리"
그날 안에 NEST에 통합했다.
현재 NEST에서는 Jev를 4곳에서 사용하고 있다
현재 NEST에서는 Jev의 3종류를 모두 사용하고 있다.
용도로는 4가지가 있다.
1. 오늘의 후보로 낼 것인가
노을
구상 중인 아이디어에 대해,
오늘의 후보로 낼 가치가 있을까?
을 판정한다.
2. 오늘의 우선순위
스코어
후보를 0~4로 평가한다.
NEST에서는 '오늘의 후보'의 판정과 우선순위를 1회의 Jev 호출로 동시에 확인하고 있다.
그 결과에서 후보를 추려 우선순위대로 나열한다.
3. 아이디어인가 태스크인가
선택
NEST의 Inbox는 입구를 하나로 통일하고 있다.
기사 소재든 개발 작업이든, 일단 집어넣는다.
예를 들어,
Jev의 기사 구성을 구상하다
이라면 Idea.
NEST의 UI를 수정한다
라면 태스크.
추가한 뒤, Jev가 알아서 분류한다.
물론 틀릴 때도 있으니 직접 변경할 수 있다.
4. 표준 에셋 선택
이것도 선택이다.
NEST에는 카드용 표준 에셋이 28종 있다.
제목을 입력하면, 그 내용에서 Jev가 어울릴 만한 것을 고른다.
예를 들어 기술계라면 PC.
기사 소재는 노트에.
AI 상담이라면 ジュリ.
그런 느낌.
확신이 낮으면 범용 노트 이미지로 되돌린다.
수수하다. 하지만, 바로 이 '수수함'을 원했다
여기까지 사용해 보고 든 생각이다.
Jev에서 하고 있는 일은 전부 꽤 소박하다.
기사를 써주는 것도 아니다.
이미지를 만들어 주는 것도 아니다.
코드를 통째로 만들어주는 것도 아니다.
하지만,
- 이건 Idea? Task?
- 오늘은 후보로 낼까?
- 어느 정도 우선해야 할까?
- 어떤 그림이 어울릴까?
같은,
사소하지만 매번 내려야 하는 판단
를 맡아 준다.
나 "이런 판단이라는 건, 하나하나는 별거 아니거든"
린카 “그래도 쌓이잖아”
그래.
NEST에서 하고 싶었던 것도, 바로 그 점이었다.
여기만 보면 괜찮습니다
그렇게 느껴지는 장소를 만들고 싶다.
그러기 위해서는 정보를 모으는 것만으로는 부족하다.
다음에 무엇을 볼까.
어느 것을 만질까.
무엇으로 취급할 것인가.
그런 작은 판단이 필요해진다.
Jev는 거기에 빠졌다.
AI에게 모든 걸 결정해 달라는 건 아니다
여기가 중요한 부분입니다.
NEST에서는 Jev가
오늘은 이걸 해라
라고 멋대로 정하는 것은 아니다.
Jev가 내놓는 것은 후보다.
마지막으로 선택할 사람은 나다.
Idea / Task의 분류도 변경할 수 있다.
표준 에셋도 변경할 수 있다.
오늘의 후보를 무시하고 다른 일을 해도 된다.
나 "AI에게 결정해 달라는 게 아니야"
린카 “그럼 뭘 원하는 거야?”
나 “망설이는 횟수를 줄이고 싶어”
결정권을 넘기고 싶은 게 아니야.
판단 자료를 정리해 주었으면 한다.
거기서부터는 스스로 결정하고 싶다.
NEST에서도 그 거리감은 깨고 싶지 않다.
Jev를 탑재한 “NEST”는 현재 테스트 중
이번에 Jev를 탑재한 것은 현재 개발 중인 NEST라는 앱이다.
쓰고 싶은 마음이 자라는 곳.
떠오른 생각은 우선 하나의 Inbox로.
아이디어는 키우는 것이다.
Task는 정리한다.
할 날짜가 정해지면 '이번 주'에 둔다.
오늘 무엇을 할지 고민된다면, NEST가 후보를 추천한다.
현재는 테스트 중입니다.
가까운 시일 내에 출시할 예정이다.
NEST 자체에 대해서는 출시할 때 별도 기사에서 제대로 쓰겠습니다.
이번에는 어디까지나,
글을 쓰지 않는 AI란 뭐야?
부터 시작해서,
“이거, 내 앱에 쓸 수 있잖아”
그렇게 되어 그날 안에 넣어버린 이야기.
맺음말
아침에는 Jev를 몰랐다.
밤에는 NEST 안에서 움직이고 있었다.
아직 사용하기 시작한 지 얼마 되지 않아서, 이것이 어디까지 유효할지는 모르겠다.
좀 더 실제로 사용해 보고 싶다.
하지만 내 안에서 단 하나 바뀐 것이 있다.
지금까지 생성형 AI를 보면,
뭘 만들어 줄 수 있어?
라고 생각하고 있었다.
문장.
이미지.
코드.
하지만 Jev를 보고, 처음으로 이렇게 생각했다.
무엇을 판단해 주나요?
옆을 본다.
린카 “그럼, 다음은?”
나 “NEST의 테스트”
린카 "그럼 빨리 할게"
네.
아마 내가 Jev를 재미있다고 생각한 건 바로 그 점이다.
🌱 이 기사의 추천 정원
관련 기사
요의 한마디
오늘도 수고했어! 망설일 때는 일단 움직여 보자!
👉“오하요 카노죠”는 @ohayo_kanojo에서 매일 아침 7:30에 게시하고 있습니다
#Jev #TypeSafeAI #SystemOneModel #ChatGPT #ClaudeCode #개인개발 #개발일기 #비즈니스 #ChatGPTCreativeClub #아카리움
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 84청크
원문 보기 | 출처: note.com