# 생성 AI 트렌드 보고서｜Gemini 3.8 Flash TTS / Claude Opus 5.5 / GPT-6 솔·루나 등 주요 업데이트 뉴스 요약 (2023년 9월 21일 ~ 2023년 9월 27일)

> https://bookfactory.kr/board/news/19691
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-10-03T00:01:27.584Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/318375857/rectangle_large_type_2_2160c2d588d852ce8ed3d47e79254456.jpeg?width=1280)

안녕하세요, WEEL 미디어 부입니다!

2026년 9월 21일부터 2026년 9월 27일까지 생성 AI 관련 주요 트렌드를 엄선하여 제공합니다.

Anthropic, OpenAI, SpaceXAI가 연이어 플래그십급 모델을 투입하면서 “더 높은 성능을 더 저렴하게”라는 가격 경쟁이 더욱 가속화되었습니다.

더욱이 구글의 음성 생성, 알리바바의 경량화 이미지 생성 모델 등도 등장하면서 텍스트 외 다른 모드에서도 실용성이 크게 높아지고 있습니다.

마치까지 시청해주시면 업무 효율화 및 업무 개선에 도움이 됩니다!

매월 트렌드 보고서를 PDF로 모아 제공하는 콘텐츠로, 최신 AI 툴부터 국내외 기업의 최신 동향, 업무 효율화에 도움이 되는 실무 사례까지 다룹니다. 한 달간의 AI 뉴스를 이 한 권으로 쏙쏙!

다운로드는 여기서 확인하세요 ✨

## 제미니 3.8 플래시 TTS란 무엇인가? 구글의 가장 표현력이 풍부한 음성 생성 AI의 특징 및 사용법을 상세히解説

제미니 3.8 플래시 TTS는 구글이 개발한 최신 음성 생성 AI입니다. 특히, 그 표현력에 정평이 있으며, 마치 인간이 말하고 있는 것처럼 자연스러운 음성을 생성할 수 있습니다.

플래시 TTS라는 명칭처럼, 매우 빠른 처리 속도가 특징이며, 실시간으로 음성 생성이 가능합니다. 이를 통해 다양한 용도로 활용되고 있습니다.

본 기사에서는 제미니 3.8 플래시 TTS의 주요 특징과 사용법을, 초보자분들께도 쉽게 상세히 설명해 드리겠습니다.

주요 특징

*   압도적인 표현력: 음성의 톤, 억양, 리듬 등을 세밀하게 제어할 수 있어, 마치 인간이 말하고 있는 것처럼 자연스러운 음성을 생성할 수 있습니다.
*   고속의 처리 속도: 플래시 TTS라는 명칭처럼, 매우 빠른 처리 속도를 구현하여, 실시간으로 음성 생성이 가능합니다.
*   다양한 용도에 대한 대응: 음성 비서, 콘텐츠 제작, 교육, 엔터테인먼트 등 다양한 용도로 활용될 수 있습니다.

사용법

제미니 3.8 플래시 TTS의 기본적인 사용법은 다음과 같은 단계로 진행됩니다.

1.  제미니 3.8 플래시 TTS 접근: 구글 클라우드 플랫폼을 통해 제미니 3.8 플래시 TTS에 접근합니다.
2.  API 이용: 제미니 3.8 플래시 TTS의 API를 이용하여 텍스트를 음성으로 변환합니다.
3.  파라미터 설정: 음성의 톤, 억양, 리듬 등을 조정하기 위한 파라미터를 설정합니다.
4.  음성 생성: 설정한 파라미터에 따라 텍스트를 음성으로 변환합니다.

향후 전망

구글은 제미니 3.8 플래시 TTS의 기능을 더욱 발전시켜 나갈 예정입니다. 더욱 자연스럽고 인간다운 음성의 생성, 다양한 언어에 대한 대응, 그리고 더욱 많은 용도에 대한 적용이 기대됩니다.

![Gemini 3.8 Flash TTS](https://assets.st-note.com/img/1790556932-b1EmWR8ew5DAzBL3hJGaZqQ2.png?width=1200)

자연어 프롬프트만으로도 캐릭터의 음성을 처음부터 설계할 수 있으며, 100개 이상의 언어 및 방언에 대응합니다. 1행 단위의 연기 지시, 2인방의 대화, 수시간에 달하는 장편 음성도 일관된 음질로 생성할 수 있습니다. Hume AI의 종합 품질 지표에서 Flash TTS가 1위(0.920), Flash-Lite TTS가 2위(0.914)를 기록했습니다. 일본어 평가에서도 1232의 최고 점수를 기록하여, 전 세대의 3.1 Flash TTS(1148)를 크게 상회했습니다. API 요금은 출력 100만 토큰당 9.00달러이며(2027년 1월 1일부터 18.00달러로 변경 예정).

Gemini 3.8 Flash TTS는 Google이 2026년 9월에 발표한 최신 음성 생성 모델입니다.

가장 큰 특징은 “차분한 30대 여성 내레이터”처럼 단순히 말로 지시하는 것만으로도 목표에 부합하는 목소리를 0부터 만들어낼 수 있다는 점입니다. 수 시간 분량의 오디오에서도 음질과 페이스가 흔들림 없이, 일본 평가에서도 최고 수준의 품질을 보여줍니다.

e러닝 교재 내레이션, 사내 영상, 팟캐스트 제작 등 음성 콘텐츠 내製화에 적합한 모델입니다. 요금 인상 전 자사의 용도에 맞는지 검증해 두는 것을 추천합니다.

## 2. 【Qwen-Image-2.1】7B로 투명 이미지 생성이 가능한 알리바바의 최신 이미지 생성 AI 사용법 및 성능을 심층적으로 분석합니다.

![Qwen-Image-2.1](https://assets.st-note.com/img/1790556938-dAbXVKsfIog84J2au60OSUDn.png?width=1200)

시각 생성부는 7B 파라미터에도 불구하고 Qwen-Image-Bench에서 60.28의 점수를 달성했습니다. RTX 4090으로 1024×1024 이미지를 약 18.7초 내에 생성할 수 있으며, 로컬 환경에서도 충분히 작동합니다. RGBA 투명 이미지를 네이티브 방식으로 생성할 수 있으며, 최대 10장의 참조 이미지를 활용한 편집에도 대응합니다. 연구 목적으로는 무료로 사용 가능하지만, 상업적 이용 시 별도의 라이선스 신청이 필요합니다.

Qwen-Image-2.1은 알리바바가 2026년 9월 20일에 공개한 오픈 웨이트 AI 모델로, 이미지 생성 및 편집 기능을 통합했습니다.

7B라는 경량 모델임에도 불구하고 많은 클로즈드 소스 모델을 능가하는 품질을 제공합니다. 특히 배경을 투과한 이미지를 직접 출력할 수 있다는 점은 잘라내기 작업의 번거로움을 줄여주는 큰 매력입니다.

배너나 EC사이트 상품 이미지, 자료용 소재 제작 등 디자인 업무의 속도 향상에 직접적으로 기여합니다. 다만 상업적 이용에는 라이선스 신청이 필요하므로, 업무에 포함하기 전에 이용 조건을 꼼꼼히 확인하시기 바랍니다.

## 3. 스페이스X 데이터로 훈련된 스페이스X AI의 최강 코딩 모델의 성능, 사용법, 요금제를 상세히 설명합니다.

![Grok 4.7](https://assets.st-note.com/img/1790556944-5U9pjlDiQzWPmNc23MHOGRwh.png?width=1200)

파라미터 수가 약 1.5조에서 약 2.1조로 약 40% 증가했으며, 전 벤치마크에서 성능이 향상되었습니다. Terminal-Bench 4.0의 점수가 20.3%에서 38.0%로 거의 2배나 상승했습니다. CursorBench 4.0에서는 46.3%를 기록했으며, Grok 4.6 대비 6점 향상되었습니다. API 요리는 입력 2달러, 출력 6달러(100만 토큰당)이며, 전 모델과 동일한 가격을 유지합니다. SpaceX의 25년 분량의 로켓·위성 엔지니어링 데이터를 보조 훈련에 활용하고 있습니다.

Grok 4.7은 SpaceX AI가 2026년 9월 22일에 출시한 코딩 및 에이전트용 프론티어 모델입니다.

SpaceX가 축적해 온 하드웨어 개발 데이터를 학습에 활용하는 점이 다른 모델에는 없는 독특한 특징입니다. 또한 요금은 고정되어 있어 실질적인 가격 인하라고 할 수 있습니다.

개발팀에서 AI 코딩 툴 선정 작업을 진행하고 계신다면, 비용 대비 성능 비교 대상으로 꼭 후보에 포함해 보시기 바랍니다.

## 4. 클로드 Opus 5.5는 무엇인가? Fable 5.1급의 성능을 Opus 5 대비 40% 낮은 비용으로 사용할 수 있는 Anthropic의 최신 모델을 심층적으로 분석합니다.

![Claude Opus 5.5](https://assets.st-note.com/img/1790556948-w1Lgmf6cY4pQW5yq2SNEKo9V.png?width=1200)

일반적인 워크로드에서 Opus 5 대비 약 40%의 비용 절감 효과를 달성했습니다. 에이전트형 코딩 지표인 Terminal-Bench 4.0에서 66.4%를 기록했습니다. 초기에 테스트에 참여한 사례에서는 68만 행의 코드 이전을 1일 미만으로 완료했습니다. 출력 생성 속도는 Opus 5보다 30% 이상 빠르고, 캐시 읽기 요금은 $0.50에서 $0.20으로 60% 인하되었습니다.

클로드 Opus 5.5는 Anthropic이 2026년 9월에 발표한 Claude 5.5 패밀리의 첫 번째 모델입니다.

많은 업무에서 최상위 모델인 Claude Fable 5.1과 동등한 성능을 발휘하면서도 비용을 크게 절감할 수 있다는 점이 가장 큰 강점입니다. 적응적 사고(adaptive thinking)와 노력 설정을 결합하여, 작업에 따라 정확성과 비용의 균형을 조절할 수 있습니다.

대규모 코드 이양이나 연구 업무 등, 기존에 비용 문제로 본격적인 도입을 망설였던 무거운 작업에도 접근성이 높아졌습니다.

## 5. 【GPT-6 Sol / Luna】API 가격이 절반에! GPT-6 Astra의 기술을 계승한 신 모델의 성능, 가격, 사용법을 철저히 해설

![GPT-6 Sol / Luna](https://assets.st-note.com/img/1790556954-myO6tJqIce7CDsP5oSHnwha2.png?width=1200)

✅ API 요금은 전 세대 대비 50% 인하 (Luna: 입력 0.10달러/출력 0.50달러, Sol: 입력 2.00달러/출력 10.00달러) ✅ DeepSWE v1.1에서 Sol이 68.8%, Luna가 66.6%를 기록하며, 동등 모델보다 약 80~96% 낮은 비용으로 이용 가능하다 ✅ GPT-6 Sol의 사실성 오류율은 GPT-5.6 Sol의 약 절반에 개선 ✅ 최대 105만 토큰의 컨텍스트 윈도우에 대응 ✅ 추론 에포트(inference effort)를 none~max의 6단계에서 조절 가능하다

GPT-6 솔과 GPT-6 루나는 OpenAI가 2026년 9월 22일에 출시한 GPT-6 시리즈의 신모델입니다.

최상위 모델인 GPT-6 Astra와 동일한 훈련 기법으로 개발되었으며, Sol은 업무 및 코딩에 특화된 핵심 모델이고, Luna는 고속·저비용으로 대량 처리에 강한 경량 모델이라는 위치를 차지합니다. 사실성 오류가 반감된 점 또한 업무 이용에서는 간과할 수 없는 개선 사항입니다.

문의 응대나 문서 일괄 처리 등의 대량 작업은 Luna, 정밀도가 요구되는 업무는 Sol로 나누어 사용함으로써 AI 활용 비용을 크게 최적화할 수 있습니다.

## 저기, 그 ‘별의 전설’이라는 책이 정말 대단하지? 이렇게 짧은 책 안에 인생의 교훈이 담겨 있는 거니까. 내가 제일 좋아하는 부분은 ‘소중한 것을 찾기 위해서는, 우선 소중한 것을 찾아야 한다’는 부분이야. 나이가 들면 잊게 되지만, 어렸을 때처럼 생각했던 마음을 떠올려 줬으면 좋겠어. 정말 단순하지만, 깊이 있는 책이다.

그런데, 요즘 읽은 책 중에 정말 감동받은 게, ‘밤은 짧아, 소녀를 걷게 해’라는 모리미 토미오키 씨의 작품이야. 독특한 세계관과 유머에 가득 찬 문체로, 읽으면서 정말 즐겁고 꿈결 같은 기분이었어. 특히 ‘비 오는 밤에, 비 오는 밤에, 비 오는 밤에…’라는 문구가 계속 머릿속에 남아.

이번 주에는 Claude Opus 5.5, GPT-6 솔/루나, Grok 4.7과 주요 각사의 LLM이 같은 주에 모여 매우 짙었던 한 주였습니다.

공통적으로는 성능을 향상시키면서 가격을 유지하거나, 심지어 대폭 인하하고 있다는 점입니다. ‘최고 성능의 모델을 선택하는’ 시대에서 ‘업무별로 최적의 비용을 갖춘 모델을 선택하고 분리하는’ 시대로 이동하고 있다고 볼 수 있습니다.

또한, Gemini 3.8 Flash TTS나 Qwen-Image-2.1과 같이 음성 및 이미지 영역에서도 실무에 바로 사용 가능한 품질의 모델이 증가하고 있습니다. 내레이션이나 이미지 소재 제작 등, 이전에 외주로 의뢰했던 업무를 내부화할 기회가 열리고 있습니다.

새로운 모델이 나올 때마다 정보를 쫓아가는 데 그치지 않고, “우리 회사의 어떤 업무에 적용할 수 있을지”라는 시각으로 작게 시도해 보면서 시작하는 것이 좋습니다.

WEEL의 무료 메일マガ진 구독을 적극 추천합니다!

✉️ 메일マガ신 구독하세요

💡 AI 활용, 어디서부터 시작해야 할지 고민이신 분들께 추천합니다. “생성 AI를 자사에 도입하고 싶지만, 무엇부터 시작해야 할지 모른다.” 또는 “구체적인 업무를 어떻게 자동화할 수 있는지, 전문가의 의견을 듣고 싶다.”

그 방향에 맞춰 무료 개인 상담을 진행하고 있습니다! 현장 사례를 포함하여 쉽고 명확하게 설명해 드립니다. ✨ 지금 바로 AI 전문가와 상담하세요 ✨

**출처:** [note 원문](https://note.com/weel_media/n/nd561b9124440)

*번역: Gemma 3(.44) 초벌 + 교정 23청크*

[원문 보기](https://note.com/weel_media/n/nd561b9124440) | 출처: note.com