이번 주부터 월요일에 ‘지난 한 주간의 AI 뉴스’를 요약하는 것을 시작할 예정입니다.
이유는 간단한데, 따라갈 수 없기 때문입니다. 매일같이 나타나고, 특히 주말에 더 많습니다. 눈을 떠보니 모르는 모델명이 5개나 늘어난 것을 발견했습니다.
따라서 1주일 분량을 모아서 제작 측에 관련된 부분만 기록하겠습니다. 모든 내용을 쫓을 수 없으며, 쫓아야 할 부분도 있을 것입니다.
이번 주(8월 18일 ~ 23일)에는 큰 물건이 두 개 있었습니다.
앤서니(Anthropic, Claude의 회사)가 상장하려 하고 있으며, 애플 뮤직이 AI가 만든 곡에 라벨을 붙이기 시작했다.
정리에 따르면, 2023년 1월 26일에 개최된 “마츠다 타쿠시의 2023년 1월 1일부터 2023년 12월 31일까지의 모든 책을 읽는 프로젝트”의 최종 결과는 다음과 같습니다.
총 134권의 책을 읽었습니다.
이 프로젝트는 마츠다 타쿠시가 2023년 한 해 동안 읽은 모든 책을 기록하는 것을 목표로 했습니다.
마츠다 타쿠시의 독서 기록은 앞으로도 계속될 예정입니다.
목차
1차 번역문: 제공 정보가 부족합니다. 77번째 본문 청크의 일본어 텍스트를 제공해 주시면, 자연스럽고 정확한 한국어 번역본을 제공해 드리겠습니다.
- 클로이드(Claude) 회사가 역대 최대 규모의 상장을 시도하고 있다.
- 그렇다면 우리에게는 어떤 관련이 있을까요?
- 애플 뮤직이 “AI가 만든 곡”이라는 라벨을 붙이기 시작했다.
- 표시되는 시대의 재현 방식
- Sora API는 9월 24일에 종료됩니다.
- 영상 모델의 현재 위치 (2023년 8월 기준)
- 인기 있는 Veo 3.1과 Kling 3.0
- Runway Gen-4.5는 “원하는 대로 조작할 수 있는 사람들을 위한” 모델입니다.
- 씨덱스 2.5가 지금 가장 강력하다.
- 세밀하고 효과적인 것
클로이(Claude) 회사가 역대 최대 규모의 상장을 시도하고 있다.
가장 큰 뉴스는 바로 이것입니다.
앤트로픽——제가 매일 사용하는 Claude를 만드는 회사인 앤트로픽이 8월 말 상장 신청을 할 것이라는 소식이 21일에 나왔습니다. 상장은 10월을 목표로 합니다.
숫자가 조금 어색합니다.
연 환산 매출: 약 650억 달러
기업용 API 시장에서 처음으로 OpenAI를 꺾고 1위(Anthropic 32% / OpenAI 25%)를 차지했으며, Claude Code 단일 제품의 연 환산 매출은 25억 달러, 투자자들이 주목하는 기업 가치 평가액은 1조 ~ 2조 달러 수준임.
실현된다면, 스페이스X를 넘어 역대 최대 상장 기업이 될 것이라고 합니다.
2조 달러라고 하니까, 단위가 전혀 모르겠어요.
그렇다면 우리에게 어떤 관련이 있을까요?
솔직히, 상장 여부는 중요하지 않습니다. 주식을 사는 이야기가 아니기 때문입니다.
제가 인상 깊었던 것은 바로 여기였습니다.
CNBC는 상장 출처 서류(S-1)의 위험 요인에 “AI에 대한 세간의 반발”이 포함될 것으로 보도하고 있습니다.
이건 상당히 굉장한 일이라고 생각했거든요.
AI가 널리 사랑받지 못하는 것에 대해, AI 회사가 공식 문서에 스스로 이를 표현합니다. “일부에서 비판받고 있다”는 식으로 표현하는 대신, “사업의 위험성”으로 포장하는 것입니다.
AI로 영상을 제작하고 납품하는 측면에서는 이는 자신들의 일이 아니라는 뜻이 아닙니다.
저 역시 AI가 만들어졌다는 식으로 말하느냐 아니냐에 따라 반응이 달라지는 상황을 실제로 여러 번 지켜보고 있습니다. 그 분위기가 지금 세계에서 가장 역동적인 기업의 실적 보고서에 담기는 것을요.
바람이 한 방향으로 불어오는 것과 반대 방향으로 불어오는 것이 동시에 느껴지면서, 묘하게 설명하기 힘든 감정이 들었습니다.
애플 뮤직이 “AI 작곡곡”이라는 라벨을 붙이기 시작했다.
21일, 애플이 “실질적으로 AI가 생성한 곡”이라는 라벨을 부착하는 방식을 발표했습니다.
유튜브와 인스타그램도 이미 AI 생성 표시栏 자체를 보유하고 있습니다. 문제는 “자동으로 얼마나 판정하고, 얼마나 주목받게 할 것인가” 하는 부분입니다.
표시되는 시대의 구성 방식
저는 여기, 비관하지 않습니다.
숨을 의도가 없다면, 라벨이 붙는 것 자체가 불편하지 않습니다. 오히려 “AI 같은 모습”을 지우려 애쓰는 방식이 더 불편합니다.
단순히 업무 진행 방식에 있어서 한 가지 차이가 있을 것이라고 생각하고 있었습니다.
이건 AI가 만든 것을 배송할 때 먼저 말씀드리는 것이 당연합니다.
먼저 말씀드리고 싶습니다. 이것만으로도, 나중에 나올 이야기의 번거로움이 절반이나 줄어듭니다. 라벨이 자동으로 붙는다는 전제라면, 숨기는 선택지는 존재하지 않습니다. 저는 명함, 브로셔, 웹사이트, 기사, 영상 모두 AI로 제작하고 있으며, 그것을 알고 계신 분들께 상의를 받고 있습니다.
Sora API는 9월 24일에 종료됩니다.
이것은 실무적인 이야기입니다.
OpenAI의 Sora는 2026년 9월 24일에 API가 중단될 예정입니다.
앱을 통해 다루는 사람들에게는 직접적인 관련이 없지만, 자동화 워크플로우에 Sora를 통합하고 있는 사람들은 이관이 필요합니다. 딱 1개월 밖에 남지 않았습니다.
소라는 작년에도 한 번 다 끝냈기 때문에 “또야”라는 생각과 “그래, 그렇게 될 수도 있겠네”라는 생각이 반반이었다. 나는 오랫동안 접하지 않았는데, 소라만의 독특한 영상 습관 때문에 잘 맞지 않았다.
이미 워크플로우에서 제외되어 실해는 없지만, AI 툴을 종료한다는 전제하에 습관을 들이는 것이 좋을 것 같다는 생각이 들게 했습니다.
영상 모델의 현재 위치 (2023년 8월 기준)
이번 주에는 각 기관의 요약이 업데이트되면서 영상 모델 순위도 확인해 보았습니다.
지금 언급되는 명단은 이 정도 범위입니다.
・Seedance 2・Google Veo 3.1・Kling 3.0・Alibaba Wan 2.7・Grok Imagine Video 1.5・Runway Gen-4.5・Luma Ray 3.2・MiniMax Hailuo 2.3
많이요
인기 있는 Veo 3.1과 Kling 3.0
Veo 3.1: 프롬프트 충실도, 원어민 음성 그대로 출력, 가로 세로 모두 4K. 종합력으로 1위 평가. Kling 3.0: 빛 표현 방식과 복잡한 움직임(머리카락, 액체, 천)으로 Veo에 필적하며, 심지어 컷을 겹쳐서 음성이 연결되는 멀티샷 콘테이트 모드를 보유하고 있다.
클링의 멀티샷은, 은근하게 가장 효과적인 방법이라고 생각합니다.
AI 영상에서 가장 번거로운 것은 장면을 이어 붙인 후 편집으로 억지스럽게 고른다는 느낌의 음성 퀄리티 차이를 수정하는 작업이 많다는 점입니다. 각 씬마다 음향 텍스처가 다르고, 편집 과정에서 이를 맞춰내야 하니까요. 이런 부분이 줄어들면 정말 기쁠 것 같습니다.
Runway Gen-4.5는 “원하는 대로 조작할 수 있는 사람들을 위한” 모델입니다.
카메라 워크, 모션 브러시, 참조 이미지에서의 캐릭터 일관성은 여전히 중요한 위치를 차지합니다.
그리고 여전히 핵심적인 방법은 이것입니다.
정지화로 그림을 결정하고 수정한다
제 Midjourney → Seedance의 흐름도, 구조적으로는 동일합니다. 결국 “첫 번째 이미지를 얼마나 채울 수 있는가”에서 후 공정의 퀄리티가 결정되기 때문입니다. 이는 이번 주 정보도 보기에 크게 달라지지 않았습니다.
씨덱스 2.5가 지금 가장 강력하다.
정말 놀랍습니다. 프롬프트만으로도 영화 같은 결과물을 얻을 수 있습니다.
어쩌면 Gen3 때 어려움을 겪을 때가 더 재밌었다고 생각하게 되기도 해요. 특히 카메라 워크는 정말 대단하고, 좋은 결과물을 얻었구나 생각하면서도, 제가 상상했던 것 이상으로 완성도가 높아서 제가 만든 것이라고 말하고 싶지 않고, 계속해서 초심으로 돌아가고 싶다는 울증과 싸우고 있습니다.
세밀하고 효과적인 것
・ChatGPT(맥판)이 메시지 연계 기능을 지원합니다. 허용하면 iMessage의 읽기, 검색, 요약, 초안 작성, 전송까지 가능합니다. 편리하면서도 씁쓸합니다.
・Gemma의 누적 다운로드 수는 10억 건을 초과했으며, 파생 모델은 10만 건 이상입니다. 작은 모델의 계층이 두터워졌습니다.
・Gemini Live에는 학생용 Student Hub가 있습니다. 학습 노트, 진단 퀴즈, 3D 다이어그램 등이 포함되어 있습니다. 아이가 셋 있는 입장에서 이쪽의 진화가 일상생활에 더 와닿습니다.
・SpaceXAI의 Grok 4.6입니다. 프론티어급 평가를 받았으며, 추론 가격이 현저히 저렴하다는 평가입니다.
・Nvidia가 Poolside에 60억 달러의 라이선스 계약과 10억 달러의 투자금을 더했습니다. 인수 합병이 아닌 ‘라이선스 + 투자 + 인력’ 형태입니다. 최근 이 형태가 늘어나고 있습니다.
요약:
이번 주말 츠키시마 료가 ‘마법소녀 마기’의 새로운 만화 12권을 선보입니다. 10권부터 16권까지 총 6개의 새로운 이야기가 공개되며, 마기 세계관의 핵심 사건들과 캐릭터들의 성장, 그리고 매력적인 새로운 캐릭터들의 등장으로 풍성한 볼거리를 제공할 것으로 기대됩니다. 특히 13권에서는 멜리사와 료의 관계가 깊어지는 과정이, 15권에서는 새로운 적의 등장과 함께 긴장감 넘치는 전개가, 16권에서는 마기의 최종 운명에 대한 중요한 단서가 드러날 것으로 보입니다.
츠키시마 료는 이번 6권 공개와 함께 ‘마법소녀 마기’의 미래 비전을 제시하고, 독자들에게 깊이 있는 감동과 재미를 선사하기 위해 끊임없이 노력할 것을 약속했습니다.
독자 여러분의 많은 관심과 기대 부탁드립니다.
바로 움직이는 것이 좋습니다. 소라 API 중단(9/24)을 활용하고 계신 분들께만 해당하며, 마감일이 얼마 남지 않았습니다. 이번 주 안에 대체 방안을 결정하는 정도로 충분합니다.
알아두면 좋을 사항은 다음과 같습니다. Apple Music의 AI 라벨은 당장 뭔가 달라지는 것은 아닐 것입니다. 다만, “표시 기준”에 맞춰 제작 방법과 전달 방식을 미리 준비해두면 나중에 당황하지 않을 수 있습니다.
Anthropic 상장 발표는 화려하지만, 내일 작업 일정은 변동 없습니다. Veo와 Kling도 기존 워크플로우를 가지고 있다면 아직 서둘러야 하지 않습니다. 저는 Kling의 멀티샷 기능만 간단히 테스트해 볼 생각입니다.
이번 주에 가장 짚었던 건 역시 S-1의 “AI 반발”이었습니다.
AI로 먹고 있는 회사들이 AI가 혐오당하고 있다는 사실을 공식적으로 인정하고 있습니다. 그 옆에서 저는 AI로 영상을 제작하여 납품하고 있습니다.
부정하거나 바로 맞서 싸우는 대신, 질문이 들어오면 평소처럼 솔직하게 대답할 수 있는 상태를 만들어 둔 것이 지금 가장 강인하다고 생각합니다.
다음 주에도 월요일에 1주일 분량을 모읍니다.
마지막까지 읽어주셔서 감사합니다.
AI 영상 크리에이터 AUN
최근 AI 영상 크리에이터 AUN이 등장하여 큰 주목을 받고 있습니다. AUN은 딥러닝 기술을 기반으로 제작된 AI 영상 생성 플랫폼으로, 사용자가 텍스트 프롬프트만 입력하면 고품질의 영상을 자동으로 생성해 줍니다.
AUN의 가장 큰 특징은 바로 ‘창의성’입니다. 단순히 이미지를 합성하거나 기존 영상을 변형하는 것을 넘어, AUN은 사용자가 제시한 텍스트에 기반하여 완전히 새로운 영상을 창조합니다. 예를 들어, “바닷가에서 서핑하는 강아지”라는 프롬프트를 입력하면, AUN은 실제 존재하는 강아지와 바닷가 풍경을 학습하여 마치 실제 촬영한 듯한 영상을 생성해 냅니다.
AUN은 다양한 스타일과 퀄리티의 영상을 제공하며, 사용자는 원하는 대로 영상의 길이, 해상도, 카메라 앵글 등을 조절할 수 있습니다. 또한, AUN은 3D 모델링, 애니메이션, 특수 효과 등 다양한 기능을 지원하여 영화, 광고, 게임 등 다양한 분야에서 활용될 가능성을 보여주고 있습니다.
현재 AUN은 베타 테스트를 진행 중이며, 곧 정식 출시될 예정입니다. 많은 관심과 기대 부탁드립니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 45청크
원문 보기 | 출처: note.com