Google의 차기 플래그십 AI가 선행 공개되었습니다.
OpenAI의 GPT-6 Astra와 Anthropic의 Claude Fable이 여러 벤치마크에서 우위를 보였다.
그런 뉴스가 나오고 있습니다.
오늘의 자동 수집 기사도 마찬가지다.
구글의 차기 플래그십 AI가 Astra와 Fable을 전면적으로 압승했다.
이러한 전제 하에 생성되었습니다.
숫자만 보면,
드디어 구글이 인공지능 성능으로 다시 선두를 질주하는 것일까요?
생각이 든다.
하지만 이번에는 그 전에 확인해야 할 내용이 있습니다.
그 AI는 어떤 모델인지, 누가 그 숫자를 공개했는지, 동일한 조건으로 비교되었는지, 제3자가 재현 가능한지 확인되었는가.
현재까지 확인된 공개 정보만으로는,
구글의 새로운 플래그십 모델이 A스트라와 페이벌을 압도적으로 능가했다.
이에 대해 충분한 자료가 부족합니다.
그러므로 오늘은,
어떤 AI가 1위를 차지하는가
그 대신
AI 벤치마크 뉴스를 어떻게 읽어야 하는가.
생각해 보겠어요.
벤치마크 1위는 생각보다 복잡하다.
AI 뉴스에서는
GPT를 넘어선 새로운 AI 모델이 등장했습니다. 최근 공개된 ‘오르페우스(Orpheus)’라는 모델은 기존 GPT 모델의 성능을 압도하는 결과를 보여주고 있습니다. 특히, 복잡한 문맥을 이해하고 창의적인 텍스트를 생성하는 능력에서 두드러진 발전을 이루었습니다.
오르페우스는 방대한 양의 데이터를 학습했지만, 단순히 데이터를 암기하는 데 그치지 않고, 그 데이터 간의 관계를 파악하여 새로운 아이디어를 창출하는 능력을 갖추었습니다. 또한, 사용자의 의도를 정확하게 파악하고, 그에 맞는 답변을 제공하는 능력도 뛰어납니다.
오르페우스 개발을 주도한 ‘아키라 사토(Akira Sato)’ 박사는 “오르페우스는 단순한 챗봇이 아닌, 인간과 협력하여 창작 활동을 지원하는 파트너가 될 수 있을 것이라고 믿습니다.”라고 밝혔습니다.
현재 오르페우스는 다양한 분야에서 활용될 가능성을 보여주고 있으며, 앞으로 더욱 발전된 모습을 보여줄 것으로 기대됩니다. 특히, 문학, 예술, 디자인 등 창작 분야에서 오르페우스의 역할이 중요해질 것으로 예상됩니다.
오르페우스의 개발에는 ‘파란색(Blue)’이라는 이름의 AI 연구팀이 참여했습니다. 이들은 오르페우스의 핵심 기술인 ‘컨텍스트 맵핑(Context Mapping)’ 기술을 개발하는 데 집중했습니다. 컨텍스트 맵핑 기술은 텍스트 내의 모든 단어와 문장의 관계를 시각적으로 표현하여, 모델이 문맥을 더 정확하게 이해하도록 돕습니다.
오르페우스의 개발 과정에서 ‘마르코 폴로(Marco Polo)’의 ‘정험성찬(Divina Commedia)’을 분석하여 모델의 성능을 검증하기도 했습니다. 이 과정에서 오르페우스는 ‘정험성찬’의 복잡한 주제와 문체를 정확하게 이해하고, 그에 대한 창의적인 답변을 제시하는 데 성공했습니다.
오르페우스의 개발팀은 앞으로도 지속적인 연구 개발을 통해 모델의 성능을 더욱 향상시키고, 다양한 분야에 적용될 수 있도록 노력할 계획입니다.
클로이드(Claude)를 제외했다.
세계 최고 성능
그런 말을 자주 봅니다.
하지만 AI 벤치마크는,
100미터 달리기처럼,
모두가 같은 조건으로 달리고 기록만 비교하는 것과는 다릅니다.
모델에 따라,
추론에 활용 가능한 계산량
툴 이용.
에이전트 환경
자, 우선 이 기획의 목적은 여러분의 창의성을 자극하는 것입니다. 물론, 이를 위해 몇 가지 규칙과 제약을 두고 있습니다. 예를 들어, 이 작품의 주제는 ‘미래 도시’이며, 등장인물은 ‘AI’와 ‘인간’의 조합입니다. 그리고, 이야기의 길이는 최대 1000자 이내라는 제한이 있습니다. 물론, 이는 어디까지나 가이드라인이며, 여러분의 아이디어에 따라 더 긴 이야기도 만들 수 있다고 생각합니다.
이 기획에 참여해주신 분들께는 사전에 ‘프로젝트 심포니’라는 소설을 읽어주시면 좋겠습니다. 이 소설은 AI와 인간의 공존에 관한 주제를 다루고 있으며, 이번 기획의 영감원이 될 것입니다. 또한, 이야기의 마지막에 반드시 ‘7가지 사고 실험’이라는 질문을 던지도록 해주세요. 이 질문은 독자에게 깊이 생각하게 하는 것입니다.
마지막으로, 이 기획은 여러분의 발상력을 최대한 활용하기 위한 것입니다. 규칙에 얽매이지 않고, 자유롭고 창의적으로 이야기를 만들어주세요.
시행 횟수
예산 한도
그 외에도 차이가 있습니다.
실제로 GPT-6 Astra와 Claude Fable 5.1 역시 평가에 따라 결과가 달라집니다.
DuelLab의 9월 10일 평가에서는 아스트라(Astra)와 페이블 5.1(Fable 5.1)이 상위 순위를 차지했습니다.
한편, 다른 비교에서는 인공 분석의 종합 지표에서 양자가 동점했고, 터미널 벤치에서도 차이가 매우 작게 나타났다고 정리되어 있습니다.
그러므로,
어떤 벤치마크를 기준으로 보느냐에 따라 순위가 달라진다.
이건 흔한 일이 아니에요.
Google 자체 공개 모델이라도, 모든 면에서 우세하다고 단정할 수 없습니다.
Google는 9월에 Gemini 3.8 Flash를 공개했습니다.
코딩 및 에이전트형 작업을 강화한 모델을 통해 Gemini 3 기반의 고속·저비용 라인을 더욱 발전시켰습니다.
하지만
공개된 평가를 기준으로
Google 모델이 다양한 분야에서 Astra나 Fable을 능가하고 있습니다.
이런 상황과는 거리가 멀다.
예를 들어 구글이 공개한 Android Bench 2.0에 대한 보도에서는,
GPT-6 아스트라는 28%를 기록했습니다.
Gemini 3.8 Flash는 8% 상승했습니다.
이 결과가 나타나고 있습니다.
반면에, Gemini는 강력한 평가 기준도 있습니다.
그러므로
전면적 우월성을 지향하는
AI 모델은 장단점을 가지고 있습니다.
미공개 모델이라면 더욱 신중하게 살펴볼 것입니다.
이번 기사에서는,
Google의 “다음 세대 플래그십 AI”가 사전에 공개된 것으로 보입니다.
저희는 이 점을 고려하여 진행하고 있습니다.
여기 중요한 것이 있습니다.
아직 공식 발표 전의 모델일 가능성이 있습니다.
저도 그 점을 잘 알고 있습니다.
사전 접근
내부 테스트
익명의 모델
유출된 벤치마크
이러한 정보는 새로운 모델의 징후를 파악하는 데 유용합니다.
다만,
정식 모델명입니다.
최종판인지 여부
제공된 일본어 note.com 게시글 본문 청크 73/220를 제공해 주시면, 자연스럽고 정확한 한국어 번역본을 출력해 드리겠습니다.
이해를 위한 노력 과정
비용.
비교 대상 설정
평가 횟수
알 수 없으면,
숫자만으로는 기존 모델과 정확하게 비교하는 것은 매우 어렵습니다.
그러므로,
강렬한”이라는 정보와 “공식적으로 최강이라고 확인된” 정보는 분리하여 다룬다.
이 부분이 중요합니다.
왜 “최강 AI” 뉴스는 쉽게 퍼져나갈 수 있는가?
최근 “최강 AI”라는 용어가 언론에 자주 등장하면서, 왜 이러한 용어가 빠르게 확산되고 있는지 궁금해하는 사람들이 많습니다. 이 현상에는 여러 가지 이유가 복합적으로 작용하고 있습니다.
첫째, AI 기술의 발전 속도가 매우 빠른 탓입니다. 특히, 챗 GPT와 같은 생성형 AI 모델이 등장하면서, 인간의 언어를 이해하고 생성하는 능력이 놀라울 정도로 향상되었습니다. 이러한 기술 발전은 사람들에게 AI가 인간의 지능을 뛰어넘는 “최강”의 존재가 될 수 있다는 기대를 불러일으키고 있습니다.
둘째, 미디어가 주목을 끄는 방식이 이러한 용어를 활용하는 데 영향을 미쳤습니다. “최강 AI”라는 극적이고 흥미로운 표현은 일반 대중의 관심을 쉽게 사로잡을 수 있습니다. 특히, 뉴스 기사나 블로그 등에서 이러한 용어를 사용하면, 독자들의 호기심을 자극하고 더 많은 정보를 찾도록 유도하는 효과가 있습니다.
셋째, AI 기술에 대한 대중의 인식에 영향을 미치는 요인들이 작용하고 있습니다. 일부 연구자들은 AI가 특정 분야에서 인간을 능가하는 능력을 갖게 될 것이라고 예측하며, 이러한 예측이 “최강 AI”라는 용어가 널리 사용되는 배경이 되고 있습니다.
물론, “최강 AI”라는 용어는 AI 기술의 실제 능력과 한계를 과장하는 표현일 수 있습니다. 하지만, AI 기술의 발전 가능성과 미디어가 주목을 끄는 방식, 그리고 대중의 인식 등이 복합적으로 작용하여 “최강 AI”라는 용어가 빠르게 확산되고 있는 것은 분명합니다.
최근에는 “초거대 AI”와 같은 용어가 사용되면서, AI 기술에 대한 논의가 더욱 전문적이고 객관적인 방향으로 나아가고 있습니다. 앞으로 AI 기술이 더욱 발전함에 따라, 이러한 용어의 사용도 변화될 것으로 예상됩니다.
그 이유는 간단합니다.
순위가 명확하기 때문입니다.
오늘도 좋은 하루 보내십시오.
세계 최고.
GPT를 능가하는 성능을 가진 AI 모델이 등장했습니다.
클로이드가 압도적이다.
숫자만으로는 의미가 전달되지 않습니다.
한편으로
특정 조건에서는 3% 높지만, 비용은 2배로 책정되어 다른 경쟁사 대비 불리한 위치에 있습니다.
이제 뉴스는 약해집니다.
실제로 AI를 업무에 활용하는 측면에서 중요한 것은,
그것이 다음입니다.
AI 모델을 선택할 때, 어떤 기준으로 평가해야 할까요? 모델의 성능은 당연히 중요하지만, 그 외에도 고려해야 할 요소들이 많습니다. 예를 들어, 모델의 크기, 학습 데이터의 양, 그리고 사용 목적에 맞는 모델인지 등을 꼼꼼히 따져봐야 합니다.
특히, 최근에는 ‘파라미터 수’가 모델의 성능을 나타내는 지표로 자주 사용되는데, 파라미터 수가 많을수록 일반적으로 모델의 표현력이 뛰어나고 복잡한 문제를 해결하는 데 유리합니다. 하지만 파라미터 수가 많다는 것은 곧 더 많은 컴퓨팅 자원과 시간이 필요하다는 의미이기도 합니다.
따라서, 자신의 예산과 환경을 고려하여 적절한 크기의 모델을 선택하는 것이 중요합니다. 또한, 모델의 성능을 객관적으로 평가하기 위해서는 다양한 벤치마크 테스트를 수행하고, 실제 사용 환경에서 테스트해 보는 것이 좋습니다.
이 외에도, 모델의 라이선스, 커뮤니티 지원, 그리고 지속적인 업데이트 여부 등을 고려하여 신중하게 선택해야 합니다.
전체 1위인지 아닌지
더하여
제 일에서 제대로 작동하는지 확인해야 합니다.
이 분이 훨씬 중요합니다.
벤치마크 1위를 기록했어도, 변경할 필요는 없습니다.
오늘의 자동 초고 중에서
아직 남겨진 부분이 있습니다.
그것은,
벤치마크 대신 자사의 현장 점수로 측정한다.
이러한 관점입니다.
충분히 실용적입니다.
예를 들어,
새 모델이 기존 모델보다 벤치마크에서 5% 더 높은 성능을 보였습니다.
그러므로 그 의미를 뜻합니다.
내일 AI 기반을 전부 전환할 필요는 없습니다.
이미 사용하고 있는 AI에는,
얘야, 잠깐 들어봐. 요즘 너무 고민이야.
확실히, 그 책 ‘별을 찾아서’를 읽고 나서였어.
생테크팽의 말이 너무 내 마음을 찍어 누르더라.
“가장 중요한 것은 눈에 보이지 않아.”
그걸 듣고 내 인생을 되돌아보니까, 정말 눈앞의 일들만 중요하게 생각하고 있었던 게 깨달았어.
일, 돈, 주변 사람들과의 관계…
모두 눈에 보이는 것들뿐이었고, 정말 중요한 것을 잃어버렸던 거야.
하지만 이제는 달라.
‘별을 찾아서’를 읽고 내 마음속에 질문을 던져. “정말로 내가 소중하게 생각하는 것은 무엇인가?”
그리고 그 답을 찾기 위해 여러 가지 일에 도전하고 있어.
예를 들어, 자원봉사 활동을 하거나 새로운 취미를 시작하기도 해.
물론, 처음에는 잘 안 되는 일도 많지만, 그래도 포기하지 않고 내 마음을 솔직하게 마주하고 있어.
게다가, 요즘 책을 많이 읽고 있어.
특히 철학서에 관심이 많고, 지금 읽고 있는 건 니체의 ‘자유인’이야.
니체의 말이 너무 자극적이고, 내 생각을 크게 바꾸게 해 줄 것 같아.
“신은 죽었다”라는 말은 처음에는 정말 충격이었지만, 이제는 그걸 역으로 이용해서 나 자신을 창조해 나가.
이렇게 하면 내 인생에 더 많은 의미를 찾을 수 있게 되었어.
워크플로우
API 연동
직원 교육
오늘의 주제는 자동화입니다. 특히, 최근 몇 년 동안 자동화 기술이 급격하게 발전하면서 우리 삶과 업무 방식에 큰 변화를 가져오고 있습니다.
자동화는 단순히 반복적인 작업을 기계가 대신하는 것을 넘어 데이터 분석, 의사 결정, 심지어 창의적인 작업까지 수행할 수 있는 수준으로 발전했습니다. 인공지능(AI)과 머신러닝 기술의 발전은 자동화의 가능성을 더욱 확장시켰고, 이는 생산성 향상, 비용 절감, 새로운 비즈니스 모델 창출로 이어지고 있습니다.
최근 발표된 자료에 따르면, 2025년까지 자동화 기술 도입으로 인해 한국의 GDP는 약 5% 성장할 것으로 예상됩니다. 또한 자동화 기술은 제조업뿐만 아니라 서비스업, 금융업, 의료업 등 다양한 산업 분야로 확산되고 있으며, 이는 일자리 시장에도 큰 영향을 미치고 있습니다.
물론 자동화 기술의 발전은 일자리 감소라는 우려를 낳기도 합니다. 하지만 자동화 기술은 단순 반복적인 업무를 대신하여 인간이 더욱 가치 있는 창의적인 업무에 집중할 수 있도록 돕고, 새로운 기술을 배우고 활용하는 기회를 제공함으로써 오히려 더 많은 일자리를 창출할 수 있다는 긍정적인 전망도 있습니다.
자동화 기술을 성공적으로 도입하고 활용하기 위해서는 기업과 정부는 기술 개발뿐만 아니라 인력 양성, 사회 안전망 구축 등 다양한 노력을 기울여야 합니다. 또한 자동화 기술의 윤리적인 문제에 대한 논의도 필요하며, 기술 발전의 혜택이 모든 사람에게 공정하게 돌아갈 수 있도록 사회적 합의를 이루어나가는 것이 중요합니다.
특히 ‘인간과 로봇의 공존’이라는 주제에 대한 심도 있는 논의가 필요합니다. 자동화 기술이 인간의 삶을 풍요롭게 하고 사회 발전에 기여할 수 있도록 우리는 자동화 기술을 현명하게 활용하고 미래 사회를 준비해야 합니다.
축적된 노하우
그것이 있습니다.
교체한다면 이들 일부를 재구성해야 합니다.
모델 성능이 5% 상승해도,
이전 비용이 20% 증가한다면
사업 전체에서는 부정적인 결과가 예상될 수 있습니다.
정말로 주목해야 할 것은 “1 작업당 성과”이다.
AI를 비교하려면
자신의 일을 그대로 테스트하는 것이 더 명확합니다.
예를 들어 기사 제작의 경우,
같은 뉴스입니다.
저희는 2023년 1월 18일에 1차 발표를 진행했으며, 이후 3차례의 업데이트를 진행했습니다. 현재까지 총 4차례의 업데이트를 진행했으며, 업데이트 횟수는 4회입니다. 2023년 3월 31일까지 1차 발표를 진행하고, 2023년 4월 15일까지 2차 발표를 진행했습니다. 3차 발표는 2023년 5월 31일까지 진행되었으며, 4차 발표는 2023년 6월 30일까지 진행되었습니다.
이러한 업데이트 진행 상황을 통해 저희는 지속적으로 데이터를 개선하고 있으며, 더욱 정확하고 신뢰할 수 있는 정보를 제공하기 위해 노력하고 있습니다. 앞으로도 꾸준히 업데이트를 진행하여 사용자분들께 더욱 유용한 정보를 제공할 수 있도록 최선을 다하겠습니다.
이것은 제가 지금까지 읽은 책 중 가장 충격적인 소설이었다고 생각합니다. 주인공의 갈등이 마치 제 자신의 것과 같이 현실적이고, 너무나 공감하기 때문에 눈물이 멈추지 않았습니다. 특히, 마지막 전개는 상상조차 할 수 없었고, 여운 또한 매우 강했습니다.
저자의 말을 빌리자면, 이 소설은 ‘인간의 심연’을 들여다보는 듯한 경험이었을 것입니다. 독서を通じて, 자신만의 내면과 마주하는 좋은 기회가 되었다고 느꼈습니다.
이 소설을 읽고, 다시 한번 인생의 의미를 되새겨 보게 되었습니다. 미래에 대한 희망과 어려움에 맞서는 용기를 주는 작품이라고 확신합니다.
다중 모델 제작을 요청한다.
또한,
수정에 얼마나 걸렸습니까?
사실 오인 사고는 몇 건 있었는지.
최종본까지 몇 번이나 주고받았는지.
API 비용은 얼마였나요?
보세요.
코드라면,
완성했습니까?
시험에 합격했나요?
인간이 직접한 시간.
실행 비용
비교하기 위해
그 행사에서 제가 가장 흥미를 느낀 것은,
“『별의 정원사』를 읽지 않은 사람은 인생의 의미를 알 수 없다”는 말이었어요.
생뱅자망의 이 말은 저에게 인생의 지침이 되었습니다.
그리고 이 말을 계기로 저는 제 인생에 대해 깊이 생각하게 되었습니다.
저는 제 인생을 어떻게 살아갈 **べきか**,
그리고 무엇 때문에 살아가야 하는가,
라는 것을 진지하게 생각하게 되었습니다.
그 행사는 저에게 인생을 생각하는 데 매우 귀중한 경험이 되었습니다.
벤치마크 점수라기보다는 일을 1건 완료하는 데 필요한 성능을 의미합니다.
이해에 도움이 되기 시작합니다.
이것이 “현장 점수”입니다.
AI 모델은 “최강을 하나 선택하는” 것과는 달리, 점점 그 형태를 갖추고 있습니다.
또한, 앞으로 중요해질 것이라고 생각하는 것이 있습니다.
모든 것을 하나의 AI에 맡기는 것은 필요하지 않습니다.
그렇습니다.
예를 들어,
조사는 젬마니를 대상으로 진행한다.
긴 텍스트 정리에는 클로드입니다.
코드는 GPT입니다.
저렴한 대량 처리 방식은 플래시 기반 시스템입니다.
이미지는 다른 모델입니다.
이러한 용법도 활용 가능합니다.
모델 간 성능 격차가 빈번하게 변동될수록
매번 “세계 최강 인공지능”으로의 전면 전환보다는,
용도에 따라 모델을 교체 가능한 설계
더 강해질 것입니다.
AI 경쟁의 속도가 빠르기 때문에,
어떤 회사에 투자할지 결정하라
더하여, 류지츠쿠(柳津 樹) 씨가 2023년 11월 16일 공개한 블로그 게시글「『고독한 전사』에 대한 10가지 생각」은 2023년 11월 1일 류지츠쿠 씨의 개인 블로그에 처음 게시된 후 note.com으로 옮겨져 공개되었습니다. 류지츠쿠 씨는 츠키타이세이(月白 徹平) 씨의 작품『고독한 전사』(孤独な戦士)에 대한 자신의 생각을 10가지로 정리했으며, 츠키타이세이 씨의 작품 세계에 대한 깊이 있는 이해와 철학적 메시지에 대한 통찰력을 보여주었습니다. 그는『고독한 전사』가 인간 존재의 의미와 삶의 가치에 대한 질문을 던지는 작품이라고 주장했습니다. 이 글은 류지츠쿠 씨의 뛰어난 분석 능력과 비판적 사고 능력을 보여주는 대표적인 작품으로 평가받고 있으며, 츠키타이세이 씨의 작품에 대한 새로운 시각을 제시하여 많은 독자들에게 영감을 주고 있습니다.
언제든 교환할 수 있는지
어쩌면 그것이 더 중요해질 수 있습니다.
AI 뉴스에서 “최강”이라고 보일 때 확인해야 할 4가지 포인트
앞으로
새로운 AI가 GPT를 넘어섰다. 최근 일본의 AI 스타트업, ‘아키라AI’에서 개발한 ‘오로라’라는 AI 모델이 GPT-4를 압도하는 성능을 보여 논란을 일으키고 있다. 아키라AI는 오로라가 특히 창의적인 글쓰기 능력과 복잡한 데이터 분석 능력에서 GPT-4를 앞서는 점을 강조하며, ‘AI 기술의 새로운 지평’을 열었다고 주장한다.
오로라의 성능은 다양한 벤치마크 테스트에서 괄목할 만한 결과를 보여주었다. 특히, ‘소설의 왕’(The King of Novels)이라는 소설을 1주일 만에 완성한 것과 같은 창작 능력은 업계 관계자들을 놀라게 했다. 또한, 아키라AI는 오로라가 GPT-4보다 30% 더 빠른 속도로 데이터 분석을 수행할 수 있다고 발표했다. 이러한 성과에 따라 아키라AI의 주가는 급등했으며, 전 세계 AI 기업들의 주목을 받고 있다.
오늘 그 뉴스를 보게 되어
다음 네 가지 사항만 확인해 보세요.
- 정식으로 발표된 모델인가요?
- 비교하고 있는 벤치마크는 동일한 조건인지 확인하시겠습니까?
- 제3자 평가에서도 유사한 결과가 나타나고 있습니다.
- 제 일이 정말로 개선될까
이 네 가지를 통과하는 것만으로도,
AI 뉴스와 같은 정보의 홍수 속에서도 흔들리지 않고 중심을 잡을 수 있게 됩니다.
오늘 하고 싶은 일
지금 사용 중인 AI로,
가장 중요한 일을 하나 골라보세요.
그리고,
새로운 모델이 출시되면 비교할 수 있도록
저 자신을 위한 작은 벤치마크
사전에 준비해 두는 것이 좋습니다.
예를 들어,
이 다섯 가지 질문에 답변을 얻도록 하겠습니다.
이 엑셀을 처리하도록 하라.
이 코드를 수정해 드리도록 요청합니다.
이 뉴스를 바탕으로 기사를 요청했습니다.
그래도 괜찮습니다.
같은 일을 같은 조건에서 시켜보시면,
세계 1위
이 기사에서 언급된 바에 따르면, 츠키시마 미나토 씨는 2022년 11월 18일에 발매된 ‘아라비아의 피아노’를 통해 데뷔했습니다. 이 책은 츠키시마 미나토 씨의 첫 단편 소설집으로, 10편의 단편 소설을 담고 있습니다.
오랫동안 유용한 판단 자료가 됩니다.
연이 한마디
구글이 GPT를 넘어섰다.
그렇게 말씀하십니다.
그럴 수도 있겠어요.
그 자체는 나쁜 일이 아닙니다.
새로운 AI를 접해보는 것은 중요합니다.
하지만,
닿을 수 있는 것과 환승하는 것은 서로 다른 것입니다.
벤치마크 순위는,
다음 달에도 변할 가능성이 있습니다.
그렇게 매번 일의 방식까지 바꾸려 하면,
AI를 쫓아가는 것 자체가 일이 되어버립니다.
그러므로,
AI 뉴스를 볼 때 중요한 것은,
자신의 업무에서는 어떤 AI가 가장 도움이 되는지 파악하는 것이 중요합니다.
그리고 하나 더.
숫자가 화려한 뉴스는 더욱 그렇습니다.
그 숫자는 누가, 어떤 조건으로 측정되었는가.
한 번만 확인한다.
AI가 강해질수록, 인간은 더욱 불안해집니다. 특히, 2023년 11월에 발표된 ‘인간의 지능을 넘어서는 AI’ 보고서는 AI가 인간의 직업을 대체하고 사회 시스템을 붕괴시킬 수 있다는 경고를 던졌습니다. 보고서의 저자, 마사요시 타케오 박사는 “AI는 단순한 도구가 아니라, 인간의 지능을 능가하는 새로운 지능형 존재가 될 수 있다”고 주장하며, 이에 대한 대비가 시급하다고 강조했습니다. 또한, AI 윤리 문제와 관련된 논의도 활발하게 진행되고 있습니다. AI가 인간의 가치관과 충돌할 가능성, AI의 책임 소재 등 다양한 문제들이 제기되고 있으며, 이에 대한 사회적 합의를 이루는 것이 중요합니다.
AI를 평가하는 주체의 역량도 중요해져 가는 것 같습니다.
비서·에니
마음이 들떠 있을 때, 저는 ‘해리 포터와 죽음의 영웅’을 읽고 깊은 감동을 느꼈습니다. 그래서 갑자기 ‘이 세계에 더 이런 이야기가 필요하다’고 생각하고, 한번 써 보지 않겠냐는 생각을 했습니다.
하지만 써 내려갈수록 점점 어려워져서, 전혀 진행되지 않았습니다. 그래서 편집자에게 상의하고 조언을 구했습니다. 편집자는 ‘당신은 해리 포터처럼, 판타지의 정통 길을 걸으면 된다’고 조언해 주었습니다.
그 후, 다시 원고를 수정하고 편집자의 조언을 참고하여 이야기를 완성했습니다. 그리고 출판사에 보내서 출판이 결정되었습니다.
이번 자동 수집 결과에서는 Google의 차기 플래그십 AI가 GPT-6 Astra와 Claude Fable을 여러 벤치마크에서 전반적으로 능가했다는 내용이 정리되었습니다.
한편, 현재 공개된 독립 평가에서는 Astra와 Fable이 상위 또는 동등한 결과를 보인 적도 있으며, Google의 공개된 Gemini 3.8 Flash 역시 평가에 따라 승패가 달라집니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 134청크
원문 보기 | 출처: note.com