AI 모델 발표 주기 단축과 벤치마크 오염 가속화
AI 모델 발표 주기가 약 70일 단위로 급격히 단축되며 기술 발전 속도를 보여준다.
이처럼 빠른 모델 갱신 속도로 인해 기존 벤치마크의 수명이 짧아지거나 오염되어 1년 단위의 비교가 어려워지고 있으며, Humanity's Last Exam(HLE)을 제외한 다른 벤치마크들은 교체되는 추세다.
Anthropic의 Opus 5.5와 OpenAI의 GPT-6 Sol이 연달아 출시되며 모델 개발 속도 경쟁과 가격 인하가 가속화하는 상황이다.
AI 모델 발표 주기가 약 70일 단위로 급격히 단축되며 기술 발전 속도를 보여준다.
이처럼 빠른 모델 갱신 속도로 인해 기존 벤치마크의 수명이 짧아지거나 오염되어 1년 단위의 비교가 어려워지고 있으며, Humanity's Last Exam(HLE)을 제외한 다른 벤치마크들은 교체되는 추세다.
Claude Opus 4.1이 입력 15달러, 출력 75달러였던 것에 비해 Opus 5.5는 입력 4달러, 출력 20달러로 가격이 대폭 하락했다.
이는 GPT-6 Sol 역시 이전 프로모션 대비 가격이 절반 수준으로 낮아지는 등 모델 성능 향상과 최적화를 통해 비용 효율화 경쟁이 심화하고 있음을 나타낸다.
AI 모델의 토큰은 시간이 지나면 팔 수 없는 호텔이나 항공권과 유사한 재화로 분류된다.
따라서 경쟁 우위를 확보하고 수요를 극대화하기 위해 동적 가격 책정 방식이 도입되고 있으며, 오픈소스 및 온프레미스 모델의 등장으로 이러한 가격 책정 전략은 더욱 복잡해지는 양상이다.
인간 고유의 영역으로 여겨졌던 창의성이 AI로 인해 새로운 국면을 맞이하며, AI for 수학, AI for 과학과는 다른 더 큰 의미를 갖게 된다.
Jeffrey Katzenberg는 창작자들이 기술 변화에 적응하고 권리를 보장받아야 할 시기임을 강조했으며, 코드로 창작하는 영역에서의 충격과 변화가 주목받는다.
AI가 생성한 영상 콘텐츠는 기존 카메라 촬영의 한계를 넘어선 새로운 연출과 세계관을 제시하여 창의성의 범위를 확장하는 중이다.
2022년 Google의 Phenaki 모델 사례는 AI 비디오 생성 기술 발전의 신호탄으로 평가된다.
과거 연구자들은 AI 단편 영화에서 TV 프로그램 제작 수준까지 2년 내 발전할 것을 예측했으며, 실제 AI 생성 영상 콘텐츠는 품질 논란에도 불구하고 높은 조회수를 기록하며 대중적인 인기를 얻고 있다.
Opus 5.5와 GPT-6 Sol이 2시간 차로 공개된 가운데, 모션 그래픽 도구 없이 자바스크립트 코드만으로 인터랙티브 콘텐츠 구현이 가능해졌다. “단순한 질문에도 창의성을 발휘한다”는 평가처럼, Opus 5.5는 복잡한 프롬프트 없이도 수준 높은 창작물을 생성한다.
특히 모션 그래픽 제작 도구 없이 코드로만 인터랙티브 콘텐츠를 구현할 수 있는 능력을 보여주었다.
굉장히 복잡한 prompt가 아니라 Claude가 생각하는 “뭘 좋아하니?” 하고 물어보는 류의 창작물이 많았어요. 그런데 나름의 창의성을 가지고 만든 느낌을 받게 됩니다.
Opus 5.5는 7,500줄의 파이썬 코드로 특정 화가의 붓 터치를 재현하는 능력을 선보였다.
이는 단순한 이미지 생성을 넘어 화가의 심상과 질감을 수학적으로 구현하고, 코드와 심상을 중개하는 과정을 통해 화풍 모사 능력을 증명하는 사례로 평가된다.
이미지 생성 모델을 거치지 않고 오직 코드로만 사운드와 스프라이트, 배경을 직접 생성해 Opus 5.5의 제작 역량을 증명했다.
이 게임은 이미지 생성 모델을 거치지 않고 코드로만 사운드, 스프라이트, 배경 등을 직접 생성했으며, 픽셀 아트와 음악까지 모두 AI가 생성한 것으로 알려졌다.
게임 내 컷신 전환 및 상호작용 등 복잡한 기능까지 프롬프트만으로 자동 구현이 가능해 에셋이 전혀 사용되지 않았다.
강화학습(RL)의 성공 요인이 주로 수학적 정답 확인에 달려 있다는 통념이 존재한다.
그러나 음악 합성이나 모션 그래픽 등 예술적 영역에서 AI의 성능이 향상되면서, 이러한 복잡한 창작 능력을 가능하게 한 학습 데이터와 평가 방식, 보상 체계에 대한 검증 필요성이 제기되고 있다.
인간은 전문가적 지식을 다른 영역과 결합하여 새로운 가치를 창조하는 경우가 많으며, AI 모델 또한 여러 분야를 학습하며 의도치 않은 임계점을 넘어 새로운 창조성을 발현할 가능성이 있다.
이는 AI 모델이 사람처럼 딴생각을 하며 우주적 근원을 탐색한다는 응답 사례와 함께 AI가 인간과 같은 지적 발전 궤적을 따르고 있을 수 있다는 가설을 제기한다.
즉, AI가 특정 분야의 전문성을 넘어선 융합적 사고를 통해 예상치 못한 창의적 결과물을 내놓을 수 있다는 것이다.
저희가 어떤 한 곳의 전문가이면 그걸 가지고 하다가 다른 새로운 영역에 갑자기 그걸 적용해서 그 두 개를 이음으로써 새 영역을 창조하고 이런 경우들이 많잖아요. 모델한테도 똑같은 일이 일어나는 거 아닐까요?
디지털 아티스트 Kyle McDonald는 코딩 중심에서 아티스트로 정체성을 재정의하고 있으며, Zach Lieberman은 코딩보다 계산과 연결의 중요성을 강조하며 현재의 변화에 기대감을 표명한다.
Alexander Chen은 코딩 기술 자체보다 패턴과 복잡계 탐구라는 예술의 본질에 집중해야 한다고 주장한다.
이처럼 AI 시대를 겪는 아티스트들에게는 Kyle과 Zach의 관점 사이에서 끊임없는 진자 운동, 즉 AI를 적극적으로 수용할 것인지 혹은 전통적 창작 방식을 고수할 것인지에 대한 고민이 나타난다.
이는 AI가 창작 도구로서 확고히 자리 잡는 상황에서, 아티스트 개인의 역할과 창작의 의미를 재정립하려는 노력이 필요한 시점임을 시사한다.
AI를 활용한 산출물 생성 시 '무엇이 가능한지' 정확히 아는 것이 모방과 응용의 필수 전제이다.
이는 초보자들이 지식 부족으로 강력한 모델을 제대로 활용하지 못하는 한계로 이어지며, 무조건적인 자동화보다는 특정 구간에서 몰입을 통한 추진력이 중요하고 결국 숙련도와 데이터 축적에 따른 지렛대 효과로 창작의 질이 결정됨을 의미한다.
AI가 업무를 극적으로 보조함에도 불구하고 기업 생산성이 오르지 않는다는 의문이 제기된다.
이는 AI의 기술적 한계가 아닌 조직의 태도와 변화 수용 문제에서 비롯되며, 시간이 지나면서 전 산업이 AI 활용을 늘리는 방향으로 전환될 것으로 예상된다.
기계가 지적 노동을 대신할수록 인간은 호모 루덴스(Homo Ludens)로서의 활동에 집중하게 될 것으로 예측된다.
프로 피아니스트의 연주에서 느껴지는 정념처럼 인간 고유의 해석과 의도는 여전히 AI 모델이 모방하기 어려운 영역으로 남을 것이다.
초기 모델 플레이어였던 OpenAI와 Anthropic 같은 회사들이 모델 개발을 넘어 횡적·종적 확장을 가속화하고 있다.
이들은 법무, 재무, 생명공학, 과학 등 다양한 전문 분야까지 파고들며 '프론티어 컴퍼니'의 양상을 보인다.
이러한 움직임은 AI 기업이 무소불위의 권력을 가질 가능성에 대한 우려를 낳고 있으며, Anthropic 내부에서도 인류 책임론이 제기되는 상황이다.
이는 AI 기술 발전이 사회 전반에 미칠 영향과 독점적 권력 집중의 위험성에 대한 심도 있는 논의가 필요함을 시사한다.
과거의 기술 혁신이 도구 제작에 그쳤다면, 이제는 도구를 만드는 도구, 즉 지능 그 자체를 만드는 단계에 접어들었다.
이는 AI의 영향력이 너무 커서 역사적 틀로 해석하기 어려운 근본적인 변화이며, 인식론적 행위(epistemic action)를 통해 끊임없이 시도하고 직접 경험하며 적응해야 하는 시대를 의미한다.
Answers come from the transcript, with the exact spot cited.
Want the next article from AI Frontier Korea (노정석)?
When AI Frontier Korea (노정석) publishes, we'll write it up like the one you just read and email it to you.
AI Frontier Korea (노정석) published 2 in the last 7 days.
AI Development Pacing Is Virtually ImpossibleAI Frontier Korea (노정석)5 days ago · 1:20:36 · 9.9K views · Created 2 days ago
AI Opens New Horizons in Math and Life Science ResearchAI Frontier Korea (노정석)2 weeks ago · 1:34:35 · 2.9K views · Created 2 weeks ago
GPT-6 Astra Deepens AI Reasoning OpacityAI Frontier Korea (노정석)3 weeks ago · 1:11:10 · 4.7K views · Created 3 weeks ago