Anthropic, 이전 모델 대비 40% 저렴한 Claude 3.5 Opus 출시
아티피셜 애널리시스 종합 순위 1위를 차지한 Claude 3.5 Opus는 페이블 5.1 수준의 성능을 구현했다.
이전 모델 대비 실행 비용을 40% 절감했으며, 벤치마크 점수가 상향되고 에이전트 코딩 능력이 강화되었다.
특히 아티피셜 애널리시스 종합 순위에서 1위를 기록하며 성능을 입증했다.
Anthropic, OpenAI, xAI, Meta 등 주요 AI 기업들이 새로운 모델과 기능을 공개하며 AI 에이전트 시대의 가능성을 제시했다.
아티피셜 애널리시스 종합 순위 1위를 차지한 Claude 3.5 Opus는 페이블 5.1 수준의 성능을 구현했다.
이전 모델 대비 실행 비용을 40% 절감했으며, 벤치마크 점수가 상향되고 에이전트 코딩 능력이 강화되었다.
특히 아티피셜 애널리시스 종합 순위에서 1위를 기록하며 성능을 입증했다.
Claude 3.5 Opus는 3D 모델링 분야에서 뛰어난 성능을 보이며, Three.js 및 블렌더와의 연동을 통해 인터랙티브한 3D 콘텐츠를 구현할 수 있다.
도트 애니메이션 제작과 웹 기반 렌더링에도 활용되며, 언리얼 엔진 기반 게임 개발 및 로직 구현도 가능하다.
또한 TTS(Text-to-Speech) 기술과 결합하여 자동 영상 제작 및 내레이션 생성에도 기여한다.
Claude 3.5 Opus에 작업을 맡길 때는 완료 기준과 멈춰야 할 조건을 명확하게 기술하는 것이 중요하다.
전체 작업을 한 번에 전달할 수 있으며, 기존에 사용되던 '깊이 생각해'와 같은 문구를 삭제해야 한다.
추론 수준(로우, 미디엄, 하이)을 작업 난이도에 맞게 선택하여 활용할 수 있으며, 기본 구현에는 로우 모드를, 검증 단계에는 하이 모드를 추천한다.
클라우드 기반 실행 환경 정식 도입과 함께 프로 계정에는 100달러, 맥스 계정에는 250달러의 크레딧이 지급되며, 플러그인 개발 및 관리 포털도 새롭게 구축했다.
클라우드 기반 실행이 정식 출시되었으며, 프로 사용자에게 100달러, 맥스 사용자에게 250달러의 크레딧이 제공된다.
플러그인 개발, 제출, 사용량 확인을 위한 전용 포털도 신설되어 개발자 편의성이 향상되었다.
이론 물리학의 산란 진폭 공식 계산 과정에서 기존 8중 루프 기록을 경신하며 과학적 난제 해결 역량을 증명했다.
기존 8중 루프 기록을 넘어서 9중 루프 문제를 설명하고 해결하며, 과학적 연구 난제 해결 가능성을 보여주었다.
아스트라급 성능을 내는 GPT-6 Sol은 인풋 2달러·아웃풋 10달러로 책정됐으며, 초저가형 GPT-6 Luna는 인풋 0.1달러·아웃풋 0.5달러를 기록했다.
GPT-6 Sol은 인풋 2달러, 아웃풋 10달러로 아스트라급의 성능을 제공하며, GPT-6 Luna는 인풋 0.1달러, 아웃풋 0.5달러의 초저가 모델이다.
두 모델 모두 종합 성능에서는 아스트라에 소폭 미치지 못하지만, 비용 효율성을 크게 강화한 것이 특징이다.
OpenAI는 데브데이를 앞두고 컴퓨터를 직접 제어하는 에이전트 서비스 도입을 예고했다.
이 서비스는 모든 프로 티어 사용자에게 도입될 가능성이 높으며, 셀레브라스 인프라를 활용한 500달러 프로맥스 티어 출시 가능성도 언급되었다.
보이스 모드 내에서는 이메일, 캘린더, 슬랙 플러그인 연동 기능이 추가될 예정이다.
GPT-6를 위한 향상된 프롬프트 캐싱 기능이 추가되어 캐시 적중률 향상으로 응답 시간을 단축했다.
개발자에게는 캐시된 입력 토큰에 대해 최대 90% 할인이 제공되며, 사용량 대시보드를 통해 캐싱 효율을 확인할 수 있다.
이 기능은 반복적인 작업의 효율성을 높여 개발 비용 절감에 기여할 것으로 보인다.
잔고 조회와 종목 데이터 연동은 나무 플러그 API를 거쳐 진행되며, 코덱스와 프롬프트를 활용해 매일 아침 투자 현황을 이메일로 받아보는 리포트 기능이 구현됐다.
사용자가 보유한 종목을 기반으로 최신 실적과 뉴스를 자동으로 요약하며, 코덱스(Codex)와 프롬프트를 이용해 매일 아침 이메일로 수신할 수 있도록 했다.
이 기능은 매번 투자 현황을 열어보고 정리할 필요 없이 필요한 내용만 리포트로 받아볼 수 있게 한다.
예약 작업을 통해 발송되는 이 리포트는 반복적인 투자 현황 정리를 자동화하며, Namuh PLUG 공식 안내에서 지원 기능과 이용 조건을 확인할 수 있다. 다만, 해당 예제는 원금 손실 위험이 있으므로 종목 추천이 아님을 유의해야 한다.
예약 작업을 통해 매일 아침 투자 브리핑과 상세 리포트가 이메일로 발송되며, 이는 투자자가 효율적으로 시장 동향을 파악하도록 돕는다.
이용 조건 및 지원 기능은 Namuh PLUG 공식 안내를 통해 확인할 수 있으며, 해당 예제는 종목 추천이 아니며 원금 손실 위험이 있음을 경고한다.
AI 에이전트가 최적의 제품을 추천하고 구매까지 대신할 경우, 아마존과 같은 플랫폼은 광고 수익 감소를 우려해 뮤즈를 차단하는 움직임을 보인다.
금융 상품 중개 등 광고 수익 중심의 금융 구독 기업들은 에이전트의 최적화 기능으로 인해 도태될 위기에 처할 수 있다.
메타는 에이전트를 무료로 제공하여 사용자를 확보한 뒤 광고 모델을 도입할 것으로 예상되며, 뮤즈에는 8코어 CPU, 8GB RAM, 100GB 디스크의 가상 머신(VM) 환경이 제공된다.
xAI가 Grok 4.7을 공개했으며, 이전 버전인 4.6 대비 동일한 가격으로 전반적인 성능이 크게 향상되었다.
Grok 4.7은 GPT 5.6 Sol 및 Fable 5.1과 유사하거나 뛰어난 성능을 기록했으며, 특히 소프트웨어 엔지니어링 능력에서는 Fable 5.1을 상회한다.
xAI는 그록봇 스토어를 개설하여 사용자들이 직접 AI 에이전트를 만들어 배포하고 활용할 수 있도록 했다.
에이전트 제작 시 '그록봇 크리에이터 리워드'를 제공하며, 많은 사용자들이 에이전트를 사용할 경우 수익을 배분하는 구조를 형성한다.
이는 AI 에이전트 생태계를 확장하고 개발자들에게 새로운 수익 창출 기회를 제공할 것으로 보인다.
이 모델은 강조나 끊어 말하기 등 감정 연기 표현에 최적화된 제어 가능한 TTS 기능을 제공한다.
구글은 '프로젝트 선 캐처'라는 장기 연구를 통해 우주에 확장 가능한 머신 러닝 인프라를 운영할 수 있는지 탐구하고 있다.
첫 시제품으로 위성을 발사하여 구글 TPU가 우주 환경에서 작동하는지 시험할 예정이다.
이 프로젝트는 지상 대비 최대 8배 많은 태양광 전력을 확보할 가능성을 제시하며, 미래 데이터 센터의 새로운 방향을 모색한다.
Grok 4.7과 동점 수준의 성능을 보여주며 AI 모델 경쟁에서 주목할 만한 성과를 거두었다.
Qwen-Image 2.1이 오픈 웨이트 모델로 공개되었으며, 유료 모델 대비 우수한 성능을 보여준다.
네이티브 투명도 및 멀티 레퍼런스 편집 기능을 지원하여 이미지 변형 및 편집에 특화되어 있다.
상업적 사용은 별도 계약이 필요하며, 검열 제거 버전, 양자화 모델, 로라(LoRA) 가속 등을 지원한다.
유비테크의 인간형 로봇 U1이 서울 갤럭시 코포레이션의 '로봇 파크'에 전시되기 시작했다.
실제 구매자에 대한 배송 및 운영이 시작되었으며, U1은 이전부터 많은 화제를 모았던 로봇이다.
자막에서 근거가 되는 대목을 찾아 답합니다.
조코딩 JoCoding의 다음 글도 받아볼까요?
조코딩 JoCoding에 새 영상이 올라오면, 방금 읽으신 것처럼 정리해서 메일로 보내 드릴게요.