머스크가 예고한 2T 모델의 진짜 관전 포인트?

구글, ‘덜 말하고 더 일하는’ Gemini 3.6 Flash 소식부터 코딩·에이전트·전문 업무를 강화한 Claude Opus 5를 출시 소식까지!

2026.07.28 | 조회 75 |
0
|
from.
VQZ, D-caf

 

Jul 28, 2026

vol. 031


첨부 이미지

[■ 위클리 픽 ]

 

① 구글, ‘덜 말하고 더 일하는’ Gemini 3.6 Flash 공개

복잡한 에이전트 작업에서 추론 단계와 토큰 사용량을 줄인 새로운 실무형 모델이 등장했습니다.

 

② xAI, 2조 매개변수 차세대 모델 예고

머스크가 Grok 4.5보다 커졌지만 속도와 토큰 효율은 비슷한 새 모델을 개발 중이라고 밝혔습니다.

 

③ Fable급 지능을 절반 가격에

Anthropic이 코딩·에이전트·전문 업무를 강화한 Claude Opus 5를 출시했습니다. 


 

구독자님, 안녕하세요. AI 트렌드 뉴스레터 피치 프롬프트 입니다.

한 주에 있었던 AI 소식 중에서 꼭 알아야 할 3가지만 먼저 모아봤어요.

복잡한 내용은 최대한 빼고, 쉽게 이해되도록 정리해드릴게요.

 


[ 이슈 포커스 ]

첨부 이미지

AI 에이전트의 다음 경쟁은 ‘비용’이다

Gemini 3.6 Flash, 같은 일을 더 적은 토큰으로

Edit. VQZ  

◆What (무슨 일?)

 구글이 Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite를 정식 출시했습니다. Gemini 3.6 Flash는 코딩, 문서 분석, 지식 업무, 이미지·차트 이해처럼 여러 단계를 거치는 작업을 겨냥한 실무형 모델입니다. 텍스트뿐 아니라 이미지, 영상, 음성, PDF를 입력할 수 있고, 100만 토큰 컨텍스트와 컴퓨터 사용, 코드 실행, 검색, 함수 호출 같은 도구도 지원합니다.

 

■How (어떻게?)

 핵심은 더 짧게 생각하고 더 적게 호출하는 것입니다. 구글에 따르면 3.6 Flash는 이전 3.5 Flash보다 출력 토큰을 평균 17% 적게 사용하며, 일부 코딩 평가에서는 최대 65%까지 줄였습니다. 추론 단계와 도구 호출 횟수도 감소했고, 출력 가격은 100만 토큰당 9달러에서 7.5달러로 낮아졌습니다.

 

▲Why (왜 지금?)

 AI 에이전트는 답변 한 번으로 끝나지 않습니다. 계획을 세우고, 파일을 읽고, 도구를 실행하고, 결과를 확인하는 과정에서 모델을 계속 호출합니다. 따라서 한 번의 성능 차이보다 작업 하나를 끝낼 때 들어가는 전체 토큰과 시간이 더 중요해집니다. 함께 출시된 3.5 Flash-Lite는 입력 100만 토큰당 0.3달러, 출력 2.5달러로, 문서 처리나 검색처럼 반복량이 많은 하위 에이전트 작업을 겨냥합니다.

 

🗣️ 에디터의 킥 (Editor's Kick)

 이번 모델을 단순히 “제미나이 성능이 또 올랐다”로 보면 핵심을 놓칠 수 있습니다. 구글이 강조한 것은 최고 벤치마크 점수보다 에이전트를 실제 서비스에 얼마나 싸고 안정적으로 투입할 수 있느냐입니다.

 

 


첨부 이미지

더 커졌는데, 속도는 그대로?

머스크가 예고한 2T 모델의 진짜 관전 포인트

Edit. VQZ  

◆What (무슨 일?)

 일론 머스크가 xAI의 차세대 2조 매개변수 모델을 예고했습니다. 머스크는 이 모델이 1조5000억 매개변수인 Grok 4.5보다 모든 면에서 개선됐으며 7월 18일을 기준으로 다음 주 초기 학습을 마칠 예정이라고 밝혔습니다. 다만 아직 모델명과 출시일, 세부 구조, 공식 성능지표는 공개되지 않았습니다.

 

■How (어떻게?)

 가장 중요한 목표는 모델 크기보다 효율 유지입니다. 현재 Grok 4.5는 초당 약 80토큰으로 제공되며 xAI는 비슷한 최상위 모델보다 작업당 출력 토큰을 적게 사용한다고 설명합니다. 머스크는 새 2T 모델도 Grok 4.5와 비슷한 속도와 토큰 효율을 유지할 것으로 예상했습니다.

 

▲Why (왜 지금?)

 초대형 AI 모델 경쟁이 다시 커지고 있습니다. Grok 4.5는 1.5조, xAI의 차세대 모델은 2조, Qwen3.8은 2.4조, Kimi K3는 2.8조 매개변수 규모입니다.  하지만 모델이 커질수록 성능 잠재력과 함께 필요한 연산량과 비용도 늘어납니다. 핵심은 Grok 4.5 수준의 속도와 토큰 효율을 유지할 수 있느냐입니다.

 

 

🗣️ 에디터의 킥 (Editor's Kick)

 매개변수는 AI가 학습하며 조정하는 수많은 숫자값입니다. 많아질수록 복잡한 패턴을 배울 가능성은 커지지만, 필요한 GPU와 전력, 비용도 함께 늘어납니다. 앞으로는 모델 크기만 보지 말고, 실제로 얼마나 빠르고 저렴하게 작동하는지도 함께 봐야 합니다. xAI의 새 모델 역시 커진 몸집보다 효율 문제를 어떻게 해결했는지가 진짜 관전 포인트입니다.


 


첨부 이미지

최고 성능보다 ‘작업당 비용’이 중요해졌다

Claude Opus 5가 보여준 프론티어 AI의 대중화

Edit. D-caf 

◆What (무슨 일?)

 Anthropic이 Claude Opus 5를 출시했습니다. 공식 설명에 따르면 Fable 5의 프론티어급 지능에 근접하면서도 가격은 절반 수준입니다. API 가격은 입력 100만 토큰당 5달러, 출력 25달러로 Opus 4.8과 같으며, 100만 토큰 컨텍스트와 최대 12만8000토큰 출력을 지원합니다.

 

■How (어떻게?)

 Opus 5는 작업에 따라 low부터 max까지 사고량을 조절할 수 있습니다. 가벼운 일에는 토큰을 아끼고 복잡한 코딩과 분석에는 더 많은 추론을 사용하는 방식입니다. Anthropic의 CursorBench 평가에서는 최고 설정 기준 Fable 5와의 차이가 0.5% 이내였지만 작업 비용은 절반 수준이었습니다.

 

▲Why (왜 지금?)

 기업에서 중요한 것은 모델 순위보다 업무 하나를 끝내는 비용입니다. Anthropic의 공식 평가에서 Opus 5는 Frontier-Bench 성능이 Opus 4.8의 두 배 이상이면서 작업 비용은 더 낮았습니다. 컴퓨터 사용 평가에서는 Fable 5의 최고 결과를 약 3분의 1 비용으로 넘어섰습니다. 프론티어급 지능이 특별한 작업용 모델에서 일상적인 업무 모델로 내려오기 시작한 셈입니다.

 

🗣️ 에디터의 킥 (Editor's Kick)

 AI 가격을 볼 때는 100만 토큰 가격만 비교하면 안 됩니다. 하나의 업무에는 여러 번의 대화와 도구 호출, 재검토가 들어가기 때문이죠. 토큰 가격이 같아도 더 적은 단계로 성공하면 실제 작업 비용은 낮아집니다. Opus 5의 핵심도 단순히 “저렴한 모델”이 아니라 같은 비용으로 더 많은 일을 완성하는 모델이라는 점입니다.

 

 



[ 피치 캘린더 ]

첨부 이미지

<🎞 2026 대전 AI 영상 공모전>

 생성형 AI를 활용해 단편 영상을 제작하는 공모전입니다. 일반 국민뿐 아니라 대전 지역 참가자와 청소년을 위한 별도 부문도 운영되며, 수상작은 9월에 열리는 대전특수영상영화제에서 소개될 예정입니다.

 

  • 접수 기간: 2026년 7월 20일(월) ~ 8월 18일(화)
  • 참가 대상: 생성형 AI 영상 제작에 관심 있는 만 14세 이상 개인 또는 팀
  • 공모 부문: 전국 일반 / 대전 일반 / 전국 청소년
  • 시상 규모: 총상금 4,800만 원, 종합 대상 1,000만 원
  • 결과 발표: 2026년 9월 9일(수)
  • 시상식: 2026년 9월 18일(금), 제8회 대전특수영상영화제

이번 주 Peach Prompt는 여기까지입니다!

읽어주셔서 감사합니다. 다음 주에도 쉽고 중요한 AI 소식으로 찾아뵐게요.

원하시는 주제가 있다면 언제든 답장으로 알려주세요~

🖤

 

LinktreeInstagram

 

 

다가올 뉴스레터가 궁금하신가요?

지금 구독해서 새로운 레터를 받아보세요

✉️

이번 뉴스레터 어떠셨나요?

피치 프롬프트 AI 님에게 ☕️ 커피와 ✉️ 쪽지를 보내보세요!

댓글

의견을 남겨주세요

확인
의견이 있으신가요? 제일 먼저 댓글을 달아보세요 !

다른 뉴스레터

© 2026 피치 프롬프트 AI

초보자도 이해하기 쉽게! 이번 주 꼭 알아야 할 AI 소식 3가지만 전해드릴게요!

뉴스레터 문의peachprompts@gmail.com

메일리 로고

도움말 오류 및 기능 관련 제보

서비스 이용 문의admin@team.maily.so 채팅으로 문의하기

메일리 사업자 정보

메일리 (대표자: 이한결) | 사업자번호: 717-47-00705 | 서울특별시 송파구 위례광장로 199, 5층 501-2-31호

이용약관 | 개인정보처리방침 | 정기결제 이용약관 | 라이선스