1 분 소요

신모델은 여전히 쏟아지는 가운데, “누가 진짜 1위냐”는 벤치마크 경쟁과 “AI 랩을 믿을 수 있느냐”는 회의론이 동시에 눈에 띄는 하루입니다. 2026년 8월 4일 기준 AI 소식을 정리했습니다.

벤치마크 왕좌에 오른 Claude Opus 5

7월 24일 나온 Anthropic Claude Opus 5가 8월 들어 각종 순위 상단을 차지했습니다.

  • Artificial Analysis 기준 Intelligence Index 61 / Agentic Index 55.3으로 선두.
  • 가격은 100만 토큰당 $5 / $25. 이전 최상위 모델(Fable 5)급 지능을 대략 절반 가격에 제공한다는 평가.
  • Claude Max의 기본 모델이자 Pro에서 가장 강력한 옵션으로 배치됐습니다.

(출처: llm-stats AI News, Artificial Analysis 인용)

계속 밀리는 Gemini 3.5 Pro

반대로 구글은 발이 묶였습니다. Bloomberg는 Gemini 3.5 Pro가 일정보다 수개월 지연됐고, 특히 코딩 성능이 내부 목표에 못 미친다고 보도했습니다. 플래시 계열은 계속 나오는데 정작 최상위 Pro가 늦어지는 모양새입니다.

신모델 러시는 계속

  • Qwen 3.8 Max (알리바바, 8월 2일)
  • DeepSeek-V4-Flash-0731 (딥시크, 8월 1일)

중국 진영이 8월 초를 신모델로 열었습니다. 업계 전체로는 추적된 모델 출시가 337개+에 달할 만큼, “출시 러시”가 일상이 됐습니다. 추론(reasoning) 모델의 정확도-속도 트레이드오프, 멀티모달 기본 탑재, 저비용화가 공통 흐름입니다.

팔란티어의 어닝과 카프의 일갈

  • 팔란티어 2분기 실적: 매출 전년비 +93%, 19.4억 달러. 미국 상업 매출은 +149%, 연간 가이던스 상향. AI 수요가 실적으로 확인됐습니다.
  • 동시에 CEO 알렉스 카프는 “프런티어 AI 랩들은 기업이 믿고 쓰기엔 너무 신뢰가 안 간다“며 업계를 강도 높게 비판했습니다. 돈은 벌지만 신뢰는 아직이라는 메시지.

단신

  • DesignArena, 790만 달러 투자 유치: 디자인 평가 플랫폼으로, 프런티어 랩에 ‘사람의 평가’ 데이터를 제공(사용자 530만 명).
  • AI 음악 판별 논쟁: 힙합 트랙 “Rubberz”를 두고 “AI 생성이다/아니다” 공방 — 창작물의 AI 여부 판별이 또 화두.
  • 틱톡, 청소년 소송 추가 합의: 캘리포니아 연방법원에 계류 중인 유사 청구 2,600건 관련.

한 줄 요약

모델 순위는 앤트로픽이, 실적은 팔란티어가 가져갔지만 — 정작 업계 화두는 “이 AI를 믿어도 되나”였다.


본 글은 2026년 8월 4일 시점의 공개 보도를 정리한 것으로, 이후 상황이 바뀔 수 있습니다. 출처는 본문 링크를 참고하세요.

댓글남기기