
[AI 브리핑] 2026.07.20 — Kimi K3·Fable 5 복귀
오늘은 중국 Moonshot AI의 초대형 오픈웨이트 모델 Kimi K3 공개와 Anthropic Claude Fable 5의 유료 요금제 정식 복귀가 겹친 하루였다. SK하이닉스의 HBM4→DDR5 전환 발표로 반도체주가 급락하며 AI 하드웨어 투자심리도 흔들렸다.
| MODEL LAUNCH 문샷AI, 세계 최대 오픈웨이트 모델 'Kimi K3' 공개
중국 Moonshot AI가 매개변수 2.8조 개로 공개된 모델 중 세계 최대 규모인 오픈웨이트 모델 Kimi K3를 발표했다. 100만 토큰까지 입력을 처리하는 긴 컨텍스트 윈도우와 상시 추론 "사고 모드"를 지원하며, 코딩·에이전트 벤치마크에서 Claude Opus 4.8과 GPT-5.5를 앞섰지만 Claude Fable 5와 GPT-5.6 Sol에는 못 미쳤다. 전체 가중치는 7월 27일 공개될 예정으로, 미국의 반도체 수출 규제 속에서도 중국의 AI 경쟁력을 보여주는 사례로 꼽힌다.
| MODEL LAUNCH 클로드 Fable 5, 오늘부터 Max·팀 프리미엄 요금제 복귀
Anthropic이 7월 20일부터 Claude Fable 5를 Max와 Team Premium 요금제에 주간 사용 한도의 50%까지 정식 포함시킨다. Pro와 Team Standard 사용자는 계속 사용 크레딧으로 Fable 5에 접근하며, 이번 전환에 맞춰 100달러 상당의 1회성 크레딧을 받는다. Fable 5는 6월 미국 수출통제로 접근이 막혔다가 7월 1일 재배포된 뒤 여러 차례 임시 연장을 거쳐 이번에 보다 안정적인 형태로 자리 잡았다.
| CHIP SK하이닉스, HBM4 대신 DDR5 확대…반도체주 급락
SK하이닉스가 HBM4 생산 전환 일정을 늦추고 일부 라인을 DDR5로 돌리기로 하면서 코스피가 10% 넘게 급락해 서킷브레이커가 발동됐고, SK하이닉스 주가는 12% 넘게 떨어졌다. 필라델피아 반도체지수(SOXX)도 6월 고점 대비 20% 하락하는 등 AI 반도체 투자심리가 전반적으로 흔들리고 있다. 마진이 높은 DDR5로 생산을 돌리는 결정이 AI 메모리 수요 성장 둔화 신호로 해석되면서 투자자들의 우려가 커졌다.
| MODEL LAUNCH 딥시크 V4 정식 출시, 시간대별 차등 요금제 첫 도입
DeepSeek이 V4 Pro(매개변수 1.6조 개)와 V4 Flash(2840억 개) 두 버전을 정식 출시했다. 전 모델에 100만 토큰 컨텍스트 윈도우를 기본 지원하며 코딩·수학·에이전트 성능이 강화됐다. 특히 오전 9
12시, 오후 2
6시를 '피크 시간'으로 정해 이 시간대 API 요금을 평소의 2배로 책정하는 업계 첫 시간대별 차등 요금제를 도입해 눈길을 끌었다.
| LAWSUIT 출판사·저자들, 구글 제미나이 저작권 소송
아셰트, 센게이지, 엘스비어 등 출판사와 작가 스콧 터로우 등이 구글을 상대로 Gemini 학습에 저작권 있는 콘텐츠를 무단 사용했다며 집단소송을 제기했다. 소송에는 구글이 저작권 표시를 무단으로 삭제·변경했다는 의혹도 포함됐다. 앞서 앤스로픽이 유사한 저작권 소송에서 15억 달러(약 2조 원) 규모로 합의한 바 있어, 이번 소송의 향방에도 관심이 쏠리고 있다.
| INFRA 챗GPT, 전 세계 접속 장애 발생
7월 19일 새벽부터 미국, 영국, 독일, 러시아 등 여러 국가에서 챗GPT 접속 오류 신고가 급증했다. 다운디텍터 등 장애 감지 서비스 기준 신고 건수가 수만 건에 달했다. OpenAI는 공식 상태 페이지에 '부분 장애(Partial Outage)'로 표시하고 원인을 조사 중이라고 밝혔으며, 이날 일부 기업 고객은 Codex 권한 없는 ChatGPT 앱 접근 제한도 함께 겪었다.
| PRODUCT MS, AI 보안 툴 '프로젝트 퍼셉션' 이달 출시 예고
마이크로소프트가 앤스로픽·OpenAI·자사 모델을 작업 성격에 따라 라우팅해 비용을 낮춘 AI 보안 취약점 탐지 도구 '프로젝트 퍼셉션'을 이달 중 출시할 것으로 알려졌다. 아직 공식 발표 전이며 업계 보도에 근거한 소식이다. 앤스로픽의 유사 제품 Mythos보다 API 비용을 크게 낮춰 가격 경쟁력을 앞세울 것으로 전해졌다.
| 오늘의 신기술
- Kimi K3 (Moonshot AI) — 매개변수 2.8조 개, 오픈웨이트 모델 사상 최대 규모. 출처
- Claude Fable 5 (Anthropic) — Max·Team Premium 요금제로 정식 복귀. 출처
- DeepSeek V4 (DeepSeek) — 정식 출시, 업계 첫 피크타임 차등 API 요금제. 출처
| 오늘의 용어
- HBM4 (High Bandwidth Memory 4세대): AI 반도체가 연산할 때 데이터를 빠르게 주고받도록 돕는 초고속 메모리의 4세대 규격이에요.
- 오픈웨이트 모델 (Open-weight Model): AI가 학습한 결과물(가중치)을 누구나 내려받아 자유롭게 쓸 수 있도록 공개한 모델이에요.
- 컨텍스트 윈도우 (Context Window): AI가 한 번에 기억하고 처리할 수 있는 글자(토큰)의 최대 분량을 말해요. 이 값이 클수록 긴 문서나 대화를 한 번에 다룰 수 있어요.
- 사용 크레딧 (Usage Credit): 정해진 구독 한도와 별도로, 사용한 만큼 차감되는 추가 이용권이에요.
| 개발자를 위한 오늘의 개념
- 100만 토큰 컨텍스트 윈도우는 어떻게 가능할까 (기술 딥다이브)
Kimi K3와 DeepSeek V4가 나란히 내세운 "100만 토큰 컨텍스트 윈도우"는 단순히 입력 길이 제한을 늘린 게 아니라, 어텐션 연산과 KV 캐시(과거 토큰의 키·값을 저장해 재계산을 피하는 메모리 구조) 비용을 어떻게 억누르느냐의 문제다. 토큰 수가 늘어날수록 표준 어텐션의 연산량은 제곱으로 증가하기 때문에, 최근 모델들은 슬라이딩 윈도우 어텐션, 선형/희소 어텐션(Kimi가 자체 개발했다고 밝힌 "Kimi Delta Attention"류), KV 캐시 양자화·압축 등을 조합해 긴 문맥을 실용적인 비용으로 처리한다. 컨텍스트가 길어질수록 서빙 인프라의 메모리 대역폭이 병목이 되기 때문에, 오늘 소개된 HBM4 이야기와도 맞닿아 있다 — 결국 긴 컨텍스트를 빠르게 서빙하려면 더 빠른 메모리가 필요하다. - MoE(Mixture-of-Experts)와 활성 파라미터 (기술 딥다이브)
Kimi K3(2.8조)와 DeepSeek V4 Pro(1.6조)처럼 총 매개변수가 조 단위인 모델은 대부분 MoE 구조를 쓴다. 입력마다 전체 네트워크를 다 쓰는 대신 일부 "전문가" 서브네트워크만 선택적으로 활성화해, 총 파라미터는 크지만 추론 시 실제로 계산에 쓰이는 "활성 파라미터"는 훨씬 적게 유지한다(DeepSeek V4 Flash는 총 2840억 개 중 활성 130억 개만 사용). 이 덕분에 모델 용량(지식·표현력)은 늘리면서도 추론 비용은 상대적으로 낮게 유지할 수 있어, 오늘 두 회사 모두 이 구조를 택한 이유이기도 하다. - 에이전트 메모리(Agent Memory)란 무엇인가 (독립 개념)
에이전트 메모리는 LLM 기반 에이전트가 단일 대화 턴을 넘어 과거 상호작용, 사용자 선호, 이전 작업 결과를 기억하고 재활용할 수 있게 하는 구조를 말한다. 가장 단순한 형태는 대화 요약을 프롬프트에 다시 넣는 방식이지만, 최근에는 개별 사실을 카테고리별로 저장해두고 필요할 때만 검색해 불러오는 "구조화된 메모리 엔트리" 방식이 늘고 있다. 이렇게 하면 컨텍스트 윈도우를 낭비하지 않으면서도 장기적인 개인화나 프로젝트 맥락 유지가 가능해져, 코딩 에이전트나 개인 비서형 AI에서 특히 중요해지고 있는 설계 요소다.
출처
- China's Moonshot AI releases Kimi K3 - VentureBeat
- Moonshot releases 2.8-trillion-parameter Kimi K3 - Tom's Hardware
- Claude Fable 5 returns to Max and Team Premium - X/@claudeai
- Anthropic to add Claude's Fable 5 model to Max, Team Premium plans - Dawn
- SK Hynix to prioritise DDR5 expansion over HBM4 - Overclock3D
- Tech stocks lead steep global selloff - Fortune
- DeepSeek V4 released - SitePoint
- DeepSeek to launch V4 with peak-time API pricing - TechNode
- Authors, publishers sue Google over alleged AI copyright infringement - Al Jazeera
- Google faces another AI training lawsuit from major publishers - TechCrunch
- ChatGPT hit by major global outage - Open The Magazine
- Microsoft's Project Perception - TechRepublic
#AI브리핑 #KimiK3 #ClaudeFable5 #DeepSeekV4 #Anthropic #Moonshot #DeepSeek #SK하이닉스 #HBM4 #구글저작권소송 #챗GPT장애 #Microsoft
'Hello! Hola! Hej! > 📰 AI TECH' 카테고리의 다른 글
| [AI 브리핑] 2026.07.22 — 오픈AI 샌드박스 탈출·구글 제미나이 3종 (0) | 2026.07.24 |
|---|---|
| [AI 브리핑] 2026.07.21 — TSMC 추가 투자·EU DMA·Kimi K3 (0) | 2026.07.24 |
| [AI 브리핑] 2026.07.17 — WAIC 개막·Grok 4.5·앤스로픽 470억 달러 (0) | 2026.07.24 |
| 2026-07-16_ai-news-briefing (0) | 2026.07.16 |
| 2026-07-15_ai-news-briefing (0) | 2026.07.16 |