딥시크 V4.1 플래시가 캐시를 4분의 1로 줄였습니다 — 100만 토큰에 0.003달러
딥시크가 9월 10일 V4.1 플래시를 공개했습니다. 5520억 개 파라미터 가운데 입력 시 80억 개만 깨어나고, KV 캐시를 토큰당 890바이트까지 줄였습니다. 가중치는 MIT 라이선스로 공개됐고 9월 14일부터 구형 엔드포인트가 전환됩니다.
딥시크가 9월 10일 V4.1 플래시를 공개했습니다. 5520억 개 파라미터 가운데 입력 시 80억 개만 깨어나고, KV 캐시를 토큰당 890바이트까지 줄였습니다. 가중치는 MIT 라이선스로 공개됐고 9월 14일부터 구형 엔드포인트가 전환됩니다.
텐센트가 8월 28일 Hy4 프리뷰를 아파치 2.0으로 공개했습니다. 전체 7,700억 파라미터에 한 번에 쓰는 것은 490억, 컨텍스트는 100만 토큰이 넘어요.
법률 AI 회사 하비가 8월 20일 오픈웨이트 기반 자체 모델 테넷을 공개했습니다. B300 150장·2개월로 사후학습해 홀드아웃 과제 완수량을 약 두 배로 올렸고, 비용은 프런티어 모델의 4분의 1 미만입니다.
엔비디아가 풀사이드의 모델 팩토리를 60억 달러 비독점 라이선스로 확보하고 10억 달러를 투자했습니다. 직원 109명이 옮기지만 창업자는 남습니다. 인수 심사를 비껴가는 새 거래 형태입니다.
알리바바가 8월 14일 큐원 3.8-27B를 아파치 2.0으로 공개했습니다. 비전 인코더가 들어간 멀티모달에 네이티브 26만 토큰, 터미널 벤치 73.0. 4비트로 줄이면 RTX 4090 한 장에 들어갑니다.
Z.ai가 8월 14일 GLM-5.3을 공개했습니다. 베이스 모델을 다시 훈련하지 않고 사후 훈련만 키웠는데 사이버짐 84.5로 클로드 미토스 5와 GPT-5.6 솔을 앞섰고, 회사는 예상 못 한 창발 능력을 이유로 가중치 공개를 2주 미뤘습니다.
xAI 공동창업자 이고르 바부슈킨이 만든 리버 AI가 창업 두 달 만에 11억 달러를 유치했습니다. 엔비디아와 AMD가 나란히 들어갔고, 목표는 누구나 자기 모델을 학습·튜닝·서빙하는 '개방형 AI 스택'이에요.
딥시크가 8월 13일 V4 Pro 0813을 공개했습니다. 블로그도 기술보고서도 없었고, 올린 안내문은 다음 날 사라졌어요. 종합 점수는 53점으로 밋밋했지만 사이버보안 평가에서는 83.3점을 찍었습니다.
2026년 8월 3일 알리바바가 Qwen3.8-Max를 공개했어요. 총 2조 4천억 파라미터, 질의당 950억 개만 활성화, 컨텍스트 100만 토큰. 16일 무인 코딩, 논리 게이트 8,298→678개, 10만 위안으로 1년 장사까지 — 사례와 한계를 함께 정리했습니다.
중국 DeepSeek이 7월 31일 공개한 V4-Flash 0731이 실제 작동 파라미터 13B로 자사 플래그십을 아홉 개 에이전트 벤치마크에서 전부 이겼어요. 재학습만으로 이룬 도약, 100만 토큰 문맥, MIT 오픈 웨이트, 그리고 서방 모델의 수십 분의 1 가격까지 쉽게 풀어드려요.
세계에서 가장 비싼 AI 스타트업 앤트로픽이 실리콘밸리 내부의 반발에 직면했어요. 클로드 디자인 vs 피그마, Fable 5 숨겨진 가드레일, 오픈웨이트 편지 거부 — 백래시의 세 갈래를 쉽게 정리했습니다.
중국 문샷AI가 7월 27일, 역대 최대 규모(2.8조 파라미터)의 오픈 웨이트 모델 Kimi K3를 무료 공개합니다. 1.4TB 파일, GPU 64장의 벽, 데이터 주권, 그리고 오픈 웨이트 패권이 중국으로 기우는 흐름까지 쉽게 풀었어요.