← 5분 AI 뉴스

오늘의 AI 브리핑 ·

데이터센터가 궤도로 올라간다

5분 브리핑

약 2분 · 6개 흐름

핵심만 먼저 읽고, 궁금한 소식은 본문으로 이어 보세요.

전체 분석 9분으로 바로 가기 ↓
  1. 데이터센터가 궤도로 갑니다 — 엔비디아·SpaceXAI '스타마인드' 공식 발표

    엔비디아가 8월 24일 뉴스룸을 통해 발표했습니다. SpaceXAI가 그록 인프라에 에이전트를 위한 첫 CPU로 소개된 베라(Vera)를 채택합니다 — 커스텀 올림푸스 코어 88개, 메모리 대역폭 최대 1.2TB/s.

  2. 가장 좋은 모델이 가장 덜 팔립니다 — FT가 짚은 Fable 5의 자리

    FT가 8월 23일 보도했습니다. 램프(Ramp)의 7만 개사 청구 데이터 기준, 플래그십 Fable 5는 앤스로픽에서 구매된 토큰의 6%, 지출의 11.4% 선에서 정체 중입니다.

  3. 사람은 이제 소수 사용자입니다 — 토큰 경제의 세 장면

    a16z가 오픈라우터 데이터로 집계했습니다. 에이전트가 사람의 5배 가까운 토큰을 쓰고 있고, 2월 대비 14배로 늘었습니다.

  4. 샤오미가 풀스택을 폈습니다 — Xring O3와 120B 로컬 박스

    샤오미가 자체 SoC Xring O3를 공식 발표했습니다. 자사 저온 실험실 측정으로 안투투 V11 5,228,014점, 3nm 공정에 트랜지스터 240억 개, 6+4 빅코어 구성(최고 4.35GHz)입니다.

  5. 그록 봇의 일주일 — 장난이 워크플로가 됐습니다

    "ESP32에서 둠을 돌려 봐"라는 요청에 그록 봇이 GPL 둠 엔진과 셰어웨어 데이터를 골라 소형 보드 포팅을 끝냈고, 머스크가 이를 옮겨 적으며 다시 불붙었습니다. 코딩 없이 봇끼리 일을 넘깁니다.

  6. 🆕 그 밖의 신기능·신제품

    MCP 커넥터 엔터프라이즈 관리형 인가, 정식 제공 — 앤스로픽이 관리자용 중앙 인가를 GA로 확대했습니다. 관리자가 ID 공급자(옥타)로 조직 단위 인가를 걸면 구성원은 개별 OAuth 없이 도구가 연결되고, 이번 확장으로 Datadog·노션·슬랙 지원이 더해졌습니다.

주요 키워드 TOP 5: 스타마인드 · Fable 5 · Ox Alpha · 에이전트 토큰 · Xring O3 | 메인 이벤트: 엔비디아와 SpaceXAI가 베라 루빈 NVL72 랙을 통째로 궤도에 올리는 1세대 AI 위성 스타마인드를 공식 발표했습니다.

26조
Ox Alpha 나흘 누적 토큰
오픈코드 집계 · 오픈라우터 첫 사흘 11.6조
5배
에이전트/사람 토큰 사용 배율
a16z 집계 — 2월 대비 14배 성장
6%
Fable 5의 토큰 점유율
지출로는 11.4% — 램프 7만 개사 청구 데이터
522만
Xring O3 안투투 V11 점수
스마트폰 SoC 첫 500만 점 돌파

오늘은 수요와 공급이 한 화면에 잡힌 날입니다. 토큰을 태우는 다수가 사람이 아니라 에이전트라는 집계가 나왔고, 정체를 숨긴 모델 하나가 나흘 만에 수십조 토큰을 받아 갔습니다. 같은 날 공급 쪽에서는 오픈AI가 주력 모델 값을 한시적으로 내렸고, 엔비디아와 SpaceXAI는 아예 데이터센터를 궤도로 올리는 위성을 발표했습니다. 서로 다른 회사의 서로 다른 결정이지만, 전부 "지금 인프라로는 모자라다"는 같은 전제 위에 서 있습니다.

스타마인드 위성 렌더링
그림 1. 스타마인드 위성 렌더링. 엔비디아 발표에 실린 공식 렌더링으로, 판형 태양전지 어레이가 화면 왼쪽 끝까지 이어지고 중앙의 얇은 수직 구조물 아래로 지구 지평선이 보입니다. 외신이 전한 제원은 태양전지 폭 약 75m입니다.
08-24 03:16
FT의 "가장 좋은 모델이 안 팔린다" 기사, 해커뉴스 1위(753점)
08-24 13:45
코덱스 '한도 소진 후 완주' 혜택 종료를 정리한 사용자 글 확산
08-24 15:16
샤오미 발표회 — Xring O3 공개, 안투투 522만 점
08-25 00:18
악시오스, 앤스로픽 컬처 면접의 '주가 0' 질문 보도
08-25 00:22
GPT-5.6 Sol 한시 인하, 해커뉴스로 표면화
08-25 00:34
오픈라우터 "Ox Alpha 오늘 6조 토큰 페이스"
08-25 01:08
엔비디아 뉴스룸 — SpaceXAI의 베라 CPU 채택·스타마인드 발표
08-25 02:22
머스크 "우주 최적화 NVL72, 내년 4분기 궤도로"

1. 데이터센터가 궤도로 갑니다 — 엔비디아·SpaceXAI '스타마인드' 공식 발표

베라 CPU 다이 렌더링
그림 2. 베라 CPU 다이 렌더링. 검은 패키지 위에 칩 다이가 3D로 기울어 있고 중앙 연산부가 초록·파랑으로 강조돼 있습니다. 위성 사진이 아니라 엔비디아가 함께 배포한 칩 홍보 이미지입니다.

발표문을 뜯어 보면 이 계획의 논리는 전력입니다. 지상 데이터센터의 병목이 부지와 냉각으로 굳어진 상황에서, 상시 태양광과 복사 냉각을 쓰는 궤도로 올라가겠다는 계산입니다. 다만 발사 시점은 엔비디아 발표문에 없고 머스크의 글에서 나온 숫자라, 일정은 그의 예고로 읽는 편이 안전합니다. 2월에 xAI를 흡수한 뒤 'SpaceXAI'라는 이름으로 내놓는 첫 대형 인프라 발표이기도 합니다.

위성만의 이야기도 아닙니다. 그록의 지상 인프라 역시 같은 베라 루빈 세대로 확장되며, 엔비디아는 이를 "AI 공장에서 궤도까지 하나의 아키텍처"라고 묶었습니다. 에이전트 워크로드의 CPU 병목(오케스트레이션·코드 실행·데이터 처리)을 겨냥해 CPU를 따로 판다는 점이 이번 발표의 실무적인 축입니다.

그 밖에: 너스리서치는 SpaceXAI와의 파트너십으로 다음 주 동안 자사 포털에서 그록 4.6을 반값에 제공한다고 알렸습니다(자체 발표 기준).

시사점: 우주 데이터센터가 콘셉트 아트에서 조달 계약이 붙은 로드맵으로 내려왔습니다. 전력이 입지를 정하던 시대의 다음 수가 어디인지, 인프라 쪽 판이 먼저 움직이고 있습니다.

#스타마인드 #베라루빈 #궤도데이터센터

출처 4🔥 @elonmusk🔥 @nvidia🔥 @SawyerMerritt🔥 @SpaceXAI


2. 가장 좋은 모델이 가장 덜 팔립니다 — FT가 짚은 Fable 5의 자리

해커뉴스 최상위 댓글
그림 3. 해커뉴스 최상위 댓글. "Fable은 플랜에서 일주일만", "이제 토큰당 과금", "아니, 몇 주 연장"처럼 오락가락한 정책 공지를 나열하고, 이를 끝없는 흥정 게임이라 부르는 댓글 캡처입니다.

회사 전체가 못 크는 게 아닙니다. 앤스로픽의 연환산 매출은 5월 470억 달러에서 7월 650억 달러로 커졌고, 못 크는 건 플래그십의 자리입니다. 앤스로픽 제품 리더 다이앤 펜은 일상 작업은 Opus 5, Fable 5는 며칠씩 걸리는 자율 프로젝트용이라는 역할 구분으로 설명해 왔습니다. 플래그십을 니치로 재정의하는 셈입니다.

사용자 쪽 실감도 비슷한 방향입니다. 개발자 유첸 진은 프런티어 모델을 쓸수록 하나가 전부를 지배한다는 믿음이 사라진다며, 가르치는 데는 Opus 5, 백엔드는 GPT-5.6 Sol, 일상 코딩의 90%는 값싼 Kimi K3와 GLM-5.2로 갈라 쓴다고 적었습니다. 모든 랩이 범용을 향해 훈련하지만 오늘의 모델들은 여전히 전문가라는 정리입니다.

그 밖에: 악시오스는 앤스로픽 컬처 면접에 "안전상 방향 전환으로 주가가 0이 되면 어떻겠나"는 취지의 질문이 있다고 보도했습니다. 며칠 안에 Opus·Sonnet·Fable의 5.1판이 나온다는 소문도 돌지만 확인된 바 없습니다.

시사점: '제일 좋은 모델'과 '제일 무난한 모델'의 시장이 갈라졌습니다. 최상위 모델은 장기 자율 작업이라는 좁은 자리로 이동 중이니, 요금제를 고를 때도 벤치마크 1위가 아니라 내 작업의 길이를 기준으로 삼는 편이 맞습니다.

#Fable5 #모델가격 #점유율

출처 4💬 @Yuchenj_UW🔥 @levelsio🔥 @MTSlive🔥 @bindureddy


3. 사람은 이제 소수 사용자입니다 — 토큰 경제의 세 장면

오픈라우터 출시 기록 차트
그림 4. 오픈라우터 출시 기록 차트. 출시 후 첫 사흘 토큰량 순위로, ox-alpha 11.6T가 1위이고 qwen3.6-plus 4.4T, hy3 2.8T, deepseek-v4-flash 2.2T가 뒤를 잇습니다. 오픈라우터가 직접 올린 집계입니다.

무제한이 왜 사라지는지 보여 준 사건도 같은 날 정리됐습니다. 코덱스에는 한도를 다 써도 진행 중인 작업은 끝까지 돌려 주는 배려가 있었는데, 한 턴을 닫지 않고 대기 도구를 끼워 넣어 이 배려를 무한정 쓰는 하네스 'Endless'가 나와 퍼졌습니다. 한 이용자는 잔여 0% 이후로 800달러어치 토큰이 돌았다고 적었고, 소동 끝에 도구는 내려갔으며 사용자들 측정으로는 이제 초과 허용치가 1% 안팎으로 잘립니다. 코덱스를 이끄는 티보 소티오는 계정에 사용량 리셋을 반영했고 수정 사항을 계속 알리겠다고 공지했습니다.

코덱스 한도 소동 캡처
그림 5. 코덱스 한도 소동 캡처. 오픈AI 직원이 "한도에 닿아도 작업 중간에 끊지 않는 건 의도된 선택"이라 설명한 글과, 그 아래 "잔여 0% 뒤 800달러어치가 돌았다"는 시연 글이 함께 캡처돼 있습니다.

a16z 수치가 말하는 건 청구서의 주인이 바뀌었다는 사실입니다. 에이전트는 캐시된 프롬프트 위주라 토큰 단가는 내려가는데, 총량 증가가 그 절감을 앞지릅니다. 값을 내리면서 구멍은 막는 오픈AI의 이번 주 행보는 그 계산의 양면입니다.

그 밖에: Ox Alpha의 상위 소비처는 헤르메스 에이전트(3.18조)와 클로드 코드(1.57조)라는 집계가 있고, 운영 주체는 GLM 계열이라는 추측 보도만 있습니다. 스트라이프 CEO 패트릭 콜리슨은 'ori' 명령 한 줄로 이 모델을 시연했습니다.

시사점: 단가 인하와 한도 강화는 모순이 아니라 한 세트입니다. 에이전트가 다수 사용자가 된 이상 개인 요금제의 '무한'은 유지되기 어려우니, 반복 작업일수록 캐시 적중과 사용량 상한을 설계에 넣어 두세요.

#에이전트토큰 #OxAlpha #토큰단가

출처 6🔥 @zerohedge🔥 @OpenRouter🔥 @opencode🔥 @dtzy_88🔥 @markvalorian🔥 @MatthewBerman


4. 샤오미가 풀스택을 폈습니다 — Xring O3와 120B 로컬 박스

Xring O3 발표회 현장
그림 6. Xring O3 발표회 현장. 무대 스크린에 "小米实验室低温环境 / Antutu V11"이라는 조건과 5,228,014라는 점수가 떠 있고, 객석에서 관객들이 일제히 폰으로 촬영 중입니다.
Xring O3 스펙 카드
그림 7. Xring O3 스펙 카드. CPU(6 울트라 코어+4, 4.35GHz)·GPU(16코어, 피크 +85%·레이트레이싱 +182%)·NPU(200 TOPS, MiMo 맞춤)·LPDDR6(113.8GB/s) 항목이 카드로 정리돼 있습니다.

핵심은 개별 칩이 아니라 묶음입니다. 클라우드에서 빌려 쓰던 급의 모델(120B)을 책상 위 상자에서 돌리겠다는 시제품과, 그 모델을 채울 중국 오픈웨이트 생태계(DeepSeek·Qwen·Kimi·MiMo)와, 그걸 돌릴 자사 실리콘까지 한 발표회에 나란히 놓였습니다. 폰 SoC의 벤치마크 기록은 그 묶음의 입장권에 가깝습니다.

수직 계열이 실제로 맞물린다는 점도 확인됩니다. MiMo는 이미 상업 이용을 허용하는 라이선스로 허깅페이스에 풀려 있고, NPU 사양표에는 이 모델에 맞췄다는 문구가 명시돼 있습니다. 모델을 팔지 않는 대신 모델이 도는 기계를 팔겠다는 배치입니다.

그 밖에: 공개 열흘 남짓 된 콴3.8-27B에는 벌써 무검열 파생판(SuperQwen3.8-27b-abliterated)이 붙었습니다. 거부율 0% 주장과 100만 토큰 컨텍스트 검증을 내걸었는데, 공식이 아닌 개인 제작물이라는 점은 감안해야 합니다.

시사점: '로컬 120B'가 시제품으로라도 무대에 오른 이상, 다음 경쟁은 프라이버시와 고정비에 민감한 시장의 기본값 싸움입니다. 클라우드 대 로컬의 총비용 계산을 다시 해 볼 때가 됐습니다.

#XringO3 #AICube #온디바이스

출처 3🔥 @UniverseIce🔥 @IntCyberDigest🔖 @jun_song


5. 그록 봇의 일주일 — 장난이 워크플로가 됐습니다

그록 봇의 둠 포팅 대화
그림 8. 그록 봇의 둠 포팅 대화. 'Chief Engineer' 봇이 240×280 패널용 레이캐스터를 먼저 제안하다가, "원작 그대로여야 한다"는 요청에 GPL 둠 엔진과 셰어웨어 에피소드 1 데이터로 계획을 바꾸는 대화가 담겨 있습니다.
클리퍼 봇 작업 화면
그림 9. 클리퍼 봇 작업 화면. 왼쪽 사이드바에 CLIPPER·TRAINER·ACCOUNTANT·RESEARCHER·WRITER 봇 목록이 있고, 클립을 1080p로 잘라 약 22MB로 만들었다는 진행 로그와 "Messaged RESEARCHER" 표시가 보입니다.

이날 타임라인에서 눈에 띈 건 결과물보다 독자층입니다. 흥행 상위 기사가 전부 그록 봇 가이드였고, "Hermes Agent Masterclass: 5. Providers & Models" 같은 심화편까지 상위에 들었습니다. 에이전트 사용이 개발자 담장을 넘어가는 속도를 보여 주는 장면인데, 다만 이 사용례들은 X 캡처 기반이라 재현성은 각자 확인할 몫입니다.

문턱도 확 낮습니다. 클리퍼 사례의 작성자는 코딩을 한 적이 없고, 구글 계정으로 로그인해 말로 요청한 게 전부라고 적었습니다. 봇을 만들고 서로 잇는 일이 설정 화면 수준의 작업으로 내려온 셈입니다.

그 밖에: 같은 흐름에 붙는 반문도 회자됐습니다 — "We can build anything. So why are we all building the same thing?"라는 에세이입니다.

시사점: 에이전트 대중화의 진짜 지표는 벤치마크가 아니라 비개발자 사용례의 총량입니다. 봇이 봇에게 일을 넘기는 캡처가 일상이 된 주간, 내 반복 작업 하나를 봇 체인으로 옮겨 볼 만합니다.

#GrokBot #봇체인 #노코드자동화

출처 5💬 @elonmusk🔥 @KanekoaTheGreat🔥 @DataChaz🔥 @tonbistudio🔥 @jasperdeboer


6. 🆕 그 밖의 신기능·신제품

커넥터 관리자 화면
그림 10. 커넥터 관리자 화면. "Enable for organization" 토글 아래 Asana·Atlassian·Canva·Figma 커넥터가 목록으로 놓인 관리자 설정 화면입니다.

시사점: 조직 단위 인가, 오픈소스 기금, IT 자회사 인수까지 — 에이전트 인프라의 '어른들 장비'가 갖춰지는 주간입니다. 개인 도구였던 것들이 회사 장비가 되는 속도를 눈여겨볼 만합니다.

#MCP #엔터프라이즈 #오픈소스기금

출처 4🔥 @ClaudeDevs🔥 @steipete🔥 @TukiFromKL🔖 @Sans_Google


📊 오늘의 감정/온도 분석

전환성장주의과열
차분 ←
전환 — 토큰 소비의 다수가 사람에서 에이전트로 넘어갔다는 집계가 나왔고, 요금과 한도 정책이 그 전제 위에서 다시 짜이고 있습니다.
성장 — 샤오미가 폰 SoC 500만 점과 120B 로컬 박스를 같은 날 내놨고, 궤도 데이터센터는 조달 계약이 붙은 로드맵이 됐습니다.
주의 — 최고 성능과 실제 지출이 갈라졌습니다. Fable 5의 6%는 성능이 아니라 가격·정책 신뢰의 문제라는 게 댓글 민심입니다.
과열 — 정체를 밝히지 않은 모델에 나흘 만에 수십조 토큰이 몰렸습니다. 그 입력이 어디로 가는지는 확인된 게 없습니다.

💼 오늘의 실무 팁 — 쉽게 풀어 쓴 사용법 6가지

1. 어려운 작업엔 그록 빌드의 노력 단계를 올려 보세요 /effort를 입력해 Extra High로 바꾸면 어려운 프로젝트에 추론량을 더 씁니다. 모든 작업에 올려 두면 느려지기만 하니 난이도로 구분해 쓰세요.

2. 밑바닥부터 LLM을 이해하고 싶다면 공개된 교과서 두 챕터면 충분합니다 프랑소와 숄레의 『Deep Learning with Python』 15~16장이 온라인에 무료로 열려 있습니다. 어텐션이 왜 작동하는지에 대한 설명으로 손꼽히는 자료입니다.

3. 위성 지도가 필요하면 NASA Worldview부터 열어 보세요 관측 후 3시간 안에 갱신되는 전 지구 위성 이미지를 가입 없이 무료로 봅니다. "방금 공개됐다"는 소문과 달리 2014년부터 오픈소스였던 오래된 보석입니다.

4. 에이전트 작업 지침은 파일 하나로 정리하세요 코드 품질 규칙을 agent.md 한 장에 적어 두면 어느 코딩 에이전트든 같은 기준으로 일합니다. 해커뉴스에서 실제 예시 문서가 크게 회자됐습니다.

5. 복사가 안 되는 문서는 OCR로 꺼내 쓰세요 스캔 PDF나 보호된 문서에서 텍스트를 추출해 주는 오픈소스 도구(OCR It)가 공유됐습니다. LLM에 넣을 자료를 만들 때 유용합니다.

6. 한시 인하는 달력에 적어 두세요 GPT-5.6 Sol 인하는 "최소 11월 21일까지"라는 조건이 붙어 있습니다. 종료일 있는 가격으로 원가 계산을 굳히면 곤란해지니, 재검토 날짜를 함께 잡아 두세요.


📦 확인 방식 스타마인드와 베라 CPU의 제원은 엔비디아 뉴스룸 발표문에서, Fable 5 점유율은 램프가 공개한 청구 데이터 집계에서, GPT-5.6 Sol 가격은 오픈AI 요금 문서 원문에서 가져왔습니다. 코덱스 한도 변경 폭은 사용자 측정치라 회사 확인 전이고, Ox Alpha의 운영 주체는 여전히 비공개입니다 — 외부 독립 검증 전입니다.

🏷 라벨 가이드 — 🔥 인기(좋아요 중심) · 🔁 공유(리트윗 비율 높음) · 💬 논쟁(댓글 비율 높음) · 🔖 저장(북마크 많음) · 🚀 떠오름(작은 계정인데 확산 시작)

전체 아카이브 보기 (지난 호 전체) →