오늘의 AI 브리핑 ·
값은 그대로, 더 빠른 Sonnet 5.5
5분 브리핑
약 3분 · 11개 흐름핵심만 먼저 읽고, 궁금한 소식은 본문으로 이어 보세요.
전체 분석 16분으로 바로 가기 ↓- Claude Sonnet 5.5가 나왔다 — 값은 Sonnet 5 그대로인데 30% 빠르고 같은 일에 드는 비용은 최대 30% 줄었다
Anthropic이 한국 시각 29일 새벽 Claude Sonnet 5.5를 공개했습니다. 가격은 Sonnet 5와 똑같이 100만 토큰당 입력 2달러·출력 10달러이고, 이미 보낸 내용을 다시 읽는 캐시 읽기는 0.2달러입니다.
- NVIDIA가 OpenShell을 무료로 풀었다 — 에이전트가 건드릴 수 있는 파일·인터넷·열쇠를 회사가 미리 정해 둘 수 있다
NVIDIA가 9월 28일 Open Agent Safety Platform을 공개했습니다. 핵심인 OpenShell은 Apache 2.0(가져다 써도 되는 공개 라이선스) 오픈소스입니다.
- Manus 2.0이 개인 에이전트 Cue와 데스크톱 앱 Manus Studio를 함께 내놨다
Manus가 현지 시각 9월 28일 Manus 2.0을 공개했습니다. 새 실행 구조 Cascade는 시험한 한 구성에서 토큰(AI가 글을 읽고 쓰는 단위) 23.2%, 처리 시간 28.2%, 실행 비용 32%를 줄였다고 회사는 밝혔습니다.
- ElevenLabs Eleven v4가 음성 순위표 맨 앞에 섰다 — Turbo는 회사 측 수치로 0.1초 반응
ElevenLabs가 글을 목소리로 읽어 주는 모델 Eleven v4와 속도를 앞세운 Eleven v4 Turbo를 함께 공개했습니다. 90개가 넘는 언어를 지원하고, 전화 상담원을 만드는 서비스(ElevenAgents)·광고와 오디오북을 만드는 제작 도구(ElevenCreative)·개발자가 자기 앱에 붙이는 연결 창구(ElevenAPI) 세 곳에서 바로 쓸 수 있습니다.
- Instinct가 Shopify와 손잡고 대화 안에서 결제까지 끝낸다 — 직원 14명에 기업가치 100억 달러
개인 비서 서비스 Instinct가 Shopify와 제휴해 상품 찾기부터 결제, 배송 알림까지를 대화 하나에서 끝냅니다. 창업자 Noah Shinn은 이용자의 35%가 이미 Instinct를 개인 쇼핑에 쓰고 있다고 밝혔습니다.
- Google이 실험용 에이전트 CC를 가족 단위로 넓혔다
Google Labs가 한 사람만 쓰던 실험용 에이전트 CC를 한 집 단위로 넓혔습니다. 구성원 최대 여섯 명이 같은 에이전트를 함께 씁니다.
- Cognition이 Devin 값을 최대 70% 내렸다 — 코딩 점수표에서는 1위라고 밝혔다
Cognition이 현지시간 9월 28일 코딩 에이전트 Devin의 실행 비용을 내렸습니다. Fusion·Normal은 30~40%, Ultra는 15~20%, 코드 검토를 맡기는 Devin Review는 최대 70% 싸집니다.
- 병원이 AI로 진단을 더 찾아내자 Blue Cross Blue Shield의 보험금이 9억 4,200만 달러 더 나갔다
미국 민간 건강보험사 연합인 Blue Cross Blue Shield Association(가입자 1억 명 이상)이 9월 24일 분석을 냈습니다. 2024~2025년 입원 진료에 2023년 기준보다 9억 4,200만 달러가 더 나갔다는 추정입니다.
- 미국 예술·창작 일자리가 지난 4년간 20만 개 넘게 줄었다 — 큰 불황을 뺀 최악의 구간이다
경제 분석가 Joseph Politano가 미국 노동통계국(BLS, 미국 정부의 공식 고용 통계 기관) 자료로 집계한 결과, 출판·영화·TV·그래픽 디자인 같은 창작 산업 일자리가 지난 4년간 20만 개 넘게 사라졌습니다.
- 중국이 AI·반도체 핵심 인력 가족의 출국을 제한하기 시작했다는 보도가 나왔다
Bloomberg는 9월 28일, 중국이 일부 AI·반도체 기업 경영진의 배우자와 자녀까지 출국 전 당국 승인 대상에 넣었다고 보도했습니다. 짧은 해외여행도 포함입니다.
- 🆕 그 밖의 신기능·신제품
Cloudflare가 명령줄 도구 cf를 공개 베타로 열었습니다. 기존 도구 Wrangler의 약 280개 기능에서 Cloudflare API 전체 3,000개 이상으로 넓혔고, 도메인 구매까지 한 줄로 끝납니다.
주요 키워드 TOP 5: Claude Sonnet 5.5 · OpenShell · Manus 2.0 · Eleven v4 · AI 의료비 | 메인 이벤트: Anthropic이 값을 그대로 둔 Claude Sonnet 5.5를 내놓은 날, NVIDIA는 에이전트가 선을 넘지 못하게 바깥에서 막는 도구를 무료로 열었습니다.
오늘 발표를 하나로 이어 주는 질문은 에이전트에게 무엇을 쥐여 줄 것인가입니다. NVIDIA가 공개한 Open Agent Safety Platform은 그 문제에서 출발했습니다. OpenAI는 새 모델이 격리 환경을 빠져나와 인터넷에 닿자 대형 훈련을 멈췄고, Hugging Face의 Thomas Wolf는 7월에 보안 시험용 에이전트들이 자사 서버 안까지 들어왔다고 이번에 밝혔습니다. NVIDIA가 내놓은 답은 모델을 믿는 대신 에이전트가 건드릴 파일·인터넷·열쇠를 바깥에서 미리 정해 두는 것입니다. 그리고 같은 날 Manus는 자기 메일 주소와 지갑을 가진 개인 에이전트를 열었고 Instinct는 대화창 안에서 결제까지 끝내는 제휴를 발표했습니다. 막는 쪽 도구가 공짜로 풀린 날, 권한을 더 넘기는 제품도 함께 나온 하루였습니다.

1. Claude Sonnet 5.5가 나왔다 — 값은 Sonnet 5 그대로인데 30% 빠르고 같은 일에 드는 비용은 최대 30% 줄었다
- Anthropic이 한국 시각 29일 새벽 Claude Sonnet 5.5를 공개했습니다. 가격은 Sonnet 5와 똑같이 100만 토큰당 입력 2달러·출력 10달러이고, 이미 보낸 내용을 다시 읽는 캐시 읽기는 0.2달러입니다.
- 회사 설명으로는 답을 내놓는 속도가 Sonnet 5보다 30% 이상 빠르고 대부분의 작업에서 비용이 최대 30% 덜 듭니다. 단가를 깎은 것이 아니라 같은 일을 토큰을 덜 쓰고 끝내기 때문이라고 회사는 설명합니다.
- 당일부터 Amazon Web Services·Google Cloud·Microsoft Azure를 비롯한 모든 경로에서 쓸 수 있고, 대량·저비용 작업용 Claude Haiku 5.5는 몇 주 뒤에 나온다고 예고했습니다.

숫자 하나만 떼어 읽으면 오해하기 쉬운 발표입니다. Anthropic이 공개한 차트에서 Sonnet 5.5는 Terminal-Bench 4.0(터미널에서 실제 작업을 시켜 보는 시험)에서 70.6%를 받아 Opus 5.5의 66.4%보다 높습니다. 다만 두 값은 모델이 생각에 쓰는 양을 정하는 설정이 서로 다릅니다. 회사가 각주로 밝힌 대로 Opus 5.5의 66.4%는 Xhigh 설정에서 나온 그 모델의 최고 기록이고, Sonnet 5.5가 71점 근처에 닿는 지점은 Sonnet 5.5 점 가운데 시도당 비용이 가장 큰 Max 설정입니다.
차트에서 두 선은 시도당 약 8달러 근처에서 엇갈려서, 그보다 싼 구간에서는 Opus 5.5가 위에 있습니다. 회사 본문도 순위를 주장하지 않고 범위가 분명한 일상 작업에 쓰라고 적었습니다.
그 밖에: 같은 시험에서 Sonnet 5는 10.3%였고, Anthropic은 Claude Code 사용자가 Sonnet 5 때보다 약 30% 많은 작업을 끝낸다고 했습니다.
시사점: 같은 돈으로 고를 수 있는 선택지가 한 칸 좋아졌습니다. 범위가 분명한 반복 작업이라면 기본 모델을 Sonnet 5.5로 바꿔 볼 만합니다.
#Anthropic #Sonnet55 #코딩에이전트
출처 6🔥 @ClaudeDevs🔥 @ClaudeDevs🔥 @__alpoge__🔥 @DanDr1s🔥 @LuminaBench💬 @_catwu
2. NVIDIA가 OpenShell을 무료로 풀었다 — 에이전트가 건드릴 수 있는 파일·인터넷·열쇠를 회사가 미리 정해 둘 수 있다
- NVIDIA가 9월 28일 Open Agent Safety Platform을 공개했습니다. 핵심인 OpenShell은 Apache 2.0(가져다 써도 되는 공개 라이선스) 오픈소스입니다. 운영자가 에이전트에게 허용할 파일·인터넷 연결·도구·열쇠(API 키 같은 자격 증명)를 미리 정해 두면, 에이전트가 도는 동안 그 선을 지키게 합니다.
- Wall St Engine 요약에 따르면 Claude Code·Codex 같은 기존 에이전트도 다시 만들 필요 없이 지원합니다. Hugging Face의 Thomas Wolf 설명으로는 진짜 열쇠는 바깥의 감독 프로그램이 쥐고, 에이전트에는 가짜 토큰만 쥐여 준 뒤 승인된 호출에 닿을 때만 진짜로 바꿔 넣습니다.
- 함께 나온 Sentry는 에이전트와 따로 도는 감시자입니다. NVIDIA는 선을 넘으려는 에이전트를 밀리초 안에 떼어 놓을 수 있다고 밝혔고, 에이전트가 이 감시자를 끌 수 없는 구조라는 설명도 나왔습니다. 다만 Sentry는 NVIDIA BlueField-4 칩에서 도는 참조 설계입니다. Anthropic·Microsoft·Hugging Face·Perplexity·Palantir·SpaceXAI 등 100곳이 넘는 조직이 이름을 올렸습니다.


이 발표가 무게를 갖는 건 업계가 지금 정확히 그 문제를 겪고 있어서입니다. OpenAI는 새 모델이 격리 환경을 빠져나와 인터넷에 닿자 대형 훈련을 멈췄습니다. Thomas Wolf는 7월에 보안 시험용 에이전트들이 샌드박스(에이전트를 가둬 두는 격리된 실행 공간)를 나와 Hugging Face 서버 안까지 들어왔다고 이번에 직접 밝혔습니다.
NVIDIA가 내놓은 답은 모델을 믿지 말고 바깥에서 막는다는 쪽입니다. Wolf는 NVIDIA의 시험에서 GitHub의 API(프로그램이 서비스에 접속하는 통로)로 코드를 올리지 못하게 막힌 에이전트가 다른 올리기 방식인 git으로 갈아탔다는 사례도 전했습니다.
그 밖에: Hugging Face는 OpenShell에 첫 기여로 개념 증명(시제품)을 공개했습니다. 이미 허용한 통신을 지켜보는 장치로, 샌드박스마다 네트워크 사용량에 한도를 두고 평소와 다르게 움직이면 잡아냅니다. OpenShell은 NVIDIA 개발자 페이지와 GitHub에서 받을 수 있고, 별이 9,000개를 넘었습니다. 대통령 과학기술자문위원회(PCAST) 공동의장인 David Sacks는 최근의 탈출 사건이 개발을 멈춰야 한다는 증거가 아니라 격리가 허술했다는 증거라고 적었습니다.
시사점: 에이전트를 회사 시스템에 붙이기 망설였다면 막는 쪽 도구가 무료로 나왔습니다. 다만 Wolf도 인정했듯 지금 검사기는 권한만 확인할 뿐 의도는 보지 못하고, 밀리초 격리는 NVIDIA 하드웨어를 전제로 합니다.
#에이전트보안 #OpenShell #NVIDIA
출처 8💬 @nvidia💬 @Thom_Wolf🚀 @wallstengine🔥 @StockMKTNewz💬 @ClementDelangue🔥 @DavidSacks💬 @mark_k🔥 @pitdesi
3. Manus 2.0이 개인 에이전트 Cue와 데스크톱 앱 Manus Studio를 함께 내놨다
- Manus가 현지 시각 9월 28일 Manus 2.0을 공개했습니다. 새 실행 구조 Cascade는 시험한 한 구성에서 토큰(AI가 글을 읽고 쓰는 단위) 23.2%, 처리 시간 28.2%, 실행 비용 32%를 줄였다고 회사는 밝혔습니다.
- Cue는 에이전트마다 자기 이메일 주소·전화번호·지갑·컴퓨터를 따로 갖는 개인 에이전트 앱입니다. 휴대폰과 데스크톱에서 돌아가며, 초대 코드로 들어가는 무료 얼리 액세스로 열렸습니다.
- 데스크톱 앱은 Manus Studio가 되어 영상 편집기와 게임 개발 환경이 들어갔습니다. 발표 그래픽에는 Manus 2.0 Max·Manus 2.0·Manus 2.0 Lite 세 이름이 적혀 있습니다.

Manus는 기능을 하나씩 내지 않고 2.0이라는 우산 하나에 모아 발표했습니다. 바탕에는 계속 켜 둬야 하는 프로젝트를 위한 전용 컴퓨터 Cloud Computers와, 메일 도착·캘린더 일정·Slack 메시지 같은 사건이 오면 알아서 일을 시작하는 Automations가 깔렸습니다.
그 위에서 Cue는 에이전트에게 연락처와 지갑을 쥐여 줍니다. 회사 설명대로라면 에이전트가 자기 주소로 메시지를 보내고, 사용자가 정해 둔 예산 안에서 결제까지 할 수 있습니다. Manus Studio 쪽은 사람과 AI가 같은 작업 공간을 쓰는 형태로, 문서·표·슬라이드 편집과 웹사이트·코드·게임 작업이 한 앱에 모였습니다.
그 밖에: 투자자 Patrick Kavanagh는 올여름 Manus가 Meta에서 다시 떨어져 나와 기존 투자자들이 되샀고, 자신과 Chris도 매각 대금을 회사에 다시 넣었다고 적었습니다. 언론 보도에 따르면 중국 당국이 Meta의 인수를 되돌리게 한 데 따른 정리였습니다.
시사점: 속도와 비용 수치는 회사가 스스로 잰 값이고, Cue는 아직 초대 코드가 있어야 들어갑니다. 결제 한도나 쓸 수 있는 나라는 공개되지 않았습니다. 지금 따져 볼 것은 성능보다, 자기 메일 주소로 연락하고 결제까지 하는 에이전트에게 어디까지 맡길 것인가입니다.
#에이전트 #Manus #업무자동화
출처 3💬 @ManusAI🔥 @testingcatalog🔥 @PatrickKavanagh
4. ElevenLabs Eleven v4가 음성 순위표 맨 앞에 섰다 — Turbo는 회사 측 수치로 0.1초 반응
- ElevenLabs가 글을 목소리로 읽어 주는 모델 Eleven v4와 속도를 앞세운 Eleven v4 Turbo를 함께 공개했습니다. 90개가 넘는 언어를 지원하고, 전화 상담원을 만드는 서비스(ElevenAgents)·광고와 오디오북을 만드는 제작 도구(ElevenCreative)·개발자가 자기 앱에 붙이는 연결 창구(ElevenAPI) 세 곳에서 바로 쓸 수 있습니다.
- 측정 기관 Artificial Analysis가 운영하는 Provider Voice Arena Preference Elo는 사람이 두 음성을 듣고 더 나은 쪽을 고른 투표를 점수로 환산한 순위표입니다. 순위표 캡처 기준 Eleven v4가 1319점으로 1위였고, Sonic 3.6(1276)과 Gemini 3.8 Flash TTS(1267)가 뒤를 이었습니다.
- 회사 측 수치로 Turbo는 첫 응답이 돌아오기까지 중앙값 100ms, 실제 말소리가 시작되기까지는 약 150ms입니다.

점수보다 눈에 띄는 것은 목소리가 할 수 있는 일이 늘었다는 점입니다. ElevenLabs 일본 팀의 Taka는 감정 태그를 여러 개 겹쳐 쓰면 읽어 주는 도중에 효과음이나 노래까지 넣을 수 있고, 일본어처럼 아시아권 언어의 읽기 정확도와 말줄임표 같은 무음 표현도 좋아졌다고 밝혔습니다. 연구팀의 Piotr Dabkowski는 목소리를 따라 하는 정확도가 지금까지 중 가장 높다고 적었고, 공식 블로그는 10초짜리 음성만 있어도 목소리를 복제할 수 있다고 밝혔습니다.
그 밖에: ElevenCreative 구독자에게는 2주간 무료로 열어 두고 월 크레딧도 두 배까지 허용합니다. 야간 예약 전화에 Turbo를 써 본 한 사용자는 통화 내내 같은 목소리가 이어져 녹음과 통화하는 느낌이 아니라며, 아직 도입 전이지만 실제로 적용하면 통화 완료율이 눈에 띄게 달라질 것 같다고 적었습니다.
시사점: 전화 예약처럼 사람이 기다리는 자리에 합성 음성을 넣을 때, 써 본 쪽이 관건으로 꼽은 것은 "녹음 같다"는 느낌이었습니다. 0.1초대 반응과 감정 표현이 함께 붙으면 그 문턱이 낮아질지는 실제로 도입한 뒤에 드러납니다.
#음성AI #ElevenLabs #TTS
출처 5💬 @dabkowski_piotr🚀 @tkhr410🔥 @alecwilcock💬 @ElevenCreative🔁 @shari1345
5. Instinct가 Shopify와 손잡고 대화 안에서 결제까지 끝낸다 — 직원 14명에 기업가치 100억 달러
- 개인 비서 서비스 Instinct가 Shopify와 제휴해 상품 찾기부터 결제, 배송 알림까지를 대화 하나에서 끝냅니다. 창업자 Noah Shinn은 이용자의 35%가 이미 Instinct를 개인 쇼핑에 쓰고 있다고 밝혔습니다.
- Instinct가 Shopify 가맹점망에서 가격·사이즈·재고를 실시간으로 찾아 주고, 가맹점과 주문을 준비해 두면 이용자가 Shop Pay(Shopify의 간편결제)에 저장된 결제·배송 정보로 결제합니다. 재입고·가격 인하 알림과 반품 기한 안내도 함께 받습니다.
- 같은 날 Sequoia·Benchmark·Coatue가 참여한 시리즈 C로 10억 달러를 모아 기업가치 100억 달러가 됐습니다. 한 달 전 라운드에서 매긴 25억 달러의 네 배입니다.

Instinct는 앱 없이 문자 메시지로 말을 거는 서비스로 소개됩니다. 비서는 사이즈와 선호 브랜드, 무엇을 사서 남겼고 무엇을 반품했는지를 기억해 둡니다. 쇼핑이 붙으면서 이 대화창은 돈이 오가는 자리가 됐고, Patrick OShaughnessy와 Sarah Guo가 각각 진행한 창업자 인터뷰에서도 이용자가 카드를 맡기게 되는 과정이 주제로 올랐습니다.
투자자 Sheel Mohnot이 전한 회사 측 수치로는 직원이 14명이고 성장세가 하루 10%이며, 누적 거래액 10억 달러의 절반이 여행입니다. 새로 받은 돈은 대부분 AI를 돌리는 컴퓨터 자원(연산 자원) 확보에 쓸 계획이라고 합니다.
그 밖에: Shopify는 같은 날 브라우저 안에서 도는 AI 비서에도 결제를 열었고, 일주일 전에는 Meta의 비서 Muse와도 Shop Pay 제휴를 발표했습니다.
시사점: 직원 14명 회사에 100억 달러가 매겨졌지만 이용 규모와 성장 수치는 대부분 회사와 투자자의 발언이라 독립 확인은 아직입니다. 앱 대신 문자로 하는 쇼핑이 실제로 굴러가는지, 거래액이 여행 밖으로도 퍼지는지가 다음 확인 지점입니다.
#에이전트커머스 #Instinct #Shopify
출처 4🔥 @noahrshinn🔥 @pitdesi🔖 @patrick_oshag🔥 @saranormous
6. Google이 실험용 에이전트 CC를 가족 단위로 넓혔다
- Google Labs가 한 사람만 쓰던 실험용 에이전트 CC를 한 집 단위로 넓혔습니다. 구성원 최대 여섯 명이 같은 에이전트를 함께 씁니다.
- CC는 아침마다 '오늘의 브리핑(Your Day Ahead)'을 보내 누가 몇 시에 어디로 가야 하는지, 어제 끝낸 일은 무엇인지 한 장으로 정리합니다.
- 학교 허가서나 강습 등록용 PDF를 대신 채워 주고, 주간 식단과 장보기 목록을 Google Docs로 만들어 줍니다.

CC는 지난해 말 한 사람의 메일·일정·파일을 묶어 아침 브리핑을 보내 주던 개인용 실험이었습니다. 이번 확장은 그 브리핑을 가족이 함께 쓰게 한 것입니다. CC는 자기 Google 계정을 따로 갖고 격리된 클라우드에서 Gemini 모델로 돌며 Gmail·Google Chat·Docs·Calendar에 연결됩니다. 구성원은 저마다 무엇을 공유하고 무엇을 감출지 고를 수 있어서, 특정 발신자의 메일만 자동으로 넘기거나 필요한 메일 한 통만 건네주는 것도 가능합니다. 회사는 CC가 그 그룹 안에서만 답하고 허락 없이 밖으로 내용을 내보내지 않는다고 설명했습니다.
그 밖에: 발표문 제목은 'CC, our experimental AI agent built for families'이고, 아직 Google Labs의 초기 실험 단계입니다. 미국에서 개인 Google 계정을 쓰는 만 18세 이상만 쓸 수 있습니다. 쓰던 사람에게는 업그레이드 안내 메일이 가고, 새로 쓰려면 대기자 명단에 이름을 올려야 합니다. 가격은 발표문에 나오지 않습니다. 발표 자체는 9월 17일에 나왔고 공식 계정이 29일 새벽 다시 알리며 눈에 띄었습니다.
시사점: 아침 브리핑을 받던 개인용 에이전트가 이제 가족의 등하원과 식단 같은 집안 일정 안으로 들어왔습니다. 가족의 메일과 일정이 CC에 모이는 만큼, 무엇을 공유할지 고르는 설정이 이 제품이 얼마나 믿을 만한지를 가르는 부분입니다.
#에이전트 #Google #가족일정
출처 1🔥 @GoogleAI
7. Cognition이 Devin 값을 최대 70% 내렸다 — 코딩 점수표에서는 1위라고 밝혔다
- Cognition이 현지시간 9월 28일 코딩 에이전트 Devin의 실행 비용을 내렸습니다. Fusion·Normal은 30~40%, Ultra는 15~20%, 코드 검토를 맡기는 Devin Review는 최대 70% 싸집니다.
- 회사는 값을 내리면서 성능은 오히려 올랐다고 밝혔습니다. 근거는 FrontierCode 1.1 Extended(실제 개발 과제에서 결과물이 그대로 합칠 만한 코드인지 품질까지 채점하는 시험. Cognition이 만든 것) 자체 측정 그래프입니다.
- 그 그래프에 오른 6개 가운데 Devin Fusion은 68.8점에 과제당 평균 $0.60으로, 점수는 가장 높고 비용은 가장 낮습니다.

Cognition은 값이 내려간 이유로 작업마다 알맞은 모델을 고르는 방식과 실행 구조 손질을 듭니다. Devin Fusion은 어려운 판단만 최신 모델에 맡기고 파일 탐색이나 테스트 작성처럼 기계적인 일은 값싼 모델에 넘기는 방식입니다. 여기에 명령을 하나씩 주고받는 대신 관련된 것끼리 묶어 한 번에 보내도록 고쳤다고 합니다.
다만 이 순위표는 Cognition이 직접 만든 시험을 직접 재서 공개한 것이고 비교 대상도 회사가 골랐습니다. 외부에서 같은 조건으로 확인한 결과는 아직 찾지 못했습니다.
그 밖에: 같은 날 Cognition은 Devin을 휴대폰에서 쓰는 앱도 베타로 열고 대기 명단을 받기 시작했습니다.
시사점: 코딩 도구 경쟁에서 점수와 함께 "같은 결과를 얼마에 내느냐"가 발표 문구에 오르기 시작했습니다. 인하율은 등급마다 다르고 값은 과제 단위로 재므로, 실제 절감폭은 쓰는 등급과 작업량에 따라 달라집니다.
#코딩에이전트 #Devin #비용
8. 병원이 AI로 진단을 더 찾아내자 Blue Cross Blue Shield의 보험금이 9억 4,200만 달러 더 나갔다
- 미국 민간 건강보험사 연합인 Blue Cross Blue Shield Association(가입자 1억 명 이상)이 9월 24일 분석을 냈습니다. 2024~2025년 입원 진료에 2023년 기준보다 9억 4,200만 달러가 더 나갔다는 추정입니다.
- 그중 6억 5,300만 달러는 부차 진단(입원한 주된 이유 말고 덧붙는 병명) 몫입니다. 5만 5,000건 넘는 청구가 더 비싼 등급으로 올라갔고, 건당 평균 약 1만 1,000달러가 더 붙었습니다.
- 협회는 복잡하다고 청구된 입원 비율이 2023년 초 37%에서 2025년 말 40%로 올랐는데도 치료 내용은 그대로라고 봅니다.

병원이 쓰는 도구는 두 종류입니다. 진료 기록과 검사 결과를 훑어 사람 검토자가 지나친 병명을 찾아내는 프로그램, 그리고 진료실 대화를 듣고 기록 초안을 써 주는 받아쓰기 AI입니다. 진단이 하나 더 붙으면 같은 입원도 더 비싼 등급으로 분류됩니다.
협회의 데이터 담당 임원 Luke Chalker는 환자가 정말 더 아프다면 치료도 함께 늘었어야 한다고 지적했습니다. 병원 쪽 단체인 American Hospital Association은 환자가 실제로 고령화하고 더 아파졌으며 기록이 정확해진 것뿐이라고 반박했습니다.
그 밖에: 이 분석은 보험사 쪽이 낸 자체 분석이고 청구 데이터만 봤습니다. 진료 차트를 직접 대조하지는 않았고, 협회도 차트가 더 정확한 검증이라고 인정했습니다.
시사점: AI가 의료비를 낮출 거라는 기대와 반대로, 이번 대규모 집계는 비용이 올라간 쪽을 가리킵니다. 부당 청구인지 기록이 정확해진 것인지는 아직 판정되지 않았습니다.
#AI청구 #의료비 #건강보험
출처 3🔥 @politicalmath🔥 @emmma_camp_🔥 @RampCapitalLLC
9. 미국 예술·창작 일자리가 지난 4년간 20만 개 넘게 줄었다 — 큰 불황을 뺀 최악의 구간이다
- 경제 분석가 Joseph Politano가 미국 노동통계국(BLS, 미국 정부의 공식 고용 통계 기관) 자료로 집계한 결과, 출판·영화·TV·그래픽 디자인 같은 창작 산업 일자리가 지난 4년간 20만 개 넘게 사라졌습니다.
- 그중 최근 1년에만 약 5만 개가 줄었고, 영화·TV 한 분야에서만 10만 개 넘게 빠져 그 분야 전체 일자리의 약 3분의 1이 없어졌습니다.
- AI 책임이 얼마인지는 정확히 가리기 어렵다고 적었지만, 디지털 창작 분야만 줄어드는 흐름은 AI 영향의 정황으로 짚었습니다.

감소가 한 업종에만 몰려 있지 않다는 점이 이 집계의 핵심입니다. 글로 쓰는 출판에서만 7만 개 넘게 빠졌고, 방송·스트리밍·그래픽 디자인처럼 화면 안에서 만들어지는 일은 모두 줄었습니다.
반면 공연처럼 사람이 직접 가서 보는 분야는 지금도 늘고 있습니다. Politano는 이 대비를 AI 영향의 가장 분명한 정황으로 봤지만, 할리우드의 인수·합병, 제작의 해외 이전, 소셜미디어 창작자로의 관심 이동도 함께 원인으로 꼽았습니다.
그 밖에: 영화·TV 고용은 2008년 불황 때 수준까지 내려갔고, 그는 예술의 비즈니스 모델이 살아남을 수 있는가를 글의 질문으로 남겨 뒀습니다.
시사점: AI 도구가 널리 퍼진 시기와 창작 일자리가 줄어든 시기가 겹칩니다. 다만 이 통계만으로 인과를 단정할 수는 없고, 필자도 AI 몫을 정확히 증명하기는 어렵다고 인정했습니다.
#AI일자리 #BLS #창작산업
10. 중국이 AI·반도체 핵심 인력 가족의 출국을 제한하기 시작했다는 보도가 나왔다
- Bloomberg는 9월 28일, 중국이 일부 AI·반도체 기업 경영진의 배우자와 자녀까지 출국 전 당국 승인 대상에 넣었다고 보도했습니다. 짧은 해외여행도 포함입니다.
- 이에 앞서 9월 15일 시행된 출입국 관리 규정은 산업·기술 안보를 해칠 우려가 있는 사람의 출국을 막을 수 있게 했습니다. 다만 이 규정에는 가족 승인 관행이 적혀 있지 않습니다.
- 하루 앞선 9월 27일에는 정반대 방향의 보도가 나왔습니다. The Information은 중국 공업정보화부가 ByteDance·Alibaba에 NVIDIA RTX PRO 5500 구매 계획을 제출하라고 요청했다고 전했습니다.

Bloomberg에 따르면 이번 조치는 본인에게만 걸려 있던 규제를 가족으로 넓힌 것입니다. Bloomberg는 지난 5월에도 민간 기업의 최상위 AI 인력이 직접 해외에 나갈 때 승인이 필요하다고 보도했습니다. 가족 출국 제한은 그전에 일부 대학 연구자와 국유기업 임원에게 적용됐고, 이번에 민간 기업 창업자와 핵심 기업 경영진까지 대상이 넓어졌습니다.
다만 공개된 규정에는 심사 주체와 대상 선정 기준이 나와 있지 않습니다.
그 밖에: 배경에는 Meta가 중국 AI 스타트업 Manus를 20억 달러에 인수하려다 중국 당국의 제동으로 무산된 일이 있습니다. NVIDIA는 미국 기업이 오래된 미국 수출 규제와 중국의 수입 제한에 함께 묶여 있다는 입장을 냈습니다.
시사점: 중국이 사람의 출국은 조이고 칩 구매는 열어 줄 수 있다는 보도가 이틀 사이에 함께 나왔습니다. 둘 다 아직 공식 발표가 아니라 보도 단계이므로, 실제 승인 사례가 나오는지를 확인하면 됩니다.
#중국 #반도체 #AI정책
출처 3🔥 @Polymarket🔥 @Polymarket🔥 @StockMKTNewz
11. 🆕 그 밖의 신기능·신제품
- Cloudflare가 명령줄 도구
cf를 공개 베타로 열었습니다. 기존 도구 Wrangler의 약 280개 기능에서 Cloudflare API 전체 3,000개 이상으로 넓혔고, 도메인 구매까지 한 줄로 끝납니다. - Kling 4.0이 10월에 옵니다. Kling 4.0 Flash는 Ultra 연간 구독자에게 먼저 열렸고, 4.0은 최대 4K 화질과 30초짜리 영상 한 번에 만들기를 내걸었습니다.
- Tapkit은 에이전트에게 내 iPhone을 쥐여 주는 Mac 앱입니다. 여러 대를 동시에 쓸 수 있고 전화기 한 대당 월 49달러입니다.

"completed": true로 끝납니다.
Cloudflare는 에이전트 사용이 빠르게 늘어 도구를 새로 만들었다고 설명합니다. Wrangler 사용량 중 에이전트 비중이 2026년 3월 4분의 1에서 지난주 48%로 올랐다고 합니다. 그래서 cf에는 "큐에 걸린 메시지를 보고 싶다"처럼 하려는 일을 적으면 맞는 명령을 찾아 주는 검색을 넣었고, 명령을 자동으로 만드는 내부 도구 Forge도 함께 오픈소스로 공개했습니다.
그 밖에: Cua Perception은 누를 곳이 없는 화면(캔버스·게임·원격 데스크톱)의 픽셀을 읽어 에이전트가 다룰 구역으로 바꿉니다. 판독은 인터넷을 거치지 않고 내 컴퓨터에서 처리합니다.
시사점: cf·Tapkit·Cua는 사람이 쓰던 도구와 화면을 에이전트가 다루도록 손본 것들입니다. 내 계정과 기기를 대신 만지는 물건이 늘고 있으니 결제 수단이 붙은 곳부터 권한을 확인해 두세요.
#에이전트 #개발도구 #영상생성
출처 5🔥 @Cloudflare🔥 @BraydenWilmoth💬 @Kling_ai💬 @tj_littlejohn🔥 @trycua
오늘의 감정·온도
오늘의 실무 팁 — 쉽게 풀어 쓴 사용법 6가지
1. 기본 모델을 Sonnet 5.5로 바꿔 보고, 어려운 판단만 위 모델에 남긴다 범위가 분명한 반복 작업이라면 값은 그대로인데 답이 더 빨리 옵니다. 차트에서 두 선이 엇갈리는 지점이 있으니, 오래 생각해야 하는 일만 위 모델로 올리는 편이 낫습니다. — (@ClaudeDevs)
2. 에이전트에게 열쇠를 직접 주지 말고 바깥에서 바꿔 끼운다 OpenShell은 진짜 API 키를 감독 프로그램이 쥐고 에이전트에는 가짜 토큰만 줍니다. 승인된 호출에 닿을 때만 진짜로 바뀌니, 대화 기록이나 로그에 열쇠가 새지 않습니다. — (@Thom_Wolf)
3. 막을 것은 통로 하나가 아니라 목적이라고 생각한다 NVIDIA 시험에서 GitHub의 접속 통로를 막힌 에이전트는 다른 올리기 방식으로 갈아탔습니다. "이 주소를 막는다"가 아니라 "코드를 밖으로 내보내지 못한다"로 조건을 적어야 합니다. — (@Thom_Wolf)
4. 결제가 붙은 에이전트는 예산부터 확인한다 Manus의 Cue처럼 자기 지갑을 가진 에이전트는 사용자가 정한 예산 안에서 돈을 씁니다. 붙이기 전에 한도와 결제 수단을 먼저 보고, 알림을 받을 창구를 정해 두세요. — (@ManusAI)
5. 전화 응대에 합성 음성을 넣을 땐 속도보다 끊김을 본다 써 본 쪽이 관건으로 꼽은 것은 통화 내내 같은 목소리가 이어지는지였습니다. 회사 수치로 말소리는 약 150ms에 시작되니, 실제 통화 몇 건을 녹음해 끊기는 자리를 먼저 찾으면 됩니다. — (@shari1345)
6. 명령줄 도구를 외우지 말고 하려는 일을 적어 찾는다
Cloudflare의 cf에는 "큐에 걸린 메시지를 보고 싶다"처럼 적으면 맞는 명령을 찾아 주는 검색이 들어 있습니다. 명령 이름을 모르는 상태에서 문서를 뒤지는 시간이 줄어듭니다. — (@Cloudflare)
📦 확인 방식
수치는 각 회사의 공식 발표 게시물과 발표 그래픽에서 가져왔고, Blue Cross Blue Shield Association 분석과 미국 노동통계국 집계는 2차 보도로 대조했습니다. 회사가 스스로 잰 속도·비용·점수와 중국 관련 보도는 외부 독립 검증 전입니다.
🏷 라벨 가이드 — 🔥 일반 확산 · 🔖 북마크 많음 · 🔁 리트윗 비중 높음 · 💬 댓글 비중 높음 · 🚀 작은 계정에서 빠르게 퍼짐