에이전트가 ‘채팅’에서 ‘실행’으로: OpenAI Astra·Agents API, Meta Muse, Mistral 210억 유로
Astra가 이제 컴퓨터 전반을 다루고, Meta의 Muse는 당신을 대신해 일을 하기 시작했으며, 업종별 도구와 공공부문 할인은 더 빠른 AI 도입을 시사한다—다만 감독은 더 촘촘해진다.
이번 주 한 줄
OpenAI가 컴퓨터 전반을 실제로 다루는 GPT‑6 Astra와 Agents API를 내놨고, Meta는 WhatsApp 안에서 일을 처리해주는 에이전트 Muse를 공개했다. Mistral은 기업가치 210억 유로로 자금을 유치하며, 에이전트가 더 촘촘한 가드레일 아래 ‘실행자’로 전환 중임을 보여줬다.
이번 주 숫자
- 47% — Astra가 OSWorld 2.0 시뮬레이션에서 작업당 소요 시간을 Sol 대비 47% 단축(약 40분 vs 75분). 1
- 210억 유로 — 삼성 주도 라운드에서 Mistral AI의 기업가치. 2
- 155억 달러 — 신규 투자 이후 Harvey의 추정 기업가치. 3
- 83,000 — 9월 10일 기준 Meta의 Muse를 미국 iOS 차트 2위로 끌어올린 다운로드 수. 4
- $0 — OpenAI–GSA 신규 계약에서 해당 미국 공공부문 고객의 1인당 월 라이선스(사용 요금 50% 할인). 5
- 1,000만 달러 — OpenAI의 1만 에이전트 수학 실행(88시간, 약 300만 메시지, 약 1,300억 토큰)의 리스트가 기준 비용 추정치. 6
- 100억 달러 — 블룸버그(로이터 인용) 기준, 엔비디아의 Anthropic IPO 지분 투자 잠재 규모. 7
TOP 뉴스
OpenAI, GPT‑6 Astra 출시: 더 빠른 컴퓨터 사용과 안전장치
OpenAI가 GPT‑6 Astra를 공개했다. 이 모델은 양식 작성, 브라우징, 문서 편집, 코드 실행 등 컴퓨터를 유능한 비서처럼 조작하도록 설계됐으며 ChatGPT Plus, Pro, Business, Enterprise와 API에 순차 제공된다. 보고된 결과에 따르면 Mind2Web에서 1.9배 빠르고, OSWorld 2.0 시뮬레이션에서는 Sol 대비 작업당 시간이 약 47% 줄었으며, 개발·디자인 벤치마크에서도 개선을 보였다. 1
OpenAI는 일반 제공 버전이 고급 공격형 사이버보안 작업을 차단하며, Stargate 사이트에서 학습에 투입된 GPU가 100,000대를 넘었고 자율 안전 프레임워크 하에서 미국 정부 검토를 받았다고 밝혔다. 팀 입장에선 실제 소프트웨어에서 보수적 기본값과 함께 엔드투엔드로 작업을 끝내는 능력이 핵심 포인트다. 8
Meta, WhatsApp 안에서 일해주는 에이전트 ‘Muse’ 공개… 보안 VM 탑재
Meta가 Muse를 선보였다. 이 에이전트는 이메일, 캘린더, 결제, 스마트홈, 쇼핑 등 일상 앱과 연결돼 iOS·Android·웹·WhatsApp 전반의 채팅 인터페이스에서 메시지 전송, 여행 예약, 양식 작성, 결제까지 처리한다. Meta는 사용자별 Secure VM과 행동을 거르는 Sentinel 승인 에이전트를 내세워, 일 처리 기능을 일상에서 ‘안심하고’ 쓰게 하는 것을 목표로 한다. 9
앱은 무료로 체험할 수 있고, 유료 티어로 월 20달러와 100달러가 보도됐다; 작업 승인과 Stripe의 Link가 내장되었고, 최대 30만 달러의 공개 버그 바운티도 제공되어 격리와 오남용 저항이 1순위 기능임을 시사한다. 초기 채택은 빠른 편으로, Sensor Tower 데이터에 따르면 9월 10일 미국 iOS에서 다운로드 약 83,000건으로 Muse가 2위에 올랐다. 10
Mistral, 삼성 주도로 35억 달러 조달… 기업가치 210억 유로
블룸버그에 따르면 Mistral AI가 35억 달러를 조달하며 기업가치 210억 유로를 인정받아, 설립 3년 차 프랑스 기업이 유럽에서 가장 가치 있는 AI 벤더 반열에 올랐다. 이번 라운드에는 반도체 운영에 모델을 적용하고 특수 칩을 설계하는 데 관한 삼성과의 전략적 파트너십이 포함됐다. 2
애널리스트들은 이를 유럽의 ‘주권형 AI’ 드라이브와 연결한다: Mistral은 스웨덴 데이터센터에 14억 달러를 약정하고 파리를 위한 8.3억 달러의 부채를 조달했으며, 지역 통제를 원하는 엔터프라이즈를 겨냥해 인프라·모델·툴을 묶어 제공하려 한다. 11
OpenAI, 금융업 전용 ChatGPT 출시… 데이터 번들까지
OpenAI가 은행·투자사를 위한 ChatGPT Work 섹터 에디션을 공개했다. Daloopa, PitchBook, LSEG News, Crunchbase 등 프리미엄 데이터셋과 Astra 기반 추론을 번들로 제공하고 모건스탠리·에버코어와 함께 다듬었으며, 표나 본문 단위에서 숫자 출처를 추적하는 세밀 인용과 엑셀·워드·파워포인트용 사내 템플릿 지원도 추가했다. 12
OfficeQA Pro 테스트에서 OpenAI는 Astra 69.9%, GPT‑5.6 Sol 60.2%라고 보고했고; 로이터는 이번 출시를 애널리스트의 일상 워크플로를 겨냥한 타깃형 공세로 해석했다. 13
OpenAI, 클라우드 지속 에이전트용 Agents API(퍼블릭 베타) 공개
Agents API는 팀이 컨텍스트, 툴, 파일, 수일에 걸친 실행을 관리하는 장기 실행형 클라우드 에이전트를 OpenAI 샌드박스 또는 자체 인프라에서 구축하고, 토큰·툴 사용분만 비용을 내도록 해준다. 컨텍스트 압축, 툴 검색과 프로그래매틱 툴 호출(Model Context Protocol, MCP 포함), 복잡 과제를 위한 병렬 서브에이전트 기능을 포함한다. 14
초기 사용자는 구체적 개선을 보고했다: SafetyKit은 케이스당 비용을 60% 절감했고, Hypha는 실패한 에이전트 응답이 86% 감소했으며, Ciridae는 점수가 0.71에서 0.85로 오르고 지연은 4배 낮아졌고, Dwelly는 버스트 트래픽에서도 성능이 더 안정적이었다고 밝혔다. 14
Harvey, 기업가치 155억 달러… Guardrails AI 인수
로이터에 따르면 법률 AI 기업 Harvey가 신규 투자로 기업가치 155억 달러에 도달했다. The Next Web은 5.5억 달러 조달, 3,000곳 이상 고객, 연간 반복 매출(ARR) 4억 달러 이상, 그리고 자율 에이전트 워크플로 강화 목적의 Guardrails AI 인수까지 더해졌다고 전했다. 3
전략 노트에는 가능한 한 저렴하면서도 적합한 모델로 작업을 라우팅하고, 사내 문서로 파인튜닝하는 방식이 포함된다. 경쟁은 공급업체 플러그인과 수직 특화 플레이어 전반에 걸쳐 전개되며, 바이어에게는 거버넌스·평가 레이어가 이제 제품의 일부라는 신호다. 15
OpenAI와 GSA, 미 공공부문에 사용자당 $0 라이선스와 사용료 50% 할인 제공
OpenAI와 미국 연방총무청(GSA)이 다년 계약을 발표했다: 2026년 10월 1일부터 2028년 12월 31일까지, 해당 연방·주·지방·부족 정부 대상 1인당 월 라이선스 $0(통상 $15)와 사용 요금 50% 할인을 제공한다. 사이버 수비대 지원도 확대된다. 5
OpenAI Academy는 온보딩, 지출 제어, 웨비나, 학습 리소스를 안내했으며, 2026년 9월 14일 정보 세션이 예정돼 있다. 낮아진 초기 비용은 명확한 거버넌스 하에서 일상 행정업무의 제한적 파일럿을 가능하게 한다. 16
Nvidia, Anthropic IPO에 최대 100억 달러 지분 투자 검토
로이터는 엔비디아가 Anthropic의 예정된 IPO에 투자 협상을 진행 중이라고 전하며, 선도 칩 공급사와 프런티어 랩 간 유대가 강화되고 있음을 시사한다. 17
블룸버그(로이터 인용)는 잠재 지분을 최대 100억 달러로 추산한다—컴퓨트 접근과 자본이 소수에 집중되며, 하위 고객의 속도 제한과 가격 체계에까지 파급될 수 있음을 시사한다. 7
OpenAI, 1만 개 에이전트를 수학 주장에 동원
뉴욕타임스는 OpenAI가 Navier–Stokes 관련 밀레니엄 문제의 일부 요소에 수천 개의 AI 에이전트를 조정했다고 보도했으며, 클레이 수학연구소의 독립 검증은 대기 중이다. 18
운영 디테일: 약 10,000개 봇이 약 88시간 동안 가동되며 약 300만 개 메시지와 약 1,300억 토큰을 교환했고, 리스트가 기준 비용은 약 1,000만 달러로 추정된다—학계 연구와의 중복 논란도 일었다. 팀 입장에선 대규모 에이전트 오케스트레이션의 잠재력과 비용 모두를 시사한다. 6
OpenAI, AI 정책 창이 닫히고 있다고 발언
OpenAI는 의무적·역량 기반의 국가 안전 규정을 옹호하고, 독립 평가·감사자 기준·청소년 보호·바이오시큐리티를 다루는 캘리포니아 4개 법안을 지지하며, 안전장치가 부족할 경우 개발을 늦추거나 중단하겠다는 정책 에세이를 발표했다. 구매자와 빌더에게는 더 엄격한 모니터링과 공시 규범을 예고한다. 19
로이터 요약은 국가 표준 수립 요구를 강조하며, 모델이 고위험 과제를 맡는 만큼 위험 통제를 제도화해야 한다는 압력이 커지고 있음을 반영한다. 8
이번 주 트렌드 분석
에이전트 제품이 ‘대화’에서 ‘실행’으로 선을 넘었다. OpenAI의 Astra는 컴퓨터 사용 작업에서 47%의 속도 개선과 웹 워크플로 1.9배 향상을 보고했고, 신규 Agents API는 장기 실행·툴 활용 자동화를 정식화했다. Meta의 Muse는 승인 가드를 얹은 ‘대신 해줘’ 패턴을 소비자 앱에 들여와, 일상 소프트웨어에서의 엔드투엔드 위임 확대를 예고한다. 14
엔터프라이즈 패키징이 가속했다. 금융 특화 ChatGPT 에디션은 라이선스 데이터, 인용, 사내 템플릿을 번들링했고, Harvey의 투자와 가드레일 인수는 바이어가 이제 ‘거버넌스+역량’을 함께 요구함을 보여준다. ‘주권형 AI’ 기치 아래의 Mistral 자금 조달은 지역 통제와 인프라까지 아우르는 메뉴를 추가—단일 모델이 아니라 완성 스택을 제안한다. 12
안전과 감시가 의제 상단으로 올라왔다. OpenAI의 정책 에세이는 의무적·역량 기반 규정과 더 강한 궤적 모니터링을 지지하고, 최근 공적 사건이 격리·공시의 빈틈을 드러냈음을 상기시킨다. 팀에겐 감사 로그, 승인, 인시던트 대응 훅이 정확도와 함께 기본 요구사항이 되어가고 있음을 뜻한다. 19
자본과 컴퓨트는 더 집중됐다. Anthropic IPO에 대한 엔비디아의 수십억 달러 규모 잠재 투자와, OpenAI의 100,000대 이상 GPU 학습은 칩·자본 접근이 프런티어 시스템을 누가 내놓고 어떤 서비스 레벨을 제공하느냐를 좌우하는 시장을 시사한다. 조달 과정에서 가격과 속도 제한이 핵심 쟁점이 될 전망이다. 7
주목할 포인트
- 모니터러빌리티(Monitorability) — 모델 업데이트에서 이 용어가 보이면, 모델의 추론·단계를 사람이 얼마나 잘 들여다볼 수 있는지를 뜻한다. 모니터러빌리티가 저하되면 감독 난도가 급격히 높아진다. 20
- 모델 컨텍스트 프로토콜(MCP) — OpenAI의 Agents API에 더 많은 툴·플랫폼이 붙어 프로그래매틱 툴 호출과 장기 세션을 지원하는지 지켜볼 것. 14
- 컨피덴셜 VM(Confidential VM) — Meta가 Muse에 사용자 키 기반 신뢰 실행 옵션을 예고했다. 실제 도입되면 결제·개인정보 연동 ‘일 처리’ 에이전트의 격리를 한층 강화한다. 10
이번 주 오픈소스
- Bernstein — 선언적 정책과 전체 액션 영수증을 갖춘 에이전트 거버넌스·오케스트레이션. 기본값으로 승인·감사가 필요한 팀에 유용. sipyourdrink-ltd/bernstein
- LiteLLM — 100여 개 모델 API를 표준화 호출하는 경량 게이트웨이; 비용 추적, 가드레일, 서명된 Docker 이미지 제공. 멀티 벤더 호출을 표준화하려는 팀에 적합. BerriAI/litellm
- vLLM 0.29.0 — 고처리량·메모리 효율 LLM 서빙; Model Runner V2가 기본이 되었고 KV 캐시 자동 사이징 지원. 프로덕션 챗·에이전트 워크로드에 적합. vllm-project/vllm
- OpenBot — 각 AI ‘동료’에게 실브라우저가 있는 격리된 컴퓨터를 제공하고, 사전 승인·액션 로그를 기본 제공. 추적 가능한 에이전트 액션이 필요한 팀을 겨냥. CopilotKit/OpenBot
댓글 (0)