제01권 · 제10호 데일리 디스패치 2026년 7월 23일

최신 AI 뉴스 모음집

AI · 논문데일리 큐레이션공개 아카이브
AI 뉴스Business
약 10분

오픈AI, 기업용 에이전트 운영 플랫폼 ‘Presence’ 출시

Presence는 정책·가드레일·평가를 묶어 음성·채팅 에이전트가 승인된 업무를 수행하도록 돕는다. 구글은 Gemini 비용을 낮추고, 중국 Moonshot은 공개 가중치 성능을 끌어올리며 ‘통제된·비용 의식적’ AI로의 이동을 보여준다.

읽기 모드

한 줄 요약

오픈AI가 통제·평가를 내장한 Presence로 기업용 에이전트를 본운영 단계로 끌어올리고, 구글은 Gemini 비용을 낮추며, 중국 Moonshot은 공개 가중치 성능을 끌어올려 ‘실전 도입과 비용 최적화’ 흐름이 뚜렷해졌다.

Big Tech

Google Gemini 3.6 Flash 등: 효율형 모델 3종 공개

구글은 속도와 비용을 겨냥한 세 가지 업데이트를 발표했다. 3.6 Flash(효율), 3.5 Flash‑Lite(초고속), 3.5 Flash Cyber(보안 특화)이며, 지연된 3.5 Pro는 여전히 테스트 중이고 차세대 Gemini 4의 사전 학습이 진행 중이다. 1

3.6 Flash는 3.5 Flash 대비 출력 토큰 사용량을 약 17% 줄이고, 코딩(DeepSWE 49% 대 37%)과 컴퓨터 사용(OSWorld 83% 대 78.4%) 성능을 끌어올렸다. API 비용은 입력 백만 토큰당 1.50달러, 출력 백만 토큰당 7.50달러로 낮아졌다. Flash‑Lite는 초당 350토큰을 목표로 하며 입력 백만 토큰당 0.30달러, 출력 백만 토큰당 2.50달러다. 1

접근 경로는 단계적이다. 3.6 Flash는 API와 Gemini 앱으로 배포가 시작되고, 3.5 Flash‑Lite는 개발자·Gemini 앱에서 사용 가능하며 구글 검색에도 적용된다. Flash Cyber는 정부와 신뢰 파트너를 대상으로 CodeMender 에이전트를 통한 제한적 파일럿으로 제공된다. 2

Industry & Biz

Moonshot Kimi K3: 2.8조 파라미터 공개 가중치 모델

Kimi 챗봇으로 알려진 Moonshot AI가 2.8조 파라미터와 100만 토큰 컨텍스트 윈도우를 가진 K3를 공개했다. 회사는 세계 최대 공개 가중치 모델이라고 주장하며 미국 선도 모델과의 격차 축소를 강조한다. 로이터는 중국의 AI 추격 가속 흐름 속에 나온 발표로 해석한다. 3

공식 문서에 따르면 K3는 Kimi Delta Attention과 Attention Residuals, 희소한 전문가 혼합(MoE, 896개 중 16개 활성)을 적용했으며, 전체 가중치는 2026년 7월 27일까지 공개 예정이다. 문서는 비전 입력, 장기 코딩, 지식 업무 시나리오를 지원한다고 설명한다. 4

독립 보도는 K3가 최상위 미국 모델에는 전반 성능에서 여전히 뒤처진다고 전하면서도, 일부 코딩·에이전트 벤치마크에서 두각을 보였다고 전한다. 7월 16일 기준 Arena의 Frontend Code Arena에서 1위를 기록했다는 보도가 나왔다. 5

Glow: AI 시대 엔드포인트 보안 스타트업 데뷔

메타·스노우플레이크 출신이 창업한 Glow가 12억 달러 가치로 1.8억 달러 시리즈 A를 유치하고 공개됐다. 이 회사는 기업 단말을 매핑하고 AI 에이전트·개발 도구를 통제해 위험 소프트웨어가 노트북·서버에 들어오기 전 정책을 집행하는 엔드포인트 보안 플랫폼을 개발한다. 투자자는 Sequoia, Cyberstarts, Greenoaks, Redpoint 등이다. 6

공격자가 생성형 AI로 자동화하는 상황을 고려해, 사후 탐지보다 사전 차단을 내세운다. 초기 도입(고객사 비공개)에서 악성 npm 패키지 차단, 누락된 엔드포인트 방어 도구 탐지 등의 사례를 제시했고, Anthropic·구글 모델을 Amazon Bedrock을 통해 오케스트레이션한다고 밝혔다. 6

New Tools

OpenAI Presence: 통제 가능한 기업형 에이전트 출시

Presence는 고객 지원·영업·고위험 내부 업무 등에서 실시간 음성·채팅 에이전트를 본운영할 수 있게 하는 오픈AI의 엔터프라이즈 제품이다. 정책·가드레일·시뮬레이션·평가를 묶어 에이전트가 승인된 조치를 수행하고 필요 시 사람에게 이관하도록 설계됐으며, 오픈AI 현장 배치 엔지니어(FDE)와 일부 통합 파트너가 이끄는 제한적 일반 제공 형태로 제공된다. 7

각 도입은 특정 업무(예: 결제 이슈 해결, IT 티켓 처리)로 시작하고, 에이전트는 그 업무에 필요한 지식과 시스템 접근만 받는다. 기업은 독자적 수행 범위, 승인 필요 조건, 사람 이관 시점을 규정한다. 출시 후에는 운영 세션과 이관 데이터가 개선 루프로 들어가고, Codex가 제안한 업데이트를 테스트·점진 배포한다. 7

오픈AI는 1‑888‑GPT‑0090 영어 전화 지원 채널에 Presence를 적용해 인바운드 이슈의 75%를 무인 처리했고, 10일간 사람 이관을 15%p 줄였다고 밝혔다. BBVA, SoftBank, IAG도 같은 기반의 적용을 검토 중이다. 7

Presence는 오픈AI 모델을 중심에 두되, 가드레일·툴·워크플로 일부에 타사 모델·서비스(API)를 연결할 수 있다고 회사 대변인은 밝혔다. 가격과 계약 조건은 공개되지 않았고, 셀프서브 제품은 아니다. 8

커뮤니티 반응

Hacker News (59↑) — 음성 에이전트의 프라이버시와 안전성, 그리고 출시 시점에 대한 우려가 제기됐다. 9

"이러한 배포가 최종 사용자에게 어떤 프라이버시 보장을 제공하나요? 샌프란시스코의 바나 라스베이거스의 컨시어지에 전화하면 음성 채팅 에이전트를 받는 경우가 많습니다. 동의하는 서비스 약관도 없어요. 전체적으로 보면 OpenAI 쪽에는 꽤 풍부한 데이터셋이 쌓입니다. 당신의 음성, 질의, 개인 식별 정보(PII)는 어떻게 되나요?" — Hacker News 9

"지금이 새 제품을 출시하기에 정말 최선의 타이밍인지 궁금하네요. 언론에 에이전트가 '탈주했다'고 난리가 난 상황에서 기업 고객이 왜 OpenAI 솔루션을 선택하겠습니까?" — Hacker News 9

나에게 주는 의미

Presence는 파일럿 데모에서 통제 가능한 본운영으로 옮겨가는 패키지형 접근이다. 다만 제한적 일반 제공이며 셀프서브가 아니므로 컨설팅형 도입으로 간주해야 한다. 가치가 큰 한 가지 워크플로를 골라 정책과 이관 규칙을 먼저 정의하고, 측정 가능한 방식으로 출시 계획을 세우는 것이 현실적이다. 7

AI 토큰 비용이 큰 조직이라면 Gemini 3.6 Flash와 3.5 Flash‑Lite가 실용적 대안이 될 수 있다. 3.6은 일반 작업에서 출력 토큰을 약 17% 줄이고, 출력 토큰 단가도 낮췄다. Flash‑Lite는 초당 350토큰 속도를 제공한다. 콘텐츠 제작, 지원 답변, 에이전트 핸드오프 등에서 비용·품질 균형을 실제 테스트로 확인해 볼 만하다. 1

모델 선택을 고민한다면 공개 가중치 흐름도 주목할 필요가 있다. Kimi K3의 가중치는 7월 27일 공개 예정이라 사내 또는 파트너 호스팅 테스트가 가능해진다(정책 허용 시). 규제 산업이라면 중국 공개 가중치 모델 테스트 전에 컴플라이언스 입장을 명확히 해야 한다. 4

보안 측면에서는 에이전트와 개발 도구가 이제 엔드포인트에 자리 잡았다고 보는 게 안전하다. Glow를 바로 도입하지 않더라도, 어떤 에이전트·도구가 직원 단말에서 실행 가능한지 목록화하고 승인 체계와 엔드포인트 커버리지를 점검한 뒤 자동화를 늘리는 것이 순서다. 6

지금 할 일

  1. OpenAI Presence 브리핑 요청: OpenAI 영업 담당에 연락해 결제 이슈나 IT 티켓 등 한 개 워크플로를 대상으로 제한적 GA 배포 가능성을 검토하고, 필요한 정책·이관 기준을 목록화한다.
  2. 에이전트 파일럿 SOP 작성: 에이전트가 따라야 할 2쪽 분량 표준 운영 절차를 만들고, 툴 권한·데이터 소스·사람 이관 기준을 포함한다.
  3. Gemini 3.6 Flash vs. 3.5 Flash‑Lite 비교 테스트: Gemini 앱 또는 Google AI Studio에서 상위 5개 프롬프트를 실행해 속도, 토큰 사용량, 출력 품질을 비교한다.
  4. Kimi K3 문서 컴플라이언스 검토: 허용된다면 K3 퀵스타트와 아키텍처를 훑어보고, 가중치 공개 후 소규모 샌드박스 테스트 계획을 수립한다.
  5. 30분 엔드포인트 AI 점검: IT/보안팀과 직원 노트북에 설치 가능한 AI 에이전트·npm 패키지·개발 도구를 목록화하고 승인 공백과 EDR 커버리지 누락을 확인한다.

출처 12

도움이 되었나요?

댓글 (0)