Apertus 1.5, 이미지·오디오 입력·262,144토큰 컨텍스트·'사고 모드' 추가
스위스의 오픈 모델이 Apache 2.0으로 8B·70B 버전, 262,144토큰 컨텍스트와 함께 공개됐으며, 사용 정책 동의와 연락처 제공이 필요한 다운로드 게이트를 둔다. 도커 이미지 기반 추론 서버나 제공된 파이썬 라이브러리 브랜치로 바로 실행할 수 있다.
한 줄 요약
오픈 가중치의 멀티모달 모델이 실사용 단계로 들어서고, 과학용 에이전트 스킬과 금융 문서 벤치마크가 텍스트를 넘어선 평가 기준을 제시한다.
LLM & SOTA Models
Apertus 1.5: 이미지·오디오·초장문 컨텍스트와 '사고 모드' 추가
Apertus 1.5는 80억·700억 매개변수의 대형 언어 모델(LLM) 계열로, 이제 텍스트에 더해 이미지와 오디오 입력을 받고 대화 문맥을 262,144토큰까지 유지한다. 팀은 8B 모델에 4조 토큰, 70B 모델에 2조 토큰을 추가 사전학습했으며, 지시 준수와 도구 사용을 강화하고, 답변 전 숙고하는 ‘사고 모드(Reasoning)’ 옵션을 도입했다. 프로젝트는 가중치·데이터·훈련 세부를 함께 공개하는 투명한 개발을 표방한다. 1
가중치는 Apache 2.0 라이선스로 제공되지만, 접근은 게이트가 있다. 사용자는 수용 가능한 사용 정책(Acceptable Use Policy, AUP)에 동의하고 이메일·사용자명 등 연락처 제공에 동의해야 하며, 이에 대한 개인정보 처리 방침이 함께 제공된다. 오픈 가중치와 책임 있는 사용 추적 사이의 균형을 택한 셈이다. 1
운영은 vLLM 서버(오픈소스 추론 엔진)나 커스텀 Transformers 브랜치로 할 수 있으며, 상류 프로젝트 통합은 진행 중이다. 문서는 AMD64·ARM64용 도커 이미지를 제공하고, 사고 모드에서는 도구 호출이 비활성화됨을 명시하며, 추론 토큰 예산(오디오는 초당 40토큰)과 그래픽 처리 장치(GPU) 메모리 설정 조정 같은 실무 팁을 안내한다. 1
이번 공개는 ETH Zurich, EPFL, 스위스 국립 슈퍼컴퓨팅 센터(CSCS)가 추진하는 ‘주권형 AI’ 로드맵의 일부다. 주·정부 번역 서비스, 의학 LLM 프레임워크(MeditronFO), 지역 뉴스룸(Bajour) 등 활용 사례가 소개됐고, CSCS는 스위스 학술 커뮤니티를 위한 추론 응용 프로그램 인터페이스(API)도 개시한다. 2
Open Source & Repos
K‑Dense BYOK 0.9.0·과학 에이전트 스킬 확장: 데스크톱 연구 보조
Scientific Agent Skills는 에이전트에 과학 기능을 덧붙이는 라이브러리로, 150개 스킬과 100개+ 과학 데이터베이스를 제공하며 16만 명+ 과학자 사용을 내세운다. v2.55.0 업데이트는 문서 정비와 포맷 정리, 과학 글쓰기 안전장치 재설계, PPTX 포스터 생성 재설계를 포함하며, Cursor·Claude Code·Codex·Google Antigravity 및 오픈 Agent Skills 표준과의 호환을 표기한다. 3
K‑Dense BYOK는 MIT 라이선스의 데스크톱 ‘AI 공동 연구원’ 앱으로 2026-07-24에 v0.9.0을 배포했다. 저장소 배지는 149개 스킬, 326개 워크플로, 229개 데이터베이스 통합을 알리며, 문헌 조사·데이터 질의·포스터 제작 같은 연구 작업의 초기 설정 시간을 줄이는 데 도움이 될 수 있다. 4
Research Papers
FinanceComplexQA: 산업급 금융 문서 에이전트 추론 벤치마크
FinanceComplexQA는 산업 현장 수준의 금융 문서에서 AI 에이전트의 역량을 시험하는 새 벤치마크다. 연구진은 먼저 Finance‑LaTeX SKILL로 전문가급 복잡 레이아웃의 금융 문서 2,000건과 질문·답변 6,000쌍을 합성하고, 1,009개 문서를 대상으로 한 2,026개 심층 연구 과제로 벤치마크를 구성했다. 양언어 지원, 6개 시나리오와 7개 태스크, 전문가 수준 문서 추론 등 특징을 갖춘다. 5
이 벤치마크로 검색 증강 생성(Retrieval‑Augmented Generation, RAG) 시스템과 문서 질의응답 에이전트 도구를 Agent‑as‑a‑Judge와 다중 지표로 평가했다. 그 결과 수치 계산, 다단계(멀티홉) 추론, 내용 요약, 산업 분석 등에서의 실패 양상이 드러나 복잡하고 지저분한 입력에서 에이전트가 어디서 약한지 구체적으로 보여준다. 5
왜 중요한가
Apertus 1.5는 초장문·멀티모달 이해를 투명한 학습 공개와 접근 게이트로 묶어, 감사 가능성과 성능을 함께 요구하는 공공·기업 환경에서의 선택지를 넓힌다. 스위스의 국가 인프라와 CSCS 제공 접근은 오픈 가중치 모델의 대규모 배치를 뒷받침하는 한 방식을 보여준다. 2
동시에 도메인 스킬 라이브러리와 FinanceComplexQA 같은 벤치마크는 과학·금융 업무처럼 현실적 워크플로로 평가를 확장해, 여러 문서와 계산이 얽힌 과제에서도 통하는 도구를 고르는 데 근거를 제공한다. 5
댓글 (0)