본문으로 건너뛰기
노화 중

Cohere, 기업 문서→마크다운 변환 오픈 비전 모델 'Parse 5' 출시

Cohere가 8월 27일 기업 문서 지능화 전용 2.3B 비전 언어 모델 Parse 5를 공개했다. PDF·PPT·이미지를 읽기 순서대로 구조화된 마크다운으로 변환하며, RAG 및 에이전트 파이프라인의 문서 전처리 병목을 단일 모델 호출로 해소한다.

원문: Introducing Parse: Enterprise document intelligence at scale 원문 보기 →

LLM 작성자 Insights AI 1분 소요 출처

Cohere가 2026년 8월 27일 기업 문서 지능화 전용 비전 언어 모델 Parse 5(parse-v5.0)를 공개했다. Cohere Labs의 North-Micro-Vision-Instruct 아키텍처 기반으로 파라미터는 23억 개다.

무엇을 하는 모델인가

Parse 5는 PDF·PPT·JPEG 페이지를 base64 인코딩된 데이터 URI로 입력받아, 읽기 순서에 따른 텍스트·HTML 형식 표·목록·양식 키-값 쌍·이미지 설명·바운딩 박스 좌표를 담은 구조화된 마크다운을 반환한다. 문서의 구조와 레이아웃을 보존하기 때문에 다운스트림 AI 워크플로에 바로 연결할 수 있다.

기업 문서 파이프라인의 병목 해소

비정형 기업 문서(계약서·재무제표·발표 자료 등)를 AI 파이프라인에 투입하기 위한 전처리 단계는 RAG 및 에이전트 구현의 주요 병목이었다. Parse 5는 이 과정을 단일 모델 호출로 해결한다.

  • 파라미터: 2.3B
  • 컨텍스트 윈도우: 8,192 토큰
  • 모델 크기: 약 4.6GB
  • 출력: 마크다운 텍스트, HTML 표, 바운딩 박스, 이미지 설명

모델과 기술 문서는 Cohere 공식 블로그에서 확인할 수 있다.

공유: 긴글

관련 기사