🤖 AI / ML 일간

Baidu, 다국어 OCR 모델 'Unlimited-OCR' 오픈소스 공개 — 63만 다운로드 돌파

바이두(Baidu)가 HuggingFace에 'Unlimited-OCR'이라는 다국어 OCR 모델을 공개해 빠르게 트렌딩에 올랐습니다. 공개 직후 63만 건이 넘는 다운로드와 1,569개의 좋아요를 기록하며 폭발적인 관심을 받고 있습니다. vision-language 기반의 image-text-to-text 파이프라인을 사용하며, MIT 라이선스로 배포되어 상업적 활용도 자유롭습니다. 관련 논문(arxiv:2606.23050)도 함께 공개되어 기술적인 배경을 직접 확인할 수 있습니다. '무제한(Unlimited)'이라는 이름처럼 기존 OCR 모델의 한계를 넘어선 성능을 표방하며, 다국어 지원이 특히 주목받고 있습니다. 문서 처리나 데이터 추출 파이프라인을 구축하는 개발자라면 주목해볼 만한 모델입니다.

키워드

출처

← 리스트로