๐ ๊ฒ์
"ocr" ๊ฒ์ ๊ฒฐ๊ณผ 3๊ฑด
-
AWS Textract vs Google Vision, ๊ทธ๋ฆฌ๊ณ ๋ ๋ค ๊ฑด๋๋ฐ์ด์ผ ํ ๋
๋ฌธ์ ์ฒ๋ฆฌ ํ์ดํ๋ผ์ธ์ ์ธ OCR(๊ดํ ๋ฌธ์ ์ธ์) ์๋น์ค๋ฅผ ๊ณ ๋ฅด๋ฉด์ ํ ์ฃผ ๋ด๋ด AWS Textract์ Google Vision์ ๋ฒค์น๋งํนํ๋ ๊ฒฝํ์ ๋ด์ ๊ธ์ ๋๋ค. ๋ ํด๋ผ์ฐ๋ OCR ์๋น์ค๋ฅผ ์ค์ ๋ฌธ์๋ก ํ ์คํธํ๋ฉด์ ์ ํ๋์ ์ฒ๋ฆฌ ์๋ ์ฐจ์ด๋ฅผ ์ง์ ๋น๊ตํฉ๋๋ค. ์ฌ๊ธฐ์ ๊ทธ์น์ง ์๊ณ , ์ด๋ค ์ํฉ์์๋ ๋ ๋ค ์ฐ์ง ์๊ณ ๋ค๋ฅธ ๋์์ ํํ๋ ๊ฒ ๋ ๋์ ์ โฆ
-
Baidu, ๋ค๊ตญ์ด OCR ๋ชจ๋ธ 'Unlimited-OCR' ์คํ์์ค ๊ณต๊ฐ โ 63๋ง ๋ค์ด๋ก๋ ๋ํ
๋ฐ์ด๋(Baidu)๊ฐ HuggingFace์ 'Unlimited-OCR'์ด๋ผ๋ ๋ค๊ตญ์ด OCR ๋ชจ๋ธ์ ๊ณต๊ฐํด ๋น ๋ฅด๊ฒ ํธ๋ ๋ฉ์ ์ฌ๋์ต๋๋ค. ๊ณต๊ฐ ์งํ 63๋ง ๊ฑด์ด ๋๋ ๋ค์ด๋ก๋์ 1,569๊ฐ์ ์ข์์๋ฅผ ๊ธฐ๋กํ๋ฉฐ ํญ๋ฐ์ ์ธ ๊ด์ฌ์ ๋ฐ๊ณ ์์ต๋๋ค. vision-language ๊ธฐ๋ฐ์ image-text-to-text ํ์ดํ๋ผ์ธ์ ์ฌ์ฉํ๋ฉฐ, MIT ๋ผ์ด์ ์ค๋ก ๋ฐฐํฌ๋์ดโฆ
-
์๊ฐ ์ธ๊ณ/๊ตญ๋ด ์ฃผ์ ์ฌ๊ฑด ์ข
ํฉ
4์์ ์ด๋-๋ฏธ๊ตญ ๊ฐ๋ฑ์ผ๋ก ์ด๋ฐ๋ ์๋์ง ์๊ธฐ์ ๊ตญ์ ์ง์ ์ฌํธ์ด ์ค์ฌ์ ์ด๋ฃจ์์ผ๋ฉฐ, ์ฐํฌ๋ผ์ด๋์ ๋ํ ๊ตญ์ ์ง์์ด ๊ฐํ๋๋ ํํธ ๋ฏธ๊ตญ ๋ด ๋ฏผ์ฃผ์ฃผ์ ๊ธฐ๋ณธ ๊ฐ์น์ ๋ํ ๋์ ์ด ์ฌํ๋ ์๊ธฐ์ ๋๋ค. ## 1. ํธ๋ฅด๋ฌด์ฆ ํดํ ์๊ธฐ์ ์๋์ง ์์ฅ ์ถฉ๊ฒฉ Trump์ด ์ด๋์ ๋ํ ํด์๋ด์๊ฐ ์๊ฐ์ ์ง์๋ ์ ์๋ค๊ณ ๊ฒฝ๊ณ ํ๋ฉด์ ์ค๋ ์ง์ ํ ๊ธด์ฅ์ด ๊ธ๊ฒฉํ ๊ณ ์กฐ๋์์ต๋๋ค.โฆ