jina-ocr-v1은 OCR 품질보다 ‘문서 한 페이지를 얼마나 싸게 끝낼지’...
jina-ocr-v1은 DeepSeek-OCR의 압축형 vision encoder와 3B MoE decoder 위에 FastMTP speculative decoding과 dense verifiable reward...
Tag
jina-ocr-v1은 DeepSeek-OCR의 압축형 vision encoder와 3B MoE decoder 위에 FastMTP speculative decoding과 dense verifiable reward...
EviRank는 멀티모달 이미지 질의를 Required·Forbidden·Ignore 제약으로 분해하고, 후보가 각 조건을 충족하는지 검증해 재정렬하는 training-free 접근이다.
Frederik vom Lehn의 DeepSeek-OCR fully visualised와 DeepSeek 공식 논문·GitHub·Hugging Face 자료를 함께 읽어, Gundam 모드, SAM/CNN/CLI...