NeoMME는 문서 검색을 위해 VLM을 버리고 단일 멀티모달 인코더로 간다
H Company의 NeoMME는 텍스트 토큰과 원본 이미지 패치를 하나의 양방향 Transformer로 처리하고, dense·late-interaction 검색 표현을 한 번에 내보내며 시각 문서 RAG의 모델...
Tag
H Company의 NeoMME는 텍스트 토큰과 원본 이미지 패치를 하나의 양방향 Transformer로 처리하고, dense·late-interaction 검색 표현을 한 번에 내보내며 시각 문서 RAG의 모델...
Qwen3.8-27B는 27B dense 비전-언어 모델에 기본 thinking, 추론 깊이 제어, 보존형 추론 문맥, 262K 네이티브 컨텍스트와 1M 확장 경로를 묶어 장기 에이전트 작업을 겨냥한 Apache...
Microsoft AI가 Build 2026에서 공개한 7종 MAI 모델은 단일 SOTA 발표보다, 깨끗한 데이터·자체 인프라·제품 통합·Frontier Tuning을 묶은 반복 개선 시스템 선언에 가깝다.
arXiv 2605.20176은 임상 에이전트가 미리 큐레이션된 컨텍스트를 읽는 대신 EHR, 웹 지식, 흉부 X-ray 도구를 직접 호출해 근거를 모으는 ClinSeekAgent와 ClinSeek-Bench,...