Semantica는 에이전트의 컨텍스트를 ‘감사 가능한 결정 그래프’로 바꾼다
semantica-agi/semantica는 검색용 벡터 인덱스만으로 남기 쉬운 에이전트의 상태·판단·근거를 context graph, provenance, reasoning, policy 계층으로 묶어 질의 가...
Blog
semantica-agi/semantica는 검색용 벡터 인덱스만으로 남기 쉬운 에이전트의 상태·판단·근거를 context graph, provenance, reasoning, policy 계층으로 묶어 질의 가...
HPD-Parsing은 전체 페이지의 읽기 순서는 layout branch가 조정하고, 블록별 내용은 병렬 branch가 생성하게 해 unified 문서 파서의 긴 autoregressive decoding 병목...
Video-DeepResearch는 프레임 선택과 객체 crop 검색을 먼저 수행하게 한 뒤 웹 탐색을 풀어 주는 단계적 tool policy, SFT+GRPO 학습, 그리고 실제 시각 근거를 요구하는 Video...
Knowledge–Geometry Decoupling(KGD)은 스트리밍 추천에서 행동 지식을 계속 갱신하는 encoder와 task별 ranking geometry를 분리한다. BMTP로 noisy next-i...
VideoCoCo는 Blender 코드로 물리 과정의 저해상도 초안을 먼저 실행한 뒤 비디오 편집 모델로 사실적 영상을 만드는 Code-as-CoT 이중 엔진 접근으로, 물리 일관성 비디오 생성의 제어 가능한 중...
Qwen-UI-Agent는 실제 기기 런타임, GUI·CLI 혼합 행동, 100턴 이상 온라인 RL, 능동형 harness를 하나의 폐루프로 묶어 모바일·컴퓨터·웹을 넘나드는 GUI 에이전트를 제안한다.
arXiv 2607.28527의 MANTA는 agent role·통신 link·실행 순서·정보 가시성·검증 경로를 inference-time trace에 맞춰 제한적으로 갱신하는 Multi-Agent Networ...
Moonshot AI의 Kimi K3는 2.8T parameter·104B activated MoE, 1M context, native vision을 내세운 모델이다. 96개 safetensors shard의 f...
Nanbeige4.2-3B는 반복 레이어를 쓰는 Looped Transformer와 실행 환경 기반 SFT·다단계 RL을 결합해 3B non-embedding parameter 안에서 코드 agent, offic...
Experience Distillation(EPD)은 agent가 실제 환경에서 모은 긴 시행착오 기록을 경험 context로 읽는 교사의 다음 결정으로 바꾼 뒤, 새 환경 상호작용이나 world model ro...
SetwiseEvalKit은 relevance·authenticity·quality부터 complementarity·redundancy·conflict, completeness·density·reachabilit...
NVIDIA-labs Object-Oriented Agents(NOOA)는 field를 state, method를 capability, docstring을 prompt, type annotation을 contra...