Qwen3.8-27B는 27B 모델을 에이전트 실행의 운영 계약으로 확장한다
Qwen3.8-27B는 27B dense 비전-언어 모델에 기본 thinking, 추론 깊이 제어, 보존형 추론 문맥, 262K 네이티브 컨텍스트와 1M 확장 경로를 묶어 장기 에이전트 작업을 겨냥한 Apache-2.0 오픈 웨이트 릴리스다.
Blog
Qwen3.8-27B는 27B dense 비전-언어 모델에 기본 thinking, 추론 깊이 제어, 보존형 추론 문맥, 262K 네이티브 컨텍스트와 1M 확장 경로를 묶어 장기 에이전트 작업을 겨냥한 Apache-2.0 오픈 웨이트 릴리스다.
AI4AI는 강한 builder model이 5% validation set에서 약한 target model용 inference-time harness를 반복 제작·검증하게 해, parameter update 없...
SkillZip은 커지는 agent skill library에서 반복되는 절차를 section-level graph와 reversible macro로 압축하되, 입력·출력·의존성·verifier·source ex...
Spark-to-Paper는 코딩 어시스턴트 안에서 13개 스킬을 조합해 아이디어·문헌·실험·그림·LaTeX 조립을 연결하고, 관측되지 않은 결과를 비워 두며 실패한 가설을 종료하는 연구 논문 생성 워크플로를 제...
Motif 3는 314B total·13.2B activated MoE, 256K context, GDLA와 MOPD를 결합해 큰 희소 모델의 용량을 도구 사용·코드·장문 추론 전문성으로 통합하려는 공개 모델 릴...
U-OPSD는 여러 on-policy rollout의 합의를 pseudo-solution으로 만들고, 그 합의와 갈린 trajectory에만 token-level distillation을 적용해 ground tr...
Better Harnesses, Smaller Models는 작은 언어 모델의 실패 trajectory를 진단해 context·tools·agent loop를 자동 적응시키고, 반복 업무에서 frontier LL...
Relevance-Based Embeddings는 query와 item을 소수 support 집합에 대한 heavy-ranker relevance 벡터로 표현하고, CUR 또는 경량 신경 변환으로 별도 embed...
WorldClaw는 자연어 장면 요청을 구조화된 계획, 전역 지형, 지역별 편집 가능한 3D 객체로 분해하고 render-guided refinement로 다시 검증하는 agentic 3D 오픈 월드 생성 프레임...
OneDayAgent는 open-ended everyday task를 bounded subtask, execution memory, global verify/repair로 관리하는 long-horizon harn...
Skill²-Bench와 Skill-Entropy RL은 긴 reasoning chain에서 모델이 앞 단계의 기술을 관성적으로 재사용하지 않고 다음 단계에 맞는 skill로 전환하는 능력을 측정하고 훈련하는 프...
GDPevo는 기업 업무의 숨은 business rule을 train task에 분산하고 held-out test에서 재조합하는 rule hybridization으로, agent의 persistent skill이...
arXiv 2608.05000은 언어·시각 이해·시각 생성을 하나의 모델에 함께 사전학습할 때의 지식 흐름, 용량 경쟁, 조기 통합, 데이터 비율을 통제 실험으로 분해해 실무적인 설계 규칙으로 연결한다.