반응형
반응형
LIST
「Figure 3, Zhang et al., arXiv:2609.18094」 Every scored contribution on a log bpb axis; first-day statistical priors deliver almost the whole reduction.오늘 읽은 논문Agora: Git as Shared Memory for Collective AutoResearchYifan Zhang · Yunheng Zou · Shaokun Zhang · Jian Hu · Hao Zhang · Binfeng Xu · Jan Kautz · Yi Dong (NVIDIA), arXiv:2609.18094, 2026-09-16.여러 연구 에이전트가 같은 과제를 나눠 돌리면, 세션이 끝날 때마다 「무엇이 시도..
「Figure 1, Li et al., arXiv:2609.06702」 Comparison between ParSer and sequential memory methods. Scatter–gather parallel reading vs sequential memory chain.오늘 읽은 논문PARSER: Read in Parallel, Reason in Depth for Long-Context LLM AgentsKun Li · Zexuan Qiu · Tianhua Zhang · Irwin King · Helen Meng (The Chinese University of Hong Kong), arXiv:2609.06702, 2026-09-06. 프로젝트: https://cuhk-parser.github.i..
「Figure 1, Nijkamp et al., arXiv:2609.19519」 The long-horizon setting. Each threshold along the horizon is where a resource runs out.며칠·몇 주짜리 일을 언어 모델 에이전트에 맡기는 말이 늘었습니다. 운영 장애 대응이나 연구 프로그램처럼, 한 번의 컨텍스트 창이나 한 프로세스보다 긴 과제입니다. 그런데 배포된 에이전트는 여전히 에피소드 안에서 멈추는 경우가 많습니다. 창이 끝나면 다음 시작과 기억은 사람에게 돌아갑니다.2026년 9월 17일 arXiv에 오른 An Architecture for Long-Horizon Agents: Levels, Ticks and Cascaded Intelligence..
테스트 타임에 추론을 키우는 흔한 방법은 두 갈래입니다. 하나는 단계별·계획·수정을 외부에서 박아 넣는 스크립트이고, 다른 하나는 샘플·가지·경로를 넓혀 후보를 쌓는 탐색입니다. 둘 다 「밖에서」 추론을 조종합니다.2026년 9월 13일 arXiv에 오른 State of Thought Enables Endogenous Reasoning(arXiv:2609.16055)는 그 축을 뒤집습니다. Zhiren Gong·Yikun Hou·Zihao Zeng·Ming Xiao·Chau Yuen·Wei Yang Bryan Lim(NTU·KTH)은 모델 내부의 동역학·기하 상태를 읽어, 지금 상태에 맞는 과거 증거만 켜고 멈출 시점도 상태로 정합니다. 백본은 얼린 채 582파라미터 컨트롤러만 둡니다.답을 먼저 말하면,..