반응형

https://arxiv.org/abs/2607.21461

2026.7.24
[AREX: Towards a Recursively Self-Improving Agent for Deep Research]

이 자료는 베이징 인공지능 연구원(BAAI)이 개발한 심층 연구용 에이전트 AREX의 기술적 성과와 구조를 설명하고 있습니다. AREX는 복잡한 제약 조건을 만족해야 하는 연구 과제에서 검색보다 검증이 쉽다는 비대칭성에 주목하여, 도출된 답변을 스스로 비판하고 부족한 부분을 다시 탐색하는 재귀적 자기 개선 프레임워크를 채택했습니다. 시스템은 증거를 수집하는 내부 연구 루프와 결과의 신뢰도를 평가해 보완 방향을 결정하는 외부 개선 루프로 구성되며, 긴 탐색 과정에서 핵심 정보를 압축해 유지하는 자율 문맥 업데이트 도구를 통해 효율성을 극대화했습니다. 벤치마크 결과 AREX는 학습 시 주요 결정 단계에 가중치를 두는 훈련 방식 덕분에 적은 매개변수로도 대규모 모델들과 대등하거나 이를 능가하는 우수한 심층 추론 및 도구 활용 능력을 입증했습니다.

 

 

 

728x90
반응형
Posted by Mr. Slumber
,