ArXiv3 Think Big, Search Small: 검색 에이전트는 메인에 큰 모델, 서브는 작게 (arXiv 2607.07548) 검색형 AI 에이전트를 만들 때 거의 모두가 하는 실수가 있다. 메인 에이전트도 최신 대형 모델, 검색 서브도 같은 대형 모델. "둘 다 비싸니까 성능이 좋겠지"라는 직관이다. 2026년 7월 논문 Think Big, Search Small은 이 직관을 통제 실험으로 정면 반박한다. 결론이 제목에 다 있다. 생각(위임)은 크게, 검색(실행)은 작게.원문: arXiv:2607.07548 문제: 용량을 어디에 써야 하나계층형 검색 에이전트는 보통 이렇게 돈다. 메인이 복잡한 질문을 작은 서브쿼리로 쪼개고, 서브들이 각자 검색해서 보고서를 올린다. 그런데 예산(모델 크기)은 한정돼 있다. 메인에 몰까, 서브에 몰까? 아무도 진지하게 안 따져봤다는 게 이 논문의 출발점이다.일상 비유로: 리서치 팀에 시니어 한 .. 2026. 7. 25. AOrchestra 해설: 서브 에이전트를 (Instruction·Context·Tools·Model)로 즉석 생성하는 법 (2026) 에이전트 시스템을 처음 짜면 대부분 이렇게 한다. "코더 에이전트, 검색 에이전트, 리뷰어 에이전트"를 미리 정의한다. 조직도를 그리듯 역할을 고정하는 것이다. 편하다. 그런데 실제 업무는 조직도대로 오지 않는다. "이번엔 PDF 3개 대조해서 표로 뽑아줘" 같은 게 오면, 어느 상설 부서에도 안 맞는다.AOrchestra(2026)는 이 "상설 부서" 방식을 버린다. 대신 일이 올 때마다 딱 맞는 임시 담당자를 즉석에서 만든다. 그 담당자를 정의하는 공식이 이 논문의 전부다.원문: arXiv:2602.03786 · 코드: FoundationAgents/AOrchestra 한 공식만 기억하면 된다에이전트 = ⟨지시문, 맥락, 도구, 모델⟩(Instruction, Context, Tools, Model) .. 2026. 7. 25. Mixture-of-Agents(MoA) 해설: 같은 모델도 층층이 쌓으면 GPT-4o를 넘는 이유 (arXiv 2406.04692) 질문 하나를 GPT에 던지면 답이 하나 나온다. 그런데 답이 애매할 때, 우리는 보통 다른 모델에도 물어보고 비교한다. 여기서 한 걸음 더 나가면 이런 질문이 된다. "여러 모델의 답을 고르지 말고 합치면 더 좋아지지 않을까?"2024년 Together AI·Duke·Stanford 팀의 Mixture-of-Agents(MoA)가 정확히 이 아이디어다. 그리고 놀랍게도, 오픈소스 모델만 합쳤는데 GPT-4o를 이겼다. 이 글은 "왜 합치면 좋아지는가"의 메커니즘까지 파고든다.원문: arXiv:2406.04692 출발점: LLM의 "협력성"이라는 발견논문의 핵심 관찰은 하나의 실험에서 나온다. 모델 A에게 그냥 답을 시키면 승률이 X다. 그런데 다른 모델들의 답을 같이 보여준 뒤 다시 답하게 하면 승률이 .. 2026. 7. 24. 이전 1 다음