CAP 기술 문서
에이전트 운영 구조와 배포 사양
파이프라인, 지식, 도구, 모델 라우팅, 보안 구조와 셀프호스트 권장 사양을 구현 담당자 관점에서 확인합니다.
조직이 필요한 모든 에이전트를 한 자리에서.
단일 워크플로우로 데이터 수집부터 검증까지: 사용자는 결과만 받습니다.
비주얼 파이프라인 디자이너
노코드로 단계별 파이프라인을 구성하고, 단계마다 LLM·도구·검증을 다르게 지정합니다.
Knowledge Hub · 6 소스
PDF·URL·FAQ·이메일·SNS·SaaS를 자동 임베딩하고 RAG로 답변에 반영합니다.
166+ 도구 · MCP 호환
Slack·Gmail·Calendar·Browser·Sandbox 등 외부 도구를 함수 호출로 즉시 실행합니다.
Multi-LLM Router
OpenAI·Anthropic·Google·Local 모델을 단계별로 골라 비용·속도·품질을 동시에 최적화합니다.
옴니채널 배포
웹 위젯·API·SNS 봇·모바일까지 같은 에이전트를 10+ 채널에 동시에 배포합니다.
엔터프라이즈 보안
PII 암호화·암호화 검색 인덱스·SSO·테넌트 격리·감사 로그를 기본 제공합니다.
5단계 파이프라인이 하나의 답변을 만듭니다.
각 단계는 독립적으로 모델·도구·검증을 갖고, 전체 트레이스가 감사 로그로 남습니다.
단계마다 다른 LLM을 쓰고, 검증 단계에서 룰 위반 시 자동으로 재시도합니다.
셀프 호스팅 스택
Docker 컴포즈 한 파일로 단일 호스트부터 멀티 노드까지 똑같이 운영합니다.
- 문서 임베딩CPU
- 음성 인식CPU
- 음성 합성CPU
- 영상 처리CPU
- 객체 검출CPU
- 이미지 생성
- 영상 생성
- 음악 생성
- 음성 생성
- 아바타 생성
- 상용 LLM API
- 자체 호스팅 LLM
- 로컬 추론 서버
| 등급 | vCPU | 메모리 | 디스크 | 비고 |
|---|---|---|---|---|
최소 | 4 vCPU | 16 GB | 50 GB SSD | 소규모 PoC, 동시 사용자 ~10명 |
권장 (Standard)권장 | 4 vCPU | 16 GB | 100 GB SSD | 동시 사용자 ~50명, be×1 + 전체 워커 |
대규모 (Large) | 8 vCPU | 32 GB | 200 GB SSD | 동시 사용자 ~200명, be×2 + 모든 워커 |
HA (멀티 노드) | 4 vCPU ×2 | 16 GB ×2 | 외부 데이터베이스 | 로드밸런서 + 외부 DB, 200+ 동시 사용자 |
- 최소
- vCPU
- 4 vCPU
- 메모리
- 16 GB
- 디스크
- 50 GB SSD
소규모 PoC, 동시 사용자 ~10명
- 권장 (Standard)권장
- vCPU
- 4 vCPU
- 메모리
- 16 GB
- 디스크
- 100 GB SSD
동시 사용자 ~50명, be×1 + 전체 워커
- 대규모 (Large)
- vCPU
- 8 vCPU
- 메모리
- 32 GB
- 디스크
- 200 GB SSD
동시 사용자 ~200명, be×2 + 모든 워커
- HA (멀티 노드)
- vCPU
- 4 vCPU ×2
- 메모리
- 16 GB ×2
- 디스크
- 외부 데이터베이스
로드밸런서 + 외부 DB, 200+ 동시 사용자
- 외부 LLM API · 외부 GPU 워커는 셀프호스팅이든 상용 API든 어느 쪽으로도 연결합니다.
- 외부 LLM API 호출량에 따라 트래픽 비용이 추가될 수 있습니다.
- GPU는 선택 사항입니다. CPU만으로 권장 사양에서 동작합니다.
이미 일하는 방식이 곧 에이전트의 워크플로우.
팀별로 자주 반복하는 업무를 같은 플랫폼에서 에이전트로 운영합니다.
사내 IT 헬프데스크
문서·티켓·코드 RAG로 1차 답변을 자동화하고, 미해결 건만 사람에게 라우팅합니다.
마케팅 콘텐츠 운영
캠페인 분석·카피 생성·SNS 발행을 에이전트 하나가 단계별 LLM으로 처리합니다.
고객 상담 어시스턴트
옴니채널로 들어온 문의를 같은 페르소나로 응답하고, 상담사 에스컬레이션을 지원합니다.
영업 리서치 / 제안
기업 데이터 + 사내 사례 RAG로 제안서 초안을 만들고 PDF로 출력합니다.