하위 에이전트에 대한 AI 모델 선택
에이전트의 각 부분에 적합한 AI 모델을 선택하여 응답 속도, 정확성, 추론 깊이의 균형을 맞춥니다.
필수 Edition
| 지원 제품: Lightning Experience |
| 지원 제품: Enterprise, Performance, Unlimited및 Developer Edition 필수 추가 기능 라이센스는 에이전트 유형에 따라 다릅니다. |
| 필요한 사용자 권한 | |
|---|---|
| AI 에이전트 관리 AND 에이전트 유형에 대한 필수 권한 | |
모델 재정의 작동 방식
하위 에이전트의 특정 작업이 다른 속도와 추론 깊이의 균형을 누릴 수 있는 경우 모델 재정의를 사용합니다.
하위 에이전트가 실행되면 Agentforce 다음 순서로 사용할 모델을 결정합니다.
- 하위 에이전트에 선택된 모델 집합
- 에이전트에 대한 모델 집합
- 설정에서 선택된 모델입니다. 기본적으로 모든 에이전트는 Einstein 감사, 분석 및 모니터링 설정 페이지에 지정된 모델을 사용합니다. 기본 모델을 변경하려면 Agentforce 모델 옵션 선택을 참조하십시오.
예를 들어 설정의 기본 모델이 GPT-4.1이고 에이전트의 모델이 설정되지 않았으며 일반 FAQ 하위 에이전트에서 Google Gemini 2.5 Flash를 선택한다고 가정합니다. Agentforce 일반 FAQ 하위 에이전트를 실행할 때 Google Gemini 2.5 Flash를 사용하지만 기타 모든 하위 에이전트에는 GPT-4.1을 사용합니다.
모델 재정의는 작업에서 프롬프트 템플릿이 사용하는 모델에 영향을 미치지 않습니다.
하위 에이전트의 모델 선택
하위 에이전트가 사용하는 모델은 지침을 준수하는 신뢰도, 응답 속도, 복잡한 과업을 얼마나 잘 처리하는지에 영향을 미칩니다. 모델을 선택할 때 다음 요소를 고려하십시오.
- 모델의 컨텍스트 창에 따라 한 세션에서 모델이 처리할 수 있는 양이 결정됩니다. 컨텍스트 창이 작으면 이전 대화 전환을 추적하지 못하거나 장기 상호 작용에서 명령을 삭제할 수 있습니다.
- 소형 모델은 더 빠르지만 부정확한 정보를 생성하고 복잡한 지침을 잘못 해석하거나 잘못된 구조 출력을 생성할 가능성이 높습니다. 또한 더 명확한 질문을 하거나 작은 토론을 추가하는 경향이 있습니다.
- 하위 에이전트가 텍스트만 처리하는 경우 텍스트 전용 모델은 다중 모달 모델보다 빠릅니다.
| 하위 에이전트의 직무 | 모델 지침 |
|---|---|
| 간단한 라우팅 또는 분류 | 하위 에이전트 분류에 최적화된 Salesforce 모델 또는 유사한 작은 모델인 HyperClassifier 모델을 사용합니다. 자세한 내용은 하위 에이전트 분류 및 라우팅을 참조하십시오. |
| 레코드 조회 또는 간단한 과업 수행 | 지침을 신뢰할 수 있게 따르고 올바른 작업을 호출하는 작은 모델을 사용합니다. |
| 복잡한 추론, 다단계 분석 또는 긴 양식 생성 | 강력한 추론 기능이 있는 대규모 모델을 사용합니다. |
| 구조화된 출력 | 구조화된 출력을 신뢰할 수 있게 처리하는 대규모 모델을 사용합니다. |
| 이미지 또는 문서 처리 | 멀티모델 지원 모델을 사용합니다. 사용 가능한 모델 목록은 대형 언어 모델 멀티모델 지원을 참조하십시오. |
사용 가능한 모델 및 기능 목록은 지원되는 모델을 참조하십시오. Einstein Trust 계층은 모든 모델 통화에 적용됩니다.
미리 보기 패널 및 테스트 센터에서 하위 에이전트의 성과를 테스트합니다.
- 다른 모델과 동일한 대화를 실행하고 응답 품질, 직속성, 속도를 비교합니다.
- 능숙한 모델로 시작하여 기준선을 설정합니다. 작은 모델을 사용하여 비즈니스 요구를 충족하는 최소 모델을 찾습니다.
- 가장자리 사례를 테스트합니다. 모델은 모호하거나 불완전한 메시지를 다르게 처리합니다.
고려 사항
- 모델 재정의는 새 Agentforce 빌더에서 생성된 에이전트에 대해서만 사용할 수 있습니다.
- 모델 사용 중지에 대한 자세한 내용은 모델 사용 중지 및 다시 라우팅 준비를 참조하십시오.
이 기사를 통해 문제를 해결했습니까?
개선을 위한 의견을 보내주세요.
