Você está aqui:
Roteamento com conhecimento geográfico para OpenAI e Azure OpenAI
Um modelo sensível a geografia, como o GPT 4.1, usa OpenAI ou Azure OpenAI para atender solicitações de LLM. O mesmo modelo subjacente é usado por OpenAI e Azure OpenAI.
Edições obrigatórias
| Disponível em: Edições Enterprise, Performance e Unlimited com um complemento Einstein para vendas, Einstein para plataforma, Einstein para serviço, Einstein 1 Service ou Einstein GPT Service. Para comprar complementos, entre em contato com seu executivo de conta do Salesforce. |
As solicitações nos Estados Unidos são atendidas nos Estados Unidos pela OpenAI e, em alguns casos, pelo Azure OpenAI. As solicitações fora dos Estados Unidos são encaminhadas para um ponto de extremidade do Azure OpenAI com suporte mais próximo do local em que sua instância da plataforma de IA generativa do Einstein está localizada.
GPT 4.1
Esta tabela mostra o roteamento com conhecimento geográfico para solicitações para o GPT 4.1. Cada modelo com conhecimento geográfico tem seu próprio conjunto de regiões de modelo em que os pontos de extremidade do modelo são implementados. Modelos que não o GPT 4.1 podem não ter pontos de extremidade de modelo em todas as regiões listadas na tabela. Para obter mais informações sobre cada modelo, consulte Suporte para modelo de idioma grande.
As colunas são:
- Região da organização do Salesforce: A região em que uma organização do Salesforce está hospedada
- Região do ponto final do modelo primário: A região principal para o ponto de extremidade do Azure OpenAI
- Regiões do ponto de extremidade do modelo secundário: Os pontos de extremidade secundários do modelo na região em que as solicitações de modelo serão tentadas novamente se o ponto de extremidade do modelo primário não responder. Se os pontos de extremidade primários e secundários não são responsivos, a solicitação volta para o Azure OpenAI nos Estados Unidos. Se a solicitação falhar em cada ponto de extremidade de modelo primário e secundário e os pontos de extremidade de modelo nos Estados Unidos, será retornado um erro. Consulte a seção Desabilitar fallback para os Estados Unidos após a tabela.
| Região da organização do Salesforce | Região do ponto de extremidade do modelo principal | Regiões do ponto de extremidade do modelo secundário |
|---|---|---|
| Austrália | Austrália | Nenhum |
| Brasil | Brasil | Nenhum |
| Canadá | Canadá | Nenhum |
| França | França |
|
| Alemanha | Alemanha |
|
| Índia | Índia | Nenhum |
| Indonésia | Austrália | Nenhum |
| Itália | Itália |
|
| Japão | Japão | Nenhum |
| Coreia do Sul | Japão | Nenhum |
| Cingapura | Cingapura | Nenhum |
| Suécia | Suécia |
|
| Suíça | Suécia |
|
| Reino Unido | Reino Unido | Nenhum |
| Estados Unidos | Estados Unidos | Nenhum |
Desabilitar fallback para os Estados Unidos
Antes de desabilitar o fallback final para os Estados Unidos, você deve ativar o Data 360. O Data 360 é provisionado automaticamente assim que uma licença do Data Cloud é adicionada à sua organização do Salesforce. Consulte Ativar o Data 360.
Para desabilitar o fallback final para os Estados Unidos, acesse Configuração do Einstein e desative Fallback de região do provedor de modelo. Em vez de voltar para os Estados Unidos, um erro é retornado. As solicitações ainda são tentadas nos pontos de extremidade do modelo primário e secundário antes de um erro ser retornado.
Processamento em lote
Para gerar de modo assíncrono grandes quantidades de respostas para modelos de prompts, você pode usar o processamento em lote de modelos de prompts. Esses modelos oferecem suporte a um ponto de extremidade global para processamento em lote nativo pelo Azure OpenAI.
- GPT 4 Omni
- GPT 4 Omni Mini
- GPT 4.1
Para esses modelos com pontos de extremidade globais, as solicitações em lote podem ser processadas em regiões fora da região da sua organização, mesmo que as solicitações de LLM não em lote estejam restritas a pontos de extremidade do Azure específicos na região. O processamento em lote não segue regras de roteamento com conhecimento geográfico e não fornece imposição na região.
Para obter mais informações sobre processamento em lote, consulte Processamento em lote de solicitação de modelo no Apex no Guia do desenvolvedor do Agentforce.
