Loading
Agentforce и Einstein Generative AI
Ограничения модели большого языка

Ограничения модели большого языка

Ознакомьтесь с ограничениями для поддерживаемых широкоязычных моделей (LLM) от нескольких поставщиков встроенных функций, например, Конструктора подсказок. Ограничения для каждой модели включают запросы в минуту и ограничения маркеров.

Ограничение отправки данных

Существует ограничение по частоте 2000 запросов создания LLM в минуту (RPM) на организацию. Однако, в зависимости от использования модели и доступной нагрузки от поставщиков модели, ограничение оборотов может меняться в зависимости от модели. Ограничение оборотов на организацию для отдельных моделей см. в разделе «Ограничения моделей под управлением Salesforce».

Для безопасных сред ограничение по частоте по умолчанию составляет 500 запросов создания в минуту на организацию.

Ограничения модели под управлением Salesforce

Данная таблица содержит ограничения для моделей под управлением Salesforce, доступные для встроенных функций, например, Конструктор подсказок.

Поставщик модели Семья модели Максимальное количество запросов в минуту (RPM) Максимальное количество маркеров в минуту (TPM)1 Максимальное количество маркеров ввода Максимальное количество маркеров вывода
Бедрок (Амазонка) Нова-Лите 500 3 миллиона 300 000 5 000
Бедрок (Амазонка) Nova Pro 500 3 миллиона 300 000 5 000
Бедрок (Антропика) Клод Хайку 4,5 250 3 миллиона 200000 64,000
Бедрок (Антропика) Клод Опус 4.5 1 000 4 миллиона 200000 8,192
Бедрок (Антропика) Клод Опус 4.6 1 000 4 миллиона 1 000 000 128,000
Бедрок (Антропика) Клод Опус 4.7 1 000 4 миллиона 1 000 000 128,000
Бедрок (Антропика) Клод Опус 4.8 1 000 4 миллиона 1 000 000 128,000
Бедрок (Антропика) Клод Сонет 4.5 1 000 4 миллиона 200000 64,000
Бедрок (Антропика) Сонет, Клод 1 000 4 миллиона 200000 64,000
Бедрок (Антропика) Клод Сонет 5 1 000 4 миллиона 200000 64,000
Бедрок (NVIDIA) Nemotron 3 Nano 30B (бета-версия) 1 000 5 миллионов 256,000 8,192
Бедрок (NVIDIA) Nemotron 3 Super 120B (бета-версия) 1 000 5 миллионов 256,000 32 000
OpenAI и Azure OpenAI GPT-4o (GPT 4 Omni) 2 000 10 миллионов 128,000 16,384
OpenAI GPT-4o Mini 1 000 5 миллионов 128,000 16,384
OpenAI и Azure OpenAI GPT-4o-mini (GPT 4 Omni Mini) 1 000 5 миллионов 128,000 16,384
OpenAI и Azure OpenAI GPT-4.1 2 000 10 миллионов 128,000 32,768
OpenAI и Azure OpenAI GPT-4.1 Mini 500 2 миллиона 128,000 32,768
OpenAI и Azure OpenAI GPT-5 500 2 миллиона 272,000 128,000
OpenAI и Azure OpenAI GPT-5 Mini 500 2 миллиона 272,000 128,000
OpenAI и Azure OpenAI GPT 5.1 300 2 миллиона 272,000 128,000
OpenAI и Azure OpenAI GPT 5.2 300 2 миллиона 272,000 128,000
OpenAI и Azure OpenAI GPT 5.4 250 2 миллиона 1,050,000 128,000
OpenAI и Azure OpenAI GPT 5.4 Mini 250 2 миллиона 400 000 128,000
OpenAI и Azure OpenAI GPT 5,5 250 2 миллиона 1,050,000 128,000
OpenAI и Azure OpenAI GPT 5.6 Luna 5 000 5 миллионов 1,050,000 128,000
OpenAI и Azure OpenAI GPT 5.6 Terra 5 000 5 миллионов 1,050,000 128,000
OpenAI и Azure OpenAI GPT 5.6 Sol 5 000 5 миллионов 1,050,000 128,000
OpenAI и Azure OpenAI O3 500 2 миллиона 200000 100 000
OpenAI и Azure OpenAI O4 Mini 500 2 миллиона 200000 100 000
Вертикальный искусственный интеллект (Google) Вспышка Gemini 2.5 250 2 миллиона 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Близнецы 2.5 Flash Lite 250 2 миллиона 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Близнецы 2,5 Pro 250 1 миллион 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Вспышка Gemini 3 (бета-версия) 100 2 миллиона 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Близнецы 3 Pro (бета-версия) 50 1 миллион 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Близнецы 3.1 Flash Lite 100 2 миллиона 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Gemini 3.1 Pro (бета-версия) 50 1 миллион 1,048,576 65,536
Вертикальный искусственный интеллект (Google) Вспышка Gemini 3.5 1 000 2 миллиона 1,048,576 65,536

1Максимальное количество маркеров в минуту (TPM) определяется суммой маркеров ввода и вывода.

Ограничение маркера маскировки данных

Когда маскировка данных включена в слое Einstein Trust, все модели в настоящее время ограничены размером контекста 65 536 маркеров. Чтобы выключить маскировку данных и использовать полное контекстное окно, см. Настройка Einstein Trust Layer.

 
Загрузка
Salesforce Help | Article