Вы находитесь здесь:
Ограничения модели большого языка
Ознакомьтесь с ограничениями для поддерживаемых широкоязычных моделей (LLM) от нескольких поставщиков встроенных функций, например, Конструктора подсказок. Ограничения для каждой модели включают запросы в минуту и ограничения маркеров.
Ограничение отправки данных
Существует ограничение по частоте 2000 запросов создания LLM в минуту (RPM) на организацию. Однако, в зависимости от использования модели и доступной нагрузки от поставщиков модели, ограничение оборотов может меняться в зависимости от модели. Ограничение оборотов на организацию для отдельных моделей см. в разделе «Ограничения моделей под управлением Salesforce».
Для безопасных сред ограничение по частоте по умолчанию составляет 500 запросов создания в минуту на организацию.
Ограничения модели под управлением Salesforce
Данная таблица содержит ограничения для моделей под управлением Salesforce, доступные для встроенных функций, например, Конструктор подсказок.
| Поставщик модели | Семья модели | Максимальное количество запросов в минуту (RPM) | Максимальное количество маркеров в минуту (TPM)1 | Максимальное количество маркеров ввода | Максимальное количество маркеров вывода |
|---|---|---|---|---|---|
| Бедрок (Амазонка) | Нова-Лите | 500 | 3 миллиона | 300 000 | 5 000 |
| Бедрок (Амазонка) | Nova Pro | 500 | 3 миллиона | 300 000 | 5 000 |
| Бедрок (Антропика) | Клод Хайку 4,5 | 250 | 3 миллиона | 200000 | 64,000 |
| Бедрок (Антропика) | Клод Опус 4.5 | 1 000 | 4 миллиона | 200000 | 8,192 |
| Бедрок (Антропика) | Клод Опус 4.6 | 1 000 | 4 миллиона | 1 000 000 | 128,000 |
| Бедрок (Антропика) | Клод Опус 4.7 | 1 000 | 4 миллиона | 1 000 000 | 128,000 |
| Бедрок (Антропика) | Клод Опус 4.8 | 1 000 | 4 миллиона | 1 000 000 | 128,000 |
| Бедрок (Антропика) | Клод Сонет 4.5 | 1 000 | 4 миллиона | 200000 | 64,000 |
| Бедрок (Антропика) | Сонет, Клод | 1 000 | 4 миллиона | 200000 | 64,000 |
| Бедрок (Антропика) | Клод Сонет 5 | 1 000 | 4 миллиона | 200000 | 64,000 |
| Бедрок (NVIDIA) | Nemotron 3 Nano 30B (бета-версия) | 1 000 | 5 миллионов | 256,000 | 8,192 |
| Бедрок (NVIDIA) | Nemotron 3 Super 120B (бета-версия) | 1 000 | 5 миллионов | 256,000 | 32 000 |
| OpenAI и Azure OpenAI | GPT-4o (GPT 4 Omni) | 2 000 | 10 миллионов | 128,000 | 16,384 |
| OpenAI | GPT-4o Mini | 1 000 | 5 миллионов | 128,000 | 16,384 |
| OpenAI и Azure OpenAI | GPT-4o-mini (GPT 4 Omni Mini) | 1 000 | 5 миллионов | 128,000 | 16,384 |
| OpenAI и Azure OpenAI | GPT-4.1 | 2 000 | 10 миллионов | 128,000 | 32,768 |
| OpenAI и Azure OpenAI | GPT-4.1 Mini | 500 | 2 миллиона | 128,000 | 32,768 |
| OpenAI и Azure OpenAI | GPT-5 | 500 | 2 миллиона | 272,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT-5 Mini | 500 | 2 миллиона | 272,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.1 | 300 | 2 миллиона | 272,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.2 | 300 | 2 миллиона | 272,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.4 | 250 | 2 миллиона | 1,050,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.4 Mini | 250 | 2 миллиона | 400 000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5,5 | 250 | 2 миллиона | 1,050,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.6 Luna | 5 000 | 5 миллионов | 1,050,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.6 Terra | 5 000 | 5 миллионов | 1,050,000 | 128,000 |
| OpenAI и Azure OpenAI | GPT 5.6 Sol | 5 000 | 5 миллионов | 1,050,000 | 128,000 |
| OpenAI и Azure OpenAI | O3 | 500 | 2 миллиона | 200000 | 100 000 |
| OpenAI и Azure OpenAI | O4 Mini | 500 | 2 миллиона | 200000 | 100 000 |
| Вертикальный искусственный интеллект (Google) | Вспышка Gemini 2.5 | 250 | 2 миллиона | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Близнецы 2.5 Flash Lite | 250 | 2 миллиона | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Близнецы 2,5 Pro | 250 | 1 миллион | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Вспышка Gemini 3 (бета-версия) | 100 | 2 миллиона | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Близнецы 3 Pro (бета-версия) | 50 | 1 миллион | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Близнецы 3.1 Flash Lite | 100 | 2 миллиона | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Gemini 3.1 Pro (бета-версия) | 50 | 1 миллион | 1,048,576 | 65,536 |
| Вертикальный искусственный интеллект (Google) | Вспышка Gemini 3.5 | 1 000 | 2 миллиона | 1,048,576 | 65,536 |
1Максимальное количество маркеров в минуту (TPM) определяется суммой маркеров ввода и вывода.
Ограничение маркера маскировки данных
Когда маскировка данных включена в слое Einstein Trust, все модели в настоящее время ограничены размером контекста 65 536 маркеров. Чтобы выключить маскировку данных и использовать полное контекстное окно, см. Настройка Einstein Trust Layer.
