Amazon Bedrock

  • Цены на модели
  • Цены на модели

    Цены зависят от формы предоставления, поставщика и модели. Выберите поставщика модели, чтобы увидеть подробные цены.

    Amazon Bedrock поддерживает множество уровней, включая уровни Standard, Flex, Priority и Reserved. Нажмите, чтобы узнать больше об уровнях обслуживания.

    Amazon Bedrock представляет избранные базовые модели (FM) от ведущих поставщиков решений на базе искусственного интеллекта, таких как Anthropic, Meta, Mistral AI и Amazon, для пакетного вывода по цене на 50 % ниже стоимости вывода по запросу. Чтобы узнать больше о пакетном выводе, нажмите здесь. Ознакомьтесь со списком моделей здесь:

    • AI21 Labs
    • AI21 Labs

      Тарификация вывода по запросу

    • Amazon
      • Amazon Nova
      • Amazon Nova

        Цены на модели понимания

        Межрегиональный вывод

        Географический, внутрирегиональный и межрегиональный вывод

        Встроенные инструменты

        Цены на модели генерации креативного контента

        Цена за секунду сгенерированного видео Amazon Nova Reel720p, 24 кадра в секунду{priceOf!bedrock/bedrock!3QJl9oQmWgdOgxfZPLt_cggAvCJkJZG3-F913fcGjfc!opt} " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">

        Цены на модели распознавания и генерации речи

        Тарификация вывода по запросу для базовых моделей преобразования речи в речь

        Примечание. *Цены на входные и выходные текстовые токены применяются к определённым сценариям использования, таким как транскрибация речи в текст, вызовы инструментов для выполнения задач или получения данных из базы знаний, добавление истории диалога в сеанс и т. д. 

        Стоимость вывода по запросу для пользовательских моделей Nova такая же, как и для базовых моделей Nova.

        Цены на модели встраивания

      • Amazon Titan
      • Amazon Titan

        документации по Генератору изображений Titan.

        " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">
      • Другие модели Amazon
      • Другие модели AmazonЦена Amazon-rerank-v1.0{priceOf!bedrock/bedrock!lCmRnze6dXKPa-Tm8cwVBOROuTxOHzb1yjUhE-3flng!*!1000} за 1000 запросов**

        ** С вас взимается плата за количество запросов, в каждом из которых может содержаться до 100 фрагментов документа. Если запрос содержит более 100 фрагментов документа, он засчитывается как несколько запросов. Например, если запрос содержит 350 документов, он будет обработан как 4 запроса. Обратите внимание, что каждый документ может содержать не более 512 токенов (включая запрос и общее количество токенов документа), а если длина токена превышает 512 токенов, он разбивается на несколько документов.

        " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">
    • Anthropic
    • **Модели, не имеющие статуса общедоступной версии (Non-GA): доступ к Claude Mythos 5 и предварительной версии Claude Mythos предоставляется с ограничениями и требует одобрения. Обратитесь в отдел по работе с клиентами Anthropic, чтобы запросить доступ к Bedrock.

      Anthropic

      Тарификация вывода по запросу и пакетного вывода

      Модели с расширенным доступом

      Поставщик Название модели Регионы Цена за 1 млн входных токенов Цена за 1 млн выходных токенов Цена за 1 млн входных токенов (пакет) Цена за 1 млн выходных токенов (пакет) Цена за 1 млн входных токенов (запись в кэш) Цена за 1 млн входных токенов (чтение из кэша)
       Anthropic  Claude 3.5 Sonnet (расширенный публичный доступ, с 1 декабря 2025 г.) Восток США (Северная Вирджиния), Восток США (Огайо), Запад США (Орегон), Европа (Франкфурт), Европа (Ирландия), Европа (Цюрих), Европа (Париж) 6,00 USD 30,00 USD 3,00 USD 15,00 USD Н/П н/п
      Anthropic  Claude 3.5 Sonnet v2 (расширенный публичный доступ, с 1 декабря 2025 г.) Восток США (Северная Вирджиния), Восток США (Огайо), Запад США (Орегон) 6,00 USD 30,00 USD 3,00 USD 15,00 USD 7,50 USD 0,60 USD

      Цены для зарезервированного уровня

      Вывод с оптимизированными показателями задержки

      Оплата за выделенную пропускную способность

      Для получения информации о ценах на выделенную пропускную способность обратитесь в отдел по работе с клиентами.

    • Cohere
    • Cohere

      Тарификация вывода по запросу

      Модели Cohere Цена за 1000 запросов**
      Rerank 3.5 2,00 USD
      ** С вас взимается плата за количество запросов, в каждом из которых может содержаться до 100 фрагментов документа. Если запрос содержит более 100 фрагментов документа, он засчитывается как несколько запросов. Например, если запрос содержит 350 документов, он будет обработан как 4 запроса. Обратите внимание, что каждый документ может содержать не более 500 токенов (включая запрос и общее количество токенов документа), а если длина токена превышает 512 токенов, он разбивается на несколько документов.

      * Общее количество обученных токенов = количество токенов в корпусе обучающих данных Х количество эпох

      Оплата за выделенную пропускную способность

      Модели Cohere Цена за час работы за модель 
      без подписки
      Цена за час за элемент модели по подписке на 1 месяц

      Цена за час за элемент модели по подписке на 6 месяцев

      Cohere Command

      49,50 USD

      39,60 USD

      23,77 USD

      Cohere Command – Light 8,56 USD

      6,85 USD

      4,11 USD
      Embed 3 (на английском языке) 7,12 USD

      6,76 USD

      6,41 USD
      Embed 3 (многоязычная версия) 7,12 USD

      6,76 USD

      6,41 USD

      Чтобы получить более подробную информацию о моделях, перейдите на свой аккаунт AWS или обратитесь в отдел продаж. 

    • DeepSeek
    • DeepSeek

      Тарификация вывода по запросу

      • Стандартный
      • Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели DeepSeek Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        DeepSeek v3.2 0,62 USD 1,85 USD

        Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Южная Америка (Сан-Паулу), Азиатско-Тихоокеанский регион (Джакарта), Азиатско-Тихоокеанский регион (Токио) и Европа (Стокгольм)

        Модели DeepSeek Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        DeepSeek v3.2 0,74 USD 2,22 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели DeepSeek Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        DeepSeek v3.1 0,5974 USD 1,7304 USD
        DeepSeek v3.2 0,6386 USD 1,9055 USD
      • Priority
      • Регион: Азиатско-Тихоокеанский (Сидней)

        Модели DeepSeek Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        DeepSeek v3.1 1,0455 USD 3,0282 USD
      • Flex
      • Регион: Азиатско-Тихоокеанский (Сидней)

        Модели DeepSeek Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        DeepSeek v3.1 0,2987 USD 0,8652 USD
    • Google
    • Google

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 4 31B 0,14 USD 0,40 USD
      Gemma 4 26B A4B 0,13 USD 0,40 USD
      Gemma 4 E2B 0,04 USD 0,08 USD
      Gemma 3 4B 0,04 USD 0,08 USD
      Gemma 3 12B 0,09 USD 0,29 USD
      Gemma 3 27B 0,23 USD 0,38 USD

      Регионы: Европа (Франкфурт) 

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 4 31B 0,17 USD 0,48 USD
      Gemma 4 26B A4B 0,16 USD 0,48 USD
      Gemma 4 E2B 0,05 USD 0,10 USD

      Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Европа (Ирландия) и Европа (Милан)

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 3 4B 0,05 USD 0,09 USD
      Gemma 3 12B 0,11 USD 0,34 USD
      Gemma 3 27B 0,27 USD 0,45 USD

      Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 3 4B 0,05 USD 0,10 USD
      Gemma 3 12B 0,11 USD 0,35 USD
      Gemma 3 27B 0,28 USD 0,46 USD

      Регион: Европа (Лондон)

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 3 4B 0,06 USD 0,12 USD
      Gemma 3 12B 0,14 USD 0,45 USD
      Gemma 3 27B 0,36 USD 0,59 USD

      Регион: Азиатско-Тихоокеанский (Сидней)

      Модели Google Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Gemma 3 4B 0,0412 USD 0,0824 USD
      Gemma 3 12B 0,0927 USD 0,2987 USD
      Gemma 3 27B 0,2369 USD 0,3914 USD

      * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
      * Цены на гибком уровне на 50 % ниже, чем на стандартном

    • Luma AI
    • Luma AI

      Тарификация вывода по запросу

    • Meta
    • Meta

      Llama 4

      Тарификация вывода по запросу и пакетного вывода 

      Llama 3.3

      Тарификация вывода по запросу и пакетного вывода 

      Llama 3.2

      Тарификация вывода по запросу и пакетного вывода 

      Цены на настройку модели (точная настройка)

      Оплата за выделенную пропускную способность

      Llama 3.1

      Тарификация вывода по запросу и пакетного вывода 

      Цены на настройку модели (точная настройка)

      Оплата за выделенную пропускную способность

      Llama 3

      Тарификация вывода по запросу 

      Llama 2

      Тарификация вывода по запросу 

      Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

      Модели Meta Цена за 1 млн входных токенов Цена за 1 млн выходных токенов

      Llama 2 Chat (13 млрд)

      0,75 USD

      1,00 USD

      Llama 2 Chat (70 млрд)

      1,95 USD

      2,56 USD

      Цены на настройку модели (точная настройка)

      Модели Meta Стоимость обучения 1 млн токенов Цена хранения каждой пользовательской модели* в месяц Цена вывода для пользовательской модели за 1 элемент модели в час (без учета стоимости выделенной пропускной способности)

      Llama 2, предварительно обученная (13 млрд)

      1,49 USD

      1,95 USD

      23,50 USD

      Llama 2, предварительно обученная (70 млрд)

      7,99 USD

      1,95 USD 23,50 USD

      * Хранение пользовательских моделей = 1,95 USD

      Оплата за выделенную пропускную способность

      Модели Meta Цена за час за элемент модели по подписке на 1 месяц Цена за час за элемент модели по подписке на 6 месяцев

      Llama 2, предварительно обученная и Chat (13 млрд)

      21,18 USD

      13,08 USD

      Llama 2, предварительно обученная (70 млрд)

      21,18 USD

      13,08 USD

      *Предварительно обученные модели Llama 2 доступны только с выделенной пропускной способностью после настройки.

      Чтобы получить более подробную информацию о моделях, перейдите на свой аккаунт AWS или обратитесь в отдел продаж.

    • MiniMax AI
    • MiniMax AI

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2 0,30 USD 1,20 USD
      Minimax M2.1 0,30 USD 1,20 USD
      MiniMax M2.5 0,30 USD 1,20 USD

      Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Европа (Ирландия) и Европа (Милан)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2 0,35 USD 1,41 USD
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2 0,36 USD 1,45 USD
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Регион: Европа (Лондон)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2 0,47 USD 1,86 USD
      Minimax M2.1 0,47 USD 1,86 USD
      Minimax M2.5 0,47 USD 1,86 USD

      Регионы: Европа (Франкфурт), Европа (Стокгольм), Азиатско-Тихоокеанский регион (Джакарта)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Регион: Азиатско-Тихоокеанский (Сидней)

      Модели Minimax Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Minimax M2 0,3090 USD 1,2360 USD
      Minimax M2.1 0,3090 USD 1,2360 USD
      Minimax M2.5 0,31 USD 1,24 USD

      * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
      * Цены на гибком уровне на 50 % ниже, чем на стандартном

    • Mistral AI
    • Mistral AI

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,40 USD 2,00 USD
      Magistral Small 1.2
      0,50 USD 1,50 USD
      Voxtral Mini 1.0
      0,04 USD 0,04 USD
      Voxtral Small 1.0
      0,10 USD 0,30 USD
      Ministral 3B 3.0
      0,10 USD 0,10 USD
      Ministral 8B 3.0
      0,15 USD 0,15 USD
      Ministral 14B 3.0
      0,20 USD 0,20 USD
      Mistral Large 3 0,50 USD 1,50 USD

      Регионы: Азиатско-Тихоокеанский (Мумбаи)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,59 USD 1,76 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,35 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD
      Mistral Large 3 0,59 USD 1,76 USD

      Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,61 USD 1,82 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,36 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD
      Mistral Large 3 0,61 USD 1,82 USD

      Регионы: Европа (Ирландия) и Европа (Милан)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,59 USD 1,76 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,35 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD

      Регион: Европа (Лондон)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,62 USD 3,10 USD
      Magistral Small 1.2
      0,78 USD 2,33 USD
      Voxtral Mini 1.0
      0,06 USD 0,06 USD
      Voxtral Small 1.0
      0,16 USD 0,47 USD
      Ministral 3B 3.0
      0,16 USD 0,16 USD
      Ministral 8B 3.0
      0,23 USD 0,23 USD
      Ministral 14B 3.0
      0,31 USD 0,31 USD

      Регион: Азиатско-Тихоокеанский (Сидней)

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,41 USD 2,06 USD
      Magistral Small 1.2
      0,5150 USD 1,5450 USD
      Voxtral Mini 1.0
      0,0412 USD 0,0412 USD
      Voxtral Small 1.0
      0,1030 USD 0,3090 USD
      Ministral 3B 3.0
      0,1030 USD 0,1030 USD
      Ministral 8B 3.0
      0,1545 USD 0,1545 USD
      Ministral 14B 3.0
      0,2060 USD 0,2060 USD
      Mistral Large 3 0,5150 USD 1,5450 USD

      Регионы: Азиатско-Тихоокеанский регион (Джакарта), Европа (Франкфурт), Европа (Стокгольм) 

      Модели Mistral Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Devstral 2 123B 0,48 USD 2,40 USD

      * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
      * Цены на гибком уровне на 50 % ниже, чем на стандартном

    • Moonshot AI
    • Moonshot AI

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели Kimi Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Kimi K2 Thinking 0,60 USD 2,50 USD
      Kimi K2.5 0,60 USD 3,00 USD

      Регион: Азиатско-Тихоокеанский (Мумбаи)

      Модели Kimi Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Kimi K2 Thinking 0,71 USD 2,94 USD
      Kimi K2.5 0,72 USD 3,60 USD

      Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

      Модели Kimi Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Kimi K2 Thinking 0,73 USD 3,03 USD
      Kimi K2.5 0,72 USD 3,60 USD

      Регионы: Европа (Стокгольм), Азиатско-Тихоокеанский регион (Джакарта)

      Модели Kimi Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Kimi K2.5 0,72 USD 3,60 USD

      Регион: Азиатско-Тихоокеанский (Сидней)

      Модели Kimi Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Kimi K2 Thinking 0,6180 USD 2,5750 USD
      Kimi K2.5 0,6180 USD 3,0900 USD

      * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
      * Цены на гибком уровне на 50 % ниже, чем на стандартном

    • NVIDIA
    • NVIDIA

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,06 USD 0,23 USD
      NVIDIA Nemotron Nano 2 VL 0,20 USD 0,60 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,06 USD 0,24 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,15 USD 0,65 USD

      Регионы: AWS GovCloud (восток США и запад США)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,072 USD 0,276 USD
      NVIDIA Nemotron Nano 2 VL 0,240 USD 0,720 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,072 USD 0,288 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,180 USD 0,780 USD

      Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Европа (Ирландия) и Европа (Милан)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,07 USD 0,27 USD
      NVIDIA Nemotron Nano 2 VL 0,24 USD 0,71 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,07 USD 0,28 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,07 USD 0,28 USD
      NVIDIA Nemotron Nano 2 VL 0,24 USD 0,73 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,07 USD 0,29 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      Регион: Европа (Лондон)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,09 USD 0,36 USD
      NVIDIA Nemotron Nano 2 VL 0,31 USD 0,93 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,09 USD 0,37 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,23 USD 1,01 USD

      Регион: Азиатско-Тихоокеанский (Сидней)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron Nano 2 0,0618 USD 0,2369 USD
      NVIDIA Nemotron Nano 2 VL 0,2060 USD 0,6180 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,0618 USD 0,2472 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,15 USD 0,67 USD

      Регион: Азиатско-Тихоокеанский регион (Джакарта), Европа (Франкфурт) и Европа (Стокгольм)

      Модели NVIDIA Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
      * Цены для уровня Flex и пакетного вывода на 50 % ниже цен для стандартного уровня

    • OpenAI
    • OpenAI

      • Продвинутые модели
      • Вывод по запросу в регионе

        Регион: Восток США (Огайо)

          Стандартное контекстное окно (272 тыс. токенов) Расширенное контекстное окно (1 млн токенов)
        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов
        Daybreak Red: GPT-5.6 Cyber 13,75 USD 17,1875 USD 1,375 USD 82,50 USD  ‑  ‑  ‑  ‑
        Daybreak Blue: GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.5 5,50 USD 0,55 USD 33,00 USD  ‑  ‑  ‑  ‑
        GPT-5.4 2,75 USD 0,275 USD 16,50 USD  ‑  ‑  ‑  ‑

        Регионы: Восток США (Северная Вирджиния)

          Стандартное контекстное окно (272 тыс. токенов) Расширенное контекстное окно (1 млн токенов)
        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов
        GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.5 5,50 USD 0,55 USD 33,00 USD  ‑  ‑  ‑  ‑
        GPT-5.4 2,75 USD 0,275 USD 16,50 USD  ‑  ‑  ‑  ‑

        Регион: Запад США (Орегон)

          Стандартное контекстное окно (272 тыс. токенов) Расширенное контекстное окно (1 млн токенов)
        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов Цена за 1 млн входных токенов Цена за 1 млн входных токенов (запись в кэш на 30 мин.) Цена за 1 млн входных токенов (чтение из кэша) Цена за 1 млн выходных токенов
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.4 2,75 USD 0,275 USD 16,50 USD  ‑  ‑  ‑  ‑

        Регион AWS GovCloud (Запад США)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн входных токенов, сохраненных к кэше Цена за 1 млн выходных токенов
        GPT-5.4 3,30 USD 0,33 USD 19,80 USD

        Примечание. Вывод в пределах региона тарифицируется на уровне, эквивалентном тарифу OpenAI для размещения данных в определенном регионе. Тарификация глобального межрегионального вывода появится в ближайшее время.

      • gpt-oss-20b, 120b
        • Стандартный
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          gpt-oss-20b 0,0721 USD 0,3090 USD
          gpt-oss-120b 0,1545 USD 0,6180 USD
        • Priority
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          gpt-oss-20b 0,1262 USD 0,5408 USD
          gpt-oss-120b 0,2704 USD 1,0815 USD
        • Flex
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          gpt-oss-20b 0,0361 USD 0,1545 USD
          gpt-oss-120b 0,0773 USD 0,3090 USD
        • Пакетный режим
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          gpt-oss-20b 0,0361 USD 0,1545 USD
          gpt-oss-120b 0,0773 USD 0,3090 USD
        • Настройка модели
        • Настройка модели

          Цены на точную настройку с подкреплением

          Amazon Bedrock поддерживает точную настройку подкрепления, что позволяет повысить точность модели без глубокого машинного обучения или больших объемов маркированных данных. Amazon Bedrock автоматизирует рабочий процесс точной настройки подкрепления: он берет образцы запросов, генерирует ответы модели и оценивает их с помощью функции вознаграждения. Эти запросы, ответы и оценки затем используются для обучения вашей модели с помощью итеративного рабочего процесса RFT. 

          Весь рабочий процесс обучения оплачивается по почасовой ставке. После завершения обучения клиенты могут сразу же использовать полученную настроенную модель для вывода по запросу. Опция вывода по запросу включает модель ценообразования на основе токенов, когда плата взимается в зависимости от количества токенов, обработанных во время вывода.

          Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

          Модели OpenAI Цена за час обучения Цена за 1 млн входных токенов Цена за 1 млн выходных токенов Цена хранения каждой обученной модели в месяц
          gpt-oss-20b 80,00 USD 0,09 USD 0,39 USD 1,95 USD
      • gpt-oss-safeguard 20b, 120b
      • Тарификация вывода по запросу

        Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GPT OSS Safeguard 20B 0,07 USD 0,20 USD
        GPT OSS Safeguard 120B 0,15 USD 0,60 USD

        Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GPT OSS Safeguard 20B 0,08 USD 0,24 USD
        GPT OSS Safeguard 120B 0,18 USD 0,71 USD

        Регионы: Европа (Ирландия) и Европа (Милан)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GPT OSS Safeguard 20B 0,08 USD 0,23 USD
        GPT OSS Safeguard 120B 0,18 USD 0,70 USD

        Регион: Европа (Лондон)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GPT OSS Safeguard 20B 0,11 USD 0,31 USD
        GPT OSS Safeguard 120B 0,23 USD 0,93 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели OpenAI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GPT OSS Safeguard 20B 0,0721 USD 0,2060 USD
        GPT OSS Safeguard 120B 0,1545 USD 0,6180 USD

        * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
        * Цены на гибком уровне и пакетные цены на 50 % ниже, чем на стандартном уровне.

    • Qwen
    • Amazon Bedrock

      Qwen

      • Qwen3 Coder, 32B, 235B
        • Стандартный
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          Qwen3 Coder 30B A3B 0,1545 USD 0,6180 USD
          Qwen3 32B 0,1545 USD 0,6180 USD
          Qwen3 235B A22B 2507 0,2266 USD 0,9064 USD
        • Priority
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          Qwen3 Coder 30B A3B 0,2704 USD 1,0815 USD
          Qwen3 32B 0,2704 USD 1,0815 USD
          Qwen3 235B A22B 2507 0,3966 USD 1,5862 USD
        • Flex
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          Qwen3 Coder 30B A3B 0,0773 USD 0,3090 USD
          Qwen3 32B 0,0773 USD 0,3090 USD
          Qwen3 235B A22B 2507 0,1133 USD 0,4532 USD
        • Пакетный режим
        • Регион: Азиатско-Тихоокеанский (Сидней)

          Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
          Qwen3 Coder 30B A3B 0,0773 USD 0,3090 USD
          Qwen3 32B 0,0773 USD 0,3090 USD
          Qwen3 235B A22B 2507 0,1133 USD 0,4532 USD
        • Настройка модели
        • Настройка модели

          Цены на точную настройку с подкреплением

          Amazon Bedrock поддерживает точную настройку подкрепления, что позволяет повысить точность модели без глубокого машинного обучения или больших объемов маркированных данных. Amazon Bedrock автоматизирует рабочий процесс точной настройки подкрепления: он берет образцы запросов, генерирует ответы модели и оценивает их с помощью функции вознаграждения. Эти запросы, ответы и оценки затем используются для обучения вашей модели с помощью итеративного рабочего процесса RFT.

          Весь рабочий процесс обучения оплачивается по почасовой ставке. После завершения обучения клиенты могут сразу же использовать полученную настроенную модель для вывода по запросу. Опция вывода по запросу включает модель ценообразования на основе токенов, когда плата взимается в зависимости от количества токенов, обработанных во время вывода.

          Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

          Модели Qwen Цена за час обучения Цена за 1 млн входных токенов Цена за 1 млн выходных токенов Цена хранения каждой обученной модели в месяц
          Qwen3 32B 80,00 USD 0,20 USD 0,78 USD 1,95 USD
      • Qwen 3 Next, VL, Coder Next
      • Тарификация вывода по запросу

        Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Next 80B A3B 0,15 USD 1,20 USD
        Qwen3 VL 235B A22B 0,53 USD 2,66 USD
        Qwen3 Coder Next 0,50 USD 1,20 USD

        Регионы: Азиатско-Тихоокеанский регион (Мумбаи), Европа (Ирландия) и Европа (Милан)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Next 80B A3B 0,18 USD 1,41 USD
        Qwen3 VL 235B A22B 0,62 USD 3,13 USD
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Регионы: Южная Америка (Сан-Паулу) и Азиатско-Тихоокеанский регион (Токио)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Next 80B A3B 0,18 USD 1,45 USD
        Qwen3 VL 235B A22B 0,64 USD 3,22 USD
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Регион: Европа (Лондон)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Next 80B A3B 0,23 USD 1,86 USD
        Qwen3 VL 235B A22B 0,82 USD 4,12 USD
        Qwen3 Coder Next 0,78 USD 1,86 USD

        Регионы: Европа (Франкфурт) и Азиатско-Тихоокеанский регион (Джакарта)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели Qwen Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        Qwen3 Next 80B A3B 0,1545 USD 1,2360 USD
        Qwen3 VL 235B A22B 0,5459 USD 2,7398 USD
        Qwen3 Coder Next 0,5150 USD 1,2360 USD

        * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
        * Цены на гибком уровне и пакетные цены на 50 % ниже, чем на стандартном уровне.

    • Stability AI
    • Stability AI

      Тарификация вывода по запросу

      Ранее сгенерированные модели изображений, предлагаемые Stability AI, оплачиваются за количество изображений с учетом количества шагов и разрешения изображения.

       

      Регион: Орегон, Северная Вирджиния, Огайо

      Службы обработки изображений Stability AI Цена за поколение для каждой модели  
      Stable Image: удаление фона 0,07 USD  
      Stable Image: удаление объекта 0,07 USD  
      Stable Image: управление с помощью структуры 0,07 USD  
      Stable Image: управление с помощью эскиза 0,07 USD  
      Stable Image: руководство по стилю 0,07 USD  
      Stable Image: поиск и замена 0,07 USD  
      Stable Image: восстановление изображений 0,07 USD  
      Stable Image: поиск и перекрашивание 0,07 USD  
      Stable Image: перенос стиля 0,08 USD  
      Stable Image: консервативное масштабирование 0,40 USD  
      Stable Image: творческое масштабирование 0,60 USD  
      Stable Image: быстрое масштабирование 0,03 USD  
      Stable Image: расширение 0,06 USD  
    • TwelveLabs
    • TwelveLabs

      Цены по требованию

      • Межрегиональный вывод
      • Географический, внутрирегиональный и межрегиональный вывод
    • Writer
    • Writer

      Цены на ресурсы по требованию

      Модели Writer Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
      Palmyra X4 2,50 USD 10,00 USD
      Palmyra X5 0,60 USD 6,00 USD
      Palmyra Vision 7B 0,15 USD 0,60 USD
    • xAI
    • xAI

      Тарификация вывода по запросу

      Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

      Модели xAI Цена за 1 млн входных токенов Цена за 1 млн входных токенов (чтение кэша) Цена за 1 млн выходных токенов
      Grok 4.3 1,25 USD 0,20 USD 2,50 USD
    • Z AI
    • Amazon Bedrock

      Z AI

      • GLM 5
      • Тарификация вывода по запросу

        Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 5 1,00 USD 3,20 USD

        Регионы: Азиатско-Тихоокеанский регион (Джакарта), Азиатско-Тихоокеанский регион (Мумбаи), Азиатско-Тихоокеанский регион (Токио), Южная Америка (Сан-Паулу) и Европа (Стокгольм)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 5 1,20 USD 3,84 USD

        Регион: Европа (Лондон)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 5 1,55 USD 4,96 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 5 1,03 USD 3,30 USD

        * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
        * Цены на гибком уровне и пакетные цены на 50 % ниже, чем на стандартном уровне.

      • GLM 4.7
      • Тарификация вывода по запросу

        Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 0,60 USD 2,20 USD

        Регионы: Азиатско-Тихоокеанский регион (Джакарта), Азиатско-Тихоокеанский регион (Мумбаи), Азиатско-Тихоокеанский регион (Токио), Южная Америка (Сан-Паулу) и Европа (Стокгольм)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 0,72 USD 2,64 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 0,6180 USD 2,2660 USD

        * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
        * Цены на гибком уровне и пакетные цены на 50 % ниже, чем на стандартном уровне.

      • GLM 4.7 Flash
      • Тарификация вывода по запросу

        Регионы: Восток США (Северная Вирджиния), Восток США (Огайо) и Запад США (Орегон)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 Flash 0,07 USD 0,40 USD
        GLM 5 1,00 USD 3,20 USD

        Регионы: Азиатско-Тихоокеанский регион (Джакарта), Азиатско-Тихоокеанский регион (Мумбаи), Азиатско-Тихоокеанский регион (Токио), Европа (Франкфурт), Европа (Ирландия), Европа (Милан), Европа (Стокгольм) и Южная Америка (Сан-Паулу)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 Flash 0,08 USD 0,48 USD

        Регионы: Азиатско-Тихоокеанский регион (Джакарта), Азиатско-Тихоокеанский регион (Мумбаи), Азиатско-Тихоокеанский регион (Токио), Европа (Франкфурт), Европа (Стокгольм) и Южная Америка (Сан-Паулу)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 5 1,20 USD 3,84 USD

        Регион: Европа (Лондон)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 Flash 0,11 USD 0,62 USD
        GLM 5 1,55 USD 4,96 USD

        Регион: Азиатско-Тихоокеанский (Сидней)

        Модели Z AI Цена за 1 млн входных токенов Цена за 1 млн выходных токенов
        GLM 4.7 Flash 0,0721 USD 0,4120 USD
        GLM 5 1,03 USD 3,30 USD

        * Стоимость уровня Priority на 75 % выше, чем стандартного уровня
        * Цены на гибком уровне и пакетные цены на 50 % ниже, чем на стандартном уровне.

    • Импорт пользовательских моделей
    • Импорт пользовательских моделей

      • Llama
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

      • Llama мультимодальная
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

      • Mistral
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

      • Mixtral
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

      • Flan
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

        Цены на инференсы по запросу
        Счет выставляется в течение 5 минут, пока копия модели активна, начиная с первого успешного вызова. Максимальный предел пропускной способности и параллелизма для каждой копии модели определяется в процессе ее импорта и зависит от таких факторов, как сочетание токенов ввода/вывода, тип оборудования, размер модели, архитектура, оптимизация логических выводов.

        Bedrock автоматически масштабирует количество копий модели в зависимости от особенностей использования. Если в течение 5 минут вызова не будет, Bedrock уменьшит масштаб до нуля и снова увеличит его при вызове модели. Во время повторного масштабирования может возникнуть продолжительность холодного запуска (в десятках секунд) в зависимости от размера модели. Bedrock также увеличивает количество копий модели, если объем вывода постоянно превышает пределы параллелизма одной копии модели. Примечание. По умолчанию на каждую импортированную модель приходится не более 3 копий модели на один аккаунт, которые можно увеличить с помощью Квоты на обслуживание.

      • Qwen
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,05718 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Регион: Европа (Франкфурт)

        Версия пользовательского модельного блока версия 1.0
        Цена за единицу пользовательской модели в минуту* 0,07144 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

        Цены на инференсы по запросу
        Счет выставляется в течение 5 минут, пока копия модели активна, начиная с первого успешного вызова. Максимальный предел пропускной способности и параллелизма для каждой копии модели определяется в процессе ее импорта и зависит от таких факторов, как сочетание токенов ввода/вывода, тип оборудования, размер модели, архитектура, оптимизация логических выводов.

        Bedrock автоматически масштабирует количество копий модели в зависимости от особенностей использования. Если в течение 5 минут вызова не будет, Bedrock уменьшит масштаб до нуля и снова увеличит его при вызове модели. Во время повторного масштабирования может возникнуть продолжительность холодного запуска (в десятках секунд) в зависимости от размера модели. Bedrock также увеличивает количество копий модели, если объем вывода постоянно превышает пределы параллелизма одной копии модели. Примечание. По умолчанию на каждую импортированную модель приходится не более 3 копий модели на один аккаунт, которые можно увеличить с помощью квоты на обслуживание.

      • OpenAI
      • Регионы: Восток США (Северная Вирджиния) и Запад США (Орегон)

        Версия пользовательского модельного блока Версия 2.0
        Цена за единицу пользовательской модели в минуту* 0,1433 USD
        Ежемесячная стоимость хранения за единицу пользовательской модели 1,95 USD

        Примечание. Настраиваемые модули модели, необходимые для ее размещения, зависят от множества факторов, в частности от архитектуры модели, количества ее параметров и длины контекста. Точное количество необходимых элементов пользовательской модели будет определено во время импорта. Примечание. Для модели Llama 3.1 8B 128 КБ требуются 2 пользовательских модельных блока, а для модели Llama 3.1 70B 128k – 8 специальных моделей.

        * Оплата выставляется в течение 5 минут.

        Цены на инференсы по запросу
        Счет выставляется в течение 5 минут, пока копия модели активна, начиная с первого успешного вызова. Максимальный предел пропускной способности и параллелизма для каждой копии модели определяется в процессе ее импорта и зависит от таких факторов, как сочетание токенов ввода/вывода, тип оборудования, размер модели, архитектура, оптимизация логических выводов.

        Bedrock автоматически масштабирует количество копий модели в зависимости от особенностей использования. Если в течение 5 минут вызова не будет, Bedrock уменьшит масштаб до нуля и снова увеличит его при вызове модели. Во время повторного масштабирования может возникнуть продолжительность холодного запуска (в десятках секунд) в зависимости от размера модели. Bedrock также увеличивает количество копий модели, если объем вывода постоянно превышает пределы параллелизма одной копии модели. Примечание. По умолчанию на каждую импортированную модель приходится не более 3 копий модели на один аккаунт, которые можно увеличить с помощью квоты на обслуживание.

  • Базы знаний
    • Управляемые базы знаний
    • Управляемая база знаний Amazon Bedrock

      Управляемая база знаний Amazon Bedrock позволяет вашему агенту находить, анализировать и извлекать нужную информацию из документов, изображений, аудио и видео без необходимости самостоятельно управлять инфраструктурой. Она легко интегрируется с Amazon Bedrock AgentCore для поддержки ваших ИИ-нагрузок. Независимо от того, являетесь ли вы опытным разработчиком или создаете свой первый агент ИИ, управляемая база знаний автоматически выполняет загрузку данных, мультимодальный анализ, векторное хранение и интеллектуальный поиск. Вы платите только за то, что храните и извлекаете.

      Что включено без дополнительной оплаты:

      • Мультимодальный анализ документов с помощью управляемого парсера
      • Генерация встраиваний с помощью управляемой модели
      • Повторное ранжирование с помощью управляемого средства повторного ранжирования

      Примечание. При вызове управляемой базы знаний через шлюз AgentCore взимается плата за вызов стандартных инструментов Gateway. Если включена функция наблюдаемости, применяются стандартные тарифы CloudWatch.

      Функция Описание Цена

      Хранение индексов

      Управляемый поисковый индекс со встроенными коннекторами для синхронизации данных из S3, SharePoint, Confluence и других приложений.

      5,00 долл. США за 1 Гбайт необработанных данных в месяц

      Мультимодальный анализ документов (управляемый парсер)

      Преобразует текст, PDF-файлы, изображения, таблицы, аудио и видео в доступный для поиска контент.

      0 USD

      Генерация встраиваний (управляемая модель)

      Преобразует контент в доступные для поиска векторы с помощью встроенной модели.

      0 USD

      Стандартное извлечение (Retrieve API)

      Гибридный поиск, сочетающий семантический поиск и поиск по ключевым словам в индексированном контенте.

      1,00 USD за 1 000 вызовов API

      Повторное ранжирование (управляемое средство повторного ранжирования)*

      Переупорядочивает извлеченные отрывки по релевантности.

      0 USD

      Агентное извлечение — планирование с помощью управляемой LLM**

      Многоступенчатое извлечение данных с использованием встроенной LLM для планирования запросов.

      4 доллара США за 1000 вызовов API Agentic Retrieve + 1 доллар США за 1000 базовых вызовов Retrieve API

      * За самостоятельно выбранную модель для генерации или повторного ранжирования встраиваний взимается дополнительная плата. Цены см. в разделе «Поставщик моделей»

      ** При использовании агентного извлечения с выбранной вами LLM вы платите 1,00 долл. США за 1 000 базовых вызовов API Retrieve, а также оплачиваете услуги поставщика модели за LLM, используемую для планирования запросов.

    • Самоуправляемые базы знаний
    • Извлечение структурированных данных (посредством генерации SQL-запросов)

      Оплата за извлечение структурированных данных производится на основании каждого запроса на генерацию SQL-запроса. Сгенерированный SQL-запрос используется для извлечения структурированных данных из хранилищ.

      ФункцияЦена Извлечение структурированных данных (посредством генерации SQL-запросов){priceOf!bedrock/bedrock!8YdzMT9JSMx-Gvsh0l1-UsC5AAqZRaKPb2bX28RTcYc!*!1000} за 1000 запросов " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">

      Модели Rerank

      Модели Rerank предназначены для повышения релевантности и точности ответов в приложениях дополненной извлеченными данными генерации (RAG). Они оплачиваются за каждый запрос.

      МоделиЦена Amazon-rerank-v1.0{priceOf!bedrock/bedrock!lCmRnze6dXKPa-Tm8cwVBOROuTxOHzb1yjUhE-3flng!*!1000} за 1000 запросов Модели Cohere RerankЦены см. в разделе «Поставщик моделей» " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">

      ** С вас взимается плата за количество запросов, в каждом из которых может содержаться до 100 фрагментов документа. Если запрос содержит более 100 фрагментов документа, он засчитывается как несколько запросов. Например, если запрос содержит 350 документов, он будет обработан как 4 запроса. Обратите внимание, что каждый документ может содержать не более 512 токенов (включая запрос и общее количество токенов документа), а если длина токена превышает 512 токенов, он разбивается на несколько документов. Запрос эквивалентен единице поиска.

  • Ограничения
  • Ограничения для Amazon Bedrock

    Цены на ограничения Amazon Bedrock основаны на стоимости фильтра, используемого в ограничении. Цены одинаковы как для стандартного, так и для классического уровня.

    Защита/фильтрация с помощью Bedrock Guardrails*

    Цена

    Фильтры контента как для стандартного, так и для классического уровня (текстовый контент)

    0,15 USD за 1000 текстовых единиц

    Фильтры контента (содержимое изображений)

    0,00075 USD за каждое обработанное изображение

    Запрещенные темы как для стандартного, так и для классического уровня

    0,15 USD за 1000 текстовых единиц

    Фильтры конфиденциальной информации 

    0,10 USD за 1000 текстовых единиц

    Фильтры конфиденциальной информации (регулярное выражение) 

    Бесплатно

    Фильтры слов

    Бесплатно

    Контекстные проверки обоснования**

    0,10 USD за 1000 текстовых единиц

    Проверки автоматизированных рассуждений

    0,17 USD за 1000 текстовых единиц на политику автоматизированных рассуждений

    В таблице ниже указаны цены на Bedrock Guardrails при использовании с API InvokeGuardrailChecks. 

    Защита/фильтрация с помощью Bedrock Guardrails*

    Цена

    Фильтры контента (только текстового)

    0,07 USD за 1000 текстовых единиц

    Атака на запрос (только текстовый контент) ***

    0,08 USD за 1000 текстовых единиц

    Фильтры конфиденциальной информации

    0,10 USD за 1000 текстовых единиц

    Тарификация вывода по запросу

    * Каждый фильтр ограничения опционален и может быть активирован в зависимости от требований вашего приложения. Плата взимается в зависимости от используемой функции защиты. Например, если вы используете фильтры контента и фильтры конфиденциальной информации, плата взимается за оба этих фильтра, при этом за использование любых других фильтров плата не взимается. 

    ** Контекстная проверка обоснования использует источник данных и запрос, чтобы определить степень соответствия ответа модели источнику данных и запросу. Общее количество текстовых единиц, за которые взимается плата, рассчитывается путем объединения всех символов в источнике, запросе и ответе модели. 

    *** С помощью API InvokeGuardrailChecks вы можете использовать фильтр атак на запросы отдельно от фильтров контента. Такое разделение доступно только в этом API. 

    Примечание: Текстовая единица может содержать до 1000 символов. Если текстовый ввод превышает 1000 символов, он обрабатывается как несколько текстовых единиц, каждая из которых содержит 1000 символов или меньше. Например, если введенный текст содержит 5600 символов, плата будет взиматься за 6 текстовых единиц. 

  • Оценка модели
  • Оценка модели

    За оценку модели взимается плата за вывод, сделанный на основе выбранной модели. Автоматически сгенерированные алгоритмические оценки предоставляются без дополнительной оплаты. В случае оценки с участием человека (собственной рабочей команды) с вас взимается плата за вывод модели и плата в размере 0,21 USD за каждую выполненную человеком задачу.

    Если при оценке моделей вы используете оценку RAG или подход LLM-как-эксперт, токены, используемые моделью-судьей, тарифицируются по стандартным ценам уровня On-Demand. Запросы для модели-судьи тарифицируются как часть использования токенов и доступны в открытой документации. Оценка RAG в базе знаний Bedrock также предполагает оплату обычных тарифов за использование баз знаний Bedrock.

    Модель

    Цена за 1000 входящих токенов

    Цена за 1000 исходящих токенов

    Стоимость выполнения каждой задачи для человека

     

    Модель, выбранная для оценки

    На основе выбранной модели

    На основе выбранной модели

     

    0,21 USD

     
  • Автоматизация обработки данных
  • Автоматизация данных

    Автоматизация данных Amazon Bedrock преобразует неструктурированный мультимодальный контент в структурированные форматы данных для таких случаев использования, как интеллектуальная обработка документов, анализ видео и RAG. Автоматизация данных Bedrock может создавать стандартный вывод с использованием предопределенных значений по умолчанию, специфичных для модальности, таких как покадровые описания видео, аудиотранскрипты или автоматический анализ документов. Кроме того, заказчики могут создавать собственные выходные данные, указав свои требования к выходным данным в шаблонах на основе своей схемы данных, которую затем можно легко загрузить в существующую базу или хранилище данных. Благодаря интеграции с базами знаний автоматизацию обработки данных Bedrock также можно использовать для анализа контента приложений RAG, повышая точность и релевантность результатов за счет включения информации, встроенной в изображения и текст.

    Стандартный выход Аудио{priceOf!bedrock/bedrock!_shBqbXfcTr_cGhwiO5tisKP9jSVJnjfW9ycezuCF2A!decimals=3}/минута Документы{priceOf!bedrock/bedrock!Q8tLf4yEvbG5PYWBnYqBG2yQEQzVk2kkxnNsH7HfSd4!decimals=3}/page Изображения*{priceOf!bedrock/bedrock!3oeLtPIxxHalyib3sOvjLNTU5mV_aPktgncNBD4tyes!decimals=3}/image Видео{priceOf!bedrock/bedrock!XHdFMWViw7uK6t9HzJc6IoNaV0mkPahj53wkwuYo1iI!decimals=3}/минута " data-pricing-endpoint="https://b0.p.awsstatic.com/pricing/2.0/meteredUnitMaps" data-partition="aws" data-locale="ru-RU" data-token-component-type="native-react">

    Базы знаний Amazon Bedrock обеспечивают интеграцию автоматизации обработки данных Bedrock для получения более релевантных и точных ответов на мультимодальные данные. При настройке базы знаний можно выбрать в качестве метода синтаксического анализа автоматизацию обработки данных Bedrock для анализа и извлечения значимой информации из изображений или документов, включая рисунки, схемы и диаграммы. Во время обработки эта функция извлекает значимую информацию из полученных документов и изображений, которая затем используется на последующих этапах базы знаний для группировки, встраивания и хранения. При интеграции с базами знаний она обеспечивает стандартизированный выход и взимает соответствующую плату.

  • Интеллектуальная маршрутизация запросов
  • Ценовой уровень Ценообразование Тарифный план
    Интеллектуальная маршрутизация запросов 1 USD за 1000 запросов По требованию

    Интеллектуальная маршрутизация запросов

    Интеллектуальная маршрутизация запросов позволяет применять комбинацию базовых моделей (FM) из одного семейства моделей для оптимизации качества и затрат. Например, используя семейство моделей Anthropic Claude, Amazon Bedrock может интеллектуально маршрутизировать запросы между Claude 3.5 Sonnet и Claude 3 Haiku в зависимости от сложности запроса. Аналогичным образом Amazon Bedrock может направлять запросы между Meta Llama 3.3, 70B и 3.18B, а также между Nova Pro и Nova Lite. Маршрутизатор запросов предсказывает, какая модель обеспечит наилучшую производительность для каждого запроса, а также поможет оптимизировать качество ответа и затраты. Это особенно полезно для таких приложений, как помощники по обслуживанию клиентов, где простые запросы можно обрабатывать с помощью небольших, быстрых и экономичных моделей, а сложные – перенаправить в более эффективные модели. Интеллектуальная маршрутизация запросов позволяет сократить расходы на 30 % без ущерба для точности.

  • Оптимизация текстовых запросов
  • Оптимизация текстового запроса для Amazon Bedrock

    Amazon Bedrock предлагает два оптимизатора запросов. 
    Простой оптимизатор запросов
    Простой оптимизатор запросов доступен одним щелчком мыши в игровой среде и Prompt Manager. Он также доступен через API OptimizePrompt. Оплата взимается только за общее количество входных токенов запросов и полученные в результате оптимизированные запросы. Цена составляет 0,03 доллара США за 1000 токенов

    Расширенный оптимизатор запросов
    Расширенная оптимизация запросов Bedrock доступна в разделе Advanced Prompt Optimization в консоли Bedrock и через API CreateAdvancedPromptOptimizationJob. Плата взимается за токены, использованные при оптимизации и тарифицируемые по стандартным ценам уровня On-Demand. Для оценки объема использования важно учитывать следующее: оптимизатор запросов использует LLM в качестве средств переформулирования и оценки, которые работают в итерационных циклах между выводом, оценкой и переформулированием. Используйте следующие формулы для оценки затрат, где N — количество записей в наборе данных для оценки для каждого шаблона запроса, P — количество входных токенов в шаблонах запросов, O — расчетное количество выходных токенов целевой модели, G — количество токенов в эталонном ответе, используемом в качестве эталонного значения.

    Оценщик на основе функций Lambda: если вы решите использовать собственную функцию Lambda в качестве оценщика, следующие формулы можно использовать для оценки общего количества токенов и стоимости для каждого шаблона запроса: 
    Количество вызовов Lambda для каждого шаблона запроса = 16 × N. 
    Общее количество токенов целевой модели = 16 × N × (P + O). 
    Количество входных токенов LLM-оптимизатора (в настоящее время Anthropic Claude Sonnet 4.6) = 101 × (3700 + 0,35P). 

    Оценщик LLM-как-эксперт: если вы выберете вариант LLM-как-эксперт или критерии управления на естественном языке, для оценки общего количества токенов для каждого шаблона запроса можно использовать следующие формулы. Общее количество токенов целевой модели = 16 × N × (P + O). 
    Количество входных токенов LLM-оптимизатора (в настоящее время Anthropic Claude Sonnet 4.6) = 101 × (3700 + 0,35P). 
    Количество токенов модели-судьи = 16 × N × (P + O + G + запрос для модели-судьи).

    Примечание. Это функция генеративного ИИ; точное количество выходных токенов неизвестно до момента выполнения и зависит от того, какой результат должен генерировать запрос.

  • Поиск в Интернете
  • Поиск в Интернете позволяет вашим моделям и агентам получать актуальную информацию из Интернета, чтобы формировать ответы на основе самых свежих данных.  Плата взимается за каждый запрос, где запросом считается отдельный поисковый запрос в Интернете.

Примеры расчета цен

  • Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Jurassic-2 Mid от AI21 Labs для суммирования вводного потока из 10 000 токенов входного текста в итоговый поток из 2000 токенов.

    Общая стоимость = 10 000 токенов / 1000 * 0,0125 USD + 2000 токенов / 1000 * 0,0125 USD = 0,15 USD

  • Цены по требованию

    Разработчик приложения каждый час выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Amazon Titan Text Lite для суммирования входящего потока из 2000 токенов входящего текста в исходящий поток из 1000 токенов.

    Общая стоимость в час = 2000 токенов / 1000 * 0,0003 USD + 1000 токенов / 1000 * 0,0004 USD = 0,001 USD.

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к базовой модели генератора изображений Amazon Titan для создания 1000 изображений размером 1024 × 1024 в стандартном качестве.

    Общая стоимость = 1000 изображений * 0,01 USD за изображение = 10 USD

    Оплата за настройку (тонкую настройку и непрерывное предварительное обучение)

    Разработчик приложения настраивает модель генератора изображений Amazon Titan, используя 1000 пар «изображение – текст». После обучения разработчик использует выделенную для пользовательской модели пропускную способность в течение 1 часа, чтобы оценить производительность модели. Тонко настроенная модель хранится в течение 1 месяца. После оценки разработчик использует выделенную пропускную способность (с подпиской на один месяц) для размещения настраиваемой модели.

    Ежемесячные затраты на тонкую настройку вычисляются так: обучение для тонкой настройки (0,005 USD * 500 * 64), где 0,005 USD – цена за просмотренное изображение, 500 – количество шагов, 64 – размер партии плюс хранение пользовательской модели в месяц (1,95 USD) + 1 час анализа пользовательской модели (21 USD) = 160 USD + 1,95 USD + 21 = 182,95 USD

    Оплата за выделенную пропускную способность

    Разработчик приложения покупает два элемента модели Amazon Titan Text Express с подпиской на один месяц, чтобы использовать ее для обобщения текста.

    Общая стоимость в месяц: 2 элемента модели * 18,40 USD/час * 24 часа * 31 день = 27 379,20 USD

    Разработчик приложения покупает один элемент модели базовой модели генератора изображений Amazon Titan с подпиской на один месяц.

    Общая стоимость = 1 элемент модели * 16,20 USD * 24 часа * 31 день = 12 052,80 USD

  • Пример 1. Чат-бот службы поддержки
    Разработчик приложения создает чат-бота службы поддержки клиентов и использует фильтры контента для блокировки вредоносного контента и запрещенных тем, чтобы отфильтровывать нежелательные запросы и ответы.

    Чат-бот обрабатывает 1000 запросов пользователей в час. Каждый пользовательский запрос имеет среднюю длину ввода 200 символов и получает ответ базовой модели размером в 1500 символов.

    Каждый пользовательский запрос длиной 200 символов соответствует одной текстовой единице.

    Каждый ответ базовой модели длиной 1500 символов соответствует двум текстовым единицам.

    Текстовые единицы, обрабатываемые каждый час = (1 + 2) * 1000 запросов = 3000 текстовых единиц

    Общая стоимость часов фильтрации контента и запрещенных тем = 3000 * (0,15 USD + 0,15 USD) / 1000 = 0,90 USD

     

    Пример 2. Обобщение стенограмм колл-центра
    Разработчик создает приложение для обобщения стенограмм чатов между пользователями и агентами поддержки. Он использует фильтр конфиденциальной информации для редактирования информации, позволяющей установить личность (PII), в сгенерированных сводках по 10 000 разговоров.

    Каждая сгенерированная сводка содержит в среднем 3500 символов, что соответствует 4 текстовым единицам.

    Общая стоимость суммирования: 10 000 разговоров = 10 000 * 4 * (0,1 USD / 1000) = 4 USD

     

    Пример 3. Механизм верификации медицинских протоколов
    Компания в сфере медицинских технологий внедряет проверки автоматизированных рассуждений в свою систему поддержки клинических решений, чтобы проверять предложенные варианты лечения на соответствие медицинским рекомендациям.

    Система обрабатывает 5000 клинических случаев в месяц. Каждый случай включает в себя:

    • Сводка данных о пациенте: 500 символов (1 текстовая единица)
    • Диагностическая оценка: 2000 символов (2 текстовых единицы)
    • Рекомендация по лечению: 4500 символов (5 текстовых единиц)

    Количество обрабатываемых текстовых единиц в месяц = (1 + 2 + 5) 5000 случаев = 40 000 текстовых единиц
    Общая ежемесячная стоимость проверок автоматизированных рассуждений = 40 000 (0,17 USD) /1000 = 6,80 USD

     

  • Примеры расчета стоимости

    Пример 1. Чат-бот службы поддержки (с использованием стандартного извлечения)

    Вы индексируете 50 Гбайт контента с вашего сайта SharePoint — примерно 100 000 документов, включая PDF-файлы, презентации, файлы Word и изображения. Ваш агент обрабатывает 100 000 запросов на стандартное извлечение в месяц.

    Позиция Подсчет Стоимость

    Хранение индексов

    50 Гбайт × 5,00 USD

    250,00 USD

    Мультимодальный анализ документов (управляемый парсер)

    Включено

    0 USD

    Генерация встраиваний (управляемая модель)

    Включено

    0 USD

    Стандартное извлечение

    100 000 ÷ 1000 × 1,00 USD

    100,00 USD

    Повторное ранжирование (управляемое средство повторного ранжирования)

    Включено

    0 USD
    Всего за месяц   350,00 USD

    Пример 2. Помощник по корпоративным исследованиям (с использованием агентного извлечения)

    Вы индексируете 50 Гбайт контента с вашего сайта SharePoint — примерно 100 000 документов, включая PDF-файлы, презентации, файлы Word и изображения. Ваш агент обрабатывает 100 000 вызовов API Agentic Retrieve в месяц. В среднем каждый агентный вызов приводит к 2 базовым вызовам API Retrieve.

    Позиция Подсчет Стоимость

    Хранение индексов

    50 Гбайт × 5,00 USD

    250,00 USD

    Мультимодальный анализ документов (управляемый парсер)

    Включено 0 USD

    Генерация встраиваний (управляемая модель)

    Включено 0 USD

    Вызовы API Agentic Retrieve

    100 000 ÷ 1000 × 4,00 USD

    400,00 USD

    Базовые вызовы API Retrieve

    (100 000 × 2) ÷ 1000 × 1,00 USD

    200,00 USD

    Повторное ранжирование (управляемое средство повторного ранжирования)

    Включено 0 USD
    Всего за месяц   850,00 USD
  • Цены по требованию

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock в регионе Запад США (Орегон): запрос к модели Claude от Anthropic для суммирования входящего потока из 11 000 токенов входящего текста в исходящий поток размером 4000 токенов.

    Общая стоимость = 11 000 токенов / 1000 * 0,008 USD + 4000 токенов / 1000 * 0,024 USD = 0,088 USD + 0,096 USD = 0,184 USD

    Оплата за выделенную пропускную способность

    Разработчик приложения покупает один элемент модели Anthropic Claude Instant в регионе Запад США (Орегон).

    Общая стоимость в месяц = 1 элемент модели * 39,60 USD * 24 часа * 31 день = 29 462,40 USD

  • Цены по требованию

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Command от Cohere для суммирования входящего потока из 6000 токенов входящего текста в исходящий поток размером 2000 токенов.

    Общая стоимость = 6000 токенов / 1000 * 0,0015 USD + 2000 токенов / 1000 * 0,0020 USD = 0,013 USD

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Command – Light от Cohere для суммирования входящего потока из 6000 токенов входящего текста в исходящий поток размером 2000 токенов.

    Общая стоимость = 6000 токенов / 1000 * 0,0003 USD + 2000 токенов / 1000 * 0,0006 USD = 0,003 USD

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Embed English или Embed Multilingual от Cohere, чтобы создавать вложения для 10 000 токенов входящего потока.

    Общая стоимость = 10 000 токенов / 1000 * 0,0001 USD = 0,001 USD

    Оплата за настройку (тонкую настройку)

    Разработчик приложения настраивает командную модель Cohere, используя 1000 токенов данных. После обучения он использует выделенную для пользовательской модели пропускную способность в течение 1 часа, чтобы оценить производительность модели. Тонко настроенная модель хранится в течение 1 месяца. После оценки разработчик использует выделенную пропускную способность (с подпиской на один месяц) для размещения настраиваемой модели.

    В ежемесячную стоимость тонкой настройки входит обучение для тонкой настройки (0,004 USD * 1000), хранение пользовательских моделей в месяц (1,95 USD), один час вывода по пользовательской модели (49,50 USD). Итого: 55,45 USD.

    Ежемесячная стоимость выделенной пропускной способности (с подпиской на один месяц) пользовательской модели составляет 39,60 USD

    Оплата за выделенную пропускную способность

    Разработчик приложения покупает один элемент модели Cohere Command с подпиской на один месяц, чтобы использовать ее для обобщения текста.

    Общая стоимость в месяц = 1 элемент модели * 39,60 USD * 24 часа * 31 день = 29 462,40 USD

  • Пример ценообразования. Разработчик приложения импортирует персонализированную модель типа Llama 3.1 с параметром 8B и длиной последовательности 128 КБ в регионе us-east-1 и удаляет модель через 1 месяц. Для этого необходимы 2 элемента нестандартной модели. Таким образом, цена за минуту составит 0,1570 USD, поскольку требуются 2 элемента пользовательской модели. Стоимость хранения двух моделей на заказ составит 3,90 USD в месяц.

    Плата за импорт модели не взимается. Первый успешный вызов осуществлен в 08:03. В это время начинается замер. Окна измерений длительностью 5 минут работают с 08:03 до 08:07, с 08:07 до 08:11 и т. д. Если за любой 5-минутный период был выполнен хотя бы один вызов, окно оплаты будет считаться активным. Если вызов поступит в 08:03, а после 08:07 больше вызовов не будет, отсчет остановится в 08:07. В этом случае счет будет рассчитан следующим образом: 0,1570 USD * 5 минут * 1 окно по пять минут = 0,785 USD.

  • Пример расчета стоимости 1.
    Допустим, вы обрабатываете документ на 1000 страниц с помощью BDA Custom Output. Все 1000 страниц обрабатываются с использованием чертежа 1, состоящего из 15 полей. Цена за обработку одной страницы с использованием любого чертежа с 30 полями или меньше составляет 0,040 USD. Общая стоимость составит 40 USD.

    Общее количество обработанных страниц: 1000
    Цена за обработку одной страницы с использованием чертежей, содержащих менее 30 полей = 0,040 USD
    Общая стоимость = 1000 страниц * 0,040 USD = 40 USD

     

    Пример расчета стоимости 2.
    Допустим, вы обрабатываете 2 документа с помощью BDA Custom Output. Документ 1 содержит 40 страниц и обрабатывается с использованием чертежа 1, состоящего из 20 полей. Документ 2 содержит 10 страниц и обрабатывается с использованием чертежа 2, состоящего из 40 полей. Цена за обработку одной страницы с использованием чертежа 1 составляет 0,040 USD, поскольку он содержит 30 полей или меньше. Цена за обработку одной страницы с использованием чертежа 2 составляет 0,045 USD. Стоимость обработки документа 1 с использованием чертежа 1 составляет 1,60 USD. Стоимость обработки документа 2 с использованием чертежа 2 составляет 0,45 USD. Общая стоимость обработки обоих документов составит 2,05 USD.

    Общее количество обработанных страниц = 50
    Цена за обработку одной страницы с использованием чертежа 1, содержащего меньше 30 полей = 0,040 USD
    Цена за обработку одной страницы с использованием чертежа 2, содержащего 40 полей = 0,040 USD + (количество дополнительных полей свыше 30 * 0,0005 USD за поле)
    Количество дополнительных полей свыше 30 = 40 - 30 = 10
    Цена за обработку одной страницы с использованием чертежа 2, содержащего 40 полей = 0,040 USD + (10 * 0,0005 USD за поле) = 0,045 USD
    Стоимость обработки документа 1 с использованием чертежа 1 = 40 страниц x 0,040 USD за страницу = 1,6 USD
    Стоимость обработки документа 2 с использованием чертежа 2 = 10 страниц x 0,045 USD за страницу = 0,45 USD
    Общая стоимость = плата за документ 1 + плата за документ 2 = 1,6 USD + 0,45 USD = 2,05 USD

     

    Пример расчета стоимости 3.
    Допустим, вы настроили базы знаний Bedrock для использования Bedrock Data Automation в качестве синтаксического анализатора, а затем загрузили документ объемом 1000 страниц. Обратите внимание, что структуры затрат различаются в зависимости от вариантов синтаксического анализа баз знаний. BDA использует цену за страницу, в то время как синтаксические анализаторы базовой модели взимают плату в зависимости от токенов ввода и вывода. Ориентировочная информация: для обработки 1000 страниц, где 30 % содержат таблицы, а 30 % – рисунки, обычно требуется 2900 входных токенов и 750 выходных токенов. Использование токенов зависит от типа контента, поэтому клиентам рекомендуется проводить тестирование, применяя свои собственные данные, чтобы получить более точные оценки. В интеграции баз знаний Bedrock и Bedrock Data Automation используется стандартный выход, в этом случае цена за страницу составляет 0,010 USD. Общая стоимость составит 10 USD.

    Общее количество обработанных страниц: 1000
    Цена за страницу для стандартного выхода = 0,010 USD
    Общая стоимость = 1000 * 0,010 USD = 10 USD

     

    Пример расчета стоимости 4.
    Допустим, вы обрабатываете 60-минутное видео с помощью BDA Standard Output. Стоимость минуты стандартного видеовыхода составляет 0,050 USD. Общая стоимость составит 3,00 USD.

    Общее количество обработанных минут = 60
    Стоимость минуты стандартного видеовыхода = 0,050 USD
    Общая стоимость = 60 * 0,050 USD = 3,00 USD

     

    Пример расчета стоимости 5.
    Допустим, вы обрабатываете 2000 изображений с помощью BDA Custom Output. Первая 1000 изображений обрабатывается с использованием чертежа 1, состоящего из 10 полей. Вторая 1000 страниц обрабатывается с использованием чертежа 2, состоящего из 40 полей. Цена за обработку одного изображения с использованием чертежа 1 составляет 0,005 USD, поскольку он содержит 30 полей или меньше. Цена за обработку одного изображения с использованием чертежа 2 составляет 0,01 USD. Стоимость обработки первой 1000 изображений с использованием чертежа 1 составляет 5,00 USD. Стоимость обработки второй 1000 изображений с использованием чертежа 2 составляет 10,00 USD. Общая стоимость обработки 2000 изображений составит 15,00 USD

    Стоимость первой 1000 изображений = 1000 изображений * 0,005 USD за изображение = 5,00 USD
    Стоимость второй 1000 изображений = 1000 изображений * (0,005 USD + (количество дополнительных полей свыше 30 * 0,0005 USD за поле))
    = 1000 * (0,005 USD + ((40-30) * 0,0005 USD))
    = 1000 * (0,005 USD + (10 * 0,0005 USD)) = 10,00 USD
    Общая стоимость = 5,00 USD + 10,00 USD = 15,00 USD

     

    Пример расчета стоимости 6.
    Предположим, вы хотите использовать Bedrock Data Automation Standard Output для обработки аудиозаписей совещаний вашей организации продолжительностью 15 000 минут. Общая стоимость обработки всех 15 000 минут аудиозаписей составит 90 USD.

    Общее количество обработанных минут = 15 000 минут
    Общая стоимость = 15 000 минут × 0,006 USD = 90 USD

     

  • Цены по требованию

    Каждый час разработчик приложения выполняет следующие вызовы API в Amazon Bedrock: запрос к модели DeepSeek-R1 с просьбой суммировать ввод 2000 токенов входного текста и 1000 токенов (включая токены рассуждения).

    Общая стоимость в час = 2000 токенов / 1000 * 0,00135 USD + 1000 токенов / 1000 * 0,0054 USD = 0,0081 USD

  • Пример. Сводка новостей
    Разработчик приложения создает поток с целью автоматизации суммирования новостей для трейдеров. Поток начинается с узла ввода, определяющего местоположение S3, далее узел загрузки S3 извлекает 10 файлов со статьями от 10 ведущих информационных агентств (2 перехода). Затем узел-итератор вызывает модель суммирования файлов с помощью узла текстового запроса (+ 10 файлов x 2 перехода). Полученные результаты собираются узлом-коллектором, затем сохраняются обратно в S3 через узел S3-хранилища и передаются в узел Output для завершения процесса (+ 3 перехода). Поток запускается каждые полчаса в рабочие дни.

    Количество переходов между узлами для выполнения одного потока: 2+1+10 * 2 + 3 = 25 переходов.

    Количество запусков потока в месяц: 24 часа * 2 запуска в час * 5 дней * 4 недели = 960 запусков.

    Общая ежемесячная стоимость: 25 * 960 * 0,035 USD / 1000 = 0,84 USD

    Дополнительные расходы
    Дополнительно в счет будут включены расходы на сервисы AWS, используемые в процессе выполнения потока, включая хранение и извлечение данных через Amazon S3 (узлы загрузки и хранения) и применение базовой модели Amazon Bedrock (узел текстового запроса).

  • Цены по требованию

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Llama 2 Chat (13 млрд) от Meta для суммирования входящего потока из 2000 токенов входящего текста в исходящий поток размером 500 токенов.

    Общая стоимость = 2000 токенов / 1000 * 0,00075 USD + 500 токенов / 1000 USD * 0,001 USD = 0,002 USD

    Оплата за настройку (тонкую настройку)

    Разработчик приложения настраивает предварительно обученную модель Llama 2 (70 млрд), используя 1000 токенов данных. После обучения он использует выделенную для пользовательской модели пропускную способность в течение 1 часа, чтобы оценить производительность модели. Тонко настроенная модель хранится в течение 1 месяца. После оценки разработчик использует выделенную пропускную способность (с подпиской на один месяц) для размещения настраиваемой модели.

    В ежемесячную стоимость тонкой настройки входит обучение для тонкой настройки (0,00799 USD * 1000), хранение пользовательских моделей в месяц (1,95 USD), один час вывода по пользовательской модели (23,50 USD). Итого: 33,44 USD.

    Ежемесячная стоимость выделенной пропускной способности (с подпиской на один месяц) пользовательской модели составляет 21,18 USD

    Оплата за выделенную пропускную способность

    Разработчик приложения покупает один элемент модели Meta Llama 2 с подпиской на один месяц, чтобы использовать ее для обобщения текста.

    Общая стоимость в месяц = 1 элемент модели * 21,18 USD * 24 часа * 31 день = 15 757,92 USD

  • Цены по требованию

    Разработчик приложения каждый час выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Mistral 7B для суммирования входящего потока из 2000 токенов входящего текста в исходящий поток из 1000 токенов.

    Общая стоимость в час = 2000 токенов / 1000 * 0,00015 USD + 1000 токенов / 1000 * 0,0002 USD = 0,0005 USD

    Разработчик приложения каждый час выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Mixtral 8x7B для суммирования входящего потока из 2000 токенов входящего текста в исходящий поток из 1000 токенов.

    Общая стоимость в час = 2000 токенов / 1000 * 0,00045 USD + 1000 токенов / 1000 * 0,0007 USD = 0,0016 USD

    Разработчик приложения каждый час выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Mistral Large для суммирования входящего потока размером 2000 токенов входящего текста в исходящий поток размером 1000 токенов. 

    Общая стоимость в час = 2000 токенов / 1000 * 0,008 USD + 1000 токенов / 1000 * 0,024 USD = 0,04 USD

  • Оценка модели, пример 1.

    Цены на ресурсы по требованию
    Разработчик приложения представляет набор данных для оценки модели с участием человека на основе Anthropic Claude 2.1 и Anthropic Claude Instant в регионе AWS «Восток США (Северная Вирджиния)».

    Этот набор данных содержит 50 запросов, а для оценки каждого сочетания запроса и ответа разработчик требует использовать 1-го сотрудника (это значение указывается в параметре «количество сотрудников на запрос» при создании задания по оценке).

    В этом оценочном задании будет 50 задач (по 1 заданию на каждый набор подсказок и ответов на каждого работника). 50 запросов в сумме содержат 5000 входящих токенов, а ответы – 15 тысяч токенов для Anthropic Claude Instant и 20 тысяч токенов для Anthropic Claude 2.1.

    Плата за эту работу по оценке модели вычисляется следующим образом:

    Элемент Количество входящих токенов Цена за 1000 входящих токенов Стоимость входящих потоков Количество исходящих токенов Цена за 1000 исходящих токенов Стоимость исходящих потоков Количество задач для человека Стоимость выполнения каждой задачи для человека Стоимость всех задач для человека Итого
    Логический вывод Claude Instant 5000 0,0008 USD 0,004 USD 15 000 0,0024 USD 0,036 USD       0,04 USD
    Логический вывод Claude 2.1 5000 0,008 USD 0,04 USD 20 000 0,024 USD 0,48 USD       0,52 USD
    Задачи для человека             50 0,21 USD 10,50 USD 10,50 USD
    Итого                   11,06 USD

    Оценка модели, пример 2.

    Цены на ресурсы по требованию
    Разработчик приложения представляет набор данных для оценки модели с участием человека на основе Anthropic Claude 2.1 и Anthropic Claude Instant в регионе AWS «Восток США (Северная Вирджиния)».

    Этот набор данных содержит 50 запросов, а для оценки каждого сочетания запроса и ответа разработчик требует использовать 2-х сотрудников (это значение указывается в параметре «количество сотрудников на запрос» при создании задания по оценке). Это означает, что задание по оценке будет состоять из 100 задач (по 1 задаче на каждый набор «запрос – ответ» на каждого сотрудника: 2 сотрудника × 50 наборов «запрос – ответ» = 100 задач для человека).

    50 запросов в сумме содержат 5000 входящих токенов, а ответы – 15 тысяч токенов для Anthropic Claude Instant и 20 тысяч токенов для Anthropic Claude 2.1.

    Плата за эту работу по оценке модели вычисляется следующим образом:

    Элемент Количество входящих токенов Цена за 1000 входящих токенов Стоимость входящих потоков Количество исходящих токенов Цена за 1000 исходящих токенов Стоимость исходящих потоков Количество задач для человека Стоимость выполнения каждой задачи для человека Стоимость всех задач для человека Итого
    Логический вывод Claude Instant 5000 0,0008 USD 0,0040 USD 15 000 0,0024 USD 0,036 USD       0,04 USD
    Логический вывод Claude 2.1 5000 0,008 USD 0,0400 USD 20 000 0,024 USD 0,48 USD       0,52 USD
    Задачи для человека             100 0,21 USD 21,00 USD 21,00 USD
    Итого                   21,56 USD
  • Пример. Сводка новостей
    Разработчик приложения создает текстовый запрос, чтобы выполнять обобщения новостей для предприятий розничной торговли, использующих Claude 3.5. Оригинальный текстовый запрос включает 429 токенов. Оптимизированный текстовый запрос содержит 511 токенов, а также более конкретные инструкции и примеры для получения более краткого ответа от базовых моделей (FM). Кроме того, он использует оптимизированный текстовый запрос с 511 токенами в качестве входных данных для оптимизатора текстового запроса и создает 2 новых варианта для Claude 3.7 и Nova Pro с 582 и 579 токенами.

    Общее количество токенов ввода и вывода для оптимизации текстового запроса: 429 + 511 + 511 + 582 + 511 + 579 = 3123

    Общий ежемесячный счет: 3123 / 1000 * 0,03 USD = 0,09 USD

  • Цены по требованию

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели SDXL для создания изображения размером 512 × 512 с величиной шага 70 (премиальное качество).

    Общая стоимость = 1 изображение * 0,036 USD за изображение = 0,036 USD

    Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели SDXL 1.0 для создания изображения размером 1024 × 1024 с величиной шага 70 (премиальное качество).

    Общая стоимость = 1 изображение * 0,08 USD за изображение = 0,08 USD

    Оплата за выделенную пропускную способность

    Разработчик приложения покупает один элемент модели SDXL 1.0 с подпиской на один месяц.

    Общая стоимость = 1 * 49,86 USD * 24 часа * 31 день = 37 095,84 USD

  • Цены по требованию

    Разработчик приложения выполняет следующий вызов API к Amazon Bedrock: запрос к модели Pegasus 1.2 для описания содержимого 10-секундного видео, который возвращает результат в объеме 2000 токенов.

    Общая стоимость = 10 секунд * 0,00049 USD + 2 тыс. токенов / 1000 * 0,0075 USD = 0,0199 USD


    Разработчик приложения обращается к Amazon Bedrock со следующими вызовами API: запрашивает модель Marengo Embed [3.0 или 2.7] для вставки 10 видеороликов общей продолжительностью 100 минут.

    Общая стоимость = 100 минут (т.е. 6000 секунд) * 0,00070 USD = 4,2 USD


    Разработчик приложения обращается к Amazon Bedrock со следующими вызовами API: запрашивает модель Marengo Embed 3.0, чтобы, введя текст и изображение, создать встраивание, которое можно использовать для поиска клипа с сумкой, показанной на данном изображении, в репозитории встраиваний, созданном по приведенному выше примеру. 

    Общая стоимость = 1 текстовый запрос * 0,00007 USD +1 запрос на изображение * 0,0001 USD = 0,00017 USD


    Разработчик приложения обращается к Amazon Bedrock со следующими вызовами API: запрашивает модель Marengo Embed [3.0 или 2.7], предоставляя текст для создания встраивания, который можно было бы использовать для поиска подходящих клипов из репозитория встраиваний, созданном по приведенному выше примеру. 

    Общая сумма понесенных расходов = 1 текстовый запрос * 0,00007 USD = 0,00007 USD

  • Разработчик приложения выполняет следующие вызовы API к Amazon Bedrock: запрос к модели Writer’s Palmyra X5 для суммирования вводного потока из 10 000 токенов входного текста в итоговый поток из 2000 токенов.

    Общая стоимость = 10 000 токенов / 1000 * 0,003 USD + 2000 токенов / 1000 * 0,015 USD = 0,06 USD