ราคา Amazon Bedrock
-
การกำหนดราคาโมเดล
-
ฐานความรู้
-
กฎควบคุมระบบ
-
การประเมินโมเดล
-
ระบบอัตโนมัติข้อมูล
-
การกำหนดเส้นทางพร้อมท์อัจฉริยะ
-
การปรับเพิ่มประสิทธิภาพพร้อมท์
-
ค้นหาเว็บ
-
การกำหนดราคาโมเดล
-
การกำหนดราคาโมเดล
ราคาขึ้นอยู่กับรูปแบบ ผู้ให้บริการ และโมเดล โปรดเลือกผู้ให้บริการโมเดลเพื่อดูราคาโดยละเอียด
Amazon Bedrock รองรับระดับที่หลากหลาย ได้แก่ ระดับ Standard, Flex, Priority และ Reserved คลิกเพื่อเรียนรู้เพิ่มเติมเกี่ยวกับระดับต่าง ๆ ของบริการ
Amazon Bedrock นำเสนอโมเดลพื้นฐาน (FM) ที่เลือกจากผู้ให้บริการ AI ชั้นนำเช่น Anthropic, Meta, Mistral AI และ Amazon สำหรับการอนุมานแบบแบทช์ในราคาที่ต่ำกว่า 50% เมื่อเทียบกับราคาอนุมานแบบ On-Demand หากต้องการเรียนรู้เพิ่มเติมเกี่ยวกับแบตช์ ให้คลิกที่นี่ โปรดดูรายการโมเดลที่นี่
-
AI21 Labs
-
Amazon
-
Anthropic
-
Cohere
-
DeepSeek
-
Google
-
Luma AI
-
Meta
-
MiniMax AI
-
Mistral AI
-
Moonshot AI
-
NVIDIA
-
OpenAI
-
Qwen
-
Stability AI
-
TwelveLabs
-
Writer
-
xAI
-
Z AI
-
นำเข้าโมเดลที่กำหนดเอง
-
AI21 Labs
-
AI21 Labs
ราคาแบบ On-Demand
-
Amazon
-
-
Amazon Nova
-
Amazon Titan
-
Amazon อื่น ๆ
-
Amazon Nova
-
Amazon Nova
ราคาสำหรับโมเดลการทำความเข้าใจ
การอนุมานข้ามรีเจี้ยนทั่วโลก
การอนุมานข้ามภูมิภาคตามภูมิศาสตร์และในรีเจี้ยน
เครื่องมือในตัว
ราคาสำหรับโมเดลการสร้างเนื้อหาสร้างสรรค์
ราคาสำหรับโมเดลการสร้างและทำความเข้าใจคำพูด
ราคาแบบตามความต้องการสำหรับโมเดลพื้นฐานการแปลงคำพูดเป็นคำพูด
หมายเหตุ: *ราคาอินพุตและเอาต์พุตโทเค็นข้อความใช้กับกรณีการใช้งานเฉพาะ เช่น การถอดคำพูดเป็นข้อความ การเรียกใช้เครื่องมือเพื่อทำงานให้เสร็จสิ้นหรือสร้างพื้นฐานความรู้ การเพิ่มประวัติการสนทนาลงในเซสชัน ฯลฯ
การอนุมานตามความต้องการสำหรับโมเดล Nova ที่กำหนดเองมีราคาเท่ากับการอนุมานพื้นฐาน Nova
ราคาสำหรับโมเดลการฝัง
-
Amazon Titan
-
Amazon Titan
-
Amazon อื่น ๆ
-
-
-
Anthropic
-
**โมเดลที่ไม่ใช่ GA: การเข้าถึง Claude Mythos 5 และ Claude Mythos Preview ถูกจำกัดสิทธิ์และต้องได้รับอนุมัติ ติดต่อทีมบัญชี Anthropic ของคุณเพื่อขอสิทธิ์เข้าถึงบน Bedrock
Anthropic
ราคาแบบตามความต้องการและแบบแบตช์
โมเดลที่มีการเข้าถึงเพิ่มเติม
ผู้ให้บริการ ชื่อโมเดล ภูมิภาค ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M (แบตช์) ราคาต่อโทเค็นเอาต์พุต 1M (แบตช์) ราคาต่อโทเค็นอินพุต 1M (เขียนแคช) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) Anthropic Claude 3.5 Sonnet (การเข้าถึงแบบขยายสาธารณะมีผลบังคับใช้ตั้งแต่วันที่ 1 ธันวาคม 2025) สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ), สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (ไอร์แลนด์), ยุโรป (ซูริก), ยุโรป (ปารีส) 6.00 USD 30.00 USD 3.00 USD 15.00 USD ไม่มี ไม่มี Anthropic Claude 3.5 Sonnet v2 (การเข้าถึงแบบขยายสาธารณะมีผลบังคับใช้ตั้งแต่วันที่ 1 ธันวาคม 2025) สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ), สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน) 6.00 USD 30.00 USD 3.00 USD 15.00 USD 7.50 USD 0.60 USD ราคาระดับ Reserved
การอนุมานแบบเพิ่มประสิทธิภาพเวลาแฝง
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
โปรดติดต่อทีมงานบัญชีของคุณสำหรับราคา Provisioned Throughput
-
Cohere
-
Cohere
ค่าบริการแบบ On-Demand
โมเดล Cohere ราคาต่อการสืบค้น 1,000 รายการ** Rerank 3.5 2.00 USD **คุณจะถูกเรียกเก็บเงินตามจำนวนการสืบค้นโดยที่การสืบค้นหนึ่งรายการสามารถมีชิ้นส่วนเอกสารได้สูงสุด 100 ชิ้น หากการสืบค้นมีชิ้นส่วนเอกสารมากกว่า 100 ชิ้น จะนับเป็นการสืบค้นหลายรายการ ตัวอย่างเช่น หากคำขอมีเอกสาร 350 ฉบับ จะถือว่าเป็นการสืบค้น 4 รายการ โปรดทราบว่าเอกสารแต่ละฉบับสามารถมีโทเค็นได้สูงสุด 500 โทเค็นเท่านั้น (รวมถึงแบบสอบถามและโทเค็นทั้งหมดของเอกสาร) และหากความยาวโทเค็นสูงกว่า 512 โทเค็น จะแบ่งออกเป็นเอกสารหลายฉบับ *โทเค็นทั้งหมดที่ได้รับการฝึก = จำนวนโทเค็นในคลังข้อมูลการฝึก x จำนวน Epoch
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
โมเดล Cohere ราคาต่อชั่วโมงต่อโมเดล
โดยไม่มีสัญญาผูกมัดราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 1 เดือน ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 6 เดือน
Cohere Command
49.50 USD 39.60 USD
23.77 USD
Cohere Command - Light 8.56 USD 6.85 USD
4.11 USD ฝัง 3 ภาษาอังกฤษ 7.12 USD 6.76 USD
6.41 USD ฝัง 3 ภาษา 7.12 USD 6.76 USD
6.41 USD โปรดติดต่อทีมบัญชีหรือฝ่ายขายของ AWS ของคุณเพื่อขอดูรายละเอียดเพิ่มเติมเกี่ยวกับหน่วยโมเดล
-
DeepSeek
-
DeepSeek
ราคาแบบ On-Demand
-
มาตรฐาน
-
Priority
-
Flex
-
มาตรฐาน
-
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M DeepSeek v3.2 0.62 USD 1.85 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), อเมริกาใต้ (เซาเปาลู), เอเชียแปซิฟิก (จาการ์ตา) เอเชียแปซิฟิก (โตเกียว) และยุโรป (สตอกโฮล์ม)
โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M DeepSeek v3.2 0.74 USD 2.22 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M DeepSeek v3.1 0.5974 USD 1.7304 USD DeepSeek v3.2 0.6386 USD 1.9055 USD -
Priority
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M DeepSeek v3.1 1.0455 USD 3.0282 USD -
Flex
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M DeepSeek v3.1 0.2987 USD 0.8652 USD
-
-
Google
-
Google
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 4 31B 0.14 USD 0.40 USD Gemma 4 26B A4B 0.13 USD 0.40 USD Gemma 4 E2B 0.04 USD 0.08 USD Gemma 3 4B 0.04 USD 0.08 USD Gemma 3 12B 0.09 USD 0.29 USD Gemma 3 27B 0.23 USD 0.38 USD รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 4 31B 0.17 USD 0.48 USD Gemma 4 26B A4B 0.16 USD 0.48 USD Gemma 4 E2B 0.05 USD 0.10 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 3 4B 0.05 USD 0.09 USD Gemma 3 12B 0.11 USD 0.34 USD Gemma 3 27B 0.27 USD 0.45 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 3 4B 0.05 USD 0.10 USD Gemma 3 12B 0.11 USD 0.35 USD Gemma 3 27B 0.28 USD 0.46 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 3 4B 0.06 USD 0.12 USD Gemma 3 12B 0.14 USD 0.45 USD Gemma 3 27B 0.36 USD 0.59 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Gemma 3 4B 0.0412 USD 0.0824 USD Gemma 3 12B 0.0927 USD 0.2987 USD Gemma 3 27B 0.2369 USD 0.3914 USD * ราคาระดับ Priority สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard -
Luma AI
-
Luma AI
ราคาแบบ On-Demand
-
Meta
-
Meta
Llama 4
ราคาแบบตามความต้องการและแบบแบตช์
Llama 3.3
ราคาแบบตามความต้องการและแบบแบตช์
Llama 3.2
ราคาแบบ On-Demand และแบบ Batch
ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
Llama 3.1
ราคาแบบ On-Demand และแบบ Batch
ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
Llama 3
ราคาแบบ On-Demand
Llama 2
ราคาแบบ On-Demand
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดล Meta ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Llama 2 Chat (13B)
0.75 USD
1.00 USD
Llama 2 Chat (70B) 1.95 USD
2.56 USD ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)
โมเดล Meta ราคาสำหรับการฝึกโทเค็น 1M ราคาในการจัดเก็บโมเดลแบบกำหนดเองแต่ละโมเดล* ต่อเดือน ราคาเพื่อการอนุมานจากโมเดลที่กำหนดเองต่อ 1 หน่วยโมเดลต่อชั่วโมง (โดยไม่มีการกำหนดราคา อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โดยไม่มีสัญญาผูกมัด) Llama 2 Pretrained (13B)
1.49 USD
1.95 USD
23.50 USD
Llama 2 Pretrained (70B) 7.99 USD
1.95 USD 23.50 USD *พื้นที่จัดเก็บโมเดลแบบกำหนดเอง = 1.95 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
โมเดล Meta ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 1 เดือน ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 6 เดือน Llama 2 Pretrained และ Chat (13B)
21.18 USD
13.08 USD
Llama 2 Pretrained (70B) 21.18 USD
13.08 USD *โมเดล Llama 2 Pre-trained มีเฉพาะใน Provisioned Throughput หลังจากการปรับแต่งเท่านั้น
โปรดติดต่อทีมบัญชีหรือฝ่ายขายของ AWS ของคุณเพื่อขอดูรายละเอียดเพิ่มเติมเกี่ยวกับหน่วยโมเดล
-
MiniMax AI
-
MiniMax AI
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2 0.30 USD 1.20 USD Minimax M2.1 0.30 USD 1.20 USD MiniMax M2.5 0.30 USD 1.20 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2 0.35 USD 1.41 USD Minimax M2.1 0.36 USD 1.44 USD Minimax M2.5 0.36 USD 1.44 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2 0.36 USD 1.45 USD Minimax M2.1 0.36 USD 1.44 USD Minimax M2.5 0.36 USD 1.44 USD รีเจี้ยน: ยุโรป (ลอนดอน)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2 0.47 USD 1.86 USD Minimax M2.1 0.47 USD 1.86 USD Minimax M2.5 0.47 USD 1.86 USD รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม), เอเชียแปซิฟิก (จาการ์ตา)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2.1 0.36 USD 1.44 USD Minimax M2.5 0.36 USD 1.44 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Minimax M2 0.3090 USD 1.2360 USD Minimax M2.1 0.3090 USD 1.2360 USD Minimax M2.5 0.31 USD 1.24 USD * ราคาระดับ Priority สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard -
Mistral AI
-
Mistral AI
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.40 USD 2.00 USD Magistral Small 1.2 0.50 USD 1.50 USD Voxtral Mini 1.0 0.04 USD 0.04 USD Voxtral Small 1.0 0.10 USD 0.30 USD Ministral 3B 3.0 0.10 USD 0.10 USD Ministral 8B 3.0 0.15 USD 0.15 USD Ministral 14B 3.0 0.20 USD 0.20 USD Mistral Large 3 0.50 USD 1.50 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.48 USD 2.40 USD Magistral Small 1.2 0.59 USD 1.76 USD Voxtral Mini 1.0 0.05 USD 0.05 USD Voxtral Small 1.0 0.12 USD 0.35 USD Ministral 3B 3.0 0.12 USD 0.12 USD Ministral 8B 3.0 0.18 USD 0.18 USD Ministral 14B 3.0 0.24 USD 0.24 USD Mistral Large 3 0.59 USD 1.76 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.48 USD 2.40 USD Magistral Small 1.2 0.61 USD 1.82 USD Voxtral Mini 1.0 0.05 USD 0.05 USD Voxtral Small 1.0 0.12 USD 0.36 USD Ministral 3B 3.0 0.12 USD 0.12 USD Ministral 8B 3.0 0.18 USD 0.18 USD Ministral 14B 3.0 0.24 USD 0.24 USD Mistral Large 3 0.61 USD 1.82 USD รีเจี้ยน: ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.48 USD 2.40 USD Magistral Small 1.2 0.59 USD 1.76 USD Voxtral Mini 1.0 0.05 USD 0.05 USD Voxtral Small 1.0 0.12 USD 0.35 USD Ministral 3B 3.0 0.12 USD 0.12 USD Ministral 8B 3.0 0.18 USD 0.18 USD Ministral 14B 3.0 0.24 USD 0.24 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.62 USD 3.10 USD Magistral Small 1.2 0.78 USD 2.33 USD Voxtral Mini 1.0 0.06 USD 0.06 USD Voxtral Small 1.0 0.16 USD 0.47 USD Ministral 3B 3.0 0.16 USD 0.16 USD Ministral 8B 3.0 0.23 USD 0.23 USD Ministral 14B 3.0 0.31 USD 0.31 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.41 USD 2.06 USD Magistral Small 1.2 0.5150 USD 1.5450 USD Voxtral Mini 1.0 0.0412 USD 0.0412 USD Voxtral Small 1.0 0.1030 USD 0.3090 USD Ministral 3B 3.0 0.1030 USD 0.1030 USD Ministral 8B 3.0 0.1545 USD 0.1545 USD Ministral 14B 3.0 0.2060 USD 0.2060 USD Mistral Large 3 0.5150 USD 1.5450 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม)
โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Devstral 2 123B 0.48 USD 2.40 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard -
Moonshot AI
-
Moonshot AI
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Kimi K2 Thinking 0.60 USD 2.50 USD Kimi K2.5 0.60 USD 3.00 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ)
Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Kimi K2 Thinking 0.71 USD 2.94 USD Kimi K2.5 0.72 USD 3.60 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Kimi K2 Thinking 0.73 USD 3.03 USD Kimi K2.5 0.72 USD 3.60 USD รีเจี้ยน: ยุโรป (สตอกโฮล์ม), เอเชียแปซิฟิก (จาการ์ตา)
Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Kimi K2.5 0.72 USD 3.60 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Kimi K2 Thinking 0.6180 USD 2.5750 USD Kimi K2.5 0.6180 USD 3.0900 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard -
NVIDIA
-
NVIDIA
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.06 USD 0.23 USD NVIDIA Nemotron Nano 2 VL 0.20 USD 0.60 USD NVIDIA Nemotron 3 Nano 30B A3B 0.06 USD 0.24 USD NVIDIA Nemotron 3 Super 120B A12B 0.15 USD 0.65 USD รีเจี้ยน: AWS GovCloud (สหรัฐฯ ฝั่งตะวันออกและสหรัฐฯ ฝั่งตะวันตก)
โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.072 USD 0.276 USD NVIDIA Nemotron Nano 2 VL 0.240 USD 0.720 USD NVIDIA Nemotron 3 Nano 30B A3B 0.072 USD 0.288 USD NVIDIA Nemotron 3 Super 120B A12B 0.180 USD 0.780 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
NVIDIA models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.07 USD 0.27 USD NVIDIA Nemotron Nano 2 VL 0.24 USD 0.71 USD NVIDIA Nemotron 3 Nano 30B A3B 0.07 USD 0.28 USD NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.07 USD 0.28 USD NVIDIA Nemotron Nano 2 VL 0.24 USD 0.73 USD NVIDIA Nemotron 3 Nano 30B A3B 0.07 USD 0.29 USD NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD รีเจี้ยน: ยุโรป (ลอนดอน)
NVIDIA models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.09 USD 0.36 USD NVIDIA Nemotron Nano 2 VL 0.31 USD 0.93 USD NVIDIA Nemotron 3 Nano 30B A3B 0.09 USD 0.37 USD NVIDIA Nemotron 3 Super 120B A12B 0.23 USD 1.01 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron Nano 2 0.0618 USD 0.2369 USD NVIDIA Nemotron Nano 2 VL 0.2060 USD 0.6180 USD NVIDIA Nemotron 3 Nano 30B A3B 0.0618 USD 0.2472 USD NVIDIA Nemotron 3 Super 120B A12B 0.15 USD 0.67 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), ยุโรป (แฟรงก์เฟิร์ต) และยุโรป (สตอกโฮล์ม)
โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard -
OpenAI
-
OpenAI
-
โมเดลของ Frontier
-
gpt-oss-20b, 120b
-
gpt-oss-safeguard 20b, 120b
-
โมเดลของ Frontier
-
การอนุมานแบบ On-Demand ในรีเจี้ยน
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ)
ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M) โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M Daybreak Red: GPT-5.6 Cyber 13.75 USD 17.1875 USD 1.375 USD 82.50 USD - - - - Daybreak Blue: GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD GPT-5.5 5.50 USD - 0.55 USD 33.00 USD - - - - GPT-5.4 2.75 USD - 0.275 USD 16.50 USD - - - - รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)
ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M) โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD GPT-5.5 5.50 USD - 0.55 USD 33.00 USD - - - - GPT-5.4 2.75 USD - 0.275 USD 16.50 USD - - - - รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M) โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD GPT-5.4 2.75 USD - 0.275 USD 16.50 USD - - - - รีเจี้ยน: AWS GovCloud (สหรัฐฯ ฝั่งตะวันตก)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุตแคช 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT-5.4 3.30 USD 0.33 USD 19.80 USD หมายเหตุ: การอนุมานในรีเจี้ยนมีราคาเทียบเท่ากับระดับสถานที่จัดเก็บข้อมูลของ OpenAI การกำหนดราคาอนุมานข้ามรีเจี้ยนทั่วโลกจะมาเร็ว ๆ นี้
-
gpt-oss-20b, 120b
-
-
มาตรฐาน
-
Priority
-
Flex
-
Batch
-
การปรับแต่งโมเดล
-
มาตรฐาน
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M gpt-oss-20b 0.0721 USD 0.3090 USD gpt-oss-120b 0.1545 USD 0.6180 USD -
Priority
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M gpt-oss-20b 0.1262 USD 0.5408 USD gpt-oss-120b 0.2704 USD 1.0815 USD -
Flex
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M gpt-oss-20b 0.0361 USD 0.1545 USD gpt-oss-120b 0.0773 USD 0.3090 USD -
Batch
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M gpt-oss-20b 0.0361 USD 0.1545 USD gpt-oss-120b 0.0773 USD 0.3090 USD -
การปรับแต่งโมเดล
-
การปรับแต่งโมเดล
การกำหนดราคา Reinforcement Fine Tuning
ด้วยความสามารถในการปรับแต่งเพิ่มเติมการเสริมแรงใน Amazon Bedrock คุณสามารถปรับปรุงความแม่นยำของโมเดลได้โดยไม่ต้องมีความเชี่ยวชาญเชิงลึกด้านแมชชีนเลิร์นนิง หรือใช้ข้อมูลที่ติดป้ายกำกับจำนวนมาก Amazon Bedrock จะเปลี่ยนเวิร์กโฟลว์การปรับแต่งการเสริมแรงให้เป็นระบบอัตโนมัติ: ใช้พร้อมท์ของคุณ สร้างการตอบสนองแบบจำลอง และให้คะแนนโดยใช้ฟังก์ชันรางวัลของคุณ พร้อมท์ คำตอบ และคะแนนเหล่านี้ จะนำไปใช้ฝึกโมเดลของคุณผ่านเวิร์กโฟลว์ RFT แบบวนซ้ำ
เวิร์กโฟลว์การฝึกทั้งหมดจะถูกเรียกเก็บเป็นอัตราต่อชั่วโมง หลังจากการฝึกเสร็จสิ้นลูกค้าสามารถใช้โมเดลที่ปรับแต่งได้ทันทีเพื่ออนุมานแบบ On-Demand ตัวเลือกการอนุมานแบบ On-Demand ประกอบด้วยแบบจำลองการกำหนดราคาตามโทเค็นที่เรียกเก็บเงินตามจำนวนโทเค็นที่ประมวลผลระหว่างการอนุมาน
ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดล OpenAI ราคาต่อชั่วโมงการฝึก ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาในการจัดเก็บแต่ละโมเดลที่ผ่านการฝึกต่อเดือน gpt-oss-20b 80.00 USD 0.09 USD 0.39 USD 1.95 USD
-
-
gpt-oss-safeguard 20b, 120b
-
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT OSS Safeguard 20B 0.07 USD 0.20 USD GPT OSS Safeguard 120B 0.15 USD 0.60 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT OSS Safeguard 20B 0.08 USD 0.24 USD GPT OSS Safeguard 120B 0.18 USD 0.71 USD รีเจี้ยน: ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT OSS Safeguard 20B 0.08 USD 0.23 USD GPT OSS Safeguard 120B 0.18 USD 0.70 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT OSS Safeguard 20B 0.11 USD 0.31 USD GPT OSS Safeguard 120B 0.23 USD 0.93 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GPT OSS Safeguard 20B 0.0721 USD 0.2060 USD GPT OSS Safeguard 120B 0.1545 USD 0.6180 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard
-
-
Qwen
-
Qwen
-
Qwen3 Coder, 32B, 235B
-
Qwen 3 Next, VL, Coder Next
-
Qwen3 Coder, 32B, 235B
-
-
มาตรฐาน
-
Priority
-
Flex
-
Batch
-
การปรับแต่งโมเดล
-
มาตรฐาน
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Coder 30B A3B 0.1545 USD 0.6180 USD Qwen3 32B 0.1545 USD 0.6180 USD Qwen3 235B A22B 2507 0.2266 USD 0.9064 USD -
Priority
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Coder 30B A3B 0.2704 USD 1.0815 USD Qwen3 32B 0.2704 USD 1.0815 USD Qwen3 235B A22B 2507 0.3966 USD 1.5862 USD -
Flex
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Coder 30B A3B 0.0773 USD 0.3090 USD Qwen3 32B 0.0773 USD 0.3090 USD Qwen3 235B A22B 2507 0.1133 USD 0.4532 USD -
Batch
-
รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Coder 30B A3B 0.0773 USD 0.3090 USD Qwen3 32B 0.0773 USD 0.3090 USD Qwen3 235B A22B 2507 0.1133 USD 0.4532 USD -
การปรับแต่งโมเดล
-
การปรับแต่งโมเดล
การกำหนดราคา Reinforcement Fine Tuning
ด้วยความสามารถในการปรับแต่งเพิ่มเติมการเสริมแรงใน Amazon Bedrock คุณสามารถปรับปรุงความแม่นยำของโมเดลได้โดยไม่ต้องมีความเชี่ยวชาญเชิงลึกด้านแมชชีนเลิร์นนิง หรือใช้ข้อมูลที่ติดป้ายกำกับจำนวนมาก Amazon Bedrock จะเปลี่ยนเวิร์กโฟลว์การปรับแต่งการเสริมแรงให้เป็นระบบอัตโนมัติ: ใช้พร้อมท์ของคุณ สร้างการตอบสนองแบบจำลอง และให้คะแนนโดยใช้ฟังก์ชันรางวัลของคุณ พร้อมท์ คำตอบ และคะแนนเหล่านี้ จะนำไปใช้ฝึกโมเดลของคุณผ่านเวิร์กโฟลว์ RFT แบบวนซ้ำ
เวิร์กโฟลว์การฝึกทั้งหมดจะถูกเรียกเก็บเป็นอัตราต่อชั่วโมง หลังจากการฝึกเสร็จสิ้นลูกค้าสามารถใช้โมเดลที่ปรับแต่งได้ทันทีเพื่ออนุมานแบบ On-Demand ตัวเลือกการอนุมานแบบ On-Demand ประกอบด้วยแบบจำลองการกำหนดราคาตามโทเค็นที่เรียกเก็บเงินตามจำนวนโทเค็นที่ประมวลผลระหว่างการอนุมาน
ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Qwen ราคาต่อชั่วโมงการฝึก ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาในการจัดเก็บแต่ละรุ่นที่ผ่านการฝึกต่อเดือนน Qwen3 32B 80.00 USD 0.20 USD 0.78 USD 1.95 USD
-
-
Qwen 3 Next, VL, Coder Next
-
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Next 80B A3B 0.15 USD 1.20 USD Qwen3 VL 235B A22B 0.53 USD 2.66 USD Qwen3 Coder Next 0.50 USD 1.20 USD รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Next 80B A3B 0.18 USD 1.41 USD Qwen3 VL 235B A22B 0.62 USD 3.13 USD Qwen3 Coder Next 0.60 USD 1.44 USD รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Next 80B A3B 0.18 USD 1.45 USD Qwen3 VL 235B A22B 0.64 USD 3.22 USD Qwen3 Coder Next 0.60 USD 1.44 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Next 80B A3B 0.23 USD 1.86 USD Qwen3 VL 235B A22B 0.82 USD 4.12 USD Qwen3 Coder Next 0.78 USD 1.86 USD รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต) และเอเชียแปซิฟิก (จาการ์ตา)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Coder Next 0.60 USD 1.44 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Qwen3 Next 80B A3B 0.1545 USD 1.2360 USD Qwen3 VL 235B A22B 0.5459 USD 2.7398 USD Qwen3 Coder Next 0.5150 USD 1.2360 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard
-
-
Stability AI
-
Stability AI
ราคาแบบ On-Demand
โมเดลรูปภาพรุ่นก่อนหน้าที่ Stability AI นำเสนอจะมีราคาต่อภาพ ขึ้นอยู่กับจำนวนขั้นตอนและความละเอียดของภาพ
ภูมิภาค: โอเรกอน, เวอร์จิเนียฝั่งเหนือ, โอไฮโอ
บริการรูปภาพ Stability AI ราคาต่อการสร้างสำหรับแต่ละโมเดล ลบพื้นหลังด้วย Stable Image 0.07 USD วัตถุลบด้วย Stable Image 0.07 USD โครงสร้างการควบคุม Stable Image 0.07 USD ภาพร่างการควบคุม Stable Image 0.07 USD คู่มือรูปแบบ Stable Image 0.07 USD การค้นหาและแทนที่ Stable Image 0.07 USD การแก้ไขรายละเอียดด้วย Stable Image 0.07 USD การค้นหาและปรับสีใหม่ด้วย Stable Image 0.07 USD การถ่ายโอนรูปแบบ Stable Image 0.08 USD การอัปสเกลแบบคงรายละเอียดด้วย Stable Image 0.40 USD การอัปสเกลเชิงสร้างสรรค์ด้วย Stable Image 0.60 USD การอัปสเกลแบบรวดเร็วด้วย Stable Image 0.03 USD การเพิ่มรายละเอียดด้วย Stable Image 0.06 USD -
TwelveLabs
-
TwelveLabs
ราคาแบบ On-Demand
-
การอนุมานข้ามรีเจี้ยนทั่วโลก
-
การอนุมานข้ามภูมิภาคตามภูมิศาสตร์และในรีเจี้ยน
-
การอนุมานข้ามรีเจี้ยนทั่วโลก
-
-
การอนุมานข้ามภูมิภาคตามภูมิศาสตร์และในรีเจี้ยน
-
-
-
Writer
-
Writer
ราคาแบบ On-demand
โมเดล Writer ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M Palmyra X4 2.50 USD 10.00 USD Palmyra X5 0.60 USD 6.00 USD Palmyra Vision 7B 0.15 USD 0.60 USD -
xAI
-
xAI
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ xAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุตแคช 1M ราคาต่อโทเค็นเอาต์พุต 1M Grok 4.3 1.25 USD 0.20 USD 2.50 USD -
Z AI
-
Z AI
-
GLM 5
-
GLM 4.7
-
GLM 4.7 Flash
-
GLM 5
-
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 5 1.00 USD 3.20 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), อเมริกาใต้ (เซาเปาลู) และยุโรป (สตอกโฮล์ม)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 5 1.20 USD 3.84 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 5 1.55 USD 4.96 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 5 1.03 USD 3.30 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard -
GLM 4.7
-
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 0.60 USD 2.20 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), อเมริกาใต้ (เซาเปาลู) และยุโรป (สตอกโฮล์ม)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 0.72 USD 2.64 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 0.6180 USD 2.2660 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard -
GLM 4.7 Flash
-
ราคาแบบ On-Demand
รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 Flash 0.07 USD 0.40 USD GLM 5 1.00 USD 3.20 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (ไอร์แลนด์), ยุโรป (มิลาน), ยุโรป (สตอกโฮล์ม) และอเมริกาใต้ (เซาเปาลู)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 Flash 0.08 USD 0.48 USD รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม) และอเมริกาใต้ (เซาเปาลู)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 5 1.20 USD 3.84 USD รีเจี้ยน: ยุโรป (ลอนดอน)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 Flash 0.11 USD 0.62 USD GLM 5 1.55 USD 4.96 USD รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)
โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M GLM 4.7 Flash 0.0721 USD 0.4120 USD GLM 5 1.03 USD 3.30 USD * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
* ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard
-
-
นำเข้าโมเดลที่กำหนดเอง
-
นำเข้าโมเดลที่กำหนดเอง
-
Llama
-
Llama หลายรูปแบบ
-
Mistral
-
Mixtral
-
Flan
-
Qwen
-
OpenAI
-
Llama
-
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
-
Llama หลายรูปแบบ
-
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
-
Mistral
-
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
-
Mixtral
-
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
-
Flan
-
Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
การกำหนดราคาอนุมานตามความต้องการ:
คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดลBedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas
-
Qwen
-
ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD Region: ยุโรป (แฟรงก์เฟิร์ต)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
การกำหนดราคาอนุมานตามความต้องการ:
คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดลBedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas
-
OpenAI
-
ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v2.0 ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.1433 USD ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย
*เรียกเก็บเงินภายในกรอบเวลา 5 นาที
การกำหนดราคาอนุมานตามความต้องการ:
คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดลBedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas
-
-
-
ฐานความรู้
-
-
ฐานความรู้ที่มีการจัดการ
-
ฐานความรู้ที่มีการจัดการด้วยตนเอง
-
ฐานความรู้ที่มีการจัดการ
-
ฐานความรู้ที่มีการจัดการของ Amazon Bedrock
ฐานความรู้ที่มีการจัดการของ Amazon Bedrock ช่วยให้เจ้าหน้าที่ของคุณสามารถค้นหา พิจารณา และดึงข้อมูลที่ถูกต้องจากเอกสาร รูปภาพ เสียง และวิดีโอของคุณ โดยไม่ต้องจัดการโครงสร้างพื้นฐานใด ๆ โดยจะผสานรวมเข้ากับ Amazon Bedrock AgentCore อย่างราบรื่นสำหรับเวิร์กโหลด AI ของคุณ ไม่ว่าคุณจะเป็นนักพัฒนาที่มีประสบการณ์หรือสร้าง AI Agent ตัวแรกของคุณ ฐานความรู้ที่มีการจัดการจะจัดการกับการนำข้อมูลเข้า การวิเคราะห์แบบหลายรูปแบบ การจัดเก็บเวกเตอร์ และการดึงข้อมูลอัจฉริยะโดยอัตโนมัติ คุณจ่ายเฉพาะสำหรับสิ่งที่คุณเก็บและเรียกคืนเท่านั้น
มีอะไรรวมโดยไม่มีค่าใช้จ่ายเพิ่มเติม:
- การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ
- การสร้างการฝังด้วยโมเดลที่มีการจัดการ
- การจัดอันดับซ้ำด้วยตัวจัดอันดับแบบมีการจัดการ
หมายเหตุ: จะมีค่าธรรมเนียมการเรียกใช้เครื่องมือ Standard Gateway หากคุณเรียกใช้ฐานความรู้ที่มีการจัดการผ่าน AgentCore Gateway จะมีค่าบริการตามอัตรา CloudWatch แบบ Standard หากเปิดใช้งานข้อมูลการสังเกตได้
คุณสมบัติ คำอธิบาย ราคา การจัดเก็บดัชนี
ดัชนีการค้นหาที่มีการจัดการด้วยตัวเชื่อมต่อดั้งเดิมเพื่อซิงค์ข้อมูลจาก S3, SharePoint, Confluence และอื่น ๆ 5.00 USD ต่อ GB ของข้อมูลดิบ/เดือน
การแยกวิเคราะห์เอกสารแบบหลายรูปแบบ (ตัวแยกข้อมูลที่มีการจัดการ)
วิเคราะห์ข้อความ, ไฟล์, PDF, รูปภาพ, ตาราง, เสียง และวิดีโอเป็นเนื้อหาที่ค้นหาได้
0 USD การสร้างการฝังตัว (โมเดลที่มีการจัดการ)
แปลงเนื้อหาของคุณเป็นเวกเตอร์ที่ค้นหาได้โดยใช้โมเดลในตัว
0 USD Standard Retrieval (Retrieve API)
การค้นหาแบบไฮบริดรวมการค้นหาเชิงความหมายและการค้นหาคำหลักบนเนื้อหาที่จัดทำดัชนีของคุณ
1.00 USD ต่อการเรียกใช้ API 1,000 ครั้ง
จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)*
จัดเรียงลำดับข้อความที่ดึงมาใหม่ตามความเกี่ยวข้อง
0 USD การดึงข้อมูลแบบเอเจนติก - การวางแผน LLM ที่มีการจัดการ**
การดึงข้อมูลแบบมัลติฮอปโดยใช้ LLM ในตัวสำหรับการวางแผนการสืบค้น
4.00 USDต่อการเรียกใช้ Agentic Retrieve API 1,000 ครั้ง + 1.00 USD ต่อ 1,000 การเรียกใช้ Retrieve API พื้นฐาน * มีค่าใช้จ่ายเพิ่มเติมหากคุณเลือกโมเดลที่คุณกำหนดเองสำหรับการสร้างการฝังหรือจัดอันดับซ้ำ โปรดดูราคาในส่วนผู้ให้บริการโมเดล
** สำหรับการดึงข้อมูลของ Agentic กับ LLM ที่คุณเลือก คุณจะจ่ายเงิน 1.00 USD ต่อการเรียกใช้ Retrieve API 1,000 ครั้ง และราคาผู้ให้บริการแบบจำลองสำหรับ LLM ที่ใช้สำหรับการวางแผนแบบสอบถาม
-
ฐานความรู้ที่มีการจัดการด้วยตนเอง
-
การดึงข้อมูลที่มีโครงสร้าง (การสร้าง SQL)
การดึงข้อมูลที่มีโครงสร้างจะถูกเรียกเก็บเงินสำหรับคำขอแต่ละรายการเพื่อสร้างการสืบค้น SQL การสืบค้น SQL ที่สร้างขึ้นจะใช้เพื่อดึงข้อมูลจากที่เก็บข้อมูลที่มีโครงสร้าง
โมเดล Rerank
โมเดล Rerank ได้รับการออกแบบมาเพื่อปรับปรุงความเกี่ยวข้องและความแม่นยำของการตอบสนองในแอปพลิเคชันการดึงข้อมูลเพื่อการสร้างแบบเสริม (RAG) มีการเรียกเก็บเงินต่อการสืบค้น
**คุณจะถูกเรียกเก็บเงินตามจำนวนการสืบค้นโดยที่การสืบค้นหนึ่งรายการสามารถมีชิ้นส่วนเอกสารได้สูงสุด 100 ชิ้น หากการสืบค้นมีชิ้นส่วนเอกสารมากกว่า 100 ชิ้น จะนับเป็นการสืบค้นหลายรายการ ตัวอย่างเช่น หากคำขอมีเอกสาร 350 ฉบับ จะถือว่าเป็นการสืบค้น 4 รายการ โปรดทราบว่าเอกสารแต่ละฉบับสามารถมีโทเค็นได้สูงสุด 512 โทเค็นเท่านั้น (รวมถึงการสืบค้นและโทเค็นทั้งหมดของเอกสาร) และหากความยาวโทเค็นสูงกว่า 512 โทเค็น จะแบ่งออกเป็นเอกสารหลายฉบับ การสืบค้นเทียบเท่ากับหน่วยค้นหา
-
-
กฎควบคุมระบบ
-
กฎควบคุมระบบ Amazon Bedrock
การกำหนดราคาสำหรับ Amazon Bedrock Guardrails ขึ้นอยู่กับค่าใช้จ่ายที่เกิดขึ้นจากตัวกรองที่ใช้ในกฎควบคุมระบบ ราคาจะเหมือนกันสำหรับทั้งระดับ Standard และระดับ Classic
การป้องกัน/การกรอง Bedrock Guardrails*
ราคา
ตัวกรองเนื้อหาสำหรับทั้งระดับ Standard และระดับ Classic (เนื้อหาข้อความ) 0.15 USD ต่อ 1,000 หน่วยข้อความ
ตัวกรองเนื้อหา (เนื้อหาภาพ)
0.00075 USD ต่อภาพที่ประมวลผล
หัวข้อปฏิเสธสำหรับทั้งระดับ Standard และระดับ Classic
0.15 USD ต่อ 1,000 หน่วยข้อความ
ตัวกรองข้อมูลที่ละเอียดอ่อน
0.10 USD ต่อ 1,000 หน่วยข้อความ
ตัวกรองข้อมูลที่ละเอียดอ่อน (นิพจน์ปกติ)
ฟรี
ตัวกรองคำ
ฟรี
การตรวจสอบกราวด์ดิ้งตามบริบท**
0.10 USD ต่อ 1,000 หน่วยข้อความ
การตรวจสอบการให้เหตุผลอัตโนมัติ
0.17 USD ต่อ 1,000 หน่วยข้อความ ต่อนโยบายการให้เหตุผลอัตโนมัติ
ตารางด้านล่างแสดงราคาสำหรับ Bedrock Guardrails เมื่อใช้กับ InvokeGuardRailChecks API
การป้องกัน/การกรอง Bedrock Guardrails*
ราคา
ตัวกรองเนื้อหา (เนื้อหาข้อความเท่านั้น) 0.07 USD ต่อ 1,000 หน่วยข้อความ
การโจมตีพร้อมท์ (เนื้อหาข้อความเท่านั้น) ***
0.08 USD ต่อ 1,000 หน่วยข้อความ
ตัวกรองข้อมูลที่ละเอียดอ่อน
0.10 USD ต่อ 1,000 หน่วยข้อความ
ราคาแบบ On-Demand
* นโยบายกฎควบคุมระบบแต่ละข้อเป็นทางเลือกและสามารถเปิดใช้งานได้ตามความต้องการของแอปพลิเคชันของคุณ ค่าธรรมเนียมจะเกิดขึ้นตามการป้องกันที่ใช้ ตัวอย่างเช่น หากคุณใช้งานตัวกรองเนื้อหาและตัวกรองข้อมูลที่มีความละเอียดอ่อน จะมีค่าบริการเกิดขึ้นเฉพาะตัวกรองทั้งสองประเภทนี้เท่านั้น โดยไม่มีค่าบริการใด ๆ สำหรับตัวกรองประเภทอื่น
** การตรวจสอบกราวด์ดิ้งตามบริบทใช้แหล่งอ้างอิงและการสืบค้นเพื่อตรวจสอบว่าการตอบสนองของโมเดลมีพื้นฐานตามแหล่งที่มาและเกี่ยวข้องกับการสืบค้นหรือไม่ จำนวนหน่วยข้อความทั้งหมดที่เรียกเก็บเงินจะถูกคำนวณโดยการรวมอักขระทั้งหมดในแหล่งที่มาการสืบค้นและการตอบสนองแบบจำลอง
*** ด้วย InvokeGuardRailChecks API คุณสามารถใช้ตัวกรองการโจมตีแบบพร้อมท์แยกต่างหากนอกตัวกรองเนื้อหา การแยกนี้สามารถใช้ได้กับ API นี้เท่านั้น
หมายเหตุ: หน่วยข้อความสามารถมีตัวอักษรได้สูงสุด 1,000 ตัวอักษร หากการป้อนข้อความมีมากกว่า 1000 ตัวอักษรจะถูกประมวลผลเป็นหน่วยข้อความหลายหน่วยโดยแต่ละตัวมีตัวอักษร 1000 ตัวหรือน้อยกว่า ตัวอย่างเช่น หากการป้อนข้อความมีอักขระ 5,600 ตัว จะถูกเรียกเก็บค่าใช้จ่ายสำหรับหน่วยข้อความ 6 หน่วย -
การประเมินโมเดล
-
การประเมินโมเดล
จะมีการเรียกเก็บค่าบริการการประเมินโมเดลสำหรับการอนุมานจากแบบจำลองที่คุณเลือก คะแนนอัลกอริทึมที่สร้างขึ้นโดยอัตโนมัติจะให้บริการโดยไม่มีค่าใช้จ่ายเพิ่มเติม สำหรับการประเมินด้วยมนุษย์ที่คุณนำเวิร์กสตรีมของคุณมาเอง คุณจะถูกเรียกเก็บสำหรับการอนุมานโมเดลในการประเมิน และคิดค่าใช้จ่าย 0.21 USD ต่องานของมนุษย์ที่เสร็จสมบูรณ์
หากคุณใช้การประเมินผล RAG หรือ LLM-as-a-Judge ในการประเมินโมเดล จะมีการเรียกเก็บค่าบริการสำหรับโทเค็นที่โมเดลตัดสินที่ใช้ตามราคาระดับ Standard แบบ On-Demand พร้อมท์ตัดสินจะถูกคิดค่าบริการรวมอยู่ในปริมาณการใช้งานโทเค็นของคุณ และสามารถเข้าดูรายละเอียดได้ในเอกสารสาธารณะ การประเมิน RAG บนฐานความรู้ Bedrock ยังมีค่าใช้จ่ายในการใช้งานปกติจากฐานความรู้ Bedrock
รุ่น
ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ
ราคาต่อโทเค็นเอาต์พุต 1,000 รายการ
ค่าบริการต่องานของมนุษย์
แบบจำลองที่เลือกสำหรับการประเมิน
ขึ้นอยู่กับโมเดลที่เลือก
ขึ้นอยู่กับโมเดลที่เลือก
0.21 USD
-
ระบบอัตโนมัติข้อมูล
-
Data Automation
Amazon Bedrock Data Automation เปลี่ยนเนื้อหาแบบหลายรูปแบบที่ไม่มีโครงสร้างเป็นรูปแบบข้อมูลที่มีโครงสร้างสำหรับกรณีการใช้งาน เช่น การประมวลผลเอกสารอัจฉริยะ การวิเคราะห์วิดีโอและ RAG Bedrock Data Automation สามารถสร้างเนื้อหาเอาต์พุตมาตรฐานโดยใช้ค่าเริ่มต้นที่กำหนดไว้ล่วงหน้าซึ่งเฉพาะรูปแบบเฉพาะ เช่น คำอธิบายวิดีโอแต่ละฉาก การถอดเสียงหรือการวิเคราะห์เอกสารอัตโนมัติ นอกจากนี้ ลูกค้ายังสามารถสร้างเอาต์พุตที่กำหนดเองได้โดยระบุข้อกำหนดเอาต์พุตในพิมพ์เขียวตามรูปแบบข้อมูลของตนเอง ซึ่งจากนั้นสามารถโหลดลงในฐานข้อมูลหรือคลังข้อมูลที่มีอยู่ได้อย่างง่ายดาย Bedrock Data Automation ยังสามารถใช้เพื่อวิเคราะห์เนื้อหาสำหรับแอปพลิเคชัน RAG ได้ ผ่านการผสานการทำงานกับฐานความรู้ ซึ่งช่วยปรับปรุงความแม่นยำและความเกี่ยวข้องของผลลัพธ์ด้วยการรวมข้อมูลที่ฝังอยู่ในทั้งรูปภาพและข้อความ
ฐานความรู้ของ Amazon Bedrock นำเสนอการผสานรวมระบบอัตโนมัติข้อมูล Bedrock เพื่อให้การตอบสนองที่เกี่ยวข้องและแม่นยำยิ่งขึ้นสำหรับข้อมูลหลายรูปแบบ เมื่อตั้งค่าฐานความรู้ คุณสามารถเลือกระบบอัตโนมัติข้อมูล Bedrock เป็นวิธีการแยกวิเคราะห์เพื่อวิเคราะห์และดึงข้อมูลเชิงลึกที่มีความหมายจากรูปภาพหรือเอกสาร ซึ่งอาจรวมถึงตัวเลข แผนภูมิ และไดอะแกรม ในระหว่างการประมวลผล ระบบอัตโนมัติข้อมูล Bedrock จะดึงข้อมูลที่มีความหมายจากเอกสารและรูปภาพที่ป้อนเข้าไป ซึ่งต่อมาจะถูกนำไปใช้ในขั้นตอนฐานความรู้ในลำดับถัดมาเพื่อทำการตัด การฝัง และการจัดเก็บ เมื่อผสานรวมเข้ากับฐานความรู้แล้ว ระบบอัตโนมัติข้อมูล Bedrock จะส่งมอบผลลัพธ์และคิดค่าบริการสำหรับผลลัพธ์ที่ได้มาตรฐานนั้น
-
การกำหนดเส้นทางพร้อมท์อัจฉริยะ
-
จุดราคา ขอบเขตราคา แผนราคา การกำหนดเส้นทางพร้อมท์อัจฉริยะ 1 USD ต่อ 1,000 คำขอ On-Demand การกำหนดเส้นทางพร้อมท์อัจฉริยะ
การกำหนดเส้นทางพร้อมท์อัจฉริยะช่วยให้คุณสามารถใช้การผสมผสานโมเดลพื้นฐาน (FM) จากตระกูลโมเดลเดียวกันเพื่อช่วยเพิ่มประสิทธิภาพในด้านคุณภาพและต้นทุน ตัวอย่างเช่น ด้วยตระกูลโมเดล Claude ของ Anthropic, Amazon Bedrock สามารถกำหนดเส้นทางคำขอระหว่าง Claude 3.5 Sonnet และ Claude 3 Haiku ได้อย่างชาญฉลาดขึ้นอยู่กับความซับซ้อนของพร้อมท์ ในทำนองเดียวกัน Amazon Bedrock สามารถกำหนดเส้นทางคำขอระหว่าง Meta Llama 3.3 70B และ 3.18B และ Nova Pro และ Nova Lite เราเตอร์พร้อมท์จะทำนายว่าโมเดลใดจะให้ประสิทธิภาพที่ดีที่สุดสำหรับแต่ละคำขอ พร้อมทั้งช่วยเพิ่มประสิทธิภาพคุณภาพการตอบสนองและต้นทุน สิ่งนี้มีประโยชน์อย่างยิ่งสำหรับแอปพลิเคชัน เช่น ผู้ช่วยฝ่ายบริการลูกค้า ที่สามารถจัดการกับข้อสอบถามที่ไม่ซับซ้อนได้โดยใช้โมเดลที่เล็กกว่า เร็วกว่า และคุ้มต้นทุนมากกว่า ขณะที่ข้อสอบถามที่ซับซ้อนจะถูกส่งต่อไปยังโมเดลที่มีความสามารถมากกว่า การกำหนดเส้นทางพร้อมท์อัจฉริยะสามารถลดต้นทุนได้ถึง 30 เปอร์เซ็นต์โดยไม่กระทบต่อความแม่นยำ
-
การปรับเพิ่มประสิทธิภาพพร้อมท์
-
การปรับเพิ่มประสิทธิภาพพร้อมท์สำหรับ Amazon Bedrock
Amazon Bedrock นำเสนอเครื่องมือเพิ่มประสิทธิภาพที่รวดเร็วสองตัว
เครื่องมือเพิ่มประสิทธิภาพพร้อมท์อย่างง่าย
เครื่องมือเพิ่มประสิทธิภาพพร้อมใช้งานง่ายด้วยการคลิกเพียงครั้งเดียวในสนามเด็กเล่นและตัวจัดการพร้อมท์ นอกจากนี้ยังสามารถใช้ได้ผ่าน OptimizePrompt API คุณจะถูกเรียกเก็บเงินสำหรับจำนวนโทเค็นพร้อมท์อินพุตทั้งหมดและพร้อมท์ที่ผ่านการปรับแต่งให้เหมาะสมแล้วเท่านั้น ราคาคือ 0.03 USD ต่อ 1,000 โทเค็นAdvanced Prompt Optimizer
Advanced Prompt Optimization ของ Bedrock มีอยู่ในส่วน Advanced Prompt Optimization ของ Bedrock Conole และ CreateAdvancedPromptopTimizationJob API คุณจะถูกเรียกเก็บเงินสำหรับโทเค็นระดับ Standard แบบ On-Demand ที่ใช้ในการเพิ่มประสิทธิภาพ ในการประเมินการใช้งานของคุณ สิ่งต่อไปนี้เป็นสิ่งสำคัญ: เครื่องมือเพิ่มประสิทธิภาพพร้อมท์ใช้ LLM เป็นผู้เขียนใหม่และประเมินผลที่ทำงานในลูปซ้ำระหว่างการอนุมานการประเมินและการเขียนใหม่ ใช้สมการต่อไปนี้เพื่อประมาณต้นทุนของคุณ โดยที่ N = จำนวนบันทึกชุดข้อมูลในชุดข้อมูลการประเมินของคุณสำหรับเทมเพลตพร้อมท์แต่ละเทมเพลต P คือจำนวนโทเค็นอินพุตในเทมเพลตพร้อมท์ของคุณ O = จำนวนโทเค็นเอาต์พุตแบบจำลองเป้าหมายโดยประมาณ, G = จำนวนโทเค็นการตอบสนองอ้างอิงความจริงพื้นฐานตัวประเมินฟังก์ชัน Lambda: หากคุณเลือกที่จะนำฟังก์ชัน Lambda มาเป็นใช้เป็นตัวประเมิน คุณสามารถใช้สูตรต่อไปนี้เพื่อประมาณโทเค็นและต้นทุนรวมทั้งหมดต่อเทมเพลตพร้อมท์:
การเรียกร้องแลมบ์ดาต่อเทมเพลตพร้อมท์ = 16* N
จำนวนโทเค็นรุ่นเป้าหมายทั้งหมด = 16* N* (P+O)
จำนวนโทเค็นอินพุต LLM ของตัวเพิ่มประสิทธิภาพ (ปัจจุบัน Anthropic Claude Sonnet 4.6) = 101 * (3700+0.35P)ตัวประเมิน LLM-as-a-Judge: หากคุณเลือกตัวเลือก LLM-as-a-Judge หรือเกณฑ์การควบคุมภาษาธรรมชาติ คุณสามารถใช้สูตรต่อไปนี้เพื่อประมาณโทเค็นรวมทั้งหมดต่อเทมเพลตพร้อมท์ จำนวนโทเค็นโมเดลเป้าหมายทั้งหมด = 16*N* (P+O)
จำนวนโทเค็นอินพุต LLM ของตัวเพิ่มประสิทธิภาพ (ปัจจุบัน Anthropic Claude Sonnet 4.6) = 101 * (3700+0.35P)
จำนวนโทเค็น LLMJudge = 16* N* (P+O+G + พร้อมท์ตัดสิน)หมายเหตุ: นี่คือคุณสมบัติ AI ช่วยสร้าง จำนวนโทเค็นเอาต์พุตที่แน่นอนจะไม่ทราบจนกว่าจะมีการรันไทม์ และแตกต่างกันไปตามที่พร้อมท์ที่ออกแบบมาเพื่อเอาต์พุต
-
ค้นหาเว็บ
-
ค้นหาเว็บ
การค้นหาเว็บช่วยให้โมเดลและเอเจนต์ของคุณดึงข้อมูลปัจจุบันจากเว็บเพื่อตอบสนองพื้นฐาน ในเนื้อหาที่ทันสมัย คุณจะถูกเรียกเก็บเงินต่อการสืบค้น โดยที่แบบสอบถามแสดงถึงคำขอค้นหาเว็บเดียว
ตัวอย่างราคา
-
AI21 Labs
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Jurrasic-2 Mid ของ AI21 สรุปการป้อนข้อความอินพุต 10,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000 * 0.0125 USD + 2,000 โทเค็น/1,000 * 0.0125 USD = 0.15 USD
-
Amazon
ค่าบริการแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Amazon Titan Text – Lite สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.0003 USD + 1,000 โทเค็น/1,000 * 0.0004 USD = 0.001 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดลพื้นฐาน Amazon Titan Image Generator สร้างภาพขนาด 1024 x 1024 ในขนาดคุณภาพ Standard จำนวน 1,000 ภาพ
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1,000 ภาพ* 0.01 USD ต่อภาพ = 10 USD
ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียดและการฝึกล่วงหน้าอย่างต่อเนื่อง)
นักพัฒนาแอปพลิเคชันปรับแต่งโมเดล Amazon Titan Image Generator โดยใช้คู่รูปภาพและข้อความ 1,000 คู่ หลังการฝึก นักพัฒนาจะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ ที่เป็นโมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง
ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียด= การฝึกการปรับแต่งอย่างละเอียด (0.005 USD * 500 * 64) โดยที่ 0.005 USD คือราคาต่อภาพที่เห็น 500 คือจำนวนขั้นตอน และ 64 คือขนาดแบทช์ + พื้นที่จัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงของการอนุมานโมเดลแบบกำหนดเอง (21 USD) = 160 USD + 1.95 USD + 21 = 182.95 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Amazon Titan Text Express สองหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ
ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น = 2 หน่วยโมเดล* 18.40 USD/ชั่วโมง* 24 ชั่วโมง* 31 วัน = 27,379.20 USD
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Amazon Titan Image Generator พื้นฐานหนึ่งหน่วยพร้อมสัญญา 1 เดือน
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 หน่วยโมเดล * 16.20 USD * 24 ชั่วโมง* 31 วัน = 12,052.80 USD
-
กฎควบคุมระบบ Amazon Bedrock
ตัวอย่างที่ 1: แชทบอทสนับสนุนลูกค้า
ผู้พัฒนาแอปพลิเคชันสร้างแชทบอทสนับสนุนลูกค้าและใช้ตัวกรองเนื้อหาเพื่อบล็อกเนื้อหาที่เป็นอันตรายและหัวข้อที่ปฏิเสธเพื่อกรองคำสืบค้นและการตอบสนองที่ไม่พึงประสงค์
แชทบอทให้บริการแบบสอบถามผู้ใช้จำนวน 1000 รายการต่อชั่วโมง แบบสอบถามผู้ใช้แต่ละรายการมีความยาวป้อนข้อมูลเฉลี่ย 200 ตัวอักษรและได้รับการตอบสนอง FM 1500 ตัวอักษร
แบบสอบถามผู้ใช้แต่ละตัวที่มีตัวอักษร 200 ตัวสอดคล้องกับ 1 หน่วยข้อความ
การตอบสนอง FM แต่ละตัวที่มีตัวอักษร 1,500 ตัวสอดคล้องกับ 2 หน่วยข้อความ
หน่วยข้อความที่ประมวลผลในแต่ละชั่วโมง = (1 + 2) * 1,000 การสืบค้น = 3,000 หน่วยข้อความ
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นต่อชั่วโมงสำหรับตัวกรองเนื้อหาและหัวข้อที่ถูกปฏิเสธ = 3,000 * (0.15 USD + 0.15 USD) / 1,000 = 0.90 USDตัวอย่างที่ 2: การสรุปผลการถอดเสียงคอลเซ็นเตอร์
ผู้พัฒนาแอปพลิเคชันสร้างแอปพลิเคชันเพื่อสรุปการถอดรหัสการแชทระหว่างผู้ใช้และเจ้าหน้าที่สนับสนุน ใช้ตัวกรองข้อมูลที่ละเอียดอ่อนเพื่อแก้ไขข้อมูลที่ระบุตัวตนของบุคคลได้ (PII) ในสรุปที่สร้างขึ้นสำหรับการสนทนา 10,000 รายการ
สรุปที่สร้างขึ้นแต่ละตัวมีตัวอักษรเฉลี่ย 3,500 ตัวซึ่งสอดคล้องกับ 4 หน่วยข้อความ
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นในการสรุป 10,000 บทสนทนา = 10000 * 4 * (0.1 USD/1000) = 4 USDตัวอย่างที่ 3: เครื่องมือตรวจสอบโปรโตคอลทางการแพทย์
บริษัทเทคโนโลยีการดูแลสุขภาพใช้การตรวจสอบเหตุผลอัตโนมัติในระบบสนับสนุนการตัดสินใจทางคลินิกเพื่อตรวจสอบคำแนะนำการรักษาตามแนวทางการแพทย์ระบบประมวลผลผู้ป่วย 5,000 เคสต่อเดือน โดยแต่ละเคสมีการใช้งานดังนี้:
- สรุปข้อมูลผู้ป่วย: 500 อักขระ (1 หน่วยข้อความ)
- การประเมินการวินิจฉัย: 2,000 อักขระ (2 หน่วยข้อความ)
- คำแนะนำในการรักษา: 4,500 อักขระ (5 หน่วยข้อความ)
หน่วยข้อความที่ประมวลผลต่อเดือน = (1 + 2 + 5) 5,000 เคส = 40,000 หน่วยข้อความ
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นต่อเดือนสำหรับการตรวจสอบการให้เหตุผลอัตโนมัติ = 40,000 (0.17 USD)/1000 = 6.80 USD -
ฐานความรู้สำหรับ Amazon Bedrock
ตัวอย่างค่าบริการ
ตัวอย่างที่ 1: แชทบอทสนับสนุนลูกค้า (ใช้ Standard Retrieval))
คุณจัดทำดัชนีเนื้อหา 50 GB จากไซต์ SharePoint ของคุณ ซึ่งมีเอกสารประมาณ 100,000 รายการ รวมถึง PDF, งานนำเสนอ, ไฟล์ Word และรูปภาพ เอเจนต์ของคุณจัดการการสืบค้นการดึงข้อมูลมาตรฐาน 100,000 รายการต่อเดือน
รายการสินค้า การคำนวณ ค่าใช้จ่าย การจัดเก็บดัชนี
50 กิกะบิต× 5.00 USD
250.00 USD
การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ
สิ่งที่รวมอยู่ด้วย
0 USD การสร้างการฝังตัว (โมเดลที่มีการจัดการ)
สิ่งที่รวมอยู่ด้วย
0 USD Standard Retrieval
100,000 ÷ 1,000 × 1.00 USD
100.00 USD
จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)
สิ่งที่รวมอยู่ด้วย
0 USD รายเดือนทั้งหมด 350.00 USD ตัวอย่างที่ 2: ผู้ช่วยวิจัยองค์กร (ใช้ Agentic Retrieval)
คุณจัดทำดัชนีเนื้อหา 50 GB จากไซต์ SharePoint ของคุณ ซึ่งมีเอกสารประมาณ 100,000 รายการ รวมถึง PDF, งานนำเสนอ, ไฟล์ Word และรูปภาพ เจ้าหน้าที่ของคุณจัดการการเรียกใช้ Agentic Retrieve จำนวน 100,000 ครั้งต่อเดือน โดยเฉลี่ยแล้วการเรียกใช้แต่ละครั้งจะทำการเรียกใช้ Receive API พื้นฐาน 2 ครั้ง
รายการสินค้า การคำนวณ ค่าใช้จ่าย การจัดเก็บดัชนี
50 กิกะบิต × 5.00 USD
250.00 USD
การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ
สิ่งที่รวมอยู่ด้วย 0 USD การสร้างการฝังตัว (โมเดลที่มีการจัดการ)
สิ่งที่รวมอยู่ด้วย 0 USD การเรียกใช้ Agentic Retrieve API
100,000 ÷ 1,000 × 4.00 USD
400.00 USD
การเรียกใช้ Retrieve APIพื้นฐาน
(100,000 × 2) ÷ 1,000 × 1.00 USD
200.00 USD
จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)
สิ่งที่รวมอยู่ด้วย 0 USD รายเดือนทั้งหมด 850.00 USD -
Anthropic
ค่าบริการแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock ใน Region สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน) คือ คำขอให้โมเดล Claude ของ Anthropic สรุปการป้อนข้อความอินพุต 11,000 โทเค็นเป็นเอาต์พุต 4,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 11,000 โทเค็น/1,000 * 0.008 USD + 4,000 โทเค็น/1,000 * 0.024 USD = 0.088 USD + 0.096 USD = 0.184 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดลของ Anthropic Claude Instant หนึ่งหน่วยใน Region สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)
ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น= 1 หน่วยโมเดล* 39.60 USD * 24 ชั่วโมง* 31 วัน = 29,462.40 USD
-
Cohere
ค่าบริการแบบ On-Demand
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Command ของ Cohere สรุปการป้อนข้อความอินพุต 6,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 6,000 โทเค็น/1,000 * 0.0015 USD + 2,000 โทเค็น/1,000 * 0.0020 USD = 0.013 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Command-Light ของ Cohere สรุปการป้อนข้อความอินพุต 6,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 6,000 โทเค็น/1,000 * 0.0003 USD + 2,000 โทเค็น/1,000 * 0.0006 USD = 0.003 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอให้ทั้ง Embed ภาษาอังกฤษหรือโมเดลหลายภาษาของ Cohere สร้างการฝังสำหรับอินพุต 10,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000* 0.0001 USD = 0.001 USD
ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียด)
นักพัฒนาแอปพลิเคชันปรับแต่งโมเดลคำสั่ง Cohere โดยใช้ข้อมูล 1,000 โทเค็น หลังการฝึก จะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้ อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง
ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียดคือ การฝึกปรับแต่งอย่างละเอียด (0.004 USD * 1000) + การจัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงการอนุมานโมเดลแบบกำหนดเอง(49.50 USD) = 55.45 USD
ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) ของโมเดลแบบกำหนดเอง = 39.60 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Cohere Command หนึ่งหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ
ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น= 1 หน่วยโมเดล* 39.60 USD * 24 ชั่วโมง* 31 วัน = 29,462.40 USD
-
นำเข้าโมเดลที่กำหนดเอง
ตัวอย่างราคา: นักพัฒนาแอปพลิเคชันนำเข้าประเภทโมเดล Llama 3.1 ที่กำหนดเองที่มีขนาดพารามิเตอร์ 8B ที่มีความยาวลำดับ 128K ในรีเจี้ยน us-east-1 และลบโมเดลหลังจากผ่านไป 1 เดือน ซึ่งต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ดังนั้น ราคาต่อนาทีจะเท่ากับ 0.1570 USD เนื่องจากต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ค่าใช้จ่ายสำหรับพื้นที่จัดเก็บโมเดลสำหรับหน่วยโมเดลแบบกำหนดเอง 2 หน่วยจะอยู่ที่ 3.90 USD ต่อเดือน
ไม่มีค่าใช้จ่ายในการนำเข้าโมเดล การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จคือเวลา 8:03 น. ซึ่งเวลาดังกล่าว การวัดจะเริ่มขึ้น การวัดช่วงเวลา 5 นาทีจะตั้งแต่ 8:03 น. - 8:07 น.; 8:07 น. - 8:11 น. เป็นต้น หากมีการเรียกดำเนินการอย่างน้อยหนึ่งครั้งในช่วงระยะเวลา 5 นาที ช่วงเวลาดังกล่าวจะถือว่าเป็นการใช้งานสำหรับการเรียกเก็บเงิน หากมีการเรียกดำเนินการเวลา 08:03 น. และไม่มีการเรียกอีกต่อไปหลังเวลา 08:07 น. การนับจะหยุดที่เวลา 08:07 น. ในกรณีนี้ จะมีการคำนวณใบเรียกเก็บเงินดังนี้ 0.1570 USD * 5 นาที * 1 ช่วงเวลาห้านาที = 0.785 USD
-
Data Automation
ตัวอย่างราคา 1:
สมมติว่าคุณประมวลผลเอกสาร 1,000 หน้า โดยใช้เอาต์พุตแบบกำหนดเองของ BDA เอกสารทั้งหมด 1,000 หน้าจะประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 15 ช่อง ราคาต่อหน้าสำหรับพิมพ์เขียวใด ๆ ที่มีฟิลด์ 30 ช่องหรือน้อยกว่าคือ 0.040 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 40 USD
จำนวนหน้าทั้งหมดที่ประมวลผล = 1,000 หน้า
ราคาต่อหน้าสำหรับพิมพ์เขียวที่มีฟิลด์น้อยกว่า 30 ช่อง = 0.040 USD
ค่าบริการทั้งหมด = 1,000 * 0.040 USD = 40 USDตัวอย่างราคา 2:
สมมติว่าคุณประมวลผลเอกสาร 2 ฉบับ โดยใช้เอาต์พุตแบบกำหนดเองของ BDA เอกสาร 1 มี 40 หน้า และประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 20 ช่อง เอกสาร 2 มี 10 หน้า และประมวลผลโดยใช้พิมพ์เขียว 2 ซึ่งมีฟิลด์ 40 ช่อง ราคาต่อหน้าสำหรับพิมพ์เขียว 1 คือ 0.040 USD เนื่องจากมีฟิลด์ 30 ช่องหรือน้อยกว่า ราคาต่อหน้าสำหรับพิมพ์เขียว 2 คือ 0.045 USD ค่าใช้จ่ายในการประมวลผลสำหรับเอกสาร 1 โดยใช้พิมพ์เขียว 1 คือ 1.60 USD ค่าใช้จ่ายในการประมวลผลสำหรับเอกสาร 2 โดยใช้พิมพ์เขียว 2 คือ 0.45 USD ค่าใช้จ่ายทั้งหมดในการประมวลผลเอกสารทั้งสองจะอยู่ที่ 2.05 USD
จำนวนหน้าทั้งหมดที่ประมวลผล = 50 หน้า
ราคาต่อหน้าสำหรับพิมพ์เขียว 1 ที่มีฟิลด์น้อยกว่า 30 ช่อง = 0.040 USD
ราคาต่อหน้าสำหรับพิมพ์เขียว 2 ที่มี 40 ฟิลด์ = 0.040 USD + (จำนวนของฟิลด์เพิ่มเติมที่เกิน 30 *0.0005 USD ต่อฟิลด์)
จำนวนฟิลด์เพิ่มเติมที่เกิน 30 = 40 - 30 = 10
ราคาต่อหน้าสำหรับพิมพ์เขียว 2 ที่มี 40 ฟิลด์ = 0.040 USD + (10 * 0.0005 USD ต่อฟิลด์) = 0.045 USD
ค่าธรรมเนียมสำหรับเอกสาร 1 โดยใช้พิมพ์เขียว 1 = 40 หน้า x 0.040 USD ต่อหน้า = 1.6 USD
ค่าธรรมเนียมสำหรับเอกสาร 2 โดยใช้พิมพ์เขียว 2 = 10 หน้า x 0.045 USD ต่อหน้า = 0.45 USD
ค่าบริการทั้งหมด = ค่าธรรมเนียมสำหรับเอกสาร 1 + ค่าธรรมเนียมสำหรับเอกสาร 2 = 1.6 USD + 0.45 USD = 2.05 USDตัวอย่างราคา 3:
สมมติว่าคุณตั้งค่าฐานความรู้ Bedrock เพื่อใช้ระบบอัตโนมัติข้อมูล Bedrock เป็นตัวแยกวิเคราะห์แล้วป้อนเอกสาร 1,000 หน้าเข้าไป หมายเหตุ โครงสร้างต้นทุนจะแตกต่างกันไปตามตัวเลือกการแยกวิเคราะห์ฐานความรู้ BDA ใช้การกำหนดราคาต่อหน้า ในขณะที่ตัวแยกวิเคราะห์แบบพื้นฐานจะเรียกเก็บเงินตามโทเค็นอินพุตและเอาต์พุต สำหรับบริบท การประมวลผล 1,000 หน้า โดยที่ 30% มีตารางและ 30% มีตัวเลข โดยทั่วไปต้องใช้ 2,900 โทเค็นอินพุตและ 750 โทเค็นเอาต์พุต การบริโภคโทเค็นแตกต่างกันไปตามประเภทเนื้อหา ดังนั้นลูกค้าจึงขอแนะนำให้ทดสอบโดยใช้ข้อมูลของตนเองเพื่อรับการประมาณการที่แม่นยำยิ่งขึ้น การผสานรวมฐานความรู้ Bedrock และระบบอัตโนมัติข้อมูล Bedrock ใช้เอาต์พุตมาตรฐาน โดยที่ราคาต่อหน้าจะเป็น 0.010 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 10 USDจำนวนหน้าทั้งหมดที่ประมวลผล = 1,000 หน้า
ราคาต่อหน้าสำหรับเอาต์พุตมาตรฐาน = 0.010 USD
ค่าบริการทั้งหมด = 1,000 * 0.010 USD = 10 USDตัวอย่างราคา 4:
สมมติว่าคุณประมวลผลวิดีโอ 60 นาทีโดยใช้เอาต์พุตมาตรฐาน BDA ราคาต่อนาทีสำหรับเอาต์พุตมาตรฐานวิดีโอคือ 0.050 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 3.00 USD
จำนวนนาทีที่ประมวลผล = 60
ราคาต่อนาทีสำหรับเอาต์พุตมาตรฐานวิดีโอ = 0.050 USD
ค่าบริการทั้งหมด = 60 * 0.050 USD = 3.00 USDตัวอย่างราคา 5:
สมมติว่าคุณประมวลผลภาพ 2,000 ภาพ โดยใช้เอาต์พุตแบบกำหนดเองของ BDA ภาพ 1,000 ภาพแรกจะถูกประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 10 ช่อง เอกสาร 1,000 หน้าสุดท้ายจะถูกประมวลผลโดยใช้พิมพ์เขียว 2 ซึ่งมีฟิลด์ 40 ช่อง ราคาต่อภาพสำหรับพิมพ์เขียว 1 คือ 0.005 USD เนื่องจากมีฟิลด์ 30 ช่องหรือน้อยกว่า ราคาต่อภาพสำหรับพิมพ์เขียว 2 คือ 0.01 USD ค่าใช้จ่ายในการประมวลผลสำหรับ 1,000 ภาพแรกโดยใช้พิมพ์เขียว 1 คือ 5.00 USD ค่าใช้จ่ายในการประมวลผลสำหรับ 1,000 ภาพที่สองโดยใช้พิมพ์เขียว 2 คือ 10.00 USD ค่าใช้จ่ายทั้งหมดในการประมวลผลภาพทั้งหมด 2,000 ภาพจะอยู่ที่ 15.00 USD
ค่าใช้จ่ายสำหรับ 1000 ภาพแรก = 1,000 ภาพ * 0.005 USD ต่อภาพ = 5.00 USD
ค่าใช้จ่ายสำหรับ 1,000 ภาพที่สอง = 1,000 รูปภาพ * (0.005 USD + (จำนวนของฟิลด์เพิ่มเติมที่เกิน 30 *0.0005 USD ต่อฟิลด์))
= 1,000 * (0.005 USD + ((40-30)*0.0005 USD))
= 1,000 * (0.005 + (10*0.0005 USD)) = 10.00 USD
ค่าใช้จ่ายทั้งหมด = 5.00 USD + 10.00 USD = 15.00 USDตัวอย่างราคา 6:
สมมติว่าคุณต้องการใช้เอาต์พุตมาตรฐานของระบบอัตโนมัติข้อมูล Bedrock เพื่อประมวลผลการบันทึกเสียงการประชุม 15,000 นาทีในองค์กรของคุณ ค่าใช้จ่ายทั้งหมดในการประมวลผลเสียงทั้งหมด 15,000 นาทีจะอยู่ที่ 90 USD
จำนวนนาทีที่ประมวลผล = 15,000 นาที
ค่าบริการทั้งหมด = 15,000 นาที × 0.006 USD = 90 USD -
DeepSeek
ค่าบริการแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล DeepSeek-R1 สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น (รวมถึงโทเค็นการให้เหตุผล)
ค่าใช้จ่ายรวมต่อชั่วโมงที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.00135 USD + 1,000 โทเค็น/1,000 * 0.0054 USD = 0.0081 USD
-
Flows
ตัวอย่าง: สรุปข่าว
นักพัฒนาแอปพลิเคชันสร้างโฟลว์เพื่อสรุปข่าวโดยอัตโนมัติสำหรับผู้ค้า โฟลว์ประกอบด้วยโหนดอินพุตที่อยู่ในตำแหน่ง S3 และโหนดดึงข้อมูล S3 ที่ดึงไฟล์ 10 ไฟล์ที่มีบทความจากสำนักข่าวหลัก 10 แห่งใน S3 (การเปลี่ยนโหนด 2 โหนด) จากนั้นจะใช้โหนดอิเทอเรเตอร์ เพื่อเรียกดำเนินการโมเดลที่มีโหนดพร้อมท์เพื่อสรุปแต่ละไฟล์ (+ 10 ไฟล์ x การเปลี่ยนโหนด 2 โหนด) จากนั้นจะรวบรวมผลลัพธ์ทั้งหมดโดยใช้โหนดรวบรวม เขียนผลลัพธ์ไปยัง S3 โดยใช้โหนดจัดเก็บ S3 และเสร็จสมบูรณ์ในโหนดเอาต์พุต (+ การเปลี่ยนโหนด 3 โหนด) พวกเขาเปิดการทำงานของโฟลว์นี้ทุกครึ่งชั่วโมงในทุกวันจันทร์ถึงศุกร์จำนวนการเปลี่ยนโหนดต่อการดำเนินการโฟลว์คือ: 2+1+10*2 + 3 = 25 การเปลี่ยนโหนด/การดำเนินการโฟลว์
จำนวนการดำเนินการโฟลว์ต่อเดือนคือ: 24 ชั่วโมง *2* 5 วัน * 4 สัปดาห์ = 960 การดำเนินการโฟลว์/เดือน
บิลรายเดือนทั้งหมดคือ 25 * 960 * 0.035 USD/1,000 = 0.84 USD
ค่าบริการเพิ่มเติม
นอกจากนี้ใบเรียกเก็บเงินจะรวมถึงค่าใช้จ่ายเพิ่มเติมสำหรับบริการ AWS ที่ใช้ในการดำเนินการเวิร์กโฟลว์ รวมถึงการใช้ Amazon S3 ในโหนดการดึงข้อมูลและการจัดเก็บข้อมูล และการใช้โมเดลพื้นฐานของ Amazon Bedrock ในโหนดพร้อมท์ -
Meta
ค่าบริการแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Llama 2 Chat (13B) ของ Meta สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 500 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 2,000 โทเค็น/1,000* 0.00075 USD + 500 โทเค็น/1000* 0.001 USD = 0.002 USD
ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียด)
นักพัฒนาแอปพลิเคชันปรับแต่งโมเดล Llama 2 ที่ผ่านการฝึกล่วงหน้า (70B) โดยใช้ข้อมูล 1,000 โทเค็น หลังการฝึก จะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้ อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง
ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียดคือ การฝึกปรับแต่งอย่างละเอียด (0.00799 USD * 1000) + การจัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงการอนุมานโมเดลแบบกำหนดเอง (23.50 USD) = 33.44 USD
ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) ของโมเดลแบบกำหนดเอง = 21.18 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดลของ Meta Llama 2 หนึ่งหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ
ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้นคือ 1 หน่วยโมเดล* 21.18 USD * 24 ชั่วโมง* 31 วัน = 15,757.92 USD
-
Mistral AI
ค่าบริการแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mistral 7B สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 2,000 โทเค็น/1,000 * 0.00015 USD + 1,000 โทเค็น/1,000 * 0.0002 USD = 0.0005 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mixtral 8x7B สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น
ค่าใช้จ่ายรวมต่อชั่วโมงที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.00045 USD + 1,000 โทเค็น/1,000 * 0.0007 USD = 0.0016 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mistral Large สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.008 USD + 1,000 โทเค็น/1,000 * 0.024 USD = 0.04 USD
-
การประเมินโมเดล
ตัวอย่างการประเมินโมเดลที่ 1:
ราคาแบบ On-demand
นักพัฒนาแอปพลิเคชันส่งชุดข้อมูลสำหรับการประเมินโมเดลโดยมนุษย์โดยใช้ Anthropic Claude 2.1 และ Anthropic Claude Instant ใน AWS Region สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)ชุดข้อมูลประกอบด้วยพรอมต์ 50 รายการ และนักพัฒนาต้องการให้ผู้ปฏิบัติงานหนึ่งคนให้คะแนนชุดการตอบกลับพรอมต์แต่ละชุด (กำหนดค่าได้ในการสร้างงานการประเมินเป็นพารามิเตอร์ “ผู้ปฏิบัติงานต่อหนึ่งพรอมต์”)
จะมี 50 งานในงานประเมินนี้ (หนึ่งงานสำหรับแต่ละชุดการตอบสนองแบบแจ้งต่อผู้ปฏิบัติงานแต่ละคน) พรอมต์ 50 รายการรวมกันเป็นโทเค็นอินพุต 5,000 รายการ และการตอบกลับที่เกี่ยวข้องรวมกันเป็น 15,000 โทเค็นสำหรับ Anthropic Claude Instant และ 20,000 โทเค็นสำหรับ Anthropic Claude 2.1
จะมีค่าใช้จ่ายสำหรับงานการประเมินโมเดลนี้ดังต่อไปนี้รายการ จำนวนโทเค็นอินพุต ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ ค่าใช้จ่ายของอินพุต จำนวนโทเค็นเอาต์พุต ค่าบริการต่อโทเค็นเอาต์พุต 1,000 รายการ ค่าใช้จ่ายของเอาต์พุต จำนวนงานของมนุษย์ ค่าบริการต่องานของมนุษย์ ค่าใช้จ่ายของงานของมนุษย์ รวมทั้งหมด การอนุมานทันทีของ Claude 5000 0.0008 USD 0.004 USD 15000 0.0024 USD 0.036 USD 0.04 USD Claude 2.1 Inference 5000 0.008 USD 0.04 USD 20000 0.024 USD 0.48 USD 0.52 USD งานของมนุษย์ 50 0.21 USD 10.50 USD 10.50 USD รวมทั้งหมด 11.06 USD ตัวอย่างการประเมินโมเดลที่ 2:
ราคาแบบ On-demand
นักพัฒนาแอปพลิเคชันส่งชุดข้อมูลสำหรับการประเมินโมเดลโดยมนุษย์โดยใช้ Anthropic Claude 2.1 และ Anthropic Claude Instant ใน AWS Region สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)
ชุดข้อมูลประกอบด้วยพรอมต์ 50 รายการ และนักพัฒนาต้องการให้ผู้ปฏิบัติงานสองคนให้คะแนนชุดการตอบกลับพรอมต์แต่ละชุด (กำหนดค่าได้ในการสร้างงานการประเมินเป็นพารามิเตอร์ “ผู้ปฏิบัติงานต่อหนึ่งพรอมต์”) งานการประเมินนี้จะมี 100 งาน (1 งานสำหรับแต่ละคู่การตอบกลับพรอมต์ต่อพนักงานแต่ละคน: 2 คน x ชุดการตอบกลับพรอมต์ 50 ชุด = 100 งานของมนุษย์)
พรอมต์ 50 รายการรวมกันเป็นโทเค็นอินพุต 5,000 รายการ และการตอบกลับที่เกี่ยวข้องรวมกันเป็น 15,000 โทเค็นสำหรับ Anthropic Claude Instant และ 20,000 โทเค็นสำหรับ Anthropic Claude 2.1
จะมีค่าใช้จ่ายสำหรับงานการประเมินโมเดลนี้ดังต่อไปนี้รายการ จำนวนโทเค็นอินพุต ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ ค่าใช้จ่ายของอินพุต จำนวนโทเค็นเอาต์พุต ค่าบริการต่อโทเค็นเอาต์พุต 1,000 รายการ ค่าใช้จ่ายของเอาต์พุต จำนวนงานของมนุษย์ ค่าบริการต่องานของมนุษย์ ค่าใช้จ่ายของงานของมนุษย์ รวมทั้งหมด การอนุมานทันทีของ Claude 5000 0.0008 USD 0.0040 USD 15000 0.0024 USD 0.036 USD 0.04 USD Claude 2.1 Inference 5000 0.008 USD 0.0400 USD 20000 0.024 USD 0.48 USD 0.52 USD งานของมนุษย์ 100 0.21 USD 21.00 USD 21.00 USD รวมทั้งหมด 21.56 USD -
การปรับเพิ่มประสิทธิภาพพร้อมท์
ตัวอย่าง: การสรุปข่าว
นักพัฒนาแอปพลิเคชันสร้างพร้อมท์เพื่อสรุปข่าวสำหรับผู้ค้าที่ใช้ Claude 3.5 พร้อมท์ดั้งเดิมประกอบด้วย 429 โทเค็น พร้อมท์ที่ปรับเพิ่มประสิทธิภาพมี 511 โทเค็น และมีคำแนะนำและตัวอย่างที่เฉพาะเจาะจงมากขึ้นเพื่อสร้างคำตอบที่กระชับมากขึ้นจาก FM เขาใช้พร้อมท์ที่ปรับเพิ่มประสิทธภาพที่มี 511 โทเค็นเป็นอินพุตสำหรับเครื่องมือเพิ่มประสิทธิภาพพร้อมท์ และสร้างตัวแปรใหม่ 2 ตัวสำหรับ Claude 3.7 และ Nova Pro ที่มี 582 โทเค็นและ 579 โทเค็นจำนวนโทเค็นอินพุตและเอาต์พุตทั้งหมดสำหรับการปรับเพิ่มประสิทธิภาพพร้อมท์: 429 + 511 + 511 + 582 + 511 + 579 = 3,123
บิลรายเดือนทั้งหมดคือ: 3,123 / 1000 * 0.03 USD = 0.09 USD
-
AI ความเสถียร
ค่าบริการแบบ On-Demand
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล SDXL เพื่อสร้างภาพ 512 x 512 ด้วยขนาดสเต็ป 70 (คุณภาพระดับพรีเมียม)
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 ภาพ* 0.036 USD ต่อภาพ = 0.036 USD
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล SDXL 1.0 เพื่อสร้างภาพ 1024 x 1024 ด้วยขนาดสเต็ป 70 (คุณภาพระดับพรีเมียม)
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 ภาพ* 0.08 USD ต่อภาพ = 0.08 USD
ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้
นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล SDXL1.0 หนึ่งหน่วยพร้อมสัญญา 1 เดือน
ค่าใช้จ่ายรวมที่เกิดขึ้น = 1 * 49.86 USD * 24 ชั่วโมง* 31 วัน = 37,095.84 USD
-
TwelveLabs
ราคาแบบตามความต้องการ
นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Pegasus 1.2 เพื่ออธิบายว่าวิดีโอยาว 10 วินาทีเกี่ยวข้องกับอะไร โดยใช้เอาต์พุต 2,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 10 วินาที* 0.00049 USD + 2,000 โทเค็น / 1000 * 0.0075 USD = 0.0199 USD
ผู้พัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed [3.0 หรือ 2.7] เพื่อฝังวิดีโอ 10 รายการโดยมีระยะเวลารวม 100 นาทีค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 100 นาที (ซึ่งเท่ากับ 6,000 วินาที) * 0.00070 USD = 4.2 USD
นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed 3.0 โดยให้ข้อความและรูปภาพร่วมกันเพื่อสร้างการฝังที่สามารถใช้เพื่อค้นหาคลิปที่มีกระเป๋าที่แสดงในภาพที่กำหนดในคลังเนื้อหาแบบฝังที่สร้างไว้โดยใช้ตัวอย่างข้างต้นค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 คำขอข้อความ* 0.00007 USD +1 คำขอรูปภาพ* 0.0001 USD = 0.00017 USD
นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed [3.0 หรือ 2.7]โดยให้ข้อความเพื่อสร้างการฝังที่สามารถใช้เพื่อค้นหาคลิปที่ตรงกันในคลังเนื้อหาแบบฝังที่สร้างไว้โดยใช้ตัวอย่างข้างต้นค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 คำขอข้อความ* 0.00007 USD = 0.00007 USD
-
Writer
นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Palmyra X5 ของ Writer สรุปการป้อนข้อความอินพุต 10,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น
ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000 * 0.003 USD + 2,000 โทเค็น/1,000 * 0.015 USD = 0.06 USD