ไทย
← กลับไปยังเทคโนโลยี AI

การอนุมานและการนำไปใช้

Speculative Decoding

วิธีอนุมานที่โมเดลร่างซึ่งเร็วกว่าเสนอหลายโทเคน แล้วโมเดลเป้าหมายตรวจสอบแบบขนาน ช่วยลดเวลาแฝงโดยไม่เปลี่ยนการแจกแจงเป้าหมาย

ช่วงเวลาอ้างอิง
2022
ตรวจล่าสุด

คำสำคัญ

  • draft model
  • verification
  • latency
  • exact sampling

ความเชื่อมโยงในโครงการ

ตั้งอยู่บน

ถูกใช้โดย

เทคโนโลยีที่เกี่ยวข้อง

บทความที่เกี่ยวข้อง

บริบททางประวัติศาสตร์

แหล่งข้อมูลปฐมภูมิ

  1. Fast Inference from Transformers via Speculative Decoding

นี่คือแผนที่เทคนิคที่คัดสรร ไม่ใช่การอ้างว่าครอบคลุมทั้งหมด