Text Generation Inference 文件
Safetensors
入門指南
Text Generation Inference快速導覽支援的模型在 Nvidia GPU 上使用 TGI在 AMD GPU 上使用 TGI在 Intel Gaudi 上使用 TGI在 AWS Trainium 與 Inferentia 上使用 TGI在 Google TPU 上使用 TGI在 Intel GPU 上使用 TGI從原始碼安裝多後端支援內部架構使用統計
教學課程
取用 TGI為推論服務準備模型提供私有與受限(Gated)模型服務使用 TGI CLI部署於 AWS (EC2 與 SageMaker)非核心模型推論服務安全性使用 Guidance、JSON 與工具視覺語言模型 (VLMs)使用 Prometheus 與 Grafana 監控 TGI訓練 Medusa
後端
參考
概念指南
加入 Hugging Face 社群
並獲得增強的文件體驗
開始使用
Safetensors
Safetensors 是一種用於深度學習模型的序列化格式。與 pickle(許多深度學習函式庫底層所使用的格式)等其他序列化格式相比,它更快速且更安全。
TGI 依賴 safetensors 格式,主要是為了實現張量平行分片 (tensor parallelism sharding)。在進行模型服務時,TGI 會先尋找儲存庫中的 safetensors 權重。如果沒有 safetensors 權重,TGI 會自動將 PyTorch 權重轉換為 safetensors 格式。
您可以透過閱讀 safetensors 文件來了解更多關於 safetensors 的資訊。
在 GitHub 上更新