Chọn mô hình cho tác vụ của bạn
Lọc danh mục hiện tại theo điểm cuối được công bố và tác vụ, chạy đánh giá nhỏ bằng ví dụ của bạn, rồi chọn dựa trên bằng chứng đo được về chất lượng, độ trễ và chi phí hiện tại.
Xác định quyết định trước
- Ghi rõ tác vụ, cấu trúc đầu vào/đầu ra bắt buộc, ngôn ngữ, mức độ trễ chấp nhận được và chi phí khi thất bại.
- Chọn giao thức ứng dụng của bạn đã hỗ trợ: Responses, Chat Completions, ảnh, video hoặc điểm cuối được công bố khác.
- Chuẩn bị ví dụ đại diện và điều kiện đạt mà con người có thể kiểm tra.
{
"task": "extract support ticket fields",
"endpoint": "openai-response",
"must_pass": ["valid JSON", "required fields", "no invented facts"],
"measure": ["quality", "latency", "live request cost"]
}Lập danh sách rút gọn có căn cứ
- Mở danh mục hiện tại và lọc theo đúng điểm cuối được công bố mà ứng dụng khách sẽ gọi.
- Đọc mô tả có nguồn và giá hiện tại của từng ứng viên; coi thông tin còn thiếu là chưa biết.
- Chạy cùng một bộ đánh giá nhỏ có tính đại diện trên từng ứng viên khi bạn chấp nhận khả năng bị tính phí.
- Ghi chất lượng đầu ra, lỗi, độ trễ và chi phí quan sát được trong cùng điều kiện.
- Chọn mô hình chính và mô hình dự phòng chỉ khi cả hai đáp ứng đặc tả bắt buộc.
Dùng danh sách kiểm tra đánh giá
| Tiêu chí | Nội dung cần ghi lại |
|---|---|
| Mức phù hợp với đặc tả | Điểm cuối được công bố, tham số bắt buộc, phân tích đầu ra và xử lý lỗi. |
| Chất lượng tác vụ | Đạt/không đạt theo các ví dụ bạn đã rà soát, không phải xếp hạng tiếp thị. |
| Độ trễ | Các quan sát trung vị và độ trễ đuôi từ cùng khu vực và cấu trúc yêu cầu. |
| Chi phí | Giá hiện tại cùng bản ghi mức sử dụng thực tế của đợt đánh giá. |
| Độ tin cậy | Lỗi và kết quả thử lại trong khoảng thời gian kiểm thử của bạn. |
Xác minh quyết định mong đợi
- Mỗi mô hình trong danh sách rút gọn đều có điểm cuối được công bố mà tích hợp của bạn sử dụng.
- Mô hình được chọn đạt mọi ví dụ bắt buộc, không chỉ câu lệnh dễ nhất.
- Tài liệu lựa chọn ghi ngày quan sát, đầu vào kiểm thử, cấu hình và các đánh đổi có thể đo lường.
Tránh sai lầm khi lựa chọn
- Không suy đoán hỗ trợ điểm cuối từ tên mô hình quen thuộc; dùng thông tin công bố trong danh mục hiện tại.
- Không so sánh mô hình với câu lệnh, khu vực, giới hạn đầu ra hoặc chính sách thử lại khác nhau.
- Không biến kết quả đo của nhà cung cấp thành bằng chứng về định tuyến, giá, tình trạng khả dụng của GetAPI.ONE hoặc chất lượng cho tác vụ của bạn.