I

InclusionAI: ling-3.0-flash-vl:free

ling-3.0-flash-vl:free
262.1K ngữ cảnh32.8K đầu raSuy luậnCông cụVideoBộ nhớ đệmCó cấu trúc
Phát hành Sep 10, 2026Đã cập nhật Sep 11, 2026

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers to complete more useful work within constrained token, latency, and serving-cost budgets.

Chế độ chatTokenizer OtherLượng tử hóa fp16inclusionAI/Ling-3.0-flash-VL

Tất cả nhà cung cấp của mô hình này hiện đang bận

Mọi nhà cung cấp thượng nguồn đã chạm giới hạn tốc độ. Mô hình tự động trở lại khi giới hạn được gỡ, thường trong vài giờ. Hãy thử lại sau ít phút hoặc chuyển sang mô hình khác.

Yêu cầu mô hình này trên Discord

Giá cả

Giá đầu vào
$0.00/ 1 triệu token
Giá đầu ra
$0.00/ 1 triệu token
Cửa sổ ngữ cảnh 262.1K tokenEndpoint tương thích -Nhà cung cấp InclusionAI

Thời gian hoạt động

Hiệu năng

Đang tải dữ liệu hiệu năng...

Sử dụng & Xếp hạng

Đang tải mức sử dụng...

Tham số hỗ trợ

Tất cả nhà cung cấp = mọi upstream phục vụ mô hình này đều hỗ trợ. Một số nhà cung cấp = tùy thuộc upstream xử lý yêu cầu. Mặc định = giá trị được gửi khi bạn không thiết lập.

Tham sốNhà cung cấpMặc định
frequency_penaltyTất cả nhà cung cấp-
include_reasoningTất cả nhà cung cấp-
logit_biasTất cả nhà cung cấp-
max_tokensTất cả nhà cung cấp-
min_pTất cả nhà cung cấp-
presence_penaltyTất cả nhà cung cấp-
reasoningTất cả nhà cung cấp-
repetition_penaltyTất cả nhà cung cấp-
response_formatTất cả nhà cung cấp-
seedTất cả nhà cung cấp-
stopTất cả nhà cung cấp-
structured_outputsTất cả nhà cung cấp-
temperatureTất cả nhà cung cấp-
tool_choiceTất cả nhà cung cấp-
toolsTất cả nhà cung cấp-
top_kTất cả nhà cung cấp-
top_pTất cả nhà cung cấp-

Câu hỏi thường gặp

Mô hình tương tự