Kiến thức nền tảng

Awesome Image Awesome Image

Infortrend: Từ Enterprise Storage đến hạ tầng dữ liệu cho kỷ nguyên AI

Infortrend: Từ Enterprise Storage đến hạ tầng dữ liệu cho kỷ nguyên AI – Infortrend Blog Series LƯU TRỮ DOANH NGHIỆP / AI & PRIVATE CLOUD Infortrend: Từ Enterprise Storage đến hạ tầng dữ liệu cho kỷ nguyên AI Nhìn lại hành trình tiến hóa từ SAN truyền thống, Unified Storage, Scale-out NAS đến Parallel […]

Read More

Infortrend tại Việt Nam: Một thương hiệu hơn 30 năm tuổi và câu chuyện 15 năm chưa được kể đủ

Infortrend tại Việt Nam: Một thương hiệu hơn 30 năm tuổi và câu chuyện 15 năm chưa được kể đủ Infortrend Vietnam Story Infortrend tại Việt Nam: Một thương hiệu hơn 30 năm tuổi và câu chuyện 15 năm chưa được kể đủ 10/08/2026 7 phút đọc CSC Distribution – NPP Infortrend VN – Quốc […]

Read More

Ghép nhiều máy chủ GPU: Giải pháp chạy được mô hình có kích thước lớn hơn vRAM của GPU

Phần 1 (Lựa chọn nền tảng chạy mô hình LLM phù hợp trong môi trường on-prem: vLLM hay SGlang) chắc các bạn đọc cũng có thấy chúng tôi sử dụng một số công cụ thể ghép nhiều GPU (hoặc node có GPU) lại với nhau để xử lý các bài toán: RAG, Agentic, Coding trong […]

Read More

vLLM hay SGLang: doanh nghiệp nên chọn engine nào cho Chatbot, RAG và Coder? (Phần 2)

vLLM hay SGLang: doanh nghiệp nên chọn engine nào cho Chatbot, RAG và Coder? 2.1 Tải thấp: vLLM tạo cảm giác phản hồi rất nhanh Ở kịch bản c1, vLLM 1N đạt 52.73 tokens/s/user và TTFT khoảng 120ms. Đây là kết quả rất tốt cho demo vì người dùng gần như thấy hệ thống bắt […]

Read More

vLLM vs SGLang: Nên Chọn Engine AI Nào?

vLLM hay SGLang: doanh nghiệp nên chọn engine nào cho Chatbot, RAG và Coder? Câu hỏi thường gặp: “vLLM hay SGLang tốt hơn?” Câu trả lời đúng không phải là chọn một engine cho mọi tình huống. Benchmark cho thấy vLLM rất mạnh ở tải thấp/single-node, trong khi SGLang nổi bật hơn khi scale-out cho […]

Read More