DeepSeek là dòng LLM mã nguồn mở hiệu suất cao được phát triển bởi một công ty AI Trung Quốc. Đầu năm 2025, nó đã gây sốc cho ngành với khả năng suy luận chi phí thấp và thu hút sự chú ý trên toàn thế giới với tên gọi “cú sốc DeepSeek”.
DeepSeek là một công ty AI của Trung Quốc do Liang Wenfeng thành lập vào năm 2023 và là tên gọi chung của nhóm mô hình ngôn ngữ quy mô lớn. DeepSeek-R1 ra mắt vào tháng 1 năm 2025, có mức độ suy luận chính xác ngang với OpenAI o1 nhưng lại có phí API thấp đến kinh hoàng, khoảng 1/20 đến 1/30, gây ra “cú sốc DeepSeek” tạm thời khiến giá cổ phiếu NVIDIA lao dốc.
Chủ yếu có 3 mẫu. Dòng V (phiên bản mới nhất là V3) dành cho hội thoại có mục đích chung, dòng R (đại diện là R1) chuyên về toán học, mã và lý luận logic và dòng Coder để hỗ trợ mã nhẹ. Cả hai đều có dung lượng mở và có thể tự lưu trữ bằng Ollama hoặc vLLM.
Hai cạm bẫy đã chắc chắn xuất hiện trong lĩnh vực này vào năm 2026. Đầu tiên là vấn đề về quyền riêng tư dữ liệu. Vì dữ liệu khi sử dụng API chính thức được gửi đến máy chủ ở Trung Quốc nên việc tự lưu trữ là lựa chọn phổ biến cho các công ty xử lý thông tin bí mật. Thứ hai là bộ lọc kiểm duyệt. Nó không phù hợp cho các ứng dụng liên quan đến báo chí và chính sách vì các câu trả lời bị né tránh hoặc sửa đổi dựa trên các chủ đề lịch sử và chính trị cụ thể. Giá thị trường là khoảng 20.000 đến 50.000 yên Nhật mỗi tháng nếu bạn chạy máy chưng cất V3 tương đương trên một tờ A100. Trong hoạt động thực tế, mô hình sử dụng DeepSeek cho công việc chung có chi phí đầu tư cao và Claude/GPT cho công việc bí mật/có đạo đức đang gia tăng nhanh chóng.