Triton là ngôn ngữ nguồn mở của OpenAI, cho phép bạn viết trực tiếp nhân tốc độ cao cho GPU bằng cú pháp giống Python.
Triton là ngôn ngữ dành riêng cho miền có cú pháp giống Python do OpenAI phát triển, được đặc trưng bởi khả năng tối ưu hóa nhân GPU với ít mã hơn mã C++ của CUDA và cũng được sử dụng làm phần phụ trợ cho cơ sở hạ tầng trình biên dịch (TorchInductor) của PyTorch 2.x. Là một tiêu chuẩn công nghiệp, nó được ca ngợi vì tính di động cao cho phép nó chạy trên các GPU khác ngoài NVIDIA như AMD từ cùng một mã, nhưng trong hoạt động thực tế kể từ năm 2026, vẫn sẽ có trường hợp nó thua kém các hạt CUDA viết tay về tốc độ do hình dạng tính toán đặc biệt và kiểu truy cập bộ nhớ khiến việc điều chỉnh tự động trở nên khó khăn. Về phương pháp lựa chọn trong lĩnh vực này, trong thực tế, việc không thay thế bắt buộc các tổ chức có nhiều tài sản CUDA hiện có và kỹ sư GPU chuyên dụng đang trở thành thông lệ mà thay vào đó áp dụng các nhóm định hướng chi phí muốn tối ưu hóa suy luận mới nội bộ và triển khai chú ý tùy chỉnh với một số ít người. Mức độ trưởng thành của môi trường gỡ lỗi và trình lược tả vẫn đang được phát triển so với CUDA, vì vậy cần phải dự đoán rằng sẽ mất thời gian để xác định các cạm bẫy để đổi lấy chi phí học tập thấp trước khi giới thiệu nó.