Các điểm chính của bài viết này AUTOMATIC1111 là một giao diện người dùng web nguồn mở để vận hành AI "Stable Diffusion" tạo hình ảnh từ màn hình trình duyệt. Bản thân phần mềm này là miễn phí và không có giới hạn về số lượng hình ảnh bạn có thể tạo nếu bạn chạy nó trên PC của chính mình. Chìa khóa để cài đặt chỉ là chuẩn bị Python 3.10.6 và Git. Sau khi vượt qua điểm này, bạn có thể hoàn thành phần còn lại bằng các thao tác trên màn hình. Tuy nhiên, trên những PC có GPU yếu (chip chuyên dụng để xử lý hình ảnh) thì thời gian chờ đợi sẽ không thực tế. Trong trường hợp đó, có một lối thoát: thông qua Google Colab hoặc Docker. Việc sử dụng thương mại được xác định bởi giấy phép của mô hình được sử dụng chứ không phải bản thân phần mềm. Nếu bạn bỏ qua phần này, bạn sẽ thất vọng về sau.
Hộp thông tin Ban biên tập
Giao diện người dùng web tự lưu trữ được xuất bản trên GitHub
Kích hoạt REST API với tùy chọn khởi động `--api`
Tự khép kín. Ngoài khuôn khổ chứng nhận của bên thứ ba (SOC2, v.v.)
Phụ thuộc vào mô hình được sử dụng và giấy phép LoRA
Có thể (chỉ cần giao tiếp cho thiết lập ban đầu và thu thập mô hình)
Xác nhận lần cuối: Ngày 2 tháng 8 năm 2026 bởi ban biên tập
Tôi muốn thử dùng AI tạo hình ảnh nhưng lại không muốn tăng phí hàng tháng. Tôi cũng không muốn đưa những bức ảnh đã tạo lên máy chủ bên ngoài. Nếu bạn cố gắng thỏa mãn cả hai cùng một lúc, các lựa chọn của bạn sẽ bị thu hẹp đáng kể.
Câu trả lời là TỰ ĐỘNG1111. Nó miễn phí, có thể được hoàn thành trên PC của riêng bạn và có nhiều chức năng hơn các dịch vụ trả phí. Thay vào đó, bạn phải trả chi phí thực tế cho ''giờ thiết lập đầu tiên''.
Chúng ta hãy xem những gì bạn có thể và không thể nhận được trong giờ đó.
TỰ ĐỘNG1111 là gì?
AUTOMATIC1111 (tên chính thức: Giao diện người dùng web Stable Diffusion) là một giao diện nguồn mở cho phép bạn vận hành AI "Stable Diffusion" tạo hình ảnh từ màn hình trình duyệt web. Nó được xuất bản trên GitHub và bất kỳ ai cũng có thể sử dụng nó miễn phí.
Thật khó hiểu nhưng AUTOMATIC1111 không phải là AI tạo sinh hình ảnh. Bản thân AI là Stable Diffusion. AUTOMATIC1111 là bảng điều khiển.
Nói về ô tô thì động cơ là Stable Diffusion, vô lăng và đồng hồ là AUTOMATIC1111. Nếu chỉ sử dụng công cụ, bạn sẽ nhập lệnh vào màn hình đen, nhưng nếu có bảng điều khiển, tất cả những gì bạn phải làm là nhập văn bản và nhấn nút.
Tên này xuất phát từ chính tên tài khoản GitHub của nhà phát triển. Vì nó không được thiết kế làm tên sản phẩm nên nó thường được viết tắt là "A1111" hoặc "1111" ở các quốc gia nói tiếng Nhật.
Sắp xếp tên
| biệt danh | cái gì đang chỉ |
|---|---|
| Stable Diffusion | Chính mô hình AI tạo sinh hình ảnh |
| TỰ ĐỘNG1111 / A1111 | Giao diện người dùng web để vận hành nó trong trình duyệt |
| Giao diện người dùng web phổ biến ổn định | Tên chính thức của AUTOMATIC1111 |
| Mô hình/Điểm kiểm tra | Tệp dữ liệu đã học xác định mẫu |
Nói cách khác, ngay cả khi bạn nói ``Chèn AUTOMATIC1111'', bạn sẽ cần chuẩn bị một mô hình riêng để xác định mẫu. Đây là điểm vấp ngã đầu tiên.
Nếu bạn chưa xem xét toàn bộ AI tạo hình ảnh, trước tiên hãy xem bài viết so sánh công cụ minh họa AI và bạn sẽ có thể nhanh chóng đi vào phần còn lại của câu chuyện.
Stable Diffusion là mô hình tạo hình ảnh AI có thể tạo hình ảnh từ hướng dẫn văn bản hoặc chỉnh sửa hình ảnh hiện có. Ngoài việc tạo hình ảnh bằng lời nhắc, nó còn hỗ trợ img2img, tạo hình ảnh từ hình ảnh, chỉnh sửa một phần và điều chỉnh kiểu bằng mô hình và LoRA. Nếu bạn cài đặt nó trong môi trường cục bộ của mình, bạn có thể tạo trong khi kiểm soát chi tiết cài đặt tạo và quy trình làm việc. Nó phù hợp cho các nhà thiết kế muốn tạo môi trường sản xuất của riêng họ, người sáng tạo minh họa và người dùng nâng cao muốn thử nghiệm sâu sắc về việc tạo hình ảnh AI.
Bạn có thể làm gì? Tổ chức các chức năng chính
Những gì bạn có thể làm với AUTOMATIC1111 có thể được chia thành ba loại: "tạo", "sửa chữa" và "mở rộng". Nó có hầu hết các tính năng có trong các dịch vụ tạo hình ảnh trả phí nhưng thậm chí còn có khả năng kiểm soát chi tiết hơn.
Chúng tôi đã liệt kê các chức năng chính để người mới bắt đầu sử dụng chúng.
| chức năng | phải làm gì | thứ tự chạm vào |
|---|---|---|
| txt2img | Chức năng cơ bản để tạo hình ảnh từ hướng dẫn văn bản | thứ nhất |
| img2img | Làm lại bằng cách sử dụng hình ảnh hiện có làm cơ sở | thứ hai |
| vẽ tranh | Chỉ đổi màu một phần ảnh (chỉnh tay, mặt) | thứ ba |
| sơn ngoài | Mở rộng bằng cách vẽ bên ngoài hình ảnh | thứ 4 |
| Thuê sửa chữa | Tạo ở độ phân giải thấp và sau đó vẽ lại ở độ phân giải cao | Sau khi đã quen với nó |
| cao cấp | Mở rộng với ESRGAN, RealESRGAN, SwinIR, v.v. | Sau khi đã quen với nó |
| Sơ đồ X/Y/Z | Tạo bảng so sánh với nhiều cài đặt khác nhau hàng loạt | Trong quá trình xác minh |
Như được trình bày trong bảng này, nếu bạn nhớ được ba điều đầu tiên, bạn sẽ có thể đạt được trình độ thực tế. Bạn có thể tra cứu phần còn lại khi bạn cần.
Kiểm soát “sự chú ý” đơn giản và hiệu quả
Bạn có thể tăng cường hoặc làm suy yếu các từ cụ thể trong hướng dẫn (lời nhắc) cho AI. Chọn một từ trong trường văn bản và nhấn Ctrl+↑ / Ctrl+↓ (Command+↑ / Command+↓ trên Mac) để tự động điều chỉnh độ đậm của từ đó.
Chỉ trong vài giây, bạn có thể thoát khỏi tình trạng muốn nhấn mạnh chiếc váy đỏ nhưng chỉ có hậu cảnh lòe loẹt. Tốc độ bạn có thể đạt được bức ảnh như mong muốn tùy thuộc vào việc bạn có biết thao tác này hay không.
Ngoài ra, nó còn đạt tiêu chuẩn với các công cụ thử nghiệm như ``Prompt Matrix'', cho phép bạn sử dụng vũ lực để kiểm tra sự kết hợp của nhiều câu lệnh và ``Loopback'', cho phép bạn lặp đi lặp lại các kết quả của img2img để tích lũy các thay đổi.
Tôi cũng muốn đọc nó
7 lựa chọn thay thế cho Nano Banana trong Google Earth, miễn phí và có sẵn bằng tiếng Nhật (phiên bản 2026)
Nano Banana trên phiên bản web của Google Earth đã tạm thời bị đình chỉ kể từ một ngày sau khi phát hành (kể từ tháng 8 năm 2026). Chúng tôi đã so sánh bảy lựa chọn thay thế trên ba trục: miễn phí, tiếng Nhật và nguồn mở, đồng thời sắp xếp cách lựa chọn dựa trên mục đích trực quan hóa bản đồ. Bạn có thể thấy các điểm đến di chuyển thực tế bao gồm ComfyUI và Stable Diffusion.
Ngày 5 tháng 8 năm 2026
OpenPose là gì? Cơ chế chỉ định các tư thế với hình người que, điều kiện sử dụng thương mại và các công cụ thay thế (phiên bản 2026)
OpenPose là một thư viện mã nguồn mở phát hiện tư thế của con người dưới dạng bộ xương hình que. Nó chỉ được sử dụng miễn phí cho mục đích phi thương mại và giấy phép thương mại có giá 25.000 USD mỗi năm. Chúng tôi đã tóm tắt mọi thứ từ cách thức hoạt động, cách sử dụng nó với ControlNet, nó khác với các lựa chọn thay thế như MediaPipe như thế nào và các tiêu chí để xác định mục đích sử dụng thương mại.
Ngày 4 tháng 8 năm 2026
Bạn cần gì để làm cho nó hoạt động? Thông số kỹ thuật PC và 3 cách lựa chọn
Có ba điều bạn cần. Python 3.10.6, Git và GPU để xử lý hình ảnh. Trong số này, trở ngại thực sự duy nhất là GPU.
Phiên bản Python chính thức được đề xuất là 3.10.6. Đây không phải là thế giới mà phiên bản mới nhất tốt hơn. Nếu bạn cài đặt Python quá mới, sẽ xảy ra sự cố khi các thư viện phụ thuộc không kết nối và không khởi động được. Câu trả lời đúng là tuân theo đặc tả phiên bản một cách ngoan ngoãn.
Ba tùy chọn cho môi trường thực thi
Con đường bạn đi sẽ phụ thuộc vào việc bạn có PC có GPU trong tay hay không. Liệt kê các điều kiện thực tế cho mỗi điều kiện.
| Làm thế nào để chạy | người phù hợp | chi phí tiền tệ | Tốc độ gần đúng |
|---|---|---|---|
| Thực thi cục bộ (GPU NVIDIA) | Một người làm ra hàng tá sản phẩm mỗi ngày | chỉ hóa đơn tiền điện | Nhanh nhất. Vài giây đến mười giây |
| Thực thi cục bộ (Apple Silicon Mac) | Những người chỉ có máy Mac | chỉ hóa đơn tiền điện | Vài chục giây. Phạm vi thực tế |
| Thông qua Google Colab | Những người có PC không có GPU | Hợp đồng gói trả phí là thực tế | Phụ thuộc vào việc phân bổ GPU |
| Qua Docker | Những người không muốn gây ô nhiễm môi trường | Phụ thuộc vào môi trường | Phụ thuộc vào hiệu suất GPU của máy chủ |
Nói cách khác, ngay cả khi bạn không có GPU, vẫn có một lỗ hổng mang tên Colab, vì vậy bạn không cần phải bỏ cuộc chỉ vì PC của bạn quá cũ.
Sẽ an toàn khi có ít nhất 8GB VRAM (bộ nhớ phụ GPU). Ngay cả với 4GB, nó sẽ hoạt động nếu bạn thêm tùy chọn khởi động để tiết kiệm bộ nhớ, nhưng nó sẽ bị kẹt ở độ phân giải cao. Thành thật mà nói, đây là phần bạn sẽ hối tiếc nếu bỏ qua.
Các bước cài đặt trên Windows
Quá trình cài đặt trên Windows 11 là một quy trình gồm bốn bước: Python → Git → Lấy thiết bị chính → Bắt đầu. Thời gian cần thiết là khoảng 30 phút đến 1 giờ tùy thuộc vào tốc độ đường truyền.
Có một hộp kiểm không thể xóa khỏi quy trình.
1. Cài đặt Python 3.10.6
Tải xuống trình cài đặt Windows (64-bit) từ trang phân phối chính thức. Đảm bảo chọn "Thêm Python 3.10 vào PATH" trên màn hình đầu tiên của trình cài đặt, sau đó nhấn "Cài đặt ngay".
Nếu bạn bỏ qua bước này, bước sau sẽ thông báo "Không thể tìm thấy lệnh python" và dừng lại. Đây là quả mìn mà những người mới bắt đầu thường xuyên dẫm phải nhất. Không có vấn đề gì khi để các mục khác làm mặc định.
2. Cài đặt Git
Git là một công cụ để lấy và cập nhật mã nguồn. Bạn có thể tải xuống trình cài đặt từ trang tải xuống chính thức và tiến hành cài đặt mặc định.
Nếu cài đặt Git, bạn có thể cập nhật thiết bị chính lên phiên bản mới nhất sau này bằng một dòng lệnh duy nhất. Ngoài ra còn có một phương pháp tải xuống tệp ZIP theo cách thủ công, nhưng nó không được khuyến khích vì việc cập nhật sẽ trở nên rắc rối.
3. Lấy và khởi động thiết bị
Sao chép kho lưu trữ GitHub và nhấp đúp vào webui-user.bat bên trong thư mục. Các thư viện cần thiết sẽ được tự động tải xuống khi bạn khởi động chương trình lần đầu tiên, vì vậy quá trình này có thể mất vài phút.
Nếu Chạy trên URL cục bộ: http://127.0.0.1:7860 xuất hiện trên màn hình đen thì đó là thành công. Khi bạn mở địa chỉ đó trên trình duyệt, màn hình thao tác sẽ xuất hiện.
4. Đặt mô hình
Nếu điều này tiếp tục, sẽ không có dữ liệu để quyết định mô hình. Đặt tệp mô hình thu được (thường có phần mở rộng .safetensors) vào thư mục mô hình/Stable Diffusion của đích cài đặt và chọn lại tệp đó từ danh sách thả xuống ở trên cùng bên trái của màn hình.
Chọn định dạng .safetensors thay vì định dạng .ckpt. Do cơ chế của nó, trước đây cho phép chèn mã độc. Đặc biệt nếu bạn không tin tưởng vào nhà phân phối.
Sự khác biệt khi chạy trên Mac
Nó cũng hoạt động trên máy Mac có Apple Silicon. Tuy nhiên, cả tốc độ và quy trình đều khác với cấu hình GPU Windows + NVIDIA.
Để cài đặt nó, hãy sử dụng Homebrew (một công cụ quản lý phần mềm dành cho Mac) để thu thập các mục cần thiết, sau đó sử dụng Git để lấy kho lưu trữ. Nó khởi động webui.sh thay vì .bat.
Thành thật mà nói, tốc độ không thể so sánh được với môi trường NVIDIA. Thường mất vài chục giây cho mỗi hình ảnh, vì vậy tốt nhất bạn nên cân nhắc rằng nó không phù hợp để sản xuất hàng loạt hình ảnh 512 x 512.
Mặt khác, sự yên Nhật tĩnh và dễ dàng xử lý bộ nhớ là những lợi thế. Nhờ tích hợp bộ nhớ nên ít bị hết VRAM hơn các máy Windows trong cùng tầm giá.
Có trường hợp một số tiện ích mở rộng được viết dựa trên thư viện cho NVIDIA và không hoạt động. Việc kiểm tra xem tiện ích mở rộng bạn muốn sử dụng có tương thích với Apple Silicon hay không trước khi cài đặt là an toàn.
Cài đặt nào quyết định chất lượng thế hệ?
Màn hình có nhiều cột để nhập số, nhưng ban đầu bạn chỉ cần ghi nhớ bốn cột. Phần còn lại có thể để ở giá trị mặc định để sử dụng thực tế.
Chúng tôi đã sắp xếp các tham số cần được đề cập ở giai đoạn ban đầu theo thứ tự tác động giảm dần của chúng.
| mục | điều gì sẽ thay đổi | Giá trị được đề xuất đầu tiên |
|---|---|---|
| Các bước lấy mẫu | Số lượng bản vẽ Càng nhiều thì càng phức tạp nhưng càng chậm. | 20-30 |
| Cân CFG | Bạn làm theo hướng dẫn chặt chẽ đến mức nào? | Khoảng 7 |
| Phương pháp lấy mẫu | Thuật toán xác định kết cấu của hình ảnh | Hãy thử từ dòng DPM++ |
| Hạt giống | Hạt số ngẫu nhiên. Nếu các giá trị giống nhau thì có thể sao chép cùng một hình ảnh. | -1 (ngẫu nhiên) |
Nói tóm lại, cách thực tế để sử dụng AUTOMATIC1111 là tìm các cài đặt bạn thích trong khi thay đổi sự kết hợp của bốn cài đặt này.
Đừng đánh giá thấp những gợi ý tiêu cực
Có hai trường nhập văn bản hướng dẫn trên màn hình tạo. Phía trên là "những thứ tôi muốn bạn vẽ" và phía dưới là "những thứ tôi không muốn bạn vẽ". Dưới đây là lời nhắc tiêu cực.
Những sự cố điển hình như tăng số lượng ngón tay trên bàn tay hoặc khuôn mặt méo mó có thể được giảm thiểu đáng kể bằng cách viết ở phía dấu nhắc tiêu cực. Những người tập trung vào cột trên cùng và để trống cột dưới cùng đang lãng phí một nửa cơ hội phát triển của mình.
Khi tìm kiếm cài đặt chính xác, hãy sử dụng chức năng vẽ đồ thị X/Y/Z để tăng hiệu quả. Bảng so sánh với các bước Lấy mẫu trên trục tung và Thang đo CFG trên trục hoành sẽ được hiển thị cùng lúc để bạn có thể lựa chọn một cách trực quan.
Tóm tắt cho đến nay: AUTOMATIC1111 là "giao diện người dùng web miễn phí", thiết kế được xác định bởi mô hình và chất lượng được xác định bởi bốn tham số. Rào cản duy nhất đối với việc cài đặt là cài đặt PATH cho Python 3.10.6. Từ đây trở đi, chúng tôi sẽ vượt xa chức năng tiêu chuẩn.
Bạn có thể đi bao xa với tiện ích mở rộng?
Sức mạnh thực sự của AUTOMATIC1111 là các tiện ích mở rộng do cộng đồng tạo ra. Có hơn 5.000 trong số đó và bạn có thể tiếp cận những khu vực mà các chức năng tiêu chuẩn không thể tiếp cận được.
Trong số đó, ba hệ thống sau đây có ảnh hưởng lớn nhất.
- ControlNet (được giới thiệu qua tiện ích mở rộng của Mikubill) - Lấy sơ đồ tư thế hình que hoặc bản vẽ đường làm đầu vào và sửa bố cục theo chỉ định.
- LoRA — Một tệp nhỏ học thêm một ký tự hoặc phong cách cụ thể. Có thể xếp chồng nhiều
- Đảo ngược văn bản / Siêu mạng — Một phương pháp đơn giản để ghi nhớ các tính năng với ít dữ liệu
- Tiện ích mở rộng tiếng Nhật hóa - thay thế màn hình tiếng Anh bằng tiếng Nhật
Khi ControlNet xuất hiện, trải nghiệm sẽ trở nên khác biệt. Từ ''gacha bằng cách nào đó tạo ra một bức ảnh đẹp'' đến ''một công cụ tạo ra bố cục như mong muốn.'' Đây là công cụ cần phải có nếu bạn muốn sử dụng nó để tạo hình minh họa hoặc tạo tài liệu.
Để truy cập tiện ích mở rộng, chỉ cần nhập URL từ tab "Tiện ích mở rộng" trên màn hình. Tuy nhiên, nếu bạn thêm quá nhiều, nó sẽ khởi động chậm và các tiện ích mở rộng có thể xung đột với nhau và không thể khởi động được. Nếu nó ngừng hoạt động, cách thực hành tiêu chuẩn là loại bỏ vật phẩm bạn đã đặt ngay trước đó.
Khi sử dụng mô hình tạo SDXL, nó cũng hỗ trợ thiết lập hai giai đoạn trong đó bạn tạo đường viền chung với mô hình Cơ sở và sau đó kết thúc với mô hình Bộ tinh chỉnh. Việc chuyển đổi này cũng được hoàn thành trên màn hình.
ComfyUI hay tôi nên chọn cái nào?
Có một giao diện người dùng đối thủ mạnh mẽ tên là ComfyUI chạy cùng tính năng Stable Diffusion. Vấn đề không phải là cái nào tốt hơn mà là cái nào phù hợp với công việc của bạn hơn.
Hãy so sánh sự khác biệt trong tính cách của hai người từ góc độ thực tế.
| quan điểm | TỰ ĐỘNG1111 | Giao diện người dùng thoải mái |
|---|---|---|
| hình thức hoạt động | Màn hình nhập biểu mẫu | Biểu thức nút kết nối các hộp và dòng |
| chi phí học tập | thấp. Có thể sử dụng ngay trong ngày | đắt. Cần hiểu rõ cơ chế |
| Tự động hóa quy trình | Tôi không tệ về khoản đó nhưng tôi cũng không giỏi về khoản đó. | giỏi. Lưu và sử dụng lại các bước |
| Lượng thông tin bằng tiếng Nhật | nhiều | Nó đang tăng lên, nhưng nó đang giảm dần. |
| hiệu quả bộ nhớ | tiêu chuẩn | nói chung là tốt |
Nói cách khác, những người muốn tạo ảnh trước tiên nên sử dụng AUTOMATIC1111 và những người lặp lại quy trình tương tự mỗi lần nên sử dụng ComfyUI. Đây là bước ngoặt.
Nếu bạn gặp khó khăn khi đưa ra quyết định, tốt nhất bạn nên đọc bài viết sắp xếp mối quan hệ giữa ComfyUI và Stable Diffusion và xem hình ảnh màn hình thực tế của loại nút trước khi đưa ra quyết định.
Theo quan điểm cá nhân của tôi, lựa chọn đầu tiên của tôi là AUTOMATIC1111. ComfyUI có cái thú vị là tạo ra các quy trình công việc, nhưng mặt khác, phải mất rất nhiều thời gian để "có được hình ảnh". Tỷ lệ thất bại là khác nhau.
Nếu bạn đang ở giai đoạn muốn kết hợp AI sáng tạo vào doanh nghiệp của mình thay vì như một sở thích cá nhân, bạn cũng cần xem xét cách quản lý nó trong công ty của mình. Cách xử lý các công cụ AI trong kiểm toán nội bộ có thể hữu ích cho việc tổ chức trước khi triển khai.
ComfyUI là một công cụ tạo hình ảnh cho phép bạn xây dựng và chạy các mô hình Stable Diffusion bằng cách sử dụng quy trình làm việc dựa trên nút. Việc xử lý như tạo văn bản thành hình ảnh, tạo hình ảnh thành hình ảnh, in-paint, nâng cấp, ControlNet, LoRA và SDXL có thể được kết nối trên cơ sở từng nút. Nó được thiết kế để dễ dàng tái tạo và điều chỉnh vì quy trình làm việc tại thời điểm tạo có thể được đọc từ siêu dữ liệu có trong hình ảnh được tạo. Nó phù hợp cho những người sáng tạo muốn tự mình lắp ráp các quy trình tạo chi tiết và những người dùng nâng cao muốn quản lý quy trình sản xuất và xác minh mô hình.
Tùy chọn chạy trên đám mây (Colab/Docker)
AUTOMATIC1111 có thể được vận hành ngay cả khi bạn không có PC được trang bị GPU. Điều này là do có hai cách để thực hiện việc này: thông qua các dịch vụ trực tuyến như Google Colab hoặc qua các vùng chứa như Docker.
Google Colab là hệ thống thuê môi trường thực thi được trang bị GPU trên trình duyệt. Có hạn ngạch miễn phí, nhưng thực tế là hạn ngạch đó không phù hợp cho mục đích tạo hình ảnh. Colab Pro trả phí có giá 1.179 yên Nhật mỗi tháng và có 100 đơn vị điện toán mỗi tháng (tính đến tháng 8 năm 2026).
Các đơn vị tính toán được tiêu thụ theo loại GPU và thời gian sử dụng. Nói cách khác, số lượng sản phẩm bạn có thể làm trong một tháng không cố định. Nếu bạn chạy nó ở chế độ nặng trong thời gian dài, nó sẽ tan chảy ngay lập tức.
Via Docker dành cho những người muốn cài đặt mà không gây ô nhiễm môi trường. Ưu điểm là không cần lo lắng về xung đột với môi trường Python hiện có và bạn có thể tạo lại nó nếu nó bị hỏng. Tuy nhiên, nó yêu cầu cài đặt riêng để chuyển GPU vào vùng chứa nên không phù hợp với người mới bắt đầu.
Quyết định chi phí rất đơn giản. Nếu bạn muốn tạo ra hàng trăm sản phẩm mỗi tháng, hãy sử dụng môi trường địa phương, nhưng nếu bạn chỉ thỉnh thoảng chạm vào chúng, hãy sử dụng đám mây. Vui lòng tự tính toán điểm giao nhau giữa chi phí mua máy được trang bị GPU và tổng chi phí thanh toán trên đám mây.
Thông báo cấp phép và sử dụng thương mại
Đây là cạm bẫy lớn nhất. Bản thân AUTOMATIC1111 là mã nguồn mở và miễn phí, nhưng điều đó không có nghĩa là bạn có thể sử dụng hình ảnh được tạo ra cho mục đích thương mại.
Chính giấy phép của mô hình chứ không phải giao diện người dùng sẽ quyết định liệu nó có thể được sử dụng thương mại hay không. Ngay cả khi chúng được tạo bằng cùng một AUTOMATIC1111, việc xử lý sẽ khác nhau tùy thuộc vào kiểu máy được sử dụng.
Chúng tôi đã sắp xếp những điểm bạn nên kiểm tra.
- Giấy phép mẫu - sự kết hợp giữa giấy phép thương mại, phi thương mại và có điều kiện
- Giấy phép LoRA - các điều khoản có thể được đặt riêng biệt với mô hình ban đầu
- Quyền của nguồn học tập - LoRA đã được học nhằm vào phong cách của một nghệ sĩ cụ thể có thể có nguy cơ bị tranh chấp nếu sử dụng cho mục đích thương mại.
- Quyền đối với sản phẩm — Có những lĩnh vực mà việc xử lý không được xác định tùy thuộc vào quốc gia hoặc mục đích sử dụng.
Nói tóm lại, bạn không có lựa chọn nào khác ngoài việc đọc thông tin giấy phép trên trang phân phối nơi bạn lấy mô hình mỗi lần. Thật nguy hiểm khi nghĩ rằng ``nó miễn phí vì nó là phần mềm miễn phí.''
Khi sử dụng nó trong một công ty, một biện pháp an toàn là ghi lại những mẫu xe nào được sử dụng với giấy phép nào. Điều đáng sợ nhất là sau này bị hỏi một điều gì đó mà không thể trả lời được.
Cách xử lý các tắc nghẽn thông thường
Nhìn chung có các khuôn mẫu cố định khi nói đến các lĩnh vực mà bạn gặp rắc rối trong quá trình triển khai và vận hành. Chúng tôi sẽ tóm tắt các triệu chứng để bạn có thể tìm ra nguyên nhân từ các triệu chứng.
| triệu chứng | Nguyên nhân phổ biến | xử lý |
|---|---|---|
| không tìm thấy python khi khởi động | Quên thêm nó vào PATH | Cài đặt lại Python và kiểm tra nó |
| Dừng khi khởi động | Các phiên bản khác nhau của Python | Thay thế bằng 3.10.6 |
| CUDA hết bộ nhớ | Thiếu VRAM | Độ phân giải thấp hơn/thêm tùy chọn khởi động tiết kiệm bộ nhớ |
| Hình ảnh chuyển sang màu đen | Hành vi đã biết trên một số GPU | Hãy thử các tùy chọn khởi động như --no-half |
| Không bắt đầu sau khi cài đặt tiện ích mở rộng | Xung đột giữa các tiện ích mở rộng | Lưu thư mục của tiện ích mở rộng được cài đặt gần đây nhất |
Bằng cách này, các vấn đề khởi động chủ yếu tập trung vào Python hoặc VRAM.
Giải pháp nhanh nhất là dán thông báo lỗi vào cửa sổ tìm kiếm. Vì đây là phần mềm có nhiều người dùng nên khả năng cao sẽ tìm thấy các bản ghi có cùng triệu chứng. Nếu bạn muốn giao việc tìm kiếm cho AI, việc biết cách sử dụng AI dành riêng cho tìm kiếm như Felo sẽ rút ngắn quá trình điều tra.
Việc cập nhật có thể được thực hiện bằng git pull, nhưng không cập nhật môi trường đang chạy khi không cần thiết. Nếu nó ổn định và có thể sử dụng được thì nên giữ phiên bản đó.
Ban biên tập Phán quyết
Là môi trường tạo hình ảnh có thể được sử dụng miễn phí, AUTOMATIC1111 thật đặc biệt. Không có giới hạn trên đối với số lượng trang có thể được tạo, không có tệp nào được tạo trên máy chủ bên ngoài và có thể thêm các chức năng bằng tiện ích mở rộng. Không có nhiều dịch vụ, kể cả dịch vụ trả phí, có thể cùng lúc đáp ứng được 3 yêu cầu này.
Tuy nhiên, nó không dành cho tất cả mọi người. Đối với những người chỉ có PC mà không có GPU, sẽ có thêm các chi phí như thanh toán Colab hoặc thay thế PC. Trong trường hợp đó, tổng cộng có thể rẻ hơn nếu trả phí hàng tháng và chọn một dịch vụ có thể hoàn thành chỉ bằng trình duyệt.
Phán quyết riêng biệt. Nếu bạn có một PC được trang bị GPU NVIDIA thì đây là lựa chọn của bạn. Rõ ràng việc đầu tư một giờ thực hiện là rất đáng giá. Nếu bạn không có GPU và chỉ làm được vài chục chiếc mỗi tháng thì hơi khó khăn. Có rất ít lợi ích cho những rắc rối khi thanh toán trên nền tảng đám mây.
Và thực lòng tôi không khuyên bạn nên chọn ComfyUI cho trải nghiệm đầu tiên của mình. Phải mất rất nhiều thời gian để tìm hiểu cơ chế và cuối cùng bạn sẽ cạn kiệt năng lượng trước khi đạt được điểm quan trọng là "tạo một bức tranh". Trước tiên, hãy cảm nhận nó với AUTOMATIC1111, sau đó chuyển sang nó khi bạn cần. Đừng hiểu sai thứ tự.
Xem các so sánh/lựa chọn thay thế liên quan
Có rất nhiều lựa chọn cho AI tạo hình ảnh và môi trường cục bộ miễn phí có thể không phải là giải pháp tốt nhất. So sánh theo cách sử dụng.
- Stable Diffusion so với giữa hành trình - Tùy thuộc vào việc bạn nhấn mạnh đến sự tự do hay chất lượng ban đầu
- ComfyUI vs Stable Diffusion - So sánh sự khác biệt trong giao diện người dùng chạy cùng một công cụ
- Midjourney vs Adobe Firefly - So sánh khi ưu tiên sự an tâm cho mục đích thương mại
- Stable Diffusion so với Adobe Firefly - Hai cách tiếp cận tương phản để xử lý quyền
- ComfyUI vs Midjourney - Sự phân cực của quy trình tự động và tính dễ sử dụng
- Danh sách các lựa chọn thay thế Stable Diffusion — Xem tất cả các tùy chọn của bạn
- Danh mục AI tạo hình ảnh - Thu hẹp các công cụ được liệt kê theo điều kiện
Điều đầu tiên bạn nên xem xét là một so sánh được viết dựa trên tiền đề gần với môi trường PC của chính bạn.
Midjourney là một công cụ tạo hình ảnh AI có thể tạo ra hình ảnh có độ phân giải cao từ các câu ngắn và hình ảnh tham chiếu đến phong cách nhiếp ảnh, hình minh họa và nghệ thuật ý tưởng. Ngoài khả năng nhập liệu nhanh chóng, các tham chiếu kiểu dáng dựa trên hình ảnh, bảng tâm trạng và cài đặt cá nhân hóa giúp bạn dễ dàng tái tạo các thiết kế phù hợp với thương hiệu hoặc dự án của mình. Sau khi tạo, bạn có thể tạo các biến thể, nâng cấp, thu nhỏ và chỉnh sửa một phần bằng trình chỉnh sửa trực tuyến, cho phép bạn tiến hành từ bản nháp thô đến sản phẩm cuối cùng trong cùng một môi trường. Nó phù hợp cho những người sáng tạo và người lập kế hoạch muốn xem xét một số lượng lớn các ý tưởng hình ảnh chất lượng cao trong một khoảng thời gian ngắn, chẳng hạn như cho quảng cáo, SNS, trò chơi, sản xuất video, v.v.
Các câu hỏi thường gặp (FAQ)
Q. AUTOMATIC1111 có thực sự miễn phí không?
Bản thân phần mềm này là miễn phí. Nó được xuất bản dưới dạng nguồn mở trên GitHub và không tính phí cho số lượng trang tính được tạo miễn là bạn chạy nó trên PC cục bộ của mình. Tất cả những gì bạn cần trả là phí sử dụng điện và đám mây nếu cần.
H. Tôi có thể sử dụng nó ngay cả khi máy tính của tôi không có GPU không?
Bạn có thể sử dụng nó. Có nhiều cách để chạy nó thông qua các dịch vụ trực tuyến như Google Colab hoặc qua vùng chứa Docker. Tuy nhiên, rất khó để hoạt động thoải mái chỉ với cấp miễn phí, vì vậy hãy cân nhắc rằng về cơ bản bạn bắt buộc phải đăng ký gói trả phí.
Q. Tôi có nên cài đặt phiên bản Python mới nhất không?
Khuyến nghị chính thức là 3.10.6. Nếu bạn sử dụng phiên bản mới hơn, các thư viện phụ thuộc có thể không khớp và có thể xảy ra lỗi trong quá trình khởi động. Chắc chắn tốt hơn hết là bạn không nên cập nhật những thông tin mới nhất ở đây.
Q. Sử dụng hình ảnh đã tạo cho công việc có được không?
Nó phụ thuộc vào kiểu máy được sử dụng và giấy phép LoRA, không phải giấy phép AUTOMATIC1111. Hãy chắc chắn kiểm tra thông tin trên trang phân phối. Thật nguy hiểm khi sử dụng nó cho mục đích thương mại với sự hiểu biết rằng nó miễn phí vì nó là phần mềm miễn phí.
H. Khi nào tôi nên chuyển sang ComfyUI?
Đây là lúc bạn bắt đầu lặp lại quy trình tạo giống nhau mỗi ngày. Giá trị của ComfyUI là bạn có thể lưu và sử dụng lại quy trình, do đó, bạn sẽ không thấy bất kỳ lợi thế nào ở giai đoạn mỗi lần bạn thử một bức ảnh khác nhau. Tốt nhất trước hết hãy củng cố nền móng bằng AUTOMATIC1111.
Q. Màn hình hiện bằng tiếng Anh, tôi có thể đổi sang tiếng Nhật được không?
Có thể. Nếu bạn cài đặt tiện ích mở rộng tiếng Nhật từ tab Tiện ích mở rộng, các menu và nhãn sẽ được hiển thị bằng tiếng Nhật. Tuy nhiên, thuật ngữ ở phần mở rộng có thể vẫn bằng tiếng Anh.
Q. Làm cách nào để khắc phục ngón tay cong của tôi?
Bạn nên sử dụng các gợi ý tiêu cực để loại trừ các biểu thức có xu hướng bị hỏng và nếu vẫn còn bất kỳ lỗi nào, hãy sử dụng tính năng inpainting để chỉ sơn lại những phần có liên quan. Nếu bạn muốn sửa toàn bộ bố cục, cài đặt ControlNet sẽ có hiệu quả.
Hỏi. Tôi nên chọn `.ckpt` hay `.safetensors` cho tệp mô hình?
Chọn .safetensor. Vì định dạng .ckpt cho phép nhúng mã tùy ý nên sẽ có rủi ro nếu không xác định được nguồn phân phối. Nếu cả hai định dạng đều có sẵn cho cùng một kiểu máy, hãy chắc chắn chọn định dạng sau.
Đọc cái này vào lần sau. Nếu bạn muốn mở rộng phạm vi của AI ngoài việc tạo hình ảnh, bài viết tổ chức các chức năng của Meta AI là phù hợp. Nếu bạn quen với việc sử dụng nó từ các khía cạnh bạn tiếp xúc hàng ngày, bạn sẽ nhanh chóng tìm hiểu những điểm chính của toàn bộ AI tổng hợp.
Trang web chính thức của từng công cụ (thông tin chính)
Giá cả, chức năng và phạm vi hỗ trợ là thông tin chính được cung cấp bởi trang web chính thức của mỗi công ty. Bài viết này dựa trên xác minh tại thời điểm xuất bản, nhưng hãy nhớ kiểm tra từng trang chính thức để biết các điều kiện chính xác và mới nhất.
- Stable Diffusion — Trang web chính thức (xem chi tiết)
- ComfyUI — Trang web chính thức (xem chi tiết)
- Midjourney — Trang web chính thức (xem chi tiết)
Bài viết liên quan
- AI ổn định là gì? Tóm tắt những gì bạn có thể làm, phí và điều kiện để sử dụng cho mục đích thương mại (phiên bản 2026)
- Giải pháp nào thay thế cho FLUX 3? 15 ứng cử viên miễn phí, tiếng Nhật và nguồn mở (phiên bản 2026)
- 7 lựa chọn thay thế cho Imagine AI — Các lựa chọn thay thế miễn phí, tiếng Nhật và nguồn mở (phiên bản 2026)
- [Mới nhất năm 2026] 15 lựa chọn thay thế cho Leonardo.ai | Được lựa chọn cẩn thận bởi nguồn mở, tiếng Nhật và miễn phí
- Cách sử dụng Fooocus | Các bước tạo SDXL cục bộ miễn phí và không cần bất kỳ cài đặt nào (phiên bản 2026)