Các điểm chính (câu trả lời trong 30 giây): Midjourney là công cụ tạo hình ảnh AI trả phí có thể được sử dụng trong ứng dụng web hoặc Discord, với mức Basic có sẵn bắt đầu từ $10/tháng (giá có thể thay đổi, xem phần chính thức). Bài viết này sẽ được giải thích dựa trên tiêu chuẩn V7, nhưng V8.1 cũng đã được phát hành kể từ tháng 5 năm 2026, vì vậy vui lòng kiểm tra tài liệu chính thức để biết thông số kỹ thuật mới nhất. Nếu bạn chỉ định lời nhắc dựa trên 7 yếu tố như chủ đề, bố cục, ánh sáng và màu sắc, bạn sẽ tiến gần hơn đến hình ảnh mà bạn đang hướng tới.
Hộp thông tin Ban biên tập
Xác nhận lần cuối: Ngày 1 tháng 8 năm 2026 bởi ban biên tập
Midjourney không có gói miễn phí. Tuy nhiên, nó đang nhận được sự ủng hộ đông đảo cho việc tạo hình ảnh AI của mình. ``Làm cách nào để bắt đầu?'' ``Có gì đã thay đổi trong V7?'' ``Tôi không biết mẹo prompt.'' Có quá nhiều thông tin đến nỗi nhiều người không biết bắt đầu từ đâu.
Vì vậy, chúng tôi đã sắp xếp mọi thứ từ cách chọn gói giá cho đến cách viết lời nhắc và các chức năng chính của V7. Tiêu chuẩn là Midjourney V7 được xác nhận kể từ tháng 5 năm 2026. Tuy nhiên, V8.1 cũng đã được phát hành, vì vậy vui lòng xem tài liệu chính thức để biết các tính năng mới nhất (Xác nhận lại vào tháng 5 năm 2026: Giá cập nhật, sự tồn tại của V8.1 và định vị của Mẫu video V1).
Các điểm chính của bài viết này Giải thích tất cả các tính năng của Midjourney V7 theo gói giá. Bao gồm thông tin mới nhất kể từ tháng 3 năm 2026, bao gồm cách sử dụng ứng dụng web, 7 yếu tố prompt, Tham khảo Omni và tạo video.
Những điểm chính của bài viết này
- Sự khác biệt giữa bốn gói giá của Midjourney và cách chọn
- Cách sử dụng ứng dụng web và Discord
- Các tính năng mới được thêm vào trong V7 (Tham chiếu Omni/Tạo video)
- 7 yếu tố gợi ý tạo hình ảnh bạn muốn
- Các quy tắc và biện pháp phòng ngừa khi sử dụng thương mại
- Cách sử dụng với các công cụ tạo ảnh AI khác
Midjourney là một công cụ tạo hình ảnh AI có thể tạo ra hình ảnh có độ phân giải cao từ các câu ngắn và hình ảnh tham chiếu đến phong cách nhiếp ảnh, hình minh họa và nghệ thuật ý tưởng. Ngoài khả năng nhập liệu nhanh chóng, các tham chiếu kiểu dáng dựa trên hình ảnh, bảng tâm trạng và cài đặt cá nhân hóa giúp bạn dễ dàng tái tạo các thiết kế phù hợp với thương hiệu hoặc dự án của mình. Sau khi tạo, bạn có thể tạo các biến thể, nâng cấp, thu nhỏ và chỉnh sửa một phần bằng trình chỉnh sửa trực tuyến, cho phép bạn tiến hành từ bản nháp thô đến sản phẩm cuối cùng trong cùng một môi trường. Nó phù hợp cho những người sáng tạo và người lập kế hoạch muốn xem xét một số lượng lớn các ý tưởng hình ảnh chất lượng cao trong một khoảng thời gian ngắn, chẳng hạn như cho quảng cáo, SNS, trò chơi, sản xuất video, v.v.
Kết luận sau 30 giây
Nếu bạn chọn dựa trên cách sử dụng, câu trả lời có thể được chia đại khái thành bốn loại.
- Nhấn mạnh vào hình ảnh có tính nghệ thuật cao → Midjourney được đánh giá cao về sản phẩm mang tính nghệ thuật (xếp hạng khác nhau tùy thuộc vào mục tiêu sử dụng và so sánh). Bắt đầu từ $10/tháng
- Tôi muốn tạo hình ảnh một cách dễ dàng và nhanh chóng → DALL-E 3 (tích hợp ChatGPT) là trở ngại thấp nhất
- Tôi muốn bắt đầu miễn phí → Các gói miễn phí của Stable Diffusion hoặc Adobe Firefly là những ứng cử viên
- Theo đuổi chủ nghĩa hiện thực của ảnh → Chế độ Raw hoặc FLUX của Midjourney V7 mạnh
- Tính nhất quán của ký tự → Omni Reference (--oref) của V7 mang tính cách mạng
Khi chọn Midjourney, trước tiên bạn nên hiểu nó là loại công cụ gì.
Tôi cũng muốn đọc nó
7 lựa chọn thay thế cho Nano Banana trong Google Earth, miễn phí và có sẵn bằng tiếng Nhật (phiên bản 2026)
Nano Banana trên phiên bản web của Google Earth đã tạm thời bị đình chỉ kể từ một ngày sau khi phát hành (kể từ tháng 8 năm 2026). Chúng tôi đã so sánh bảy lựa chọn thay thế trên ba trục: miễn phí, tiếng Nhật và nguồn mở, đồng thời sắp xếp cách lựa chọn dựa trên mục đích trực quan hóa bản đồ. Bạn có thể thấy các điểm đến di chuyển thực tế bao gồm ComfyUI và Stable Diffusion.
Ngày 5 tháng 8 năm 2026
OpenPose là gì? Cơ chế chỉ định các tư thế với hình người que, điều kiện sử dụng thương mại và các công cụ thay thế (phiên bản 2026)
OpenPose là một thư viện mã nguồn mở phát hiện tư thế của con người dưới dạng bộ xương hình que. Nó chỉ được sử dụng miễn phí cho mục đích phi thương mại và giấy phép thương mại có giá 25.000 USD mỗi năm. Chúng tôi đã tóm tắt mọi thứ từ cách thức hoạt động, cách sử dụng nó với ControlNet, nó khác với các lựa chọn thay thế như MediaPipe như thế nào và các tiêu chí để xác định mục đích sử dụng thương mại.
Ngày 4 tháng 8 năm 2026
DALL-E 3 là một công cụ tạo hình ảnh AI có thể tạo ra các hình ảnh như hình minh họa, hình ảnh và tài liệu quảng cáo từ hướng dẫn văn bản. Khi sử dụng ChatGPT, bạn có thể tạo lời nhắc và đưa ra hướng dẫn chỉnh sửa trong khi truyền đạt bố cục và bầu không khí mà bạn muốn tạo thông qua cuộc trò chuyện. Nó cũng hỗ trợ biểu thức văn bản và mô tả chi tiết bằng hình ảnh, đồng thời bạn có thể thực hiện các yêu cầu tương tác để thay đổi nền, điều chỉnh màu sắc, tạo kế hoạch thay thế, v.v. Nó phù hợp cho các nhà tiếp thị, biên tập viên và người sáng tạo cá nhân muốn nhanh chóng tạo ý tưởng thiết kế và hình ảnh để đăng trên SNS.
Giữa cuộc hành trình là gì? Vị trí hiện tại vào năm 2026
Midjourney là một nền tảng tạo hình ảnh AI độc lập được phát triển bởi David Holz và một nhóm các nhà nghiên cứu. Đây là một công ty độc lập không có vốn từ Google hay OpenAI và luôn giương cao khẩu hiệu “tạo ra hình ảnh có tính nghệ thuật cao”.
Kể từ khi phát hành vào tháng 7 năm 2022, nó đã nhanh chóng trở nên phổ biến nhờ giao diện dựa trên Discord độc đáo. Tính đến tháng 3 năm 2026, số lượng người dùng hoạt động hàng tháng đã vượt quá hàng chục triệu và giờ đây nó đồng nghĩa với việc tạo hình ảnh AI.
Tại sao nó được hỗ trợ như vậy? Những lý do có thể được chia thành ba.
3 lý do để chọn Midjour
- Chất lượng hình ảnh vượt trội Chủ nghĩa quang học đã có một bước tiến lớn ở V7. Trong 30 loại thử nghiệm nhanh chóng, những cải tiến ở 23 mục so với V6 đã được xác nhận: kết cấu da, chi tiết vải, biểu hiện bóng.
- Tính thẩm mỹ độc đáo Ngay cả khi được đưa ra cùng một lời nhắc, Midjourney có xu hướng tạo ra nhiều kết quả "đẹp" hơn các công cụ khác. Điều này là do các thuật toán độc đáo được sử dụng để cân bằng màu sắc, bố cục và xử lý ánh sáng.
- Tính năng Omni Reference của Character Consistency V7 giúp dễ dàng giữ khuôn mặt, kiểu cơ thể và quần áo của nhân vật giống nhau trên nhiều hình ảnh. Nó rất hữu ích trong việc sản xuất truyện tranh, sách tranh và hình ảnh thương hiệu (độ chính xác của việc sao chép phụ thuộc vào hình ảnh tham chiếu và lời nhắc, đồng thời không đảm bảo sự trùng khớp chính xác).
Chúng ta hãy xem những gì chúng ta có thể tạo ra một cách cụ thể.
Bạn có thể làm gì ở Midjourney (phiên bản 2026)
- Tạo hình ảnh: Tạo tác phẩm nghệ thuật, ảnh và hình minh họa chất lượng cao từ lời nhắc văn bản
- Các biến thể của hình ảnh: Phối lại/thay đổi kiểu của hình ảnh được tạo
- Nâng cấp: Đầu ra PNG lên tới 2048 x 2048 pixel
- Duy trì tính nhất quán của ký tự: Mở rộng cùng một ký tự thành nhiều hình ảnh bằng Omni Reference (--oref)
- Tham chiếu kiểu: --sref áp dụng một kiểu cụ thể cho các lời nhắc khác
- Trình chỉnh sửa web: Chỉnh sửa một phần/Tẩy/Tiện ích mở rộng (Outpaint)
- Tạo video: Tạo hoạt ảnh từ ảnh tĩnh (tương thích với V7)
- Cá nhân hóa: Tùy chỉnh đầu ra cho phù hợp với sở thích của bạn
Khi bạn đã hiểu rõ các tính năng, điều tiếp theo cần quan tâm là giá cả.
So sánh gói giá hoàn chỉnh | Sự khác biệt giữa bốn phương án và cách lựa chọn
Tất cả các gói Midjourney đều được thanh toán. bản dùng thử không có sẵn kể từ tháng 5 năm 2026. Có hai tùy chọn thanh toán: hàng tháng và hàng năm (giảm giá khoảng 20%) (vui lòng tham khảo trang web chính thức vì phí và tỷ lệ chiết khấu khác nhau).
Bốn gói này chủ yếu khác nhau ở lượng thời gian GPU nhanh và sự hiện diện hay vắng mặt của chế độ ẩn.
4 chi tiết kế hoạch
Gói cơ bản ($10/tháng)
- Tạo khoảng 200 hình ảnh mỗi tháng (khoảng 3,3 giờ thời gian GPU)
- Không có chế độ thư giãn
- 3 công việc cùng lúc
- Sử dụng thương mại OK
- Khuyến nghị: Những người mới bắt đầu muốn dùng thử trước và những người chỉ cần vài chục chiếc mỗi tháng.
Gói tiêu chuẩn ($30/tháng)
- 15 giờ Thời gian GPU nhanh
- Chế độ thư giãn không giới hạn (tốc độ chậm nhưng không giới hạn số tờ)
- 3 công việc cùng lúc
- Sử dụng thương mại OK
- Khuyến nghị: Dành cho người sáng tạo và nhà tiếp thị nội dung sử dụng nó hàng ngày
Gói chuyên nghiệp ($60/tháng)
- 30 giờ Thời gian GPU nhanh
- Chế độ thư giãn không giới hạn
- Chế độ ẩn (hình ảnh được tạo không xuất hiện trong thư viện công cộng)
- 12 công việc cùng lúc
- Sử dụng thương mại OK
- Khuyến nghị: Nhà thiết kế có nhiều mục đích sử dụng thương mại, công việc của khách hàng đòi hỏi sự riêng tư
Gói Mega ($120/tháng)
- 60 giờ thời gian GPU nhanh
- Chế độ thư giãn không giới hạn
- chế độ tàng hình
- 12 công việc cùng lúc
- Sử dụng thương mại OK
- Đề xuất cho: Các công ty sản xuất và cơ quan cần sản xuất hàng loạt.
Ngay cả khi chỉ nhìn vào những con số về số lượng hình ảnh và thời gian GPU, bạn sẽ không thể biết nên chọn cái nào. Hãy tập trung phán đoán của chúng tôi.
Bạn nên chọn phương án nào?
Nếu bạn không thể quyết định, Standard ($30/tháng) là an toàn. Có chế độ Thư giãn, do đó bạn có thể sử dụng hình ảnh hầu như không giới hạn và thời gian chụp nhanh 15 giờ mỗi tháng cho phép bạn xử lý các tác vụ khẩn cấp. Mức độ tự do mà bạn có thể nhận được với mức chênh lệch 20 USD so với 10 USD của Basic lớn hơn nhiều so với những gì bạn có thể tưởng tượng.
Chỉ những chuyên gia nhận công việc của khách hàng mới cần chế độ ẩn. Nếu mục đích của bạn là sử dụng cá nhân hoặc đăng lên SNS thì không cần phải vượt quá Pro.
Khi bạn đã quyết định được kế hoạch, bạn sẽ bắt đầu từ đâu? Midjourney có hai lối vào.
Làm thế nào để bắt đầu | Hai lối vào: ứng dụng web và Discord
Cách 1: Ứng dụng web (khuyên dùng)
Kể từ năm 2026, ứng dụng web (midjourney.com) là lối vào chính thức được đề xuất.
- Truy cập midjourney.com
- Đăng ký bằng tài khoản Google hoặc địa chỉ email của bạn
- Chọn gói và thanh toán
- Nhập hướng dẫn vào thanh nhắc ở cuối màn hình
- 4 hình ảnh ứng cử viên được tạo ra
Bốn điểm này có hiệu quả đối với các ứng dụng web.
- Giao diện người dùng trực quan: Nhập lời nhắc, xem và quản lý tất cả hình ảnh trên một màn hình
- Chức năng soạn thảo: Có thể sử dụng chỉnh sửa một phần, mở rộng (Outpaint) và tẩy
- Tính năng khám phá: Xem công việc và lời nhắc của người dùng khác
- Sắp xếp/tìm kiếm: Chia các hình ảnh được tạo trước đây vào các thư mục và tìm kiếm theo từ khóa
Cách 2: Bất hòa
Discord là giao diện ban đầu và vẫn hoạt động.
- Tham gia máy chủ tại discord.gg/midjourney
- Liên kết tài khoản
- / tưởng tượng lệnh nhập vào dấu nhắc
- Được vận hành bằng các nút U1~U4 (cao cấp), V1~V4 (biến thể)
Sức mạnh độc đáo của Discord nằm ở khía cạnh cộng đồng.
- Tương tác thời gian thực với cộng đồng
- Bạn có thể quan sát quá trình tạo của những người dùng khác trong thời gian thực.
- Tạo ngược các lời nhắc từ hình ảnh bằng lệnh /describe
Vậy bạn nên vào bằng đường nào?
Tôi nên sử dụng cái nào: Web hay Discord?
Người mới bắt đầu chỉ có thể chọn ứng dụng web. Giao diện người dùng trực quan và các chức năng soạn thảo có thể được sử dụng như hiện tại. Discord được sử dụng tốt nhất khi bạn muốn cảm nhận bầu không khí cộng đồng hoặc xem lời nhắc của người khác trong thời gian thực.
Khi bạn đã quyết định lựa chọn lối vào, việc biết những gì đã thay đổi với V7 sẽ giúp bạn hiểu rõ hơn về cách sử dụng nó.
Tính năng mới của V7 | Điểm tiến hóa từ V6
MidjourneyV7 là bản cập nhật lớn giúp tổ chức lại kiến trúc về cơ bản. Chúng tôi sẽ tập trung vào sáu điểm chính đã thay đổi kể từ động cơ V6.
1. Cải thiện đáng kể tính chân thực của ảnh
Ở V7, người ta nói rằng kết cấu da, kết cấu vải và độ đổ bóng đã được cải thiện trong thông báo chính thức. Tùy thuộc vào mục đích, kích thước và điều kiện xem, có thể khó phân biệt ảnh chân dung với ảnh thật. Tuy nhiên, khả năng nhận dạng khác nhau tùy thuộc vào kết quả đầu ra, vì vậy vui lòng xác minh nó để bạn sử dụng trước khi đưa ra quyết định (kể từ tháng 5 năm 2026).
Chìa khóa của chủ nghĩa hiện thực là --style raw. Tham số này giảm bớt các bộ lọc thẩm mỹ của Midjourney, làm cho đầu ra mang tính nhiếp ảnh hơn. Nếu bạn đang hướng tới chủ nghĩa quang học, nó có thể được coi là một thông số gần như thiết yếu.
2. Tham chiếu Omni (--oref) - Một cuộc cách mạng về tính nhất quán của ký tự
Đây chính là điểm nhấn lớn nhất của V7. Sự xuất hiện của một người, nhân vật hoặc đồ vật cụ thể có thể nhất quán qua nhiều lời nhắc.
/hãy tưởng tượng một người phụ nữ đang đi dạo trong công viên --oref [URL hình ảnh tham khảo] --ow 80
- --oref: Chỉ định URL của hình ảnh tham chiếu (chỉ hỗ trợ hình ảnh duy nhất)
- --ow: Cường độ tham chiếu (mặc định là 100). Vui lòng tham khảo tài liệu chính thức để biết phạm vi có thể chỉ định, giá trị giới hạn trên và hành vi khi tăng cường độ (nếu quá cao, nó có thể tuân theo hình ảnh tham chiếu quá mức và làm giảm chất lượng)
- Bố cục kiểu của nhiều hình ảnh được hỗ trợ bằng cách sử dụng Style Reference (--sref), v.v.
Cách sử dụng tốt nhất của nó là tập trung vào việc tạo chuỗi.
- Thống nhất các ký tự của sách tranh trên tất cả các trang
- Triển khai linh vật thương hiệu ở nhiều cảnh khác nhau
- Sản xuất chuỗi nhân vật cho SNS
--cref (Tham chiếu ký tự) cũ vẫn có thể được sử dụng, nhưng Tham chiếu Omni được cho là linh hoạt hơn và chính xác hơn.
3. Tham chiếu kiểu nâng cao (--sref)
Trong V7, giờ đây có thể chỉ định nhiều hình ảnh tham chiếu kiểu cùng một lúc.
/tưởng tượng một con mèo trong vườn --sref [URL hình ảnh1] [URL hình ảnh2] --sw 80
- --sw: Ảnh hưởng của phong cách (0 đến 1000, mặc định 100)
- Tạo phong cách độc đáo của riêng bạn bằng cách kết hợp phong cách của hai hoặc nhiều hình ảnh
4. Cải thiện tính năng vẽ văn bản
Trong V7, văn bản được trích dẫn trong lời nhắc hiện được vẽ dưới dạng hình ảnh với độ chính xác cao hơn. Việc thiết kế logo, áp phích, bảng hiệu,… đã đạt đến mức thực tế.
5. Tạo video (Mô hình video V1)
Việc tạo video được cung cấp dưới dạng Mô hình Video V1 của Midjourney, đây là một chức năng riêng biệt với mô hình hình ảnh (V7). Bạn có thể tạo hoạt ảnh ngắn từ ảnh tĩnh và có các tùy chọn như Chuyển động thấp/Chuyển động cao. Các gói tương thích, độ phân giải, tính khả dụng của chế độ Thư giãn và chi phí cho mỗi video sẽ khác nhau, vì vậy vui lòng kiểm tra tài liệu chính thức để biết thông số kỹ thuật và giá mới nhất (kể từ tháng 5 năm 2026).
6. Độ chính xác của bản vẽ tay/mặt
Điểm yếu lâu nay của việc tạo hình ảnh AI là vấn đề bàn tay có 6 ngón gần như đã được giải quyết hoàn toàn với V7. Ngay cả những tư thế và cử chỉ tay phức tạp cũng có thể được khắc họa một cách tự nhiên.
Ngay cả khi bạn biết chức năng, chính những lời nhắc sẽ quyết định chất lượng đầu ra. Đây là nơi sự thật bắt đầu.
Cách viết lời nhắc | 7 yếu tố tạo nên hình ảnh bạn mong muốn
Lời nhắc của Midjourney về cơ bản là "Viết bằng tiếng Anh". Mặc dù tôi có thể hiểu tiếng Nhật nhưng tiếng Anh chính xác hơn và có phạm vi diễn đạt rộng hơn.
7 yếu tố của lời nhắc
Những lời nhắc hiệu quả được xây dựng dựa trên bảy yếu tố sau: Bạn không cần phải đặt mọi thứ vào mọi lúc, nhưng sẽ rất hữu ích nếu bạn nhớ nó như một ngăn kéo để có được hình ảnh mà bạn đang hướng tới.
- Chủ đề - vẽ gì
- Mọi người: một phụ nữ trẻ người Nhật, một ông già đeo kính
- Động vật: một chú chó tha mồi vàng, một con mèo trắng
- Đối tượng: một chiếc máy ảnh cổ điển, một chiếc khinh khí cầu steampunk
- Trung bình - định dạng gì?
- ảnh chụp, tranh sơn dầu, Màu nước, Render 3D, Phác họa bằng bút chì, nghệ thuật số
- Môi trường - ở đâu
- trong một con hẻm ở Tokyo vào ban đêm, rạn san hô dưới nước, trên đỉnh núi lúc bình minh
- Ánh sáng - loại ánh sáng nào?
- ánh sáng giờ vàng, đèn neon, ánh sáng studio, chiaroscuro ấn tượng
- Màu sắc – tông màu
- màu sắc rực rỡ, tông màu đất trầm, đơn sắc, bảng màu pastel
- Tâm trạng – cảm xúc
- thanh thản, tràn đầy năng lượng, bí ẩn, u sầu, hay thay đổi
- Bố cục - góc máy ảnh
- chân dung cận cảnh, nhìn từ trên không, ảnh góc rộng, quy tắc một phần ba
Có một khuôn mẫu lỏng lẻo về thứ tự sắp xếp các phần tử.
Cú pháp prompt
/imagine [mô tả] --ar [tỷ lệ khung hình] --v 7 [tham số bổ sung]
Khi bạn đã có sẵn mẫu, việc xem xét các kết hợp thực tế sẽ nhanh hơn.
Ví dụ thực tế
Chụp ảnh doanh nghiệp chuyên nghiệp: /hãy tưởng tượng một nữ doanh nhân tự tin trong văn phòng hiện đại ở Tokyo, ánh sáng tự nhiên ấm áp từ cửa sổ kính suốt từ trần đến sàn, độ sâu trường ảnh nông, chụp trên Sony A7IV --ar 16:9 --v 7 --style raw
Minh họa giả tưởng: /tưởng tượng một khu rừng huyền diệu với những cây nấm phát quang, một nàng tiên nhỏ ngồi trên lá, phong cách màu nước, bầu không khí mộng mơ, màu phấn nhẹ nhàng --ar 3:4 --v 7 --stylize 800
Ảnh chụp sản phẩm: /hãy tưởng tượng một chiếc tai nghe không dây kiểu dáng đẹp nổi trên nền trắng tinh, ánh sáng studio, chụp ảnh sản phẩm, hình thức thương mại cao cấp, tối giản --ar 1:1 --v 7 --style raw
Tham số -- ở cuối từ sẽ trở thành đòn bẩy điều khiển giúp kiểm soát đầu ra một cách tinh tế. Hãy tập trung vào những điều chính.
Danh sách các thông số chính
- --ar ngang:dọc — tỷ lệ khung hình. 16:9 (ngang), 3:4 (dọc), 1:1 (vuông)
- --v 7 — phiên bản mẫu. V7 là mới nhất (V8 Alpha cũng có sẵn)
- --stylize N (--s N) — Sức mạnh nghệ thuật (0-1000). Giá trị càng cao thì khả năng xử lý thẩm mỹ độc đáo của Midjourney càng mạnh mẽ.
- --style raw — loại bỏ bộ lọc thẩm mỹ. Lý tưởng cho hình ảnh chân thực
- --chaos N (--c N) — Tính ngẫu nhiên (0-100). Cao hơn là kết quả khó dự đoán hơn
- --no [element] — Dấu nhắc tiêu cực. Chỉ định các yếu tố bạn muốn loại trừ
- --quality N (--q N) — Chất lượng thế hệ (0 đến 2). Cao hơn là chất lượng tốt hơn nhưng chậm hơn
- --oref [URL] - Tham khảo Omni. Tính nhất quán của ký tự (chỉ V7)
- --sref [URL] - Tham chiếu kiểu. Áp dụng một phong cách cụ thể
- --cref [URL] - Tham chiếu ký tự. sự nhất quán trên khuôn mặt
Khi bạn đã ghi nhớ các thông số, có năm mẹo để nâng sản lượng của bạn lên cấp độ tiếp theo.
5 lời khuyên cho lời nhắc
- Cụ thể: ❌ phong cảnh đẹp ✅ thung lũng núi mù sương lúc bình minh, rừng thông, dòng sông uốn lượn phản chiếu bầu trời màu cam Tính từ trừu tượng giống như giữa cuộc hành trình. Bạn càng chia nhỏ khung cảnh và diễn đạt nó thành lời thì bạn càng tiến gần đến mục tiêu của mình hơn.
- Sử dụng thuật ngữ máy ảnh Nếu bạn bao gồm các cài đặt máy ảnh thực tế, chẳng hạn như chụp trên phim 35mm, ống kính 85mm, hiệu ứng mờ f/1.4, bạn có thể dễ dàng thu được kết quả ảnh chân thực.
- Tránh sử dụng tên nghệ sĩ Vì lý do bản quyền, tránh đưa tên nghệ sĩ còn sống vào lời nhắc. Thay vào đó, có thể chỉ định phong cách nghệ thuật một cách an toàn, chẳng hạn như theo phong cách tân nghệ thuật.
- Học ngược với /describe Nếu bạn đưa hình ảnh yêu thích của mình vào /describe, nó sẽ trả về bốn lời nhắc có thể có để tái tạo hình ảnh đó. Đó là cơ sở thực hành hoàn hảo để mở rộng vốn từ vựng của bạn.
- Nó thay đổi rất nhiều tùy thuộc vào giá trị của --stylize.
- 0-100: Đúng như lời nhắc (ảnh thực)
- 100-500: Cân bằng
- 500-1000: Quá trình xử lý thẩm mỹ độc đáo của Midjourney được thể hiện đầy đủ (nghệ thuật)
Nếu bạn sử dụng hình ảnh được tạo có lời nhắc cho công việc, bạn phải tuân theo các quy tắc sử dụng cho mục đích thương mại.
Các quy tắc và biện pháp phòng ngừa khi sử dụng thương mại
Sử dụng thương mại là ổn với điều kiện.
Theo nguyên tắc chung, nếu bạn là người đăng ký gói trả phí, bạn có thể sử dụng hình ảnh được tạo cho mục đích thương mại. Tuy nhiên, có một số điều kiện và biện pháp phòng ngừa cần được thực hiện.
- Các công ty có doanh thu hàng năm từ 1 triệu USD (khoảng 150 triệu yên Nhật) trở lên: Phải đăng ký gói Pro hoặc cao hơn (không thể sử dụng cho mục đích thương mại đối với các điều kiện Cơ bản/Tiêu chuẩn. Ngoại lệ được chỉ định trong Điều khoản dịch vụ chính thức)
- Chế độ ẩn: Chỉ khả dụng trên các gói Pro trở lên. Theo mặc định, hình ảnh được tạo sẽ hiển thị trong thư viện công cộng của Midjourney.
- Khi tham chiếu đến hình ảnh của người khác: Khi tham chiếu đến tác phẩm có bản quyền của người khác bằng cách sử dụng --oref/--sref, v.v., người dùng có trách nhiệm xin phép sử dụng tác phẩm đó.
- Quyền sở hữu/quyết định bản quyền: Người dùng chịu trách nhiệm đưa ra quyết định cuối cùng về quyền và việc sử dụng thương mại các sản phẩm AI. Vì các điều khoản và luật pháp của mỗi quốc gia thay đổi theo thời gian, chúng tôi khuyên bạn nên kiểm tra Điều khoản dịch vụ chính thức và luật pháp địa phương.
- Lợi ích mới của V7: Không cần ghi công đối với các gói trả phí
- Bản quyền: Bản quyền đối với hình ảnh do AI tạo sinh có cách hiểu pháp lý khác nhau tùy thuộc vào quốc gia/khu vực. Khuyến nghị xác nhận pháp lý cho các dự án quan trọng
Điều tiếp theo mà những người muốn sử dụng cho mục đích thương mại với số lượng lớn sẽ gặp phải là rào cản API.
API là riêng tư
Kể từ tháng 3 năm 2026, Midjourney không cung cấp API công khai. Đây là một chiến lược có chủ ý, tập trung vào trải nghiệm trong nền tảng. Nếu cần xử lý hàng loạt một lượng lớn, việc xem xét API DALL-E 3 hoặc môi trường cục bộ Stable Diffusion là thực tế.
Sức mạnh của Midjourney không chỉ nằm ở bản thân thế hệ mà còn ở những sửa đổi sau thế hệ.
Stable Diffusion là mô hình tạo hình ảnh AI có thể tạo hình ảnh từ hướng dẫn văn bản hoặc chỉnh sửa hình ảnh hiện có. Ngoài việc tạo hình ảnh bằng lời nhắc, nó còn hỗ trợ img2img, tạo hình ảnh từ hình ảnh, chỉnh sửa một phần và điều chỉnh kiểu bằng mô hình và LoRA. Nếu bạn cài đặt nó trong môi trường cục bộ của mình, bạn có thể tạo trong khi kiểm soát chi tiết cài đặt tạo và quy trình làm việc. Nó phù hợp cho các nhà thiết kế muốn tạo môi trường sản xuất của riêng họ, người sáng tạo minh họa và người dùng nâng cao muốn thử nghiệm sâu sắc về việc tạo hình ảnh AI.
Cách sử dụng trình soạn thảo web
Chức năng soạn thảo có trong ứng dụng web sẽ phát huy tác dụng với việc tinh chỉnh sau mỗi thế hệ. Hãy tập trung vào ba đại diện.
Chỉnh sửa một phần (Inpaint)
Chọn một phần hình ảnh bằng công cụ tẩy và thêm lời nhắc mới để thay thế nó. Nó phù hợp để thực hiện các điều chỉnh chi tiết chẳng hạn như ``Tôi chỉ muốn thay quần áo của một người trong khi vẫn giữ nguyên phông nền.''
Mở rộng (Outpaint)
Tự động tạo và mở rộng phần bên ngoài của hình ảnh. Điều này hữu ích khi bạn muốn thay đổi bố cục, chẳng hạn như kéo dài hình ảnh vuông theo kích thước của biểu ngữ ngang.
phóng
"Kéo" hình ảnh để tạo ra một vùng rộng hơn. Nó có thể được sử dụng để tạo ra một hình ảnh tổng thể từ cận cảnh của một đối tượng.
Cho đến nay chúng ta chỉ xem xét Midjourney nhưng chúng tôi cũng muốn làm rõ mối quan hệ vị trí của nó với các công cụ khác.
So sánh với các công cụ tạo hình ảnh AI khác
Khi bốn công cụ chính được đặt cạnh nhau, lĩnh vực chuyên môn tương ứng của chúng sẽ được tách biệt rõ ràng.
| Điểm so sánh | giữa hành trình | DALL-E 3 | Stable Diffusion | Adobe đom đóm |
|---|---|---|---|---|
| vẻ đẹp của hình ảnh | ◎ Đỉnh cao nhất | ○ Ổn định | ○ Phụ thuộc vào cài đặt | ○ Thiên nhiên |
| chủ nghĩa hiện thực | ◎ Cải tiến vượt bậc với V7 | ○ Tốt | ◎ Mô hình FLUX | ○ Tốt |
| Lời nhắc tiếng Nhật | △ Khuyến khích sử dụng tiếng Anh | ◎ Tích hợp ChatGPT | △ Khuyến khích sử dụng tiếng Anh | ○ Tương thích |
| Sự tiện lợi | ○ Web/Bất hòa | ◎ Từ ChatGPT | △ Yêu cầu xây dựng môi trường | ◎ Hoàn thành trên trình duyệt |
| Gói miễn phí | ✕ Không có | ○ Bị giới hạn | ◎ Hoàn toàn miễn phí | ○ 25 tín chỉ mỗi tháng |
| sử dụng thương mại | ◎ Tất cả các kế hoạch | ◎ Tương thích | ◎ Tương thích | ◎ An toàn chứng khoán Adobe |
| API | ✕ Riêng tư | ◎ Hoàn thành | ◎ Cục bộ/API | ○ API được cung cấp |
| tính nhất quán của ký tự | ◎ Tham chiếu tổng thể | △ Yếu | ○ Phụ thuộc vào LoRA | △ Yếu |
Tóm tắt bảng này lại bằng một từ, không phải là hơn hay kém mà là tùy vào mục đích.
Hướng dẫn sử dụng hợp lý
- Tôi muốn “hình ảnh đẹp nhất” → Giữa cuộc hành trình
- Tôi muốn tạo hình ảnh một cách dễ dàng nhất → DALL-E 3 (chỉ cần nói chuyện với ChatGPT)
- Tôi muốn tạo "miễn phí và không giới hạn" → Stable Diffusion (yêu cầu môi trường cục bộ)
- Muốn “giảm thiểu rủi ro bản quyền” → Adobe Firefly (Dữ liệu học tập của Adobe Stock)
Mặc dù động cơ V7 hiện tại là trọng tâm chính nhưng động cơ V8 thế hệ tiếp theo đã bắt đầu hoạt động.
Tin tức nóng hổi về V8 Alpha
Vào tháng 3 năm 2026, phiên bản alpha của Midjourney V8 đã được phát hành cho một số người dùng. Đây là những tính năng hiện có thể nhìn thấy được.
- Cải thiện sự hiểu biết về lời nhắc. Hướng dẫn phức tạp ít có khả năng thất bại
- Các giá trị cao hơn như --stylize 1000 nâng cao khả năng thể hiện nghệ thuật độc đáo
- Chủ nghĩa hiện thực được cải thiện hơn nữa với tham số --raw
- Đã thêm chế độ HD
- Phiên bản kiểu (kiểu trước đó có thể được gọi bằng --sv 6)
Tuy nhiên, động cơ V8 vẫn đang trong giai đoạn alpha. Để sử dụng ổn định, V7 vẫn được khuyên dùng ở thời điểm hiện tại.
Đánh giá độc lập về Ban biên tập liên tục đánh giá hơn 500 công cụ AI. Điểm của bạn sẽ không thay đổi tùy thuộc vào việc bạn đặt quảng cáo hay có quan hệ đối tác.
| tên công cụ | Tổng điểm | Loại phí |
|---|---|---|
| giữa hành trình | 91 điểm | Trả |
| DALL-E 3 | 85 điểm | freemium |
| Stable Diffusion | 86 điểm | miễn phí |
| Adobe đom đóm | 79 điểm | freemium |
Điểm được tính theo tiêu chuẩn riêng của ban biên tập. Vui lòng xem tiêu chí đánh giá để biết chi tiết.
Quan điểm của ban biên tập đằng sau bản nhạc cũng sẽ được giữ nguyên.
Biên bản xác minh của ban biên tập
Quan điểm xác minh
Có nhiều công cụ tạo hình ảnh AI, nhưng Midjourney, DALL-E 3, Stable Diffusion và Adobe Firefly mà chúng tôi so sánh trong bài viết này là đại diện cho những thế mạnh riêng biệt về ``nghệ thuật'', ``đơn giản'', ``khả năng tùy chỉnh'' và ``an toàn thương mại''. Khi so sánh thông tin được công bố rộng rãi, ban biên tập đặt ra ba trục sau.
- Sức mạnh biểu đạt của hình ảnh và định hướng phong cách hội họa (định hướng nghệ thuật/ảnh thực/minh họa)
- Dễ dàng bắt đầu và cơ cấu phí (có gói miễn phí/phí hàng tháng tối thiểu)
- Mối quan hệ quyền và sử dụng thương mại rõ ràng
Bằng cách sắp xếp lại các thông tin chính thức trên ba trục này, chúng ta có thể thấy được sơ lược của từng công cụ.
So sánh và tổ chức từ thông tin công cộng
| dụng cụ | Giá tối thiểu (thông tin chính thức) | Bậc miễn phí | Mẫu được cung cấp | sử dụng thương mại |
|---|---|---|---|---|
| giữa hành trình | Từ $10/tháng | không có | Web・Bất hòa | Điều kiện áp dụng tùy theo gói |
| DALL-E 3 | ChatGPT Plus từ $20/tháng | Có sẵn thông qua Bing Image Creator | Tích hợp ChatGPT/Bing | Có thể theo quy định |
| Stable Diffusion | Nguồn mở (miễn phí) | Có (thực thi cục bộ) | API/Cục bộ/Giao diện người dùng khác nhau | Yêu cầu xác nhận giấy phép |
| Adobe đom đóm | Gói miễn phí có sẵn | Có (tín dụng hàng tháng) | Tích hợp Web/Creative Cloud | Chính thức tuyên bố an toàn thương mại |
*Giá cả và thông số kỹ thuật tính đến tháng 5 năm 2026. Vui lòng tham khảo từng trang web chính thức để biết thông tin mới nhất.
Nhận định toàn diện của ban biên tập
Đánh giá từ các thông số kỹ thuật chính thức, các đề xuất theo ứng dụng có thể được sắp xếp như sau.
- Những người muốn ưu tiên công việc và nghệ thuật → Giữa cuộc hành trình. Một loạt các tiến bộ về khả năng biểu cảm, chẳng hạn như Omni Reference và tạo video của V7, khiến nó trở nên khác biệt so với phần còn lại.
- Những người muốn dùng thử miễn phí trước khi đưa ra quyết định → Adobe Firefly hoặc Stable Diffusion. Điểm mạnh của Firefly là chính thức công bố an toàn thương mại.
- Những người muốn tạo hình ảnh dựa trên luồng hội thoại → DALL-E 3. Gánh nặng thiết kế prompt nhẹ nhàng nhất khi tích hợp ChatGPT
Cuối cùng, tôi muốn tóm tắt một số câu hỏi chưa được đề cập trong văn bản chính.
Câu hỏi thường gặp
Q. Có thể sử dụng Midjourney với lời nhắc tiếng Nhật không?
Bạn có thể sử dụng nó. Các khái niệm đặc trưng của Nhật Bản như ``ukiyo-e'' và `` phong cách Nhật Bản '' thực sự có thể hiệu quả hơn bằng tiếng Nhật. Tuy nhiên, đối với những lời nhắc phức tạp, tiếng Anh sẽ chính xác hơn nên nên sử dụng tiếng Anh làm ngôn ngữ chính và tiếng Nhật làm ngôn ngữ bổ sung.
Q. Ai sở hữu bản quyền của hình ảnh được tạo ra?
Về mặt pháp lý, đó là một khu vực màu xám. Văn phòng Bản quyền Hoa Kỳ thường không công nhận bản quyền đối với các hình ảnh do AI tạo sinh, nhưng nếu có đủ sự tham gia sáng tạo của con người thì một số hình ảnh có thể được bảo vệ. Ở Nhật Bản, không có tiền lệ rõ ràng kể từ năm 2026. Để sử dụng cho mục đích thương mại, vui lòng kiểm tra điều khoản sử dụng của Midjourney.
Q. Có cách nào để sử dụng miễn phí không?
Kể từ tháng 3 năm 2026, Midjourney không có gói miễn phí. Trước đây đã có những bản dùng thử trong thời gian giới hạn nhưng chúng không phải là vĩnh viễn. Nếu bạn muốn dùng thử miễn phí tính năng tạo hình ảnh AI, hãy xem xét môi trường cục bộ của Stable Diffusion hoặc phiên bản miễn phí ChatGPT của DALL-E 3 (tối đa 2 hình ảnh mỗi ngày).
H. Nó có thể được sử dụng bên ngoài Discord không?
Đúng. Kể từ năm 2026, ứng dụng web (midjourney.com) là giao diện chính chính thức. Bạn vẫn có thể sử dụng Discord nhưng ứng dụng web có nhiều tính năng hơn.
H. Mất bao lâu để tạo ra một hình ảnh?
Khoảng 30 giây đến 1 phút ở chế độ Nhanh. Ở chế độ Thư giãn (Gói tiêu chuẩn trở lên), có thể mất vài đến 10 phút.
Tôi cũng muốn đọc nó
- [Mới nhất năm 2026] Hướng dẫn đầy đủ cách sử dụng Adobe Firefly và giá cả | Tạo hình ảnh AI phù hợp cho mục đích thương mại
- [Mới nhất năm 2026] Giải thích đầy đủ về cách sử dụng DALL-E 3 và các khoản phí của nó | Từ cách bắt đầu tạo hình ảnh ChatGPT cho đến các mẹo về lời nhắc
- [Mới nhất năm 2026] Hướng dẫn đầy đủ về cách sử dụng Ideogram AI và các gói giá | Giải pháp tối ưu để tạo hình ảnh bằng văn bản
Trang web chính thức của từng công cụ (thông tin chính)
Giá cả, chức năng và phạm vi hỗ trợ là thông tin chính được cung cấp bởi trang web chính thức của mỗi công ty. Bài viết này dựa trên xác minh tại thời điểm xuất bản, nhưng hãy nhớ kiểm tra từng trang chính thức để biết các điều kiện chính xác và mới nhất.
- Midjourney — Trang web chính thức (xem chi tiết)
- DALL-E 3 — Trang web chính thức (xem chi tiết)
- Stable Diffusion — Trang web chính thức (xem chi tiết)
- Adobe Firefly — Trang web chính thức (xem chi tiết)
Bài viết liên quan
- Tìm hiểu cách sử dụng Magnific AI và so sánh Topaz trong bài viết này