Ở đây có hướng dẫn cách tạo ảnh
bằng A.I siêu đơn giản!

5 phút làm chủ – Tạo ảnh AI với Stable Diffusion

4539
18.01.2024

Nhờ sự phát triển của trí tuệ nhân tạo (AI), giờ đây bạn có thể tạo ảnh nhân vật mà mình yêu thích dưới đa dạng các style, hành động,… mà bạn tưởng tượng. Nhưng cụ thể cần làm thế nào? Bài viết sẽ cung cấp cho các bạn cái nhìn tổng quan về Quy trình tạo ảnh AI cơ bản với Stable Diffusion. 

  • Bước 1: Cài đặt User Interface (UI)

Đây là bước bạn thiết lập những hiển thị cần thiết trên giao diện SD-webui của bạn. Cùng thực hiện nhé:

1.1. Mở tab Setting, lướt tới mục User Interface

1.2. Tại dòng thứ 2 [info] Quicksettings list (setting entries that appear at the top of page rather than in settings tab), viết thêm sd_vaeCLIP_stop_at_last_layer

1.3. Chọn Apply Setting và Reload UI

1.4. Cài đặt kết thúc nếu sau khi khởi động lại, bạn thấy 2 phần clip_skip và SD Vae xuất hiện ở trên cùng của giao diện web. 

  • Bước 2: Cài đặt Extension

Extension có thể hiểu đơn giản là những tiện ích bổ sung, giúp bạn tối ưu hiệu suất hay nâng cao chất lượng ảnh được tạo bởi Stable Diffusion. Dưới đây là một vài Extension thông dụng và khuyến khích nên cài: 

  • Controlnet: giúp kiểm soát ảnh đầu ra tốt hơn bằng cách tạo dáng sẵn hoặc từ các nét cơ bản
  • Adetailer: giúp mặt nhân vật đẹp hơn
  • Rembg: tách nền siêu xịn
  • Dynamic Prompt: cung cấp thêm các kỹ thuật và cú pháp prompt để có thể tạo 2000 ảnh với 2000 prompt khác nhau chỉ với 1 cú click chuột
  • Waifu Diffusion 1.4 (Tagger): tạo tag ảnh để train LoRA

Các bước để cài đặt extension: 

2.1. Vào tab “Extension”, chọn “Available”

2.2. chọn “Load from”

2.3. Tại Load from sẽ hiện ra một danh sách các extension có thể cài đặt, bạn có thể chọn từ danh sách đó hoặc gõ từ khóa vào thanh tìm kiếm.

  • Bước 3: Lựa chọn checkpoint

Checkpoint định hình phong cách và tính năng chung của tranh AI. Như vậy, có thể hiểu Lựa chọn checkpoint là lựa chọn artstyle chung cho mô hình cũng như bức tranh bạn muốn tạo (như 2D anime, 3D cartoon, Realistic,…).

Để khám phá và tải các Checkpoint,, các bạn có thể truy cập Civitai.com – nền tảng cung cấp các checkpoint và LoRA được model creators đăng tải lên. Để download, các bạn chọn tab model và cài đặt filter như hình dưới để tìm kiếm những hình ảnh phù hợp với nhu cầu của bản thân. 

  • Bước 4: Lựa chọn LoRa

LoRA được ví như một mini model được sử dụng để thay đổi các mô hình checkpoint chuẩn. Cụ thể, so với checkpoint, LoRA mang phong cách, chủ đề, hay đặc điểm cụ thể của hình ảnh. LoRA có thể là:

  • model nhân vật (ví dụ: muốn tạo nhân vật Veera thì lựa chọn LoRA Veera)
  • Một artstyle nhánh nằm trong Checkpoint (ví dụ: bạn lựa chọn checkpoint chung là 2D Anime, nhưng muốn cụ thể là phong cách ghibli studio thì chọn thêm LoRA artstyle ghibli)

Tương tự như Checkpoint, các bạn có thể tìm và tải LoRA tại Civitai.com bằng cách vào tab Models và cài đặt filter như hình dưới đây:

Thông thường, các LoRA sẽ đi kèm với các Trigger Word – những “từ ngữ” mô tả các đặc điểm của LoRA, và những chỉ khi trong câu mô tả tranh AI của bạn có bao gồm các từ ngữ có trong prompt, thì LoRA mới hoạt động.

Nếu tải LoRA ở CivitAI, bạn có thể xem trong phần mô tả để biết Trigger Word. Tất nhiên, không phải LoRA nào cũng có Trigger Word.

  • Bước 5: Mô tả tranh với Prompt

Prompt là đoạn văn bản chứa những từ ngữ mô tả đặc điểm tranh AI mà bạn muốn. Bạn có thể viết Prompt theo công thức như sau:

Chất lượng hình ảnh (Standard) + Chủ thể + Không gian + Màu sắc/Trang phục + Phong cách tranh

Ví dụ: Đây là một đoạn Prompt mô tả hình ảnh Keera mặc bikini đang chạy trên bãi biển theo phong cách tả thực:

Masterpiece, best quality, highest quality, 1 girl, Keera, bikini, beachwear, running on the beach, photorealistic

Lưu ý: 

Việc viết các từ khóa cách nhau bằng dấu phẩy như trên sẽ mặc định các từ khóa có độ quan trọng (trọng số) bằng nhaubằng 1. Để tăng hoặc giảm trọng số của bất kì từ khóa nào trong prompt, bạn có thể áp dụng các phương pháp sau đây: 

  • Cú pháp trọng số:

Thêm trọng số bên cạnh các từ khóa. Vì trọng số mặc định là 1, nên để tăng trọng số từ khóa có thể thêm số từ 1 – 1.999 đằng sau từ khóa, và -1.999 đến 0.9999 nếu muốn giảm.

Ví dụ: masterpiece:1.5

  • Cú pháp ():

Một lần ngoặc đơn tương đương với trọng số 1.1

2 lần ngoặc đơn tương đương với trọng số 1.21

Đặt từ khóa bạn muốn tăng trọng số vào trong ngoặc đơn, VD: (masterpiece) = masterpiece:1.1

  • Cú pháp []:

Đây là cách dùng ngoặc vuông để giảm trọng số từ khóa. Một lần ngoặc vuông tương đương 0.9, Hai lần tương đương 0.81

Ví dụ: [masterpiece] = masterpiece:0.9

  • Bước 6: Mô tả tranh với Negative Prompt

Cũng là một đoạn văn bản nhằm mô tả tranh AI bạn muốn tạo, nhưng trái với Prompt, Negative Prompt sẽ mô tả những chi tiết bạn không muốn xuất hiện trong thành phẩm. Dưới đây là những Negative Prompt có thể ứng dụng trong mọi trường hợp, ngoài ra các bạn có thể bổ sung thêm những chi tiết khác theo ý muốn:

(worst quality:1.9), (low quality:1.9), (normal quality:1.9), lowres, bad anatomy, bad hands

  • Bước 7: Tối ưu các thông số cuối

7.1. Sampling method – Sampling steps

AI tạo ra hình ảnh theo nguyên tắc lấy mẫu (sampling method). Có nhiều phương pháp lấy mẫu khác nhau, đi kèm với đó là các bước lấy mẫu khác nhau (sampling steps) và ưu/nhược điểm khác nhau. Dưới đây là bảng so sánh 3 loại phương pháp lấy mẫu phổ biến nhất trong Automatic1111.

Sampling method Sampling steps LCM support Phong cách phù hợp nhất
DPM++ 2M Karras >15 >15 Khá đồng đều
Euler a >20 >20 Thực (realistic)
DPM++ 2M SDE Karras >30 >30 Giả tưởng (Fantasy Art)

 

*Bảng trên chỉ áp dụng cho SD1.5

7.2. CFG Scale – Batch count – Batch size

  • CFG Scale: có thể đặt thông số từ 6-9, thông thường là 7
  • Batch count: số lượt ảnh tạo ra sau khi nhấn “Generate”
  • Batch size: Số hình ảnh được tạo ra đồng thời

Ví dụ: Với batch count = 50 và batch size = 2, bạn có 50 lượt generate ảnh, mỗi lượt tạo ra 2 ảnh. Tổng cộng là 100 ảnh.

  • Bước 8: Tạo ảnh

Sau khi đã setup xong các trường thông tin, nhấn “Generate” để bắt đầu quá trình tạo ảnh. Số lượng ảnh được tạo ra sẽ phụ thuộc vào số Batch Count và Batch size mà bạn thiết lập.

Ngoài ra, bạn có thể tạo ảnh mà không cần thiết lập Batch Count và Batch size bằng cách chuột phải tại nút “Generate”, chọn “Generate Forever”. WebUI sẽ tự động tạo ảnh liên tục cho tới khi bạn chọn “Cancel Generate Forever”. 

LỜI KẾT

Trên đây là tổng quan các bước cơ bản để bắt đầu quá trình tạo ảnh AI bằng công cụ Stable Diffusion. Anh em hãy tải Stable Diffusion và thực hiện ngay những tác phẩm đầu tay của mình nhé!