Ở đây có hướng dẫn cách tạo ảnh
bằng A.I siêu đơn giản!

Bách khoa toàn thư: Giải nghĩa mọi thuật ngữ A.I

571
11.04.2024

Ở bài viết này, mình sẽ tổng hợp các thuật ngữ AI phổ biến và thường gặp nhất và giải nghĩa cho mọi người để có thể sử dụng các công cụ tạo ảnh một cách dễ dàng hơn nhé! Trong từ điển này sẽ không đủ bao hàm hết tất cả các thuật ngữ, nên nếu có bổ sung thì mọi người cứ thoải mái comment cho mình với nha!

  • AI (Artificial Intelligence) là trí tuệ nhân tạo, công nghệ này mô phỏng những suy nghĩ và quá trình tiếp thu kiến thức của con người cho máy móc, đặc biệt là các hệ thống máy tính.
  • Stable Diffusion: Stable Diffusion là một mô hình trí tuệ nhân tạo tạo sinh (AI tạo sinh) có khả năng tạo ra hình ảnh tả thực độc đáo từ lời nhắc bằng văn bản và hình ảnh. Đây là công cụ miễn phí có thể được cài đặt và sử dụng trên máy tính cá nhân của bạn.
  • WebUI: là viết tắt của từ User Interface có nghĩa là giao diện người dùng. UI bao gồm tất cả những gì người dùng có thể nhìn thấy như: màu sắc web, bố cục sắp xếp như thế nào, web/app sử dụng fonts chữ gì, hình ảnh trên web có hấp dẫn hay không,…
  • Extension: Ứng dụng mở rộng dùng để tùy biến công cụ SD.
  • Checkpoint: Là một bản sao lưu của trạng thái hiện tại của một mô hình AI đang trong quá trình được hoàn thành. Checkpoint sẽ giúp bạn lưu lại tiến trình tạo AI và tiếp tục tạo mới thay vì phải tạo lại từ đầu. (Copy google)

Một checkpoint sẽ bao gồm rất nhiều LoRA. Là một định dạng phong cách mà chúng ta sẽ tạo cho LoRA, ở đó các LoRA sẽ theo một style cố định (VD: Realistic, 2D anime, 3D cartoon, v.v)

  • LoRA: Là viết tắt của cụm từ Low-Rank Adaptation of Large Language Models, LoRa như một mini model được train trên một tập dữ liệu nhất định. Khi hoạt động, nó sẽ trở thành các layer được “chèn” vào các layer của model gốc, khiến Stable Diffusion tạo ra nhân vật hay phong cách mà LoRA đó được train.

Hiểu đơn giản thì nó là 1 model của 1 nhân vật cố định. Ví dụ model của nhân vật Veera thì được gọi là LoRA Veera.

  • Prompt: Là một dòng mô tả về hình ảnh mà bạn muốn AI tạo ra, ví dụ như tóc đỏ, chân dài, váy ngắn, v.v… bằng tiếng Anh. Các bạn có thể làm theo công thức cơ bản nhất như sau

“Standard + Subject + Space + Skin + Style”

“Chất lượng hình ảnh + Chủ thể + Bối cảnh + Quần áo/Màu sắc + Phong cách”

VD: Để tạo ra hình ảnh Iggy đang chạy trên bãi biển theo phong cách ảnh thật chúng ta sẽ viết prompt như sau 

“Masterpiece, best quality, highest quality, 1 boy, Iggy, running on the beach, photorealistic”

hoặc

“Masterpiece, best quality, highest quality, photorealistic of Iggy boy is running on the beach”

  • Negative Prompt: Là một dòng mô tả về hình ảnh mà bạn không muốn AI tạo ra, ví dụ như 2 đầu, 4 tay, cụt chân,v.v
  • TI: Là viết tắt của cụm từ Textual inversion, đây là các tệp tin nhỏ định nghĩa các từ khóa mới để tạo ra các đối tượng hoặc style mới cho một checkpoint.
  • Sampling method: Phương pháp lấy mẫu trong quá trình tạo ảnh sao cho phù hợp với một dạng hình ảnh khác nhau. Các loại sampling phổ biến là UniPC, Euler hoặc DDIM …
  • CFG scale: Chỉ số này gồm các giá trị từ 1 đến 30. Nó là mức độ tuân thủ của AI trong quá trình tạo ảnh theo các từ khoá prompt. Số càng thấp thì càng cho phép AI thỏa sức sáng tạo. Số càng cao thì AI càng tuân thủ sát hơn với từ khoá prompt ở trên.
  • Seed: Đây là tham số thuật toán để tạo hình ảnh. Mặc định là -1 để tạo ngẫu nhiên theo AI. Nếu hình ảnh mà mình thấy ưng ý về chi tiết, bố cục… ta hãy giữ con số đó lại (hoặc copy từ nguồn khác dán vào) để sử dụng cho về sau.
  • Upscaler: Đây là công cụ giúp lựa chọn tăng độ phân giải hình và kích thước của ảnh
  • Restore faces: Đây là lựa chọn giúp cho các khuôn mặt được AI tạo ra sẽ được tinh chỉnh chi tiết sao cho chân thực và hài hòa nhất.
  • Batch count: số lượt tạo ảnh sau khi nhấn generate. Ví dụ Batch count = 50, WebUI sẽ generate 50 hình ảnh, sau khi chọn generate, 50 ảnh này được tạo lần lượt từng ảnh 1
  • Batch size: Số hình ảnh được tạo đồng thời. Ví dụ đặt batch size = 2 và batch count = 50 tức là bạn có 50 lượt generate mỗi lượt tạo ra 2 ảnh. Tổng là 100 hình ảnh
  • Hiresfix: Là các lựa chọn để tiếp tục tinh chỉnh hình ảnh, tăng độ phân giải hình ảnh

Hi vọng “từ điển” của mình sẽ giúp các bạn làm ảnh dễ dàng hơn! Chúc các bạn thành công!