Hướng Dẫn · 6 phút đọc · 2026-09-17
Tạo ảnh bằng AI miễn phí trên máy tính: chạy SDXL, prompt tiếng Việt, tốc độ và chữ trong ảnh
Mình chạy Stable Diffusion XL trên RTX 3080 Ti, không cần tài khoản: 12 giây mỗi ảnh, 10,5 GB bộ nhớ card. Prompt tiếng Anh cho ảnh sát hơn tiếng Việt, chữ tiếng Việt trong ảnh bị méo, và giấy phép có danh sách cấm dùng.

Muốn tạo ảnh bằng AI miễn phí mà không phụ thuộc hạn mức của trang web nào, bạn có thể chạy mô hình ngay trên máy tính của mình. Mình thử Stable Diffusion XL (SDXL) base 1.0 trên Windows với card RTX 3080 Ti 12 GB: tức là tạo ảnh AI không cần đăng ký, không trả phí mỗi ảnh, mỗi ảnh 1024×1024 xong trong khoảng 12 giây.
Nhưng miễn phí không có nghĩa là dùng gì cũng được, và chạy được không có nghĩa là ảnh đúng ý. Ngày 17/09/2026, mình đo và ghi lại:
- Lần đầu tải khoảng 7,1 GB mô hình, cần card màn hình còn trống khoảng 10,5 GB bộ nhớ.
- Cùng một ý, prompt tiếng Anh cho ảnh sát hơn hẳn prompt tiếng Việt.
- Chữ tiếng Việt trong ảnh bị méo thành ký tự vô nghĩa.
- Giấy phép cho dùng thương mại nhưng có danh sách cấm dùng cụ thể.
Nhận xét về ảnh trong bài là mô tả bốn ảnh cụ thể mình tạo ra, không phải đánh giá chung cho mọi trường hợp.
Chọn mô hình: xem giấy phép và có bị khoá không
Mình kiểm hai ứng viên trên Hugging Face:
- stabilityai/stable-diffusion-xl-base-1.0: giấy phép CreativeML Open RAIL++-M, không bị khoá, tải thẳng không cần đăng nhập.
- black-forest-labs/FLUX.1-schnell: giấy phép Apache-2.0, nhưng repo bị khoá, phải đăng nhập và chấp nhận điều khoản mới tải được. Mình loại vì bài này không tạo tài khoản.
Tệp giấy phép của SDXL cấp quyền dùng "vĩnh viễn, toàn cầu, không thu phí". Về ảnh tạo ra, giấy phép ghi bên cấp phép không nhận quyền gì với ảnh, và bạn chịu trách nhiệm về ảnh cùng cách dùng nó. Phụ lục A cấm dùng mô hình để, trong số các mục:
- Vi phạm pháp luật, gây hại cho trẻ vị thành niên.
- Tạo hoặc lan truyền thông tin sai nhằm gây hại, bôi nhọ, quấy rối người khác.
- Tư vấn hay diễn giải kết quả y tế.
- Phân biệt đối xử, hoặc dùng cho tư pháp, thực thi pháp luật, di trú.
Đây là tóm tắt của mình từ tệp giấy phép, không phải tư vấn pháp lý. Nếu dùng ảnh cho sản phẩm thương mại, bạn nên đọc nguyên văn.
Cài môi trường để tạo ảnh bằng AI miễn phí trên máy
Đây là cách cài Stable Diffusion bằng thư viện diffusers, không cần giao diện đồ hoạ. Mình dùng Python 3.12 với bản torch có CUDA cho card NVIDIA:
py -3.12 -m venv sdxl-venv
.\sdxl-venv\Scripts\python.exe -m pip install torch --index-url https://download.pytorch.org/whl/cu128
.\sdxl-venv\Scripts\python.exe -m pip install diffusers transformers accelerate safetensors numpyCác phiên bản cài được: torch 2.11.0+cu128, diffusers 0.40.0, transformers 5.17.0. Mô hình sẽ tải về thư mục cache Hugging Face, mặc định nằm trên ổ C. Muốn để 7 GB đó ở ổ khác, đặt biến trước khi chạy:
$env:HF_HOME = "D:\hf-cache"Code tạo ảnh đầu tiên
Lưu thành tao-anh.py:
import torch
from diffusers import StableDiffusionXLPipeline
pipe = StableDiffusionXLPipeline.from_pretrained(
"stabilityai/stable-diffusion-xl-base-1.0",
dtype=torch.float16,
variant="fp16",
use_safetensors=True,
).to("cuda")
g = torch.Generator("cuda").manual_seed(42)
anh = pipe(
prompt="a bowl of Vietnamese pho with beef slices, fresh herbs and lime on a wooden table, food photography",
num_inference_steps=30,
guidance_scale=7.0,
width=1024,
height=1024,
generator=g,
).images[0]
anh.save("pho.png").\sdxl-venv\Scripts\python.exe tao-anh.pyBa điều mình gặp khi chạy:
- Bản diffusers 0.40 báo tham số
torch_dtypesắp bị bỏ, nên code trên dùngdtype. - Lần đầu, ngoài 6,94 GB các tệp chính, diffusers tải thêm thư mục
vae_1_0(167 MB). Tổng khoảng 7,1 GB. - Hub in cảnh báo "You are sending unauthenticated requests", tức đang chạy không cần tài khoản; cảnh báo này không làm hỏng gì.
Cùng seed thì ảnh lặp lại được. Chạy lại đúng đoạn code trên, ảnh ra giống hệt từng điểm ảnh với lần trước. Muốn biến thể khác, đổi số trong manual_seed.
Tốc độ và bộ nhớ trên RTX 3080 Ti
- Nạp mô hình lên card: 4,04 giây.
- Bộ nhớ card dùng tối đa: 10,49 GB trên 12 GB.
- Ảnh 1024×1024, 30 bước: 11,5 đến 13,1 giây mỗi ảnh (ảnh đầu tiên chậm nhất).
- Giảm xuống 20 bước: 9,44 giây.
Card còn trống ít hơn 10,5 GB thì cấu hình này có thể không chạy nổi. Mình chưa thử các cách tiết kiệm bộ nhớ như chuyển bớt mô hình sang RAM.
Prompt tạo ảnh AI tiếng Việt hay tiếng Anh
Mình giữ nguyên seed 42 và mọi tham số, chỉ đổi ngôn ngữ của prompt:
- Tiếng Anh: "a bowl of Vietnamese pho with beef slices, fresh herbs and lime on a wooden table, food photography".
- Tiếng Việt: "một bát phở bò với rau thơm và chanh trên bàn gỗ, ảnh chụp món ăn".

Ảnh từ prompt tiếng Anh có đủ những gì được mô tả: thịt bò thái lát, rau thơm, chanh, bàn gỗ. Ảnh từ prompt tiếng Việt ra một bát bún nước, không thấy thịt bò thái lát rõ ràng, chanh không nằm trong bát. Nếu bạn đang tìm cách viết prompt tạo ảnh cho SDXL, viết bằng tiếng Anh là cách đơn giản nhất để ảnh sát ý.
Món Việt và chữ tiếng Việt: hai chỗ cần kiểm bằng mắt
Món Việt có thể bị "Tây hoá". Prompt tiếng Anh "a tall glass of Vietnamese iced milk coffee on a small cafe counter, soft morning light, product photo" cho ra một ly cà phê sữa đá có kem tươi phủ sốt caramel, trông như đồ uống ở quán cà phê phương Tây, không có phin.

Nếu dùng ảnh cho thực đơn hay quảng cáo món Việt, bạn nên mô tả kỹ đặc điểm món trong prompt và luôn xem lại ảnh trước khi đăng.
Chữ trong ảnh không đọc được. Prompt yêu cầu biển gỗ ghi "CÀ PHÊ SỮA ĐÁ 25.000đ". Ảnh có một tấm biển gỗ đẹp, nhưng chữ trên biển là các ký tự vô nghĩa, trông giống chữ tượng hình, không có chữ nào đúng.

Với SDXL, cách thực tế là tạo ảnh nền không có chữ, rồi thêm chữ bằng phần mềm thiết kế.
Chạy không cần mạng
Sau khi tải xong, mình bật chế độ offline của Hugging Face (HF_HUB_OFFLINE=1). Nếu gọi mô hình bằng tên repo mà thiếu tệp vae_1_0, lệnh báo "the model is not fully cached locally". Còn nếu nạp bằng đường dẫn thư mục đã tải (trong HF_HOME\hub\models--stabilityai--stable-diffusion-xl-base-1.0\snapshots\...), SDXL chạy bình thường ở chế độ offline.
Một chi tiết khác: gói invisible-watermark không được cài, nên pipeline không gắn watermark ẩn vào ảnh. Nếu bạn cần đánh dấu ảnh là do AI tạo, phải tự làm.
Stable Diffusion miễn phí nhưng không phải cho mọi máy
Tạo ảnh bằng AI miễn phí theo cách này là đổi tiền thuê bao lấy phần cứng: card NVIDIA còn trống khoảng 10,5 GB bộ nhớ và khoảng 7 GB ổ đĩa cho mô hình. Có đủ hai thứ đó, tạo ảnh AI miễn phí trên máy tính chỉ tốn vài giây mỗi ảnh và tiền điện.
Những gì mình chưa kiểm
- Máy không có card NVIDIA, hoặc card ít bộ nhớ hơn.
- Mô hình refiner của SDXL, LoRA, sửa một vùng ảnh (in-painting).
- Tạo ảnh người, và các giao diện đồ hoạ như ComfyUI.
- Tác giả
- Quản trị viên
- Đăng ngày
- 2026-09-17
- Cập nhật
- 2026-09-17
- Thời gian đọc
- 6 phút đọc
- Tất cả bài viết