Ảnh du lịch AI — đặt một người vào một nơi
Ghép một khuôn mặt vào địa danh nổi tiếng và chọn tông ảnh: Hội An đêm đèn lồng, Sa Pa mùa lúa chín, vịnh Hạ Long lúc bình minh, Paris giờ vàng, Tokyo mùa hoa anh đào. Kết quả đọc như một tấm ảnh du lịch thật.
Skill này làm phần hình — một tấm ảnh chính của một người tại một nơi. Nếu người dùng cần lịch trình chuyến đi, dùng skill lập kế hoạch du lịch.
Ngôn ngữ. Tài liệu skill viết bằng tiếng Việt, nhưng nói chuyện với người dùng bằng đúng ngôn ngữ họ đang dùng. Chỉ có một thứ luôn giữ tiếng Anh bất kể người dùng nói tiếng gì: prompt gửi cho công cụ tạo ảnh, vì các mô hình tạo ảnh bám tiếng Anh tốt hơn.
Ranh giới — kiểm trước mọi thứ khác
Skill này đặt khuôn mặt người thật vào nơi họ chưa từng đến. Vui khi là trò đùa, độc hại khi là bằng chứng giả — nên ranh giới ở đây quan trọng hơn ở một skill tạo ảnh thông thường.
Được dùng mặt của ai
- Chính người đang yêu cầu, hoặc người đã đồng ý. Nếu chưa rõ, hỏi đúng một câu: "Ảnh này là của anh/chị, hay của người đã đồng ý cho ghép?" Một câu trả lời là đủ — đây là bước xác nhận, không phải tra hỏi.
- Từ chối người nổi tiếng — nghệ sĩ, chính trị gia, lãnh đạo doanh nghiệp, người có ảnh hưởng. Một tấm ảnh giả thuyết phục về một người có tên tuổi tại một nơi có thật đúng là thứ skill này không bao giờ được tạo ra.
- Từ chối ảnh trẻ em. Không khóa mặt trẻ em, kể cả cho album gia đình hay minh họa sách thiếu nhi. Nếu là album gia đình, đề xuất phương án chỉ gồm người lớn, hoặc dùng nhân vật chung không khóa mặt.
Không dùng để làm gì
Từ chối khi mục đích được nêu ra là thuyết phục một người hoặc một cơ quan cụ thể rằng chuyến đi có thật — hồ sơ xuất nhập cảnh, yêu cầu bồi thường bảo hiểm, thanh toán công tác phí, bằng chứng ngoại phạm, hay để lừa một người đang bị giấu sự thật. Trò đùa chỉ vui khi mọi người đều biết đó là đùa. Các mục đích thông thường — thiệp sinh nhật, ảnh chọc bạn trong nhóm chat, "wish you were here" gửi người yêu xa, ảnh xây thương hiệu cá nhân, bảng mơ ước du lịch — không cần kiểm gì thêm.
Gắn nhãn. Khuyến khích chú thích "ảnh AI" hoặc "chuyến đi tưởng tượng" khi đăng. Bước giao hàng đã kèm sẵn một caption có nhãn (xem Bước 7) để việc gắn nhãn là đường dễ đi nhất, thay vì phải rao giảng.
Tôn trọng địa điểm. Ở nơi thờ tự, di tích, lăng tẩm, hãy cho nhân vật mặc đúng cách một người đến thăm sẽ mặc (kín vai ở chùa, trang phục nhã ở Đại Nội, khăn che ở đền Hồi giáo). Vừa là phép lịch sự, vừa là yếu tố thực tế — trang phục lệch bối cảnh là một trong những nguyên nhân hàng đầu khiến ảnh trông giả.
Quy trình
- Thu thập đầu vào — ảnh tham chiếu là bắt buộc
- Viết khối neo nhận dạng (viết một lần, dán nguyên văn ở mọi lần render)
- Khảo sát điểm chụp và đề xuất tạo hình — nếu người dùng mới chỉ nêu tên một nơi
- Điền prompt từ công thức địa danh
- Render trên bất kỳ công cụ nào đang có
- Đối chiếu khuôn mặt — bắt buộc, tối đa ba lần thử
- Giao kết quả
- Nếu nhiều điểm đến, theo quy trình loạt ảnh
Công thức nhìn thật
Năm thành phần. Đủ cả năm thì ảnh đọc như ảnh du lịch thật; thiếu một là tụt về "chân dung AI đứng cạnh địa danh".
- Địa danh nhận ra được, khung hình chuẩn. Đúng góc, đúng tỷ lệ, nhận ra trong nửa giây.
- Người ở tiền cảnh. Bán thân đến ba phần tư người, đứng trước địa danh — không bị nuốt trong khung rộng.
- Ánh sáng đúng giờ đặc trưng của nơi đó. Tháp Eiffel = giờ vàng; Hội An = chập tối lên đèn; Sa Pa = sương sớm; Hạ Long = bình minh; New York = giờ xanh.
- Bố cục kiểu ảnh du lịch. Khung hơi lệch một chút, dáng tự nhiên, nhìn máy hoặc nhìn cảnh.
- Tông màu phim hoặc ảnh điện thoại. Ấm cho giờ vàng, lạnh cho buổi tối, Kodachrome cho cảm giác du lịch cổ điển. Tuyệt đối không bóng bẩy kiểu ảnh tạp chí.
Bước 1 — Đầu vào
Ảnh tham chiếu là bắt buộc, không phải tùy chọn. Toàn bộ công việc của skill là đưa một khuôn mặt cụ thể vào một bối cảnh. Chỉ mô tả bằng chữ sẽ ra một người du lịch AI chung chung, không phải người dùng. Chưa có ảnh mặt thì hỏi xin trước khi render.
Không phải ảnh nào cũng như nhau. Ảnh chính diện, rõ nét, ánh sáng đều là lý tưởng. Ảnh thẻ hay ảnh hộ chiếu vẫn dùng được — mặt rõ — nhưng khung cứng của nó kéo kết quả về dáng đơ; bù bằng mô tả dáng và trang phục thật mạnh. Ảnh mờ, ảnh chỉnh filter nặng, ảnh đeo kính râm, ảnh chụp nhóm là tham chiếu yếu: nói thẳng rằng độ khớp sẽ chỉ ở mức gần đúng, rồi hỏi người dùng muốn làm luôn hay đợi ảnh tốt hơn.
| Ô | Ví dụ | Ghi chú |
|---|---|---|
{subject_anchor} |
Ảnh tham chiếu (bắt buộc) + mô tả nhận dạng đầy đủ | Ảnh quyết định độ khớp; chữ giữ cho không trôi. Xem Bước 2 |
{location} |
"Hội An, chùa Cầu bên sông Hoài" / "ruộng bậc thang Mường Hoa, Sa Pa" / "Paris, tháp Eiffel nhìn từ quảng trường Trocadéro" | Nêu rõ thành phố và điểm nhìn, đừng nêu chung chung |
{time_of_day} |
giờ vàng / giờ xanh / trưa nắng / chập tối lên đèn / sương sớm | Bám giờ đặc trưng của nơi đó |
{photo_style} |
Kodachrome travel film / modern iPhone candid / 1990s Polaroid / blogger cinematic | Quyết định tông màu và cảm giác bố cục |
{pose_brief} |
ngoái đầu nhìn lại mỉm cười / tựa lan can nhìn ra cảnh / đang bước qua khung hình tay cầm ly cà phê | Dáng du lịch tự nhiên, không đứng như ma-nơ-canh |
{wardrobe_brief} |
áo dài trắng + nón lá / sơ mi linen + mũ cói / áo khoác dạ + khăn len | Hợp khí hậu và quy định trang phục của nơi đó |
{aspect} |
3:4 (khung ảnh du lịch được chia sẻ nhiều nhất), 9:16 (story), 1:1 (lưới) | Mặc định 3:4 |
Bước 2 — Viết khối neo nhận dạng
Ảnh tham chiếu gánh phần lớn phần nhận dạng; khối neo bằng chữ là thứ giữ cho mặt không trôi khi dáng, trang phục và ánh sáng đều đổi. Một khối neo viết nửa vời ("tóc nâu, mắt nâu") chừa quá nhiều khoảng trống.
Phải đủ bảy nhóm, theo đúng thứ tự này, ở mọi lần viết:
- Dáng mặt — trái xoan / tròn / trái tim / vuông / dài; gò má cao hay thấp; bề ngang hàm.
- Mắt — hình dáng (hạnh nhân / tròn / mí sụp), loại mí (mí đôi / mí đơn / có nếp mí góc trong), khoảng cách hai mắt, màu mắt.
- Mũi — độ cao sống mũi, bề ngang, hình đầu mũi.
- Môi — độ dày, bề ngang, trạng thái khi thư giãn.
- Chân mày + chân tóc — độ dày và độ cong của mày, hình chân tóc, màu / kết cấu / độ dài tóc.
- Da + dấu vết — tông da, tàn nhang, nốt ruồi, sẹo, đặc điểm riêng.
- Vóc dáng + phụ kiện — chiều cao ước chừng, thể trạng, bề ngang vai, tư thế; kính, hình xăm lộ, trang sức hay đeo.
Nhóm cuối không phải phần thêm cho dài. Prompt yêu cầu khung ba phần tư người và toàn thân, nên nếu khối neo chỉ có mặt thì thân hình sẽ trôi giữa các ảnh dù mặt vẫn khớp — và người xem nhận ra ngay khi vóc dáng đổi.
Viết khối neo một lần, rồi dán đúng nguyên khối đó vào mọi lần render. Không diễn đạt lại giữa các ảnh; khối neo bị diễn đạt lại là nguyên nhân số một của lỗi "trông như hai người khác nhau". Nếu có công cụ đọc ảnh, hãy đọc đặc điểm từ chính ảnh tham chiếu trước để khối neo mô tả đúng người thật thay vì đoán. Giữ khối neo đã viết lại trong hội thoại để tái dùng ở các phiên sau.
Bước 3 — Khảo sát điểm chụp và đề xuất tạo hình
Phần lớn người dùng chỉ nêu một cái tên: "cho tôi đi Đà Nẵng", "làm ảnh ở Nhật". Đó chưa phải một tấm ảnh — mới là một vùng địa lý. Bước này biến cái tên đó thành một thực đơn tạo hình cụ thể để người dùng chọn.
Khi nào chạy bước này
- Người dùng nêu một thành phố, một vùng, một quốc gia hoặc một mong muốn mơ hồ ("chỗ nào biển đẹp", "đi đâu đó châu Âu") → chạy khảo sát, đưa thực đơn, đợi họ chọn.
- Người dùng đã nêu một điểm chụp cụ thể ("chùa Cầu Hội An", "tháp Eiffel từ Trocadéro") → bỏ qua bước này, sang thẳng Bước 4.
- Người dùng nói "gợi ý giúp tôi" dù đã có địa danh → vẫn chạy, nhưng chỉ đề xuất các góc và giờ khác nhau trong cùng địa danh đó.
Tìm điểm chụp ở đâu, theo thứ tự:
references/destinations.md— mười tám công thức đã viết sẵn. Nếu nơi người dùng nêu đã có ở đó, dùng luôn, không cần khảo sát lại.- Công cụ tìm kiếm hoặc tra địa điểm nếu phiên làm việc có — dùng để xác nhận điểm chụp còn tồn tại, còn mở cửa, và đang mùa nào.
- Kiến thức sẵn có, nếu không có công cụ nào. Khi đó chỉ đề xuất những địa danh lớn và bền vững, và nói rõ với người dùng rằng chi tiết mùa vụ hay tình trạng hiện tại chưa được kiểm chứng.
Tuyệt đối không bịa tên quán, homestay, hay điểm check-in nhỏ. Một địa danh lớn sai vài chi tiết thì vẫn ra ảnh đẹp; một cái tên bịa làm hỏng niềm tin vào cả bộ đề xuất.
Đề xuất bao nhiêu và đa dạng thế nào
Đưa bốn đến sáu phương án, mỗi phương án là một tấm ảnh khác hẳn nhau — không phải sáu góc của cùng một cái tháp. Trải theo bốn trục:
- Loại cảnh — biểu tượng / thiên nhiên / phố phường đời thường / một chỗ ít người biết.
- Giờ trong ngày — đừng để cả sáu đều giờ vàng. Có sương sớm, có trưa rực, có chập tối lên đèn, có giờ xanh.
- Khoảng cách — ít nhất một chỗ ngay trung tâm, một chỗ phải đi xa hơn.
- Không khí — một tấm rực rỡ để đăng, một tấm trầm và điện ảnh.
Một bộ trải đủ bốn trục nhìn như một chuyến đi thật. Sáu phiên bản của cùng một chỗ nhìn như một lần render lặp lại.
Định dạng mỗi phương án — ngắn, đủ để chọn trong mười giây, viết bằng ngôn ngữ người dùng đang dùng (họ hỏi bằng tiếng Việt thì trả lời tiếng Việt, hỏi bằng tiếng Anh thì trả lời tiếng Anh). Riêng tên địa danh giữ nguyên dạng bản địa kèm dạng quen thuộc quốc tế nếu có — "chùa Cầu (Japanese Covered Bridge)":
**{số}. {Tên điểm chụp} — {giờ đẹp nhất}**
Cảnh: {một câu về thứ nằm sau lưng nhân vật và chi tiết nhận ra nơi đó}
Tạo hình: {dáng} + {trang phục} + {tông màu}
Vì sao chọn: {một câu — nó cho ra tấm ảnh kiểu gì}
Lưu ý: {mùa, giờ, độ đông, quy định trang phục hoặc cấm chụp — chỉ ghi khi thật sự có}
Sau thực đơn, hỏi đúng một câu: chọn tấm nào, hoặc chọn hai đến bốn tấm để làm thành một loạt. Nếu phiên làm việc có công cụ hiển thị lựa chọn bấm được thì dùng, không thì đánh số cho họ trả lời bằng số.
Sau khi người dùng chọn
Biến phương án đã chọn thành một công thức địa danh hoàn chỉnh theo mẫu ở cuối references/destinations.md, rồi mới sang Bước 4. Công thức mới phải qua đủ các bước kiểm trong mẫu đó: có điểm nhìn cụ thể, có giờ đặc trưng, có tông màu, có trang phục, có chi tiết nhận dạng riêng, và có xử lý mức độ đông người.
Chi tiết cách khảo sát — tiêu chí một điểm chụp đạt, lịch mùa vụ Việt Nam, và các cạm bẫy — nằm ở references/location-research.md. Đọc file đó khi bắt đầu khảo sát một nơi chưa có công thức.
Bước 4 — Điền prompt
Công thức địa danh nằm ở references/destinations.md — mười địa danh Việt Nam và tám địa danh quốc tế, kèm một ví dụ hoàn chỉnh và mẫu để viết công thức mới. Đọc file đó khi đã chọn được điểm đến.
Prompt luôn viết bằng tiếng Anh — các mô hình tạo ảnh bám tiếng Anh tốt hơn.
Prompt đầy đủ (cho backend xử lý tốt prompt dài — GPT-Image, Gemini, Flux):
A {photo_style} travel snapshot of {subject_anchor} at {location},
{aspect} aspect.
Setting: {location_recipe — landmark recognizable in the background,
correct angle, correct scale}.
Lighting: {time_of_day_recipe — exact time, direction, color cast}.
Composition: {pose_brief}. {wardrobe_brief}. Subject is medium-shot to
three-quarter length, foreground clear and sharp, landmark visible
behind but not dominating.
Style: {photo_style} — real travel-snapshot feel, gentle imperfection in
framing, candid energy. Hyper-detailed real photo, natural skin texture,
no smoothing.
Locks: single travel-snapshot photo, NOT a magazine spread. NO
posed-mannequin stiffness. NO over-saturated post-processing. NO
on-image text, no postcard frame, no border. Just the photograph.
Prompt rút gọn (cho backend yếu với prompt dài — Midjourney, các giao diện Stable Diffusion). Giữ quanh sáu mươi từ, và giữ những đặc điểm nặng ký nhất của khối neo:
{photo_style} travel snapshot, {subject_anchor: face shape + eye/eyelid
type + nose + hair + build}, at {location}, {time_of_day}. {pose_brief},
{wardrobe_brief}, three-quarter length, landmark behind. Candid framing,
natural skin texture, film grain. No text, no border, no frame.
Ví dụ đã điền đầy đủ nằm trong references/destinations.md.
Bước 5 — Render
Backend cần gì. Việc khóa mặt phụ thuộc vào một năng lực duy nhất, không phụ thuộc sản phẩm nào:
| Yêu cầu | Vì sao | Nếu thiếu |
|---|---|---|
| Nhận ảnh tham chiếu | Đây chính là thứ khóa mặt | Không dùng để khóa mặt — xem Đường C |
| Điều khiển tỷ lệ khung | 3:4 là khung ảnh du lịch | Yêu cầu bằng chữ: "portrait 3:4 framing" |
| Đầu ra từ 2K trở lên | Đủ nét để chia sẻ | Chấp nhận thấp hơn, ghi rõ khi giao |
| Nhận nhiều ảnh tham chiếu | Giữ đồng nhất trong loạt ảnh (Bước 8) | Chỉ dựa vào khối neo bằng chữ; chấp nhận trôi nhiều hơn |
Sau đó chọn đường phù hợp với môi trường đang chạy.
Đường A — Có công cụ tạo ảnh nhận ảnh tham chiếu
Dùng luôn. Đính ảnh tham chiếu qua cơ chế nhập ảnh của công cụ, đặt tỷ lệ 3:4, dán prompt đầy đủ.
Hai đường chính là ChatGPT / GPT-Image và Gemini / AI Studio; cả hai đều nhận nhiều ảnh tham chiếu nên quy trình loạt ảnh ở Bước 8 dùng được. Mỗi công cụ có một thói quen cần chặn trước — GPT-Image làm mịn da và ám vàng, Gemini dán mặt phẳng không khớp ánh sáng cảnh — và cách chặn nằm ở references/rendering.md, cùng cú pháp cho Midjourney, Flux Kontext và API chung. Có sẵn cả hai thì render tấm đầu trên cả hai, giữ tấm khớp mặt hơn làm ảnh mồi cho các tấm sau.
Đường B — Có công cụ nhưng không nhận ảnh tham chiếu
Đây không phải backend khóa mặt. Đừng lặng lẽ render ra một người du lịch chung chung rồi giao. Hoặc chuyển sang công cụ khác, hoặc sang Đường C và nói rõ vì sao.
Đường C — Không có công cụ tạo ảnh nào
Giao bộ prompt để người dùng tự dán vào công cụ họ đang có, và nói rõ lý do:
- Prompt đầy đủ và prompt rút gọn đã điền xong.
- Khối neo nhận dạng, ghi rõ là dán nguyên văn để tái dùng.
- Cú pháp cho hai ba nền tảng khả dĩ, lấy từ
references/rendering.md— gồm cả chuỗi tham số Midjourney nếu cần. - Checklist đối chiếu ở Bước 6, viết sao cho người dùng tự kiểm bằng mắt được.
- Một dòng nói rõ điều gì sẽ hỏng nếu thiếu ảnh tham chiếu: khuôn mặt sẽ chỉ na ná, không phải họ.
Đường này là một sản phẩm giao thật, không phải một lần thất bại. Hãy nói rõ như vậy.
Bước 6 — Đối chiếu khuôn mặt (bắt buộc)
Một skill khóa mặt mà không bao giờ kiểm mặt thì chẳng khóa được gì. Không bao giờ giao ảnh chưa đối chiếu.
Đối chiếu ảnh ra với ảnh gốc trên bảy điểm: dáng mặt, hình mắt và loại mí, hình mũi, hình môi, chân mày, chân tóc, vóc dáng. Rồi kiểm địa danh — công trình biểu tượng rất dễ bị bóp méo; xác nhận tỷ lệ và hình khối đọc đúng.
Chạy bằng thứ đang có, theo thứ tự này:
Công cụ đọc ảnh — bất kỳ công cụ nào trong phiên nhận hai ảnh và so sánh. Câu hỏi dùng chung:
Image 1 is an AI-generated travel photo; image 2 is the reference face. Do they look like the SAME person? Compare face shape, eye shape and eyelid type, nose shape, lip shape, brows, hairline, and body build. Answer match / partial / no-match and name any feature that drifted.
So sánh trực tiếp — nếu cả ảnh render lẫn ảnh gốc đều xem được trong phiên, tự đối chiếu theo bảy điểm và nêu kết luận rõ ràng.
Người dùng tự kiểm — ở Đường C, đưa họ checklist bảy điểm và đề nghị xác nhận trước khi đăng bất cứ đâu.
Kết luận. match → giao. partial / no-match → không giao; render lại theo thứ tự sửa sau:
- Làm mạnh khối neo — điền đầy nhóm nào còn sơ sài, nhất là đặc điểm vừa bị trôi.
- Render lại trên cùng model với khối neo dán nguyên văn. Render lại với khối neo mạnh hơn thường ăn đứt việc nhảy sang model khác.
- Chỉ sau đó mới đổi sang model dự phòng.
Dừng sau ba lần thử. Nếu lần thứ ba vẫn hỏng, đừng đốt thêm lượt render. Báo thẳng: đặc điểm nào cứ trôi, khả năng cao ảnh tham chiếu quá yếu (mờ, filter nặng, chụp nghiêng, đeo kính râm), và xin ảnh khác. Nếu người dùng vẫn muốn lấy, giao bản tốt nhất kèm ghi chú rõ đây là bản chỉ khớp một phần.
Bước 7 — Giao kết quả
Giao theo thứ tự này:
- Ảnh, đặt tên
{tên}-{địa-danh}-{tỷ-lệ}.png— ví dụlinh-hoi-an-3x4.png. Việc đặt tên nhất quán quan trọng nhất khi giao cả loạt. - Một dòng xuất xứ — công cụ, model, tỷ lệ, độ phân giải.
- Kết luận đối chiếu mặt — "match", kèm điều gì đáng lưu ý.
- Một caption gợi ý có nhãn AI — ví dụ: "Chiều Hội An lên đèn ✨ (ảnh AI — thực ra tôi vẫn đang ngồi ở bàn làm việc) #aivacation". Đưa sẵn caption chính là thứ khiến việc gắn nhãn trở nên dễ; đừng lên lớp thêm ngoài chuyện đó.
- Khối neo nhận dạng, để loạt ảnh sau dán lại nguyên văn.
Bước 8 — Loạt nhiều điểm đến
Với hai đến bốn nơi cùng lúc, mục tiêu là cùng một người ở mọi ảnh. Render độc lập sẽ không cho ra điều đó.
- Cùng ảnh tham chiếu, cùng khối neo. Ảnh gốc giống hệt, khối neo dán nguyên văn. Chỉ đổi địa danh, giờ, dáng, trang phục và tông màu.
- Lấy ảnh đầu tiên đạt làm chuẩn. Render điểm đến thứ nhất, đối chiếu, và khi đã đạt thì coi ảnh đó là "diện mạo chuẩn". Với các điểm đến sau, đưa vào cả ảnh gốc và ảnh thứ nhất đã duyệt làm tham chiếu. Mọi backend nhận nhiều ảnh tham chiếu đều dùng được cách này — mồi bằng ảnh đã duyệt kéo các ảnh sau về cùng một người, chắc chắn hơn nhiều so với chỉ dựa vào chữ. Trên backend chỉ nhận một ảnh (ví dụ Midjourney), chấp nhận trôi nhiều hơn và kiểm gắt hơn.
- Đối chiếu từng ảnh, không chỉ ảnh đầu. Ảnh nào ra
partialthì render lại trước khi giao cả bộ. - Giữ trang phục nhất quán nếu là một chuyến đi. Một chuyến qua nhiều nơi → cùng bộ đồ. Mỗi ảnh là một tấm bưu thiếp riêng → đổi trang phục theo nơi là hợp lý.
Biến thể hai người / cặp đôi
Có hỗ trợ, nhưng cần chuẩn bị chặt hơn ảnh đơn:
- Mỗi người một ảnh tham chiếu, đưa cả hai vào backend. Nếu backend chỉ nhận một ảnh, nói thẳng rằng khuôn mặt thứ hai sẽ chỉ gần đúng, và đề xuất phương án render hai ảnh đơn.
- Hai khối neo riêng, có nhãn ("Subject A: … / Subject B: …"), mỗi khối đủ bảy nhóm. Không gộp thành một đoạn — mô tả gộp làm đặc điểm lẫn giữa hai khuôn mặt.
- Bố cục phải nêu ai đứng đâu: "A on the left with an arm around B, both looking at the view."
- Đối chiếu từng khuôn mặt riêng với ảnh gốc của chính người đó. Ảnh cặp đôi chỉ đạt khi cả hai đều đạt.
- Quy trình loạt ảnh ở Bước 8 áp dụng y hệt, vẫn mồi bằng ảnh đầu tiên đã duyệt.
Lỗi thường gặp
- Địa danh sai hoặc méo. Nêu một điểm nhìn cụ thể ("nhìn từ quảng trường Trocadéro", "chùa Cầu từ phía sông Hoài"), đừng nêu mơ hồ ("gần tháp").
- Nhân vật quá nhỏ trong khung. Ghi rõ "three-quarter length, mid-frame, landmark behind but not dominating".
- Dáng đơ như ma-nơ-canh. Mô hình mặc định cho nhìn thẳng, tay buông xuôi. Kê sẵn một dáng tự nhiên bằng câu chữ cụ thể.
- Tông màu lệch. Cảnh Santorini chói nắng mà tông xanh lạnh là sai. Chọn tông theo từng nơi và từng giờ.
- Tự thêm viền, khung bưu thiếp hoặc chữ. Mô hình rất thích thêm — luôn giữ dòng khóa cấm chữ, cấm viền.
- Trôi nhận dạng. Lỗi phổ biến nhất: ảnh ra là một người du lịch, không phải chính người dùng. Theo thứ tự: luôn có ảnh tham chiếu; khối neo đầy đủ gồm cả vóc dáng; dán nguyên văn; đối chiếu trước khi giao.
- Trôi vóc dáng trong loạt ảnh. Mặt khớp mà dáng người không khớp. Xử lý bằng nhóm vóc dáng trong khối neo cộng với mồi nhiều ảnh tham chiếu.
File tham chiếu
references/location-research.md— tiêu chí một điểm chụp đạt, trình tự khảo sát, lịch mùa vụ Việt Nam và quốc tế, cạm bẫy, và một bộ đề xuất mẫu. Đọc ở Bước 3 khi khảo sát một nơi chưa có công thức.references/destinations.md— mười công thức địa danh Việt Nam, tám công thức quốc tế, một ví dụ hoàn chỉnh và mẫu viết công thức mới. Đọc khi đã chọn điểm đến.references/rendering.md— cú pháp từng backend (GPT-Image/ChatGPT, Gemini, Midjourney, Flux, API chung), cách chọn model, và bảng xử lý sự cố. Đọc ở Bước 5.