Bản tin công nghệ quốc tế · dịch tiếng Việt 04.09.2026 RSS
AI & Dữ liệu · TechCrunch

Vấn đề sự đồng nhất đằng sau những thực đơn tạo bởi AI trông kỳ lạ

Nhiều nhà hàng đang sử dụng hình ảnh thực đơn tạo bằng AI với vẻ ngoài hoàn hảo đến mức khó tả, gây cảm giác khó chịu cho khách hàng. Hiện tượng này xuất phát từ việc các mô hình AI tối ưu hóa theo thẩm mỹ chung và việc chỉnh sửa lặp đi lặp lại làm mất đi tính chân thực của món ăn.

TechCrunch04.09.20267 phút đọc2 lượt đọc

Khi bạn lần đầu tiên trải nghiệm điều này, bạn sẽ nghĩ rằng mình đang phát điên. Bạn bước vào một quán cà phê và nhìn vào thực đơn với nhiều loại bánh mì kẹp bagel, nhưng mỗi hình minh họa trông hoàn hảo đến kỳ lạ, chính xác một cách đối xứng và mịn màng một cách kỳ quặc, gợi lên cảm giác trực quan rằng có điều gì đó không ổn. Bạn có thể nghĩ rằng mình đa nghi, nhưng bạn không hề mất trí đâu. Các thực đơn do AI tạo ra đã thâm nhập vào ngành kinh doanh nhà hàng nhờ các mô hình được huấn luyện trên một thẩm mỹ hẹp, mang lại cảm giác sai lệch ngay cả khi bạn không thể diễn tả được lý do tại sao.

Đôi khi, những hình minh họa này giả tạo một cách rõ mồn một, giống như một chiếc burrito với lớp phô mai sủi bọt và tan chảy đến mức trông giống nghệ thuật trừu tượng hơn là bữa trưa. Thường thì chúng trông bình thường đến mức bạn chỉ nhận ra có điều gì đó không ổn khi dành chút thời gian nhìn kỹ hơn.

Alex Lisle, Giám đốc công nghệ của Reality Defender, chia sẻ với TechCrunch: "Nó giống như một người ngoài hành tinh đang cố gắng làm một chiếc pizza mà không hiểu các nguyên lý cốt lõi của nó". (Bản thân Reality Defender là một phần trong nhóm các startup đang phát triển các công cụ phát hiện AI và xác thực nội dung - một lĩnh vực tồn tại một phần do những vấn đề như thế này).

Lisle cho biết cách các mô hình này được xây dựng có thể giúp giải thích lý do tại sao các hình minh họa dường như tôn vinh một thẩm mỹ cụ thể - nơi mọi viên kem đều tròn hoàn hảo, và tôm dường như đã biến đổi gen để ăn chính đuôi của chúng, tạo ra những "cơn ác mộng ẩm thực mang phong cách Lovecraftian" mới.

Các mô hình ngôn ngữ lớn (LLM) và mô hình khuếch tán (diffusion model) - những loại mô hình AI tạo nên các chatbot dường như thông thái mọi thứ và các công cụ tạo hình ảnh như ChatGPT và Midjourney - được huấn luyện trên lượng dữ liệu khổng lồ. Các mô hình sau đó xác định các mẫu trong tập dữ liệu để dự đoán người dùng đang tìm kiếm điều gì khi họ yêu cầu một cái gì đó như, "Hãy tạo cho tôi một thực đơn cho một nhà hàng burger".

Lisle cho biết: "Rất nhiều thứ trong số này trông giống như thực đơn của Chili's từ năm 2015, và có lý do cho điều đó. Đó là tập hợp các tác phẩm mà [các mô hình] đã rút ra chức năng của chúng".

Dữ liệu huấn luyện mới là vô giá đối với các công ty xây dựng mô hình AI - Amazon thậm chí còn được phát hiện là đi tìm các cuốn sách hiếm để quét và bổ sung vào dữ liệu huấn luyện của mình, rồi tiêu hủy những cuốn sách đó sau khi chúng được tải lên. Sắp tới, một số nội dung do AI tạo ra chắc chắn sẽ len lỏi vào các tập dữ liệu khổng lồ không thể tưởng tượng nổi này. Nhưng khi các mô hình AI huấn luyện trên quá nhiều nội dung do chính chúng tạo ra, chúng có nguy cơ sụp đổ mô hình (model collapse).

Lisle giải thích: "Sụp đổ mô hình giống như bệnh bò điên vậy... khi bạn đưa đầu ra từ mô hình này quay trở lại chính nó, cuối cùng sự cận huyết trở thành quá mức và toàn bộ hệ thống sụp đổ. Những gì chúng ta thấy ở đây là sự hội tụ (convergence), không nhất thiết phải là sụp đổ mô hình".

Sự hội tụ ít cực đoan hơn một chút, làm giảm chất lượng đầu ra của AI mà không khiến nó trở nên hoàn toàn vô dụng.

Nếu ai đó yêu cầu một mô hình AI tạo thực đơn cho một nhà hàng đồ ăn nhanh, mô hình đó rất có thể sẽ tham khảo thực đơn từ Wendy's, Burger King, McDonald's hoặc một chuỗi cửa hàng phổ biến khác. Những thực đơn này đã có sẵn một phong cách tương tự nhau, có nghĩa là các đầu ra do AI tạo ra sẽ bắt chước chính phong cách đó, để rồi tiếp tục củng cố nó hơn nữa nếu thực đơn do AI tạo ra cuối cùng lại quay trở lại tập dữ liệu huấn luyện.

Nhưng các thực đơn và quảng cáo đồ ăn sẽ luôn trông đẹp hơn thực tế, giống như một chiếc Big Mac trong quảng cáo của McDonald's nơi từng lớp của chiếc bánh sandwich được sắp xếp bởi một nhà thiết kế đạo cụ để trông hấp dẫn nhất có thể. Hiệu ứng này thậm chí còn trở nên rõ rệt hơn trong các đầu ra của AI.

Lee Rainie, Giám đốc Trung tâm Tương lai Kỹ thuật số tại Đại học Elon, chia sẻ với TechCrunch: "Việc tối ưu hóa các tập dữ liệu là để tạo sự dễ chịu, hoặc không mang tính xúc phạm, và đó là cách biến thành sự đồng nhất. Những gì AI được biết đến là làm cả trong hình ảnh và ngôn ngữ là gọt giũa các góc cạnh".

Ở quy mô địa phương hơn, hiện tượng làm mượt hình ảnh này dường như xảy ra khi bạn sử dụng công cụ tạo hình ảnh AI để tạo thực đơn và áp dụng các chỉnh sửa cho nó. Trên X, một người dùng tên Labtec đã cho thấy điều gì xảy ra khi bạn tạo thực đơn trong ChatGPT, sau đó chỉnh sửa nó 100 lần để xem thức ăn tiếp tục trông kém tự nhiên như thế nào. (Chúng tôi đã làm lại thí nghiệm và thu được kết quả tương tự).

Labtec viết: "Kết quả cuối cùng thực sự làm tôi cảm thấy khó chịu".

Các nhà hàng có thể đang là nạn nhân của vấn đề này, sửa đổi thực đơn do AI tạo ra để thay đổi các chi tiết nhỏ lặp đi lặp lại, như giá cả hoặc tên món ăn. Có vẻ như sau mỗi lần chỉnh sửa, hình ảnh món ăn lại trở nên tròn hơn và mịn màng hơn một chút.

Rainie cho biết: "Mọi người có một cảm giác gần như không thể giải thích được khi họ đang nhìn vào thứ gì đó do AI tạo ra, so với thứ gì đó vốn dĩ là thật. Có một sự nhạy cảm mà đôi khi mọi người khó diễn tả, nhưng họ nhận ra nó khi nhìn thấy và tôi nghĩ đó là một trong những lý do tại sao một số câu chuyện ban đầu về phản ứng dữ dội [chống lại các nhà hàng sử dụng thực đơn AI] lại mạnh mẽ đến vậy".

Có khoa học đằng sau sự ác cảm của chúng ta đối với các thực đơn AI này. Các nhà nghiên cứu tại Đại học Duisburg-Essen ở Đức phát hiện ra rằng hình ảnh thực đơn do AI tạo ra thể hiện hiệu ứng "thung lũng kỳ lạ" (uncanny valley), trong đó hình ảnh đồ ăn trông gần như thật lại gợi lên sự ghê tởm và khó chịu nhiều hơn so với hình ảnh giả mạo rõ ràng. Cảm giác e dè đó càng trở nên mãnh liệt hơn dướiσ ánh sáng của bối cảnh văn hóa xung quanh AI.

Nếu mọi người phản ứng với những hình ảnh này một cách tiêu cực như vậy, thì đó có lẽ là lý do đủ để các nhà hàng ngừng cố gắng sử dụng thực đơn AI. Nhưng các vấn đề mang lại cho chúng ta những chiếc bánh mì kẹp thịt màu vàng nâu hoàn hảo còn vượt ra ngoài bàn ăn.

Lisle nói: "Việc nhìn và nghe luôn là tin tưởng, đến mức hệ thống tòa án của chúng ta hoàn toàn phù hợp với ý tưởng rằng tiêu chuẩn vàng trong bằng chứng là những lời thú tội được ghi băng và bằng chứng bằng video. Điều đó không còn đúng nữa. Thế giới đã thay đổi căn bản, dù tốt hay xấu".

🔗 Bài gốc (tiếng Anh): The sameness problem behind those unappetizing AI-generated menus
Nguồn: TechCrunch

Cùng chuyên mục · AI & Dữ liệu
🚀 VGSNews
AI & Dữ liệu

Crusoe huy động thành công 3 tỷ USD với định giá 30 tỷ USD

Công ty phát triển trung tâm dữ liệu Crusoe vừa huy động được 3 tỷ USD, nâng định giá lên mức 30 tỷ USD trong bối cảnh…

TechCrunch · 1 phút đọc
AI & Dữ liệu

NVIDIA mua lại Hugging Face với giá 12,9 tỷ USD, cam kết duy trì nền tảng mở

NVIDIA đã đạt thỏa thuận thâu tóm Hugging Face với giá 12,93 tỷ USD và cam kết giữ nền tảng này hoạt động độc lập, mở…

TechPowerUp · 2 phút đọc
AI & Dữ liệu

OpenAI ra mắt GPT-6 Astra: Kỷ nguyên AGI chính thức bắt đầu với hiệu năng vượt trội

OpenAI vừa hé lộ mô hình GPT-6 Astra đánh dấu bước ngoặt kỷ nguyên AGI với điểm số benchmark ấn tượng. Model này có khả…

Wccftech · 4 phút đọc