Khách nhắn riêng và khách bình luận công khai là hai bài toán khác hẳn nhau, vì nền tảng mở cửa cho hai việc đó khác nhau rất xa. Biết mình đang ở nhánh nào rồi mới bàn được câu quan trọng nhất: mình có cần tự dựng không?
Đây là trang mở đầu. Nó không dạy bấm nút ở đâu, nó dạy chọn đường. Chọn sai đường thì bấm nút giỏi cỡ nào cũng vẫn sai chỗ.
Mỗi khái niệm kèm từ khóa gốc tiếng Anh ngay tại chỗ, cuối trang có sổ tay thuật ngữ. Ẩn dụ giúp hiểu ngay, nhưng lúc mở tài liệu và nói chuyện với agent thì hiện ra toàn chữ gốc.
Tin nhắn riêng hay bình luận công khai, Fanpage hay YouTube hay một nền tảng chưa ra đời: bóc vỏ ra đều là bốn nhịp nối thành vòng. Nhớ vòng này thì mọi công cụ gặp sau đó chỉ là một cách lắp khác của cùng bốn nhịp.
Biết được là vừa có người bình luận, và lấy về nội dung của bình luận đó.
Bình luận này hỏi gì, khen hay chê, có phải việc mình trả lời được không.
Ra một câu trả lời đúng nội dung, đúng giọng, và kiểm xem có được phép phát đi không.
Đưa câu trả lời quay lại đúng chỗ bình luận đó, dưới danh nghĩa trang của mình.
Hai việc nghe na ná nhau nhưng nền tảng đối xử với chúng khác hẳn. Trả lời câu này trước, bạn khỏi mất cả tuần đi nhầm hướng.
Nhánh một
Đây là sân nhà của đồ có sẵn, và tin tốt là bạn thường không cần tự dựng gì cả. Cả nền tảng lẫn các công cụ trung gian đều đổ công vào đây, vì đó là chỗ ra đơn.
Bật cái gì: Meta Business Agent đọc thông tin doanh nghiệp của bạn (danh mục sản phẩm, trang công khai, website, mô tả, địa chỉ, giờ mở cửa) rồi dựa vào đó trả lời khách, nói theo giọng bạn đặt, và tự lùi ra khi bạn nhảy vào nhắn tay. Hoặc ManyChat, nếu bạn muốn tự vẽ luồng và giữ quyền kiểm soát từng bước.
Ba điều nên biết trước khi đặt cược: trợ lý AI của Meta hiện mới mở ở một số nước cho một số doanh nghiệp được chọn, phải ghi tên vào danh sách chờ. Bắt đầu thì miễn phí nhưng Meta đã nói sắp chuyển sang gói trả phí. Và tin nhắn trong những cuộc chat có bật nó vẫn được Meta thu thập để cải thiện AI của họ, khách cũng được báo là đang nói chuyện với AI.
Nhánh hai
Mỏng hơn hẳn. Cùng một nền tảng, cùng một công ty, nhưng cửa mở cho bình luận nhỏ hơn nhiều so với cửa mở cho tin nhắn. Đây cũng là chỗ sai một câu thì cả làng nhìn thấy, chứ không phải chuyện riêng giữa hai người.
Chỗ rất dễ hiểu nhầm: nhiều người thấy trợ lý AI của nền tảng mạnh quá liền tưởng nó lo luôn phần bình luận. Không phải. Theo công bố chính thức, nó chạy trong các ứng dụng nhắn tin, và cả bài công bố lẫn trang giới thiệu sản phẩm đều không nhắc tới bình luận công khai một lần nào.
Vậy dùng gì cho bình luận: có ba đường đi, và chọn đường nào lại phụ thuộc vào chuyện nền tảng mở cửa tới đâu. Hai mục tiếp theo giải quyết đúng chuyện đó.
Rút ra một thói quen dùng được mãi: trước khi tin một công cụ làm được việc của mình, hãy kiểm xem nó đứng ở tin nhắn hay ở bình luận. Nếu việc của bạn là tin nhắn, bật đồ có sẵn rồi quay lại làm việc khác. Phần còn lại của trang này dành cho nhánh hai, nhánh khó.
Nhịp hai và ba nằm trong máy của bạn, muốn làm gì thì làm. Nhưng nhịp một và bốn chạm vào nền tảng, và nền tảng mới là bên cầm chìa khóa. Nó mở cửa cho máy móc tới đâu (API), bạn làm được tới đó.
Áp cho nhịp nghe
Kiểu thứ nhất: bạn để lại một địa chỉ, có bình luận mới thì nền tảng tự gọi vào báo, giống lắp một cái chuông cửa (webhook). Kiểu thứ hai: nền tảng im lặng, bạn phải cứ vài phút tự ra hỏi một lần (polling).
Vì sao đáng quan tâm: hỏi vòng không miễn phí. Mỗi lần gọi cửa đều tính vào một trần nền tảng đặt cho bạn (rate limit, quota). Hỏi thưa thì chậm, hỏi dày thì cụt hạn mức.
Áp cho nhịp đăng
Đọc được chưa chắc đăng được. Hai quyền tách rời, xin riêng từng cái (permission, còn gọi là scope), và quyền đăng thường khó xin hơn hẳn.
Vì sao đáng quan tâm: nền tảng không cho máy đăng thì dù dựng giỏi tới đâu, đoạn cuối vẫn là người ngồi dán bằng tay. Biết trước, bạn thiết kế thành "máy soạn sẵn, người bấm gửi" thay vì hứa với khách một thứ không tồn tại.
Hai câu hỏi này là thứ bạn mang đi hỏi bất kỳ nền tảng nào, kể cả nền tảng chưa ai dùng. Trả lời xong hai câu đó, bạn đã biết giới hạn của mình trước khi viết một dòng nào.
Không phải bảng tra cứu để thuộc lòng, vì nền tảng đổi luật liên tục. Đây là bốn ví dụ mẫu cho thấy hai câu hỏi trên chạy ra sao trong thực tế.
Fanpage, nơi dễ tự động nhất
Điều phải biết: cả hai việc đều đòi quản trị viên trang có quyền kiểm duyệt đứng ra cấp phép, và mỗi việc dùng một loại chìa khác nhau (access token).
Chỗ nhiều người tưởng làm được, nhưng không
Điều phải biết: tài liệu Meta nói thẳng rằng đọc bình luận trên bài, ảnh, video của một cá nhân bằng chìa của người dùng thì kết quả trả về rỗng. Cửa đóng ngay từ nhịp một.
Đăng được, nhưng phải tự đi hỏi
Điều phải biết: YouTube có gửi tin báo, nhưng chỉ ba việc: video mới, đổi tiêu đề, đổi mô tả. Bình luận không nằm trong đó, nên nhịp một buộc phải hỏi vòng, và cả lượt hỏi lẫn lượt đăng đều ăn vào hạn mức.
Không phải bình luận, mà là đánh giá
Điều phải biết: Google thả tin vào một hộp thư chung rồi bạn ra lấy (pub/sub) chứ không gọi thẳng. Khác biệt lớn hơn ở bản chất: đây là đánh giá kèm số sao, gắn với một địa điểm và ai cũng thấy lâu dài, nên trả lời sai tốn hơn nhiều.
Bốn ô trên là ảnh chụp tại thời điểm bài này ra đời. Bền hơn là bốn việc sau, làm trên tài liệu chính thức dành cho nhà phát triển của chính nền tảng đó, không phải bài blog kể lại:
Đa số chọn đường theo câu "mình có biết code không". Câu đúng là: trong bốn nhịp, khúc nào bạn cần tự quyết? Ba đường dưới đây khác nhau đúng một chỗ: chúng mở khúc giữa của cái vòng ra rộng tới đâu.
Nền tảng cho sẵn, không cài gì, bật lên là chạy. Nhưng riêng với bình luận công khai thì thứ có sẵn còn mỏng: máy chỉ dò chữ bạn liệt kê rồi phát ra câu viết sẵn, nó không đọc hiểu nội dung bài.
Một dịch vụ bên thứ ba đã nối sẵn với nền tảng. Bạn kéo thả dựng luồng, không phải viết code, và khúc giữa hé ra: rẽ nhánh theo điều kiện, lưu thông tin người bình luận, thường gọi được AI ở giữa luồng.
Bạn tự nối vào cửa nền tảng, tự chạy phần giữa, tự lo chỗ cho nó chạy suốt ngày đêm. Khúc giữa mở hẳn: bạn quyết được AI đọc những gì trước khi soạn, đặt lời dặn riêng cho nó (system prompt), và cài lớp chặn bằng luật cứng của riêng mình trước lúc phát ra (guardrail).
Rút gọn còn một câu: câu trả lời của bạn có cần đọc hiểu nội dung bài và bình luận không? Không cần thì đường một là đủ, hơn thế là làm thừa. Cần thì bạn đã bị đẩy về đường hai hoặc ba, dù muốn hay không.
Trước khi hỏi bốn câu này, phải qua cửa chặn đã nói ở trên: nền tảng có cho máy nghe và cho máy đăng không. Cửa đóng thì cả ba đường đều vô nghĩa.
Nếu người ta chỉ hỏi vài câu lặp lại và một câu chung là xong thì máy không cần hiểu gì. Còn nếu câu trả lời phải nhắc đúng thứ đang nói trong bài, máy buộc phải đọc được ngữ cảnh.
Mất vui thôi, hay mất tiền, mất uy tín, hay thành lời hứa ràng buộc với khách? Rủi ro càng cao càng cần chỗ cài lớp chặn và một người thật đứng trong luồng để duyệt trước khi phát ra (human in the loop).
Vài chục một ngày thì làm tay vẫn kịp. Nhưng cứ ra một bài là dồn về hàng trăm bình luận trong một giờ thì việc phải giải không còn là "trả lời hay" mà là "trả lời kịp mà không vỡ trần".
Câu bị bỏ qua nhiều nhất. Hệ thống tự dựng cần chỗ chạy suốt ngày đêm, cần thay chìa khi hết hạn, cần người biết mở ra sửa lúc nó im. Không có người đó thì đường ba là đường ngắn nhất dẫn tới một hệ thống tắt ngấm lúc nào không hay.
Ba đường không phải ba phe đối nghịch mà là ba bậc thang. Bắt đầu ở bậc thấp nhất còn giải được việc, chạy thật một thời gian, chỉ leo lên khi thực tế chỉ ra chỗ nghẽn. Leo trước khi biết mình nghẽn ở đâu là leo mò.
Những điều dưới đây không phải chuyện kỹ thuật, nên đúng cả khi bạn chỉ bật một công tắc có sẵn. Đây là phần hay bị bỏ qua nhất, và gây thiệt hại thật nhiều nhất.
Quay lại câu hỏi size M: "còn hàng" là một lời hứa về tồn kho. Giá cả, thời gian giao, cam kết bảo hành cũng vậy. Đây là chỗ nhường lại cho người, dù câu tự động mượt tới đâu.
Câu bạn vừa đăng cũng là một bình luận mới. Trước khi xử lý bất cứ thứ gì nghe được, việc đầu tiên là hỏi: cái này có phải do chính mình vừa nói ra không.
Nền tảng có thể báo trùng, mạng chập chờn khiến một việc chạy hai lượt. Phải nhớ được là mình đã trả lời cái này rồi (idempotency).
Có những bình luận máy phải im và chuyển cho người: khiếu nại, pháp lý, sức khỏe, hoặc đơn giản là máy không chắc. Cửa này định sẵn từ đầu (escalation).
Cho chạy im để xem nó định nói gì, rồi tới mức người duyệt từng câu, cuối cùng mới thả cho tự đăng. Và nhớ rằng kiểu hỏng nguy hiểm nhất là hỏng trong im lặng (silent failure): chìa hết hạn, gói hết hạn, nền tảng đổi luật.
Nhóm bình luận nào trả lời sai sẽ tốn uy tín, nhóm đó phải có người đọc. Tự động hóa không phải trò được ăn cả: bạn được quyền tự động một phần và giữ lại phần còn lại.
Bạn không cần tự làm phần kỹ thuật. Nhưng agent chỉ làm đúng khi bạn đưa cho nó thứ nó không tự nghĩ ra, và khi bạn biết hỏi lại để kiểm.
Ẩn dụ giúp bạn hiểu ngay, nhưng lúc mở tài liệu và lúc trao đổi với agent thì hiện ra toàn chữ này. Đọc lướt một lượt, gặp lại là nhận ra.
Cửa riêng để phần mềm gọi vào một dịch vụ, thay cho việc con người ngồi bấm nút.
Cái chìa: một chuỗi ký tự gửi kèm mỗi lần gọi cửa để chứng minh mình được phép.
Từng quyền lẻ bạn xin. Quyền đọc bình luận và quyền trả lời bình luận là hai quyền khác nhau.
Cái chuông. Một địa chỉ bạn để lại để nền tảng tự gọi vào khi có việc.
Cách ngược lại với chuông: tự hỏi nền tảng liên tục xem có gì mới không.
Kiểu đưa tin qua một hộp thư chung: bên gửi thả tin vào, bên nhận ra lấy, hai bên không gọi thẳng nhau.
Trần số lần được gọi cửa trong một khoảng thời gian. Hỏi vòng dày là ăn vào trần này.
Lời dặn viết sẵn cho AI: vai của nó, giọng văn, và những điều cấm.
Lớp chặn bằng luật cứng đặt ngay trước lúc phát ra, viết bằng code nên chạy lần nào cũng như nhau.
Làm lại bao nhiêu lần vẫn ra một kết quả, không nhân đôi. Đây là cái chặn trả lời trùng.
Có người thật đứng trong luồng để duyệt, thay vì để máy quyết hết.
Việc chuyển một ca lên cho người xử lý. Phải định sẵn ca nào thì chuyển, chứ không đợi lúc rối mới nghĩ.
AI nói ra thứ nghe rất hợp lý nhưng không có thật. Lớp chặn bằng code không bắt được loại này.
Hỏng mà không báo. Hệ thống ngừng chạy êm ru trong khi bạn tưởng nó vẫn làm việc.
Bạn không cần nhớ nền tảng nào cho phép gì, vì điều đó sẽ khác vào năm sau. Đáng mang theo là cái vòng bốn nhịp, hai câu hỏi để soi bất kỳ nền tảng nào, và cái ngã ba đo bằng "khúc nào tôi cần tự quyết". Có ba thứ đó thì gặp nền tảng lạ hoắc, bạn vẫn tự trả lời được câu quan trọng nhất: mình có cần dựng gì không.
Trang 2 của loạt này: nếu bốn câu hỏi ở trên đẩy bạn về đường ba, trang tiếp theo đi sâu vào đúng ca đó, dựng hệ thống tự trả lời bình luận cho Facebook Fanpage gồm những giai đoạn nào và điều gì bắt buộc phải có. Đọc tại ai-agent-tra-loi-binh-luan.pages.dev