Trí tuệ nhân tạo Claude từ công ty Anthropic đã trở thành quản lý của một cửa hàng bán lẻ thực sự và đề xuất sa thải một nhân viên vì thường xuyên đi làm muộn. Sự việc xảy ra trong một thử nghiệm của startup Andon Labs, chuyên nghiên cứu về AI - công ty muốn kiểm tra xem một đại lý dựa trên mô hình ngôn ngữ lớn có khả năng điều hành một doanh nghiệp thực tế hay không: tổ chức công việc của nhân viên, đưa ra các quyết định quản lý và chịu trách nhiệm về kết quả tài chính.
Andon Market ở San Francisco là một điểm bán hàng thực sự với những nhân viên thực, những người đã ký hợp đồng lao động. Theo dữ liệu hiện có, đây là trường hợp đầu tiên được ghi nhận, khi một mô hình ngôn ngữ đóng vai trò là người quản lý trực tiếp của con người và đưa ra quyết định sa thải một trong số họ.
Mười bảy lần đi muộn trong hai mươi ba ca làm việc
Lý do chính thức cho việc sa thải là do đi muộn có hệ thống: nhân viên này đã đi muộn mười bảy lần trong hai mươi ba trường hợp. Tuy nhiên, Claude không phát hiện ra quy luật này ngay lập tức. Một trong những nguyên nhân là hướng dẫn dành cho nhân viên do công ty biên soạn đã biến mất khỏi bộ nhớ làm việc hạn chế của mô hình - đây là một trong những sự cố được phát hiện trong thử nghiệm, cho thấy rằng ngay cả một đại lý AI có năng lực cũng có thể đơn giản "quên" thông tin quan trọng về tổ chức.
Ngoài ra, Claude nói chung tỏ ra quá khoan dung với nhân viên: theo nhật ký, chính mô hình đã nói với nhân viên rằng họ không nên quá lo lắng về việc đi muộn. Giám đốc Andon Labs, Lucas Petersson, lưu ý rằng một quản lý là con người trong tình huống tương tự rất có thể đã sa thải nhân viên đó sớm hơn nhiều, và do đó quyết định của Claude không thể được coi là không đạo đức hoặc quá khắt khe.
Quyết định cuối cùng do con người gợi ý
Bất chấp vẻ ngoài tự chủ, vai trò của con người trong câu chuyện này vẫn là chìa khóa. Nhật ký quản lý mà Andon Labs cung cấp cho tạp chí Time cho thấy, nhân viên của công ty thường xuyên định hướng hành động của Claude. Chính con người đã yêu cầu mô hình tìm và xem lại hướng dẫn dành cho nhân viên - trong quá trình thực hiện công việc này, trí tuệ nhân tạo đã phát hiện ra những lần đi muộn lặp đi lặp lại.
Ban đầu, Claude không đề xuất sa thải, mà cho rằng biện pháp phù hợp hơn là một cảnh cáo chính thức. Sau đó, người quản lý Andon Labs giải thích với mô hình rằng đã có một số cuộc trò chuyện chính thức với nhân viên này, nhưng vấn đề vẫn không biến mất, và yêu cầu Claude đánh giá lại xem có nên tiếp tục hợp tác với nhân viên này hay không. Chỉ sau đó, mô hình mới đề xuất chấm dứt hợp đồng. Petersson gọi sự can thiệp như vậy là một "câu hỏi dẫn dắt", khá rõ ràng ám chỉ mô hình về quyết định mà nó được kỳ vọng đưa ra.
Kết quả tài chính hiện còn khiêm tốn
Thử nghiệm của Andon Labs cũng cho thấy AI có khả năng quản lý doanh nghiệp hiệu quả như thế nào ở giai đoạn phát triển hiện tại của công nghệ. Khi dự án bắt đầu vào tháng 3, Andon Market có khoảng $100,000 trong tài khoản. Sau năm tháng, số tiền này còn lại $61,186.
Theo đánh giá của công ty, một phần tổn thất liên quan đến phong cách quản lý quá mềm mỏng của Claude và những quyết định kinh doanh gây tranh cãi. Tuy nhiên, Petersson nhấn mạnh rằng các chỉ số hiện tại không nhất thiết phản ánh tiềm năng dài hạn của việc quản lý bằng AI, và ông đã so sánh với sự phát triển của các mô hình trong lĩnh vực lập trình, nơi chúng đã cải thiện đáng kể chất lượng công việc trong thời gian tương đối ngắn dưới sự giám sát của chuyên gia. Theo ông, một động thái tương tự có thể xuất hiện trong quản lý doanh nghiệp: các mô hình dần học cách tuân thủ các mục tiêu đề ra một cách chặt chẽ hơn, và việc mở rộng quyền hạn của AI trong việc ra quyết định về lâu dài có thể dẫn đến sự xuất hiện của nhiều tổ chức được quản lý bởi trí tuệ nhân tạo hơn. Ngoài ra, ở giai đoạn hiện nay, các quyết định cuối cùng vẫn cần đến sự tham gia trực tiếp của con người.
Góc nhìn của nhân viên về thực tế mới
Đối với nhân viên của Andon Market, những thay đổi này trông ít trừu tượng hơn nhiều so với các nhà nghiên cứu. Một trong những nhân viên còn lại trong công ty, Felix Carson, mô tả việc làm việc dưới sự quản lý của trí tuệ nhân tạo là một trải nghiệm khó chịu: "Điều đó gây buồn nôn, nhưng tôi vẫn ở lại vì tôi cần công việc". Anh đồng ý rằng một quản lý là con người có lẽ đã sa thải đồng nghiệp cũ của anh sớm hơn, và nhận xét Claude nhìn chung là một người quản lý khoan dung.
Tuy nhiên, bản thân Carson không nghĩ rằng trí tuệ nhân tạo nhất thiết phải trở thành sếp của con người: "Ít nhất, tôi hy vọng điều đó sẽ không xảy ra. Việc bạn có thể làm điều gì đó không có nghĩa là bạn nên làm điều đó".
Thử nghiệm của Andon Labs ghi nhận một kết quả nghịch lý: Claude có thể đưa ra quyết định sa thải một con người thực sự, nhưng chỉ đạt được kết luận đó nhờ những gợi ý liên tiếp từ con người. Trí tuệ nhân tạo vẫn chưa trở thành một sự thay thế toàn diện cho người quản lý.
Tuy nhiên, bản thân thực tế của thử nghiệm cho thấy ranh giới giữa công cụ hỗ trợ và người quản lý AI toàn diện ngày càng trở nên mờ nhạt, và sự tham gia của con người trong các quá trình như vậy dần chuyển từ quản lý trực tiếp sang kiểm soát và điều chỉnh quyết định của mô hình.
Ý kiến của AI
Phân tích cho thấy, trường hợp của Andon Market không phải là lần đầu tiên Claude được kiểm tra về khả năng quản lý. Trước đó, một thử nghiệm của Anthropic với máy bán hàng tự động đã ghi nhận mô hình hành vi tương tự: cùng sự khoan dung, sẵn sàng làm việc thua lỗ và mất kiểm soát các quy tắc cơ bản của doanh nghiệp. Sự trùng hợp không nói về một lỗi ngẫu nhiên, mà về một đặc điểm hệ thống của các mô hình hiện tại - chúng khó duy trì các khuôn khổ cứng nhắc mà không có những gợi ý liên tục từ con người.
Khía cạnh kỹ thuật, bị bỏ ngoài bài viết, là chính cấu trúc bộ nhớ làm việc của đại lý. Việc biến mất quy định khỏi ngữ cảnh của Claude cho thấy những hạn chế về kiến trúc, chứ không phải sự "hay quên" theo nghĩa thông thường: mô hình ngôn ngữ về mặt vật lý không lưu trữ thông tin lâu hơn dung lượng cửa sổ ngữ cảnh của nó nếu không có các công cụ bộ nhớ bên ngoài. Một câu hỏi được đặt ra: chất lượng của những quyết định tương tự sẽ thay đổi khi các đại lý có được bộ nhớ thực sự dài hạn, hay ranh giới giữa người quản lý và nhân viên sẽ bị xóa nhòa vì những lý do khác?
end-content







