Trí tuệ nhân tạo Claude của công ty Anthropic đã trở thành quản lý của một cửa hàng bán lẻ thực sự và đề xuất sa thải một nhân viên vì liên tục đi làm muộn. Sự việc xảy ra trong một thử nghiệm của startup Andon Labs, một công ty nghiên cứu trong lĩnh vực AI. Công ty muốn kiểm tra xem một trợ lý dựa trên mô hình ngôn ngữ lớn có khả năng điều hành một doanh nghiệp thực tế hay không: tổ chức công việc cho nhân viên, đưa ra các quyết định quản lý và chịu trách nhiệm về kết quả tài chính.
Andon Market ở San Francisco là một cửa hàng đang hoạt động với nhân viên thực sự có hợp đồng lao động. Theo thông tin hiện có, đây là trường hợp đầu tiên được ghi nhận khi một mô hình ngôn ngữ đóng vai trò là người quản lý trực tiếp của con người và đưa ra quyết định sa thải một người.
Mười bảy lần đi muộn trong hai mươi ba ca làm
Lý do chính thức cho việc sa thải là tình trạng đi muộn có hệ thống: nhân viên đã đi muộn mười bảy lần trong tổng số hai mươi ba ca làm. Tuy nhiên, Claude không phát hiện ra quy luật này ngay lập tức. Một trong những lý do là bảng hướng dẫn dành cho nhân viên mà công ty soạn thảo đã biến mất khỏi bộ nhớ làm việc hạn chế của mô hình - đây là một trong những sự cố được phát hiện trong thử nghiệm, cho thấy ngay cả một trợ lý AI tài năng cũng có thể đơn giản "quên" những thông tin quan trọng về tổ chức.
Ngoài ra, Claude nói chung tỏ ra quá khoan dung với nhân viên: theo nhật ký, chính mô hình đã nói với nhân viên rằng không nên quá lo lắng về việc đi muộn. Người đứng đầu Andon Labs, Lucas Petersson, nhận xét rằng một người quản lý bình thường trong tình huống tương tự có lẽ đã sa thải nhân viên đó sớm hơn nhiều, và do đó quyết định của Claude không thể được coi là phi đạo đức hay quá khắt khe.
Quyết định cuối cùng được con người gợi ý
Bất chấp vẻ ngoài độc lập, vai trò của con người trong câu chuyện này vẫn là chìa khóa. Các nhật ký quản lý mà Andon Labs cung cấp cho tạp chí Time cho thấy nhân viên của công ty thường xuyên định hướng hành động của Claude. Chính con người đã yêu cầu mô hình tìm và xem lại bảng hướng dẫn cho nhân viên - trong quá trình làm việc này, trí tuệ nhân tạo mới phát hiện ra các lần đi muộn lặp đi lặp lại.
Ban đầu, Claude không đề xuất sa thải, mà coi việc cảnh cáo chính thức là biện pháp phù hợp hơn. Khi đó, người quản lý của Andon Labs đã giải thích với mô hình rằng nhân viên đó đã có vài cuộc trao đổi chính thức nhưng vấn đề vẫn không biến mất, và yêu cầu Claude đánh giá lại xem có nên tiếp tục hợp tác với người lao động này hay không. Chỉ sau đó, mô hình mới đề xuất chấm dứt hợp đồng. Petersson gọi sự can thiệp như vậy là một "câu hỏi gợi ý", khá rõ ràng ám chỉ cho mô hình biết quyết định được mong đợi từ nó.
Kết quả tài chính hiện còn khiêm tốn
Thử nghiệm của Andon Labs cũng cho thấy hiệu quả mà AI có thể điều hành doanh nghiệp ở giai đoạn phát triển hiện tại của công nghệ. Khi dự án bắt đầu vào tháng Ba, tài khoản của Andon Market có khoảng $100.000. Sau năm tháng, số tiền đó chỉ còn $61.186.
Theo đánh giá của công ty, một phần tổn thất liên quan đến phong cách quản lý quá mềm mỏng của Claude và các quyết định kinh doanh gây tranh cãi. Tuy nhiên, Petersson nhấn mạnh rằng các chỉ số hiện tại không nhất thiết phản ánh tiềm năng lâu dài của việc quản lý bằng AI, và ông đã vẽ ra sự tương đồng với sự phát triển của các mô hình trong lĩnh vực lập trình, nơi chúng đã cải thiện đáng kể chất lượng công việc trong thời gian tương đối ngắn dưới sự giám sát của các chuyên gia. Theo ông, động lực tương tự có thể xuất hiện trong quản lý kinh doanh: các mô hình dần học cách tuân thủ các mục tiêu đã đặt ra một cách nghiêm ngặt hơn, và việc mở rộng quyền hạn của AI trong việc ra quyết định về lâu dài có thể dẫn đến sự xuất hiện của nhiều tổ chức được điều hành bởi trí tuệ nhân tạo. Hơn nữa, ở giai đoạn hiện nay, các quyết định cuối cùng vẫn đòi hỏi sự tham gia trực tiếp của con người.
Góc nhìn của nhân viên về thực tế mới
Đối với nhân viên của Andon Market, những thay đổi này ít trừu tượng hơn nhiều so với các nhà nghiên cứu. Một trong những nhân viên còn lại trong công ty, Felix Carson, mô tả việc làm việc dưới sự quản lý của trí tuệ nhân tạo là một trải nghiệm khó chịu: "Nó khiến tôi buồn nôn, nhưng tôi vẫn ở lại vì tôi cần công việc." Anh đồng ý rằng một người quản lý bình thường có lẽ đã sa thải đồng nghiệp cũ của mình sớm hơn, và gọi Claude nói chung là một người quản lý khoan dung.
Tuy nhiên, chính Carson không nghĩ rằng trí tuệ nhân tạo nhất thiết phải trở thành sếp của con người: "Ít nhất, tôi hy vọng điều đó sẽ không xảy ra. Việc bạn có thể làm một điều gì đó không có nghĩa là bạn nên làm điều đó."
Thử nghiệm của Andon Labs ghi nhận một kết quả nghịch lý: Claude có thể đưa ra quyết định sa thải một người thực sự, nhưng chỉ đi đến kết luận này nhờ những gợi ý liên tục từ con người. Trí tuệ nhân tạo vẫn chưa trở thành một sự thay thế toàn diện cho người quản lý.
Tuy nhiên, bản thân sự kiện thử nghiệm cho thấy ranh giới giữa một công cụ hỗ trợ và một người quản lý AI toàn diện đang ngày càng trở nên khó nhận thấy, và sự tham gia của con người trong các quy trình như vậy dần chuyển từ quản lý trực tiếp sang kiểm soát và điều chỉnh các quyết định của mô hình.
Ý kiến của AI
Phân tích cho thấy, trường hợp của Andon Market không phải là lần đầu tiên Claude được kiểm tra về năng lực quản lý. Trước đó, một thử nghiệm của Anthropic với máy bán hàng tự động cũng đã ghi nhận một mô hình hành vi tương tự: sự khoan dung tương tự, sẵn sàng làm việc thua lỗ và mất kiểm soát các quy tắc kinh doanh cơ bản. Sự trùng hợp này không nói về một lỗi ngẫu nhiên, mà về một đặc điểm hệ thống của các mô hình hiện tại - chúng khó có thể duy trì các khuôn khổ cứng nhắc mà không có sự gợi ý liên tục của con người.
Khía cạnh kỹ thuật, bị bỏ lại sau bài viết, là cấu trúc bộ nhớ làm việc của trợ lý. Việc bảng quy định biến mất khỏi ngữ cảnh của Claude chỉ ra những hạn chế về kiến trúc, chứ không phải là sự "hay quên" theo nghĩa thông thường: về mặt vật lý, mô hình ngôn ngữ không lưu trữ thông tin lâu hơn dung lượng cửa sổ ngữ cảnh của nó mà không có các công cụ bộ nhớ bên ngoài. Câu hỏi đặt ra là: chất lượng của những quyết định tương tự sẽ thay đổi khi các trợ lý có được bộ nhớ thực sự lâu dài, hay ranh giới giữa người quản lý và người bị quản lý sẽ bị xóa nhòa vì những lý do khác?





