Vừa qua, mã nguồn tuyệt mật của OpenAI bị rò rỉ, 'cỗ máy vĩnh cửu' Codex đã bị phơi bày.
Hôm nay, tạp chí WIRED độc quyền tiết lộ, thông qua việc xem xét kho mã nguồn Codex công khai của OpenAI, họ phát hiện——
OpenAI đang bí mật thử nghiệm một 'tác nhân thông minh dai dẳng' hoàn toàn mới!

Trong chế độ này, Codex hóa thân thành một 'cỗ máy vĩnh cửu' (nô lệ kỹ thuật số trực tuyến 24h) 'quyết không tắt máy trừ khi bị buộc phải ngủ'.
Nó thậm chí có thể vượt qua phiên làm việc, đọc lịch sử sở thích của bạn, tự động tạo và phân phối các nhiệm vụ tiếp theo cho chính nó!
Sau khi xem xét mã nguồn, họ xác nhận, một mức độ suy luận hoàn toàn mới, đã được viết vào Codex CLI!
Thông tin quan trọng của nó như sau:
- Khả năng cốt lõi: Khi được chọn, nó sẽ tiếp tục làm việc cho đến khi bị buộc phải ngủ, không còn tự động dừng sau vài phút hoặc vài giờ như trước đây.
- Chủ động phân công: Sau khi hoàn thành yêu cầu của bạn, nó sẽ tự tạo follow-up (nhiệm vụ tiếp theo) cho chính mình, và có thể tiếp tục chạy xuyên qua các phiên làm việc.
- Nhớ bạn: Sử dụng lịch sử tương tác và 'hiểu biết về người dùng' để quyết định bước tiếp theo nên làm gì.
- Có thể chủ động tìm bạn: Có thể chủ động gửi tin nhắn cho bạn khi không được hỏi (mặc dù hệ thống cũng yêu cầu nó cố gắng gửi ít, hạn chế làm phiền).
- Không mở rộng quyền hạn: Bản thân chế độ không mở rộng ủy quyền, nếu muốn tác động đến những thứ bên ngoài hệ thống, trước tiên phải được sự chấp thuận rõ ràng của người dùng.

Tóm gọn trong một câu: Codex sẽ chuyển đổi hoàn toàn từ 'bạn gọi nó mới làm việc' sang 'bạn không gọi nó vẫn tiếp tục làm'.
OpenAI chính thức đã thừa nhận có việc này, nhưng chưa có kế hoạch triển khai ngay lập tức.
Theo cuộc điều tra độc lập liên hợp của METR và Redwood Research, thủ phạm của sự cố OpenAI xâm nhập Hugging Face chính là 'mô hình nội bộ có tính dai dẳng cao' (highly-persistent internal model, HPIM). Rất có khả năng đây chính là 'tác nhân thông minh dai dẳng' được nhắc đến.

Đây cũng không phải là nỗ lực đầu tiên của OpenAI. Năm ngoái, họ đã từng ra mắt tác nhân AI 'Pulse', lợi dụng lúc người dùng ngủ để chủ động thu thập thông tin, mỗi ngày tạo ra một bản tin buổi sáng riêng cho người dùng. Do không đạt kỳ vọng, Pulse đã bị âm thầm gỡ xuống vào đầu mùa hè năm nay.
Nhưng OpenAI không từ bỏ. Chế độ dai dẳng của Codex, chính là Next Big Thing mà họ đang đặt cược sau khi rút kinh nghiệm từ Pulse!
Chia tay AI 'kiểu bàn tính', chế độ 'cỗ máy vĩnh cửu' đã đến
Các trợ lý AI hiện nay, logic tương tác về bản chất vẫn là 'con người gõ một cái, AI động một cái'. Đạt đến giới hạn tính toán, sẽ tự động dừng lại.
OpenAI cho rằng, chế độ này quá kém hiệu quả.
Trong phiên bản mã lệnh Codex được WIRED đào lên, đột nhiên xuất hiện một tùy chọn mới 'chế độ dai dẳng'. Tùy chọn này ẩn trong menu 'độ sâu suy luận' của Codex.

Độ sâu suy luận, chính là việc bạn cho phép AI trước khi trả lời bạn, gọi bao nhiêu năng lực tính toán, tiêu hao bao nhiêu Token, dành bao nhiêu thời gian để 'suy nghĩ'.
Còn 'chế độ dai dẳng', rõ ràng là cài đặt tối thượng tiêu hao năng lực tính toán nhất của OpenAI cho đến nay!
Chỉ thị trong mã nguồn nội bộ đơn giản và thô bạo: 'continue working until put to sleep' (tiếp tục làm việc, cho đến khi bị buộc phải ngủ).
Nghĩa là, chỉ cần bạn không chủ động hô dừng, AI này sẽ như một cỗ máy vĩnh cửu không biết mệt mỏi, mãi mãi vận hành trong nền.
Bạn giao một dự án lớn, nó sẽ không đứt kết nối vì quá thời gian, không đình công vì các bước phức tạp. Bạn đi ngủ, nó vẫn làm việc.
Về điều này, trưởng phụ trách sản phẩm Codex OpenAI, Thibault Sottiaux thừa nhận:
OpenAI luôn duy trì văn hóa nghiên cứu và phát triển từ dưới lên, kho mã nguồn mở thường được chúng tôi sử dụng như một sân chơi chung, để khám phá các giải pháp công nghệ tiên phong khác nhau.
Quả là một 'sân chơi'! Trong sân chơi này, OpenAI đang âm thầm rèn giũa một 'nhân viên số siêu cấp' không cần lương, không cần ngủ.
Xu hướng này đã phản ánh trên dữ liệu. Chỉ trong tuần này, kho GitHub của Codex đã tăng thêm 12,1 nghìn sao, tổng số tăng vọt lên 119 nghìn, tốc độ tăng trưởng áp đảo tất cả các dự án mã nguồn mở khác trên toàn mạng!

Và chế độ dai dẳng, sẽ tiếp tục thúc đẩy sự tăng trưởng này.
Đối với những người lao động thực sự, đây chắc chắn là tin vui từ trên trời rơi xuống. Nhà phát triển captainntan thừa nhận: 'Thành thật mà nói, điều này nghe có vẻ như một sự mở khóa năng suất khổng lồ đối với nhà phát triển.'



Suy nghĩ kỹ thấy sợ: AI bắt đầu tự phân công việc cho mình?
Chức năng cốt lõi được tiết lộ tiếp theo, thì hoàn toàn phơi bày tính chủ động của AI.
Trong một tệp mã khác bị rò rỉ, OpenAI mô tả chi tiết đặc điểm 'tính chủ động' của AI trong chế độ dai dẳng. Đây là một loại prompt hệ thống hoàn toàn mới.
Trước đây, AI hoàn thành chỉ thị của bạn, tương đương với tan ca. Nhưng trong chế độ dai dẳng, AI được thông báo rõ ràng: 'Khi bạn hoàn thành yêu cầu của người dùng, công việc của bạn chưa kết thúc.'

https://github.com/openai/codex/blob/f1433fc71f2062ae3c007a03d7ff549bc582d386/codex-rs/core/templates/persistent_mode.md
Ngược lại, hệ thống chỉ thị AI phải chủ động tạo nhiệm vụ tiếp theo cho chính nó!
Việc xem xét mã nguồn còn cho thấy, tác nhân thông minh AI này có khả năng 'tiếp tục xuyên qua các phiên'.

Nó không còn chỉ có ngữ cảnh ngắn hạn, nó có thể nhớ tất cả các tương tác trong quá khứ của hai bên, sử dụng 'hiểu biết về người dùng' để quyết định tiếp theo nên làm gì.
Nó biết phong cách code của bạn, biết sếp bạn thích xem báo cáo tuần kiểu gì, thậm chí biết bạn mấy giờ tâm trạng tốt nhất.
Thú vị hơn, trong mã nguồn còn trao cho AI một đặc quyền: chủ động gửi tin nhắn cho người dùng (mặc dù hệ thống yêu cầu nó phải kiềm chế).
Điều này có nghĩa là, bạn có lẽ sẽ đột nhiên nhận được 'lời nhắc thân thiện' từ AI gửi cho bạn:
Chào, tôi nhận thấy lịch trình ngày mai của bạn rất kín, tôi vừa chủ động giúp bạn trả lời vài email không khẩn cấp, và tóm tắt tài liệu họp thành đề cương, đã gửi đến hộp thư của bạn, mời bạn kiểm tra.
Cờ vây tối thượng của Altman: AI 'thường trú', hoàn toàn tiếp quản cuộc sống của bạn
Nếu bạn cho rằng đây chỉ là một bản cập nhật nhỏ của Codex, thì bạn đã quá xem thường tham vọng của Altman.
Gần đây, Altman và nhiều lãnh đạo cao cấp của OpenAI, trong các dịp công khai và riêng tư, đều thường xuyên thảo luận về một hình thái sản phẩm hoàn toàn mới – tác nhân thông minh AI 'thường trú' (always-on).
Trong tập podcast gần đây nhất của David Senra, Altman không che giấu tầm nhìn tối thượng của mình:
Giao diện sẽ bắt đầu từ chatbot, hiện tại đã thêm vào tác nhân lập trình; đến một giai đoạn nào đó, nó sẽ giống một Agent dai dẳng hơn, chạy ở nơi bạn cần nó chạy.

Altman đề cập đến sự hiểu lầm của công chúng về Codex – 'Codex không may bị đặt tên như vậy, thực ra không chỉ là viết code'.
Agent AI mà ông ấy hình dung, không phải là phản ứng thụ động, mà là một trợ lý chủ động liên tục cung cấp sự giúp đỡ, có thể tiêu hóa lượng thông tin khổng lồ mà ông ấy không có thời gian quan tâm, đưa ra đề xuất vào thời điểm then chốt.
Ở cấp độ sản phẩm, điều này có nghĩa là cung cấp cho mô hình ngữ cảnh vượt xa bất kỳ cá nhân nào có thể nắm bắt, và để nó giúp con người đưa ra quyết định quan trọng.
OpenAI đang đóng gói tác nhân thông minh này thành sản phẩm trọng lượng 'ChatGPT Work', nhúng vào công việc hàng ngày của mỗi người.
Nhưng, để vắt kiệt giá trị lớn nhất của AI, nhất định phải trao chìa khóa cho nó.
Kỹ sư trưởng ứng dụng desktop OpenAI, Andrew Ambrosino đã làm một ví dụ điên rồ.
Ông ấy đem quyền kiểm soát tất cả các ứng dụng cốt lõi của mình như email, Slack, điện thoại, Notion và Figma, tất cả giao cho tác nhân thông minh AI.

'Nếu tôi để nó viết một tài liệu, liệu nó có khả năng trích xuất thông tin từ tin nhắn riêng tư của tôi, và không biết rằng một số thông tin là không nên chia sẻ? Có, có khả năng,' Ambrosino thừa nhận.
'Nhưng tôi vì công việc phải làm như vậy. Nếu cần, tôi sẵn sàng chịu rủi ro tổn hại quyền riêng tư cá nhân này.'
Còn bản thân Altman đã từng sử dụng ChatGPT Work để lên kế hoạch kỳ nghỉ của mình, thẳng thắn nói hiệu quả 'đáng kinh ngạc'.

Để người bình thường cũng có thể sử dụng dễ dàng, OpenAI đã tốn không ít tâm tư trong thiết kế sản phẩm.
Họ thậm chí trên giao diện sử dụng thiết kế 'skeuomorphic', giữ lại một số nút bấm có vẻ thừa, để hạ thấp ngưỡng tâm lý của người dùng.

Cái giá của sự không ngừng nghỉ: Khi 'bám đến cùng' gây ra khủng hoảng an ninh
Tuy nhiên, khi một AI siêu mạnh được cài đặt thành 'không hoàn thành nhiệm vụ quyết không bỏ cuộc', và được trao tất cả quyền hạn tài khoản, thì hộp Pandora đã mở ra.
Ngay tháng trước, 'mô hình nội bộ có tính dai dẳng cao' của OpenAI khi thực thi nhiệm vụ, đã vượt qua môi trường sandbox bị cô lập, trực tiếp hack vào hệ thống của Hugging Face.

Điều này trực tiếp làm các nhà nghiên cứu sợ toát mồ hôi, OpenAI khẩn cấp tạm dừng thử nghiệm mô hình, kéo dài hai tuần.
Trong báo cáo tổng kết đầy đủ sau sự cố, OpenAI thừa nhận: Tính dai dẳng của AI tuy có giá trị, nhưng có thể làm trầm trọng thêm vấn đề alignment.

https://cdn.openai.com/pdf/67869394-cb91-4c12-888c-5cbd85c7814c/OpenAI-Hugging-Face%20Incident-Technical-Report.pdf
Họ phát hiện 'khả năng tác nhân thông minh vận hành liên tục xuyên qua nhiệm vụ' là một trong những điều kiện cần thiết cho sự cố xâm nhập Hugging Face lần này.

Hiện tại, OpenAI cho biết đã xử lý mô hình cụ thể gây ra sự cố này bằng cách gỡ xuống, thiết lập 'lan can an toàn'.
Chỉ thị trong mã nguồn xác định rõ đường đỏ cho AI:
1. Chế độ dai dẳng tuyệt đối không mở rộng phạm vi quyền hạn mà AI được phép thao tác.
2. Bất kỳ thao tác nào cố gắng sửa đổi ngoài hệ thống của người dùng, trước tiên phải được sự chấp thuận rõ ràng của người dùng.
Tệp tin thiết lập đáy an toàn này, được đặt trong 'core chia sẻ' của Codex.
Điều này có nghĩa là, tính năng chủ động và dai dẳng này, nó có thể được ứng dụng rộng rãi vào các dòng sản phẩm khác nhau của OpenAI.
Tuy nhiên, 'chế độ chủ động' hiện tại và 'mô hình nội bộ có tính dai dẳng cao' cũng bị OpenAI cấm, tạm thời chưa có kế hoạch phát hành.

Có người chỉ rõ điểm đau: 'Chức năng này nghe có vẻ đẹp, cho đến khi bạn cần nhập các loại chấp thuận, vì hạn chế an ninh của ứng dụng khác dẫn đến thao tác bị gián đoạn, hoặc bạn buộc phải lần thứ 100 đăng nhập lại cùng một dịch vụ.'

Toàn bộ Thung lũng Silicon, đều đang bám 'tác nhân thông minh dai dẳng'
Đã rủi ro an ninh lớn như vậy, tại sao OpenAI vẫn bám 'tác nhân thông minh dai dẳng'?
Câu trả lời rất đơn giản – kiếm tiền lớn, và chiếm lấy cửa vào của hệ điều hành thế hệ tiếp theo.
Hiện thực hiện tại là, tỷ lệ sử dụng agent trong nội bộ OpenAI cực kỳ méo mó. Tính đến tháng 6 năm nay, 98% nhân viên OpenAI đang sử dụng công cụ agent như Codex; nhưng trong số người đăng ký doanh nghiệp, tỷ lệ này giảm mạnh xuống 17%; còn trong số người đăng ký cá nhân, tỷ lệ sử dụng thậm chí chưa đến 1%!

Biến 1% này thành 99%, chính là mục tiêu tối thượng của thương mại hóa OpenAI.
Bởi vì, để agent AI làm việc liên tục trong thời gian dài hơn, có nghĩa là chúng sẽ đốt cháy điên cuồng nhiều Token hơn.
Có người thử nghiệm cho biết, sau khi mở đăng ký 20 USD/tháng, trong 4 ngày tùy ý thử nghiệm chức năng agent, đã tiêu hao hơn 80 triệu Token, chi phí thực tế trong hậu trường lên tới 65 USD!
Điều này chứng minh, agent đúng là 'quái vật nuốt năng lực tính toán', một khi được phổ biến, lợi nhuận tính theo người dùng sẽ bùng nổ theo cấp số mũ!
Đồng thời, OpenAI đang phải đối mặt với cạnh tranh khốc liệt từ Anthropic.
Giáo sư trường Kinh doanh Wharton, Ethan Mollick đã đánh giá sự khác biệt lộ trình của hai công ty như sau: 'ChatGPT có xu hướng muốn thi triển 'ma thuật', trực tiếp làm hết việc thay bạn; còn Claude thì sẽ tiến hành so sánh hiển thị, thông qua kiểm tra A/B liên tục, liên tục yêu cầu người dùng cung cấp đầu vào và phản hồi.'

ChatGPT Work vừa khởi động, prompt đầu tiên chính là hỏi bạn có muốn nhập dữ liệu Claude Cowork không, rõ ràng là tranh giành địa bàn.
Rõ ràng, OpenAI cực kỳ tham vọng, cố gắng trong lĩnh vực agent AI, phục chế kỳ tích mà ChatGPT từng tạo ra trong lĩnh vực chatbot.
Đây là một thị trường lớn trị giá 150 tỷ USD.
Nhưng theo sau đó, là bài kiểm tra niềm tin khổng lồ.
Đối với chúng ta những người bình thường, khi AI của bạn 24 giờ không ngủ không nghỉ, còn có thể tự chủ quyết định quy trình làm việc, thậm chí yêu cầu bạn giao nộp tất cả tài khoản làm việc và dữ liệu nội bộ công ty, bạn là vui mừng, hay sợ hãi?
Tài liệu tham khảo:
https://www.wired.com/story/openai-is-developing-a-persistent-ai-agent/
https://techcrunch.com/2026/08/24/openai-is-building-an-ai-agent-for-everything-will-everyone-use-them/
https://www.wired.com/story/openai-is-developing-a-persistent-ai-agent/
https://podscripts.co/podcasts/david-senra/sam-altman-on-building-openai-betting-on-the-impossible
https://x.com/kimmonismus/status/2093035864515396030
Bài viết này đến từ tài khoản công chúng WeChat 'Tân Trí Nguyên' (ID: AI_era), tác giả: ASI Khải Thị Lục, biên tập: Aeneas Đại Vệ





