Hôm nay, một bài đăng X từ hai ngày trước bắt đầu lan truyền, nội dung chỉ có 5 từ: Scott Gray đã rời OpenAI.

Nhà kỹ sư nổi tiếng với biệt danh 'Vị thần hạ tầng CUDA, lập trình viên GPU mạnh nhất thế giới' này đã trở thành một trong những nhân tài trọng yếu tiếp theo mà OpenAI mất đi trong năm nay. Bản thân anh tuy chưa xác nhận qua X, trang LinkedIn cũng chưa cập nhật, nhưng phần tiểu sử cá nhân trên X và Bluesky của anh đều đã được sửa từ 'GPU Geek tại @OpenAI' thành 'Former GPU geek tại @OpenAI', và phía trước còn được thêm dòng chữ 'Hiện độc lập, đang khám phá một số phương pháp AI lấy cảm hứng từ khoa học thần kinh.'


Một kỹ sư làm việc tại OpenAI suốt mười năm, chỉ bằng một dòng tiểu sử đã tuyên bố sự ra đi của mình.

Thật trùng hợp. Đúng vào ngày 16 tháng 8, mười năm trước, OpenAI đã xuất bản một bài blog có tiêu đề 'Team update' (Cập nhật nhóm), giới thiệu năm thành viên toàn thời gian gia nhập trong tháng đó. Danh sách bao gồm Dario Amodei, Filip Wolski, Jack Clark, Scott Gray và Zain Shah.

https://openai.com/index/team-update-august/
Mười năm sau ngày hôm nay, Dario là CEO của Anthropic, Jack Clark phụ trách chính sách tại Anthropic, còn Scott Gray đã đánh dấu OpenAI là 'former' (cựu).
Cho đến thời điểm hiện tại, OpenAI chưa đưa ra bất kỳ tuyên bố nào về việc Scott Gray rời đi, bản thân Gray cũng chưa đăng bài giải thích cụ thể. Nguồn tin chung cho tất cả các bài báo cho đến nay đều là sự thay đổi tiểu sử trên tài khoản mạng xã hội của anh, và sau đó là một bài đăng X tố giác lan truyền. Ngày rời đi cụ thể, nơi đến, liệu đã có công ty mới hay chưa, đều chưa có thông tin công khai.
Một chi tiết đáng chú ý khác trên tài khoản của anh. Bài đăng X gốc cuối cùng của Gray dừng lại vào ngày 20 tháng 11 năm 2023, nội dung là một câu: 'OpenAI is nothing without its people.' (OpenAI chẳng là gì nếu không có con người của nó). Đó là ngày thứ ba sau khi Sam Altman bị hội đồng quản trị sa thải, hơn bảy trăm nhân viên đã ký tên yêu cầu hội đồng quản trị từ chức, câu này đã được sao chép dán đi dán lại nhiều lần trong nội bộ OpenAI thời điểm đó, được coi như một hành động bày tỏ lòng trung thành tập thể. Sau đó, anh ấy có trả lời một số bài đăng (các phản hồi cũng đã dừng sau tháng 2 năm 2025), nhưng chưa bao giờ cập nhật bài đăng gốc nào nữa.

Tiểu sử Scott Gray
Chúng tôi trước đây có một bài viết chuyên về việc giới thiệu Scott Gray, tham khảo 'Vị thần hạ tầng CUDA, lập trình viên GPU mạnh nhất thế giới? Vị đại thần hậu trường của OpenAI là ai'. Ở đây sẽ tóm tắt lại một chút.

Danh tiếng của anh bắt đầu từ thời kỳ Nervana Systems. Thời đó, đại đa số nhà phát triển phụ thuộc vào CUDA C/C++ của NVIDIA và các thư viện chính thức như cuBLAS, cuDNN. Nhiều lớp trừu tượng phần mềm che giấu chi tiết phần cứng, đồng thời cũng tạo ra giới hạn hiệu năng. Gray phán đoán rằng phải vượt qua các lớp trừu tượng này, vì vậy anh đã viết maxas, một trình hợp dịch (assembler) dành riêng cho kiến trúc Maxwell, cho phép nhà phát triển viết trực tiếp mã máy SASS, phân bổ thanh ghi thủ công, quản lý độ trễ bộ nhớ, kiểm soát đường ống lệnh.
Để chứng minh con đường này là khả thi, anh đã dùng maxas viết tay một hạ tầng SGEMM. Trên GPU GM204, hạ tầng này đạt 98% hiệu năng lý thuyết tối đa của phần cứng, và nhanh hơn 4.8% so với cuBLAS chính thức của NVIDIA - cũng là sản phẩm viết tay bởi các chuyên gia và là mã nguồn đóng. Sau đó, maxDNN đã mở rộng cùng một phương pháp luận sang tích chập: đạt hiệu suất tính toán ổn định 93% đến 95% trên tất cả các lớp tích chập của AlexNet, trong khi hiệu suất của cuDNN cùng thời dao động mạnh từ 32% đến 57%.
Đây là nền tảng phương pháp luận cho tất cả các công việc sau này của anh: không chấp nhận giới hạn hiệu năng được định sẵn bởi các lớp trừu tượng.
Trong bài cập nhật nhóm của OpenAI vào tháng 8 năm 2016 đó, phần giới thiệu chính thức về anh chỉ có hai câu đánh giá kỹ thuật, đại ý là trước đây anh tập trung vào việc tối ưu hiệu suất của mạng sâu trên GPU tại Nervana, và các tối ưu hóa cấp hợp dịch (assembly-level) của anh về đại số tuyến tính dày đặc và tích chập 'đến nay vẫn là nhanh nhất'. Đoạn này cũng đề cập rằng, khi không viết code, anh thường đọc các nghiên cứu mới nhất về khoa học thần kinh và các lĩnh vực liên quan.
Có vẻ như, mười năm sau, hướng đi mới 'các phương pháp AI lấy cảm hứng từ khoa học thần kinh' của anh, thực chất là quay trở lại với sở thích chưa từng thay đổi đó.
Sau khi gia nhập OpenAI, vai trò của anh chuyển từ 'người tối ưu hóa' thành 'người tạo khả năng'. Năm 2017, anh cùng với Alec Radford và Durk Kingma đã công bố hạ tầng GPU khối thưa (block sparse GPU kernel). Khác với việc loại bỏ các trọng số riêng lẻ trong tính thưa không cấu trúc, tính thưa khối chia ma trận trọng số thành các khối có kích thước cố định và đặt toàn bộ khối về 0, hạ tầng chuyên dụng khi tính toán sẽ hoàn toàn bỏ qua các khối giá trị 0, tốc độ có thể nhanh hơn vài bậc độ lớn so với cuBLAS xử lý ma trận dày đặc hoặc cuSPARSE xử lý ma trận thưa chung. Bộ hạ tầng này đã được mã nguồn mở vào thời điểm đó, trực tiếp thúc đẩy hàng loạt công trình về cơ chế chú ý thưa sau này.

Sơ đồ minh họa hạ tầng khối thưa của OpenAI, https://cdn.openai.com/blocksparse/blocksparsepaper.pdf
Theo dòng này tiếp tục, nghiên cứu 'Generating Long Sequences with Sparse Transformers' năm 2019 của Rewon Child, Scott Gray, Alec Radford và Ilya Sutskever - đã giảm chi phí thời gian và bộ nhớ cho cơ chế chú ý từ O(n²) xuống O(n√n), bài báo đã liệt kê rõ ràng 'hạ tầng huấn luyện cơ chế chú ý nhanh' là một trong ba đóng góp.

Về sau, tên anh xuất hiện trong danh sách tác giả của GPT-3, danh sách tác giả của 'Scaling Laws for Neural Language Models', danh sách tác giả của DALL·E và trong báo cáo kỹ thuật của OpenAI Five.
Trong khoảng thời gian này, anh cũng thu về danh hiệu 'Vị thần hạ tầng CUDA'. Đó là vào tháng 9 năm 2025, cựu nhân viên OpenAI Rohan Pandey đã đăng bài trên X rằng, trong công ty chỉ có khoảng một người phụ trách hạ tầng CUDA phía suy luận (inference), đồng nghiệp gọi hạ tầng cơ chế chú ý do anh viết là 'the Bob kernel', hạ tầng này mỗi ngày thực thi hàng nghìn tỷ lần trên hàng trăm nghìn GPU. Sau khi bài đăng nổi tiếng, phần bình luận phổ biến đoán 'Bob' chính là Scott Gray.

Bài đăng liên quan còn đề cập: Trên toàn thế giới, số người có thể viết được hạ tầng CUDA hiệu năng cao cho quá trình huấn luyện (đặc biệt là lan truyền ngược), có lẽ chưa đến một trăm. Bởi vì kỹ năng này đòi hỏi đồng thời tinh thông lý thuyết tính toán song song, kiến trúc phần cứng GPU và thuật toán học sâu, trong khi đa số người thực hành chỉ dừng lại ở tầng ứng dụng hoặc tầng tối ưu suy luận.
Và bây giờ, Scott Gray đã ra đi.
Năm 2026, OpenAI đã mất đi không ít người
OpenAI năm nay đã mất đi không ít nhân tài. Theo thống kê của blogger X Chubby, OpenAI tính đến nay đã có 12 leader cấp cao rời đi, bao phủ các lĩnh vực vận hành, kinh doanh, sản phẩm, nghiên cứu, an toàn, đạo đức và phần cứng.

Những ngày trước, Brad Lightcap, người làm việc tại OpenAI tám năm, từng là CFO và COO, đã thông báo trên X về việc rời đi, nói rằng muốn 'start something new' (bắt đầu một điều gì đó mới); hai ngày sau, Giám đốc Doanh thu (Chief Revenue Officer) Denise Dresser mới nhậm chức từ tháng 12 năm ngoái cũng tuyên bố rời đi, vị trí này sẽ do cựu Chủ tịch kiêm COO của Wiz, Dali Rajic, tiếp quản.

Trên tuyến kinh doanh và sản phẩm, CEO bộ phận ứng dụng Fidji Simo vào tháng 4 đã nghỉ phép vì lý do sức khỏe, đến tháng 7 thì từ chức toàn thời gian, chuyển sang làm cố vấn bán thời gian; CMO cũ Kate Rouch vào tháng 4 đã từ chức vì nhu cầu điều trị; CTO bộ phận doanh nghiệp Srinivas Narayanan cũng tuyên bố rời đi vào tháng 4. Về phía nghiên cứu và sản phẩm, người dẫn dắt OpenAI for Science Kevin Weil và trưởng bộ phận Sora Bill Peebles cùng tuyên bố rời đi vào một ngày tháng 4, Weil hiện đang làm một công ty khởi nghiệp AI về khoa học; Barret Zoph tháng 1 năm nay từ Thinking Machines Lab quay trở lại OpenAI dẫn dắt bán hàng AI cấp doanh nghiệp, đến tháng 6 lại một lần nữa rời đi, công ty không giải thích lý do.

Ba người trên tuyến an toàn và đạo đức tập trung vào tháng 7: Trưởng bộ phận Hệ thống An toàn Johannes Heidecke rời đi trong quá trình tái cấu trúc nhóm an toàn, trách nhiệm được sáp nhập vào bộ phận nghiên cứu do Mia Glaese lãnh đạo; Nhà tương lai học trưởng (Chief Futurist) Joshua Achiam sau gần chín năm đã rời đi, nhóm sứ mệnh căn chỉnh (mission alignment) do anh lãnh đạo trước đây đã bị giải tán vào tháng 2 năm nay; Trưởng bộ phận Đạo đức Chloé Bakalar gia nhập chưa đầy một năm đã rời đi. Sớm hơn, vào tháng 3, Trưởng bộ phận Robot và Phần cứng Tiêu dùng Caitlin Kalinowski đã từ chức vì không đồng tình với việc hợp tác giữa công ty và Lầu Năm Góc, cô ấy trên LinkedIn cho biết vấn đề liên quan nên được xem xét kỹ lưỡng hơn, sau đó lại bổ sung rằng sự bất đồng của cô chủ yếu hướng vào quy trình quản trị.
Danh sách này còn bỏ sót một người: vào tháng 1 năm nay, Phó Chủ tịch Nghiên cứu phụ trách mô hình suy luận Jerry Tworek sau gần bảy năm đã rời đi để khởi nghiệp, lý do là muốn làm một số hướng nghiên cứu 'khó thực hiện bên trong OpenAI'.

Lời kết
Sự ra đi của Scott Gray, có lẽ sẽ không ngay lập tức thay đổi nhịp độ phát hành mô hình của OpenAI. Hệ thống kỹ thuật tích lũy trong mười năm sẽ không ngừng hoạt động chỉ vì một người ra đi. Nhưng đối với một công ty ngày càng phụ thuộc vào quy mô, hiệu quả và kiểm soát chi phí, việc mất đi một kỹ sư như vậy - người có thể đẩy hiệu năng phần cứng đến giới hạn và lại tham gia sâu vào nhiều thế hệ mô hình cốt lõi - vẫn không phải là một thay đổi có thể xem nhẹ.
Thời điểm của lần rời đi này cũng đáng chú ý: OpenAI đang chuẩn bị lên sàn, trở thành một doanh nghiệp khổng lồ theo đuổi doanh thu và tham gia cuộc đua cơ sở hạ tầng toàn cầu. Bây giờ, những người đầu tiên định hình nó, cũng đang đánh giá lại những gì họ muốn làm tiếp theo.
Lựa chọn của Scott Gray không phải là gia nhập một phòng thí nghiệm tiên phong khác hay tuyên bố khởi nghiệp, mà chỉ là nói trong tiểu sử cá nhân rằng anh đang độc lập khám phá 'các phương pháp AI lấy cảm hứng từ khoa học thần kinh'. Từ một kỹ sư năm 2016 trong phần giới thiệu chính thức mà thời gian rảnh rỗi đọc các bài báo khoa học thần kinh, đến mười năm sau viết lại khoa học thần kinh vào tiểu sử cá nhân, điều này giống như một lần quay về sau một hành trình vòng vo khá lâu: Sau khi vắt kiệt đến tận cùng mô hình tính toán hiện có, anh bắt đầu tìm kiếm một khả năng khác.
Năm 2023, Gray viết 'OpenAI is nothing without its people'. Nhìn lại hôm nay, câu nói này vừa là thái độ đối với cuộc khủng hoảng công ty thời điểm đó, cũng giống như một lời chú thích muộn màng. OpenAI sẽ không mất đi tất cả vì sự ra đi của một cá nhân nào đó, nhưng phương hướng của một công ty, rốt cuộc vẫn được định hình bởi những người ở lại, những người ra đi, và những vấn đề mà mỗi người họ lựa chọn để khám phá.
Bài viết này đến từ tài khoản công chúng WeChat '机器之心' (ID:almosthuman2014), tác giả: 关注AI的





