# Bài viết Liên quan tự cải thiện

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "tự cải thiện", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Blog mới của Ông Lệ đề xuất "Tiến hóa tự động bắt đầu từ Harness", Thôi Thiên Ý từ DeepSeek chuyển tiếp đồng tình

Cựu Phó chủ tịch phụ trách an ninh tại OpenAI, Weng Li, mới đây đã xuất bản một bài blog với tiêu đề "Harness Engineering for Self-Improvement", thảo luận về con đường thực tế để AI tự phát triển (Recursive Self-Improvement - RSI). Cô đề xuất rằng sự tiến hóa tự động gần đây có thể bắt đầu từ **Harness** - hệ thống thời gian chạy bên ngoài quyết định cách mô hình gọi công cụ, quản lý ngữ cảnh, đọc/ghi tệp, chia nhỏ nhiệm vụ và xác minh kết quả - thay vì trực tiếp sửa đổi trọng số mô hình ngay từ đầu. Bài viết chỉ ra xu hướng tối ưu hóa từng bước: từ **Context Engineering** (như ACE, MCE) để quản lý bộ nhớ, đến **Workflow Design** (như AI Scientist, ADAS) để thiết kế quy trình làm việc, và cuối cùng là **Self-Improving Harness**. Ở cấp độ này, mô hình có thể phân tích điểm yếu của chính harness, đề xuất sửa đổi mã và xác minh chúng thông qua các vòng lặp như Weakness Mining, Harness Proposal và Proposal Validation. Các phương pháp như **Evolutionary Search** và **DGM** (Darwin Gödel Machine) thậm chí cho phép tìm kiếm và tiến hóa harness tự động, mang lại cải thiện hiệu suất đáng kể trên các benchmark như SWE-bench. Nhà nghiên cứu DeepSeek, Cui Tianyi, đồng tình và nhấn mạnh rằng tự phát triển theo hướng harness là một hướng đi đầy hứa hẹn như tự phát triển mô hình. Tuy nhiên, Weng Li cũng chỉ ra những thách thức hiện tại: bộ đánh giá còn yếu và mơ hồ, vấn đề quản lý vòng đời bộ nhớ, kết quả tiêu cực bị bỏ qua, sự thu hẹp đa dạng, reward hacking, và mâu thuẫn giữa thành công ngắn hạn và sức khỏe lâu dài của hệ thống. Cô tin rằng harness và mô hình sẽ củng cố lẫn nhau, và con người vẫn sẽ đóng vai trò giám sát ở cấp độ trừu tượng phù hợp, không bị loại khỏi vòng lặp. Bài blog kết luận rằng harness đang trở thành một biến số quan trọng, vì cùng một mô hình có thể thể hiện khả năng hoàn toàn khác nhau trong các harness khác nhau.

marsbit07/08 10:28

Blog mới của Ông Lệ đề xuất "Tiến hóa tự động bắt đầu từ Harness", Thôi Thiên Ý từ DeepSeek chuyển tiếp đồng tình

marsbit07/08 10:28

AGI không phải là điểm kết thúc, nghiên cứu mới của DeepMind: Hướng tới ASI, tiến bộ AI thực sự mới chỉ bắt đầu

DeepMind mới đây công bố nghiên cứu cho rằng AGI (Trí tuệ nhân tạo phổ quát) không phải là điểm cuối. AI sẽ tiếp tục phát triển vượt qua khả năng của các nhóm chuyên gia con người hàng đầu, hướng tới ASI (Trí tuệ siêu nhân tạo). Báo cáo phân biệt ba khái niệm: AGI (năng lực nhận thức tương đương mức trung bình của con người), ASI (vượt trội con người trong hầu hết lĩnh vực quan tâm), và UAI (giới hạn lý thuyết tối thượng). Nghiên cứu đề xuất bốn con đường tiềm năng để chuyển từ AGI sang ASI: 1. Mở rộng quy mô tính toán, mô hình và dữ liệu. 2. Tiến hóa thuật toán, có thể thay đổi mô hình mới. 3. Tự cải thiện đệ quy, tạo phản hồi tích cực. 4. Điều phối đa tác tử và trí tuệ tập thể. Đồng thời, báo cáo chỉ ra sáu điểm nghẽn chính: giới hạn dữ liệu chất lượng cao, áp lực tài nguyên và kinh tế, hạn chế của mô hình mạng nơ-ron hiện tại, nghiên cứu ngày càng khó khăn, rào cản trừu tượng, cùng các vấn đề quản lý và phản ứng xã hội. Khi AI vượt con người, các phương pháp đánh giá truyền thống sẽ mất ý nghĩa. Cần xây dựng hệ thống đánh giá mới cho thời kỳ hậu AGI. ASI không phải là hệ thống toàn năng, vẫn chịu ràng buộc bởi các quy luật vật lý, độ phức tạp tính toán, dữ liệu, tài nguyên và tốc độ phản hồi thực tế. Tương lai phát triển của AI vẫn chứa nhiều bất định, đòi hỏi một nỗ lực liên ngành quy mô lớn để theo dõi và ứng phó.

marsbit06/16 12:04

AGI không phải là điểm kết thúc, nghiên cứu mới của DeepMind: Hướng tới ASI, tiến bộ AI thực sự mới chỉ bắt đầu

marsbit06/16 12:04

Cảnh báo về AI đệ quy của Anthropic, công ty mới của Tian Yuandong vừa thực hiện 'bước đầu tiên'

Anthropic gần đây đã công bố bài viết "Khi AI tự xây dựng chính mình", cảnh báo về tương lai của việc AI có thể tự cải thiện một cách đệ quy. Trong bối cảnh này, công ty Recursive Superintelligence do Tian Yandong đồng sáng lập đã công bố bước đầu tiên về nghiên cứu AI tự động, mang tên "First Steps Toward Automated AI Research". Hệ thống này nhằm mục đích tự động hóa vòng lặp nghiên cứu AI truyền thống: đề xuất ý tưởng, viết mã, chạy thử nghiệm, phân tích và học hỏi để quyết định bước tiếp theo. Nó được thử nghiệm trên ba lĩnh vực khác nhau và đều đạt kết quả tốt nhất hiện tại (SOTA): 1. **NanoChat Autoresearch:** Huấn luyện mô hình ngôn ngữ nhỏ với ngân sách tính toán cố định, giảm tổn thất kiểm chứng xuống 0.9109 BPB. 2. **NanoGPT Speedrun:** Rút ngắn thời gian huấn luyện mô hình GPT xuống mức kỷ lục 77,5 giây thông qua các kỹ thuật như tính toán chú ý FP8 và tối ưu kernel GPU. 3. **SOL-ExecBench:** Tối ưu hóa kernel GPU, nâng điểm số SOL lên 0,754, thu hẹp 18% khoảng cách với giới hạn lý thuyết phần cứng. Recursive Superintelligence, với đội ngũ toàn sao và số vốn huy động lớn, theo đuổi sứ mệnh xây dựng hệ thống AI có khả năng tự cải thiện đệ quy. Thành công bước đầu này đánh dấu sự xuất hiện của một mô hình phát triển AI mới, nơi AI đóng vai trò chủ thể trong nghiên cứu. Điều này có thể thay đổi tốc độ và chi phí tiến bộ AI, đồng thời làm dấy lên những thảo luận về sự cần thiết phải điều phối và quản trị toàn cầu, như lời cảnh báo từ Anthropic.

marsbit06/12 04:14

Cảnh báo về AI đệ quy của Anthropic, công ty mới của Tian Yuandong vừa thực hiện 'bước đầu tiên'

marsbit06/12 04:14

Anthropic cảnh báo toàn cầu, OpenAI đã vượt qua 'ngưỡng tin cậy': AI tự kích hoạt tăng tốc

Cộng đồng AI đang chấn động bởi cảnh báo từ Anthropic: nghiên cứu AI cần dừng lại! Hãng này lo ngại AI đang tiến gần đến điểm "tự tạo ra chính mình", với quá trình tự cải tiến đệ quy diễn ra nhanh hơn dự kiến. Đồng thời, Yann Dubois của OpenAI chia sẻ một quan điểm then chốt: sự phát triển của AI là liên tục, nhưng người dùng cảm nhận một bước nhảy vọt khi nó vượt qua "ngưỡng độ tin cậy". OpenAI đã đạt được ngưỡng này vào khoảng tháng 12 năm ngoái. Khi AI đủ tin cậy, nó từ một "thực tập sinh" trở thành một "nhân viên" thực thụ và bắt đầu tự gia tốc, đặc biệt trong việc hỗ trợ lập trình, tạo ra một vòng lặp phát triển ngày càng nhanh. Dubois nhấn mạnh việc xây dựng AI giống "nghề thủ công" hơn là khoa học thuần túy, dựa nhiều vào thử nghiệm và trực giác. Ông cũng đưa ra một tuyên bố gây chú ý: nếu đóng băng các mô hình hiện tại và chỉ tập trung vào hệ thống điều phối (Harness) cho các lĩnh vực chuyên sâu, chúng ta có thể đã đạt được cảm giác của AGI (Trí tuệ nhân tạo phổ quát). Rào cản thực sự không nằm ở bộ não mô hình, mà ở "quyền truy cập, kết nối và dữ liệu" – công việc khó khăn của "chặng đường cuối cùng" để đưa AI vào thực tế. Tuy vậy, một thách thức lớn vẫn tồn tại: khả năng học liên tục (continual learning). Hiện tại, AI thường đạt hiệu suất cao ban đầu nhưng sau đó không cải thiện nhiều trong môi trường cụ thể. Giải quyết vấn đề này là chìa khóa quan trọng cho tương lai. Dubois kết luận rằng vẫn có không gian rộng lớn cho các công ty khởi nghiệp trong việc tạo ra các ứng dụng chuyên sâu, tập trung vào tích hợp và giải quyết các vấn đề thực tế.

marsbit06/06 23:27

Anthropic cảnh báo toàn cầu, OpenAI đã vượt qua 'ngưỡng tin cậy': AI tự kích hoạt tăng tốc

marsbit06/06 23:27

Lúc CT (Crypto Twitter) Chìm Trong Tâm Trạng Thấp Thỏm, Nên Làm Gì?

Khi tâm trạng trên Crypto Twitter (CT) chạm đáy trong thị trường giá xuống, thay vì chán nản, đây là thời điểm để hành động và tái đầu tư vào bản thân. Dưới đây là 9 việc nên làm: 1. **Suy ngẫm về cuộc sống:** Tự hỏi bản thân xem bạn có đang thực sự sống theo ý muốn hay chỉ đang phản ứng lại hoàn cảnh. Hãy xác định điều bạn thực sự mong muốn. 2. **Hoàn thành "nhiệm vụ phụ":** Đừng mãi ngồi trước màn hình. Hãy ra ngoài, trải nghiệm và tạo nên những câu chuyện của riêng mình khi còn trẻ. 3. **Kết nối trên Twitter/X:** Dù thuật toán có thay đổi, nền tảng này vẫn là nơi tuyệt vời để kết nối với những người cùng chí hướng. Hãy nhắn tin trực tiếp và tương tác. Giá trị thực sự là tình bạn. 4. **Tập thể dục:** Tận dụng thời gian rảnh để xây dựng cơ bắp. Bạn có thể tập tại nhà với các bài như hít xà, đẩy tạ tay và gập bụng. 5. **Tắm nắng:** Tiếp xúc với ánh nắng mặt trời một cách an toàn để cải thiện sức khỏe và điều chỉnh nhịp sinh học, tránh tác hại của việc chỉ ở trong nhà. 6. **Khám phá các nền tảng mới:** Nếu cảm thấy chán Twitter, hãy thử sức với TikTok, YouTube Shorts hoặc các lĩnh vực kinh tế trực tuyến khác. Cơ hội mới có thể nằm ở đó. 7. **Chuẩn bị cho tương lai:** Tiếp tục tìm hiểu các cơ hội airdrop tiềm năng và tích lũy các altcoin bạn tin tưởng. Lịch sử cho thấy thị trường luôn phục hồi sau giai đoạn ảm đạm. 8. **Viết lách:** Dù ít người đọc, viết là cách kết nối với quá khứ, tương lai và biến nỗi đau thành nghệ thuật. Hãy viết cho chính mình, cho cộng đồng hoặc cho thế hệ sau. 9. **Trở thành hình mẫu bạn mong muốn:** Tương lai được tạo nên bởi hành động hôm nay. Hãy sống và hành động như con người bạn muốn thấy trong thế giới này, góp phần định hình một tương lai tươi sáng hơn. Tóm lại, thay vì tuyệt vọng, hãy coi đây là cơ hội để phát triển bản thân, củng cố mối quan hệ và chuẩn bị kỹ lưỡng cho chu kỳ phát triển tiếp theo.

marsbit05/19 05:52

Lúc CT (Crypto Twitter) Chìm Trong Tâm Trạng Thấp Thỏm, Nên Làm Gì?

marsbit05/19 05:52

活动图片