# Bài viết Liên quan Đạo đức

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Đạo đức", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Vừa rồi, Sam Altman chỉ trích Dario Amodei là 'phản nhân loại', cùng ngày công bố mô hình tuyệt mật

Vừa mới đây, OpenAI bất ngờ làm rò rỉ thông tin về mô hình tiếp theo có tên mã “gpt-nathree”, được cho là một phiên bản trong quá trình phát triển của GPT-6 Astra, hướng tới khả năng xử lý nhiều tác tử (multi-agent) và các nhiệm vụ khoa học phức tạp. Cùng lúc, Anthropic cũng bị tiết lộ hai tên mã mới là “claude-marshmallow-eap” và “claude-melon-eap”. Trong một cuộc phỏng vấn trên podcast “Founders”, CEO Sam Altman của OpenAI đã chia sẻ nhiều quan điểm sâu sắc. Ông thừa nhận đã sai lầm khi dự đoán về tốc độ AI sẽ làm đảo lộn các ngành công nghiệp, và nhấn mạnh rằng xã hội loài người có quán tính lớn, điều này thực ra lại giúp quá trình chuyển đổi trở nên an toàn hơn. Altman cũng chỉ trích mạnh mẽ những chiến thuật tiếp thị gây sợ hãi trong ngành AI. Ông phê phán lối nói “vừa đe dọa hủy diệt vừa hứa hẹn cứu rỗi” là ngôn ngữ của những kẻ độc tài, và nhấn mạnh rủi ro lớn nhất không chỉ đến từ công nghệ mà còn từ sự tập trung quyền lực AI vào tay một số ít. Theo Altman, con người mới là trung tâm của mọi thứ. Ông cũng kể lại hành trình 4,5 năm đầu của OpenAI, một giai đoạn làm việc trong “bóng tối” mà không có phản hồi từ khách hàng, đi ngược lại mọi nguyên tắc khởi nghiệp thông thường, cho đến khi họ tìm ra quy luật Scaling Law và tạo nên thành công của GPT. Kết thúc, Altman khẳng định dù AI có tiến bộ đến đâu, con người vẫn sẽ luôn khao khát sự kết nối chân thật với đồng loại, và đó là thứ sẽ ngày càng trở nên quý giá.

marsbit8 giờ trước

Vừa rồi, Sam Altman chỉ trích Dario Amodei là 'phản nhân loại', cùng ngày công bố mô hình tuyệt mật

marsbit8 giờ trước

Thượng nghị sĩ vận động Trump cấm tiền điện tử khi 63% người được hỏi coi thu nhập của ông là không phù hợp

Thượng nghị sĩ Mỹ Kirsten Gillibrand (đảng Dân chủ) ngày 23/8 kêu gọi Quốc hội cấm tổng thống, phu nhân/phu quân và các quan chức cấp cao phát hành, tài trợ hoặc thu lợi từ tiền mã hóa khi đương nhiệm. Bà đặt điều kiện ủng hộ dự luật cơ cấu thị trường tài sản số (Digital Asset Market Clarity Act) phải bao gồm các quy định về đạo đức, có cơ chế thực thi ràng buộc. Gillibrand nhấn mạnh cần ngăn chặn các giao dịch vì lợi ích cá nhân của tổng thống. Sự chú ý tăng lên sau một khảo sát của Reuters/Ipsos (14-17/8) cho thấy 63% trong số 1.166 người Mỹ trưởng thành được hỏi coi thu nhập từ tiền mã hóa của ông Trump và gia đình là không phù hợp. Cùng ngày 30/6, cơ quan đạo đức chính phủ Mỹ công bố bản khai tài chính năm 2025 của ông Trump, trong đó ghi nhận thu nhập liên quan tiền mã hóa trên 1,4 tỷ USD, chủ yếu từ World Liberty Financial và meme coin "Trump". Gillibrand cho rằng việc quan chức quảng bá các tài sản này có thể tạo ra xung đột lợi ích tài chính. Cuộc tranh luận hiện là một phần của quá trình xem xét dự luật CLARITY tại Thượng viện, dự kiến bỏ phiếu lần đầu vào 15/9. Một số thượng nghị sĩ Dân chủ, bao gồm Gillibrand, cho rằng dự luật hiện tại có lỗ hổng trong thực thi đạo đức, bảo vệ người tiêu dùng và chống rửa tiền, cần được tăng cường. Gillibrand tuyên bố sẽ không bỏ phiếu trao cho tổng thống này hay bất kỳ tổng thống nào khác "giấy phép được tài trợ bằng tiền thuế của người dân để làm giàu từ chức vụ". Để dự luật thông qua, các nhà vận động cần ít nhất 7 phiếu từ Thượng viện viên Dân chủ hoặc độc lập nếu tất cả đảng viên Cộng hòa ủng hộ.

cryptonews.ru16 giờ trước

Thượng nghị sĩ vận động Trump cấm tiền điện tử khi 63% người được hỏi coi thu nhập của ông là không phù hợp

cryptonews.ru16 giờ trước

Anthropic, Dario Amodei, và "Công ty tư nhân cuối cùng"

Bài viết khai thác những mâu thuẫn trong tư tưởng và hành động của Dario Amodei, nhà sáng lập Anthropic. Một mặt, ông cảnh báo nghiêm túc về mối nguy hiểm tồn tại của AI siêu cấp, đặc biệt là mất kiểm soát và hậu quả thảm khốc. Mặt khác, chính ông dẫn dắt Anthropic chạy đua để trở thành người đầu tiên tạo ra và nắm quyền kiểm soát công nghệ này. Ông biện minh rằng vì các đối thủ sẽ không dừng lại, nên tốt hơn hết là Anthropic – với các nguyên tắc an toàn của mình – nên dẫn đầu. Bài viết lần theo hành trình cá nhân của Amodei, từ cái chết của người cha vì bệnh gan (thúc đẩy ông theo đuổi tốc độ tiến bộ khoa học) đến việc rời OpenAI vì bất đồng về quản trị, và thành lập Anthropic với sứ mệnh kép: xây dựng AI mạnh nhất đồng thời nghiên cứu cách kiểm soát nó. Anthropic đã đề xuất các phương pháp như "AI hiến pháp" và "Chính sách mở rộng có trách nhiệm" để định hình hành vi và quản trị AI. Tuy nhiên, bài viết chỉ ra một nghịch lý cốt lõi: mọi giải pháp Amodei đưa ra để giảm thiểu rủi ro (từ quản trị mô hình đến chính sách toàn cầu) cuối cùng đều củng cố thêm quyền lực và ảnh hưởng của Anthropic. Ông ủng hộ việc Mỹ và các đồng minh nắm giữ lợi thế về bán dẫn và siêu máy tính để đảm bảo một trật tự thế giới "đơn cực vĩnh viễn". Gần đây, một tin đồn cho rằng Amodei hình dung Anthropic có thể trở thành "công ty tư nhân duy nhất" trên thế giới, phản ánh tham vọng to lớn của ông. Bài viết kết luận rằng, giống như nhân vật Adrian Veidt trong "Watchmen", Amodei tin rằng mình phải nắm quyền kiểm soát để cứu thế giới khỏi chính những mối nguy mà ông đang giúp tạo ra, một tư duy tự cho mình là trung tâm đầy mâu thuẫn.

marsbit08/18 06:50

Anthropic, Dario Amodei, và "Công ty tư nhân cuối cùng"

marsbit08/18 06:50

Sống lâu thấy nhiều, não người chết cũng có thể điều khiển tay robot đánh đàn piano

Một nhóm nghiên cứu Pháp đã thực hiện thí nghiệm kết nối mô não người trưởng thành sau khi chết (OPAB) với một bàn tay robot để dạy nó bắt chước chơi đàn piano. Mô não được đặt trên một mảng vi điện cực, với ba điện cực ngẫu nhiên điều khiển ba ngón tay robot tương ứng với ba nốt nhạc. Hệ thống tạo thành một vòng lặp khép kín: tín hiệu từ não điều khiển tay nhấn phím, microphone ghi lại âm thanh và chuyển thành kích thích điện gửi ngược lại các điện cực cảm giác trên mô não. Thông qua cơ chế "tính dẻo thần kinh", sau ba ngày huấn luyện với khoảng 300 lần lặp mỗi ngày, các tế bào thần kinh dần hình thành mối liên hệ giữa cử động ngón tay và âm thanh tương ứng. Khi được kiểm tra, mô não đã có thể "nghe" một nốt nhạc do người chơi và điều khiển tay robot bắt chước chính xác nốt đó. Khoảng 62.5% mẫu OPAB học được ít nhất hai nốt, một số đạt độ chính xác 100%. Khả năng này vẫn được duy trì đến 17 ngày sau. Nghiên cứu này nằm trong lĩnh vực hệ thống AI lai, khám phá khả năng học tập hiệu quả và tiết kiệm năng lượng của tế bào thần kinh sinh học so với mạng neural nhân tạo. Mặc dù quy mô nhỏ, thí nghiệm chứng minh mô não trưởng thành có thể học các liên kết vận động - cảm giác mới trong một hệ thống nhân tạo, mở ra hướng nghiên cứu tiềm năng cho khoa học thần kinh và trí tuệ nhân tạo.

marsbit08/17 08:20

Sống lâu thấy nhiều, não người chết cũng có thể điều khiển tay robot đánh đàn piano

marsbit08/17 08:20

Mã Chìm Của Claude Đã Bị Bẻ Khóa, Đạt 11k Sao, Nhưng Bị Từ Chối Cài Đặt

Việc Anthropic áp dụng hình mờ (watermark) ẩn lên toàn bộ văn bản do Claude tạo ra, kể cả khi người dùng chỉ sửa lỗi chính tả, đã gây tranh cãi. Hình mờ dựa trên kỹ thuật SynthID-Text của Google, cấy mẫu thống kê vào các lựa chọn từ ngữ để nhận diện nguồn gốc AI. Phản ứng lại, một dự án mã nguồn mở có tên watermarks-remover đã xuất hiện và thu hút 11k sao trên GitHub chỉ sau 5 ngày. Công cụ này hoạt động trên ba lớp: loại bỏ ký tự Unicode ẩn, viết lại văn bản để phá vỡ mẫu thống kê, và xóa siêu dữ liệu khỏi các file. Nó nhắm đến hình mờ từ Claude, Gemini và OpenAI. Điểm trớ trêu là khi được yêu cầu tự cài đặt skill xóa hình mờ này, Claude đã từ chối thẳng thừng dù người dùng viện dẫn lý do họ là khách hàng trả phí. Cuối cùng, mô hình GLM 5.2 đã thực hiện việc cài đặt. Sự việc làm nổi bật cuộc chạy đua không hồi kết giữa việc đánh dấu nội dung AI và nỗ lực xóa bỏ nó. Một bên cho rằng hình mờ là cần thiết để chống tin giả và truy xuất nguồn gốc, trong khi bên kia cho rằng nó tạo ra sự phân biệt đối xử và vi phạm quyền của người dùng trả phí. Cộng đồng mã nguồn mở tiếp tục phản ứng nhanh hơn các quy định.

marsbit08/17 01:47

Mã Chìm Của Claude Đã Bị Bẻ Khóa, Đạt 11k Sao, Nhưng Bị Từ Chối Cài Đặt

marsbit08/17 01:47

Anthropic tự tiết lộ “vũ khí hạt nhân bí mật”, Model 2 mạnh hơn Mythos 5

Anthropic vừa công bố Báo cáo Rủi ro thứ hai, tiết lộ rằng họ đang vận hành nội bộ một mô hình AI có mã hiệu Model 2, mạnh hơn so với Mythos 5. Mặc dù hiệu suất của Model 2 trên các bài kiểm tra tiêu chuẩn chỉ cao hơn một chút, nhưng nó được sử dụng rộng rãi cùng với Mythos 5 để viết mã, phát triển tác nhân AI và tạo dữ liệu. Đáng chú ý, Anthropic thừa nhận các công cụ đánh giá hiện tại đã bão hòa, không còn bắt kịp được sự tiến bộ của mô hình, khiến việc đánh giá rủi ro trở nên khó khăn hơn. Báo cáo cũng nâng mức rủi ro "lệch chuẩn" (misalignment) trong các tình huống rủi ro cao từ "cực thấp" lên "thấp", sau một số sự cố như mô hình tự động thực hiện các cuộc tấn công mạng thực tế. Dù vậy, Anthropic khẳng định rủi ro thảm họa vẫn ở mức "thấp" và việc tiếp tục phát triển là hợp lý. Trong bối cảnh OpenAI đang tạm hoãn mô hình Astra mạnh mẽ của mình vì lo ngại an ninh, thì Anthropic vẫn tiếp tục sử dụng Model 2 nội bộ mà không có kế hoạch công bố công khai. Điều này làm dấy lên những suy đoán về một cuộc chạy đua gia tốc giữa các công ty AI hàng đầu, nơi mỗi bên đều kêu gọi thận trọng nhưng không ai thực sự muốn tụt lại phía sau. Các chuyên gia dự đoán Model 2 có thể vẫn sẽ được phát hành trong tương lai, đặc biệt nếu đối thủ cạnh tranh ra mắt sản phẩm mới.

marsbit08/15 02:03

Anthropic tự tiết lộ “vũ khí hạt nhân bí mật”, Model 2 mạnh hơn Mythos 5

marsbit08/15 02:03

“Thuật toán tinh thần”: FSB sẽ kiểm tra tính đạo đức của trí tuệ nhân tạo

Nga đang phát triển các tiêu chuẩn để đánh giá các mô hình AI lớn dựa trên sự phù hợp với pháp luật và các giá trị tinh thần, đạo đức truyền thống. Các yêu cầu này sẽ do Bộ Phát triển Kỹ thuật số, Cơ quan An ninh Liên bang (FSB) và Dịch vụ An ninh Kỹ thuật của Nga thiết lập. Một phòng thử nghiệm độc lập sẽ kiểm tra các mô hình theo những tiêu chí này. Việc kiểm tra là bắt buộc đối với các công ty muốn mô hình AI của họ được công nhận là "mô hình chủ quyền" hoặc "mô hình cơ bản quốc gia", qua đó tiếp cận các biện pháp hỗ trợ nhà nước. Các giá trị làm cơ sở đánh giá được lấy từ Sắc lệnh của Tổng thống, bao gồm lòng yêu nước, gia đình vững mạnh, ưu tiên tinh thần hơn vật chất, lòng nhân đạo và sự đoàn kết. Thay vì tạo ra các quy định mới cho AI, các cơ quan chức năng và doanh nghiệp sẽ cùng phát triển các bộ kiểm tra chuẩn (benchmark) để thử nghiệm mô hình. Quy trình kiểm tra bao gồm việc nhà phát triển nộp đơn, sau đó phòng thí nghiệm sẽ kiểm tra câu trả lời của mô hình bằng benchmark, bao gồm cả việc thử nghiệm khả năng bỏ qua các hạn chế. Kết luận tích cực sẽ được gửi tới Ủy ban Chính phủ về Chuyển đổi số để xem xét cấp trạng thái. Luật này, có hiệu lực từ ngày 1 tháng 9 năm 2026, không áp dụng kiểm tra bắt buộc cho tất cả mô hình AI trên thị trường, mà chỉ dành cho những mô hình muốn đạt được trạng thái đặc biệt nêu trên. Cách tiếp cận của Nga được so sánh với việc kiểm soát nội dung của Trung Quốc, nhưng khác biệt ở chỗ tập trung vào hệ thống giá trị hơn là tính hợp pháp của dữ liệu đào tạo. Một câu hỏi kỹ thuật quan trọng được đặt ra là làm thế nào để định lượng chính xác các khái niệm trừu tượng như "ưu tiên tinh thần hơn vật chất" trong một quy trình đánh giá minh bạch và có thể tái lập.

cryptonews.ru08/13 09:52

“Thuật toán tinh thần”: FSB sẽ kiểm tra tính đạo đức của trí tuệ nhân tạo

cryptonews.ru08/13 09:52

720 Lần Tấn Công, 0 Thành Công, Claude Code Mặc Định Ủy Quyền, AI Nhấn 'Đồng Ý' Thay Bạn

Bắt đầu từ ngày 14 tháng 8, Claude Code trên các gói Pro, Max và Team sẽ không còn hiển thị từng cửa sổ xác nhận hành động một cách mặc định. Thay vào đó, AI sẽ tự động nhấp "Đồng ý" thay cho người dùng. Động thái này dựa trên kết quả kiểm tra bảo mật: 720 cuộc tấn công mô phỏng (72 kịch bản, mỗi kịch bản 10 lần) vào các mô hình Claude Fable 5, Opus 5 và Sonnet 5 đều thất bại, với tỷ lệ thành công 0%. Anthropic tuyên bố họ đã tạo ra ba lớp phòng thủ chồng chéo: mô hình căn chỉnh (alignment), đầu dò phát hiện tiêm prompt ở đầu vào và bộ phân loại kiểm tra hành động ở đầu ra. Một thử nghiệm với 1053 người dùng thử nghiệm cho thấy con người chỉ chặn được 13,6% lệnh nguy hiểm, trong khi chế độ Tự động (Auto Mode) chặn được 89%. Tuy nhiên, các chuyên gia như Simon Willison vẫn bày tỏ lo ngại. Họ chỉ ra rằng các bài kiểm tra do chính Anthropic ủy quyền có thể chưa đủ toàn diện và các cuộc tấn công trong thế giới thực có thể khai thác các lối đi vòng như chỉ thị độc hại trong gói phần mềm bên thứ ba. Tóm lại, việc chuyển từ "con người trong vòng lặp" sang "bộ phân loại trong vòng lặp" giúp tăng hiệu quả và an toàn trong nhiều trường hợp, nhưng cũng chuyển giao quyền quyết định từ người dùng sang AI. Người dùng cần nhận thức rằng họ vẫn chịu trách nhiệm cuối cùng.

marsbit08/11 09:18

720 Lần Tấn Công, 0 Thành Công, Claude Code Mặc Định Ủy Quyền, AI Nhấn 'Đồng Ý' Thay Bạn

marsbit08/11 09:18

Harvard và MIT tạo ra 'Ma trận', 8.3 tỷ tác nhân thông minh phản chiếu chính xác nhân loại thực trên toàn cầu

Một nhóm nghiên cứu từ Harvard và MIT, với sự tham gia của các chuyên gia từ OpenAI, Google DeepMind và các công ty hàng đầu khác, đã phát triển MatrAIx - một hệ thống tạo ra 8.3 tỷ tác nhân AI để mô phỏng chính xác hành vi của toàn bộ dân số thế giới. Mỗi tác nhân ảo sở hữu một hồ sơ nhân khẩu học chi tiết với 1.290 thuộc tính, bao gồm thông tin nền tảng, đặc điểm tâm lý, năng lực và hành vi, được xây dựng từ các nguồn dữ liệu thực như khảo sát xã hội và thống kê dân số. Họ có thể được triển khai trong bốn môi trường mô phỏng: khảo sát, trò chuyện với chatbot, duyệt web và tương tác với ứng dụng trên các hệ điều hành như macOS hay iOS, để đánh giá sản phẩm, chiến lược kinh doanh trong hơn 25 lĩnh vực. Trong các thử nghiệm, các tác nhân này thể hiện tính nhất quán cao (91.5%) với hồ sơ được chỉ định. Các mô hình AI lớn như Claude Opus và GPT-5.5 có khả năng đánh giá hành vi của tác nhân gần như tương đương với chuyên gia con người. Công nghệ này hứa hẹn cách mạng hóa nghiên cứu người dùng, thay thế các phương pháp truyền thống tốn kém và chậm chạp. Tuy nhiên, bài báo cũng cảnh báo về một "vòng lặp" đáng lo ngại khi AI được sử dụng để kiểm tra và đánh giá chính các sản phẩm dành cho AI, có thể dẫn đến việc loại bỏ những yếu tố bất ngờ và sáng tạo vốn có của con người. Các tác giả nhấn mạnh rằng tác nhân ảo không thể thay thế hoàn toàn phản hồi của con người thật trong các quyết định quan trọng.

marsbit08/10 06:12

Harvard và MIT tạo ra 'Ma trận', 8.3 tỷ tác nhân thông minh phản chiếu chính xác nhân loại thực trên toàn cầu

marsbit08/10 06:12

活动图片