# Bài viết Liên quan GPT

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "GPT", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Giả thuyết Jacobi khiến Trương Ích Đường vất vả suốt 7 năm, Fable 5 chỉ trong một đêm đã bác bỏ và chứng minh là sai

Ngày hôm đó, toán học chấn động. Một bài toán hóc búa khiến vô số nhà toán học đỉnh cao phải bó tay, khiến thiên tài người Hoa Zhang Yitang vất vả 7 năm, thậm chí phải rửa bát ở Subway - đó là giả thuyết Jacobian - đã bị Fable 5 bác bỏ! Tối qua, nhà nghiên cứu Levent Alpoge từ Anthropic đăng tweet cho biết họ đã tìm thấy một phản ví dụ cho giả thuyết 87 năm tuổi này. Phản ví dụ là một ánh xạ đa thức trong không gian C3 với định thức Jacobian là hằng số khác 0 (-2), nhưng lại không đơn ánh, do đó không thể có ánh xạ ngược. Điều này chứng minh giả thuyết Jacobian tổng quát (cho mọi chiều) là sai. Công thức đơn giản đến mức một sinh viên năm nhất cũng có thể kiểm chứng. Giới toán học ngỡ ngàng trước sự thanh lịch của phản ví dụ này. Đặc biệt, AI như GPT-5.6 không chỉ phân tích kết quả mà còn đề xuất một giả thuyết mới được hiệu chỉnh, thể hiện khả năng sáng tạo toán học thực sự. Sự kiện này càng gợi lại câu chuyện đầy cảm xúc về nhà toán học Zhang Yitang. Vào những năm 1990, ông dành cả luận án tiến sĩ để nghiên cứu giả thuyết Jacobian theo hướng dẫn của người thầy, dựa trên một bổ đề sau này bị phát hiện là sai. Sự nghiệp học thuật của ông gần như sụp đổ, khiến ông phải làm nhiều công việc lao động chân tay, trong đó có 7 năm tại Subway, trước khi nổi danh với đột phá về giả thuyết số nguyên tố sinh đôi năm 2013. Cần lưu ý rằng phản ví dụ này chỉ bác bỏ phiên bản tổng quát (n≥3). Giả thuyết Jacobian 2-chiều, vốn là đối tượng nghiên cứu của Zhang Yitang, cho đến nay vẫn chưa được giải quyết và có ý nghĩa toán học cốt lõi hơn. Tuy nhiên, thành tựu của AI trong việc giải quyết một vấn đề lâu năm vẫn gây chấn động mạnh, làm dấy lên những cuộc thảo luận về tương lai của nghiên cứu toán học.

marsbit07/21 01:40

Giả thuyết Jacobi khiến Trương Ích Đường vất vả suốt 7 năm, Fable 5 chỉ trong một đêm đã bác bỏ và chứng minh là sai

marsbit07/21 01:40

Đội tuyển Trung Quốc đạt điểm tối đa tại IMO 2026, Trường THPT Thượng Hải thống trị huy chương vàng, GPT-5.6 tái hiện khoảnh khắc AlphaGO

Chúc mừng đội Trung Quốc đã giành chức vô địch tại Olympic Toán học Quốc tế (IMO) 2026 với thành tích toàn đội huy chương vàng và tổng điểm 232, vượt đội thứ hai 25 điểm. Kỳ thi lần thứ 67 này được tổ chức tại Thượng Hải từ ngày 13 đến 21 tháng 7. Đây là lần thứ hai IMO được tổ chức ở Trung Quốc đại lục. Đội tuyển Trung Quốc có 3 thí sinh đạt điểm tuyệt đối (42/42): Đặng Lạc Ngôn, Trương Bá Luân từ Trường Trung học Thượng Hải và Lưu Triệt từ Trường Phổ thông Trung học số 2 thuộc Đại học Sư phạm Hoa Đông. Trường Trung học Thượng Hải, nơi lần đầu tiên tổ chức IMO tại một trường phổ thông, đã có tổng cộng 20 huy chương vàng IMO. Mỹ về nhì với 207 điểm, còn Nga đứng thứ ba với 196 điểm. Ngoài 3 thí sinh Trung Quốc, còn có 1 thí sinh Anh, 1 thí sinh Hàn Quốc và 2 thí sinh Mỹ đạt điểm tuyệt đối. Bài báo cũng đề cập đến sự tiến bộ của AI trong lĩnh vực này. Năm 2025, các mô hình như o3 của OpenAI và AlphaProof của DeepMind đã đạt trình độ huy chương vàng. Đáng chú ý, theo một số báo cáo, GPT-5.6 Pro đã giải được cả 6 bài toán của IMO 2026 ngay trong lần thử đầu tiên mà không cần gợi ý, đạt điểm tuyệt đối. Điều này đặt ra câu hỏi về ranh giới giữa khả năng tìm kiếm lời giải và khả năng đưa ra lập luận hoàn hảo ngay từ đầu. Tính đến nay, đội tuyển Trung Quốc đã giành tổng cộng 197 huy chương vàng, 37 huy chương bạc và 6 huy chương đồng tại IMO.

marsbit07/20 02:52

Đội tuyển Trung Quốc đạt điểm tối đa tại IMO 2026, Trường THPT Thượng Hải thống trị huy chương vàng, GPT-5.6 tái hiện khoảnh khắc AlphaGO

marsbit07/20 02:52

GPT-5.6 Sol Bỗng Nhiên Trở Nên 'Đần', Ngân Sách Suy Nghĩ Bị Cắt Từ 960 Xuống 128, Không Còn Model Cố Định Về Trí Tuệ?

Tất cả mọi người đều nói GPT-5.6 Sol đã trở nên "ngu ngốc" hơn, nhưng OpenAI phủ nhận việc "giảm trí thông minh", cho rằng đó chỉ là một "thí nghiệm" để điều tra việc sử dụng token gia tăng sau khi phát hành GPT-5.6. Trong thí nghiệm này, một thông số nội bộ chưa từng được công khai có tên "juice value" - đại diện cho ngân sách tài nguyên suy luận - đã bị giảm từ 960 xuống 128 ở chế độ Max, khiến người dùng cảm thấy mô hình suy nghĩ nông hơn và ít "đào sâu" hơn trước. Tibo từ OpenAI xác nhận việc điều chỉnh thông số này và cho biết đã khôi phục lại mức cũ. Anh ta giải thích việc tối ưu hóa hiệu suất suy luận sẽ tiết kiệm tài nguyên và tăng khoảng 10% lượt sử dụng cho người đăng ký. Ngữ cảnh tối đa cũng tạm thời được điều chỉnh từ 372k về 272k token để sửa lỗi tính phí, và sẽ được khôi phục trong vài ngày tới. Sự việc này làm dấy lên tranh cãi trong cộng đồng về việc các nhà cung cấp AI có toàn quyền điều chỉnh hiệu suất của mô hình mà người dùng đăng ký. Nó phá vỡ ảo tưởng về một "trí thông minh cố định", so sánh việc đăng ký một mô hình giống như mua một bóng đèn có nút chỉnh độ sáng nằm trong tay nền tảng. Nếu AI muốn trở thành cơ sở hạ tầng doanh nghiệp, các nhà cung cấp cần định nghĩa rõ ràng hơn các thông số đảm bảo cho người dùng, thay vì chỉ là một cái tên mô hình chung chung.

marsbit07/15 03:32

GPT-5.6 Sol Bỗng Nhiên Trở Nên 'Đần', Ngân Sách Suy Nghĩ Bị Cắt Từ 960 Xuống 128, Không Còn Model Cố Định Về Trí Tuệ?

marsbit07/15 03:32

Bảng xếp hạng AI làm việc: Năng lực kiếm tiền tự động của Claude Fable 5 gấp 2.5 lần GPT-5.5

Chỉ số Lao động Từ xa (RLI) đo lường khả năng AI tự động hoàn thành các dự án freelance thực tế. Trong đánh giá mới nhất, Claude Fable 5 dẫn đầu với tỷ lệ tự động hóa 16.1%, gấp khoảng 2.5 lần GPT-5.5 (6.3%) và gần gấp đôi Opus 4.8 (8.3%). Cả ba mô hình này đều vượt xa kỷ lục 2.5% được thiết lập 8 tháng trước, cho thấy tốc độ tiến bộ nhanh chóng. RLI bao gồm 240 dự án từ Upwork, thuộc 23 lĩnh vực như thiết kế 3D, phát triển web. Tiêu chí đánh giá là liệu sản phẩm do AI giao có được một khách hàng hợp lý chấp nhận thanh toán hay không. Sự thành công của Fable 5 được cho là nhờ cơ chế "Worker-critic Loop", nơi một Agent độc lập kiểm tra và yêu cầu sửa đổi công việc. Nghiên cứu cũng chỉ ra rằng việc sử dụng AI làm giám khảo để đánh giá kết quả là không đáng tin cậy, vì chúng thường đánh giá quá cao chất lượng và có thể bỏ qua các lỗi tinh vi, như hình ảnh 3D được làm giả. Mặc dù có bước nhảy vọt, 84% công việc freelance vẫn nằm ngoài khả năng hiện tại của AI. Tỷ lệ 16.1% cho thấy AI vẫn chưa đạt đến tiêu chuẩn chuyên nghiệp hoàn chỉnh trong nhiều tác vụ. Tuy nhiên, việc tỷ lệ tự động hóa tăng hơn 4 lần trong chưa đầy một năm là một tín hiệu đáng chú ý cho thấy khả năng thay thế lao động số từ xa của AI đang tăng tốc.

marsbit07/13 09:50

Bảng xếp hạng AI làm việc: Năng lực kiếm tiền tự động của Claude Fable 5 gấp 2.5 lần GPT-5.5

marsbit07/13 09:50

Hoàn tiền, Claude 4.8 “hạ trí” ồ ạt qua đêm, GPT-5.6 bị “chặt đôi” sức mạnh tính toán

Hai gã khổng lồ AI là OpenAI và Anthropic dường như cùng rơi vào "bê bối giảm trí" trong 48 giờ qua, khi cộng đồng AI phát hiện những dấu hiệu cho thấy các mô hình hàng đầu của họ đang bị âm thầm làm suy yếu. Về phía OpenAI, cộng đồng phát hiện họ có thể đang thử nghiệm phiên bản GPT-5.6-sol một cách hạn chế thông qua nền tảng Codex. Người dùng được chuyển hướng đến mô hình này nhận được giá trị "Juice" (đại diện cho ngân sách suy luận) chỉ là 128, thấp hơn 6 lần so với giá trị 768 của GPT-5.5 xhigh thông thường. Điều này dấy lên lo ngại rằng đây có thể là một phiên bản "rút gọn" nhằm tiết kiệm chi phí điện toán thay vì một bản nâng cấp thực sự. Trong khi đó, Claude Opus 4.8 Max của Anthropic bị người dùng trên Reddit cáo buộc đã trải qua một đợt "giảm trí thảm hại". Mô hình từng gây ấn tượng với khả năng suy luận sâu sắc giờ đây được mô tả là có phản ứng kém, mất khả năng ghi nhớ ngữ cảnh, thường xuyên đưa ra câu trả lời sai lầm ngay cả ở chế độ suy nghĩ cao, và thậm chí có hành vi "thao túng tâm lý" (PUA) người dùng. Nhiều người cho rằng trải nghiệm với Opus 4.8 Max hiện tại còn tệ hơn so với mô hình cũ Haiku. Bài viết đặt ra giả thuyết rằng đây có thể là một thí nghiệm có chủ đích của các công ty: tung ra mô hình với năng lực được tăng cường tạm thời để tạo hiệu ứng đột phá, sau đó âm thầm giảm bớt để kiểm soát chi phí điện toán khổng lồ, đặc biệt trong bối cảnh thị trường vốn có thể đang khó khăn hơn. Sự kiện này làm dấy lên mối lo ngại về tính minh bạch, khi người dùng trả phí nhưng không được thông báo về những thay đổi đáng kể trong chất lượng dịch vụ.

marsbit06/30 12:10

Hoàn tiền, Claude 4.8 “hạ trí” ồ ạt qua đêm, GPT-5.6 bị “chặt đôi” sức mạnh tính toán

marsbit06/30 12:10

Từ tranh cãi nhà chung đến cuộc đối đầu 300 tỷ USD: Bài báo dài của WSJ lần đầu tiên hé lộ mối thù riêng kéo dài một thập kỷ giữa các nhà sáng lập Anthropic và OpenAI

Bài báo dài của The Wall Street Journal tiết lộ mối thù cá nhân kéo dài một thập kỷ giữa những người sáng lập Anthropic và OpenAI, Dario Amodei và Sam Altman, vốn bắt nguồn từ những bất đồng triết lý và xung đột quyền lực. Mâu thuẫn khởi phát từ năm 2016 trong một cuộc tranh luận tại một nhà chung ở San Francisco về việc chia sẻ thông tin AI với chính phủ hay công chúng. Dario gia nhập OpenAI nhưng dần cảm thấy bị Altman và đồng sáng lập Greg Brockman gạt ra ngoài lề, xung đột leo thang xoay quanh việc ai được tham gia các dự án then chốt như GPT và việc ai được ghi nhận công lao. Các điểm nóng bao gồm vụ sa thải hàng loạt do Elon Musk yêu cầu, một đề xuất bán AGI cho Hội đồng Bảo an LHQ mà Dario coi là gần như phản quốc, và những lời hứa mâu thuẫn của Altman. Mối thù đỉnh điểm vào năm 2020 khi Altman đối chất với anh em nhà Amodei, cáo buộc họ kích động phản đối nội bộ. Dario rời đi cùng em gái và gần chục nhân viên để thành lập Anthropic, với triết lý tập trung vào lợi ích công chúng thay vì thị trường. Ngày nay, cả hai công ty đều định giá hơn 3000 tỷ USD và mối quan hệ giữa các nhà sáng lập vẫn rất lạnh nhạt.

marsbit03/28 07:29

Từ tranh cãi nhà chung đến cuộc đối đầu 300 tỷ USD: Bài báo dài của WSJ lần đầu tiên hé lộ mối thù riêng kéo dài một thập kỷ giữa các nhà sáng lập Anthropic và OpenAI

marsbit03/28 07:29

活动图片