# Bài viết Liên quan DeepSeek

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "DeepSeek", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Người nhận giải thưởng đặc biệt Đại học Thanh Hoa, Cố Dục Hiền, gia nhập DeepSeek

Gần đây, DeepSeek đang mở rộng tuyển dụng mạnh mẽ. Trong danh sách tác giả của bài báo nghiên cứu DeepSeek V4 (dự kiến ra mắt giữa tháng này) có sự xuất hiện của **Cố Dục Hiền (Yuxian Gu)**, nghiên cứu sinh tiến sĩ khóa 2021 tại Đại học Thanh Hoa và người nhận được Học bổng Đặc biệt cho Nghiên cứu sinh năm 2025. Được biết, anh đã chính thức gia nhập DeepSeek. Cố Dục Hiền, cựu nghiên cứu sinh tại Nhóm AI Đàm thoại (CoAI) thuộc Đại học Thanh Hoa dưới sự hướng dẫn của Giáo sư Hoàng Dân Liệt, từng nhận học bổng tiến sĩ Apple 2025 và học bổng Ant In-Tech. Nghiên cứu của anh tập trung vào nâng cao hiệu quả trong toàn bộ vòng đời của mô hình ngôn ngữ lớn (LLM), bao gồm ba hướng chính: Lọc dữ liệu tiền huấn luyện (với các công trình như PDS), Cất cánh kiến thức trong nén mô hình (đại diện là MiniLLM), và Kiến trúc mô hình hiệu quả (như Jet-Nemotron). Lượng trích dẫn bài báo khoa học của anh trên Google Scholar đã gần 5.000. Công trình nổi bật Jet-Nemotron của anh, một kiến trúc ngôn ngữ lai mới, đạt độ chính xác ngang bằng các mô hình chú ý đầy đủ tiên tiến nhất (SOTA) nhưng với hiệu suất vượt trội, tăng tốc tạo sinh lên tới 53.6 lần trên GPU H100 ở ngữ cảnh dài. Mô hình MiniLLM trước đó của anh về phương pháp cất cánh kiến thức cũng được áp dụng rộng rãi bởi Google, Alibaba, NVIDIA. Việc Cố Dục Hiền gia nhập DeepSeek được kỳ vọng sẽ mang lại nhiều thành tựu mới cho công ty.

marsbit07/06 02:09

Người nhận giải thưởng đặc biệt Đại học Thanh Hoa, Cố Dục Hiền, gia nhập DeepSeek

marsbit07/06 02:09

Dự đoán vòng loại World Cup, các mô hình AI khác nhau sai biệt nhiều đến vậy?

Trong thử nghiệm dự đoán kết quả vòng loại trực tiếp World Cup, các mô hình AI thể hiện sự khác biệt rõ rệt về hiệu quả. DeepSeek và Gemini tỏa sáng nhờ khả năng dự đoán chính xác trận đấu giữa Hà Lan và Maroc. Gemini thậm chí còn đưa ra tỷ số hòa 1-1 trong thời gian thi đấu chính thức và dự đoán Maroc thắng trên chấm luân lưu, trùng khớp hoàn toàn với thực tế. DeepSeek cũng có phân tích tương tự, nhấn mạnh khả năng phòng ngự và phản công của Maroc. Grok và Qwen (Thông Vấn) thể hiện ổn định trong các trận có cửa trên rõ ràng, dự đoán đúng cả đội thắng và tỷ số sát thực tế, như trận Canada thắng Nam Phi 1-0 và Brazil thắng Nhật Bản 2-1. ChatGPT thiên về phân tích quá trình trận đấu, thường cảnh báo về những khó khăn mà các đội mạnh có thể gặp phải, mặc dù không luôn đúng về tỷ số cuối cùng. Tuy nhiên, tất cả các mô hình đều "thất bại tập thể" trong trận Đức gặp Paraguay, đều đánh giá quá cao sức mạnh của Đức và không lường trước được khả năng kéo bài của Paraguay dẫn đến loạt sút luân lưu. Tóm lại, mỗi mô hình có thế mạnh riêng: DeepSeek và Gemini nổi bật ở các dự đoán bất ngờ; Grok và Qwen chính xác về tỷ số ở các trận ít biến động; ChatGPT và Claude cung cấp phân tích quá trình chi tiết. Người dùng nên lựa chọn mô hình phù hợp dựa trên nhu cầu cụ thể: tham khảo tỷ số hay phân tích diễn biến.

Odaily星球日报07/02 01:46

Dự đoán vòng loại World Cup, các mô hình AI khác nhau sai biệt nhiều đến vậy?

Odaily星球日报07/02 01:46

DeepSeek Bắt Đầu Tạo Ra Của Cải

Tác giả: Họa Họa Trong một thời gian dài, DeepSeek giống một phòng thí nghiệm bí ẩn hơn là một công ty: không gọi vốn, không phỏng vấn, không giải thích. Gần đây, việc họ bắt đầu tuyển dụng quy mô lớn, chấp nhận vốn ngoài và thành lập đội Harness đánh dấu bước chuyển: thời kỳ thần thoại kết thúc, một công ty AI thực thụ bước vào cuộc cạnh tranh thị trường. DeepSeek huy động thành công 51 tỷ NDT (vốn hóa ước tính 400 tỷ NDT), cùng với sự kiện Zhipu AI lên sàn và hàng loạt "kỳ lân" AI khác (Moonshot, Baichuan, Stepfun, 01.AI) ở giai đoạn Pre-IPO, cho thấy ngành AI Trung Quốc lần đầu tiên bước vào giai đoạn tạo ra của cải hàng loạt cho nhân viên. Đây là ngành công nghiệp mới đầu tiên trong một thập kỷ qua mở ra cánh cửa tăng trưởng và cơ hội tương tự như internet di động ngày trước. Cơ hội không chỉ nằm ở quyền chọn cổ phiếu. Cuộc cạnh tranh AI đang chuyển từ giai đoạn 1 (cuộc đua mô hình thuần túy) sang giai đoạn 2 (cuộc đua Agent - tác nhân AI). DeepSeek thành lập đội Harness chính là để đối đầu với Codex của OpenAI hay Claude Code của Anthropic trong cuộc đua toàn cầu này. Họ không chỉ tuyển nhân sự mà đang định nghĩa lại tiêu chuẩn kỹ sư thời đại Agent: những người hiểu về tư duy, kiến trúc Agent và khả năng phối hợp đa phương thức. Mỗi cuộc cách mạng công nghệ đều định nghĩa lại một thế hệ kỹ sư. Những người tham gia DeepSeek hôm nay đang tiếp thu những kỹ năng khan hiếm bậc nhất về tối ưu hóa suy luận và kiến trúc Agent - thứ sẽ có nhu cầu cực lớn trong tương lai. Tuy nhiên, cơ hội lớn nhất không chỉ giới hạn trong 36 vị trí tại DeepSeek hay các công ty AI lớn. Làn sóng tạo ra của cải thực sự thuộc về mỗi người biết sử dụng AI. Giống như internet di động, lợi ích lớn nhất sẽ thuộc về những người bình thường trong mọi ngành nghề biết kết hợp kỹ năng cốt lõi của mình với AI để định nghĩa lại công việc: nhà thiết kế, giáo viên, bác sĩ, người bán hàng... Khi Agent trở thành công cụ phổ biến, những người đi tiên phong trong việc ứng dụng nó vào lĩnh vực của mình sẽ tạo ra khoảng cách lớn so với đồng nghiệp.

marsbit06/28 01:30

DeepSeek Bắt Đầu Tạo Ra Của Cải

marsbit06/28 01:30

Vừa qua, DeepSeek V4 cập nhật DSpark, tốc độ suy luận tăng 80%

Vừa qua, DeepSeek V4 đã được cập nhật với framework giải mã suy đoán mới là **DSpark**, giúp tăng tốc độ suy luận lên tới 80%. Cốt lõi của bản cập nhật này là framework **DSpark**, một kỹ thuật giải mã suy đoán được triển khai trên DeepSeek-V4-Pro hiện có để tăng tốc độ suy luận, chứ không phải là nâng cấp kiến trúc mô hình. DSpark giải quyết các điểm nghẽn về độ trễ và thông lượng trong môi trường sản xuất, đặc biệt ở các tình huống có tải cao. DSpark kết hợp hai cải tiến chính: 1. **Kiến trúc sinh bán tự hồi quy (Semi-Autoregressive Generation)**: Giữ lợi thế về thông lượng cao của mô hình phác thảo song song, đồng thời thêm mô-đun nối tiếp nhẹ để mô hình hóa mối quan hệ phụ thuộc giữa các token, giúp giảm thiểu tỷ lệ chấp nhận suy giảm. 2. **Xác minh theo lịch trình độ tin cậy, nhận biết phần cứng (Confidence-Scheduled Verification)**: Một "đầu độ tin cậy" (Confidence Head) được sử dụng để đánh giá xác suất tồn tại của mỗi token phác thảo. Hệ thống điều phối sẽ xác định độ dài xác minh tối ưu một cách linh hoạt dựa trên đặc điểm tải và phần cứng, chỉ phân bổ tài nguyên tính toán cho những token có khả năng được chấp nhận cao nhất. Trong các thử nghiệm trên nhiều lĩnh vực như suy luận toán học, tạo mã và hội thoại, DSpark vượt trội so với các phương pháp tiên tiến hiện tại như Eagle3 và DFlash. So với cơ sở sinh token đơn trước đó (MTP-1), DSpark đã **tăng tốc độ phản hồi cho người dùng từ 57% đến 85%** (tuỳ thuộc vào việc sử dụng mô hình Flash hay Pro) trong khi vẫn duy trì cùng tổng thông lượng. Cùng với DSpark, DeepSeek cũng công khai mã nguồn **DeepSpec**, một bộ công cụ toàn diện để đào tạo và đánh giá các mô hình phác thảo cho giải mã suy đoán. DeepSpec cung cấp một đường ống công việc tiêu chuẩn bao gồm chuẩn bị dữ liệu, đào tạo và đánh giá, hỗ trợ nhiều thuật toán (DSpark, DFlash, Eagle3) và mô hình mục tiêu (hiện tại là Qwen3 và Gemma).

marsbit06/27 08:54

Vừa qua, DeepSeek V4 cập nhật DSpark, tốc độ suy luận tăng 80%

marsbit06/27 08:54

Sóng gió thị trường AI bạo lực điều chỉnh, phải chăng đã đến giờ GLM-5.2 của ZhiPu?

Thứ Ba, thị trường AI toàn cầu đối mặt đợt bán tháo mạnh nhất năm nay. Chỉ số KOSPI của Hàn Quốc giảm gần 10%, kích hoạt cơ chế ngừng giao dịch, với Samsung Electronics và SK Hynix lao dốc. Sự sụt giảm sau đó lan sang Mỹ, Nasdaq mất 2.2%, các cổ phiếu bán dẫn và AI dẫn đầu đà giảm. Nhiều ý kiến coi đây là "thời khắc DeepSeek của GLM", ám chỉ việc mô hình mã nguồn mở GLM-5.2 của Trí Tuệ Đại Thúc (Zhipu AI) Trung Quốc, được đánh giá vào top 3 toàn cầu, gây lo ngại về khả năng cạnh tranh của các mô hình Mỹ đắt đỏ. Các nhà đầu tư đặt câu hỏi về tính bền vững của hàng nghìn tỷ USD chi cho trung tâm dữ liệu nếu các mô hình rẻ hơn đủ tốt. Áp lực kép từ nghi ngờ về lợi tức đầu tư AI và kỳ vọng lãi suất cao hơn tại Mỹ khiến vốn rút khỏi chuỗi phần cứng hưởng lợi từ câu chuyện hạ tầng. Giao dịch hiện tại tập trung bán các "công ty chi tiêu nhiều nhất" như Alphabet, Meta. Sự kiện cụ thể ở Hàn Quốc như cảnh báo về ETF đòn bẩy và việc MSCI không nâng hạng nước này cũng góp phần gây sụt giảm. Thị trường chờ đợi báo cáo của Micron để kiểm chứng sức khỏe ngành. Một mối lo khác là việc tài trợ cho cơ sở hạ tầng AI ngày càng phụ thuộc vào nợ, như trường hợp SpaceX phát hành trái phiếu, làm dấy lên lo ngại về chi tiêu quá mức. Tuy nhiên, nhiều nhà đầu tư vẫn lạc quan, coi đây là đợt điều chỉnh cần thiết trong giai đoạn sớm của cuộc cách mạng AI, chứ không phải kết thúc xu hướng. Cốt lõi vấn đề chuyển từ "AI có tăng trưởng không" sang "giá phải trả cho tăng trưởng đó có quá cao không", tập trung vào khả năng chuyển đổi chi tiêu vốn thành dòng tiền và định giá hợp lý.

marsbit06/24 02:22

Sóng gió thị trường AI bạo lực điều chỉnh, phải chăng đã đến giờ GLM-5.2 của ZhiPu?

marsbit06/24 02:22

Trí Phổ đạt nghìn tỷ rồi, DeepSeek còn xa không?

Công ty AI Trung Quốc Zhipu AI đã đạt vốn hóa thị trường hơn 1 nghìn tỷ HKD trên sàn chứng khoán Hồng Kông, bất chấp doanh thu năm 2025 chỉ là 7,24 tỷ nhân dân tệ và lỗ ròng 47,18 tỷ nhân dân tệ. Sự tăng trưởng mạnh mẽ này được thúc đẩy bởi mô hình ngôn ngữ GLM-5.2 và kỳ vọng thị trường coi Zhipu là “Anthropic của Trung Quốc”, sau thành công về thương mại hóa của Anthropic với Claude Code. Sự kiện này đánh dấu đỉnh cao mới trong việc định giá lại ngành mô hình lớn (LLM) Trung Quốc, trong bối cảnh các công ty như DeepSeek (định giá 500 tỷ USD), MiniMax và Step Fun liên tục hút vốn và nhắm đến IPO. Tuy nhiên, tranh cãi về bong bóng giá trị vẫn tồn tại do khoảng cách lớn giữa định giá và kết quả kinh doanh hiện tại. Thách thức chính của Zhipu và toàn ngành là tăng tốc tăng trưởng doanh thu và chứng minh khả năng sinh lời. Thị trường MaaS (Model-as-a-Service) Trung Quốc đang mở rộng nhanh chóng, với lượng token xử lý tăng vọt. Nếu Anthropic có thể đạt lợi nhuận hoạt động, nó sẽ tạo tiền đề để các công ty Trung Quốc được định giá lại theo hướng tương tự. Tương lai của đường biên định giá AI Trung Quốc phụ thuộc vào việc các công ty chuyển đổi thành công năng lực mô hình thành dòng tiền bền vững.

marsbit06/22 23:26

Trí Phổ đạt nghìn tỷ rồi, DeepSeek còn xa không?

marsbit06/22 23:26

Câu chuyện gọi vốn của DeepSeek

Câu chuyện gọi vốn của DeepSeek, được bắt đầu vào khoảng tháng 4, đã thu hút sự chú ý lớn với các chi tiết thú vị. Trong một cuộc họp trực tuyến kéo dài 4 giờ qua Tencent Meeting vào giữa tháng 5, CEO Lương Văn Phong đã chia sẻ tầm nhìn và triết lý của công ty với các nhà đầu tư tiềm năng. Ông nhấn mạnh sự tập trung theo đuổi AGI (Trí tuệ nhân tạo phổ quát), tinh thần "less is more" và tính kỷ luật. Điều kiện quan trọng nhất đối với các nhà đầu tư là không được săn tuyển nhân sự của DeepSeek. Ban đầu, DeepSeek đặt mức đầu tư tối thiểu là 5 tỷ nhân dân tệ và cấu trúc vốn thuần nội địa, nhưng sau đó đã linh hoạt điều chỉnh xuống 1.5 tỷ nhân dân tệ. Danh sách nhà đầu tư cuối cùng gồm 10 tổ chức, nhưng khi xem xét kỹ các quỹ thành phần, số lượng thực tế lên tới gần 100 tổ chức và cá nhân. Các cái tên nổi bật bao gồm Monolith (đầu tư 3 tỷ), Chính Tâm Cốc, IDG, cùng nhiều quỹ đầu tư mạo hiểm và nhà đầu tư chiến lược khác. Đáng chú ý, hai quỹ lớn là Sequoia China và Hillhouse Capital ban đầu được đồn đoán sẽ tham gia nhưng lại vắng mặt trong danh sách cuối cùng. Lương Văn Phong thể hiện hình ảnh một lãnh đạo khiêm tốn, đề cao sự ổn định đội ngũ và tầm nhìn dài hạn về AGI. Các nhà đầu tư tham gia đánh giá cao tinh thần và giá trị cốt lõi này của DeepSeek, xem đây không chỉ là một cơ hội đầu tư mà còn là sự ủng hộ cho một mục tiêu lớn lao.

marsbit06/18 02:10

Câu chuyện gọi vốn của DeepSeek

marsbit06/18 02:10

WeChat Agent phát "Hùng Lệnh", nửa bầu trời Internet hưởng ứng

Để cung cấp trải nghiệm tương tác thông minh hơn, WeChat Open Platform đã ban hành hướng dẫn cho nhà phát triển về AI WeChat, cho phép các mini-program tích hợp vào hệ sinh thái AI WeChat. Sau khi tích hợp, các mini-program có cơ hội được AI WeChat đề xuất và gọi. Meituan, Ctrip, Tongcheng và các nền tảng dịch vụ khác đã công bố tích hợp hàng đầu. AI WeChat, hay Agent WeChat, dự kiến sẽ cho phép người dùng thực hiện các tác vụ như đặt đồ uống hoặc nhà hàng thông qua lệnh bằng giọng nói. Agent này có thể điều phối hàng triệu mini-program trong hệ sinh thái WeChat, tạo thành một siêu ứng dụng với khả năng hiểu ý định, gọi công cụ, xử lý thanh toán và quản lý ngữ cảnh. Nền tảng kỹ thuật bao gồm UI-Oceanus, một mô hình thế giới để dự đoán kết quả thao tác trên mini-program. WeChat là nền tảng lý tưởng cho Agent này nhờ bối cảnh phong phú từ chuỗi quan hệ, mini-program, thanh toán và nội dung. Các sản phẩm AI khác của Tencent như Yuanbao, WorkBuddy, ima và Marvis đã tích lũy năng lực cho AI WeChat thông qua cơ chế Thiết kế chung (Co-Design), cho phép chuyển giao năng lực giữa các sản phẩm. Tencent chọn cách tiếp cận Giao thức Agent-to-Agent (A2A) để các Agent từ các nhà sản xuất khác (như Honor, Xiaomi) có thể giao tiếp và gọi các chức năng có kiểm soát trong WeChat, thay vì phương pháp Giao diện người dùng đồ họa (GUI) có thể bị chặn. Điều này giúp Tencent kiểm soát quyền truy cập và các quy tắc trong hệ sinh thái của mình. Với 1,432 tỷ người dùng hoạt động hàng tháng, chi phí vận hành AI WeChat là rất lớn. Tencent có thể sử dụng chiến lược đa mô hình, kết hợp các mô hình nhỏ cho tác vụ cơ bản và mô hình mạnh cho tác vụ phức tạp. Khoản đầu tư tiềm năng 10 tỷ nhân dân tệ vào DeepSeek và việc điều chỉnh giá trên Tencent Cloud cho thấy mối quan hệ hợp tác chiến sâu sắc, có thể cung cấp năng lực suy luận chi phí thấp cho AI WeChat. Các chuyên gia của Tencent nhấn mạnh rằng AI là một cuộc chơi dài hạn, nơi giá trị thực tiễn quan trọng hơn điểm số trên bảng xếp hạng. AI WeChat hướng tới giải quyết các "vấn đề hay" trong cuộc sống hàng ngày của hàng tỷ người dùng, đánh dấu sự bước vào hiệp hai của Tencent trong lĩnh vực AI.

marsbit06/09 04:21

WeChat Agent phát "Hùng Lệnh", nửa bầu trời Internet hưởng ứng

marsbit06/09 04:21

DeepSeek Có Thể Giúp Trung Quốc Tiết Kiệm 1 Nghìn Tỷ Đô La Mỹ?

Vào nửa cuối năm 2026, Nvidia sẽ giao nền tảng AI mạnh nhất từ trước đến nay: Vera Rubin VR200 NVL72, với chi phí vật tư khoảng 7,8 triệu USD, trong đó bộ nhớ (HBM4 và LPDDR5X) chiếm tới 2 triệu USD. Bài viết phân tích cách DeepSeek, thông qua các công nghệ như nén bộ nhớ ngữ cảnh dài (MLA), mô hình hỗn hợp chuyên gia (MoE) và tái sử dụng bộ nhớ cache, có thể tăng hiệu suất xử lý token lên gấp 4 lần trên cùng phần cứng, giảm đáng kể sự phụ thuộc vào phần cứng đắt đỏ như GPU và HBM. Khi nhu cầu token AI của Trung Quốc dự kiến đạt hàng nghìn tỷ mỗi ngày, việc tăng hiệu quả này có khả năng tiết kiệm một lượng lớn đầu tư cơ sở hạ tầng. Ước tính, với mức tăng hiệu suất 4 lần, có thể tiết kiệm số tiền tương đương việc xây dựng ít đi hàng chục nghìn trung tâm điện toán AI, tổng giá trị lên tới khoảng 1 nghìn tỷ USD trong tương lai. Chiến lược của DeepSeek không phải là thay thế phần cứng tính toán mà là tối ưu hóa việc sử dụng nó, dịch chuyển giá trị sang các khâu như kiến trúc mô hình, hệ thống suy luận và quản lý bộ nhớ - những lĩnh vực mà chuỗi cung ứng trong nước có lợi thế hơn. Điều này làm giảm sự phụ thuộc vào các linh kiện công nghệ cao bị hạn chế và giúp phổ biến AI với chi phí thấp hơn cho các ngành công nghiệp Trung Quốc.

marsbit06/03 00:51

DeepSeek Có Thể Giúp Trung Quốc Tiết Kiệm 1 Nghìn Tỷ Đô La Mỹ?

marsbit06/03 00:51

活动图片