Trương Triều Dương cùng nhà vật lý Lưu Nhược Vi thảo luận về bản chất vật chất và tư duy khoa học, nhấn mạnh tầm quan trọng của việc dám đặt ra những câu hỏi 'ngớ ngẩn' để khám phá thế giới.
Nhà sáng lập Zhipu AI khẳng định Scaling Law không chỉ nằm ở số lượng tham số mà còn là sự kết hợp giữa dữ liệu, tính toán và cấu trúc. GLM-5.3 cho thấy xu hướng chuyển dịch từ việc chạy đua quy mô sang tìm kiếm cấu trúc tối ưu cho suy luận dài hạn.
Tang Jie phản biện Scaling Law, khẳng định hiệu năng không chỉ phụ thuộc vào số lượng tham số mà còn ở dữ liệu và tối ưu hóa hậu huấn luyện. Thử nghiệm trên GLM-5.3 cho thấy chỉ cần tinh chỉnh RL trong một tháng đã mang lại bước tiến lớn mà không cần thay đổi kiến trúc.
Baidu sẽ tổ chức khóa đào tạo thực chiến về tác nhân AI (AI Agent) 'Dazi' tại Thượng Hải, hướng dẫn người dùng từ khâu lên ý tưởng đến triển khai thực tế trong các tác vụ văn phòng như PPT, tài liệu và phân tích tài chính.
Dù chưa giải được giả thuyết Riemann, mô hình Claude đã đạt bước tiến quan trọng khi xử lý thành công một trong những bài toán khó nhất của toán học hiện đại.
GLM-5.3 chính thức ra mắt với khả năng lập trình và bảo mật vượt trội, đạt 60 điểm trên thang đo AA, ngang hàng với các mô hình đầu bảng hiện nay nhưng với chi phí vận hành tối ưu hơn.
Diễn biến sự kiện · 6 bài →Thêm 6 nguồn khác đưa tinThe Decoder: AI NewsX: Lan Xi (@foxshuo)X: X.PIN (@thexpin)IT HomeX: Artificial Analysis (@ArtificialAnlys)X: Zhipu AI Z.ai (@Zai_org)
Vì sao đáng đọc: Đây là tin tức quan trọng về một mô hình AI mới có hiệu suất cạnh tranh cao, đặc biệt là việc tối ưu hóa chi phí cho người dùng cuối, rất đáng chú ý trong cộng đồng công nghệ.
GLM-5.3 API is now live. - Built for coding, defensive cybersecurity, and long-horizon agentic task…
DịchGLM-5.3 đã sẵn sàng trên API với khả năng vượt trội trong lập trình, an ninh mạng và tác vụ đại lý thông minh dài hạn, đồng thời duy trì mức giá như phiên bản 5.2.
Grok is also the most fun AI, with an unmatched sense of humor. Ask Grok to roast someone and see f…
DịchGrok được đánh giá là AI thú vị nhất hiện nay nhờ khả năng châm biếm sắc sảo và khiếu hài hước không đối thủ. Hãy thử yêu cầu Grok "cà khịa" một ai đó để thấy sự khác biệt.
Thinking Machines vừa giới thiệu Inkling, mô hình được huấn luyện từ đầu với kiến trúc chuyên gia hỗn hợp (MoE), sở hữu 975 tỷ tham số nhưng chỉ kích hoạt 41 tỷ tham số cho mỗi token.
Zetta ζ từ Đại học Thanh Hoa giúp robot không chỉ thực hiện nhiệm vụ mà còn tự quan sát, sửa lỗi và tích lũy kinh nghiệm theo thời gian thực, đạt tỷ lệ thành công vượt trội trong các thử nghiệm phức tạp.
Vì sao đáng đọc: Đột phá quan trọng trong lĩnh vực robot học (Embodied AI), giải quyết bài toán khó về khả năng tự học trực tuyến và thích nghi với môi trường thực tế thay vì chỉ chạy theo kịch bản sẵn.
Nghiên cứu đề xuất mô hình nhận thức System 0-3, mở rộng lý thuyết song hành truyền thống bằng cách tích hợp yếu tố cơ thể học (System 0) và trí tuệ tập thể từ tương tác xã hội (System 3), tạo ra khung lý thuyết đa quy mô từ cá nhân đến cộng đồng.
Baidu AI Cloud chính thức công bố sự kiện lớn về 'thực thể trí tuệ công nghiệp' (Industry Intelligent Agent) diễn ra vào ngày 16/9, hứa hẹn mang đến những đột phá mới trong ứng dụng AI cho doanh nghiệp.
"The episode of history where humanity was the apex intelligence is about to end." AI is crossing a…
DịchCựu giám đốc Google, Mo Gawdat, cảnh báo rằng khi AI bắt đầu tự phát minh ra toán học và khả năng tự tối ưu hóa, tốc độ phát triển của máy móc sẽ vượt xa mọi giới hạn của con người, chấm dứt thời kỳ đỉnh cao của trí tuệ nhân loại.
Be nice, Tibo 😂 AGI is cool, but can it be this funny?
DịchYann LeCun hóm hỉnh nhắc nhở mọi người hãy đối xử tốt với Tibo. Liệu AGI trong tương lai có thể sở hữu khiếu hài hước thực thụ hay chỉ là những cỗ máy khô khan?
Tại Hội sách Thượng Hải 2026, Mạc Ngôn khẳng định AI dù giỏi kỹ thuật nhưng chỉ là sự xào nấu từ dữ liệu cũ, không thể tạo ra những tác phẩm kinh điển như thơ ca cổ hay văn chương giàu cảm xúc của các đại thi hào.
Gemini 3.7 Flash không chỉ dừng lại ở việc phản hồi thông tin mà còn được thiết kế để chủ động thực hiện các tác vụ phức tạp, mở ra kỷ nguyên AI tự làm việc.
So GLM-5.3 has already found a "potentially serious vulnerability" in Cursor. GLM-5.3's CyberGym sc…
DịchGLM-5.3 vừa phát hiện lỗ hổng bảo mật nghiêm trọng trên Cursor thông qua kỹ thuật đảo ngược. Mô hình này đã đạt bước tiến lớn trong các bài kiểm tra an ninh mạng với điểm số CyberGym lên tới 84.5% và ExploitBench tăng gấp đôi lên 54.4% mà không cần đào tạo lại từ đầu.
Congrats to @Zai_org on GLM-5.3. It massively beats every American open model: Nemotron, Laguna, Ink…
DịchGLM-5.3 vừa ra mắt đã cho thấy hiệu suất vượt trội so với các đối thủ từ Mỹ như Nemotron. Điểm đáng chú ý là sự cải tiến này hoàn toàn đến từ quy trình hậu huấn luyện (post-training) trên cùng một nền tảng với phiên bản cũ.
Regular reminder -- the set of public ARC 3 games is called "demonstration set", not "eval set" nor …
DịchFrançois Chollet nhấn mạnh bộ dữ liệu ARC 3 công khai chỉ mang tính chất minh họa, không phải chuẩn mực đánh giá. Điểm số 2,7% trên bảng xếp hạng hiện tại không phản ánh đúng năng lực thực tế của mô hình so với bộ dữ liệu kiểm tra kín.
Jeremy's excellent work here is a great illustration of a very powerful type of approach: LLM-guided…
DịchFrançois Chollet nhận định rằng các phương pháp dẫn đầu trong thử thách ARC-AGI-3 đều dựa trên việc dùng LLM để tổng hợp các mô hình thế giới biểu tượng, thông qua việc viết mã thực thi nhằm giải mã cơ chế nhân quả của thế giới.
WHAT: Zai just launched GLM-5.3, and its biggest leap may be in cybersecurity. The 743B base model …
Dịch(Zhipu) vừa phát hành GLM-5.3 với khả năng suy luận đa giai đoạn và xây dựng chuỗi tấn công vượt trội, đạt điểm số ấn tượng trong các bài kiểm tra bảo mật như Terminal-Bench 3.0 và ExploitBench.
Could a language model derive General Relativity yet still be unable to invent it? This Google Deep…
DịchDeepMind chỉ ra rằng LLM gặp khó khăn trong việc tạo ra các đột phá khoa học như thuyết tương đối vì thiếu khả năng 'suy luận ngược' (abduction). Dù giỏi xử lý dữ liệu, mô hình ngôn ngữ vẫn bị giới hạn bởi cơ chế nén dữ liệu thay vì tư duy sáng tạo vượt bậc.
Test-time training was popularized during the ARC Prize 2024 competition, after being explored in pa…
DịchFrançois Chollet đánh giá cao tiềm năng của TTT khi giúp ARC Prize 2024 đạt mức tăng trưởng kỷ lục lên 55,5%. Đây được xem là bước nhảy vọt lớn nhất về khả năng tổng quát hóa của AI kể từ khi học trong ngữ cảnh (in-context learning) xuất hiện.
NeuPAT là phương pháp mới giúp bảo vệ các neuron quan trọng trong LLM khi huấn luyện đa phương thức, ngăn chặn tình trạng suy giảm khả năng ngôn ngữ vốn có bằng cách phân bổ mức độ cập nhật linh hoạt cho từng neuron.
Bản thử nghiệm Xiaomi HyperOS 4 sẽ bắt đầu được phát hành từ chiều 14/8 cho các dòng Xiaomi 17, Redmi K90 và Xiaomi Pad 8, mang đến nhiều cải tiến về giao diện và trí tuệ nhân tạo.
Korean AI lab Upstage has released Solar Pro 4, scoring 42 on the Artificial Analysis Intelligence I…
DịchPhòng thí nghiệm AI Upstage (Hàn Quốc) vừa trình làng mô hình suy luận Solar Pro 4 với chỉ số thông minh đạt 42 điểm trên Artificial Analysis, tăng mạnh so với mức 14 điểm của phiên bản tiền nhiệm và ngang hàng với Inkling.
models that are not usable by humans are not useful i don't think it is constructive to say that "o…
DịchDex Horthy cho rằng các mô hình AI hiện nay chỉ có 'năng lực' chứ không có 'trí tuệ' thực sự, đồng thời chỉ trích việc các mô hình ngày càng khó sử dụng và có dấu hiệu suy giảm hiệu suất.
Mẫu robot tích hợp trí tuệ nhân tạo mới của Trung Quốc đã gây ấn tượng khi xử lý 1.816 kiện hàng có hình dạng phức tạp chỉ trong một giờ, đạt hiệu suất vượt trội so với đối thủ Figure AI với chi phí tối ưu hơn.
Vì sao đáng đọc: Tin tức mang tính đột phá về công nghệ robot hình người, cho thấy sự cạnh tranh gay gắt về hiệu suất và chi phí giữa các ông lớn AI, rất thu hút độc giả quan tâm công nghệ.
Tencent ghi nhận doanh thu 401,2 tỷ NDT trong nửa đầu năm 2026, tăng 10%. Hãng đang tập trung mở rộng hạ tầng tính toán cho AI, ra mắt mô hình Hy3 và thử nghiệm trợ lý ảo 'Tiểu Vi' trên WeChat.
Elon Musk tuyên bố doanh thu từ AI của SpaceX sẽ vượt tổng các mảng kinh doanh khác vào tháng 9, đồng thời đẩy mạnh huấn luyện mô hình Grok bằng dữ liệu nội bộ và kế hoạch đưa trung tâm dữ liệu lên không gian.