22/08

Thứ Bảy · 6 tin
Gabriel@gabriel1
Hướng dẫnĐiểm AI 18/100

Cách đánh giá AI: Tập trung vào trải nghiệm người dùng thay vì các chỉ số ảo

any recommendations for someone in evals that care more about the behavior and experience for the us…

DịchLời khuyên cho đội ngũ đánh giá mô hình AI: Hãy ưu tiên phân tích hành vi và trải nghiệm thực tế của người dùng thay vì chỉ dựa vào các con số benchmark mang tính hình thức.

21/08

Thứ Sáu · 5 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 24/100

Mô hình AI 'lắm lời' đến mức người dùng phải nhắc nhở giữ im lặng mỗi lượt chat

i have not verified this but this is absolutely bananas if true. How hard did they RL-fry our boy to…

DịchNgười dùng phản ánh các mô hình AI hiện nay gặp vấn đề nghiêm trọng về tuân thủ chỉ dẫn, buộc họ phải liên tục nhắc nhở AI không được nói lan man. Điều này đặt ra nghi vấn về việc quá trình huấn luyện RL (Học tăng cường) đang bị đẩy đi quá xa.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 47/100

Vấn đề văn phong đơn điệu của các mô hình ngôn ngữ lớn cần được nghiên cứu nghiêm túc

Even when LLMs write well, the lack of variety in style is crippling. Reading the same prose in your…

DịchDù AI viết rất tốt, sự thiếu đa dạng trong văn phong đang trở thành điểm yếu chí mạng. Việc lặp lại một kiểu giọng điệu trong mọi ngữ cảnh từ quảng cáo đến thuyết trình sẽ gây cảm giác nhàm chán và thiếu tự nhiên.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 34/100

Sự bùng nổ của các chế độ AI khiến người dùng lạc lối trong tính năng

A confusing thing about the proliferation of AI modes (ChatGPT Work/Codex/Chat, Claude Cowork/Code/C…

DịchSự đa dạng hóa quá nhanh của các mô hình và ứng dụng AI khiến người dùng khó theo dõi các tính năng như plugin, bộ nhớ hay quyền truy cập dữ liệu đang nằm ở đâu.

20/08

Thứ Năm · 3 tin
Artificial Intelligence News
Nghiên cứuĐiểm AI 57/100

Nghiên cứu: 1/3 quảng cáo trên ChatGPT không liên quan đến nội dung hội thoại

Phân tích từ Searchable cho thấy 33% quảng cáo trên ChatGPT không khớp với ngữ cảnh hội thoại và 68% xuất hiện trong các cuộc trò chuyện không có ý định mua hàng, dù OpenAI khẳng định tỷ lệ người dùng tắt quảng cáo đang giảm dần.

Suno@suno
Sản phẩmĐiểm AI 33/100

Suno nâng cấp lớn cho tính năng danh sách phát trên di động và web

Playlists on mobile and Web just got a serious upgrade… Here's some of our favorite updates 🧵

DịchSuno vừa tung ra bản cập nhật quan trọng cho tính năng danh sách phát trên cả nền tảng web và ứng dụng di động, mang đến trải nghiệm quản lý âm nhạc mượt mà và tiện lợi hơn cho người dùng.

19/08

Thứ Tư · 5 tin
Elon Musk@elonmusk
Sản phẩmĐiểm AI 23/100

Cùng sự kiệnGrok Bot cập nhật tính năng nhóm thông báo trên thiết bị di động

Improvements to Grok @Bot

DịchGrok Bot vừa tung ra bản cập nhật cải thiện trải nghiệm người dùng, trong đó các thông báo trên di động giờ đây sẽ được nhóm lại theo từng Bot và hiển thị kèm biểu tượng riêng biệt.

Cùng sự kiện, tinh chọn hiển thị «Grok Build chính thức ra mắt trên web và di động cho mọi người dùng»

18/08

Thứ Ba · 7 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 29/100

Lập trình viên thất vọng: AI Agent ngày càng chậm chạp và hay mắc lỗi ngớ ngẩn

a little one sided and its not black and white, but the "its slower but still makes enough mistake…

DịchNhiều lập trình viên phàn nàn rằng các AI Agent hiện nay trở nên chậm chạp, dài dòng và thiếu chính xác hơn so với 18 tháng trước. Dù hiệu suất giảm sút, cộng đồng vẫn thừa nhận không thể quay lại cách làm cũ và buộc phải thích nghi với công nghệ này.

The Verge: AI
Hướng dẫnĐiểm AI 47/100

Tính năng nhận diện thú cưng của Google Gemini gây thất vọng: Camera Nest không thể phân biệt được các chú mèo

Tính năng Pet Memory trên Google Home thất bại trong việc nhận diện riêng biệt các chú mèo, dù người dùng phải trả phí 20 USD/tháng. Hệ thống liên tục gắn nhầm tên cho tất cả thú cưng và thiếu công cụ để người dùng chỉnh sửa lỗi.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 44/100

Khi AI trở thành 'chuyên gia IT' trong gia đình: Cha tôi tự thiết lập MacBook mới nhờ Codex

My father just got a new MacBook after years with no laptop, and he did not know how to set it up H…

DịchEthan Mollick chia sẻ câu chuyện cha mình sử dụng Codex để tự cài đặt và thiết lập MacBook mới thay vì cần đến sự trợ giúp của người thân. AI đang dần thay thế vai trò hỗ trợ kỹ thuật truyền thống nhờ khả năng giải thích đơn giản và trực quan.

Emad Mostaque@EMostaque
Hướng dẫnĐiểm AI 29/100

Trải nghiệm giới hạn của Grok: Sự thất vọng khi thiếu cơ chế dự phòng

Hit the @grok @bot limit after solid use testing things Using it as a coordinator (gave it my gpt/c…

DịchViệc Grok đột ngột dừng hoạt động khi hết hạn mức mà không có cảnh báo hay tự động chuyển sang mô hình nhẹ hơn gây ra trải nghiệm người dùng không tốt, đặc biệt khi dùng nó làm điều phối viên cho các công cụ AI khác.

17/08

Thứ Hai · 2 tin
Ethan Mollick@emollick
Hướng dẫnĐiểm AI 29/100

Dùng AI tự động trích xuất toàn bộ dữ liệu dấu trang (bookmark) trên X

A long annoyance with X is that you can't export your bookmarks, all you can do is scroll & scro…

DịchThay vì phải cuộn trang thủ công, người dùng đã sử dụng AI để điều khiển trình duyệt, tự động trích xuất và phân loại hơn 5.000 dấu trang trên X từ năm 2014 đến nay.

16/08

Chủ Nhật · 3 tin
Deedy Das@deedydas
Sản phẩmĐiểm AI 31/100

Deedy Das ra mắt website tạo trải nghiệm đắm chìm dựa trên cảm xúc

Made a lil website that takes a "mood" and turns it into a whole experience: a playlist of songs, am…

DịchMột nền tảng web mới cho phép người dùng nhập cảm xúc để tạo ra trải nghiệm đa giác quan, bao gồm danh sách nhạc, âm thanh môi trường và video nền vòng lặp phù hợp với tâm trạng.

Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 56/100

Chi phí niềm tin của AI chuyên sâu: Tại sao người dùng lại dùng Doubao để kiểm chứng?

Người dùng thường dùng các công cụ AI quen thuộc như Doubao để kiểm chứng lại kết quả từ AI chuyên sâu. Để xây dựng niềm tin, các sản phẩm AI cần thiết kế lộ trình xác thực dễ hiểu: đưa ra kết luận trước, sau đó mới dẫn chứng bằng chuỗi bằng chứng chuyên môn.

IT Home
Sản phẩmĐiểm AI 32/100

Trải nghiệm thú vị với 'Your AI Slop Bores Me': Khi con người đóng giả AI để trả lời câu hỏi

Dự án web độc đáo này cho phép người dùng đóng vai AI để giải đáp thắc mắc của người khác. Với cơ chế tích điểm và giới hạn thời gian, đây là một thử nghiệm xã hội thú vị nhằm châm biếm sự bão hòa của nội dung do AI tạo ra.

15/08

Thứ Bảy · 4 tin
IT Home
Hướng dẫnĐiểm AI 39/100

Cựu nhân viên Google tạo ra 'chatbot' ChatTJB: Đằng sau không phải AI mà là hàng vạn người thật

Thay vì dùng mô hình ngôn ngữ lớn, cựu nhân viên Google đã tạo ra ChatTJB, nơi hàng chục nghìn tình nguyện viên trực tiếp trả lời câu hỏi của người dùng. Dự án độc đáo này đã thu hút hơn 100.000 lượt truy vấn chỉ sau thời gian ngắn quảng bá.

Testing Catalog@testingcatalog
Sản phẩmĐiểm AI 40/100

Anthropic sắp ra mắt giao diện so sánh các phiên bản mô hình Claude

ANTHROPIC 🔥: Claude may get a new Model Comparison interface for users to have a simple way to see …

DịchAnthropic đang thử nghiệm tính năng cho phép người dùng so sánh trực tiếp phản hồi giữa các mô hình Claude khác nhau trong cùng một giao diện. Người dùng có thể linh hoạt chuyển đổi giữa chế độ trò chuyện thông thường và chế độ đối chiếu, kèm theo các tùy chọn quản lý bộ nhớ và lưu trữ phản hồi.

Gabriel@gabriel1
Hướng dẫnĐiểm AI 23/100

Cơn sốt AI và khoảng cách thực tế: Liệu người dùng phổ thông có đang hiểu nhầm?

me: *getting increasingly lost in abstractions and excitement about the future of work with ai* the…

DịchKhi giới công nghệ mải mê bàn về tương lai trừu tượng của AI, người dùng bình thường vẫn chỉ đang loay hoay tìm cách định nghĩa nó như một ứng dụng máy tính đơn thuần. Khoảng cách giữa kỳ vọng và thực tế cho thấy kỷ nguyên AI thực chất chỉ mới bắt đầu.

14/08

Thứ Sáu · 6 tin
Gabriel@gabriel1
Hướng dẫnĐiểm AI 14/100

Người dùng phàn nàn về việc AI lạm dụng thuật ngữ 'triage'

i still don't know what "triage" means, i never heard the word until every low taste ai started spit…

DịchNhiều người dùng cảm thấy khó chịu khi các công cụ AI liên tục sử dụng từ 'triage' (phân loại ưu tiên) trong mọi gợi ý. Đây là một ví dụ về việc AI đang dần trở nên máy móc và lặp lại các thuật ngữ chuyên môn một cách thiếu tự nhiên.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 47/100

Tại sao trải nghiệm sử dụng Opus 5 lại gây thất vọng?

Dù đạt điểm benchmark cao, Opus 5 lại gây khó chịu vì xu hướng tự ý suy diễn thay vì đặt câu hỏi làm rõ, khiến người dùng phải giám sát thủ công nhiều hơn. Tác giả cho rằng áp lực điểm số đã vô tình ưu tiên các mô hình 'liều lĩnh' thay vì sự cẩn trọng cần thiết trong lập trình.

JiQiZhiXin
Sản phẩmĐiểm AI 85/100

Tại sao nhạc AI vẫn luôn 'thiếu chút gì đó'? Giải mã rào cản sáng tạo

Dù các công cụ tạo nhạc AI như Suno đang bùng nổ, người dùng vẫn cảm thấy sản phẩm đầu ra thiếu cảm xúc và khó kiểm soát. Bài viết phân tích sự lệch pha giữa tư duy âm nhạc của con người và cách AI xử lý ngôn ngữ, lý giải tại sao việc 'ra lệnh' bằng văn bản chưa thể thay thế sự sáng tạo thực thụ.

Gabriel@gabriel1
Hướng dẫnĐiểm AI 18/100

Kỷ nguyên AI siêu tốc: Chấm dứt cảnh 'nhảy việc' giữa các tác vụ

imagine when the models are super fast, and we don't need to context switch between different tasks …

DịchKhi tốc độ xử lý của AI đạt ngưỡng siêu nhanh, người dùng không còn phải chuyển đổi qua lại giữa các tác vụ phức tạp. Bạn chỉ cần liên tục đưa ra phản hồi, giúp quy trình làm việc trở nên liền mạch và hiệu quả hơn.

JiQiZhiXin
Sản phẩmĐiểm AI 85/100

Bài kiểm tra Turing ngược: 'AI thủ công' khiến cộng đồng mạng dở khóc dở cười

Một dự án mang tên ChatTJB tại San Francisco tự xưng là mô hình ngôn ngữ lớn, nhưng thực chất là một người đàn ông tên Tucker tự tay trả lời mọi tin nhắn và vẽ hình cho người dùng. Đây là màn châm biếm hài hước về cơn sốt AI hiện nay khi mọi quy trình đều được vận hành bằng 'công suất con người'.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (45 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Trải nghiệm người dùng” — Trang 6 | AIHOT.vn