Chết tiệt, giờ bình luận toàn những kẻ giả nhân giả anh thật nhiều, và việc họ chỉnh AI phản hồi cũng giống hệt nhau. Chúng mua gợi ý và khóa học ở đâu vậy?
Grok Bot đã cập nhật một vai trò Agent chính được gọi là Grok Bot
Nó có thể giúp bạn phân công nhiệm vụ và tạo ra nhiều loại Bot khác nhau để phân công
Tính dễ dùng đã được cải thiện đáng kể—việc người dùng phổ thông phải tự tùy chỉnh nhiều Bot thì quá rắc rối
Người dùng gần như không hề cảm nhận được công cụ, và cũng không biết nên phân loại Bot dựa trên nhiệm vụ như thế nào; có lẽ là do Muse đã được sửa lại
Tối qua Anthropic đã cho ra mắt Claude mods, PI bản cập nhật 1.0 gần đây cũng đã giới thiệu code mode, cộng thêm hệ thống plugin của các bản cập nhật Codex và mọi thứ của DeepSeek harness đều là plugin.
Có vẻ như tất cả các “siêu Agent” kiểu này đang phát triển các tính năng tương tự, cho phép người dùng tự lắp chồng lên Agent của mình một hệ thống plugin để mở rộng chức năng.
Tuy nhiên, vị trí hoạt động và cơ chế vận hành của từng hệ thống này lại không giống nhau lắm. Tôi đã thảo luận với Muse, thu thập thông tin, rồi làm một hình minh họa để mọi người có thể hiểu dễ dàng hơn về 4 sản phẩm này, cũng như những năng lực khác nhau của hệ thống plugin mà chúng sử dụng.
Sonnet 5.5 đã ra mắt rồi—một mô hình thật sự rất kỳ diệu: điểm số của nó trong các bài kiểm tra Agentic coding còn cao hơn Opus 5.5 tới 4 điểm.
Về giá cả cũng cực kỳ rẻ. Giá cho mỗi 1 triệu token đầu vào và đầu ra lần lượt là 2 USD và 10 USD, giống như GPT-6 Sol. Ngoài ra, tốc độ chạy của nó so với Sonnet 5 nhanh hơn 30%; Claude chính thức cũng cho biết chi phí đã giảm 30%.
Còn lý do vì sao hiệu suất của nó trong Agentic coding lại tương đương thậm chí còn cao hơn Opus 5.5, có thể xem phần kiểm tra theo giá.
Với Sonnet 5.5 ở mức max cố gắng, chi phí cho cùng một tác vụ cao hơn rất nhiều so với Opus 5.5—gần như ngang bằng hoặc thậm chí vượt lên. Có lẽ chính điều này là nguyên nhân khiến điểm số của nó cao.
Vì vậy, khi mọi người dùng Opus 5.5 hoặc Sonnet 5.5, tuyệt đối đừng bật max: với một số tác vụ phức tạp, nó có thể chạy ra một mức giá rất đắt, gần như ngang với Claude Fable 5.1.
Codex đã được cập nhật, điều hướng giao diện đã thay đổi rất nhiều. Ở bên trái, bạn vừa có thêm một thanh điều hướng mới; các mục như plugin, tác vụ hẹn giờ, site, dự án, bản đồ và PR giờ đều nằm trong thanh điều hướng bên trái.
Đã thêm hai trang mới: Thư viện tài nguyên và Hình ảnh.
Trong Thư viện tài nguyên có tất cả hình ảnh, ảnh, tệp, thư mục và mục đã lưu của bạn. Tất cả các tài liệu do bạn tạo ra, cũng như các tài liệu hình ảnh do AI tạo ra, đều được lưu ở đây.
Còn ở mục Hình ảnh thì trước đây, trong trang hình ảnh gốc của ChatGPT, có một số mẫu và lời nhắc được dùng cho mô hình GPT-Image.
Thực ra như vậy là tốt hơn.
Nếu không thì trước đây mọi thứ lại nằm ở phía trên cùng. Khi dự án và các cuộc trò chuyện ngày càng nhiều, mỗi lần tìm mấy cổng vào phía trên bạn đều phải cuộn trở lại, rất phiền.
Ngoài ra lần này, CodePilot của thầy Cất đi trước Codex một phiên bản. Vài tháng trước đã thêm Thư viện tài nguyên, tổng hợp toàn bộ kết quả nội dung do AI tạo của bạn thành một trang: ví dụ như các tư liệu như hình ảnh, video, trang web, âm thanh.
Bạn cũng có thể nhảy trực tiếp từ kết quả trong Thư viện tài nguyên quay trở lại cuộc trò chuyện để xem cụ thể cách làm, rất tiện để quản lý. Đồng thời cũng thuận lợi để các mô hình khác gọi và tái sử dụng các tư liệu đó.
Tuy nhiên, cũng có nhiều người thấy không tiện, vì không quen nhìn như vậy. Những thay đổi lớn như thế này chắc chắn sẽ có trường hợp như vậy.
Dùng Opus 5.5 làm animation kết toán khi chơi cũng rất tuyệt!
Ban đầu nó tạo ra các icon SVG dạng 2D, sau đó mình bảo nó chuyển sang hiệu ứng 3D như thế này—phong phú hơn nhiều, đồng thời cũng tối ưu thêm phần hiệu ứng ánh sáng, v.v.
Đây là phiên bản rương kho báu đầu tiên, phía sau còn có phiên bản huy hiệu
Muse là thật sự bùng nổ, trực tiếp leo lên vị trí số 1 trên bảng xếp hạng App Store khu vực Mỹ. Ngày công bố chính thức tích hợp, Shopify liền tăng 13%.
Vừa đúng lúc đó, bạn tôi làm Today AI cũng đã ra mắt tại thị trường Trung Quốc.
Muse đã thổi bùng khái niệm Personal Agent; thực ra trước đó Grok bot cũng đã có những dấu hiệu.
Tiếc là Muse khi dùng cho chúng ta lại khá rắc rối, rất tốn công (dù sao Meta đã tích lũy kinh nghiệm quản trị rủi ro trong vài chục năm, còn chặt chẽ hơn cả Anthropic).
Today AI có lẽ cũng là một trong những Personal AI đầu tiên làm khá hoàn chỉnh và có thể sử dụng tại thị trường nội địa.
Mình nghĩ loại Agent này cuối cùng đã hình thành một dạng ứng dụng AI mẫu mực mà không cần “ngưỡng” tiếp cận. Đây là lần đầu tiên mình nhận ra rằng người dùng cuối thật ra không quá quan tâm tầng lõi của Agent dùng mô hình gì. Dù không thể chuyển đổi mô hình thì mọi người vẫn sẵn sàng dùng.
Thực ra, ba nhu cầu cốt lõi nhất của Personal AI theo mình là:
Nó có thể hiểu bạn không? Nó có thể chủ động tìm đến bạn không? Khi tìm đến bạn, liệu nó có thể dựa trên ngữ cảnh để đưa ra những gợi ý thực sự hữu ích không?
Lấy Today AI làm ví dụ, nó chủ yếu gồm ba phần:
Máy tính đám mây: Trước đây, vấn đề của các máy ảo là nó sẽ tắt máy. Còn mình nghĩ việc máy tính đám mây không tắt là một mắt xích cực kỳ quan trọng của Personal AI. Mọi thứ của bạn luôn nằm trên chính chiếc máy đó; đây mới là một “máy tính đám mây” thực sự. Tư duy Today nhất quán với Muse: âm thầm thích nghi, người dùng hoàn toàn không cần cảm nhận sự tồn tại của máy tính đám mây.
Bộ kết nối: Có thể lấy được ngữ cảnh từ các kênh khác của bạn nhanh chóng và chỉ bằng một nút hay không. Phần khó nhất của ngữ cảnh chính là lấy được. Bên ngoài, các công ty lớn như Google có thể trực tiếp cung cấp MCP; còn trong nước có thể sẽ khó hơn.
Cuối cùng chính là ngữ cảnh, và dựa trên ngữ cảnh đó, liệu có thể tạo ra nhiều hành động chủ động cùng những gợi ý phù hợp hay không—điều này cũng rất quan trọng.
Thực ra, với đa số người, các kịch bản “năng suất cao” chuyên sâu lại không phải là số ít. Nhiều lúc chỉ cần AI giúp ghi nhớ thông tin, sắp xếp kế hoạch là đủ.
Trong đời sống thì lại có rất nhiều tình huống thực sự cần AI: chẳng hạn họ có thể kết nối với Apple Health, mỗi ngày dựa trên tình trạng cơ thể của bạn để đưa ra gợi ý. Có những ngữ cảnh này thì lời khuyên về sức khỏe sẽ chính xác và đầy đủ hơn.
Học tập, tình hình tài chính, chuyện của con cái và những việc lặt vặt trong gia đình: những hạng mục cần theo dõi lâu dài cũng rất cần.
Tất nhiên nói thật: với các sản phẩm kiểu này, chỉ khi cấu hình bộ kết nối ngữ cảnh đủ tốt thì càng dùng càng chuẩn. Vì vậy nếu lúc đầu bạn thấy nó chưa thực sự hiểu bạn, cũng có thể dùng thêm vài ngày, rồi tăng tương tác thử xem.
Đồng thời, điều này cũng cho thấy làm sao để người dùng có thể tiếp cận mà không bị “cảm giác” rằng mình đang thiết lập—đây cũng là một bài toán cực kỳ quan trọng.
Mình nghĩ đây chính là hai đặc tính khiến Personal Agent rất quan trọng:
Thứ nhất, bạn không cần quan tâm các chi tiết kỹ thuật tầng lõi của AI; cứ dùng là được;
Thứ hai, bạn có thể đồng bộ thông tin của chính mình lên rất nhanh. Rất nhiều khi, sau khi thông tin đã tích lũy đủ, thường là bạn còn chưa kịp nói ra, nó đã biết bạn định làm gì và thậm chí đã giúp bạn chuẩn bị xong.
Hệ thống kiểm soát rủi ro của Anthropic trước Meta thì đúng là chỉ như “đàn em”. Sản phẩm của Zuck nói không cho bạn dùng thì bạn căn bản không dùng được, thậm chí không đăng ký tài khoản được.
Có vẻ hiện tại việc phát hành model chỉ có thể đi theo hai thái cực:
Một là làm cho model rẻ nhất nhưng vẫn làm được thật “đỉnh”; hoặc là trực tiếp làm model tiên phong nhất, nếu không thì hoàn toàn không có thảo luận và mức độ sử dụng.
Hai lần ra mắt tối qua: Grok 4.7 và Mimo V2.6. Khả năng của cả hai trong các bài đánh giá của bên thứ ba thì đều gần như tương đương, nhưng chênh lệch về giá quá lớn.
Mimo V2.6 Pro khi hit cache: giá đầu vào là ¥0.025, đầu ra là ¥6. Còn Grok 4.7, nếu quy đổi từ USD thì giá đầu vào đã là ¥3.35, và đầu ra thậm chí lên tới ¥40.
Sau khi xem một số phản hồi và bài đánh giá trên Twitter sáng nay về Grok 4.7, chủ yếu có một lời than phiền là quá đắt, và một ý kiến khác là hiệu quả có thể không tốt bằng—vừa chậm vừa không ổn.
Giá của Mimo hiện rẻ hơn ít nhất gấp đôi so với mức “đáy” của DeepSeek V4 (dù là Flash hay Pro) hiện tại.
Ví dụ: giá đầu ra của Mimo V2.6 Flash là ¥2, còn DeepSeek V4.1 Flash là ¥4.
Ngoài ra, Mimo V2.6 hiện có vẻ sẽ bắt đầu giảm giá miễn phí trên OpenCode từ tuần sau.
Mimo cũng đã ra mắt phiên bản desktop riêng; dường như là một mức phí đăng ký riêng, có thể thử. Trong bản desktop còn kèm các model tạo ảnh, có thể kết hợp để vẽ một số giao diện kiểu như vậy.
Có lẽ cả hai bên đều nghĩ rằng hôm nay chiều OpenAI có thể sẽ tung model mới (có thể là GPT-6 Sol và GPT-6 Luna, nghe nói cực kỳ rẻ). Vì muốn phát hành trước OpenAI nên cuối cùng lại “đụng” lịch với nhau.
Đăng nhập để khám phá thêm nội dung
Tham gia cùng người dùng tiền mã hóa toàn cầu trên Binance Square
⚡️ Nhận thông tin mới nhất và hữu ích về tiền mã hóa.
💬 Được tin cậy bởi sàn giao dịch tiền mã hóa lớn nhất thế giới.
👍 Khám phá những thông tin chuyên sâu thực tế từ những nhà sáng tạo đã xác minh.