Mở 3 tab trình duyệt, dán cùng một câu hỏi vào mỗi tab, rồi liên tục chuyển đổi qua lại giữa chúng để đối chiếu câu trả lời – đó là cách thông thường để so sánh các mô hình AI, và nhiều người thường tận dụng các chatbot miễn phí theo kiểu này để không bao giờ phải trả phí.
Msty Studio thực hiện công việc tương tự chỉ trong một cửa sổ duy nhất. Ứng dụng này chạy nhiều mô hình cùng lúc với cùng một câu lệnh, đặt các câu trả lời cạnh nhau để dễ so sánh, và gói miễn phí đã đáp ứng đầy đủ mọi nhu cầu của bạn. Sự khác biệt khi so sánh không nằm nhiều ở nội dung câu trả lời nhận được, mà chủ yếu là ở mức độ tin cậy mà bạn dành cho chúng.
Msty Studio là gì?
Msty Studio là công cụ cung cấp giao diện thân thiện để tương tác với các mô hình được cài đặt cục bộ và chuyển đổi giữa chúng trong quá trình trò chuyện.
Những ưu điểm nổi bật của Msty Studio
Msty Studio tập hợp mọi mô hình vào một cửa sổ duy nhất
Mỗi khung hiển thị duy trì ngữ cảnh riêng biệt, và điều này rất quan trọng
Msty Studio là một không gian làm việc trên desktop do CloudStack phát triển, cho phép truy cập các mô hình cục bộ và những nhà cung cấp dịch vụ đám mây thông qua một giao diện thống nhất. Ứng dụng này hỗ trợ Windows, macOS và Linux, đồng thời không yêu cầu người dùng phải tạo tài khoản để bắt đầu sử dụng.
Có thể bỏ qua tùy chọn mô hình cục bộ trong quá trình thiết lập, vì các mô hình nhỏ chạy trên laptop tầm trung thường có tốc độ chậm đến mức gây khó chịu. Thay vào đó, hãy sử dụng OpenRouter key; giải pháp này cho phép truy cập hàng chục nhà cung cấp dịch vụ chỉ với một thông tin xác thực duy nhất. Hiện có nhiều công cụ miễn phí khác cho phép chạy AI trên máy tính mà không cần đăng ký thuê bao, và một số công cụ vận hành mô hình rất mượt mà. Tuy nhiên, Msty Studio lại vượt trội hơn ở khả năng so sánh các mô hình này với nhau.
Tính năng "Split Chats" cung cấp cho mỗi mô hình một khung hiển thị và lịch sử trò chuyện riêng biệt, nhờ đó mỗi khung sẽ đưa ra câu trả lời độc lập mà không bị ảnh hưởng bởi kết quả của các mô hình khác. Sự độc lập đó là một yếu tố quan trọng, không phải chi tiết vụn vặt.
Điểm tương đồng và khác biệt giữa ba mô hình
Chính sự bất đồng mới là điều đáng để lưu tâm
Đặt cùng một câu hỏi cho cả ba mô hình:
Làm thế nào để chi 600 USD mua một chiếc laptop phục vụ nhu cầu viết lách, lướt web và chỉnh sửa ảnh cơ bản? Hãy đưa ra ba câu cho mỗi phần: những yếu tố cần ưu tiên và những yếu tố có thể cắt giảm.
Cả ba mô hình đều đưa ra cùng một câu trả lời về những thứ nên cắt giảm: Hãy bỏ qua card đồ họa rời, khung máy bằng kim loại cao cấp và màn hình có tần số quét cao. Ba mô hình từ ba phòng thí nghiệm khác nhau nhưng lại có chung một câu trả lời; sự đồng thuận này cho thấy vấn đề đã có lời giải rõ ràng.
Tuy nhiên, chúng lại có ý kiến khác nhau về dung lượng bộ nhớ (RAM). GLM và Gemma đều đề xuất mức 16GB. Trong khi đó, Nemotron cho rằng 8GB là đủ và còn đưa ra gợi ý cụ thể hơn: một chiếc laptop siêu di động cỡ 13-14 inch, trang bị chip Core i5 hoặc Ryzen 5, ổ cứng SSD 256GB và màn hình IPS độ phân giải 1080p - những thông số mà nó tính toán là phù hợp với ngân sách 600 USD.
Sự khác biệt này rất đáng chú ý trong tầm giá đó, bởi chiếc laptop mà Nemotron mô tả là một sản phẩm hoàn toàn có thể tìm mua được trên thị trường.
Phiên bản miễn phí của ChatGPT xử lý rất tốt hầu hết các câu hỏi và đã được bổ sung nhiều tính năng vốn trước đây chỉ dành cho người dùng trả phí. Hạn chế của nó nằm ở cấu trúc vận hành hơn là chất lượng câu trả lời: một mô hình trong một luồng hội thoại không thể cho bạn biết rằng một mô hình khác có thể sẽ đưa ra câu trả lời khác biệt.
Các bảng hiển thị quá trình tư duy cho thấy lộ trình xử lý đã diễn ra
Các bảng hiển thị quá trình tư duy hóa ra lại thú vị hơn cả câu trả lời cuối cùng. GLM ban đầu soạn thảo phản hồi dựa trên mức RAM 8GB, nhưng sau đó tự dừng lại. Bảng tư duy ghi nhận rằng 8GB là hơi thấp cho tác vụ chỉnh sửa ảnh, và mô hình đã điều chỉnh con số này lên 16GB trước khi đưa ra câu trả lời chính thức.
Không có chi tiết nào trong câu trả lời cuối cùng hé lộ quá trình đó. Khi xem bảng tư duy, bạn sẽ biết rằng con số 16GB là kết quả của sự cân nhắc kỹ lưỡng hơn là phản xạ ban đầu; thông tin này rất đáng giá, nhất là khi so sánh với một mô hình khác đưa ra kết quả hoàn toàn khác biệt.
Các bảng này cũng cho thấy sự khác biệt trong cách thức hoạt động của các mô hình. GLM dành 14 giây để liệt kê chi tiết các ràng buộc và ưu tiên theo từng mục. Nemotron suy nghĩ nhanh và phác thảo câu trả lời chỉ với ba câu. Gemma hoàn toàn không hiển thị quá trình tư duy và trả lời với tốc độ 19,90 token mỗi giây, so với mức 56,85 token mỗi giây của GLM.
Knowledge Stack và những lợi thế thực sự của gói miễn phí
Knowledge Stack đảm nhiệm việc truy xuất thông tin. Bạn có thể thêm tài liệu, thư mục hoặc ghi chú, chọn một mô hình nhúng (embedding model), và các mô hình sẽ trả lời dựa trên dữ liệu của bạn thay vì chỉ dựa vào dữ liệu huấn luyện ban đầu. Việc cho ba mô hình cùng xử lý một tài liệu sẽ làm nổi bật những khía cạnh trọng tâm khác nhau từ nguồn dữ liệu do chính bạn kiểm soát; đây chính là điểm khiến mô hình AI riêng tư (có thể tự vận hành) trở nên thực sự hữu ích.
Prompt Studio quan trọng hơn vẻ bề ngoài của nó. Việc lưu lại một câu lệnh (prompt) dùng để so sánh đồng nghĩa với việc mọi bài kiểm tra sau này đều sử dụng cùng một cách diễn đạt; và sự đồng nhất về câu chữ chính là yếu tố duy nhất giúp các câu trả lời có thể so sánh được với nhau. Tính năng này nằm trong gói miễn phí, cùng với các tính năng khác như trò chuyện với mô hình cục bộ và trực tuyến, Split Chats, Agent Mode, cũng như các công cụ Persona, Skill và Media Studio.
Gói Aurum có giá 149 USD/năm hoặc 349 USD (trả một lần), bổ sung các tính năng như Msty Studio Web, Turnstiles, Forge Mode, Insights và Live Contexts. Các mô hình miễn phí cũng đi kèm với những hạn chế riêng. OpenRouter giới hạn mức sử dụng ở 20 yêu cầu mỗi phút và 50 yêu cầu mỗi ngày cho đến khi bạn mua thêm tín dụng; ngoài ra, các nhà cung cấp có thể thu hồi dung lượng miễn phí mà không cần báo trước.
Gemma đã thất bại 3 lần trước khi yêu cầu trả một khoản phí cực nhỏ để tiếp cận cùng một mô hình đó theo cách khác. Các mô hình cũng thường âm thầm thay đổi ở phía sau hệ thống; đây là một lý do nữa để bạn nên cân nhắc sử dụng song song nhiều mô hình cùng lúc.
Giấy phép miễn phí của Msty Studio chỉ áp dụng cho mục đích sử dụng cá nhân, phi thương mại. Đối với công việc chuyên nghiệp có thu phí, bạn cần có giấy phép Aurum.
Một câu lệnh, ba câu trả lời, và cơ sở để tin tưởng vào một trong số đó
Điều mọi người mong muốn tiếp theo ở workspace này là một bộ câu lệnh cố định - được sử dụng mỗi khi cần đưa ra quyết định quan trọng có ảnh hưởng đến chi phí hay nguồn lực - và hướng vào Knowledge Stack chứa tài liệu tham khảo của riêng bạn thay vì tìm kiếm trên mạng mở. Việc thiết lập hệ thống này sẽ tốn công sức của một ngày cuối tuần, nhưng nó sẽ giúp các lần so sánh sau đó trở nên sắc bén và hiệu quả hơn nhiều.
Đối với bất kỳ vấn đề nào mà việc sai sót sẽ gây lãng phí thời gian hoặc tiền bạc, thì việc gửi một câu lệnh tới ba mô hình và xem xét những điểm khác biệt trong câu trả lời của chúng hoàn toàn xứng đáng với vài phút bỏ ra để thiết lập. Tuy nhiên, nếu chỉ cần tra cứu một câu lệnh mà bạn chỉ nhớ mang máng, thì sử dụng một chatbot duy nhất vẫn là cách nhanh chóng hơn.
Hướng dẫn AI
AI Tools
Học IT









AI
Hàm Excel