Công cụ này làm được gì?
Ollama là phần mềm miễn phí giúp tải và chạy các mô hình trí tuệ nhân tạo ngay trên máy tính của bạn, thay vì gửi câu hỏi lên máy chủ của một hãng nào đó. Khi bạn đưa một tệp tài liệu vào, tệp ấy được xử lý tại chỗ, không có gói dữ liệu nào đi ra ngoài.
Việc nó làm tốt nhất là đọc và xử lý tài liệu dài: tóm tắt báo cáo, rút ý chính từ văn bản nhiều trang, phân loại hàng loạt hồ sơ, dịch thô, soạn bản nháp. Đây đúng là những việc chiếm nhiều thời gian nhất của công tác văn phòng, và cũng đúng là những việc mà tài liệu thường không được phép đưa lên mạng.
Giao diện công cụ AI Ollama. Ảnh: Ollama.com
Dùng thử trong 5 phút
Bước 1. Vào trang ollama.com, tải bản dành cho Windows hoặc macOS, cài như một phần mềm thông thường.
Bước 2. Mở cửa sổ dòng lệnh, gõ lệnh tải mô hình. Người mới nên bắt đầu với một mô hình nhỏ để máy nhẹ hơn, khi quen thì chuyển lên mô hình lớn.
Bước 3. Gõ lệnh chạy mô hình rồi đặt câu hỏi bằng tiếng Việt như khi trò chuyện với các trợ lý quen thuộc.
Bước 4. Muốn cho nó đọc một tệp tài liệu thì đưa nội dung tệp vào cùng câu lệnh. Với tài liệu dài, xem phần cảnh báo ở mục V vì đây là chỗ dễ sai nhất.
So sánh với hai công cụ cùng nhóm
| Tiêu chí | Ollama | LM Studio | Dùng trợ lý trên mạng |
|---|---|---|---|
| Chi phí | 0 đồng | 0 đồng | Miễn phí có hạn mức, trả tiền nếu dùng nhiều |
| Dữ liệu đi đâu | Ở lại trong máy | Ở lại trong máy | Gửi lên máy chủ của hãng |
| Cách dùng | Dòng lệnh, hợp với người kỹ thuật | Có giao diện, dễ cho người mới | Dễ nhất, chỉ cần trình duyệt |
| Ghép vào phần mềm sẵn có | Rất tốt, có sẵn cổng kết nối | Được | Được, nhưng tính phí theo lượt |
| Chất lượng trả lời | Khá, kém mô hình thương mại lớn | Tương đương Ollama | Tốt nhất |
| Yêu cầu máy | Máy khỏe, cần card đồ họa | Máy khỏe | Máy nào cũng chạy |
Kết luận so sánh: nếu chỉ cần chất lượng trả lời cao nhất và tài liệu không nhạy cảm thì dùng trợ lý trên mạng vẫn hơn. Ollama thắng ở đúng một điểm, nhưng là điểm quyết định với cơ quan nhà nước và doanh nghiệp: dữ liệu không rời khỏi máy.
Hợp với ai, không hợp với ai?
Nên dùng nếu bạn thuộc nhóm này:
Cơ quan, đơn vị thường xuyên xử lý tài liệu nội bộ, hồ sơ nhân sự, dữ liệu chưa công bố, tức là những thứ không được phép đưa lên dịch vụ đặt máy chủ ở nước ngoài.
Doanh nghiệp cần xử lý khối lượng lớn và đều đặn, ví dụ phân loại hàng nghìn hồ sơ mỗi tháng, vì khi đó chi phí trả theo lượt của dịch vụ trên mạng sẽ cộng lại thành khoản đáng kể.
Người muốn học cách trí tuệ nhân tạo hoạt động, vì chạy tại chỗ cho phép nhìn thấy và điều chỉnh các tham số mà dịch vụ trên mạng che đi.
Chưa nên dùng nếu:
Máy tính không có card đồ họa rời hoặc bộ nhớ dưới 16 GB, vì mô hình cỡ vừa sẽ chạy rất chậm hoặc không chạy nổi.
Công việc đòi hỏi chất lượng câu chữ cao nhất, ví dụ viết bài hoàn chỉnh để đăng, vì mô hình chạy tại chỗ còn kém các mô hình thương mại lớn về văn phong.
Bạn không quen dùng dòng lệnh và không có người hỗ trợ kỹ thuật. Trường hợp này nên bắt đầu bằng công cụ có giao diện.
Cảnh báo quan trọng nhất
Đây là điều Báo Công Thương phát hiện khi thử nghiệm và cho rằng người dùng cần biết trước. Ollama mặc định chỉ đọc khoảng 2.048 đơn vị văn bản, tương đương vài trang giấy. Khi bạn đưa vào một tài liệu dài hơn, phần vượt quá bị cắt lặng lẽ ở phía máy chủ, nhưng mô hình vẫn trả lời như thể đã đọc hết.
Hậu quả là bản tóm tắt trông rất hợp lý nhưng thiếu hẳn nửa sau tài liệu, và người đọc không có cách nào biết. Mọi lời nhắc kiểu hãy đọc kỹ toàn bộ đều vô hiệu, vì mô hình không hề biết mình đang nhìn dữ liệu thiếu. Cách chữa là khai báo tường minh mức đọc lớn hơn mỗi lần gọi, chia tài liệu theo mục rồi xử lý từng phần, và đo lại xem mục nào chưa được xử lý.
Cảnh báo thứ hai: mô hình chạy tại chỗ vẫn có thể bịa. Khi giao việc đọc tài liệu, tuyệt đối không dùng thẳng kết quả làm trích dẫn, mà phải mở tài liệu gốc đối chiếu nguyên văn.
Giá và điều kiện
| Hạng mục | Thực tế |
|---|---|
| Phí phần mềm | 0 đồng, mã nguồn mở |
| Phí theo lượt dùng | Không có |
| Dung lượng tải về | Mô hình cỡ vừa khoảng 9 GB, mô hình nhỏ khoảng 2 GB |
| Bộ nhớ card đồ họa nên có | 16 GB cho mô hình cỡ vừa |
| Chi phí thật | Nằm ở phần cứng và điện, không nằm ở phần mềm |
Hồ sơ phép thử
Theo quy định của chuyên mục, mọi bài đánh giá công cụ đều phải công khai phép thử đã thực hiện.
| Nội dung | Chi tiết |
|---|---|
| Ngày thử | 01/8/2026 |
| Mô hình dùng | qwen3:14b, dung lượng 9,3 GB |
| Mô hình giám sát chéo | deepseek-r1:14b, dung lượng 9,0 GB |
| Máy thử | Card đồ họa 16 GB bộ nhớ |
| Việc giao | Đọc trọn hai tài liệu 32.229 và 24.149 ký tự, trích lọc từng mục |
| Tham số ép | Mức đọc khai báo tường minh 12.288, thay cho mặc định 2.048 |
| Kết quả đo | Độ phủ 100% trên 87 mục và 100% trên 34 mục, đo bằng đối chiếu máy chứ không qua mô hình |
| Điều mô hình giám sát bắt được | Bốn mục bị xử lý hời hợt mà phép đo tự động không thấy, trong đó một cảnh báo sai đã được người kiểm tra bác bỏ sau khi đối chiếu bản gốc |
| Chi phí | 0 đồng |
Điểm rút ra từ phép thử: phép đo tự động chỉ biết một mục có được xử lý hay không, chứ không biết xử lý kỹ hay hời hợt. Vì vậy cần cả hai lớp, đo bằng máy và một mô hình khác chấm chéo, rồi cuối cùng vẫn phải có người đọc lại bản gốc.