Đóng

Công cụ AI hôm nay: Ollama chạy trí tuệ nhân tạo ngay trên máy tính cá nhân

Có một nhóm công việc mà mọi cơ quan đều gặp: cần dùng trí tuệ nhân tạo để đọc và tóm tắt tài liệu, nhưng tài liệu lại là thứ không được phép gửi ra ngoài.

Công cụ này làm được gì? 

Ollama là phần mềm miễn phí giúp tải và chạy các mô hình trí tuệ nhân tạo ngay trên máy tính của bạn, thay vì gửi câu hỏi lên máy chủ của một hãng nào đó. Khi bạn đưa một tệp tài liệu vào, tệp ấy được xử lý tại chỗ, không có gói dữ liệu nào đi ra ngoài.

Việc nó làm tốt nhất là đọc và xử lý tài liệu dài: tóm tắt báo cáo, rút ý chính từ văn bản nhiều trang, phân loại hàng loạt hồ sơ, dịch thô, soạn bản nháp. Đây đúng là những việc chiếm nhiều thời gian nhất của công tác văn phòng, và cũng đúng là những việc mà tài liệu thường không được phép đưa lên mạng.

Giao diện công cụ AI Ollama. Ảnh: Ollama.com

Dùng thử trong 5 phút

Bước 1. Vào trang ollama.com, tải bản dành cho Windows hoặc macOS, cài như một phần mềm thông thường.

Bước 2. Mở cửa sổ dòng lệnh, gõ lệnh tải mô hình. Người mới nên bắt đầu với một mô hình nhỏ để máy nhẹ hơn, khi quen thì chuyển lên mô hình lớn.

Bước 3. Gõ lệnh chạy mô hình rồi đặt câu hỏi bằng tiếng Việt như khi trò chuyện với các trợ lý quen thuộc.

Bước 4. Muốn cho nó đọc một tệp tài liệu thì đưa nội dung tệp vào cùng câu lệnh. Với tài liệu dài, xem phần cảnh báo ở mục V vì đây là chỗ dễ sai nhất.

So sánh với hai công cụ cùng nhóm

Tiêu chí Ollama LM Studio Dùng trợ lý trên mạng
Chi phí 0 đồng 0 đồng Miễn phí có hạn mức, trả tiền nếu dùng nhiều
Dữ liệu đi đâu Ở lại trong máy Ở lại trong máy Gửi lên máy chủ của hãng
Cách dùng Dòng lệnh, hợp với người kỹ thuật Có giao diện, dễ cho người mới Dễ nhất, chỉ cần trình duyệt
Ghép vào phần mềm sẵn có Rất tốt, có sẵn cổng kết nối Được Được, nhưng tính phí theo lượt
Chất lượng trả lời Khá, kém mô hình thương mại lớn Tương đương Ollama Tốt nhất
Yêu cầu máy Máy khỏe, cần card đồ họa Máy khỏe Máy nào cũng chạy

Kết luận so sánh: nếu chỉ cần chất lượng trả lời cao nhất và tài liệu không nhạy cảm thì dùng trợ lý trên mạng vẫn hơn. Ollama thắng ở đúng một điểm, nhưng là điểm quyết định với cơ quan nhà nước và doanh nghiệp: dữ liệu không rời khỏi máy.

Hợp với ai, không hợp với ai? 

Nên dùng nếu bạn thuộc nhóm này:

Cơ quan, đơn vị thường xuyên xử lý tài liệu nội bộ, hồ sơ nhân sự, dữ liệu chưa công bố, tức là những thứ không được phép đưa lên dịch vụ đặt máy chủ ở nước ngoài.

Doanh nghiệp cần xử lý khối lượng lớn và đều đặn, ví dụ phân loại hàng nghìn hồ sơ mỗi tháng, vì khi đó chi phí trả theo lượt của dịch vụ trên mạng sẽ cộng lại thành khoản đáng kể.

Người muốn học cách trí tuệ nhân tạo hoạt động, vì chạy tại chỗ cho phép nhìn thấy và điều chỉnh các tham số mà dịch vụ trên mạng che đi.

Chưa nên dùng nếu:

Máy tính không có card đồ họa rời hoặc bộ nhớ dưới 16 GB, vì mô hình cỡ vừa sẽ chạy rất chậm hoặc không chạy nổi.

Công việc đòi hỏi chất lượng câu chữ cao nhất, ví dụ viết bài hoàn chỉnh để đăng, vì mô hình chạy tại chỗ còn kém các mô hình thương mại lớn về văn phong.

Bạn không quen dùng dòng lệnh và không có người hỗ trợ kỹ thuật. Trường hợp này nên bắt đầu bằng công cụ có giao diện.

Cảnh báo quan trọng nhất

Đây là điều Báo Công Thương phát hiện khi thử nghiệm và cho rằng người dùng cần biết trước. Ollama mặc định chỉ đọc khoảng 2.048 đơn vị văn bản, tương đương vài trang giấy. Khi bạn đưa vào một tài liệu dài hơn, phần vượt quá bị cắt lặng lẽ ở phía máy chủ, nhưng mô hình vẫn trả lời như thể đã đọc hết.

Hậu quả là bản tóm tắt trông rất hợp lý nhưng thiếu hẳn nửa sau tài liệu, và người đọc không có cách nào biết. Mọi lời nhắc kiểu hãy đọc kỹ toàn bộ đều vô hiệu, vì mô hình không hề biết mình đang nhìn dữ liệu thiếu. Cách chữa là khai báo tường minh mức đọc lớn hơn mỗi lần gọi, chia tài liệu theo mục rồi xử lý từng phần, và đo lại xem mục nào chưa được xử lý.

Cảnh báo thứ hai: mô hình chạy tại chỗ vẫn có thể bịa. Khi giao việc đọc tài liệu, tuyệt đối không dùng thẳng kết quả làm trích dẫn, mà phải mở tài liệu gốc đối chiếu nguyên văn.

Giá và điều kiện

Hạng mục Thực tế
Phí phần mềm 0 đồng, mã nguồn mở
Phí theo lượt dùng Không có
Dung lượng tải về Mô hình cỡ vừa khoảng 9 GB, mô hình nhỏ khoảng 2 GB
Bộ nhớ card đồ họa nên có 16 GB cho mô hình cỡ vừa
Chi phí thật Nằm ở phần cứng và điện, không nằm ở phần mềm

Hồ sơ phép thử

Theo quy định của chuyên mục, mọi bài đánh giá công cụ đều phải công khai phép thử đã thực hiện.

Nội dung Chi tiết
Ngày thử 01/8/2026
Mô hình dùng qwen3:14b, dung lượng 9,3 GB
Mô hình giám sát chéo deepseek-r1:14b, dung lượng 9,0 GB
Máy thử Card đồ họa 16 GB bộ nhớ
Việc giao Đọc trọn hai tài liệu 32.229 và 24.149 ký tự, trích lọc từng mục
Tham số ép Mức đọc khai báo tường minh 12.288, thay cho mặc định 2.048
Kết quả đo Độ phủ 100% trên 87 mục và 100% trên 34 mục, đo bằng đối chiếu máy chứ không qua mô hình
Điều mô hình giám sát bắt được Bốn mục bị xử lý hời hợt mà phép đo tự động không thấy, trong đó một cảnh báo sai đã được người kiểm tra bác bỏ sau khi đối chiếu bản gốc
Chi phí 0 đồng

Điểm rút ra từ phép thử: phép đo tự động chỉ biết một mục có được xử lý hay không, chứ không biết xử lý kỹ hay hời hợt. Vì vậy cần cả hai lớp, đo bằng máy và một mô hình khác chấm chéo, rồi cuối cùng vẫn phải có người đọc lại bản gốc. 

Nguồn: