Chạy các mô hình AI tiên tiến tại chỗ đã trở thành một giải pháp thực tế cho các nhà phát triển và nhà nghiên cứu cần tốc độ, quyền riêng tư và kiểm soát. EXAONE Deep, một mô hình AI suy luận đổi mới từ LG AI Research, xuất sắc trong việc giải quyết các vấn đề phức tạp trong toán học, khoa học và lập trình. Bằng cách sử dụng Ollama, một nền tảng được thiết kế để triển khai các mô hình ngôn ngữ lớn trên phần cứng cục bộ, bạn có thể thiết lập EXAONE Deep trên máy tính của mình một cách dễ dàng.
Làm việc với các mô hình AI như EXAONE Deep thường liên quan đến việc tích hợp API. Apidog là một công cụ miễn phí, mạnh mẽ giúp thử nghiệm và gỡ lỗi API trở nên dễ dàng. Tải Apidog ngay hôm nay để tối ưu hóa quy trình phát triển của bạn và đảm bảo giao tiếp suôn sẻ với thiết lập AI cục bộ của bạn.
Hãy cùng tìm hiểu quy trình này.
EXAONE Deep và Ollama là gì?
Trước khi tiếp tục, hãy làm rõ những gì EXAONE Deep và Ollama là và tại sao chúng quan trọng.
EXAONE Deep là một mô hình AI tiên tiến được phát triển bởi LG AI Research. Khác với các mô hình ngôn ngữ thông thường, nó là một AI suy luận, có nghĩa là nó tập trung vào lý luận và giải quyết vấn đề. Nó tự động tạo ra giả thuyết, xác minh chúng và cung cấp câu trả lời cho các câu hỏi phức tạp trong các lĩnh vực như toán học, khoa học và lập trình. Điều này khiến nó trở thành một tài sản quý giá cho bất kỳ ai đang đối mặt với các thách thức kỹ thuật.

Trong khi đó, Ollama là một nền tảng mã nguồn mở cho phép bạn chạy các mô hình ngôn ngữ lớn, bao gồm cả EXAONE Deep, trên máy tính cục bộ của bạn. Nó sử dụng công nghệ container hóa để quản lý các phụ thuộc và tài nguyên của mô hình, đơn giản hóa quy trình triển khai. Bằng cách chạy EXAONE Deep tại chỗ với Ollama, bạn có được một số lợi thế:
- Quyền riêng tư: Dữ liệu của bạn được lưu trên thiết bị của bạn, tránh bị lộ ra ngoài đám mây.
- Tốc độ: Xử lý cục bộ giảm thiểu độ trễ từ các cuộc gọi mạng.
- Độ linh hoạt: Bạn kiểm soát thiết lập và có thể điều chỉnh nó theo nhu cầu.
Yêu cầu cần có để chạy EXAONE Deep tại chỗ
Để chạy EXAONE Deep tại chỗ, hệ thống của bạn phải đáp ứng một số tiêu chuẩn phần cứng và phần mềm nhất định. Vì đây là một mô hình AI nặng tài nguyên, việc có thiết lập đúng là rất quan trọng. Đây là những gì bạn cần:
Yêu cầu phần cứng
- RAM: Ít nhất 16GB. Nhiều hơn thì tốt hơn cho hiệu suất mượt mà hơn.
- GPU: Một GPU NVIDIA riêng biệt với ít nhất 8GB VRAM. Điều này đảm bảo mô hình chạy hiệu quả, vì EXAONE Deep phụ thuộc vào tăng tốc GPU cho các nhiệm vụ suy luận.
- Storage: Đủ không gian trống (20-50GB) để lưu trữ mô hình và các phụ thuộc của nó.
Yêu cầu phần mềm
- Hệ điều hành: Linux hoặc macOS. Windows có thể hoạt động nhưng thường yêu cầu thêm bước, vì vậy Linux/macOS được khuyến nghị.
- Internet: Kết nối ổn định để tải xuống Ollama và mô hình EXAONE Deep.
Với những điều này, bạn đã sẵn sàng cài đặt Ollama và khởi động EXAONE Deep. Hãy chuyển sang quy trình cài đặt.
Cài đặt Ollama trên hệ thống của bạn
Ollama là cánh cửa của bạn để chạy EXAONE Deep tại chỗ, và việc cài đặt của nó rất dễ dàng. Làm theo các bước sau để thiết lập:
Tải xuống Ollama:
- Truy cập trang web Ollama và tải xuống tệp nhị phân cho hệ điều hành của bạn.

- Hoặc, đối với Linux hoặc macOS, sử dụng lệnh terminal này:
curl -fsSL https://ollama.ai/install.sh | sh
Tập lệnh này tự động hóa quá trình tải xuống và thiết lập.
Kiểm tra cài đặt:
- Sau khi cài đặt, xác minh rằng Ollama hoạt động bằng cách chạy:
ollama --version

- Bạn sẽ thấy số phiên bản (ví dụ:
0.1.x). Nếu không, hãy kiểm tra lại cài đặt của bạn hoặc tham khảo Ollama GitHub để được trợ giúp.
Khi Ollama đã được cài đặt, bạn đã sẵn sàng tải xuống và chạy EXAONE Deep. Hãy chuyển sang bước tiếp theo.
Thiết lập và chạy EXAONE Deep với Ollama
Giờ đây, Ollama đã sẵn sàng, hãy cùng khởi động EXAONE Deep. Điều này bao gồm tải xuống mô hình và khởi chạy nó tại chỗ.
Bước 1: Tải xuống mô hình EXAONE Deep
Ollama lưu trữ EXAONE Deep trong thư viện mô hình của nó. Để tải nó về máy bạn, hãy chạy:
ollama pull exaone-deep
Lệnh này lấy các tệp mô hình. Tùy thuộc vào tốc độ internet của bạn và kích thước của mô hình (có thể lên đến vài gigabytes), điều này có thể mất vài phút. Hãy theo dõi terminal để xem cập nhật tiến độ.

Bước 2: Khởi động mô hình
Khi đã tải xuống, hãy khởi động EXAONE Deep bằng:
ollama run exaone-deep
Lệnh này khởi động mô hình, và Ollama sẽ khởi động một máy chủ cục bộ. Bạn sẽ thấy một dấu nhắc nơi bạn có thể nhập câu hỏi hoặc lệnh. Ví dụ:
> Giải 2x + 3 = 7
Mô hình xử lý và trả lại câu trả lời (ví dụ: x = 2).
Bước 3: Tùy chỉnh cài đặt (Tùy chọn)
Ollama cho phép bạn điều chỉnh cách mà EXAONE Deep chạy. Ví dụ:
- GPU Layers: Chuyển tải tính toán sang GPU của bạn với các cờ như
--num-gpu-layers. - Giới hạn bộ nhớ: Điều chỉnh mức sử dụng RAM nếu cần.
Kiểm tra tài liệu Ollama để biết chi tiết, vì các tùy chọn này phụ thuộc vào phần cứng của bạn.
Tại thời điểm này, EXAONE Deep đã hoạt động. Tuy nhiên, việc nhập lệnh trong terminal không phải là cách duy nhất để sử dụng nó. Tiếp theo, chúng ta sẽ khám phá cách tương tác với nó theo cách lập trình thông qua API của nó—và cách mà Apidog phù hợp trong quá trình này.
Sử dụng Apidog để tương tác với EXAONE Deep
Đối với các nhà phát triển xây dựng ứng dụng, việc truy cập EXAONE Deep thông qua API của nó là thực tế hơn so với dòng lệnh. May mắn thay, Ollama cung cấp một API RESTful khi bạn chạy mô hình. Đây cũng chính là lúc Apidog, một công cụ thử nghiệm API, trở nên vô giá.
Hiểu về API của Ollama
Khi bạn khởi động EXAONE Deep bằng ollama run exaone-deep, nó sẽ mở ra một máy chủ cục bộ, thường tại http://localhost:11434. Máy chủ này cung cấp các điểm cuối như:
/api/generate: Để gửi các lệnh và nhận phản hồi./api/tags: Để liệt kê các mô hình có sẵn.
Cài đặt Apidog
Thực hiện theo các bước này để sử dụng Apidog với EXAONE Deep:
Cài đặt Apidog:
- Tải xuống và cài đặt nó. Nó miễn phí và hoạt động trên tất cả các hệ điều hành chính.
Tạo một yêu cầu mới:
- Mở Apidog và nhấp vào “Yêu cầu mới.”
- Đặt phương thức thành
POSTvà URL thànhhttp://localhost:11434/api/generate.

Cấu hình yêu cầu:
- Trong thân yêu cầu, thêm JSON như sau:

{
"model": "exaone-deep",
"prompt": "Căn bậc hai của 16 là gì?",
"stream": false
}
- Điều này sẽ yêu cầu EXAONE Deep xử lý lệnh của bạn.
Gửi và kiểm tra:
- Nhấn “Gửi” trong Apidog. Bạn sẽ thấy phản hồi (ví dụ:
{"response": "4"}) trong giao diện của công cụ.

- Sử dụng Apidog để điều chỉnh yêu cầu, kiểm tra các trường hợp biên hoặc tự động hóa các cuộc gọi lặp đi lặp lại.
Tại sao sử dụng Apidog?
Apidog đơn giản hóa công việc với API bằng cách:
- Hiển thị phản hồi: Xem chính xác những gì EXAONE Deep trả về.
- Tiết kiệm thời gian: Lưu trữ và sử dụng lại các yêu cầu thay vì phải gõ lại chúng.
- Gỡ lỗi: Phát hiện lỗi trong các cuộc gọi API của bạn nhanh chóng.

Với Apidog, việc tích hợp EXAONE Deep vào các dự án của bạn trở nên liền mạch. Nhưng nếu bạn gặp phải vấn đề? Hãy cùng tìm hiểu cách khắc phục tiếp theo.
Khắc phục các vấn đề thường gặp
Chạy một mô hình như EXAONE Deep tại chỗ đôi khi có thể gây ra vấn đề. Dưới đây là những vấn đề thường gặp và cách khắc phục:
Vấn đề: Lỗi bộ nhớ GPU
- Triệu chứng: Mô hình gặp sự cố với thông báo “CUDA hết bộ nhớ”.
- Cách khắc phục: Giảm kích thước lô hoặc các lớp GPU. Chạy
nvidia-smiđể kiểm tra mức sử dụng và điều chỉnh cài đặt qua các cờ của Ollama.
Vấn đề: Mô hình không khởi động
- Triệu chứng:
ollama run exaone-deepthất bại với lỗi. - Cách khắc phục: Đảm bảo Docker đang chạy (
docker ps). Kiểm tra nhật ký của Ollama (ollama logs) để tìm manh mối và xác minh mô hình đã tải xuống hoàn toàn.
Vấn đề: API không phản hồi
- Triệu chứng: Các yêu cầu của Apidog bị hết thời gian hoặc trả về lỗi.
- Cách khắc phục: Xác nhận máy chủ đang chạy (
curl http://localhost:11434) và điểm cuối phù hợp với tài liệu của Ollama.
Mẹo tối ưu hóa
Để có hiệu suất tốt hơn, nâng cấp GPU của bạn hoặc thêm RAM. EXAONE Deep cần phần cứng mạnh mẽ để hoạt động tốt.
Với những giải pháp này, bạn sẽ giữ cho thiết lập của mình hoạt động trơn tru. Hãy kết thúc.
Kết luận
Chạy EXAONE Deep tại chỗ bằng Ollama mở ra một thế giới lý luận dựa trên AI mà không phụ thuộc vào đám mây. Hướng dẫn này đã cho bạn thấy cách cài đặt Ollama, thiết lập EXAONE Deep, và sử dụng Apidog để tương tác với API của nó. Từ việc giải quyết các vấn đề toán học đến hỗ trợ lập trình, thiết lập này giúp bạn thực hiện các nhiệm vụ khó khăn một cách hiệu quả.
Bạn đã sẵn sàng để khám phá? Khởi động Ollama, tải xuống EXAONE Deep và lấy Apidog để tối ưu hóa quy trình làm việc của bạn. Sức mạnh của AI cục bộ đã nằm trong tầm tay bạn.

