Ollama Local AI APP
🚀 Ollama Local AI là người bạn đồng hành tối ưu dành cho các nhà phát triển muốn tích hợp liền mạch các Mô hình Ngôn ngữ Lớn (LLM) cục bộ với quy trình phát triển IDE yêu thích của họ. Biến thiết bị Android của bạn thành một máy chủ proxy LLM tương thích OpenAI an toàn, siêu nhanh và có thể chuyển đổi trên mạng cục bộ.
📱 Trỏ Cursor, VS Code, Antigravity, Windsurf hoặc bất kỳ trợ lý lập trình hiện đại nào trực tiếp đến địa chỉ IP mạng LAN của điện thoại và bắt đầu sử dụng các mô hình hoặc khóa API cục bộ — mà không cần cấu hình nhiều điểm cuối trên máy tính phát triển của bạn.
🔒 100% trên thiết bị: các mô hình, khóa và dữ liệu của bạn được bảo mật hoàn toàn trên thiết bị của riêng bạn — không có dịch vụ bên thứ ba, không có máy chủ chuyển tiếp bên ngoài.
⚡ Các tính năng chính
🧠 Mô hình LLM cục bộ trên thiết bị: chạy mô hình trực tiếp trên điện thoại của bạn, không cần internet
💬 Chế độ trò chuyện: các phiên trò chuyện đầy đủ với mô hình cục bộ hoặc API đám mây (OpenAI, Claude, và hơn thế nữa) — chuyển đổi bất cứ lúc nào
🎨 Chế độ Canvas: xây dựng và kiểm thử trang web ngay trong cuộc trò chuyện, xem AI xây dựng trực tiếp
🌐 Xem trước WebX: xem trước ngay lập tức bất kỳ trang web nào Ollama xây dựng, có thể xem được trên bất kỳ trình duyệt nào trên bất kỳ thiết bị nào trong mạng của bạn
🖥️ Truy cập giao diện WebUI đa thiết bị: mở giao diện WebUI trò chuyện của bạn từ trình duyệt của bất kỳ thiết bị nào — điện thoại, máy tính bảng hoặc PC
🖥️ Lưu trữ cục bộ không cần cấu hình: khởi tạo máy chủ HTTP nhúng được tối ưu hóa cao (NanoHTTPD) ngay trên điện thoại Android của bạn
🔌 API tương thích với OpenAI: triển khai các điểm cuối tiêu chuẩn (/v1/chat/completions, /v1/models, /health) để tương thích dễ dàng
🔄 Chuyển đổi nhà cung cấp tức thì: lưu cấu hình cho Ollama, NVIDIA, OpenAI, Claude, Hugging Face, các điểm cuối tùy chỉnh — chuyển đổi chỉ với một cú nhấp chuột
📊 Trình hiển thị lưu lượng truy cập thời gian thực: theo dõi luồng yêu cầu, định tuyến gói và số liệu thống kê hiệu suất trực tiếp
🔋 Giới hạn tốc độ bằng Lazy Token Bucket: tiết kiệm pin, không tiêu hao tài nguyên nền
🔐 Lưu trữ mã hóa an toàn: khóa API được mã hóa AES-256 (EncryptedSharedPreferences)
🧵 I/O được giảm tải: giao diện người dùng Compose mượt mà, định tuyến tối ưu hiệu suất cao thông qua Coroutines + Dispatchers.IO
🛠️ Hỗ trợ đầy đủ IDE: logic tối ưu hiệu suất cao cho Cursor, VS Code, Antigravity, Windsurf và nhiều hơn nữa
🛣️ Sắp ra mắt — Lộ trình
🌐 Hỗ trợ cụm đa thiết bị: liên kết nhiều điện thoại/thiết bị vào một cụm suy luận cục bộ
🧠 Chế độ điều phối: phân phối khả năng tính toán trên các thiết bị để có nhiều sức mạnh IDE hơn
⚙️ Nhiều logic, tích hợp và tối ưu hóa khác đang được phát triển
❓ Tại sao nên chọn Ollama Local Trí tuệ nhân tạo (AI)?
Trò chuyện, lập trình và xem trước — tất cả đều được hỗ trợ bởi AI cục bộ hoặc trên đám mây, được bảo mật hoàn toàn trên thiết bị của bạn. Nhẹ, nhanh, thống nhất và riêng tư.
🔥 Tối ưu hóa quá trình phát triển LLM của bạn ngay hôm nay với Ollama Local AI!

