1. Mục tiêu công việc
• Đưa AI vào công việc hằng ngày của các phòng ban: giảm tác vụ lặp lại, tăng năng suất
• Vận hành mô hình AI tại chỗ (trên máy chủ của Công ty) và tối ưu chi phí sử dụng AI
• Khai thác hợp lý các công cụ AI Công ty đang dùng (OpenClaw)
2. Mô tả công việc
• Triển khai và vận hành mô hình ngôn ngữ lớn (LLM) chạy tại chỗ; chọn mô hình phù hợp cấu hình máy và từng loại việc
• Tối ưu token và chi phí: rút gọn prompt, quản lý ngữ cảnh, cache, phân luồng giữa mô hình tại chỗ và mô hình trả phí
• Vận hành và cải thiện các công cụ AI đang dùng (OpenClaw)
• Xây dựng các ứng dụng AI nhỏ
phục vụ phòng ban: tổng hợp, tra cứu tài liệu nội bộ, trả lời tự động
• Theo dõi chất lượng đầu ra và chi phí sử dụng; viết tài liệu, đưa mã nguồn lên kho chung
3. Yêu cầu
• Đã làm dự án/sản phẩm với LLM (prompt, RAG hoặc tích hợp API mô hình)
• Có kinh nghiệm host LLM tại chỗ (Ollama, vLLM, [protected info] hoặc tương đương)
• Có kinh nghiệm tối ưu token / chi phí khi dùng LLM
•
Lập trình Python cơ bản trở lên
Ưu tiên:
• Hiểu về lượng tử hoá mô hình (quantization), chạy mô hình trên GPU/CPU
• Xử lý tiếng Việt
• Đã dùng các nền tảng AI agent (OpenClaw, n8n, Dify hoặc tương đương)
Kỳ vọng (Expected Outcomes)
• 1 tháng: nắm các công cụ AI đang dùng và chi phí thực tế · có 1 mô hình chạy tại chỗ phục vụ thử 1 việc
• 3 tháng: có ứng dụng AI dùng hằng ngày cho ít nhất 1 phòng ban · có số liệu chi phí trước-sau tối ưu
4. Quyền lợi
• Thu nhập: Lương cứng thỏa thuận + các khoản: KPI 10%, Thưởng, Tết + Lương tháng 13
• Review 6-12 tháng theo hiệu quả
• Được thử nghiệm, triển khai giải pháp AI cho toàn Công ty
• Thu nhập: Lương cứng thỏa thuận + các khoản: KPI 10%, Thưởng, Tết + Lương tháng 13
• Review 6-12 tháng theo hiệu quả
• Được thử nghiệm, triển khai giải pháp AI cho toàn Công ty