Bỏ qua tới nội dung chính
WebDoAnPrecision in every system
AI & xử lý dữ liệuWeb + API + AdminNâng cao

Hệ thống tổng hợp và nhân bản giọng nói AI đa ngôn ngữ tích hợp nền tảng quản lý Django

Đồ án xây dựng nền tảng tổng hợp tiếng nói đa ngôn ngữ, hỗ trợ nhân bản giọng và điều chỉnh cảm xúc qua giao diện quản trị Django.

Giới thiệu

Nhu cầu tạo nội dung âm thanh số hóa, trợ lý ảo và lồng tiếng tự động đòi hỏi các mô hình chuyển đổi văn bản thành giọng nói (TTS) phải đạt độ tự nhiên cao và có khả năng sao chép âm sắc chính xác từ mẫu âm thanh ngắn. Hệ thống tập trung nghiên cứu ứng dụng mô hình sinh giọng nói tiên tiến, giải quyết bài toán biểu đạt ngữ điệu linh hoạt và giảm thiểu độ trễ xử lý.\n\nĐề tài được triển khai dưới dạng ứng dụng fullstack, sử dụng Django làm backend điều phối luồng dữ liệu, quản lý tài khoản người dùng, hàng đợi tác vụ và lưu trữ cấu hình giọng đọc. Phía người dùng được cung cấp giao diện trực quan để tải lên file mẫu, nhập văn bản, tinh chỉnh tham số ngữ điệu và tải xuống tệp âm thanh thành phẩm với hiệu năng xử lý ổn định.

Chức năng có trong gói chuẩn

  • Tổng hợp tiếng nói chất lượng cao từ văn bản đa ngôn ngữ
  • Nhân bản giọng nói tức thì từ đoạn âm thanh mẫu ngắn (Zero-shot Voice Cloning)
  • Điều chỉnh ngữ điệu, cảm xúc và tốc độ phát của giọng đọc
  • Quản lý thư viện giọng mẫu cá nhân và danh mục phát âm thanh
  • Hàng đợi xử lý tác vụ ngầm cho các yêu cầu chuyển đổi văn bản dài
  • Hệ thống xác thực người dùng và phân quyền hạn mức sử dụng tài nguyên
  • API RESTful phục vụ kết nối và tích hợp hệ thống bên thứ ba
  • Trang quản trị Django theo dõi hiệu năng hệ thống và nhật ký xử lý

Chức năng ngoài danh sách này được tính riêng và ghi rõ trong bản chốt scope trước khi bắt đầu.

Công nghệ

  • django

Muốn đổi sang công nghệ khác cho khớp yêu cầu môn học? Được — báo trước khi chốt scope, giá điều chỉnh theo hệ số công nghệ chứ không phải làm lại từ đầu.

Đề tài liên quan