Bỏ qua điều hướng
🚀 Tích hợp AI Generative - Chính xác đến 99% trên 50 ngôn ngữ

Biến giọng nói thành văn bản trong tích tắc
trong tích tắc

Nền tảng Speech-to-Text thế hệ mới giúp bạn tiết kiệm hàng trăm giờ biên soạn. Hỗ trợ API, đa nền tảng và tương thích mọi định dạng âm thanh.

Được tin dùng bởi hơn 10,000+ nhà sáng tạo nội dung và doanh nghiệp hàng đầu

VTV
Đài Truyền hình VN
FPT Software
FPT Group
Vietcetera
Podcast Network
VCCI
Phòng Thương mại VN
Vingroup
Tập đoàn đa ngành
Sconnect
Media Agency
Giá trị cốt lõi

Không chỉ là chuyển đổi văn bản. Chúng tôi tái định nghĩa cách bạn làm việc với âm thanh.

Nhanh gấp 20 lần

Tiết kiệm 90% thời gian

Tự động hóa hoàn toàn việc ghi chép cuộc họp, phỏng vấn. Biến 1 giờ âm thanh thành văn bản hoàn chỉnh chỉ trong vòng 3 phút.

Tích hợp LLM

Tìm kiếm & Phân tích thông minh

Biến file âm thanh tĩnh thành dữ liệu động có thể tìm kiếm cụm từ, sao chép nhanh, dịch thuật tức thì và tóm tắt tự động bằng AI.

Độ chính xác 99%

Xóa bỏ rào cản ngôn ngữ

Hỗ trợ đa phương ngữ vùng miền, tự động nhận diện danh tính người nói (Speaker Diarization) và chèn dấu câu thông minh.

Show, Don't Tell

Trải nghiệm sức mạnh AI ngay trên trình duyệt

Chọn thu âm giọng nói trực tiếp của bạn, tải lên file âm thanh có sẵn hoặc dán link podcast để thấy AI bóc băng văn bản và phân loại đa loa tức thì.

Năng lực Công nghệ

Xây dựng cho mọi nhu cầu, từ cá nhân đến Enterprise

Đồng bộ Realtime

Đa nền tảng & Đồng bộ đám mây

Sử dụng mượt mà trên Web App, thiết bị iOS, Android và máy tính Windows. Toàn bộ hội thoại, bản dịch được đồng bộ hóa tức thì theo thời gian thực.

Kéo & Thả

Hỗ trợ mọi định dạng

Chấp nhận tất cả định dạng âm thanh phổ biến: MP3, WAV, MP4, M4A, FLAC, AAC... Chỉ cần kéo thả trực tiếp để bắt đầu xử lý.

Diarization AI

Nhận diện đa loa thông minh

Thuật toán nâng cao tự động phát hiện số lượng người nói trong phòng, phân biệt rõ ràng "Người phát biểu 1", "Người phát biểu 2" và chia cuộc đối thoại theo dòng thời gian chuyên nghiệp.

Dành cho Nhà phát triển

API & Webhook cực mạnh

Dành riêng cho Developer. Tích hợp tính năng nhận diện giọng nói chất lượng cao vào CRM, ERP hoặc ứng dụng di động của bạn chỉ với dưới 10 dòng code.

Bảo mật & Riêng tư

Bảo mật tuyệt đối cấp Enterprise

Mã hóa dữ liệu End-to-End khi truyền tải và lưu trữ. Tuân thủ nghiêm ngặt các tiêu chuẩn bảo mật quốc tế GDPR và SOC2. Tùy chọn tự động xóa file âm thanh ngay sau khi chuyển dịch thành công.

Khởi động chỉ sau 30 giây

Sẵn sàng để biến âm thanh thành tài sản số giá trị?

Đăng ký ngay hôm nay để nhận 60 phút chuyển đổi miễn phí hàng tháng. Không cần thẻ tín dụng. Hủy bất kỳ lúc nào.

Liên hệ tư vấnĐã kiểm chứng bởi 10,000+ người dùng
Giải pháp chuyên sâu

Tối ưu hóa theo từng lĩnh vực của bạn

Đối tượng sử dụng

Doanh nghiệp

Vấn đề / Nỗi đau

Tốn hàng giờ ghi chép biên bản cuộc họp, dễ bỏ sót các quyết định quan trọng và đầu việc được giao.

Giải pháp của V-STT

V-STT ghi nhận âm thanh cuộc họp, tự động chia người nói và trích xuất ngay danh sách công việc (Action-items) bằng AI.

Tính năng cốt lõi
Biên bản họp tự động
Phân loại người nói
Trích xuất Action Items
★★★★★

"Từ ngày dùng V-STT, phòng ban chúng tôi tiết kiệm được ít nhất 5 tiếng mỗi tuần để soạn thảo báo cáo cuộc họp. AI tóm tắt cực kỳ sát nghĩa."

Nguyễn Minh Thư

Trưởng phòng Vận hành FPT Software

Biểu phí dịch vụ

Gói cước linh hoạt, trả theo những gì bạn dùng

Chọn gói cước phù hợp với nhu cầu cá nhân hay quy mô doanh nghiệp của bạn. Tiết kiệm 20% khi chọn hình thức thanh toán theo năm.

Thanh toán hàng thángThanh toán theo năm Tiết kiệm 20%

Starter

Phù hợp cho cá nhân trải nghiệm công nghệ hoặc chuyển đổi âm thanh cơ bản.

60 phút chuyển đổi miễn phí/tháng
Độ chính xác cơ bản (~92%)
Xuất file định dạng TXT / SRT
Hỗ trợ tải lên file dưới 20MB
Hỗ trợ qua Email/Cộng đồng
Bắt đầu miễn phí
Khuyên dùng

Pro

Dành cho nhà sáng tạo nội dung, biên dịch viên làm việc hàng ngày.

199.000đ/tháng

*Thanh toán 199.000đ /tháng

10 giờ chuyển đổi chất lượng cao/tháng
Độ chính xác tối đa AI thế hệ mới (~99%)
Nhận diện đa loa (Speaker Diarization)
Tóm tắt nội dung & Trích xuất ý chính bằng AI
Xuất mọi định dạng: Word, PDF, Excel, SRT, VTT
Hỗ trợ tải file dung lượng lớn tới 500MB
Hỗ trợ ưu tiên 24/7
Nâng cấp lên Pro

Enterprise

Dành cho doanh nghiệp yêu cầu bảo mật và tích hợp hệ thống riêng.

999.000đ/tháng

*Thanh toán 999.000đ /tháng

Thời lượng tùy chỉnh không giới hạn
Hạ tầng máy chủ riêng (On-premise hoặc Private Cloud)
Truy cập đầy đủ API & Webhook tích hợp
Cam kết chất lượng SLA 99.9%
Tùy chỉnh từ điển & Fine-tune AI theo ngành nghề
Mã hóa bảo mật End-to-End tuyệt đối
Quản lý tài khoản riêng biệt (Dedicated Account Manager)
Liên hệ bộ phận Sales
Dành cho Nhà phát triển

Tài liệu tích hợp API & Webhooks

Tích hợp tính năng bóc băng và phân giải âm thanh tự động vào ứng dụng di động, hệ thống quản lý khách hàng CRM hay ERP của bạn chỉ với vài phút.

Endpoints

POST/v1/transcribe

Tải lên tệp tin âm thanh hoặc chỉ định luồng âm thanh đầu vào để chuyển dịch thành văn bản có mốc thời gian chi tiết.

Tham số yêu cầu (Body Form-Data)
filerequired
binary (MP3, WAV...)
diarizationoptional
boolean (default: false)
languageoptional
string ("vi", "en"...)

Xác thực API

Sử dụng mã Header Authorization: Bearer YOUR_API_KEY. Tạo mã khóa bảo mật trong trang quản trị Dashboard của bạn.

Mẫu Code
curl -X POST "https://api.vstt.ai/v1/transcribe" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "file=@/path/to/meeting.mp3" \
  -F "diarization=true" \
  -F "language=vi"
Giải đáp thắc mắc

Các câu hỏi thường gặp

Liên hệ

Biến giọng nói thành văn bản

Nền tảng Speech-to-Text thế hệ mới giúp bạn tiết kiệm hàng trăm giờ biên soạn. Hỗ trợ API, đa nền tảng và tương thích mọi định dạng âm thanh.

Cam kết bảo mật dữ liệu

Hạ tầng thử nghiệm và biểu mẫu của PTHub được thiết kế để xử lý thông tin an toàn, bảo vệ dữ liệu của doanh nghiệp và cơ quan nhà nước.