Nhật ký thay đổi

Ghi chú phát hành và cập nhật sản phẩm

ScribeToAny v2.3: Gói Plus mới và nâng cấp nhận diện người nói

v2.3.0

Gói Plus mới, hiển thị thanh toán theo năm mặc định, nhãn người nói rõ ràng hơn, xuất file PDF/DOCX có thương hiệu và bổ sung các trang trợ giúp.

2026/09/03

Gói dịch vụ

  • Gói Plus mới: Gói Plus mới ra mắt nằm giữa gói Free và Max, mang lại lựa chọn cân bằng cho nhu cầu sử dụng thường xuyên. Xem chi tiết tại trang bảng giá.
  • Thanh toán theo năm mặc định: Các gói hiện hiển thị mức giá theo năm làm mặc định để bạn thấy ngay mức tiết kiệm. Tùy chọn theo tháng vẫn sẵn sàng chỉ với một cú nhấp.

Chất lượng phiên âm

  • Nhận diện người nói chuẩn xác hơn: Tính năng tách người nói (diarization) được nâng cấp cho ra các nhãn người nói rõ ràng và duy trì sự ổn định ngay cả với các bản ghi dài nhiều giờ.

Xuất dữ liệu

  • PDF & DOCX có thương hiệu: Các tệp xuất PDF và DOCX dành cho người đọc nay có thêm dòng chân trang tinh tế "Transcribed with ScribeToAny" kèm liên kết. Các định dạng phụ đề và dữ liệu (SRT, VTT, TSV, CSV, JSON) được giữ nguyên vẹn.

Tin cậy & Trợ giúp

ScribeToAny v2.2: Công cụ miễn phí chạy trong trình duyệt

v2.2.0

Bộ công cụ phụ đề, đa phương tiện và hình ảnh miễn phí chạy hoàn toàn trong trình duyệt — không cần tải lên máy chủ, không cần tài khoản.

2026/08/25

Bộ công cụ miễn phí mới chạy hoàn toàn trong trình duyệt của bạn — không tải lên, không cần tài khoản và không mất phí. Tệp của bạn không bao giờ rời khỏi thiết bị.

Công cụ phụ đề

  • Chuyển đổi phụ đề: Chuyển đổi qua lại giữa SRT, VTT, TXT, CSV và JSON, xuất sang DOCX hoặc PDF.
  • Chỉnh sửa phụ đề: Sửa câu từ và căn chỉnh lại thời gian phụ đề ngay trong trình duyệt rồi xuất lại.

Tiện ích đa phương tiện

  • Trích xuất & chuyển đổi âm thanh: Tách âm thanh từ video hoặc chuyển đổi giữa các định dạng âm thanh.
  • Chuyển đổi video: MP4 → WebM và video → GIF.
  • Chuyển đổi hình ảnh: HEIC → JPG.

Cách thức hoạt động

Tất cả các công cụ này đều chạy cục bộ bằng WebCodecs và WebAssembly — không có gì được tải lên máy chủ. Chúng hoạt động độc lập với tính năng phiên âm và hoàn toàn miễn phí. Khám phá tại /tools.

ScribeToAny v2.1: dịch sang 56 ngôn ngữ

v2.1.0

Dịch bản phiên âm đã hoàn tất sang 56 ngôn ngữ mà không làm lệch thời gian phụ đề.

2026/07/29

Bản dịch

  • 56 ngôn ngữ đích: chọn ngôn ngữ khi bắt đầu tác vụ và bản phiên âm hoàn tất sẽ được dịch sang đó — tiếng Trung giản thể và phồn thể, Tây Ban Nha, Pháp, Đức, Nhật, Hàn, Ả Rập, Hindi và 48 ngôn ngữ khác. Danh sách này là những ngôn ngữ mô hình thực sự được huấn luyện và đo đạc.
  • Giữ nguyên mốc thời gian: việc dịch diễn ra theo từng đoạn và mỗi kết quả được ghi lại đúng mốc thời gian gốc. Tệp SRT hoặc VTT đã dịch vào thẳng phần mềm dựng và vẫn khớp hình.
  • Giữ cả hai tài liệu: bản phiên âm gốc và bản dịch nằm cạnh nhau trong cùng một tác vụ, cả hai đều xuất được ở đủ tám định dạng. Ngôn ngữ đích được chọn khi bắt đầu tác vụ và sau đó không thể thay đổi.

Phạm vi áp dụng

Bản dịch thuộc gói Max. Việc phiên âm âm thanh không phải tiếng Anh thẳng sang tiếng Anh vẫn có ở mọi gói, kể cả gói miễn phí.

ScribeToAny v2.0: nhận diện người nói và tám định dạng xuất

v2.0.0

Bản phiên âm có nhãn người nói, nhập trực tiếp từ liên kết, và tất cả định dạng xuất mà chúng tôi hỗ trợ.

2026/07/22

Tính năng mới

Sau phản hồi sâu rộng từ các nhà sáng tạo, v2.0 mang đến nhiều nâng cấp hiệu suất lớn:

  • Nhận diện người nói: phỏng vấn và cuộc họp được gắn nhãn theo người nói, phụ đề ngắt khi đổi người thay vì giữa câu trả lời.
  • Nhập từ liên kết: dán URL trực tiếp của tệp phương tiện, chúng tôi sẽ tải về và phiên âm — không phải tải xuống rồi tải lên lại. (Không hỗ trợ liên kết YouTube; hãy tải tệp về trước.)
  • Tám định dạng xuất: ngoài văn bản thuần, bạn xuất được phụ đề SRTVTT khớp thời gian chính xác, bảng TSVCSV, JSON có cấu trúc, cùng PDFDOCX sẵn sàng in. Chọn nhiều định dạng cùng lúc thì nhận một tệp ZIP.

Cải tiến UX và hiệu năng

  • Tải lên lớn có thể tiếp tục: Thành phần tải lên thiết kế mới hỗ trợ tệp video khổng lồ đến 5GB với tự động thử lại trên mạng không ổn định.
  • Nâng cấp bảng điều khiển: giao diện thiết kế lại, tìm kiếm trong lịch sử, thư mục để sắp xếp tác vụ, và xuất hàng loạt.
  • Tăng cường chống ồn: Thuật toán tách giọng được tối ưu riêng cho phỏng vấn ngoài trời và môi trường quán cà phê ồn ào.

Phiên bản đầu tiên: ScribeToAny đã ra mắt!

v1.0.0

Trải nghiệm phiên âm âm thanh và video nhanh như chớp, độ chính xác cao.

2026/07/01

Tính năng cốt lõi

Chúng tôi vô cùng phấn khích công bố phiên bản chính thức đầu tiên của ScribeToAny! Công cụ phiên âm thông minh dành cho nhà sáng tạo và đội nhóm chuyên nghiệp nay đã sẵn sàng:

  • Động cơ hàng đầu: Được hỗ trợ bởi mô hình Whisper large dẫn đầu ngành, mang lại độ chính xác nhận dạng vô song.
  • Hỗ trợ định dạng toàn diện: Tải lên trực tiếp các định dạng âm thanh/video phổ biến bao gồm MP3, WAV, FLAC, MP4 và MOV.
  • Tốc độ chớp nhoáng: Với tăng tốc ma trận GPU, phiên âm 1 giờ âm thanh trung bình chỉ khoảng 1 phút.
  • Ngôn ngữ toàn cầu: Hỗ trợ tự động nhận diện và phiên âm chính xác hơn 90 ngôn ngữ.
  • Bảo mật dữ liệu nghiêm ngặt: Mọi tệp media gốc tải lên đều bị hủy ngay lập tức và tự động sau khi xử lý, không bao giờ dùng để huấn luyện mô hình.

Chào mừng đến với ScribeToAny, nơi chuyển giọng nói thành văn bản dễ dàng hơn bao giờ hết!