Khi làm việc với công cụ AI coding, phần tốn thời gian không phải lúc nào cũng là viết code. Bạn còn phải gõ yêu cầu, mô tả lỗi, giải thích bối cảnh và phản hồi kết quả. Vietnamese Voice Mic biến lời nói tiếng Việt thành văn bản rồi đưa trực tiếp vào đúng ô nhập, giúp giảm việc gõ lặp lại và giữ liền mạch luồng suy nghĩ.

Cách dùng ngắn gọn: mở ứng dụng, giữ Alt và click chuột trái vào ô cần nhập, nói yêu cầu, chờ nhận diện rồi kiểm tra transcript trước khi gửi.

Vietnamese Voice Mic là gì?

Vietnamese Voice Mic là ứng dụng chạy nền trên Windows, được tối ưu để nhập tiếng Việt bằng giọng nói vào ô chat hoặc ô nhập liệu. Công cụ nhận diện giọng nói qua Google Speech Recognition, tự phát hiện lúc bạn bắt đầu và ngừng nói, sau đó dán transcript trở lại cửa sổ đã chọn.

Ứng dụng hữu ích trong nhiều tình huống:

  • Giao việc cho AI trong Cursor, VS Code và các IDE có trợ lý lập trình.
  • Nhập prompt trong Codex, ChatGPT, Claude hoặc công cụ AI trên trình duyệt.
  • Ghi chú công việc trong Notion, Trello, Linear và ứng dụng quản lý dự án.
  • Soạn email, tài liệu, biểu mẫu và các nội dung tiếng Việt dài.

Vietnamese Voice Mic không tự viết code thay bạn. Công cụ rút ngắn bước chuyển ý tưởng thành văn bản để bạn giao tiếp với AI và ghi lại công việc nhanh hơn.

Vì sao voice coding giúp tối ưu tiến độ?

Mô tả yêu cầu tự nhiên và đầy đủ hơn

Khi nói, bạn thường diễn đạt được cả mục tiêu, bối cảnh, điều kiện và kết quả mong muốn. Một prompt có đủ bốn phần này giúp AI hiểu việc tốt hơn một câu gõ vội và giảm số vòng hỏi lại.

Giảm thời gian gõ giải thích dài

Mô tả lỗi giao diện, review một luồng nghiệp vụ, viết tài liệu hay giao nhiều bước cho AI thường cần hàng trăm từ. Đọc thành câu rồi chỉnh vài chi tiết kỹ thuật có thể nhanh hơn việc gõ từ đầu.

Giữ liền mạch luồng suy nghĩ

Bạn có thể quan sát code hoặc giao diện và mô tả vấn đề ngay khi nhìn thấy, thay vì liên tục chuyển sự chú ý giữa màn hình và bàn phím.

Dễ phục hồi nội dung vừa nói

Transcript mới nhất được giữ trong clipboard. Nếu nội dung bị dán nhầm hoặc ô nhập thay đổi, bạn có thể dùng Ctrl + V để dán lại mà không phải đọc lại từ đầu.

Tính năng nổi bật

  • Kích hoạt bằng Alt + click chuột trái ngay tại ô muốn nhập.
  • Ghi nhớ cửa sổ và vị trí ban đầu để dán transcript đúng chỗ.
  • Nhận diện tiếng Việt bằng Google Speech Recognition.
  • Tự phát hiện khi người dùng bắt đầu và ngừng nói bằng VAD WebRTC/RMS.
  • Xử lý đoạn nói dài bằng cách chia tại vùng âm lượng thấp, nhận diện song song rồi ghép lại.
  • Hiển thị trạng thái đang nghe, đang nhận diện và đã có văn bản trên HUD.
  • Không tự dán nếu cửa sổ mục tiêu đã đóng, giúp hạn chế đưa nội dung nhầm nơi.
  • Lưu transcript mới nhất trong clipboard, file phục hồi và lịch sử cục bộ.
  • Hỗ trợ cập nhật qua GitHub Releases.
  • Context và từ điển cá nhân được lưu trên máy, không đưa lên GitHub.

Yêu cầu hệ thống

  • Máy tính chạy Windows 10 hoặc Windows 11.
  • Microphone đang hoạt động và đã được Windows cấp quyền.
  • Kết nối Internet để sử dụng Google Speech Recognition.
  • Nên dùng tai nghe hoặc đặt microphone gần miệng khi môi trường có nhiều tiếng ồn.

Cách tải và cài Vietnamese Voice Mic

  1. Đi đến phần tải ứng dụng ở cuối bài.
  2. Tải file VietnameseVoiceMic-windows.zip từ GitHub Releases chính thức.
  3. Giải nén toàn bộ file ZIP vào một thư mục cố định, ví dụ D:\Apps\VietnameseVoiceMic.
  4. Mở thư mục vừa giải nén và chạy VietnameseVoiceMic.exe.
  5. Nếu Windows hiển thị cảnh báo, kiểm tra nguồn tải là repository Ducpt88/VietnameseVoiceMic trước khi tiếp tục.
  6. Cho phép ứng dụng sử dụng microphone nếu Windows yêu cầu.
Lưu ý: không chạy file trực tiếp bên trong cửa sổ xem ZIP. Hãy giải nén đầy đủ để các file cấu hình, lịch sử và chức năng cập nhật hoạt động đúng.

Cách sử dụng Vietnamese Voice Mic

  1. Mở Vietnamese Voice Mic và để ứng dụng chạy nền.
  2. Mở Cursor, VS Code, Codex, ChatGPT hoặc ứng dụng có ô nhập văn bản.
  3. Giữ phím Alt và click chuột trái đúng vào ô muốn nhập.
  4. Khi vòng tròn hiển thị ĐANG NGHE, bắt đầu nói rõ ràng với tốc độ vừa phải.
  5. Khi bạn ngừng nói, ứng dụng chuyển sang trạng thái ĐANG NHẬN DIỆN.
  6. Sau khi xử lý, transcript được tự động dán vào vị trí đã chọn.
  7. Đọc lại nội dung, sửa tên hàm, đường dẫn, câu lệnh hoặc thuật ngữ rồi mới gửi.

Trong lúc đang nghe, bạn có thể nhấn Esc để kết thúc thu và yêu cầu ứng dụng xử lý phần âm thanh đã ghi.

4 cách dùng giọng nói khi coding

1. Nói prompt giao việc cho AI

Thay vì nói một câu chung chung như “sửa code này”, hãy đọc prompt theo cấu trúc:

Bối cảnh → mục tiêu → phạm vi → điều kiện → cách kiểm tra.

Ví dụ:

“Dự án này dùng React và TypeScript. Hãy sửa form đăng nhập để hiển thị lỗi ngay dưới từng trường. Không thay đổi API hiện tại. Sau khi sửa, chạy kiểm tra TypeScript và test liên quan, sau đó tóm tắt các file đã thay đổi.”

2. Mô tả lỗi trong lúc quan sát màn hình

Nhìn trực tiếp vào giao diện và mô tả vị trí, điều kiện xuất hiện lỗi cùng hành vi mong muốn:

“Ở màn hình điện thoại, nút thanh toán đang tràn ra ngoài khung khoảng 20 pixel. Lỗi chỉ xuất hiện khi chiều rộng dưới 375 pixel. Kiểm tra CSS của checkout footer và sửa nhưng không làm thay đổi giao diện desktop.”

Sau khi transcript xuất hiện, bổ sung tên file hoặc selector chính xác bằng bàn phím nếu cần.

3. Review code bằng giọng nói

Khi review, hãy nói lần lượt file hoặc chức năng đang xem, điều bạn nghi ngờ, hành vi mong muốn và cách cần kiểm tra.

“Kiểm tra hàm đồng bộ đơn hàng trong file service. Tôi nghi ngờ request bị gửi hai lần khi người dùng bấm nút liên tục. Hãy tìm nguyên nhân, giải thích trước, sau đó đề xuất cách chống duplicate request và thêm test hồi quy.”

4. Viết tài liệu và báo cáo tiến độ

Ứng dụng phù hợp để đọc nhanh nội dung README, mô tả pull request, ghi chú phát hành, checklist kiểm thử và báo cáo cuối ngày. Với commit message hoặc lệnh terminal, nên nói phần ý tưởng rồi tự nhập cú pháp chính xác bằng bàn phím.

Quy trình voice coding hiệu quả

Bước 1: Chọn đúng ô nhập

Giữ Alt và click trực tiếp vào ô chat của công cụ đang dùng. Tránh click sang cửa sổ khác trong khi ứng dụng đang nghe nếu bạn muốn transcript được dán tự động.

Bước 2: Chia yêu cầu thành từng lượt có mục tiêu

Với nhiệm vụ lớn, hãy chia thành bốn lượt:

  1. Yêu cầu AI khảo sát và giải thích.
  2. Yêu cầu lập phương án.
  3. Yêu cầu thực hiện thay đổi.
  4. Yêu cầu chạy kiểm tra và báo cáo.

Cách này giúp transcript dễ kiểm soát và AI ít bỏ sót yêu cầu.

Bước 3: Nói phần tự nhiên, gõ phần kỹ thuật

Giọng nói phù hợp với mục tiêu, bối cảnh và logic. Bàn phím vẫn chính xác hơn với tên biến, tên hàm, đường dẫn file, URL, regular expression và lệnh terminal.

Quy tắc thực dụng: nói 80% nội dung, gõ và chỉnh 20% chi tiết kỹ thuật.

Bước 4: Kiểm tra trước khi gửi

  • Tên công nghệ và thuật ngữ đã đúng chưa?
  • Có thiếu từ phủ định như “không” hay không?
  • Có vô tình yêu cầu AI xóa hoặc thay đổi ngoài phạm vi không?
  • Tên file, URL và câu lệnh đã chính xác chưa?

Bước 5: Lưu mẫu prompt thường dùng

Tạo sẵn các khung “sửa lỗi”, “review code”, “viết test” và “tối ưu hiệu năng”. Khi dùng giọng nói, bạn chỉ cần bổ sung bối cảnh cụ thể của nhiệm vụ.

Cấu hình microphone

Cấu hình chính nằm trong file voice-mic-settings.json. Ví dụ:

{
  "preferred_microphone": "USB Audio Device",
  "microphone_name_hints": [
    "USB Audio Device",
    "Microphone",
    "Headset"
  ],
  "enable_particle_effect": true,
  "enable_context_memory": true
}

Để ứng dụng tự chọn microphone dựa trên danh sách gợi ý, đặt:

"preferred_microphone": ""

Sau khi sửa cấu hình, lưu file và khởi động lại ứng dụng.

Tối ưu nhận diện thuật ngữ coding

Tên framework, thư viện và biến tiếng Anh có thể bị nhận sai. Bạn có thể:

  • Nói chậm hơn ở phần thuật ngữ và ngắt nhẹ trước, sau tên riêng.
  • Thêm từ thường dùng vào speech_context_terms trong cấu hình hoặc context của ứng dụng.
  • Lưu từ điển cá nhân trong file local để không đưa dữ liệu riêng lên GitHub.
  • Dùng giọng nói cho phần mô tả, sau đó gõ lại chính xác tên biến hoặc đường dẫn.
Bảo mật: không đọc mật khẩu, API key, mã OTP, dữ liệu khách hàng hoặc thông tin bí mật vào công cụ nhận diện trực tuyến.

Khôi phục nội dung khi dán lỗi

Nếu transcript bị dán sai vị trí hoặc cửa sổ mục tiêu không còn hoạt động:

  • Nhấn Ctrl + V để dán lại transcript mới nhất từ clipboard.
  • Mở voice-last.txt để xem nội dung nhận diện gần nhất.
  • Mở voice-transcripts.jsonl để xem lịch sử transcript trên máy.
  • Mở voice-last.wav nếu cần nghe lại đoạn âm thanh vừa thu.

Các file phục hồi được lưu cục bộ và nằm trong .gitignore của dự án.

Cho ứng dụng tự chạy cùng Windows

Nếu chạy Vietnamese Voice Mic từ mã nguồn, mở PowerShell tại thư mục dự án và dùng:

powershell -ExecutionPolicy Bypass -File .\install-startup.ps1

Để gỡ tự khởi động:

powershell -ExecutionPolicy Bypass -File .\uninstall-startup.ps1

Chỉ bật tự khởi động nếu bạn sử dụng voice coding thường xuyên. Việc để ứng dụng sẵn sàng sẽ giảm một thao tác trước mỗi phiên làm việc.

Xử lý lỗi thường gặp

Giữ Alt và click nhưng ứng dụng không nghe

Hãy chắc chắn bạn vẫn giữ Alt tại đúng thời điểm click chuột trái. Kiểm tra ứng dụng đang chạy và microphone đã được Windows cấp quyền.

Ứng dụng không nhận giọng nói

Kiểm tra microphone mặc định trong Windows và giá trị preferred_microphone. Thử ghi âm bằng Voice Recorder để xác nhận mic hoạt động.

Transcript bị cắt câu quá sớm

Nói liền mạch hơn và hạn chế dừng quá lâu giữa câu. Người chạy từ mã nguồn có thể tăng WEBRTC_VOICE_END_SECONDSRMS_VOICE_END_SECONDS trong voice_mic_icon.py.

Ứng dụng nhận sai nhiều từ

Đưa microphone gần hơn, giảm tiếng nền và bổ sung thuật ngữ thường dùng vào context. Luôn đọc lại transcript trước khi gửi yêu cầu cho AI.

Transcript không được dán đúng chỗ

Hãy Alt + click trực tiếp vào đúng ô input trước khi nói. Nếu cửa sổ đã đóng, ứng dụng không tự dán để tránh đưa nội dung nhầm nơi; dùng Ctrl + V để phục hồi thủ công.

Câu hỏi thường gặp

Vietnamese Voice Mic có dùng được với Cursor và VS Code không?

Có. Ứng dụng hoạt động với ô chat hoặc ô nhập liệu trên Windows nên có thể dùng trong Cursor, VS Code và nhiều công cụ AI coding khác.

Ứng dụng có tự gửi prompt không?

Không. Ứng dụng nhận diện rồi dán văn bản vào ô đã chọn. Bạn vẫn có cơ hội kiểm tra, chỉnh sửa và chủ động nhấn gửi.

Vietnamese Voice Mic có cần Internet không?

Có. Phiên bản hiện tại dùng Google Speech Recognition để nhận diện tiếng Việt nên cần kết nối Internet.

Dữ liệu cá nhân có được đưa lên GitHub không?

Theo tài liệu dự án, context cá nhân, transcript phục hồi và cấu hình local được lưu trên máy, không đưa lên GitHub. Tuy nhiên, việc nhận diện sử dụng dịch vụ trực tuyến nên không được đọc thông tin nhạy cảm.

Ứng dụng có dùng được trên macOS không?

Bản phát hành hiện tại dành cho Windows. Repository chưa cung cấp gói cài đặt chính thức cho macOS.

Tải Vietnamese Voice Mic cho Windows

Phiên bản được kiểm tra khi viết bài: v1.1.1, phát hành ngày 10/07/2026. Gói Windows có dung lượng khoảng 46,6 MB.

Tải trực tiếp VietnameseVoiceMic-windows.zip

Xem phiên bản mới nhất trên GitHub Releases

Xem mã nguồn và tài liệu chính thức

Cập nhật và kiểm tra liên kết tải ngày . Khi dự án có bản mới, hãy ưu tiên trang “Latest release”.