Ê, tin hot từ Đại học Sungkyunkwan (Hàn Quốc) nè! Một nhóm nghiên cứu xịn xò tại đây vừa cho ra đời công nghệ bảo mật giọng nói siêu đỉnh, chuyên "bắt bài" những tên tội phạm dùng deepfake giọng nói để lừa đảo đấy. Giờ mấy ông này ngày càng tinh vi, nên công nghệ mới này đúng chuẩn "anh hùng cứu mỹ nhân" luôn!
Nhóm research do GS Park Eun-il (Khoa Trí tuệ Nhân tạo Ứng dụng) dẫn đầu đã chứng minh rằng công nghệ này có thể phát hiện được các đoạn âm thanh đã bị "động chạm" và được chèn vào bản ghi âm giọng nói gốc. Nghe có vẻ sci-fi nhưng thật đấy!
Công nghệ này được kỳ vọng sẽ ứng dụng rộng rãi trong cuộc sống, từ chặn đứng lừa đảo qua giọng nói (kiểu mấy cuộc gọi giả mạo ấy), xác thực danh tính bằng giọng nói cho các dịch vụ tài chính, đến phân tích bằng chứng kỹ thuật số. Nói chung là bảo vệ an ninh đời sống cực kỳ xịn sò! ️
Điểm đặc biệt là nhóm nghiên cứu đã dùng AI để phân tích những thay đổi siêu nhỏ trong tín hiệu âm thanh và đặc điểm lời nói mà tai người ta khó nghe ra được. Qua đó, xác định chính xác vị trí của các đoạn lời nói đã bị chỉnh sửa với độ chính xác trong phạm vi một giây. Lú luôn nhỉ!
Hai bài nghiên cứu của nhóm đã được chấp nhận trình bày tại Interspeech 2026 – Hội nghị thường niên về khoa học và công nghệ lời nói, do Hiệp hội Truyền thông Lời nói Quốc tế (ISCA) tổ chức, dự kiến diễn ra từ ngày 27/9 đến ngày 1/10 tại Sydney, Úc. Sang Úc "flex" thành quả luôn!
GS Park, người đứng đầu nhóm nghiên cứu cho biết: "Những nỗ lực của chúng tôi trong việc phát triển các công nghệ mà mọi người có thể sử dụng một cách an toàn và hiệu quả, thay vì chỉ tập trung vào việc cải thiện hiệu suất AI đã được công nhận trên toàn cầu. Chúng tôi sẽ tiếp tục phát triển các công nghệ AI thế hệ mới có khả năng tăng cường sự an toàn cho xã hội và giải quyết các vấn đề thực tiễn".
Kết quả nghiên cứu này được kỳ vọng sẽ tạo ra nền tảng quan trọng cho việc phát triển các hệ thống AI đáng tin cậy, cung cấp những giải thích thực sự hữu ích chứ không chỉ "màu mè" bên ngoài thôi. Đặc biệt là trong các lĩnh vực đòi hỏi sự chính xác cao như y tế và tài chính – nơi mà sai một li đi một dặm!
Nhóm nghiên cứu còn "flex" thêm nhiều công trình đa dạng về AI trong đời sống thường ngày nữa nè! Từ công nghệ tổng hợp giọng nói có thể tái tạo tự nhiên các phương ngữ và ngữ điệu vùng miền chỉ dựa vào hình ảnh và thông tin địa điểm (kiểu nhìn ảnh là biết giọng Huế hay giọng Sài Gòn ấy), đến công nghệ phát hiện lời nói ác ý theo thời gian thực chỉ dựa vào âm sắc và nhịp điệu giọng nói.
Còn có cả mô hình thị giác máy tính nhận diện các tín hiệu cảm xúc tinh tế trong hình ảnh, và công nghệ chẩn đoán hình ảnh y tế giúp xác định chính xác vùng bệnh từ nguồn thông tin hạn chế. Những nghiên cứu này cho thấy phạm vi rộng lớn trong các hoạt động nghiên cứu hội tụ AI của nhóm, nhằm giải quyết các thách thức thực tiễn trong cuộc sống. Thật sự là respect!
Nguồn: svvn.tienphong.vn