Qualcomm Tiết Lộ Chương Trình Nhận Diện Giọng Nói Mới

28 Tháng Năm 20182:29 SA(Xem: 13112)
Qualcomm Tiết Lộ Chương Trình Nhận Diện Giọng Nói Mới
Qualcomm Tiết Lộ Chương Trình Nhận Diện Giọng Nói Mới
Qualcomm Tiết Lộ Chương Trình Nhận Diện Giọng Nói Mới

Khoảng cuối tháng 05/2018, trong Hội nghị thượng đỉnh Re-Work Deep Learning diễn ra tại thành phố Boston, Mỹ, Qualcomm đã tiết lộ những thông tin đầu tiên về chương trình nhận diện giọng nói hoàn toàn mới của hãng.

 

Chris Lott, chuyên gia nghiên cứu về trí tuệ nhân tạo AI tại Qualcomm cho biết, công nghệ mới sẽ bao gồm 2 mạng neural riêng biệt: mạng neural hồi quy RNN, sử dụng bộ nhớ nội bộ để xử lý thông tin đầu vào; và mạng neural tích chập CNN, mô phỏng lại kết cấu của các nơ-ron trong não bộ con người.

 

Chris Lott khẳng định hệ thống nhận diện giọng nói mới của Qualcomm có thể đạt độ chính xác lên đến 95% và được tích hợp trực tiếp vào smartphone và các thiết bị cầm tay khác. Ông cho biết: “Công nghệ của chúng tôi sẽ học được từ thói quen sử dụng thiết bị của người dùng. Nhờ đó, nó có thể cá nhân hóa các hoạt động của mình sao cho phù hợp với họ nhất”.

 

Đa số quá trình xử lý thông tin của các hệ thống nhận diện giọng nói hiện nay đều hoạt động dựa trên nền tảng điện toán đám mây, từ các vi xử lý hay microphone trên smartphone, loa thông minh như Google Home, Echo của Amazon cho đến các thiết bị máy tính Windows có tích hợp trợ lý ảo Cortana của Microsoft. Chỉ cần sử dụng một số lệnh như “OK Google” hay “Hey Cortana” là người dùng đã có thể dễ dàng điều khiển các trợ lý ảo bằng chính giọng nói của mình.

 

Tuy nhiên, những trợ lý ảo lại không thực sự xử lý thông tin đầu vào, là những câu lệnh mà người dùng đưa ra. Chúng chỉ đơn giản chuyển những từ hoặc cụm từ nghe được đến các máy chủ từ xa để thực hiện rất nhiều thuật toán machine-learning phức tạp và đáp ứng nhu cầu của người dùng.

 

Mặt khác, nhiều người tỏ ra lo ngại về vấn đề bảo mật khi cung cấp những dữ liệu giọng nói của mình cho các trợ lý ảo, mà thực chất là các máy chủ đám mây. Cả Alexa và Google Assistant đều ghi lại và gửi đi những từ khóa nhất định đến máy chủ để thực hiện quá trình phân tích. Những từ khóa sẽ không bị xóa bỏ nếu người dùng không cho phép hoặc không muốn. Amazon và Google cũng khẳng định sử dụng công nghệ thu âm giọng nói để cải thiện dịch vụ và đáp ứng nhu cầu của người dùng tốt hơn.

 

Tuy nhiên, trong một số trường hợp, quá trình trên lại diễn ra một cách thiếu an toàn và gây nên hậu quả nghiêm trọng. Chẳng hạn như vụ việc loa thông minh Echo tích hợp Alexa của Amazon đã tự động ghi âm cuộc trò chuyện của một cặp vợ chồng tại Portland rồi gửi ngẫu nhiên cho một số liên lạc trong danh bạ. Lott chia sẻ công nghệ nhận diện giọng nói của Qualcomm có thể giải quyết vấn đề, vì nó được tích hợp trực tiếp vào thiết bị và không phải gửi dữ liệu đến các máy chủ đám mây. Nó có thể ngay lập tức đáp ứng mệnh lệnh của người dùng mà không cần đến kết nối Internet, giúp bảo mật được nâng cao và an toàn hơn.

 

Trong năm 2016, Google đã tạo ra một hệ thống nhận diện giọng nói offline tương tự như Qualcomm và có tốc độ nhanh hơn gấp 7 lần so với các hệ thống online khác. Được biết, hệ thống có dung lượng khoảng 20.3MB, đã trải qua khoảng 2,000 giờ đào tạo về dữ liệu âm thanh và độ chính xác đạt đến 86.5%.

 

Các hệ thống nhận diện giọng nói tích hợp trong thiết bị cũng có những hạn chế của riêng mình. Chẳng hạn những thuật toán được thiết kế để hoạt động ngoại tuyến sẽ không thể kết nối Internet để tìm kiếm mở rộng câu trả lời cho người dùng. Ngoài ra, chúng cũng không thể tận dụng những tiến bộ công nghệ mà các hệ thống đám mây đang được sử dụng, trong đó bao gồm nguồn cơ sở dữ liệu đa dạng hơn.

 

Tuy nhiên, Chris Lott vẫn cho rằng giải pháp của Qualcomm vẫn sẽ mang lại những hiệu quả và lợi ích nhất định: “Công nghệ đám mây có thể thực hiện được rất nhiều thứ, nhưng tôi nghĩ sẽ tốt hơn nếu chúng được tiến hành ngay trên thiết bị của người dùng”.

59Vote
41Vote
37Vote
26Vote
16Vote
329
Gửi ý kiến của bạn
Tắt
Telex
VNI
Tên của bạn
Email của bạn
Tạo bài viết
02 Tháng Giêng 2019
Không chỉ kết nối thành công 3 bộ não của 3 người mà các nhà khoa học còn có thể giúp họ chia sẻ suy nghĩ và cùng nhau chơi trò chơi xếp hình Tetris. Không dừng lại ở đó, mô hình mới được cho là còn có thể mở rộng ra một “mạng não” nhiều người kết nối với nhau và không chỉ trực tiếp tại chỗ mà còn có thể kết nối qua Internet. Các nhà khoa học đã sử dụng công nghệ đo điện não đồ EEG để ghi lại các xung do hoạt động của não bộ tạo ra, và công nghệ kích thích từ xuyên sọ TMS, dùng từ trường để kích thích các nơ ron thần kinh.
02 Tháng Giêng 2019
Khoảng đầu tháng 01/2019, theo hãng nghiên cứu Counterpoint, thị phần smartphone cao cấp (có giá bán từ 400 USD trở lên) vẫn đang tăng trưởng mạnh. Cụ thể trong Q3/2018, thị phần của phân khúc smartphone cao cấp đạt 19%, trong khi đó thị trường smartphone tổng thể lại giảm 5%.
02 Tháng Giêng 2019
Chiếc nhẫn trôi nổi trong hình có kích thước của một thiên hà. Thực tế, nó là một thiên hà - hoặc ít nhất là một phần của một thiên hà: Thiên hà Sombrero tỏa sáng, một trong những thiên hà lớn nhất trong Cụm thiên hà Xữ Nữ (Virgo) gần đó.
02 Tháng Giêng 2019
Đại Tinh vân ở Orion là một nơi hấp dẫn. Có thể nhìn thấy được bằng mắt thường, nó xuất hiện dưới dạng một mảng mờ nhỏ trong Chòm Orion. Còn hình ảnh quý vị đang xem là một bức tranh khảm bốn bảng màu huyền ảo, được chụp trong các dải ánh sáng hồng ngoại khác nhau với kính thiên văn WISE quay quanh Trái đất, cho thấy Tinh vân Lạp Hộ (Orion Nebula) là một khu nhộn nhịp của các ngôi sao, khí nóng và bụi đen mới hình thành gần đây.
02 Tháng Giêng 2019
Tính đến tháng 01/2019, trong khi các hãng khác đã công bố lộ trình rõ ràng cập nhật Android 9 (Android Pie), LG vẫn khá là mơ hồ, hãng chỉ nói G7 sẽ nhận Pie vào quý đầu năm 2019, người dùng vẫn chưa có thời gian cụ thể để chờ đợi.
02 Tháng Giêng 2019
Tính đến tháng 01/2019, Hệ sinh thái Microsoft Surface vẫn chưa có những thay đổi đáng chú ý, khi nhiều nhà phê bình cho rằng bản nâng cấp mà hãng phát hành hồi tháng 10/2018 không hề hấp dẫn.