Khi huấn luyện mô hình phân loại khả năng một cây cầu có thể sụp đổ dựa trên các yếu tố khác nhau, bạn có một tập dữ liệu gồm hàng nghìn cây cầu hiện có và các đặc điểm của chúng, nơi mỗi cây cầu được dán nhãn là có thể sụp đổ hoặc không. Chỉ có một vài cây cầu trong tập dữ liệu được dán nhãn là có thể sụp đổ – phần còn lại được dán nhãn là không thể sụp đổ. Với mục tiêu của bạn là giảm thiểu sự sụp đổ của cây cầu và hậu quả nghiêm trọng mà nó gây ra, thì chỉ số nào sau đây sẽ hữu ích nhất để đánh giá mô hình? Mặc dù độ chính xác (Accuracy) và độ chính xác của ma trận nhầm lẫn (Confusion matrix) đều là các chỉ số quan trọng trong việc đánh giá mô hình, nhưng chúng không phù hợp trong trường hợp này. Độ chính xác (Accuracy) chỉ cho biết tỷ lệ dự đoán chính xác của mô hình, nhưng nó không thể hiện được khả năng mô hình trong việc phát hiện các cây cầu có thể sụp đổ. Ma trận nhầm lẫn (Confusion matrix) cho thấy số lượng dự đoán chính xác và sai lầm của mô hình, nhưng nó cũng không thể hiện được khả năng mô hình trong việc phát hiện các cây cầu có thể sụp đổ. Độ chính xác (Precision) và độ nhớ (Recall) là hai chỉ số quan trọng trong trường hợp này. Độ chính xác (Precision) cho biết tỷ lệ dự đoán chính xác của mô hình đối với các cây cầu có thể sụp đổ, trong khi độ nhớ (Recall) cho biết tỷ lệ dự đoán chính xác của mô hình đối với các cây cầu có thể sụp đổ. Trong trường hợp này, độ nhớ (Recall) là chỉ số quan trọng hơn vì mục tiêu của bạn là giảm thiểu sự sụp đổ của cây cầu và hậu quả nghiêm trọng mà nó gây ra. Vì vậy, độ nhớ (Recall) sẽ hữu ích nhất để đánh giá mô hình.
Tất cả câu hỏi
Ngân hàng câu hỏi trắc nghiệm có đáp án và giải thích chi tiết.
Khi huấn luyện và kiểm tra mô hình AI trong một ngữ cảnh cụ thể, có một số hạn chế cần lưu ý. Mô hình AI có thể không thể hoạt động hiệu quả khi được áp dụng vào các ngữ cảnh khác nhau. Điều này là do mô hình AI đã được huấn luyện và kiểm tra trong ngữ cảnh cụ thể, vì vậy nó có thể không có đủ kiến thức và kỹ năng để xử lý các tình huống khác nhau. Ngoài ra, mô hình AI cũng có thể không thể thích nghi được với các thay đổi trong ngữ cảnh, dẫn đến hiệu suất thấp. Vì vậy, cần phải xem xét kỹ lưỡng khi áp dụng mô hình AI vào các ngữ cảnh khác nhau.
Goodhart's luật là một nguyên tắc quan trọng trong học máy, giúp chúng ta tránh được những sai lầm tiềm ẩn khi xây dựng và triển khai mô hình học máy. Lý do quan trọng của Goodhart's luật là mô hình có thể tối ưu hóa một chỉ số nhất định, nhưng đồng thời bỏ qua hoặc giảm thiểu các chỉ số khác. Điều này có thể dẫn đến hiệu suất tốt trong một số trường hợp, nhưng lại gây ra hậu quả tiêu cực trong các trường hợp khác. Ví dụ, một mô hình có thể tối ưu hóa độ chính xác của dự đoán, nhưng lại bỏ qua độ tin cậy của dự đoán. Điều này có thể dẫn đến việc đưa ra những dự đoán không chính xác, gây ra hậu quả nghiêm trọng. Vì vậy, Goodhart's luật giúp chúng ta nhận ra được những hạn chế của mô hình và tránh được những sai lầm tiềm ẩn.
Trong quá trình kiểm tra lại (cross-validation), tập dữ liệu được chia thành ba phần: tập huấn luyện, tập kiểm tra và tập xác minh. Tập xác minh được sử dụng để tinh chỉnh hiệu suất của mô hình. Khi mô hình được huấn luyện trên tập huấn luyện và kiểm tra trên tập kiểm tra, tập xác minh được sử dụng để đánh giá hiệu suất của mô hình và tinh chỉnh các tham số của mô hình. Điều này giúp đảm bảo rằng mô hình hoạt động tốt trên dữ liệu mới chưa được nhìn thấy trước đó.
Hacktivism là một hình thức hoạt động mạng nhằm mục đích thúc đẩy thay đổi xã hội. Các hacker thường sử dụng công nghệ để chống lại các chính sách hoặc hành vi mà họ coi là bất công hoặc độc hại. Mục tiêu chính của hacktivism không phải là kiếm tiền hoặc phục vụ một người có quyền lực, mà là tạo ra sự thay đổi tích cực trong xã hội. Điều này có thể bao gồm việc tiết lộ thông tin bí mật, phá vỡ các hệ thống độc tài hoặc chống lại các chính sách phân biệt đối xử. Mục đích của hacktivism là tạo ra sự thay đổi và nâng cao nhận thức về các vấn đề xã hội.
Một mô hình dự đoán có thể tiết lộ nhiều thông tin về bản thân nó. Trong đó, dữ liệu mà mô hình được đào tạo trên có thể được xem là một trong những thông tin quan trọng nhất. Khi chúng ta biết được dữ liệu mà mô hình được đào tạo trên, chúng ta có thể hiểu được tính chất và đặc điểm của mô hình. Điều này giúp chúng ta đánh giá được độ chính xác và tin cậy của mô hình. Ngoài ra, dữ liệu mà mô hình được đào tạo trên cũng có thể giúp chúng ta nhận biết được các vấn đề tiềm ẩn trong mô hình, chẳng hạn như sự thiên vị trong dữ liệu.
Các hệ thống thông minh môi trường (ambient intelligence systems) thu thập, truyền tải, lưu trữ và truy cập dữ liệu liên tục, dẫn đến những rủi ro bảo mật liên quan đến quyền riêng tư. Trong số các lựa chọn trên, rủi ro không được phép truy cập dữ liệu (Unauthorized data access) là phổ biến nhất do giám sát dữ liệu liên tục. Điều này là vì dữ liệu được thu thập và lưu trữ liên tục, tạo điều kiện cho những kẻ tấn công có thể truy cập trái phép và sử dụng dữ liệu nhạy cảm. Ngoài ra, việc giám sát dữ liệu liên tục cũng có thể dẫn đến việc thu thập và lưu trữ dữ liệu không cần thiết, gây lãng phí tài nguyên và vi phạm quyền riêng tư của người dùng.
Loại malware nào sau đây theo dõi hành vi của người dùng mà không có sự biết hoặc sự cho phép của họ?
Một mô hình dự đoán có thể giúp chúng ta học hỏi được những điều gì không phụ thuộc vào việc liệu dữ liệu của cá nhân đó có được bao gồm trong tập dữ liệu huấn luyện hay không. Điều này có nghĩa là nếu chúng ta huấn luyện mô hình dự đoán với dữ liệu của cá nhân đó, hoặc nếu chúng ta huấn luyện mô hình dự đoán mà không bao gồm dữ liệu của cá nhân đó, kết quả dự đoán của mô hình vẫn nên giống nhau. Điều này cho thấy rằng mô hình dự đoán đã học hỏi được những đặc điểm chung của dữ liệu mà không bị ảnh hưởng bởi dữ liệu của cá nhân đó.
STRIDE và VAST là các phương pháp phân loại và phân tích mối đe dọa. STRIDE là một phương pháp phân loại mối đe dọa theo 6 loại: Spoofing, Tampering, Repudiation, Information Disclosure, Denial of Service và Elevation of Privilege. VAST là một phương pháp phân loại mối đe dọa theo 5 loại: Threat, Attack Pattern, Attack Resource, Attack Pattern Impact và Attack Pattern Platform. Các phương pháp này thường được sử dụng trong quá trình phân tích và mô hình hóa mối đe dọa để xác định và đánh giá các mối đe dọa tiềm ẩn. Vì vậy, STRIDE và VAST có thể được áp dụng trong các công cụ phân tích và mô hình hóa mối đe dọa.
Trong bối cảnh trí tuệ nhân tạo (AI), sự đồng ý được thông tin (informed consent) đòi hỏi phải có sự minh bạch trong việc sử dụng dữ liệu và sự cho phép của người dùng. Điều này có nghĩa là người dùng phải được thông báo rõ ràng về cách dữ liệu của họ sẽ được sử dụng, bao gồm cả việc phân tích, xử lý và bảo mật dữ liệu. Người dùng cũng phải được cho phép về việc sử dụng dữ liệu của họ cho mục đích nào đó. Điều này giúp đảm bảo rằng người dùng hiểu rõ về cách dữ liệu của họ sẽ được sử dụng và có thể đưa ra quyết định một cách thông minh về việc sử dụng dịch vụ hoặc sản phẩm dựa trên AI.
Để xác định thông tin nào là thông tin nhận dạng cá nhân (Personally Identifiable Information - PII), chúng ta cần xem xét từng lựa chọn. Thông tin nhận dạng cá nhân là bất kỳ thông tin nào có thể được sử dụng để xác định hoặc liên hệ với một cá nhân cụ thể. Ví dụ, địa chỉ nhà của một người (A user's home address) là một loại thông tin nhận dạng cá nhân vì nó có thể được sử dụng để liên hệ với người đó. Cùng với đó, một ID khách hàng trong hệ thống đặt hàng trực tuyến (A user's customer ID in an online ordering system) cũng là một loại thông tin nhận dạng cá nhân vì nó có thể được sử dụng để xác định người dùng cụ thể. Ngược lại, các sự kiện hệ thống được thêm vào nhật ký (System events added to a log) và các giá trị đo nhiệt độ cho tòa nhà văn phòng (Temperature readings for an office building) không phải là thông tin nhận dạng cá nhân vì chúng không thể được sử dụng để xác định hoặc liên hệ với một cá nhân cụ thể.
Kỹ thuật mã hóa homomorph là một phương pháp mã hóa dữ liệu mà cho phép thực hiện các phép toán trên dữ liệu đã mã hóa mà không cần phải giải mã chúng trước. Điều này có nghĩa là bạn có thể thực hiện các phép tính như cộng, trừ, nhân, chia, v.v. trên dữ liệu đã mã hóa mà không cần phải biết thông tin bí mật. Kỹ thuật này được sử dụng rộng rãi trong các ứng dụng như bảo mật dữ liệu, bảo mật giao dịch, và bảo mật thông tin. Nó cho phép các tổ chức và cá nhân thực hiện các phép toán trên dữ liệu đã mã hóa mà không cần phải lo lắng về việc dữ liệu bị truy cập trái phép. Kỹ thuật mã hóa homomorph cũng cho phép thực hiện các phép toán trên dữ liệu đã mã hóa mà không cần phải biết thông tin bí mật, điều này giúp tăng cường bảo mật dữ liệu và ngăn chặn các cuộc tấn công từ bên ngoài.
Khi nói đến việc bảo vệ dữ liệu riêng tư, có thể có một số nguyên nhân dẫn đến vấn đề. Trong số các lựa chọn trên, 'Dữ liệu được lưu trữ không an toàn' có thể là nguyên nhân gốc rễ của vấn đề. Điều này có nghĩa là dữ liệu đã được lưu trữ mà không được bảo vệ đúng cách, khiến cho nó dễ bị truy cập trái phép hoặc bị xâm phạm. Điều này có thể xảy ra do việc sử dụng mật khẩu yếu, không sử dụng mã hóa hoặc không tuân thủ các biện pháp bảo mật khác. Nếu dữ liệu được lưu trữ không an toàn, nó có thể bị truy cập trái phép, bị xâm phạm hoặc bị đánh cắp, dẫn đến việc lộ thông tin cá nhân của người dùng.
Differential bí mật (Differential privacy) là một phương pháp bảo mật dữ liệu, giúp đảm bảo rằng dữ liệu cá nhân không thể được xác định một cách chính xác. Để đạt được điều này, Differential bí mật hoạt động bằng cách thêm một loại thông tin ngẫu nhiên vào dữ liệu. Loại thông tin này được gọi là "noise" (ồn). Noise được thêm vào dữ liệu để che giấu thông tin cá nhân và ngăn chặn việc xác định dữ liệu một cách chính xác. Điều này giúp bảo vệ quyền riêng tư của người dùng và ngăn chặn việc sử dụng dữ liệu một cách không được phép.
Để đảm bảo an toàn cho dữ liệu trong các tập dữ liệu học máy, cần thực hiện một số biện pháp bảo mật. Trong số các lựa chọn trên, "Tổ chức một cấu trúc quản trị dữ liệu vững chắc" là một thực hành bảo mật được khuyến nghị. Điều này bao gồm việc thiết lập các quy trình và chính sách rõ ràng để quản lý dữ liệu, bao gồm việc thu thập, lưu trữ, phân tích và chia sẻ dữ liệu. Một cấu trúc quản trị dữ liệu vững chắc giúp ngăn chặn việc truy cập không hợp lệ, bảo vệ dữ liệu khỏi bị xâm phạm và đảm bảo rằng dữ liệu được sử dụng một cách có trách nhiệm.
Khi thảo luận về quyền truy cập vào dữ liệu người dùng một cách đạo đức, cần phải thông báo cho người dùng về một số yếu tố quan trọng. Trước hết, cần phải giải thích ý định đằng sau một hoạt động hoặc yêu cầu cụ thể. Điều này giúp người dùng hiểu rõ mục đích và hậu quả của việc truy cập vào dữ liệu của họ. Thứ hai, cần phải yêu cầu sự đồng ý từ người dùng trước khi thực hiện một hành động nào đó. Điều này đảm bảo rằng người dùng đã được thông báo và đồng ý với việc truy cập vào dữ liệu của họ. Các yếu tố khác như giá trị tiền tệ của dữ liệu hoặc đề nghị tiền hoặc lợi ích khác để từ bỏ quyền của người dùng không phải là yếu tố cần thiết khi thảo luận về quyền truy cập vào dữ liệu một cách đạo đức.
Một ví dụ về tập dữ liệu công khai có nguy cơ vi phạm quyền riêng tư của thuật toán là tập dữ liệu của bệnh viện Stanford. Tập dữ liệu này có thể chứa thông tin cá nhân của bệnh nhân, chẳng hạn như tên, địa chỉ, số điện thoại, v.v. Nếu thuật toán được sử dụng để phân tích dữ liệu này mà không có biện pháp bảo vệ quyền riêng tư, có thể dẫn đến việc tiết lộ thông tin cá nhân của bệnh nhân. Điều này có thể gây ra hậu quả nghiêm trọng cho bệnh nhân, chẳng hạn như bị xâm phạm quyền riêng tư, bị lừa đảo, v.v. Do đó, cần phải có biện pháp bảo vệ quyền riêng tư khi sử dụng thuật toán để phân tích dữ liệu của bệnh viện Stanford.
Khi bỏ qua các yếu tố đạo đức trong quá trình phát triển công nghệ, hậu quả lâu dài có thể xảy ra là mất lòng tin của công chúng và khả năng bị phản ứng từ các cơ quan quản lý. Điều này có thể dẫn đến sự sụp đổ của doanh nghiệp và ảnh hưởng nghiêm trọng đến nền kinh tế. Ngoài ra, việc bỏ qua các yếu tố đạo đức cũng có thể dẫn đến sự mất mát về uy tín và danh dự của công ty. Điều này có thể ảnh hưởng đến khả năng thu hút nhân tài và đầu tư trong tương lai. Vì vậy, việc xem xét các yếu tố đạo đức là rất quan trọng trong quá trình phát triển công nghệ.
Một loại trí tuệ nhân tạo (AI) có khả năng vượt trội so với con người trong tất cả các nhiệm vụ được gọi là Trí tuệ nhân tạo chung (General AI). Trí tuệ nhân tạo chung là một loại AI có khả năng tự học hỏi, tự thích nghi và tự cải thiện mà không cần sự can thiệp của con người. Nó có thể thực hiện các nhiệm vụ phức tạp và đa dạng, bao gồm cả những nhiệm vụ mà con người không thể thực hiện được. Ví dụ, một General AI có thể hiểu và giải thích ngôn ngữ tự nhiên, giải quyết vấn đề phức tạp, và thậm chí còn có thể tạo ra nghệ thuật và văn học. Mục tiêu của việc phát triển General AI là tạo ra một loại AI có khả năng tự động hóa và cải thiện các nhiệm vụ phức tạp mà không cần sự can thiệp của con người.