Mô hình đang xem xét điều gì
Máy ảnh ghi lại ánh sáng đi qua thấu kính lên cảm biến. Quá trình đó để lại một loại nhiễu cụ thể, một mẫu độ sắc nét giảm dần về phía các cạnh cụ thể, và một mối quan hệ cụ thể giữa các điểm ảnh liền kề xuất phát từ lưới cảm biến và quá trình khử khảm theo sau đó.
Một mô hình diffusion xây dựng hình ảnh bằng cách liên tục loại bỏ nhiễu khỏi một trường ngẫu nhiên cho đến khi một hình ảnh mạch lạc xuất hiện. Quá trình đó cũng để lại một dấu ấn, và nó rất khác biệt. Kết quả có thể vừa hoàn hảo về mặt thị giác vừa có thể phân biệt được về mặt thống kê cùng một lúc.
Đây là lý do tại sao tính năng phát hiện vẫn hoạt động trên ảnh chụp màn hình khi siêu dữ liệu không còn. Dấu ấn nằm ngay trong giá trị của các điểm ảnh thay vì trong phần tiêu đề, do đó việc sao chép các điểm ảnh cũng là sao chép bằng chứng.
Bốn giai đoạn
- 1 Đọc tệp Được giải mã trong trình duyệt, không bao giờ tải lên
- 2 Chấm điểm khung hình Vision transformer ở kích thước 384 pixel vuông
- 3 Chấm điểm các ô Cùng một mô hình trên các vùng chồng lấp
- 4 Đọc thông tin xác thực C2PA và các đánh dấu của trình tạo, nếu có
Giai đoạn một: giải mã
Tệp được đọc từ đĩa bởi trang web và được giải mã thành các điểm ảnh thô. HEIC, AVIF, TIFF và các định dạng khác được xử lý bằng các trình giải mã của chính trình duyệt. Không có dữ liệu nào được truyền đi, đây là đặc tính của vị trí thực hiện tác vụ thay vì là chính sách áp dụng trên máy chủ.
Giai đoạn hai: điểm số toàn khung hình
Hình ảnh được thay đổi kích thước thành 384 pixel vuông và đi qua một vision transformer. Mô hình trả về một xác suất thô cho thấy khung hình là ảnh nhân tạo. Con số đó sau đó được hiệu chuẩn để nó ánh xạ nhất quán lên các dải đã công bố thay vì bị lệch theo mô hình.
Việc thay đổi kích thước làm mất chi tiết, đó là nơi đầu tiên độ chính xác bị rò rỉ. Điều này cũng là không thể tránh khỏi: mô hình có kích thước đầu vào cố định và một bức ảnh 4000 pixel phải được thu nhỏ lại để vừa với nó.
Giai đoạn ba: bước chia ô
Khung hình được chia thành các vùng chồng lấp và mỗi vùng được chấm điểm riêng bởi cùng một mô hình. Đây là yếu tố tách biệt một hình ảnh hoàn toàn do AI tạo ra khỏi một bức ảnh thực tế có chèn thêm thứ gì đó, và đây là giai đoạn mà một con số đơn lẻ không thể thay thế.
Lấy trung bình các giá trị này cho ra 21. Chế độ xem theo ô giữ lại thông tin mà phép tính trung bình làm mất đi.
Các ô cần đủ điểm ảnh để có ý nghĩa, đó là lý do tại sao những hình ảnh có cạnh ngắn nhỏ hơn khoảng 576 pixel chỉ nhận được điểm số toàn khung hình. Không có đủ chi tiết trong một vùng cắt nhỏ để chấm điểm độc lập.
Giai đoạn bốn: bản ghi của chính tệp
Tách biệt với các điểm ảnh, tệp được kiểm tra Content Credentials và các đánh dấu trình tạo do một số công cụ để lại. Đường dẫn này mang tính mật mã hơn là thống kê: một chữ ký hợp lệ được đối chiếu với danh sách đáng tin cậy, thay vì được ước tính.
Cách kết hợp các kết quả
Hai đường dẫn không được lấy trung bình, vì chúng mang trọng số khác nhau. Thông tin xác thực hợp lệ tuyên bố ảnh chụp từ máy ảnh sẽ có trọng số cao hơn điểm số điểm ảnh ở mức trung bình. Thông tin xác thực tuyên bố hình ảnh do AI tạo ra sẽ tự động giải quyết vấn đề.
| Bằng chứng | Loại | Trọng số |
|---|---|---|
| Thông tin xác thực hợp lệ tuyên bố hình ảnh do AI tạo ra | Mật mã | Quyết định |
| Thông tin xác thực hợp lệ tuyên bố ảnh chụp từ máy ảnh | Mật mã | Rất mạnh |
| Đánh dấu của trình tạo trong tệp | Tuyên bố | Mạnh, nhưng có thể bị xóa |
| Điểm số điểm ảnh toàn khung hình | Thống kê | Trung bình |
| Điểm số các ô vùng | Thống kê | Trung bình, và cụ thể hơn |
| Không có thông tin xác thực | Không có gì | Không có thông tin theo cả hai hướng |
Hàng cuối cùng đó là hàng mọi người thường hiểu lầm nhiều nhất. Việc vắng mặt thông tin xác thực không phải là tín hiệu tiêu cực. Đại đa số hình ảnh từng được tạo ra đều không có thông tin này và hầu hết mọi nền tảng đều xóa chúng khi tải lên.
Tại sao tính năng này chạy trong trình duyệt
Mô hình có dung lượng khoảng 40 MB và chạy thông qua WebAssembly trên thiết bị của chính người truy cập. Đó là một lựa chọn kiến trúc có chủ đích với ba hệ quả cần hiểu rõ.
- Không có hình ảnh nào được tải lên, do đó không có máy chủ nào lưu giữ ảnh của bất kỳ ai và không có mối quan hệ xử lý dữ liệu nào cần tài liệu hóa.
- Một lần kiểm tra không tốn chi phí vận hành, đó là lý do tại sao công cụ này có thể miễn phí mà không cần bộ đếm mức sử dụng đi kèm.
- Lần kiểm tra đầu tiên sẽ chậm hơn, bởi vì mô hình tải xuống một lần trước khi có thể chạy. Các lần kiểm tra sau sẽ tái sử dụng bản sao được lưu trong bộ nhớ đệm.
Những gì quy trình có chủ đích không làm
Một số kỹ thuật xuất hiện trong các công cụ pháp y cũ không còn xuất hiện nữa, bởi vì chúng không còn hoạt động hiệu quả trên những hình ảnh đã qua các nền tảng hiện đại.
- Phân tích mức độ lỗi (ELA). Phổ biến, bị hiểu lầm rộng rãi và không đáng tin cậy trên bất kỳ hình ảnh nào đã được lưu lại nhiều hơn một lần.
- Phát hiện sao chép-di chuyển. Tìm kiếm các vùng bị trùng lặp bên trong khung hình, giúp phát hiện việc sao chép kiểu cũ chứ không phải hình ảnh do AI tạo ra.
- Phán quyết dựa trên siêu dữ liệu. EXIF hầu như bị xóa ở khắp mọi nơi khi tải lên, do đó việc kiểm tra phụ thuộc vào nó sẽ thất bại chính xác trên những hình ảnh mà mọi người cần xác minh.
- Phân tích chuyên sâu về khuôn mặt. Hữu ích cho một nhóm thao túng hạn hẹp, và mù mịt đối với mọi thứ khác.