हम क्यों मौजूद हैं
2019 में हेरफेर की गई तस्वीर पकड़ने का मतलब आमतौर पर क्लोन-स्टैंप का धुँधला किनारा या ग़लत दिशा में पड़ती छाया ढूँढ़ना होता था। आज ऐसी घटना की भरोसेमंद तस्वीर जो कभी हुई ही नहीं, लगभग चार सेकंड में, कोई भी, मुफ़्त बना सकता है। कृत्रिम मीडिया बनाने के उपकरण आगे निकल गए; उन्हें जाँचने के उपकरण नहीं।
जो सत्यापन सेवाएँ आईं भी, उनमें एक पेच था। वे कहती थीं कि जिस फ़ाइल पर आपको संदेह है, ठीक वही सौंप दीजिए, उसे ऐसे अधिकार-क्षेत्र के सर्वरों पर अपलोड कीजिए जिसका नाम भी आप नहीं जानते, और बिना यह जाने कि वह कहाँ से आया, एक अकेला विश्वास-प्रतिशत स्वीकार कर लीजिए। लीक हुई तस्वीर थामे पत्रकार, मुक़दमे का साक्ष्य रखने वाले वकील, या शिकायत जाँचते मॉडरेटर के लिए यह सौदा अस्वीकार्य है।
इसलिए हमने इसका उल्टा बनाया। Fake Images Detector पूरी तरह आपके ब्राउज़र में चलता है — छवि कहीं जाती ही नहीं, और हर स्कोर उन मापों में विभाजित होता है जिनसे वह बना है।
हम असल में क्या करते हैं
इंजन हर छवि पर चार स्वतंत्र फ़ोरेंसिक विश्लेषण करता है और उन्हें एक-दूसरे के सामने तौलता है:
- फ़ोरेंसिक मेटाडेटा विश्लेषण — आयामी हस्ताक्षर, अनुपात की अखंडता, प्रारूप छाप और प्रति पिक्सेल बिट घनत्व।
- नॉइज़ पैटर्न पहचान — मापता है कि रंग चैनल असली सेंसर की तरह अव्यवस्थित ढंग से बदलते हैं या जेनरेटर अथवा रीटच प्रक्रिया की तरह चिकने ढंग से।
- संपीड़न अवशेष बुद्धिमत्ता — नियंत्रित पुनः संपीड़न पर छवि की प्रतिक्रिया का प्रोफ़ाइल बनाकर पिछली संपादन पीढ़ियाँ उजागर करता है।
- त्रुटि-स्तर विश्लेषण — पूरे फ़्रेम में संपीड़न त्रुटि का ऊष्मा-मानचित्र बनाता है, ताकि जोड़े या चिपकाए गए हिस्से अछूती पृष्ठभूमि से दृश्य रूप से अलग दिखें।
इनमें से कोई भी अकेले निर्णायक नहीं है। इनका आपसी मतभेद ही अक्सर सबसे सूचनाप्रद संकेत होता है, और इसीलिए हम चारों दिखाते हैं, न कि उन्हें एक संख्या में औसत कर बाक़ी छिपा देते हैं।
शून्य अपलोड बनावट से है, नीति से नहीं। ऐसा कोई अपलोड एंडपॉइंट है ही नहीं जिसके बारे में आपको हम पर भरोसा करना पड़े। जाँच चलाते समय अपने ब्राउज़र का नेटवर्क टैब खोलें — आप देखेंगे कि पृष्ठ से कोई छवि डेटा बाहर नहीं जाता।
हम किसमें विश्वास करते हैं
सत्यापन मुफ़्त होना चाहिए
भुगतान की दीवार के पीछे सच की जाँच केवल उन्हीं की रक्षा करती है जो उसे वहन कर सकें। चूँकि हमारा विश्लेषण हमारे नहीं, आपके हार्डवेयर पर चलता है, वसूलने को कोई सीमांत लागत ही नहीं — इसलिए यह उपकरण असीमित और मुफ़्त है, व्यक्तिगत और पेशेवर दोनों उपयोग के लिए, बिना खाते और बिना सीमा के।
व्याख्या आत्मविश्वास से बेहतर है
बिना तर्क का प्रतिशत अंधे भरोसे की माँग है। हम आपको दिखने वाले प्रमाणों सहित अनिर्णायक परिणाम देना पसंद करेंगे, बजाय ऐसे आत्मविश्वासी परिणाम के जिसकी आप जाँच न कर सकें। हर जाँच परत-वार आँकड़े और एक डाउनलोड करने योग्य रिपोर्ट लौटाती है जिसे आप अपने नोट्स के साथ लगा सकते हैं।
सीमाओं के बारे में ईमानदारी
फ़ोरेंसिक युक्तियाँ अवशेष मापती हैं, और अवशेष नष्ट किए जा सकते हैं। किसी नक़ल का स्क्रीनशॉट, बार-बार सहेजा गया सोशल मीडिया डाउनलोड, या आक्रामक रूप से बड़ा किया गया रेंडर — तीनों उन्हीं संकेतों को कमज़ोर करते हैं जिन पर हम निर्भर हैं। हम इसे छिपाने के बजाय साफ़ कहते हैं।
इसका उपयोग कौन करता है
- समाचार कक्ष और तथ्य-जाँचकर्ता जो प्रकाशन से पहले उपयोगकर्ता और एजेंसी की छवियाँ छाँटते हैं।
- ट्रस्ट व सेफ़्टी टीमें जो बड़ी मात्रा में रिपोर्ट की गई सामग्री जाँचती हैं।
- कानूनी और eDiscovery पेशेवर जो मुक़दमे की सामग्री तीसरे पक्ष के सर्वरों पर नहीं भेज सकते।
- बीमा और दावा अन्वेषक जो क्षति और घटना की तस्वीरें जाँचते हैं।
- OSINT शोधकर्ता जो खुले स्रोत के दृश्य साक्ष्य की पुष्टि करते हैं।
- शिक्षक और छात्र जो सीखते हैं कि छवि फ़ोरेंसिक वास्तव में कैसे काम करती है।
हम कहाँ जा रहे हैं
जनन मॉडल हर महीने बदलते हैं, और हर नई संरचना अपनी छाप छोड़ती है। हमारी योजना इसी वास्तविकता का अनुसरण करती है: विशिष्ट जेनरेटरों के अवशेषों की व्यापक पहचान, C2PA और उद्गम मेटाडेटा का पठन, टीमों के लिए थोक विश्लेषण, और उन संगठनों के लिए प्रोग्रामेटिक इंटरफ़ेस जिन्हें बड़े पैमाने पर जाँच करनी है।
यदि आप सत्यापन के क्षेत्र में काम करते हैं और कोई जाँच आपको चाहिए जो अभी नहीं है, तो हमें बताएँ। हमने जो कुछ बनाया, उसका अधिकांश किसी न किसी की ठोस और साधारण-सी समस्या से शुरू हुआ था।