Theos Group

עד כמה העסק שלך ניתן למצוא ב-Google ובב-AI? בחינם, באופן מידי.

מעדיף לקבל את הדוח המלא מיד? סריקה מורחבת — € 49 →

מה מוסתר בדוקומנט שלך?

תן ל-Harry, הכלי שלנו, לבדוק את הטקסטים שלך.

קובץ Word או PDF נושא יותר מאשר הטקסט: מי יצר אותו, באיזה תוכנה, כמה דקות בילו עליו, טקסט שמישהו חשב שהוא הסיר, הערות בשולי הדף — וב-PDF גם כל הגרסאות הקודמות, במלואן. וגם בתוך הטקסט עצמו יכולים להיות תווים שאתה לא רואה.

הדבק את הטקסט שלך או בחר קובץ. תראה מה יש בו, מה זה אומר, ואיפה כולם הסתכלו. אתה מחליט מה יוצא.

או

Word (.docx) או PDF, עד 15 MB. הקובץ יקרא על השרת שלנו ולא יישמר. קובץ אחד ביום הוא חינם וללא חשבון — הדבקת טקסט היא בלתי מוגבלת.

מה הארי בודק

בטקסט. תווים שאתה לא רואה אבל הם שם: רווחים ללא רוחב, תווי בקרה שמהפכים את כיוון הקריאה, רווחים מיוחדים וסיומי שורה, ואותיות מקירילית, יוונית או ארמנית שנראות כמו אותיות רגילות. אלה מגיעים כשאתה מעתיק טקסט מחלון צ'אט, מ-pdf או מאתר, והם נשארים במה שאתה שולח אחר כך.

בקובץ. קובץ Word נושא את שם מי שיצר אותו ומי שערך אותו לאחרונה, החברה שהיתה מוזנת בתוכנה, כמה דקות עבדו על זה, קודי תיקייה שבהם אפשר לקשור שני מסמכים זה לזה, טקסט שמישהו חשב שמחקה, והערות בשוליים. ל-pdf יש גם את זה, ועוד — עליו להלן.

מה קורה עם המסמך שלך

שום דבר לא יוצא החוצה. הארי לא משתמש ב-AI ולא קורא לשום שירות אחר. זהו תוכנה שקוראת והשוואה. הקובץ שלך נקרא בזיכרון בשרת שלנו ולא הולך לשום מקום אחר.

אנחנו לא שומרים את המסמך שלך. אין קובץ, אין טקסט, אין עותק. מה שדרוש כדי להחזיר לך את הקובץ הנקי עומד רבע שעה בזיכרון העבודה ונעלם מאליו אחר כך. במקרה של PDF, זהו הקובץ עצמו — PDF מעובד במקום ולא בנוי מחדש מטקסט, כך שללא המקור אין מה לנקות. כלום לא הולך לדיסק וכלום לא נכנס למסד נתונים.

מה שאנחנו כן סופרים. הדבקת טקסט אפשרית ללא הגבלה ולא נספרת. לקבצים חל אחד ביום ללא חשבון, וכדי לעשות זאת אנחנו צריכים להיות מסוגלים לסיכום כמה פעמים הנחת לבדיקה קובץ היום. זה קורה עם מספר אקראי בקוקיה וכתובת האינטרנט שלך בצורה מוצפנת — מספיק כדי לספור, לא מספיק כדי למצוא מישהו. אחרי שבעה ימים גם זה הולך.

אתה מחליט. הארי לא מסיר כלום ללא שתסמן זאת, וברור לכל ממצא למה הוא לא שייך שם.

מה שנמצא ב-PDF

PDF נושא אותו סוג של נתונים כמו קובץ Word, ובדרך כלל עוד יותר: בנוסף לסופר ולחותמות הזמן גם מספר מסמך המקשר כל ייצוא של אותו קובץ מקור זה לזה, היסטוריית עריכה עם חותמות זמן, ולפעמים קובץ מוטבע לחלוטין או נתוני EXIF של תמונה — דגם המצלמה, מספר סידורי, ובתמונת טלפון את המקום שבו היא צולמה.

והנקודה הגדולה ביותר: PDF לא משכתב, הוא הדבק לכל מה שאחרי. מסמך שעובר עריכה שלוש פעמים מכיל את כל שלוש הגרסאות בצורה מלאה — דפים שנמחקו, ניסוחים קודמים, טקסט שמישהו חשב שהוסר. הארי בונה את הקובץ מחדש בפעם אחת וכך כל ההיסטוריה הזו נעלמת. זה לא תופס חזיר צד אלא ניקיון חשוב ביותר שיש.

מה שהארי ב-PDF כן מוצא ולא מסיר: טקסט מתחת לרצועה שחורה, טקסט שלא מצויר, טקסט בצבע הנייר, וזו תוכן מחוץ לגזירה. אלה לא עקבות בקליפה אלא תוכן של הדף; הסרתם משנה את מה שהקורא רואה, וזה החלטה של הסופר ולא של תוכנת ניקיון. אתה מקבל לראות מה יש שם ובאיזה דף.

שני דברים שעליך לדעת

א קובץ Word נוקה מחדש יבנה מחדשרק הטקסט, הכותרות, רשימות הנמנים והטבלאות חוזרים. בדיוק לכן אין עוד שם מחבר ולא זמן עריכה — אלה היו בקליפה, והקליפה חדשה. עיצוב שביצעת בעצמך לא מלווה אותך.

בקובץ pdf זה שונה, וזה גם צריך להיות כך: עיצוב קבוע הוא כל הסיבה שזה pdf. הוא לא משוחזר מטקסט אלא מעודכן במקום — העמודים נשארים בדיוק כפי שהיו, וכל מה שנושא זהות יוצא. Harry לא יכול לבדוק pdf עם סיסמה; הסר תחילה את ההגנה.

ו-Harry מבטיח שום אי-ניתן למציאה. הוא מוציא את המחבר, חותמות הזמן, ההיסטוריה וההקבצות. אך הדרך בה משוך קובץ עדיין חושפת באיזה תוכנית הוא נוצר — לאחר הניקוי זה שלנו. בדרך כלל זה בדיוק מה שאתה רוצה, אבל זה לא אותו דבר כמו שום עקבות.

Harry לא מסיר סימון מים סטטיסטי, וגם לא מבטיח זאת. מה שלא קיים כתו בטקסט, הוא לא יכול להוציא. מי שמבטיח משהו אחר מוכר לך משהו שלא קיים.