הקבצים שלכם נשארים במכשיר שלכם
הקבצים מעובדים בדפדפן שלכם ואינם מועלים לשרתים שלנו. האתר עשוי להוריד מנועי עיבוד ולשלוח אירועי שימוש או משוב ללא תוכן הקבצים.
כיצד אנו מטפלים בנתונים שלכם →PDF ל-HTML
הפיכת טקסט PDF מוטמע לקובץ HTML עצמאי המחולק לדפים, לקריאה נוחה, בדפדפן שלכם. תמונות והפריסה המקורית אינן חלק מהתוצאה.
דוגמה סינתטית – בדקו את הגדרות הפעולה לפני ההפעלה.
המסמכים שלכם נשארים במכשיר הזה. הורדות הכלים וסטטיסטיקות השימוש אינן כוללות תוכן של קבצים.
מגבלות במכשיר שלכם: גודל קובץ בודד מרבי: 10 MB
הקבצים שלכם מעובדים בדפדפן שלכם. הם אינם מועלים לאתר הזה.
מדריך מעשי
תצוגת הטקסט נשארת קשורה לרצף הדפים.
- בחרו קובץ PDF שאפשר לבחור את הטקסט בו.
- ייצאו HTML ופתחו את הקובץ שהורד במחשב שלכם.
- השוו את המקטעים ואת הנוסח שהתקבלו לקובץ ה-PDF המקורי.
נסו את הדוגמה הזו
ייצאו הצעה בת חמישה דפים עם טקסט הניתן לחיפוש ל-HTML. וודאו שסיכום דף 1 ופרטי הקשר בדף 5 מופיעים במקטעים הצפויים לפני ששולחים את עותק הטקסט.
לפני
- דפי PDF עם טקסט
אחרי
- מקטעי דפים ב-HTML
לפני שמתחילים: זו אינה הצגת PDF או המרה ששומרת על הפורמט; תמונות והפריסה המקורית מושמטות.
המשך עם ה-PDF המקורימה מקבלים
ייצאו טקסט מוטמע למסמך HTML עצמאי, עם מקטע אחד לכל דף. הטקסט עובר הסתרת תווים (escaping) ואינו מורץ כ-HTML. גופנים, תמונות, טבלאות ופריסה מקוריים אינם נשמרים; ללא OCR. מגבלות: קלט של 10 MiB, 200 דפים, פלט של 4 MiB.
מגבלות ופרטים חשובים
קלט של עד 10 MiB, 200 דפים ופלט טקסט של 4 MiB. במסמכים סרוקים בלי שכבת טקסט מוצגת שגיאה, במקום חילוץ מוצלח לכאורה. סדר הקריאה, העמודות והגופנים עשויים לא להתאים לפריסה החזותית. זה אינו OCR ואינו המרה מ-PDF ל-Word.
דוגמה
ייצאו דוח מבוסס טקסט ופתחו את קובץ ה-HTML שהורד במכשיר. המקטעים עוקבים אחרי סדר הדפים ב-PDF; דפים ריקים או סרוקים מסומנים בתווית ואינם מטופלים בשקט כטקסט שזוהה.