למה כתוביות בעברית מתקלקלות בפרימייר, ואיך מתקנים כל אחת מהן
כתוביות שנראו תקינות בקובץ, ובטיימליין של פרימייר הופכות לג'יבריש, מתהפכות בכיוון או נשברות באמצע מילה. הנה מה בדיוק נשבר בכל אחת מהתקלות, למה זה קורה, ואיך נראית הגרסה התקינה.
אתה מייבא לפרימייר קובץ SRT או VTT עם כתוביות בעברית — כזה שקיבלת ממתמלל או שהכנת בעצמך — ומה שמופיע על המסך לא דומה למה שנכתב. במקום מילים בעברית מופיע רצף תווים חסר משמעות, ולפעמים ריבועים ריקים או סימני שאלה. זה לא באג אקראי, אלא שרשרת קידוד שנשברת תמיד באותה נקודה: פרימייר מצפה לקובץ בקידוד UTF-8, ולא מעט כלי תמלול ותוכנות טקסט ישנות שומרות כברירת מחדל בקידוד עברי ישן יותר, כמו Windows-1255 או ISO-8859-8. פרימייר קורא את אותם בתים לפי UTF-8, ומקבל תווים שאין להם שום קשר לעברית שנכתבה במקור.
זו רק הראשונה מתוך שלוש תקלות שכמעט תמיד מגיעות יחד. השנייה היא כיוון: עברית נכתבת מימין לשמאל, אבל מספרים, סימני פיסוק בסוף משפט ומילים לועזיות בתוך משפט עברי נשארים משמאל לימין. מנוע שלא מטפל בערבוב הזה כמו שצריך מייצר שורה שהמילים בה קריאות, אבל הפיסוק קופץ לצד הלא נכון והשילוב של עברית ואנגלית מתפרק. השלישית היא חלוקה לשורות: מנוע שמחלק לפי ספירת תווים בלבד עלול לחתוך בדיוק באמצע מילה, ולהשאיר את תחילתה בסוף שורה אחת ואת המשכה בתחילת השורה הבאה.
שלוש התקלות האלה לא באמת דורשות שלושה תיקונים נפרדים. הן דורשות תהליך שנבנה עם עברית כשפת יעד, ולא כתוספת מאוחרת. במדריך הזה נראה איך כל תקלה נראית, מה הסיבה הטכנית שלה, ומה ההבדל בין לתקן קובץ שבור לבין למנוע את השבירה מלכתחילה.
Translated naturally.
In every language.
Native phrasing, not word-for-word. Word-level timestamps, burned-in or exported as SRT — in seconds.
תקלת קידוד: למה עברית תקינה הופכת לג'יבריש
זו התקלה הנפוצה ביותר, והיא גם המטעה ביותר, כי הקובץ נראה תקין כשפותחים אותו בעורך טקסט מסוים ונשבר רק כשהוא נכנס לפרימייר. הסיבה פשוטה: פרימייר קורא קובצי SRT ו-VTT כקבצים בקידוד UTF-8. חלק מכלי התמלול הישנים, וגם עורכי טקסט בסיסיים בחלונות, שומרים כברירת מחדל בקידוד עברי ישן — Windows-1255 או ISO-8859-8. שני הקידודים האלה ממפים את האותיות העבריות לרצף בתים אחר לגמרי, וכשפרימייר מפרש את הבתים האלה כ-UTF-8 הוא מציג תווים אקראיים, סימני שאלה או ריבועים ריקים.
חשוב להבין מה בדיוק קרה כאן: זה לא תרגום כושל ולא גופן חסר, אלא קריאה שגויה של בתים ברמה הבינארית. אין שום קשר בין הטקסט שמופיע על המסך לבין הטקסט המקורי, מלבד העובדה ששניהם נובעים מאותם בתים עצמם.
הבדיקה המהירה: פתח את קובץ ה-SRT בעורך טקסט שמציג את הקידוד, כמו VS Code או Sublime Text, ובדוק איזה קידוד הוא מזהה. אם לא כתוב שם UTF-8 במפורש, מצאת את מקור הבעיה, והוא לא בפרימייר. התיקון הידני הוא לשמור מחדש בקידוד UTF-8 ולייבא שוב. זה עובד, אבל זה שלב נוסף בכל פרויקט, והוא לא נוגע בשתי התקלות הבאות. ב-Captain Cut השאלה הזו לא עולה, כי התמלול נעשה בתוך פרימייר והכתוביות נוצרות ישירות כמסלול כתוביות רגיל, בלי קובץ ביניים שיכול להישמר בקידוד שגוי.
תקלת כיוון: פיסוק, מספרים ומשפטים מעורבים
גם כשהקידוד תקין והאותיות נקראות נכון, נשארת שכבה שנייה של תקלות שייחודית לשפות שנכתבות מימין לשמאל. עברית היא שפה ימין-לשמאל, אבל מספרים, סימני פיסוק בסוף משפט ותוכן לועזי בתוך משפט עברי — שם מותג, כתובת אימייל, מונח מקצועי — נשארים שמאל-לימין. שילוב שני הכיוונים בשורה אחת דורש טיפול מפורש, ומנועי כתוביות רבים פשוט מיישרים את השורה לימין ומקווים לטוב.
כך זה נראה עם פיסוק. המשפט התקין הוא "תעקבו אחרינו באינסטגרם!", וסימן הקריאה אמור להופיע בקצה השמאלי של השורה, כי הקריאה מתחילה מימין. במנוע שלא מטפל בכיוון נכון סימן הקריאה קופץ לקצה הימני ונראה כאילו הוא פותח את המשפט, מפני שהמנוע התייחס אליו כתו עצמאי במקום לשייך אותו לכיוון הטקסט שסביבו.
כך זה נראה עם מספרים. במשפט "הפרק השני יעלה ב-15 לחודש" המספר אמור להישאר 15. מנוע שלא מטפל בכיוון עלול להציג את הספרות בסדר הפוך, כך שהצופה קורא 51, למרות שבקובץ עצמו שום דבר לא השתנה. אותו דבר קורה בשילוב של עברית ואנגלית: ביטוי כמו "תורידו את האפליקציה מ-App Store" עלול להתפרק לשני חלקים במקום להישאר יחידה אחת בתוך המשפט העברי.
זה לא עניין קוסמטי. כתובית שהפיסוק בה במקום הלא נכון מכריחה את הצופה לקרוא את המשפט פעמיים, וזה בדיוק ההפך ממה שכתובית אמורה לעשות. Captain Cut מטפל בכיוון עצמו, במיקום הפיסוק, במספרים ובשורות שמערבבות שני כיוונים, כחלק מיצירת הכתובית ולא כתיקון בדיעבד.
חלוקה לשורות: כתובית שנקטעת באמצע מילה
התקלה השלישית עדינה יותר, כי היא לא נראית שבורה באופן בוטה. היא רק מקשה מעט על הקריאה, וזה מצטבר לאורך סרטון שלם. מנוע שמחלק שורות לפי מגבלת תווים גולמית — למשל ארבעים ושניים תווים לשורה — לא בודק אם נקודת החיתוך נופלת בתוך מילה, והתוצאה מגיעה מהר מאוד.
כך נראית חלוקה שגויה של המשפט "אנחנו רוצים להודות לכל מי שתמך בנו לאורך הדרך הזאת":
שורה 1: "אנחנו רוצים להודות לכל מי שתמך ב"
שורה 2: "נו לאורך הדרך הזאת"
המילה "בנו" נחתכה בדיוק באמצע, כי המנוע ספר תווים ולא זיהה גבול מילה. אותו משפט בחלוקה תקינה:
שורה 1: "אנחנו רוצים להודות לכל מי שתמך בנו"
שורה 2: "לאורך הדרך הזאת"
ההבדל הוא שהחיתוך נופל בין מילים שלמות, במקום שבו קורא טבעי היה עוצר לנשימה. Captain Cut בונה את הכתוביות מתמלול עם חותמות זמן ברמת מילה בודדת, כך שכל שורה מורכבת ממילים שלמות ואף מילה לא נחתכת באמצע. אם יש שורה שאתה רוצה לחלק אחרת, אפשר לערוך אותה בפרימייר כמו כל כתובית אחרת.
שני מסלולים לכתוביות בעברית בפרימייר
| Captain Cut | ייבוא קובץ SRT חיצוני | |
|---|---|---|
| קידוד | אין קובץ ביניים — הכתוביות נוצרות ישירות בפרימייר | תלוי בקידוד שבו נשמר הקובץ במקור |
| כיוון, פיסוק ומספרים | מטופלים כחלק מיצירת הכתובית | תלוי במנוע שיצר את הקובץ |
| חלוקה לשורות | נבנית מחותמות זמן ברמת מילה בודדת | לרוב חיתוך לפי ספירת תווים |
| שילוב עברית ואנגלית בשורה | חלק מהטיפול בשורות מעורבות כיוון | תלוי במנוע שיצר את הקובץ |
| פלט | מסלול כתוביות רגיל של פרימייר, סטיילינג ב-Essential Graphics וייצוא SRT | קובץ חיצוני שצריך לייבא ולבדוק |
אם קיבלת קובץ SRT מוכן ואתה רואה ג'יבריש בפרימייר — בדוק קודם את קידוד הקובץ, UTF-8 מול Windows-1255, לפני שאתה מנסה לתקן משהו אחר. זה כמעט תמיד המקור, וזה השלב הראשון שכדאי לבדוק, לא האחרון.
לתקן קובץ שבור או למנוע את השבירה מלכתחילה
יש שתי גישות לבעיה, וההבדל ביניהן קובע כמה זמן יורד לטמיון בכל פרויקט. הגישה הראשונה, הנפוצה, היא לתקן אחרי שהנזק כבר נעשה: לפתוח את קובץ ה-SRT, לזהות את הקידוד השגוי, לשמור מחדש ב-UTF-8, לייבא שוב, לעבור על השורות שנחתכו באמצע מילה ולתקן אותן אחת-אחת בעורך הכתוביות של פרימייר, ואז לבדוק שוב כל שורה שיש בה מספר או מילה לועזית. בסרטון ארוך עם מאות כתוביות זו עבודה מייגעת שאין לה שום קשר לעריכה עצמה.
הגישה השנייה היא למנוע את שלוש התקלות מראש, על ידי כך שהתמלול ויצירת הכתוביות קורים באותה סביבה שבה הן ייערכו — בתוך פרימייר, בלי קובץ ביניים חיצוני. זה ההבדל המהותי. Captain Cut מתמלל את השמע ומייצר את הכתוביות עם חותמות זמן ברמת מילה בודדת וטיפול מלא בכיוון, כבר בשלב היצירה. הפלט הוא מסלול כתוביות רגיל של פרימייר, כך שאפשר לעצב אותו ב-Essential Graphics — גופן, צבע, גודל — בדיוק כמו כל כתובית אחרת, ולייצא ממנו SRT בסוף.
יש גם תרחיש שלישי: תרגום. אם יש לך סרטון בעברית ואתה רוצה גרסה בשפה אחרת, Captain Cut מתרגם תוך כדי התמלול, ולא בשלב נפרד. זה רלוונטי במיוחד כשבתוכן יש שמות פרטיים או מונחים מקצועיים שאתה רוצה לשמר, כי שימור השמות מובנה בתהליך. ואם אתה עובד בכיוון ההפוך, עם כתוביות עבריות שהגיעו משירות חיצוני ומלאות בתקלות, לרוב מהיר יותר לתמלל מחדש מהשמע מאשר לנסות להציל את הקובץ השבור.
שאלות נפוצות על תיקון כתוביות בעברית
פתח את הקובץ בעורך טקסט שמציג קידוד, כמו VS Code או Sublime Text, ולא ב-Notepad הרגיל. בדוק איזה קידוד מזוהה, ואם זה Windows-1255 או ISO-8859-8 שמור מחדש בקידוד UTF-8 וייבא שוב לפרימייר. זה פותר את הג'יבריש, אבל לא נוגע בבעיות כיוון או בחלוקת שורות שגויה שעדיין עשויות להיות בקובץ — אלה דורשים עריכה ידנית שורה אחר שורה.
מפני שהמנוע שיצר את הכתובית לא מטפל נכון בערבוב כיוונים. מספרים נשארים שמאל-לימין גם בתוך משפט עברי, וזה דורש טיפול מפורש ברינדור — לא מספיק לקבוע שהשורה כולה בעברית, צריך לזהות בתוכה את הקטעים שכיוונם הפוך ולשמר את הסדר שלהם. Captain Cut מטפל במספרים, בפיסוק ובשורות מעורבות כיוון כחלק מיצירת הכתובית.
כן. תקלות קידוד וכיוון נובעות מהאופן שבו הקובץ נוצר, לא מהתוכנה שאליה הוא מיובא, אז אותו קובץ שבור יציג בעיות גם ב-DaVinci. חשוב לציין ש-Captain Cut הוא תוסף ל-Premiere Pro בלבד ואינו רץ בתוך DaVinci — אם אתה עורך שם, הפתרון הוא לתקן את קידוד הקובץ ידנית לפני הייבוא, כמתואר בשאלה הראשונה.
מפני שהמנוע שחילק את השורות ספר תווים בלבד ולא זיהה גבולות מילה. זה נפוץ בכלים שנבנו קודם כול לשפות שמאל-לימין ותומכים בעברית ברמת תצוגה בסיסית. Captain Cut בונה את השורות מתמלול עם חותמות זמן ברמת מילה בודדת, ולכן החיתוך נופל תמיד בין מילים שלמות.
לא באותו אופן, כי אנגלית היא שפה שמאל-לימין ואין בה ערבוב כיוונים. אבל אם התרגום נעשה מקובץ עברי שכבר שבור — בקידוד או בחלוקת השורות — התוצאה המתורגמת תירש חלק מהשגיאות, מפני שהתרגום מתבסס על טקסט פגום. הדרך הנקייה היא לתרגם מהשמע המקורי, כך שהתמלול והתרגום קורים על מקור תקין.
תיקון הקידוד עצמו הוא פעולה קצרה של שמירה מחדש. מה שגוזל את הזמן הוא מה שבא אחריו: מעבר ידני על השורות שנחתכו באמצע מילה ועל כל שורה שיש בה מספר או מילה לועזית, אחת-אחת בעורך הכתוביות. ככל שהסרטון ארוך יותר ומספר הכתוביות גדול יותר, כך העבודה הזו מתארכת — וזה בדיוק הזמן שנחסך כשהכתוביות נוצרות נכון כבר בשלב התמלול.
לא. פרימייר תומך בגופני מערכת שכוללים תווי עברית, כמו Arial Hebrew או David. אם מה שאתה רואה הוא ריבועים ריקים במקום אותיות, זה כמעט תמיד סימן לתקלת קידוד ולא לגופן חסר, ולכן כדאי לבדוק את קידוד הקובץ לפני שמחליפים גופן.
כתוביות בעברית שלא צריך לתקן אחר כך
תמלול בתוך פרימייר, כיוון RTL מלא וחותמות זמן ברמת מילה — נכון מהרגע הראשון. שבעה ימי ניסיון חינם בכל התוכניות.
התחל תקופת ניסיון חינם