מאת צוות ניהול מוניטין | עודכן: 18 בספטמבר 2026 | מדריך מקצועי על בסיס תיעוד OpenAI וניתוח שיווקי
A/B Testing בקמפיין מודעות בצ׳אט ג׳י פי טי דורש יותר מהעלאת שתי מודעות. צריך להגדיר מה בודקים, לבחור מדד הצלחה ולוודא שההשוואה אינה מטעה. מודעה שקיבלה יותר קליקים יכולה פשוט לקבל יותר חשיפות; מודעה עם CTR גבוה יכולה להביא פניות פחות מתאימות.
המדריך של חברת ניהול מוניטין, בהובלת לירון קטלן, מציג דרך מסודרת לבדוק מסרים ווריאציות. הוא מיועד גם למי שרגיל לעבוד בקמפיינים של Meta או גוגל, אך אינו מניח שמנגנוני הניסוי, החלוקה והבקרה זהים בכל הפלטפורמות.
- מה ההבדל בין כמה מודעות לבין ניסוי A/B?
- מתחילים מהשערה, לא מעוד עשר כותרות
- מה כדאי לבדוק בכל פעם?
- איך משלבים כמה מודעות במבנה קמפיין הגיוני?
- כך מכינים טופס ניסוי לפני ההפעלה
- איך קוראים תוצאות בלי לבחור מנצחת מוקדם מדי?
- למה לא להעתיק אוטומטית את השיטה מגוגל או Meta?
- איך הופכים תוצאה להחלטה?
- שאלות נפוצות
מה ההבדל בין כמה מודעות לבין ניסוי A/B?
כמה מודעות מאפשרות לבדוק דרכים שונות להציג הצעה. ניסוי מבוקר נועד לענות על שאלה מדויקת יותר: האם השינוי עצמו גרם להבדל? כדי לענות בביטחון צריך לשלוט בתנאים, בחלוקת התנועה ובשיטת הניתוח. כאשר המערכת בוחרת איזו מודעה להציג בהקשרים שונים, הביצועים עשויים לשקף גם הבדלים בחשיפה ובהתאמה.
אין בכך סיבה לוותר על השוואות. המשמעות היא לתאר אותן נכון: ״וריאציה ב׳ הייתה יעילה יותר בתקופה ובתנאים שנבדקו״, במקום ״הוכחנו שהכותרת מעלה מכירות ב־40% אצל כולם״. החלטה עסקית שימושית יכולה להתבסס על ראיות חלקיות, כל עוד לא מסתירים את מגבלותיהן.

מתחילים מהשערה, לא מעוד עשר כותרות
בחרו שאלה אחת: האם הסבר של התהליך מביא פניות מתאימות יותר ממסר המדגיש חיסכון בזמן? האם תמונה שממחישה את השירות מועילה יותר מתמונה כללית? האם קריאה לפעולה ברורה מקלה על ההחלטה? השערה ממוקדת מאפשרת להבין מה למדנו גם כשהתוצאה אינה חיובית.
OpenAI ממליצה על מסרים מובחנים, שימושיים ונאמנים להצעה, ועל דף נחיתה שממשיך את המודעה. מגוון אמיתי הוא יותר מהחלפת מילה נרדפת. עם זאת, ככל שמוסיפים גרסאות, צריך מספיק תנועה ותקציב כדי ללמוד מכל אחת. מקור: Create Ads.
מה כדאי לבדוק בכל פעם?
| סוג הבדיקה | מה משתנה? | מה רצוי להשאיר דומה? |
|---|---|---|
| כותרת | ניסוח תועלת או זווית אחת. | תמונה, תיאור, יעד והצעה. |
| תמונה | המחשה חזותית. | טקסט, שירות ודף נחיתה. |
| קריאה לפעולה | הצעד שמציעים לקורא. | תנאי השירות והמסר המרכזי. |
| קונספט מלא | שילוב של תמונה, כותרת ותיאור. | אותה מטרה עסקית והצעה, ככל שניתן. |
אם החלפתם כותרת, תמונה ודף יחד, אפשר להשוות בין חבילות קריאייטיב, אך אי אפשר לבודד איזו מהן גרמה לשינוי. זו אינה טעות אם זו הייתה השאלה מלכתחילה. הבעיה מתחילה כאשר בודקים קונספט שלם ומכריזים שהצבע בכפתור הוא הגורם להצלחה.
איך משלבים כמה מודעות במבנה קמפיין הגיוני?
קבוצת מודעות צריכה לעסוק בהצעה או בצורך משותפים. וריאציות של אותו שירות יכולות להיבחן באותה קבוצה. אם מדובר במוצרים, מסלולי לקוח או דפי נחיתה שונים מהותית, קודם מחליטים על המבנה המתאים ורק אחר כך על הניסוי. לא מערבבים שירותי חירום ושירותי תחזוקה רק כדי לקבל טבלה אחת קצרה.
ככלל עבודה שלנו, אפשר להתחיל בזוג גרסאות או במספר קטן של זוויות מובחנות, בהתאם לנפח הפעילות. זו המלצה לניהול למידה, לא מגבלה של המערכת. אין מספר קסם של מודעות שמבטיח הצלחה. פיצול מוגזם עלול להשאיר לכל גרסה מעט מאוד מידע.
דוגמה לימודית לשלוש זוויות לאותו שירות
- זווית תהליך: הסבר מה קורה מרגע הפנייה ועד קבלת השירות.
- זווית התאמה: הבהרה לאילו עסקים השירות מתאים.
- זווית שקיפות: פירוט מה כלול ואיך מדווחים על העבודה.
נניח שהשירות הוא ניהול ביקורות לעסק. כל זווית חייבת להיות מגובה בתהליך אמיתי. לא מוסיפים ״תוצאה מובטחת״ או ״מחיקה בתוך יום״ כדי להפוך גרסה לתחרותית יותר. בדיקת מודעות צריכה להשוות מסרים תקינים, לא אמינות מול הבטחה שאין לה בסיס.
כך מכינים טופס ניסוי לפני ההפעלה
- הגדירו את ההצעה ואת השאלה שרוצים לבדוק.
- בחרו מדד ראשי: לדוגמה, עלות לפנייה מתאימה, ולא מספר קליקים בלבד.
- ציינו מדדי בקרה כגון הוצאה, מסירה ושיעור פניות לא רלוונטיות.
- תעדו שמות גרסאות, השינוי שבוצע ותאריך התחלה.
- קבעו מסגרת תקציב ותנאי עצירה, כולל טיפול מיידי בתקלה.
- קבעו מתי בוחנים תוצאות ואילו נתונים צריכים להבשיל לפני החלטה.
שמות כמו service-process-A ו־service-fit-B עדיפים על ״מודעה חדשה 7״. אפשר לשמור מזהה גרסה גם בתיוג קישורים, לפי מוסכמות המדידה של העסק. שמרו את הנוסח המקורי; אחרת שינוי באמצע התקופה יטשטש מה באמת נבדק.
איך קוראים תוצאות בלי לבחור מנצחת מוקדם מדי?
השוו שיעורים ועלויות לצד הכמויות. אם מודעה א׳ קיבלה 20 קליקים ו־ב׳ קיבלה 40, הנתון לבדו אינו אומר דבר על יעילות. צריך לדעת כמה חשיפות והוצאה היו לכל אחת. אחר כך בודקים מה קרה לאחר הקליק והאם הפניות התאימו לשירות.
| מדד | מודעה א׳ | מודעה ב׳ |
|---|---|---|
| חשיפות | 2,000 | 4,000 |
| קליקים | 60 | 80 |
| CTR | 3% | 2% |
| הוצאה | 180 ₪ | 240 ₪ |
| פניות מתאימות | 2 | 4 |
| עלות לפנייה מתאימה | 90 ₪ | 60 ₪ |
בדוגמה א׳ מובילה ב־CTR, וב׳ מובילה בעלות לפנייה מתאימה. אך מדובר בשתי פניות מול ארבע ובחשיפה לא שווה: זהו סימן להמשך בדיקה, לא הוכחה סטטיסטית. המספרים אינם נתוני החברה, אינם מחירון ואינם המלצה לבנצ׳מרק.
למה לא להעתיק אוטומטית את השיטה מגוגל או Meta?
אפשר להעביר עקרונות עבודה: השערה, תיעוד, מדידה והפרדה בין זוויות. אין להניח שקיימים אותם כפתורים, אותם כללי חלוקת תנועה או אותה הגדרת קליק. גם השוואה בין פלטפורמות צריכה להשתמש באותה תוצאה עסקית ולהתחשב בהבדלי הקשר ומסלול לקוח.
בדיקה סדרתית — א׳ השבוע וב׳ בשבוע הבא — עלולה להיות מושפעת מעונתיות ומביקוש. בדיקה מקבילה אינה מבטיחה כשלעצמה הקצאה שווה. אם רוצים לטעון למובהקות או להשפעה סיבתית, נדרש תכנון סטטיסטי מתאים; אין רף אוניברסלי של ״100 קליקים״ שמספיק לכל מטרה.
איך הופכים תוצאה להחלטה?
רשמו מה ידוע, מה עדיין לא ידוע ומה הצעד הבא. אפשר להמשיך לאסוף מידע, לחדד וריאציה או להעביר יותר משקל לזווית שנראית מבטיחה במסגרת התקציב. הגדלה אינה מבטיחה שהיחס יישמר. אל תשנו בדיעבד את מדד ההצלחה כדי להכתיר את הגרסה שאהבתם מראש.
חברת ניהול מוניטין בהובלת לירון קטלן יכולה לסייע לבנות ספריית מסרים, להתאים אותם לדף ולבחון איכות פניות. המטרה היא לצבור ידע שימושי על הלקוחות, לא רק לייצר הרבה תמונות או להציג דוח עם אחוז ירוק.
שאלות נפוצות
האם שתי מודעות באותה קבוצה הן A/B Test מבוקר?
לא בהכרח. בלי אימות של חלוקה אקראית ותנאי ניסוי, זו השוואת ביצועים תפעולית.
כמה וריאציות כדאי להעלות?
מספר שניתן לממן ולנתח באופן משמעותי. התחילו בשאלות מעטות וברורות והרחיבו לפי הנתונים.
האם תמיד בוחרים את המודעה עם CTR גבוה?
לא. בוחנים את המדד העסקי שהוגדר ואת איכות התוצאות, לצד העלות והיקף המדגם.








