מדריך יצירת תמונות עם GPT Image — OpenAI Cookbook
OpenAI Cookbook · מדריך פרקטי בעברית

יצירת תמונות WITH GPT Image
מהנחיה בסיסית לתוצאה מקצועית

מבוסס על ה-Prompting Guide הרשמי של OpenAI — כל מה שצריך לדעת כדי לשלוט בדגמי gpt-image

📐 מבנה פרומפט 🎨 ריאליזם ועיצוב ✏️ טקסט בתוך תמונה 🔁 עריכה איטרטיבית ⚡ אופטימיזציית מהירות 🏗️ UI Mockups
חלק 01 — נקודת הכניסה

לפני הכל — מי אתה?

לפני שמדברים על מודלים ופרומפטים — שאלה אחת שחייבת לקבל תשובה. כל שאר המדריך נחלק לשניים בהתאם לתשובה שלך.

השאלה שמכריעה הכל

איך אתה יוצר תמונות WITH GPT Image?

💬 דרך ChatGPT

נכנס ל-chatgpt.com,
מקליד פרומפט,
מוריד את התמונה ידנית

← אם זה אתה, קרא את הריבוע הירוק

⚙️ דרך קוד / API

כותב Python / JS,
שולח request לשרת OpenAI,
אפליקציה מקבלת תמונות אוטומטית

← אם זה אתה, קרא את הריבוע האדום

💬משתמש ChatGPT — מה חשוב לך

  • אין "בחירת מודל" — ChatGPT בוחר בשבילך (Images 2.0 = gpt-image-2)
  • אין "quality: low/high" — ChatGPT מנהל את זה אוטומטית
  • מנוי Free → Instant Mode (בסיסי)
  • מנוי Plus / Pro → Thinking Mode (המודל חושב לפני שמצייר)
  • הפרומפטים שלך מורחבים אוטומטית ע"י ChatGPT — אפשר לכתוב בצורה קצרה יחסית
  • תשלום: מנוי חודשי קבוע ($0 / $20 / $200)

✅ המסקנה עבורך

כל הפרקים על מבנה פרומפט, ריאליזם, טקסט, ועריכה — רלוונטיים גם לך.
הפרקים על בחירת מודל / quality / endpoints — לא רלוונטיים.

⚙️מפתח API — מה חשוב לך

  • אתה בוחר את המודל — וצריך לבחור נכון
  • אתה בוחר quality — וזה משפיע ישירות על עלות
  • הפרומפט שלך מגיע 1:1 למודל — ללא הרחבה אוטומטית
  • תשלום: לפי שימוש (per token / per image)
  • Rate Limits: ~5 תמונות/דקה ב-Tier 1
  • בייצור: השתמש ב-snapshot ID, לא ב-alias

⚠️ המסקנה עבורך

כל הפרקים רלוונטיים לך — כולל בחירת מודל, quality, ו-endpoints.
שים לב: פרומפטים שעבדו בצ'אט יצריכו פירוט רב יותר ב-API.


בחירת מודל ב-API

⚙️ רלוונטי למפתחי API בלבד

משתמשי ChatGPT — אתם יכולים לדלג לפרק 2. המודל נבחר עבורכם אוטומטית.

מודל מתי להשתמש? עלות יחסית המלצה
gpt-image-2 תמונות לקוחות, ריאליזם, עריכה, מיתוג, טקסט בתמונה גבוה ✅ הבחירה הראשית
gpt-image-2 quality: low ניסויים, כמות גבוהה, אב-טיפוס מהיר נמוך ✅ חסכוני ומצוין
gpt-image-1-mini batch גדולים, תמונות לא-קריטיות נמוך מאוד ⚠️ רק לכמויות גבוהות
gpt-image-1 / 1.5 תאימות לאחור בלבד בינוני 🚫 אל תתחיל איתם

⚠️ אמת לא נוחה (למפתחים)

רוב המפתחים ממשיכים להשתמש ב-gpt-image-1 מתוך הרגל — זה טעות. gpt-image-2 עם quality: low עדיין עולה על gpt-image-1.5 ברוב המדדים, לפי הנתונים של OpenAI. הגיע הזמן לשדרג.

🔑כלל הבסיס לבחירת מודל (API)

תמונות שלקוחות יראו → gpt-image-2 quality: high
ניסויים ואב-טיפוס → gpt-image-2 quality: low
batch גדולים של תמונות לא-חשובות → gpt-image-1-mini

חזרה לתפריט

חלק 02

הנוסחה הבסיסית: מבנה הפרומפט

OpenAI גילו ב-alpha testing שפרומפטים WITH מבנה קבוע מייצרים תוצאות טובות יותר עקביות. הנה הנוסחה שחוזרת שוב ושוב.

רקע / סצנהנושא ראשיפרטים מרכזייםאילוציםמטרת השימוש

💡 למה סדר חשוב?

המודל נותן משקל רב יותר לאלמנטים שמופיעים בתחילת הפרומפט. רקע/סצנה קודם לכל דבר אחר — כי הוא מגדיר את "מצב הכוונה" (mode) של כל מה שאחריו.

1

רקע / סצנה — Setting the Stage

איפה זה מתרחש? מה האווירה? דוגמה: "חוף ים שקט בשעת שקיעה, גלים קטנים, אור זהוב"

2

נושא ראשי — The Subject

מה/מי הנושא המרכזי? "ספן מבוגר עם קמטים ושרירים ישנים, מתאים רשת דייג"

3

פרטים מרכזיים — Key Details

חומרים, מרקמים, צבעים, ביטוי. "עור שזוף WITH טטואז' ימי, בגדים בלויים מהשמש"

4

אילוצים — Constraints

מה חייב להישאר / מה אסור לשנות. "אל תוסיף ספינות ברקע, שמור על הביטוי השקט"

5

מטרת השימוש — Intended Use

מגדיר את רמת ה"ליטוש". "לשימוש כפוסטר מגזין פרימיום" vs "לבדיקת קונספט"

💡 סגנון סינטקס גמיש

OpenAI מאשרים שכל הפורמטים הבאים עובדים: פסקה תיאורית, שורות מופרדות, או מבנה JSON מפתח-ערך. העיקר הוא כוונה ברורה ואילוצים מוגדרים.

פרומפט לפני ואחרי

❌ לפני — פרומפט ענייני אך חלש

An old fisherman on a boat. Make it realistic.

✅ אחרי — פרומפט מובנה ומנצח

A small fishing boat on calm coastal waters at golden hour. An elderly sailor adjusting a net while his dog sits nearby on the deck. Weathered skin with visible wrinkles and faded tattoos on arms. Shot like a 35mm film photo, 50mm lens, eye-level. Subtle grain, natural colors. For premium magazine poster.

חזרה לתפריט

חלק 03

פוטוריאליזם — לצלם מציאות שלא קיימת

פוטוריאליזם הוא אחת הדרישות הנפוצות ביותר — ואחת המקומות הכי קל לטעות בהן.

🚫הטעות הכי נפוצה

שימוש במילות "איכות גנריות" כמו "8K ultra-detailed" — הן לא עוזרות ואפילו מבלבלות את המודל. במקום זאת: תיאור ציוד צילום אמיתי.

מילות הקסם של פוטוריאליזם

📷שפת צילום

  • עדשה: 35mm lens, 50mm lens
  • עומק שדה: shallow depth of field
  • גרעין: subtle film grain
  • תאורה: golden hour, soft coastal light
  • זווית: eye-level, low-angle

🦠מרקמים ואי-שלמויות

  • visible pores and wrinkles
  • fabric wear and imperfections
  • natural color balance
  • honest and unposed
  • real skin texture
פרומפט ריאליזם מלא (מה-Cookbook הרשמי)

✅ פרומפט לדוגמה — פוטוריאליזם

Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail.

💡 הסוד האמיתי

תחשוב: "איך צלם אמיתי היה מתאר את הצילום הזה למנהל תמונות?"
זה הטון שהמודל מגיב אליו הכי טוב — שפת מקצוענים, לא שפת פנטזיה.

חזרה לתפריט

חלק 04

טקסט בתוך תמונה — נקודת הכאב

gpt-image-2 הוא הדגם הראשון שיכול לכתוב טקסט מדויק בתוך תמונות — אך יש כללים ברורים.

מה לא לעשות

  • להזכיר טקסט ב"אמצע" הפרומפט ובמשפט ארוך
  • לא לציין גופן / גודל / מיקום
  • לשכתב לשים קווים מפרידים בין אלמנטים
  • להשתמש ב-quality: low לטקסט חשוב

מה לעשות

  • שים הטקסט במרכאות או ב-ALL CAPS
  • ציין: גופן, גודל, צבע, מיקום
  • הפרד בין שכבות: "background... overlay text..."
  • השתמש תמיד ב-quality: high לאינפוגרפיקות
פרומפט טקסט בתמונה — דוגמה

✅ פרומפט להוספת טקסט

A modern tech startup ad banner. Dark background with purple gradient accents. Centered headline text: "BUILD FASTER WITH AI" Below: subtext "Your complete development platform" Bottom right: CTA button with text "Get Started Free" Typography: bold sans-serif for headline, light weight for subtext. High contrast, clean layout. For digital display ad.

⚠️ חשוב מאוד

טקסט ארוך או מורכב עדיין מאתגר גם לדגמים החדשים. בדוק תמיד את הפלט ושקול לחלק טקסט ארוך לאלמנטים נפרדים.

חזרה לתפריט

חלק 05

עריכה ואיטרציה — שינויים בלי "סחיפה"

אחד האתגרים הכי גדולים בעבודה WITH AI image: כל עריכה יכולה לשנות דברים שלא ביקשת לשנות. זה נקרא "drift".

🔒הכלל הזהב: Invariant + Change

בכל פרומפט עריכה, חייב להיות שתי מחלקות ברורות:

מה לשנות: "Change only the background to a rainy street"
מה לשמור: "Keep the person's face, outfit, and pose exactly the same"

כללי עריכה מוצלחת

1

שינוי אחד בכל פעם

אל תשנה 5 דברים במקביל — המודל יתקשה לשמור על Invariants. שינוי = שינוי אחד בכל בקשה.

2

חזור על כל האילוצים בכל איטרציה

המודל אין לו זיכרון. אם לא חזרת על "שמור על הלוגו בצד ימין עליון" — הוא עלול לשכוח.

3

היה מפורש לגבי זהות

לשמירת פנים ואנשים: "This is the same person from the reference image. Change only X. Face, hair, and clothing must remain identical."

4

השתמש ב-input_fidelity = high

בעת שימוש בתמונת reference — הוסף פרמטר זה ב-API כדי לשמור על נאמנות גבוהה יותר לתמונת המקור.

דוגמת עריכה נכונה

✅ פרומפט עריכה — שמירת זהות

[Reference image: woman in red jacket, park setting] Change only the background to a modern office interior. The woman — her face, red jacket, hairstyle, and expression — must remain exactly as in the reference. Do not change anything about the subject. Only the environment behind her changes: open-plan office, floor-to-ceiling windows, warm lighting.

חזרה לתפריט

חלק 06

תבניות לפי סוג שימוש

ה-Cookbook מכסה קטגוריות ספציפיות WITH גישות שונות. הנה הרלוונטיות ביותר.

📊אינפוגרפיקות ודיאגרמות

תמיד השתמש ב-quality: high. הגדר מבנה כמו שאתה מגדיר layout של דף.

תבנית — אינפוגרפיקה

Infographic layout: [subject]. Section 1 (top): headline "[TEXT]", icon on right. Section 2 (middle): 3 columns with icons and 2-line descriptions. Section 3 (bottom): single CTA button. Color scheme: [colors]. Font: clean sans-serif. High contrast, professional. For print at A4 size.

🖥️UI Mockups

תאר את המוצר כאילו הוא כבר קיים. אל תגיד "תצור ממשק" — תאר מה הממשק עושה.

תבנית — App UI

[App name] mobile app screen, [OS] design language. The screen shows [specific feature/state]. Navigation bar at bottom with [tabs]. Primary action button at bottom center: "[label]". Color palette: [colors]. Clean, minimal, high fidelity. Screenshot style, no device frame.

🎨קומיקס / סיפור ויזואלי

הגדר כל פאנל כ"beat" ויזואלי ברור. שמור על עקביות כל הזמן.

תבנית — 4-Panel Comic

4-panel comic strip, [art style] illustration. Consistent character throughout: [character description]. Panel 1: [scene + action + emotion] Panel 2: [scene + action + emotion] Panel 3: [scene + action + emotion] Panel 4: [scene + action + emotion] No dialogue text. Clean borders between panels.

📦תמונות מוצר / E-commerce

Virtual try-on ועיצוב מוצר דורשים precision ו-input_fidelity גבוה.

תבנית — Product on Model

[Product: e.g., white linen shirt from reference] worn by [model description: gender, build, skin tone]. Studio setting: clean white background, soft diffused lighting. Model poses naturally, shirt visible without distortion. Product must appear exactly as in reference — same cut, color, details. E-commerce hero image style.

חזרה לתפריט

חלק 07

איכות מול מהירות — מתי להתפשר?

הפרמטר quality הוא ההחלטה הכלכלית הכי חשובה שתקבל. הנה המסגרת לקבלת ההחלטה.

quality: "low"

  • מהיר ב-70-80%
  • מחיר נמוך משמעותית
  • מצוין לניסויים
  • טוב לתמונות ללא טקסט
  • מתאים ל-batch גדולים

🏆quality: "high"

  • חייב לאינפוגרפיקות
  • הכרחי לטקסט מדויק
  • לתמונות שלקוחות רואים
  • לעריכה מדויקת
  • למיתוג ופרסום

📐רזולוציות ב-gpt-image-2 — כללים טכניים

  • שני הצלעות חייבות להיות מכפלה של 16
  • הצלע המקסימלית: פחות מ-3840px
  • יחס מקסימלי: 3:1
  • סה"כ פיקסלים: בין 655,360 ל-8,294,400

💡 אסטרטגיית "Draft → Final"

פתח תמיד ב-quality: low עד שאתה מרוצה מהפרומפט. רק אז עבור ל-quality: high לפלט הסופי. זה חוסך 60-80% מהעלות בשלב הפיתוח.

חזרה לתפריט
חלק 08 — הכי חשוב למי שמתחיל

צ'אט לעומת API — מה ההבדל האמיתי?

זו השאלה שהכי הרבה אנשים לא שואלים — ואז תוהים למה אותו פרומפט נותן תוצאה שונה בצ'אט מול הקוד שלהם. אלה שתי מערכות WITH חוזים שונים לחלוטין.

🧭 שאלה אחת שמכריעה הכל

מי יוצר את התמונה — אדם שיושב מול מסך,
או קוד שרץ אוטומטית?

👤 אדם → ChatGPT (צ'אט)

חיפוש ניסיונות, יצירה ידנית, הורדת קבצים, עבודה חד-פעמית

⚙️ קוד → API (gpt-image-2)

אפליקציה, אוטומציה, batch, מוצר שאחרים משתמשים בו

היבט 💬 ChatGPT (ממשק צ'אט) ⚙️ API (gpt-image-2)
מי משתמש? אדם שיושב ומקליד קוד שרץ אוטומטית
כיצד משלמים? מנוי חודשי ($0 / $20 / $200) תשלום לפי שימוש (per token/image)
Thinking Mode ✅ זמין ב-Plus/Pro — הדגם חושב לפני שיוצר ⚙️ דרך פרמטר reasoning_effort
חיפוש אינטרנט בזמן יצירה ✅ Thinking Mode יכול לחפש ברשת ❌ לא זמין דרך Image API
עד כמה תמונות בבת אחת? עד 8 בפרומפט אחד (Plus/Pro) פרמטר n — עד 8
עריכת תמונות ✅ שיחה רב-סבבית, עריכה ויזואלית ✅ endpoint נפרד: v1/images/edits
רקע שקוף (PNG) ✅ זמין ⚠️ מוגבל — תלוי endpoint
שמירת היסטוריה ✅ אוטומטית בשיחה ❌ אין — חייב לנהל בקוד
שליטה ב-quality/size ⚠️ מוגבלת — תלוי ממשק ✅ מלאה — quality, size, format
Rate Limits מוסתר מהמשתמש 👀 גלוי — Tier 1: ~5 תמונות/דקה
מתאים לייצור? ❌ לא — אין logging, retries, storage ✅ כן — אחריות מלאה על הזרימה

איך ההבדל משפיע על הפרומפטים שלך?

💬בצ'אט — אתה יכול להיות עצלן

  • ChatGPT מרחיב את הפרומפט שלך אוטומטית
  • Thinking Mode מתכנן את הלייאוט לפני הביצוע
  • אפשר לכתוב "תמונה של כלב" ולקבל תוצאה סבירה
  • אפשר לשכתב בשיחה: "עכשיו הוסף שלג"
  • המודל עשוי לחפש הקשר מאינטרנט

⚠️ הבעיה

לא ניתן לשחזר את אותה תוצאה — כי אין לך שליטה על מה שהמודל הוסיף לפרומפט.

⚙️ב-API — חייב להיות מדויק

  • אין הרחבה אוטומטית של הפרומפט
  • מה שכתבת = מה שהמודל רואה
  • "תמונה של כלב" תיתן תוצאה גנרית
  • אין זיכרון בין קריאות API
  • חייב לשלוח את כל ההיסטוריה בכל קריאה

✅ היתרון

שחזוריות מלאה — אותו פרומפט = אותה תוצאה (בערך). אידיאלי למוצר ייצור.

שלושת ה-Endpoints של ה-API — מה ההבדל?

🔀Image API לעומת Responses API

ל-gpt-image-2 יש שני "שערי כניסה" ב-API, ועוד endpoint לעריכה. הבחירה ביניהם קריטית.

Endpoint מתי להשתמש? מאפיין ייחודי
v1/images/generations יצירת תמונה אחת מפרומפט פשוט, ישיר, הכי נפוץ
v1/images/edits עריכת תמונה קיימת WITH mask שינוי חלק מהתמונה בלבד
v1/responses יצירת תמונה בתוך שיחה מרובת-סבבים שומר הקשר, כמו ה-Chat API לטקסט

💡 כלל פשוט

תמונה אחת מפרומפט → v1/images/generations
שיחה WITH עריכות חוזרות → v1/responses
שינוי חלק ספציפי בתמונה → v1/images/edits

Thinking Mode — מה זה ולמתי?

🧠Thinking Mode = המודל חושב לפני שהוא מצייר

gpt-image-2 הוא הדגם הראשון של OpenAI WITH reasoning מובנה. לפני שיוצר, הוא יכול לתכנן layout, לבדוק הקשר, ולתקן את עצמו.

✅ תשתמש ב-Thinking Mode כשיש:

  • טקסט מדויק בתמונה
  • layout מורכב (אינפוגרפיקה)
  • consistency בין כמה תמונות
  • פרומפטים WITH הרבה אילוצים

⚠️ דלג על Thinking Mode כשיש:

  • צורך במהירות (עד 2 דקות המתנה!)
  • batch גדול של תמונות פשוטות
  • ניסויים מהירים
  • תמונות רקע/אווירה בלי פרטים

⚠️ הסוד שרוב המדריכים לא מגלים

בצ'אט, ChatGPT שכתב את הפרומפט שלך לפני שהוא שולח לדגם — הוסיף פרטים, שיפר את הניסוח. זה אחד הסיבות שאותו פרומפט קצר נותן תוצאה טובה יותר בצ'אט מאשר ב-API. ב-API — מה שכתבת הוא מה שהדגם מקבל. לכן פרומפטים ב-API חייבים להיות מפורטים יותר.

קוד בסיסי ל-API — שלד התחלה

Python — קריאה בסיסית ל-Image API
from openai import OpenAI
import base64

client = OpenAI(api_key="YOUR_API_KEY")

response = client.images.generate(
    model="gpt-image-2",          # המודל הנוכחי
    prompt="""
      [רקע/סצנה] → [נושא] → [פרטים] → [אילוצים]
      כתוב כאן את הפרומפט המלא שלך
    """,
    size="1024x1024",             # רזולוציה
    quality="low",                # "low" לניסויים / "high" לייצור
    n=1,                          # כמות תמונות (עד 8)
    response_format="b64_json"    # b64_json | url
)

# שמירת התמונה
image_data = base64.b64decode(response.data[0].b64_json)
with open("output.png", "wb") as f:
    f.write(image_data)

print("✅ תמונה נשמרה: output.png")
Python — עריכת תמונה קיימת (edits endpoint)
response = client.images.edit(
    model="gpt-image-2",
    image=open("original.png", "rb"),   # תמונה מקורית
    mask=open("mask.png", "rb"),         # אזור לעריכה (שחור = שנה, לבן = שמור)
    prompt="Change only the background to a rainy street. "
           "Keep the person exactly the same.",
    size="1024x1024",
    quality="high"
)

💡 טיפ קריטי לייצור: השתמש ב-snapshot ID

  • gpt-image-2 = alias — מתעדכן אוטומטית כשOpenAI מוציאה גרסה חדשה
  • gpt-image-2-2026-04-21 = snapshot — תמיד אותו דגם, אותה התנהגות
  • בייצור: תמיד השתמש ב-snapshot. שינוי גרסה אוטומטי = עיצוב שונה = לקוחות מופתעים.
חזרה לתפריט

⚡ גיליון עזר מהיר

🏗️ מבנה פרומפט

  • רקע/סצנה → נושא → פרטים → אילוצים → שימוש
  • שים אלמנטים חשובים בהתחלה
  • עבור פרומפטים ארוכים: שורות מופרדות

📷 פוטוריאליזם

  • עדשה + תאורה + זווית
  • אל תכתוב "8K ultra"
  • בקש מרקמים ואי-שלמויות

✏️ טקסט בתמונה

  • טקסט במרכאות או ALL CAPS
  • ציין גופן + מיקום + צבע
  • תמיד quality: high

🔁 עריכה

  • שינוי אחד בכל פעם
  • חזור על invariants תמיד
  • input_fidelity: high לזהות

🎯 בחירת מודל

  • gpt-image-2 = ברירת מחדל
  • quality: low לניסויים
  • quality: high לייצור

⚠️ שגיאות נפוצות

  • פרומפטים ללא מבנה = drift
  • "8K ultra" = לא עוזר
  • שינוי הרבה בבת אחת = אובדן שליטה

💬 צ'אט vs API

  • צ'אט = אדם + שכתוב אוטומטי
  • API = קוד + פרומפט מדויק בלבד
  • ייצור → API עם snapshot ID
  • Thinking Mode → זמין בשניהם
Scroll to Top