דביר נעמן

סקירה מקצועית של לאונרדו מודל התמונה המתאמן
כלים ומערכות

לאונרדו / Leonardo AI

12 דקות קריאה דביר נעמן

לאונרדו הוא הכלי שמתחיל בדיוק במקום שבו רוב מודלי התמונה נעצרים. במקום להתחרות על השאלה מי מייצר את התמונה היפה ביותר מבקשה אחת, הוא נותן לכם לאמן מודל משלכם על סדרת תמונות שאתם מעלים, לשלוט בקומפוזיציה באמצעות תמונת הכוונה, ולבחור מתוך ספרייה עצומה של מודלים שקהילה שלמה כבר אימנה. הוא נולד בעולם נכסי המשחקים, נרכש בהמשך על ידי אחת מפלטפורמות העיצוב הגדולות, והוא נשאר הכלי המדויק ביותר למי שצריך סדרה עקבית ולא תמונה מרשימה. סקירה מעמיקה של האימון האישי, של שיטת האסימונים, ושל ההשוואה מול המתחרים.

סקירה מקצועית של לאונרדו מודל התמונה המתאמן

מה זה לאונרדו ולמה אימון אישי משנה הכול?

לאונרדו הוא מוצר שהתחיל בשנת 2022 באוסטרליה, ולא כמחולל תמונות כללי. הצוות המקורי בנה כלי לייצור נכסים למשחקי מחשב, כלומר סדרות של פריטים, סמלים ודמויות שכולם צריכים להיראות כאילו הם שייכים לאותו עולם. הבעיה הזאת שונה לגמרי מהבעיה של לייצר תמונה יפה אחת, והיא זו שעיצבה את כל המוצר. בהמשך הכלי נרכש על ידי פלטפורמת העיצוב Canva, וממשיך לפעול כמוצר עצמאי.

מה שנובע מהמורשת הזאת הוא דגש על שליטה ולא על רושם. אפשר להעלות סדרה של תמונות ולאמן עליהן מודל שמייצר בסגנון שלכן, אפשר להצביע על תמונת מקור שקובעת את הקומפוזיציה, ואפשר לבחור מתוך אלפי מודלים שמשתמשים אחרים אימנו ופרסמו. במקום לנסח בקשה ולקוות, בונים מערכת שמייצרת שוב ושוב את אותו דבר. זו גישה הפוכה לחלוטין מזו של הכלים שמכוונים ליופי מיידי.

ההבדל הזה בולט במיוחד כשמשווים לכלי האסתטיקה המוביל. שם מקבלים תמונה מרהיבה מבקשה קצרה, וכאן מקבלים ממשק עם עשרים כפתורים ותוצאה ראשונה בינונית. אחרי שבוע התמונה מתהפכת: מי שהשקיע בהגדרות מקבל שליטה שאין לו במקום אחר, ומי שרצה תוצאה מיידית כבר עזב. זו לא שאלה של איכות אלא של מה אתם מוכנים להשקיע לפני שאתם מקבלים ערך.

הרכיב השלישי שכדאי להכיר הוא ספריית המודלים הקהילתית. עשרות אלפי מודלים מאומנים שמישהו אחר כבר בנה, לתחומים ספציפיים: אדריכלות, איור ילדים, צילום מוצר, נכסי משחק, וסגנונות שקשה לתאר במילים. מי שמוצא שם מודל שמתאים לו חוסך את כל שלב האימון, ומקבל עקביות מהרגע הראשון בלי להעלות אף תמונה משלו.

2022שנת ההקמה באוסטרליה
150אסימונים חינמיים ליום
$12מחיר החבילה הראשונה
1מודל אישי שאתם מאמנים

הפיצ'רים המרכזיים של לאונרדו

שש יכולות בונות את המוצר. שתיים מהן נוגעות לאימון ולסגנון, וארבע נוגעות לשליטה מדויקת בתוצאה ולעבודה שוטפת.

אימון מודל אישי

מעלים סדרת תמונות ומאמנים מודל שמייצר בסגנון שלהן. הדרך היחידה לקבל עקביות מוחלטת לאורך זמן.

ספריית מודלים קהילתית

אלפי מודלים מאומנים לתחומים ספציפיים. מי שמוצא התאמה חוסך את כל שלב האימון.

הכוונה בתמונת מקור

מצביעים על תמונה שקובעת קומפוזיציה, קווי מתאר או תנוחה. שליטה מדויקת במקום ניחוש בניסוח.

קנבס עריכה

מילוי אזור נבחר, הרחבה לצדדים ותיקון פרטים בתוך תמונה קיימת. עבודה נקודתית ולא ייצור מחדש.

הנפשת תמונה

הפיכת תמונה סטטית לקטע קצר עם תנועה. שימושי לבאנרים ולתוכן קצר ברשתות.

ממשק תכנות מלא

ייצור מקוד עם בחירת מודל ופרמטרים. מאפשר לבנות מסלול ייצור נכסים ולא לעבוד תמונה אחר תמונה.

שלושה דברים קובעים כאן את ההצלחה יותר מרשימת היכולות. הראשון הוא שאיכות האימון תלויה באיכות הסט ולא בגודלו. עשרים תמונות עקביות, באותה תאורה ובאותו יחס, מייצרות מודל טוב יותר ממאתיים תמונות מעורבבות. זו הטעות הראשונה שכל מי שמנסה עושה, והיא גם הסיבה שרוב האימונים הראשונים מאכזבים.

השני הוא שההכוונה בתמונת מקור חזקה יותר מכל ניסוח. כשצריך אובייקט בזווית מסוימת או דמות בתנוחה מסוימת, אפשר לכתוב על זה פסקה שלמה ולקבל משהו אחר, ואפשר להעלות סקיצה גסה ולקבל בדיוק את המבנה. זו היכולת שהופכת את הכלי משעשוע לכלי עבודה, והיא גם זו שהכי פחות מוסברת למשתמשים חדשים.

השלישי הוא שהממשק עמוס במכוון. יש כאן יותר בקרות מאשר בכל מתחרה, וזה גם החוזק וגם החיסרון. מי שמגיע מכלי שבו כותבים משפט ומקבלים תמונה יחווה את זה כמורכבות מיותרת, ומי שצריך לייצר מאה נכסים שנראים כמו משפחה אחת יבין תוך יום למה כל בקרה שם.

מבחינת שילוב בעבודה, הכיוון הטבעי הוא ייצור נכסים בנפח ולא תמונה בודדת. מי שכבר בנה תהליכי אוטומציה שמחברים בין מערכות יכול לחבר את ממשק התכנות לטבלת מוצרים או לתור משימות, ולקבל נכסים שנוצרים לפי כלל. ההבדל בין להיכנס לממשק ולייצר אחד אחד לבין להריץ סדרה שלמה הוא ההבדל בין כלי לבין קו ייצור.

כמה זה עולה?

התמחור מבוסס על אסימונים שנצרכים בכל פעולה, ולא על מספר תמונות. זו שיטה שמבלבלת בהתחלה, וקל להבין אותה כשמפרקים אותה לשלושה גורמים.

החבילה החינמית – $0

מכסה יומית של אסימונים שמתחדשת. מספיקה בהחלט לבדוק את הכלי ולהתנסות באימון ראשון.

Apprentice – כ-$12 לחודש

מכסה חודשית קבועה, ייצור פרטי, ותורים מהירים יותר. מתאימה לעצמאי שמייצר בקצב סביר.

Artisan – כ-$30 לחודש

מכסה גדולה משמעותית ואימון מודלים ללא מגבלה מעשית. זו החבילה של מי שעובד עם זה כל שבוע.

Maestro – כ-$60 לחודש

מכסה מורחבת לצוותים ולסטודיו שמייצרים נכסים כל יום. כולל עדיפות בתור ובקרות נוספות.

מה שקובע כאן את החשבון הוא שלא כל פעולה עולה אותו דבר. תמונה ברזולוציה בסיסית עולה מעט, הגדלה עולה יותר, הנפשה עולה הרבה יותר, ואימון מודל הוא ההוצאה הגדולה ביותר. מי שמסתכל רק על מספר האסימונים בחבילה בלי לדעת כמה כל פעולה צורכת, לא באמת יודע מה הוא קונה. ההמלצה שלי היא להריץ שבוע בחבילה החינמית ולראות במה נגמרים האסימונים בפועל.

הנקודה השנייה היא שהחבילה החינמית כאן נדיבה יחסית, והיא מתחדשת מדי יום ולא פעם אחת. זה אומר שאפשר לבדוק את הכלי לעומק במשך שבועיים בלי לשלם, כולל אימון מודל ראשון. מי שמתלבט בין כמה כלים בקטגוריה צריך להתחיל דווקא כאן, כי כאן הבדיקה הכי זולה, ורק אחר כך להשוות לכלים שדורשים תשלום כתנאי כניסה.

אצל לקוח בתחום המסחר, אימון מודל אחד על 24 תצלומי מוצר קיימים החליף הזמנת צילומים חוזרת. סדרה של 60 ויזואלים לקטלוג יצאה בשלושה ימים במקום בשבועיים, וכולם נראו כאילו צולמו באותו סטודיו.

מפרויקט קטלוג אצל לקוח בתחום המסחר

משהו אחרון על התמחור שנוטים לפספס: האימון הוא הוצאה חד פעמית והשימוש הוא הוצאה שוטפת. מודל שאומן פעם אחת משרת חודשים, ולכן החישוב הנכון אינו כמה עולה אימון אלא כמה עולה אימון מחולק במספר התמונות שייצא ממנו. כשעושים את החישוב הזה, גם החבילה היקרה יוצאת זולה מאוד לעומת יום צילום אחד.

לאונרדו מול הכלים האחרים בקטגוריה

שוק יצירת התמונות התפצל לפי מה שכל כלי מנסה לעשות טוב, ולכן ההשוואה הרלוונטית היא לפי סוג המשימה. לאונרדו נמצא בקצה של השליטה, ובקצה השני נמצאים הכלים שמכוונים לתוצאה מיידית.

מול כלי האסתטיקה, ההבדל הוא בזמן עד לערך. שם מקבלים תמונה מרשימה מבקשה של שורה, וכאן מקבלים ממשק שדורש למידה ותוצאה ראשונה בינונית. אחרי שבוע היחס מתהפך: כאן אפשר לייצר סדרה עקבית של חמישים נכסים, ושם כל תמונה עדיין הרפתקה בפני עצמה.

מול כלי הטיפוגרפיה, החלוקה נקייה. מי שצריך כיתוב קריא בתוך התמונה לא יקבל אותו כאן, ומי שצריך סדרת נכסים חזותיים בלי טקסט לא יקבל שם את השליטה. אלה שני עולמות שכמעט לא נפגשים, וההחלטה ביניהם נופלת בשאלה אחת: יש טקסט או אין.

מול כלי הווידאו, ההנפשה שכאן היא תוספת ולא מוצר. מי שצריך שוט אמיתי עם תנועת מצלמה יעבור לכלי הווידאו Runway או למודל הווידאו Veo, ומי שצריך תנועה עדינה בבאנר יקבל אותה כאן בלי לצאת מהכלי. השילוב הנפוץ הוא לייצר את הפריים כאן ולהנפיש אותו במקום ייעודי, ולהוסיף לו פסקול בכלי קול כמו ElevenLabs אם הקטע מיועד לרשתות ולא רק לבאנר שקט באתר.

יש כאן גם השוואה שכדאי לעשות מול כלי עיצוב ממשקים. מי שמייצר מסכי מוצר ורכיבי ממשק יגלה שהכלי Stitch פותר בעיה אחרת לגמרי, כלומר מבנה ופריסה ולא סגנון חזותי. שני הכלים משלימים זה את זה כשבונים מוצר: אחד מייצר את המסכים, והשני מייצר את הנכסים שנכנסים לתוכם.

המסקנה שלי מהשטח: לאונרדו אינו הבחירה הראשונה למי שמייצר תמונה בשבוע, והוא כן הבחירה כשמייצרים סדרות. הרף הוא בערך עשרים נכסים באותו סגנון: מתחת לזה השליטה לא מצדיקה את הלמידה, ומעליה אין באמת חלופה.

הפיצ'ר שעושה את ההבדל: מודל שמאומן על הסט שלכם

מה שמצדיק כאן את כל ההשקעה בלמידה הוא האפשרות לאמן מודל על סדרת תמונות משלכם ואז לייצר ממנו בנפח. זה מה שפותר את הבעיה שכל עסק נתקל בה: לא תמונה יפה אחת, אלא חמישים תמונות שנראות כאילו הן שייכות לאותו מותג. הצלחת האימון נקבעת כמעט לגמרי באיכות סט הנתונים, ולכן שווה להשקיע בו יותר מאשר בניסוח. הנה איך נראה סט תקין ואיך מריצים ממנו סדרה.

# מפרט סט אימון. זה החלק שקובע את התוצאה, לא הניסוח
# ---------------------------------------------------------------
# כללי הסט:
#   20 עד 30 תמונות, לא יותר. סט גדול ומעורבב גרוע מסט קטן ועקבי
#   אותה תאורה בכל התמונות
#   אותו יחס צדדים, רצוי ריבועי
#   רקע אחיד או לפחות עקבי
#   מגוון בזוויות ובמרחקים, אבל לא בסגנון
#   בלי טקסט בתוך התמונות, הוא מבלבל את האימון
#   בלי כפילויות כמעט זהות
# ---------------------------------------------------------------

import os
import time
import requests

API = "https://cloud.leonardo.ai/api/rest/v1"
HEADERS = {
    "Authorization": "Bearer " + os.environ["LEONARDO_API_KEY"],
    "Content-Type": "application/json",
    "Accept": "application/json",
}

# מזהה המודל שאימנתם, נשמר פעם אחת ומשמש בכל ההרצות
CUSTOM_MODEL_ID = os.environ.get("LEONARDO_MODEL_ID", "")

BASE = "product photograph on a seamless surface, soft studio lighting, deep navy backdrop"

ITEMS = [
    {"slug": "bottle-01", "subject": "a tall matte bottle standing upright"},
    {"slug": "bottle-02", "subject": "the same bottle lying on its side"},
    {"slug": "box-01", "subject": "a closed rectangular box seen at a slight angle"},
]

def create(item, width=1024, height=1024, n=2):
    body = {
        "prompt": f'{item["subject"]}, {BASE}',
        "modelId": CUSTOM_MODEL_ID,
        "width": width,
        "height": height,
        "num_images": n,
        "guidance_scale": 7,
        "public": False,
    }
    r = requests.post(API + "/generations", json=body, headers=HEADERS, timeout=120)
    r.raise_for_status()
    return r.json()["sdGenerationJob"]["generationId"]

def collect(generation_id, tries=30, wait=6):
    for _ in range(tries):
        r = requests.get(API + "/generations/" + generation_id, headers=HEADERS, timeout=60)
        r.raise_for_status()
        data = r.json()["generations_by_pk"]
        if data["status"] == "COMPLETE":
            return [img["url"] for img in data["generated_images"]]
        time.sleep(wait)
    return []

def run(items):
    jobs = {item["slug"]: create(item) for item in items}
    return {slug: collect(job) for slug, job in jobs.items()}

# שילוב במסלול ייצור נכסים
# שלב 1: כל מוצר חדש במערכת מייצר רשומה בתור עם התיאור שלו
# שלב 2: ההרצה מייצרת שתי אפשרויות לכל מוצר מהמודל האישי
# שלב 3: אדם בוחר אחת, והנבחרת נשמרת עם תיאור חלופי בעברית לפני העלאה

מה שהמפרט הזה מדגים הוא שהעבודה האמיתית קורית לפני שכותבים שורת קוד אחת. סט של עשרים תמונות עקביות שווה יותר ממאתיים תמונות מעורבבות, וזה כמעט הפרמטר היחיד שקובע אם המודל שיוצא יהיה שימושי או מבזבז זמן. מי שמקדיש שעה לניקוי הסט חוסך שלושה סבבי אימון כושלים.

שווה להוסיף הערה על התהליך עצמו, כי כאן נוצרת אי הבנה נפוצה. אימון אינו פעולה חד פעמית שאחריה סיימתם, אלא סבב: מאמנים, מייצרים עשרה נכסים, מסתכלים מה חוזר על עצמו לרעה, מתקנים את הסט, ומאמנים שוב. הסבב השני כמעט תמיד טוב משמעותית מהראשון, והשלישי כבר מספיק. מי שמצפה שהאימון הראשון יהיה גם האחרון מפרש את התוצאה הבינונית שקיבל ככישלון של הכלי, בזמן שהיא פשוט השלב הראשון בתהליך שיש לו שלושה שלבים. שווה לתכנן מראש יומיים ולא חצי יום.

הזווית השנייה היא ניהול נכסים. ברגע שמייצרים סדרות, נוצרת ספרייה שצריך למצוא בה דברים בעוד חצי שנה: איזה מודל ייצר מה, איזו הרצה נבחרה, ולאיזה מוצר היא שייכת. זה נשמע כמו פרט קטן ומתגלה כבעיה אמיתית בפרויקט השלישי. דוגמאות לתהליכים שבהם בניתי את שכבת הניהול הזאת מראש אפשר לראות בפורטפוליו הפרויקטים שלי, ובכולם היא הייתה ההבדל בין ספרייה שמשרתת לבין תיקייה שאף אחד לא נכנס אליה.

חסרונות שאתם צריכים לדעת

כאן צריך להיות מדויקים, כי הכלי תובעני והוא לא מתאים לכולם. שישה חסרונות, והראשונים שבהם הם בדיוק הסיבה שאנשים נוטשים אותו בשבוע הראשון.

עקומת למידה תלולה

הממשק עמוס בבקרות ותוצאה ראשונה בדרך כלל בינונית. מי שרוצה ערך מיידי יתאכזב ויעזוב.

חשבון אסימונים לא אינטואיטיבי

כל פעולה צורכת אחרת, והנפשה או אימון יקרים בהרבה מתמונה. קשה לתכנן תקציב מראש.

פוטוריאליזם לא בחזית

בסצנות מציאותיות מאוד המובילים בקטגוריה עדיין מחזירים תוצאה משכנעת יותר. הפער קיים.

אימון תלוי באיכות הסט

סט מעורבב מייצר מודל חסר תועלת. ההשקעה בהכנת הנתונים גדולה מכפי שרוב האנשים מצפים.

אין טקסט בתוך התמונה

כיתוב לטיני יוצא לא אמין, ובעברית לא עובד כלל. כל טקסט חייב להתווסף בכלי עיצוב.

יותר מדי אפשרויות

ריבוי המודלים והבקרות מקשה להתחיל. בלי מסלול עבודה מוגדר מראש קל ללכת לאיבוד בממשק.

הרביעי ברשימה הוא זה שמסביר את רוב האכזבות מהכלי הזה. אימון מודל אינו כפתור אלא פרויקט נתונים קטן, והתוצאה שלו טובה בדיוק כמו הסט שהוזן. אנשים מעלים מאה תמונות שנאספו מכל מקום, מקבלים מודל שלא מייצר שום דבר עקבי, ומסיקים שהיכולת לא עובדת. הכלל שאני עובד לפיו הוא להשקיע שעה בבחירה וניקוי של עשרים תמונות, ורק אז ללחוץ על אימון.

היתרונות שעושים את לאונרדו שווה

כנגדם עומדות שש סיבות שמסבירות למה מי שנשאר אחרי השבוע הראשון בדרך כלל לא עוזב.

עקביות אמיתית בסדרה

מודל מאומן מייצר עשרות נכסים שנראים כמו משפחה אחת. אין לזה תחליף בכלים אחרים.

שליטה בקומפוזיציה

תמונת הכוונה קובעת מבנה ותנוחה במקום לקוות שהניסוח יעבוד. מדויק ברמה אחרת.

ספריית מודלים ענקית

אלפי מודלים מאומנים לתחומים ספציפיים. אפשר לקבל עקביות בלי לאמן דבר בעצמכם.

חבילה חינמית מתחדשת

מכסה יומית שמתחדשת מאפשרת בדיקה רצינית של שבועיים בלי לשלם. סף כניסה נמוך במיוחד.

ממשק תכנות מלא

ייצור מקוד עם בחירת מודל ופרמטרים. מה שהופך אותו מכלי לקו ייצור נכסים.

הכל במקום אחד

ייצור, עריכה נקודתית, הגדלה והנפשה באותה סביבה. פחות מעברים בין כלים באמצע עבודה.

היתרון שהכי מורגש בפועל הוא שינוי בסוג ההוצאה. עסק שמייצר קטלוג שילם עד היום על יום צילום, על סטודיו ועל עורך, וקיבל סדרה אחת. אחרי אימון מודל על התצלומים שכבר יש לו, אותו עסק מייצר וריאציות ללא הגבלה, כולל זוויות שלא צולמו וגרסאות לעונות שונות. ההוצאה עוברת מהפקה חוזרת להשקעה חד פעמית, וזה שינוי מבני ולא חיסכון נקודתי.

נקודה שנייה שראוי להדגיש היא מי מרוויח מזה הכי הרבה. דווקא לא סוכנויות עיצוב, שכבר יש להן מעצבים, אלא עסקים בינוניים עם קטלוג ובלי מחלקת עיצוב: חנויות מקוונות, יבואנים, יצרנים קטנים. אצלם הפער בין המצב הקיים לבין מה שהכלי מאפשר הוא הגדול ביותר, והם גם אלה שהכי פחות מודעים לכך שזה בכלל אפשרי. על הגישה שלי לזיהוי הפערים האלה אצל עסקים אפשר לקרוא בעמוד האודות שלי.

מתי לבחור לאונרדו ומתי לבחור אחרת?

הכול נסגר על שאלה אחת פשוטה: כמה נכסים באותו סגנון אתם צריכים. הנה המסגרת המעשית.

בחרו לאונרדו אם

אתם צריכים עשרות נכסים באותו סגנון, יש לכם תמונות מקור לאמן עליהן, ואתם מוכנים ללמוד ממשק.

בחרו כלי אסתטי אם

אתם צריכים תמונות בודדות מרשימות, המראה חשוב מהעקביות, ואין לכם זמן ללמוד בקרות.

בחרו כלי טיפוגרפיה אם

יש טקסט בתוך התמונה. שום מודל בקטגוריה הזאת לא יפתור את זה, וזה שיקול מכריע.

# עץ החלטה ליצירת נכסים חזותיים
שאלה 1: כמה נכסים באותו סגנון?
    עד עשרה             -->  כלי אסתטי, לא שווה את הלמידה
    עשרים עד חמישים     -->  לאונרדו, כאן הוא מנצח
    מאות לפי כלל        -->  לאונרדו דרך ממשק התכנות

שאלה 2: יש לכם תמונות מקור?
    יש סדרה עקבית       -->  לאמן מודל אישי
    יש כמה בודדות       -->  הכוונה בתמונת מקור, בלי אימון
    אין כלום            -->  לבחור מודל מהספרייה הקהילתית

שאלה 3: יש טקסט בתוך התמונה?
    אין                 -->  ממשיכים כאן
    יש, באנגלית         -->  כלי טיפוגרפיה ייעודי
    יש, בעברית          -->  רקע כאן, טקסט בכלי עיצוב

שאלה 4: כמה זמן יש ללמידה?
    שעה                 -->  כלי אחר, לא זה
    יום עבודה           -->  לאונרדו עם מודל מהספרייה
    שבוע                -->  לאונרדו עם מודל אישי מאומן

השגיאה שחוזרת אצל כמעט כל מי שמנסה היא לשפוט את הכלי לפי היום הראשון. התוצאה הראשונה כמעט תמיד פחות מרשימה ממה שאותה בקשה הייתה מחזירה בכלי אסתטי, וזה מוביל למסקנה מהירה ושגויה. הבדיקה הנכונה היא לקחת עשרים תמונות אמיתיות מהעסק, לאמן עליהן מודל, ולייצר עשרה נכסים חדשים. אם הם נראים כמו משפחה אחת, קיבלתם את התשובה.

נקודה שנייה: לא להתחיל מאימון. הדרך הנכונה להיכנס היא דרך ספריית המודלים הקהילתית, כלומר למצוא מודל קיים שקרוב לסגנון שאתם רוצים ולעבוד איתו שבוע. זה נותן את כל היתרון של העקביות בלי שום עבודת הכנה, ומלמד אתכם מה בכלל אתם מחפשים לפני שאתם משקיעים באימון משלכם. רק אחרי שיודעים מה חסר, שווה לאמן.

נקודה שלישית נוגעת לזכויות ולשקט הנפשי, והיא רלוונטית במיוחד למי שמייצר נכסים ללקוח. מודל שאומן על תמונות שאתם צילמתם או הזמנתם שייך לסיפור שלכם, ומודל מהספרייה הקהילתית אומן על חומר שאתם לא מכירים. ההבדל הזה לא מורגש כשמייצרים ויזואל לפוסט פנימי, והוא כן מורגש כשהנכס נכנס לאריזת מוצר או לקמפיין ממומן. הכלל שאני עובד לפיו הוא להשתמש במודלים קהילתיים לשלב החיפוש והכיוונים, ולעבור למודל שאומן על חומר שבבעלות הלקוח לפני שמייצרים את הנכסים שבאמת יוצאים החוצה. זה מוסיף יום עבודה לפרויקט וחוסך שיחה לא נעימה בהמשך.

השורה התחתונה: האם לאונרדו שווה?

התשובה היא כן, אם אתם מייצרים סדרות ולא תמונות. לאונרדו הוא הכלי הכי פחות מיידי בקטגוריה והכי מדויק בה, וזה בדיוק ההסכם שהוא מציע: תשקיעו בלמידה ובהכנת נתונים, ותקבלו שליטה שאין בשום מקום אחר. מי שמחפש תמונה יפה עכשיו יעבוד בכלי אחר וייצא צודק, ומי שמחפש חמישים נכסים שנראים אותו דבר ימצא כאן את התשובה היחידה.

מי שיפיק ממנו את המרב ברור: קטלוגים ותמונות מוצר, נכסים למשחקים ולאפליקציות, סדרות איור, מותגים שצריכים שפה חזותית אחידה, וכל מקום שבו הבעיה היא עקביות ולא יופי. ומולם, יש מי שהכלי הזה רק יאט אותו: תמונת נושא אחת לפוסט, ויזואל בודד למצגת, וכל מקרה שבו יש טקסט שצריך להיות קריא בתוך התמונה.

התחלה מסודרת נראית כך. ראשית, למצוא בספרייה הקהילתית מודל קרוב לסגנון שאתם רוצים ולעבוד איתו שבוע בחבילה החינמית. שנית, לאסוף עשרים תמונות עקביות מהעסק ולאמן עליהן מודל אחד. שלישית, להשוות בין השניים על אותם עשרה נכסים ולהחליט אם ההשקעה באימון החזירה את עצמה. ליצירת קשר ולקבלת ייעוץ בבניית שפה חזותית אחידה ובתכנון קו ייצור הנכסים סביבה.

הערה אחרונה לסיום. הכלי הזה מייצג הבדל מהותי בין שני סוגי כלים שקל לבלבל ביניהם: כלי שנותן תוצאה, וכלי שנותן שיטה. הראשון מרשים ביום הראשון והשני משתלם בחודש השלישי, ורוב העסקים צריכים דווקא את השני. שאר הסקירות בקטגוריה, לצד הדרך שבה אני בוחן אם כלי מסוים ראוי להשקעת הלמידה שהוא דורש, מחכות אצל דביר נעמן, שיווק וצמיחה לעסקים.

שיתוף הפוסט

שאלות ותשובות

האם לאונרדו חינמי?

יש חבילה חינמית עם מכסת אסימונים יומית שמתחדשת, וזו אחת החבילות החינמיות הנדיבות בקטגוריה. אפשר לבדוק את הכלי לעומק במשך שבועיים, כולל אימון מודל ראשון, בלי לשלם. החבילות בתשלום מוסיפות מכסה גדולה יותר, ייצור פרטי, ותורים מהירים. מי שמתלבט בין כמה כלים כדאי שיתחיל דווקא כאן, כי הבדיקה כאן הכי זולה.

מה זה אימון מודל אישי?

זו אפשרות להעלות סדרה של תמונות משלכם ולאמן עליהן מודל שמייצר בסגנון שלהן. במקום לנסח כל פעם מחדש ולקוות שהתוצאה תהיה דומה, מקבלים מודל שכבר יודע איך הדברים שלכם נראים. זו היכולת המרכזית של הכלי, והיא גם זו שדורשת הכי הרבה הכנה, כי איכות התוצאה תלויה כמעט לגמרי באיכות סט התמונות שהוזן.

כמה תמונות צריך כדי לאמן מודל?

בין עשרים לשלושים, ולא יותר. זו נקודה שמפתיעה אנשים, כי האינטואיציה אומרת שיותר נתונים זה יותר טוב. בפועל, סט קטן ועקבי מייצר תוצאה טובה בהרבה מסט גדול ומעורבב. מה שחשוב הוא שכל התמונות יהיו באותה תאורה, באותו יחס, ובאותו סגנון, עם מגוון בזוויות ובמרחקים ולא במראה.

האם לאונרדו טוב יותר ממידג'רני?

בעקביות כן, ברושם מיידי לא. כלי אסתטי יחזיר תמונה בודדת מרשימה יותר מבקשה קצרה, וכאן צריך להשקיע לפני שמקבלים ערך. ההבדל מתהפך ברגע שצריך סדרה: חמישים נכסים שנראים כמו משפחה אחת הם משימה שכאן נסגרת ושם כמעט בלתי אפשרית. הבחירה ביניהם היא בין רושם לבין שליטה.

האם הוא כותב טקסט בתמונה?

לא באופן אמין, וזה נכון גם לאנגלית וגם לעברית. הכלי נבנה סביב נכסים חזותיים ולא סביב טיפוגרפיה, ולכן כל כיתוב שצריך להיות קריא חייב להתווסף בשלב נפרד בכלי עיצוב. מי שהמשימה שלו היא פוסטר או מודעה עם כותרת צריך מודל שנבנה במיוחד לזה, ולא את הכלי הזה.

מה זה הכוונה בתמונת מקור?

זו האפשרות להעלות תמונה או אפילו סקיצה גסה שקובעת את המבנה של התוצאה, כלומר את הקומפוזיציה, את קווי המתאר או את התנוחה, בלי להעתיק את הסגנון. זו הדרך היעילה ביותר לקבל אובייקט בזווית מדויקת, והיא חוסכת את כל הניסוי והטעייה שכרוך בניסוח מפורט. בפועל היא משפיעה על התוצאה יותר מכל ניסוח.

יש לו ממשק תכנות?

כן, ואפשר לייצר דרכו תמונות מקוד, כולל בחירת המודל האישי שאימנתם והפרמטרים של הייצור. זה מה שמאפשר להפוך אותו מכלי שמישהו פותח בדפדפן לחלק ממסלול ייצור נכסים, למשל כשלכל מוצר חדש במערכת נוצרים אוטומטית שני ויזואלים לבחירה. הבדיקה האנושית לפני פרסום נשארת, וזה מכוון.

צריך ידע בעיצוב כדי להשתמש בו?

לא בעיצוב, אבל כן סבלנות. הממשק עמוס בבקרות ויש בו יותר אפשרויות מאשר בכל מתחרה, ולכן היום הראשון מתסכל. מה שכן עוזר הוא חשיבה שיטתית: להבין מה קבוע בסדרה ומה משתנה, ולהכין סט תמונות נקי לפני אימון. אלה מיומנויות של סדר ולא של אמנות, והן נלמדות תוך שבוע עבודה.

דביר נעמן

על הכותב

דביר נעמן – מומחה שיווק דיגיטלי, SEO ואוטומציות

מלווה עסקים בצמיחה דיגיטלית: קידום אורגני, קידום במנועי AI, אימייל מרקטינג, אוטומציות ופיתוח תוכנה. תוצאות מדידות ושקיפות מלאה.