Lemonade — שרת AI מקומי בקוד פתוח לטקסט, תמונה וקול
לימונדה (Lemonade) הוא שרת בינה מלאכותית מקומי — תוכנה שרצה על המחשב שלכם ומאחדת כמה סוגי יצירת AI מאחורי ממשק תכנות (API) אחד: יצירת טקסט (LLM), יצירת תמונות, תמלול דיבור לטקסט (Speech-to-Text) והפיכת טקסט לקול (Text-to-Speech). הפרויקט קוד פתוח לגמרי (רישיון Apache 2.0) ובחסות AMD, אך תומך גם בחומרת NVIDIA. הנקודה המבדלת: ה-API שלו תואם בו-זמנית לשלושה תקנים — OpenAI, Ollama ו-Anthropic Messages API (הפרוטוקול שקלוד עובד לפיו) — כך שכלים קיימים יכולים לדבר איתו כמעט בלי שינוי קוד. זהו כלי טכני למפתחים ולחובבי AI, לא אפליקציית צ'אט מוכנה-לשימוש למשתמש קצה.
מה זה לימונדה, ומה זה לא?
לימונדה היא לא מנוע AI בפני עצמו אלא "מתאם" (orchestrator) שעוטף כמה מנועי קוד-פתוח מוכרים — llama.cpp ליצירת טקסט, whisper.cpp לתמלול, stable-diffusion.cpp ליצירת תמונות, Kokoro לקריינות, ו-FastFlowLM להאצה על שבבי NPU — ומספקת להם ממשק אחיד. זו גם לא אפליקציית "בלי-קוד" בסגנון ChatGPT: מדברים איתה דרך API, כך שהיא מיועדת למפתחים ובוני סוכני AI ולא למי שמחפש חלון צ'אט מוכן. נכון ל-31.7.2026 יש לפרויקט כ-5,200 כוכבים ו-431 forks בגיטהאב, נוצר במאי 2025, והגרסה האחרונה — v11.5.1 — יצאה ב-29.7.2026.
האם לימונדה באמת חינמית?
כן. התוכנה קוד פתוח (Apache 2.0), ואין תשלום, הרשמה או מכסת שימוש כדי להריץ אותה מקומית. בשונה מכלים שבהם "התוכנה חינם" אבל השימוש בפועל צורך קרדיטים בענן — כאן הכול רץ על החומרה שלכם, וה"מחיר" היחיד הוא חשמל וזמן חישוב על מחשב שכבר יש לכם. קיימת גם אפשרות אופציונלית להעברה לענן (Cloud Offload), אבל זו לא ברירת המחדל.
מה מקבלים מלימונדה?
יצירת טקסט (LLM) לצ'אט וקוד; יצירת תמונות מטקסט דרך stable-diffusion.cpp; תמלול דיבור לטקסט דרך Whisper; הפיכת טקסט לקריינות דרך Kokoro; ותוספות נוספות לאודיו, תלת-מימד וסיווג טקסט. ההבדל המרכזי מחלופות מקומיות פופולריות כמו Ollama או LM Studio: הן מתמקדות ב-LLM טקסטואלי בלבד, בעוד לימונדה נותנת חוויה רב-מודלית אמיתית ממקום אחד. בזכות התאימות ל-Anthropic Messages API, התיעוד הרשמי מפרט את קלוד קוד (Claude Code) בעצמו כאחת האפליקציות שאפשר לחבר ישירות ללימונדה.
איך מתחילים להתנסות?
שלושה שלבים: (1) מתקינים לפי מערכת ההפעלה — Windows 11 (קובץ MSI), macOS (קובץ pkg), לינוקס (Ubuntu, Fedora, Debian, Arch — לכל אחת דף הוראות משלה), או Docker; ההוראות המעודכנות תמיד באתר הרשמי. (2) מריצים את השרת, שעולה מקומית בכתובת http://localhost:13305. (3) מצביעים כלי קיים שכבר יודע לדבר עם OpenAI, Ollama או Anthropic אל הכתובת המקומית, בלי לשנות איך הוא בנוי — לדוגמה עם ה-SDK הרגיל של OpenAI בפייתון: client = OpenAI(base_url="http://localhost:13305/api/v1", api_key="lemonade"). מי שרוצה להריץ את זה 24/7 ולא רק כשהמחשב האישי דלוק יכול גם להעביר את זה לשרת וירטואלי (VPS).
Lemonade מול Ollama ו-LM Studio — מה ההבדל?
| פרמטר | Ollama / LM Studio | Lemonade |
|---|---|---|
| יכולות | טקסט (LLM) בלבד | טקסט + תמונה + תמלול + קריינות |
| תאימות API | בעיקר OpenAI / Ollama | OpenAI + Ollama + Anthropic יחד |
| רישיון | Ollama קוד פתוח (MIT); LM Studio חינמית אך ה-UI סגור | קוד פתוח לגמרי — Apache 2.0 |
| חסות | חברה פרטית | AMD (תומך גם ב-NVIDIA) |
| שבב NPU ייעודי | תמיכה משתנה | תמיכה ילידית ב-AMD XDNA2 |
עמוד הבית של Ollama מתמקד בהרצת מודלי שפה פתוחים ולא מציג יצירת תמונות, תמלול או קריינות כיכולות שרת ילידיות — לא בהכרח שהיכולות האלה לעולם לא יגיעו, רק שנכון להיום ההצעה הרשמית שלהן ממוקדת בטקסט, בעוד שלימונדה בונה על ריבוי-מודליות כתכונת ליבה.
איזו חומרה ומערכות הפעלה נתמכות?
מערכות הפעלה: Windows 11, macOS, ולינוקס (Ubuntu 24.04+, Fedora 43+, Debian 13/Trixie+, Arch) וגם Docker. מעבד: x86_64 ו-ARM64. כרטיס מסך: NVIDIA דרך CUDA (מדור Turing ואילך), AMD דרך ROCm (RDNA3/4, Strix Halo), ו-Apple Silicon דרך Metal. שבב NPU ייעודי: תמיכה ילידית ב-XDNA2 של AMD (Ryzen AI). מחשב בלי כרטיס מסך חזק עדיין יכול להריץ את השרת ומודלים קטנים על המעבד, פשוט לאט יותר.
מה זמין בישראל?
זו תוכנה שרצה מקומית — אין חסימות גיאוגרפיות, אין צורך באמצעי תשלום, ואין תלות בכתובת IP ישראלית. הממשק והתיעוד באנגלית בלבד. איכות עברית (אם מריצים LLM לצ'אט בעברית) תלויה לגמרי באיזה מודל טוענים, בדיוק כמו בכל שרת מודלים מקומי אחר.
שאלות נפוצות
האם זה באמת חינם?
כן. התוכנה קוד פתוח (Apache 2.0), אין תשלום להרצה מקומית ואין מכסת שימוש. יש אפשרות אופציונלית להעברה לענן למי שרוצה, אבל זו לא ברירת המחדל.
למה כלי בחסות AMD תומך גם ב-NVIDIA?
AMD ממנת ותומכת בפיתוח (בעיקר אופטימיזציות לכרטיסי Ryzen AI, Radeon ו-Strix Halo שלה), אבל הפרויקט עצמו קוד פתוח ופתוח לתרומות — ורשימת החומרה הנתמכת כוללת גם NVIDIA CUDA וגם Apple Metal.
מה ההבדל מ-Ollama או LM Studio?
שתיהן מתמקדות בהרצת מודלי שפה בלבד. לימונדה מוסיפה יצירת תמונות, תמלול וקריינות מאחורי אותו API, וגם תאימות בו-זמנית לשלושה תקנים במקום אחד או שניים.
זה מתאים למי שלא מתכנת?
פחות. זה שרת שמדברים איתו דרך API, לא אפליקציית צ'אט מוכנה. הקהל הטבעי הוא מפתחים, בוני סוכני AI, ומי שנוח לו עם שורת פקודה.
האם זה תומך בעברית?
התיעוד והממשק באנגלית. איכות תגובות בעברית תלויה במודל השפה הספציפי שבוחרים להריץ.
עודכן: 31 ביולי 2026 · מאת הנרי שטאובר, מומחה AI