דילוג לתוכן הראשי

העתיד כבר כאן. אנחנו נגיע מוכנים עד שנת 2030.

לקריאה מהירה: המלצות לקוד קלוד טור #14 מאת אלכס

תוכן הפוסט

הי חברים יקרים 😍 מדי שבוע אני אחלק טיפים מתוך הניסיון שלי ורק מתוך הניסיון שלי. יש אלפי "תעשה ככה וככה" אבל אני מדבר מתוך ניסיון של קרוב לשנה עם קלוד קוד ועשיתי כמה פרוייקטים מעניינים איתו. אז אחרי שטור שעבר עשיתי סקירה על כל הטורים עד כמה ב brief ממש קצרצר סוף סוף אפשר להתפנות למשהו טכני שרציתי האמת לכתוב על שבוע שעבר הוא הממשק Ollama שאני מאמין שרובכם או חלקכם הגדול מכיר ויודע . אבל לפני שנצלול לכלי הנהדר הזה נזכיר שהוא לא (!)

Cluade Code או Codex או OpenCode שדיברנו לא מזמן...

Ollama הוא לא סביבת פיתוח ולא Coding Agent שמתחרה ישירות ב-Claude Code או Codex.

אפשר לחשוב עליו יותר בתור מנוע שמאפשר להריץ מודלי AI אצלכם במחשב (אבל לא רק.. ) .

במקום שכל בקשה תישלח למודל שיושב בענן, אפשר להוריד מודל למחשב ולהריץ אותו מקומית.

וזה בדיוק מה שהופך את Ollama למעניין.

אז למה בכלל צריך אותו אם כבר יש Claude Code?

כי אתם לא חייבים לבחור.

אחד הדברים היפים ב-Ollama הוא שאפשר להשתמש בו יחד עם הכלים שכבר הכרנו.

לדוגמה, Ollama תומך כיום בחיבור ישיר ל:

Claude Code (ברמת ה- CLI שזה הממשק מבוסס טרמינל)
Codex (ברמת ה- CLI מבוסס טרמינל)
OpenCode (ברמת ה- CLI מבוסס טרמינל)

וההפעלה יכולה להיות פשוטה להפתיע:

ollama launch claude

או:

ollama launch codex

Ollama מאפשר לבחור מודל מקומי או מודל ענן ולהפעיל דרכו את כלי הקוד שאנחנו כבר רגילים אליהם.

כלומר, אפשר להמשיך להשתמש בממשק הנוח וביכולות של Claude Code בטרמינל, אבל מאחורי הקלעים לתת ל-Ollama לספק את המודל למשל " glm-5.3-flash:cloud".

🔒 היתרון הגדול: פרטיות!

כאשר מריצים מודל מקומי דרך Ollama, המידע שמעבירים למודל נשאר במחשב ולא צריך להישלח לשירות AI חיצוני.

זה יכול להיות שימושי במיוחד כאשר עובדים עם קוד פרטי, פרויקטים אישיים או מידע שלא רוצים להעביר לענן.

Ollama מציינת במפורש שמודלים מקומיים רצים על המחשב עצמו!! ואין קריאות החוצה וזה חינם !!!! .

💰 ומה לגבי עלויות?

גם כאן יש יתרון מעניין.

המודלים המקומיים ב-Ollama ניתנים להרצה ללא תשלום לפי Tokens או לפי מספר בקשות.

אפשר להוריד מודלים פתוחים ולהשתמש בהם שוב ושוב.

כמובן שיש מחיר אחר: המחשב שלכם הוא זה שעושה את העבודה.

מודלים גדולים יותר יכולים לדרוש הרבה VRAM וכרטיס מסך חזק, ולכן לא כל מודל ירוץ בצורה טובה על כל מחשב וצריך לקחת את זה בחשבון. כדי להריץ מודלים לוקליים חזקים כגון: "qwen3-coder:30" ויש הרבה אחרים מעולים תלוי ברמת העוצמה ש של המעבד הגרפי , המעבד של המחשב והזיכרון (אבל זה לא הטור לזה..)

🤖 ויש לא מעט מודלים Ollama מאפשר לבחור מתוך ספרייה גדולה של מודלים פתוחים.

יש מודלים לשיחה, חשיבה, תמונות וכמובן גם מודלים שמתאימים במיוחד לתכנות.

היתרון הוא שאפשר להתנסות.

לא אהבתם מודל אחד?

מורידים אחר.

במקום להיות מחויבים למודל של חברה אחת, Ollama הופך את המודל לרכיב שאפשר להחליף.

🖥️ ומה לגבי Desktop?

כאן Ollama השתפר משמעותית.

כיום קיימת אפליקציית Ollama רשמית ל-Windows ול-macOS, כך שכבר לא חייבים לעבוד רק דרך Terminal.

מתוך האפליקציה אפשר להוריד מודלים ולנהל איתם שיחות בצורה גרפית ונוחה.

אפשר גם לגרור לתוכה קבצי טקסט ו-PDF, ובמודלים מתאימים אפילו לעבוד עם תמונות.

וזה שינוי חשוב, כי Ollama כבר אינו כלי שמיועד רק למשתמשי CLI מתקדמים.

ב-Windows נדרשת כיום Windows 10 ומעלה!! שימו לב.

ויש עוד חיבור מעניין מאוד

נכון ל־24 בספטמבר 2026, Ollama אכן הכריזה רשמית על אינטגרציה עם Claude Desktop ב־25 באוגוסט 2026, אבל בפועל החיבור הגרפי הישיר דרך Apps עדיין לא זמין כראוי ב־Windows אז בינתיים התמיכה היא בממשק ה- CLI (ה"טרמינל" ) .

Claude Code ו-Codex הם הכלים שעובדים על הקוד שלכם.

Ollama הוא אחד המקומות שמהם הכלים האלה יכולים לקבל את מודל ה-AI שלהם.

אפשר לחשוב על זה כך:

Claude Code = הנהג
המודל = המנוע
Ollama = המוסך שמאפשר לכם לבחור איזה מנוע להתקין.

🙂

למי זה מתאים?

אם אתם רק מתחילים עם Claude Code, אין שום חובה להתקין Ollama.

אבל ברגע שמתחילים להתעניין במודלים שונים, רוצים לעבוד יותר מקומית, לחסוך שימוש בענן או פשוט להבין קצת יותר כיצד עולם ה-AI עובד מתחת למכסה המנוע, Ollama הוא כלי שבהחלט כדאי להכיר.

ודרך אגב.. אפשר להתחיל מאוד פשוט: להתקין את Ollama, להוריד מודל קטן (מהאפליקצייה) , לפתוח את אפליקציית הדסקטופ ולדבר איתו.

אחרי שמרגישים בנוח, אפשר לחבר אותו ממשקים המבוססים טרמינל

-Claude Code, Codex או OpenCode ולעבוד מול המודלים שלו.

💡 הטיפ שלי

אל תחשבו על Ollama כתחליף ל-Claude Code.

תחשבו עליו כעל ארגז מנועים נוסף שאפשר לחבר לכלי העבודה שכבר יש לכם.

וזה בדיוק מה שהופך אותו לכל כך מעניין.

דיסקליימר מאד חשוב. OLLAMA אמנם רץ מול מודלים לוקליים שהם

Open Weights או Open Source, אך לא כולם. חשוב לבדוק את הרישיון של כל מודל בנפרד, הכלי עובד בעיקר עם מודלים סיניים של חברות כגון עליבאבא ,DeepSeek , וחברת Z.AI אז שכל אחד יהיה מודע אם מתאים לו לעבוד מול מודל סיני , ואני יכול להבין לגמרי אם אנשים לא ירצו לעבוד מול מודל סיניים בגלל נושאים פרטיות אבל זה גם גלישה לנושא אישי שכל אחד יחליט מה מתאים לו ...

דיסקליימר 2: בכוונה לא נכנסתי לנושא טכני מדי ל־API, quantization, VRAM שיש לכל מודל ומודל והשארתי את הטוור כמה שיותר פשוט ונעים... אבל כמובן שאם מורידים מודלים לוקליים אז צריך לקחת בחשבון מרכיבים נוספים כגון אלו .

בקיצור כדי לסכם אני ארשום את היתרונות בקיצור.

א. יכול לעבוד מול הממשק CLI של קודקס או קלודקוד אבל הקריאות API הם לשרת של OLLAMA ולא לשרתים של אנתרופיק והם זולים בהרבה ויש מודלים מבוססי ענן מעולים שלא מביישים את opus 5 כגון: glm-5.3:cloud!

ב. אפשר לבחור הרבה מודלים מבוססי ענן או לוקליים שרובם הם open source לא כמו בקלודקוד ואז אנחנו מוגבלים במודלים של קלוד .

ג. ולא משלמים עם טוקנים שעובדים מול מודל לוקלי !!!! כלום! רק משאבים של המחשב: מהירות ה־GPU/CPU, הזיכרון, צריכת החשמל וכמובן תנאי הרישיון של המודל עצמו.

ד. אם בכל זאת החלטתם להשתמש במודלים של OLLAMA מבוססי ענן הנהדרים שלהם כגון GLM 5.3 אז המחיר הוא ממש זול מאד לעומת קלודקוד ששם הטוקנים נשרפים במהירות מסחררת. אז זהו.. השתדלתי שזה לא יהיה טכני מדי..

מקווה שאהבתם את הטור 🥰 באהבה, אלכס!


=================================================

קצת עליי: קוראים אלכס גולדבלט, במקצוע שלי אני בודק תוכנה בחברה גדולה ואחד התחביבים שלי הוא מחשבי וינטאג' 8 ביט . אתם יכולים לבקר אותי כאן:

https://8bitretro.tech/

נכתב על ידי Commodore 64