רשימת המילים האסורות שלכם פגה במרץ 2024
סימן מת מרגע שהוקיעו אותו, ולכן כל רשימת מילים מתחילה להתיישן ביום שהיא מתפרסמת. מתחתיה יושב הכשל שאף רשימה לא נוגעת בו: הטיוטה לא מתחייבת לכלום. בניתי סקיל עריכה בשביל זה.
כתיבה
הערות על retrieval, evals, observability ועל העבודה ההנדסית שמתחילה ברגע שהדמו הוא החלק הקל.
איך אימנתי מאפס מודל CoreML קטן למתקן פריסת מקלדת ב-macOS, השתמשתי בו חודשים, ואז פתחתי את הקוד במקום לנסות לסקיילל לבד.
למה אני משאיר את העתיד לאסטרולוגיה ופונה למחלקות-ייחוס, פרה-מורטמים ויומני קליברציה. אי-ודאות מדויקת בטקסט פשוט.
אורקסטרטור דטרמיניסטי בקוד פתוח לסוכני קידוד CLI מקבילים. מריץ Claude Code, Codex CLI, Gemini CLI במקביל: אפס טוקני קואורדינציה, 40+ מתאמים, אימות janitor, בידוד git worktree.
הערה קצרה מישראל על מה אזעקות חוזרות עושות לקשב, לשיקול הדעת ולהרגלי עבודה, ואילו הרגלים מקצועיים עוזרים לחזור לעבודה בלי לעשות מהלחץ הצגה.
Blueprint מעשי ל-Legal QA, שנשען בין היתר על עבודה סביב Agentic RAG Legal Challenge: זהות מסמכים, hybrid retrieval, תשובות מובנות, grounding ברמת עמוד, טלמטריה ו-evals.
מדריך מעשי לבטיחות במוצרי LLM: prompt injection, אוטונומיה עודפת, פלט מסוכן, evals וגבולות מפוכחים.
איך לבנות ממשקים שנראים שקולים, יקרים במובן הטוב, ואמינים תחת עומס. בלי גימיקים ובלי תיאטרון AI.
איך להשתמש ב-AI בתוך תהליך פיתוח בלי להפוך green build למשחק ניחושים ובלי לשחוק את הריפו.
עקרונות מעשיים לחוזי כלים, הנדסת הקשר, evals, אישורים וטלמטריה במערכות agentic.
Query rewrite, decomposition, step-back prompting, HyDE, fusion: מתי כל אחד מהם שווה את ה-latency הנוסף.
איך לבנות שכבת grounding, abstention ו-verification שמורידה hallucinations בלי להפוך את המוצר לאיטי או יהיר.
Chunking, כותרות, metadata, מבנה parent-child, reranking ו-QA לקורפוס במערכות RAG.
איך אני משתמש ב-workflow קל של Spec-Driven Development בפרויקטים אמיתיים, מה SDDRush עושה בפועל, ואיפה Kotef נכנס אם רוצים שכבת agent חזקה יותר.
איך להפעיל LLM evals בפרודקשן עם gold sets, graders, בדיקות trace, סיגנלים תפעוליים ושערי ריליז.
Prompt design היום הוא פורמטים, דוגמאות, כלים ולולאות eval, לא לחשים.
איך לגרום לעמודי BI לתמוך בהחלטות דרך נרטיב, היררכיה חזותית ואמון.