כל המשרות
מהנדס/ת AI
להשיק את המודלים והצינורות שמאחורי התובנות.
שטוטגרט, גרמניה — היברידי (2–3 ימים בשבוע במשרד)משרה מלאה / סטודנט/ית עובד/ת (Werkstudent)הנדסה
מנוע הניתוח — סנטימנט, דירוג מערכת היחסים, זיהוי אבני דרך והתובנות שנכתבות על ידי AI — הוא לב המוצר. תהיה/י אחראי/ת על האופן שבו אנחנו קוראים ל-LLM ולמודלים קלאסיים: הפרומפטים, החלוקה למקטעים, ההערכה, העלות וזמן התגובה. פרטיות היא אילוץ מוחלט: תוכן הצ'אט מעובד באופן זמני ולעולם לא נשמר.
מה תעשו
- אחריות על צינור ה-LLM (כיום OpenAI ו-Gemini דרך שכבת הפשטה של ספקים) — פרומפטים, חלוקה למקטעים, סכמות פלט מובנה, ניסיונות חוזרים ובקרת עלויות.
- לבנות מערך הערכה כך ששינוי בפרומפט או במודל יהיה שיפור מדיד, לא תחושת בטן.
- לשפר את האנליטיקה שאינה מבוססת LLM — מידול זמני תגובה, פילוח שיחות, מגמות מצב רוח — בדיוק ובמהירות.
- לשמור על הסקה זולה ומהירה מספיק כדי לרוץ בקנה מידה צרכני; למדוד ולקצץ בהוצאה על טוקנים.
- לשמור על מודל הפרטיות: עיבוד זמני, טלמטריה מצטברת בלבד, ושום תוכן צ'אט לא יוצא מגבולות הבקשה.
את מי אנחנו מחפשים
- 3 שנים ומעלה בפיתוח תוכנה לייצור, עם ניסיון אמיתי בהשקת פיצ'רים מבוססי LLM או ML (לא רק קריאה חד-פעמית ל-API).
- שליטה חזקה ב-TypeScript / Node.js (הסטאק שלנו), או יכולת להגיע לשם מהר משפה טיפוסית אחרת.
- בנית צינורות פרומפט/תגובה עם פלט מובנה ואת/ה יודע/ת איך הם נכשלים.
- נוח לך עם הערכה: בניית מאגרי נתונים, הגדרת מדדים ותפיסת רגרסיות.
- אנגלית ברמת C1 ומעלה.
יתרון
- רקע ב-NLP — embeddings, סיווג, סנטימנט.
- ניסיון באופטימיזציה של עלות וזמן תגובה באפליקציות LLM (מטמון, אצוות, ניתוב בין מודלים).
- עניין בהסקה על המכשיר / בתוך הדפדפן.
- גרמנית.
שפות
נדרשת אנגלית ברמת C1 ומעלה. גרמנית מהווה יתרון משמעותי.
סטודנט/ית עובד/ת
כסטודנט/ית עובד/ת: כ-16–20 שעות בשבוע, בשילוב עם מהנדס/ת בכיר/ה, עם אחריות על חלק מוגדר בצינור (למשל מערך ההערכה או מודול ניתוח אחד).