נחמן AI
עוזר AI לתורת רבי נחמן מברסלב שעונה עם מקורות, בטקסט ובקול, בווב ובאפליקציות.
- ווב
- iOS
- Android

האתגר
רצינו שכל אחד יוכל לשאול שאלה על תורת רבי נחמן ולקבל תשובה מדויקת, עם מקור, בלי לחפש שעות בספרים. זה אומר לבנות מאגר ידע מאלפי עמודים, לשלב מודל שפה שלא ממציא, ולתת חוויה מהירה גם בטקסט וגם בקול.
האתגר היה בכל שכבה: צינור קליטה שמפרק ספרים ומטמיע אותם כווקטורים, סטרימינג של תשובות ללקוח, שיחה קולית בזמן אמת, תשלומים ומנויים, ושתי אפליקציות מובייל שנבנות ומתפרסמות אוטומטית מ-GitHub Actions ל-TestFlight ול-Google Play.
ארכיטקטורה
סטאק
- Next.js
- React
- Supabase
- pgvector
- Claude
- OpenAI Realtime
- SSE
- WebSockets
- Capacitor
- PayPal
- Vercel
- GitHub Actions
בעיות קשות שפתרתי
01 תשובות בסטרימינג, עם מקורות
- הגישה
- חיפוש סמנטי ב-pgvector על כ-30 אלף קטעי מקור, ואז Claude מזרים את התשובה מילה אחר מילה ב-SSE. כל ציטוט מקושר לקטע שממנו נלקח.
- התוצאה
- התשובה מתחילה להופיע מיד במקום אחרי המתנה ארוכה, וכל טענה אפשר לבדוק מול המקור.
02 שאלות בקול, בזמן אמת
- הגישה
- אודיו מהדפדפן עובר דרך audio worklet ל-OpenAI Realtime ב-WebSocket. השרת מנפיק מפתח קצר-טווח לכל שיחה, כך שהמפתח הסודי אף פעם לא מגיע ללקוח.
- התוצאה
- משתמשים שואלים בקול ורואים את התמלול נכתב בזמן שהם מדברים, בלי לחשוף מפתחות API.
03 עלויות ובטיחות בשליטה
- הגישה
- מכסות, קרדיטים ו-rate limiting לכל משתמש, תקציב LLM חודשי, סינון נושאים רגישים לפני הקריאה למודל, ושתי רמות מודל (מהירה ופרימיום).
- התוצאה
- עלות חודשית צפויה, ושאלות רגישות מקבלות מענה אחראי.
במספרים
- קטעי מקור מאונדקסים
- 30K+
- בדיקות אוטומטיות
- 300+
- פלטפורמות
- 3
צילומי מסך


