דילוג לתוכן

כלים/בינה מלאכותית

Ragas

מסגרת קוד פתוח לבדיקה והערכה של יישומי LLM.

מה Ragas עושה?

Ragas מיועדת למדוד יישומי מודל שפה, בעיקר צינורות אחזור ותשובה, לפי מדדים ולא לפי תחושה. מריצים שאלות, בודקים נאמנות למקור וחושפים תשובות שאינן נשענות על המסמך. לפני שסומכים על הציון כדאי להתאים את סט השאלות לתהליך העסקי שלכם, כולל שאלות שאין עליהן תשובה במאגר. מדד גבוה על סט מלאכותי עלול להסתיר כשל בעברית.

יכולות מרכזיות

  • הערכת יישומי LLM במסגרת קוד פתוח
  • מדדים לנאמנות מקור ולאיכות אחזור
  • בדיקה חוזרת אחרי שינוי בצינור

שימושים בעסק

  • בדיקת סוכן ידע מול שאלות שיש להן מקור ידוע
  • זיהוי תשובות שאינן נשענות על המסמך שאוחזר

איך מתחילים

  1. אספו שאלות ותשובות מקור אחרי הסרת מזהים.
  2. הריצו הערכה ראשונה ושמרו אותה כבסיס.
  3. הוסיפו שאלות בלי מקור ובדקו שהמערכת נמנעת מניחוש.

מה לבדוק לפני שבוחרים

  • התאימו את סט הבדיקה לשפה ולמסמכים שלכם.
  • ציון ממוצע עלול להסתיר כשל חמור בודד.

מקורות רשמיים

המקורות נבדקו ב־. מסלולים, מחירים ומגבלות שימוש עשויים להשתנות; בדקו את התנאים העדכניים באתר הכלי.

כלים נוספים בתחום בינה מלאכותית

4 מתוך 4