עיבוד שפה טבעית
ElectiveEMLמטרה: האם מחשבים יכולים להבין שפה אנושית? האם ניתן בעזרתם לחלץ באופן אוטומטי היסקים בעלי משמעות מהמוני המסמכים הזמינים לנו באינטרנט? כיצד פועל Google Translate ? התשובות לשאלות אלו נידונות בתחום מחקר הנקרא "בלשנות חישובית / עיבוד שפה טבעית" (CL / NLP) המשלב שיטות חישוביות, בלשניות, סטטיסטיות, קוגניטיביות ואף פילוסופיות על מנת לחקור כיצד שפה טבעית מובנת על ידי בני אדם, ולבנות יישומים טכנולוגיים היכולים לעבד שפה אנושית באופן דומה. קורס זה מלמד טכניקות ואלגוריתמים לעיבוד שפה טבעית ומדגים את יישומם בטכנולוגיות עכשוויות. הקורס בנוי מארבעה חלקים שווים, כשכל חלק מעמיק את רמת עיבוד המוצגת בקודמו. חלק א' "מילים" מתמקד במכונות מצבים סופיות, עיבוד מורפולוגי, הפגת עמימות, ויישומים פשוטים כגון בדיקת איות. חלק ב' "משפטים" מגדיר דקדוקים פורמליים והסתברותיים, ומלמד את יסודות הניתוח התחבירי הסטטיטסטי לשפות שונות. חלק ג' "משמעות" מטפל בייצוג לוגי ופרשנות של משפטים מורכבים (כלומר, ההבנה "מי עשה מה למי"), ביחסי דמיון והוראה בין ביטויים במסמך, ובשימוש במילונים ולקסיקונים מקוונים. חלק ד' "יישומים" מציג ארכיטקטורות לאחזור מידע, כרייה, חישוביות פסיכו-בלשנית, ותרגום מכונה. קורס זה מיועד לסטודנטים למדעי המחשב המתעניינים בשפה טבעית, בינה מלאכותית, תקשורת אדם-מחשב ובמודלים חישוביים קוגניטיביים. במהלך הקורס יעשה שימוש בטכנולוגיות בינה מלאכותית מתקדמות כגון רשתות נוירונים ומודלי שפה גדולים. הציון הסופי יתבסס על הערכה של משימות תכנות, בחינת אמצע קצרה, ופרויקט גמר . פרוייקטים מצטיינים ישקלו כמועמדים להגשה לכנסים בינלאומיים בנושא בלשנות חישובית (כדוגמת ACL). הקורס אינו דורש ידע בלשני קודם או שליטה כלשהיא בשפות זרות (מלבד אנגלית).