המכון לחדשנות טכנולוגית מכריז על השקת NOOR, מודל עיבוד השפה הטבעית בערבית הגדול בעולם

דרוג:

 

המכון לחדשנות טכנולוגית מכריז על השקת NOOR, מודל עיבוד השפה הטבעית בערבית הגדול בעולם

*המודל הוא החזק ביותר בשפה הערבית עד כה עם 10 מיליארד משתנים

*כולל יישומים בתחומים כמו תקצור אוטומטי, צ'אטבוטים, שיווק מותאם אישית

 

 

אבו דאבי, איחוד האמירויות, 11 באפריל 2022, (BUSINESS WIRE):

 

המכון לחדשנות טכנולוגית - Technology Innovation Institute (TII), מרכז מחקר עולמי ועמוד תווך בתחום המחקר היישומי של מועצת המחקר הטכנולוגי המתקדם של אבו דאבי (ATRC), הודיע ​​היום על השקת NOOR, מודל עיבוד השפה הטבעית (NLP) בערבית הגדול בעולם עד כה.

 

צוות החוקרים המתקדם ומומחי הבינה המלאכותית (AI) של TII איחד כוחות עם LightOn, חברת טכנולוגיה המשחררת לשימוש בינת מכונות בקנה מידה גדול במיוחד לעסקים, כדי לשנות את מודל עיבוד השפה הטבעית הערבי. למודל NOOR יש את היכולת לבצע משימות מעבר לתחום השפה - ומציע נתונים באיכות גבוהה מקצה לקצה, כולל סריקה, סינון ואצירה בקנה מידה גדול. המודל מאפשר הכשרה והגשה מבוזרת בקנה מידה גדול במיוחד - כדי לספק יישומים המציעים התמחות לטובת להסקת מסקנות ומודלים יעילים.

ד"ר ריי או. ג'ונסון, מנכ"ל, TII ו-ASPIRE, אמר: "עם הפיתוח הזה, אנו נמצאים היטב על המסלול כדי לשפר את יכולות המחקר והאישורים שלנו, כמו גם להעלאת קרנה של אבו דאבי ואיחוד האמירויות כאקו סיסטם מחקרי רציני. צוותי המומחים שלנו הוכיחו שוב שאזור זה יכול להשיג תוצאות מחקר ופיתוח פורצות דרך כדי להשפיע על העולם".

ד"ר אבטסאם אלמאזרואי, מנהל, יחידת AI Cross-Center ב-TII, אמר: "מודלים גדולים של שפה כבשו בסערה את עולם עיבוד השפה הטבעית ואנו גאים להציג מודל חדשני זה עם 10 מיליארד משתנים - מודל NLP הערבי הגדול בעולם. מערך הנתונים הערבי הגדול והייחודי שנאסף כדי להכשיר את המודל הוא תוצאה של חודשים של עבודה קשה שכללה איסוף, גריטה וסינון של מקורות מגוונים. תודה מיוחדת לכל הצוות שעבד על הפרויקט הזה כדי להפוך את NOOR למודל החיפוש בערבית לאקדמאים ועסקים בכל מקום".

פרופ' מרוואן דבה, חוקר ראשי, מרכז המחקר למדע דיגיטלי ויחידת AI Cross-Center, TII, אמר לגבי ההשקה הקרובה: "עם NOOR, TII הרחיב את היקף המודל הסטנדרטי הערבי המודרני על ידי מינוף הידע בתחום מודלי השפה הגדולים לבניית מומחיות חוצת תחומים מתקדמת בדור החדש הזה של מחקר הבינה המלאכותית".

כדי לאצור את ערכות הנתונים הערביות הגדולות בעולם, ערכת הנתונים הייחודית של NOOR, המונה יותר מ-30 מיליארד מילים, משלבת נתוני אינטרנט עם ספרים, שירה, מאמרי חדשות ומידע טכני כדי להרחיב באופן משמעותי את תחולת המודל.

ד"ר אבטסאם אלמאזרואי אמר שמודל NOOR מבוסס על ארכיטקטורת שינוי או לימוד מכונה. מודל הפיענוח בלבד שלו דומה במבנהו ל-GPT-3 והוא מתוכנת להתמודד עם משימות יצירתיות עם ארכיטקטורה משודרגת כדי לשקף את ההתפתחויות האחרונות בעולם למידת המכונה, כולל שיפורים כגון הטמעות מיקום טובות יותר.  

 

 

כדי להבטיח איכות בקנה מידה גדול בערכת הנתונים של  ,NOORצוות TII תכנן צינור סינון אוטומטי המבוסס על טכניקות לימוד מכונה. כלים אלו מזהים מלל הרלוונטי להפניות איכותיות ומגנים על המודל מחשיפה לספאם.

 

NOOR עבר אימון באמצעות מחשוב בעל ביצועים גבוהים עם 128 מעבדים גרפיים מסוג A100, והוא ממנף גישת מקבילית תלת-ממדית מתקדמת כדי לאפשר הפצת חישובים תוך הבטחת שימוש יעיל במשאבי החומרה הזמינים.

 

מנהל היחידה לבינה מלאכותית הבין-מרכזית ציין כי זהו רק הצעד הראשון במאמצי היחידה לתרום לאסטרטגיה הרחבה יותר של איחוד האמירויות לבינה מלאכותית.

 

המודל נקרא על שם המילה הערבית "אור", כדי לבסס את המתאם של מודל השפה הערבית להארת המוח.

 

אודות Technology Innovation Institute (TII)

למידע נוסף, בקרו בכתובת www.tii.ae

*מקור: AETOSWire

תמונות / גלריית מולטימדיה זמינים: https://www.businesswire.com/news/home/52671760/en

 

*מקור: AETOSWire

 

קשרי מדיה

 

Technology Innovation Institute

Sneha Sivanand, [email protected]

 

 

כיתוב תמונה מצורפת: נור, מודל עיבוד השפה הטבעית (NLP) בערבית הגדול בעולם - צוות יחידת AI, המכון לחדשנות טכנולוגית (צילום: AETOSWire)

מקור: Technology Innovation Institute

תוכן הודעה זו בשפת המקור, מהווה את הגרסה הרשמית והמהימנה היחידה של מסמך זה. תרגומים מסופקים למטרות נוחות בלבד ויש להצליבם מול המסמך בשפת המקור, המהווה את הגרסה היחידה של טקסט זה שהינה בעלת תוקף משפטי.

 

*** הידיעה מופצת בעולם על ידי חברת התקשורת הבינלאומית BUSINESS WIRE

 

לפרטים נוספים: נוי תקשורת 03-6026026 זהר 052-2641769


כתבות נוספות בקטגוריה הייטק וטכנולוגיה

העדשות הכפולות של C30 Dual מעניקות להורים יד מסייעת IMILAB, מובילה בטכנולוגיית בית חכם, תשיק את IMILAB
BlinkOps משיקה את הפלטפורמה הראשונה ללא קוד לבניית סוכני אבטחה עבור צוותים ארגוניים BlinkOps, הפלטפורמה המובילה בתחום האוטומציה של האב
Imricor מתחילה בניסוי VISABL-VT ‏ Imricor Medical Systems, Inc. ("החברה" או Imrico
HYCU® חושפת את R-Shield™ כדי לספק כיסוי חוסן סייבר מוחלט עבור סביבות תוכנה כשירות, מחשוב ענן וגם סביבות IT מקומיות HYCU, Inc, מובילה בתחום ההגנה על נתונים מודרניים ע
81% מצוותי אבטחת הסייבר רואים באוטומציית אבטחה מבוססת בינה מלאכותית עדיפות אסטרטגית – חשיפה של סקר שנערך על ידי BlinkOps BlinkOps, פלטפורמת אוטומציית האבטחה המובילה בשוק,
חברת הסטרטאפ Axibo AI מווטרלו הבטיחה 12 מיליון דולר כדי להיות חלוצה בפיתוח רובוטים דמוי אדם ש-'מיוצרים בקנדה' Axibo Inc, חברה חדשנית בתחום הרובוטיקה שפועלת מווט
ניצחונות לבינה המלאכותית בתחרות הנחשבת ביותר לרחפנים אוטונומיים באבו דאבי ליגת המרוצים לרחפנים אוטונומיים של אבו דאבי (A2RL)
OMP ממוקמת גבוה מכולן בקטגוריית יכולת הביצוע ב-Gartner® Magic Quadrant™ לשנת 2025 עבור פתרונות תכנון שרשרת אספקה OMP, מובילה עולמית בפתרונות תכנון שרשרת אספקה, הוכ
AI-Media חושפת את LEXI Voice בתערוכת NAB 2025 - זמין גלובלית עם תרגום קולי מועצם בינה מלאכותית AI-Media (ASX: AIM), מובילה עולמית בטכנולוגיית כתו
Zoom Workplace for Frontline זמין כעת כדי לשפר את התקשורת במשמרת ואת ניהול העבודה לעובדים בשטח Zoom Communications, Inc (נאסד"ק: ZM) הכריזה היום
GA-ASI מכריזה על השקעות טכנולוגיות מאירוע Blue Magic Netherlands General Atomics Aeronautical Systems, Inc (GA-ASI)
VeriSilicon משיקה מעבד גרפי OpenGL ES עם צריכת הספק נמוכה ביותר וביצועי 3D/2.5D היברידיים להתקנים לבישים VeriSilicon (688521.SH) הכריזה היום על השקת GCNano
VeriSilicon חושפת את VC9000D_LCEVC: מפענח וידאו LCEVC יעיל במיוחד התומך ב-8K Ultra HD ‏VeriSilicon (688521.SH) הכריזה היום על השקת VC900
Gradiant זוכה בפרס הזהב בטקס פרסי Edison לשנת 2025 עבור ForeverGone PFAS Removal and Destruction ‏Gradiant, חברה מובילה בעולם בתחום הטיפול המתקדם ב
SolarWinds מציגה באירועים הגלובליים של GITEX 2025 ‏SolarWinds (NYSE:SWI), ספקית מובילה של תוכנה פשוט
ExaGrid מרעננת את משפחת המוצרים שלה בדגמים חדשים ומוציאה את גרסה 7.2.0 ExaGrid®, הספקית של הפתרון היחיד בענף לאחסון גיבוי
GA-ASI חתמה על עסקת שיתוף פעולה עם Hanwha מדרום קוריאה General Atomics Aeronautical Systems, Inc. (GA-ASI
Bitget משיקה את Bitget Onchain כדי להעניק למשתמשי CEX גישה מוקדמת לנכסי בלוקצ'יין מבטיחים Bitget, הבורסה המובילה למטבעות קריפטוגרפים וחברת ה
DPI מקבלת את אישור ISO 27001 היוקרתי על ניהול אבטחת מידע ‏Datalec Precision Installations (DPI), ספקית מובי
GA-ASI מרחיבה את יכולת הכיוון למטה עבור MQ-9B SeaGuardian® General Atomics Aeronautical Systems, Inc (GA-ASI)
הוסף תגובה 
תגובות  ( תגובות)