מאגר-הביבליוגרפיה DBLP

עולם המחקר

הגדרה

DBLP הוא מאגר-ביבליוגרפיה חופשי לכל מדעי-המחשב, לא רק AI, שהקים מיכאל ליי ב-1993 באוניברסיטת טריר; ב-2025 חצה את רף שמונת-מיליון-הפרסומים, ומאז 2018 מפעיל אותו במלואו מרכז-המחקר Schloss Dagstuhl.

הקמה ב-1993: פרויקט של איש אחד באוניברסיטת טריר

מיכאל ליי (Michael Ley) הקים את DBLP ב-1993 באוניברסיטת טריר שבגרמניה, כתגובה למאפיין-ייחודי בתרבות-הפרסום של מדעי-המחשב: מאמרי-כנסים, שמדדי-ציטוט "רגילים" נטו להתעלם מהם, ממלאים בתחום הזה תפקיד חשוב לפחות כמו מאמרים בכתבי-עת — בניגוד למדעים אחרים, שבהם כתב-העת הוא כמעט תמיד זירת-הפרסום המרכזית. שם הפרויקט המקורי — Databases and Logic Programming — שיקף את המיקוד-ההתחלתי הצר שלו בשני תת-תחומים בלבד: מסדי-נתונים ותכנות-לוגי.

מ"תחביב אישי" למאגר-הכיסוי-הרחב-ביותר במדעי-המחשב

מהמיקוד המקורי הצר התרחב DBLP בהדרגה לכיסוי כל תחומי מדעי-המחשב, כשהמאגר צומח כמעט כולו על עבודתו האישית של ליי במשך קרוב לשני עשורים, לפני שהפך לפרויקט-צוות. עיקרון-העיצוב שעמד במרכז ההרחבה נשאר יציב לאורך כל הדרך: לתעד כל פרסום — מאמר-כנס, מאמר-כתב-עת או ספר — עם שם-מחבר, כותרת, שנה ומקור-פרסום מדויקים, בלי לדרג את איכותו או להביע דעה על ערכו.

מעבר לניהול מוסדי: Schloss Dagstuhl מ-2011

בנובמבר 2010 חברו אוניברסיטת טריר ומרכז-המחקר הגרמני Schloss Dagstuhl (Leibniz-Zentrum für Informatik) כדי לחזק את התשתית ולהבטיח את המשכיותה לטווח-ארוך; החל מ-2011 חדל DBLP להיות פרויקט של אדם בודד והפך לצוות קבוע בחסות Schloss Dagstuhl, כשליי עצמו ממשיך להיות מעורב במפעל ומזוהה איתו עד היום. המעבר המלא של הפעלת-הפרויקט ל-Schloss Dagstuhl הושלם, לפי אתר-המכון, רק בנובמבר 2018 — לרגל יום-הולדתו ה-25 של dblp — נקודת-מעבר פורמלית מניהול-משותף לניהול יחיד.

ציון-דרך ב-2020: חמישה מיליון פרסומים

לפי הודעה רשמית של Schloss Dagstuhl, DBLP חצה ב-2020 את רף חמשת-מיליון-הפרסומים המתועדים — ציון-דרך שמשקף את הפיכתו לכלי-הבדיקה הבסיסי ביותר עבור כל מי שרוצה לדעת "מי פרסם מה, איפה, ומתי" במדעי-המחשב, כולל תת-התחום של בינה-מלאכותית.

הצמיחה מאז 2020: שמונה מיליון פרסומים ומעלה

הצמיחה נמשכה גם אחרי 2020: ב-25 ביולי 2025 חצה המאגר את רף שמונת-מיליון-הפרסומים, ציון-דרך שצוות dblp חגג בקולוקוויום חגיגי באוניברסיטת טריר ב-19 בספטמבר 2025, לרגל 32 שנה למאגר — תחת הכותרת המשחקית "2^5 שנים ל-dblp — 2^23 פרסומים". לפי הצהרת-המשימה הרשמית של הפרויקט, נכון ל-2023 הכיל dblp למעלה משלושה מיליון מחברים רשומים, למעלה מ-50,000 כרכי-כתבי-עת, למעלה מ-50,000 קובצי-כנסים וסדנאות, ולמעלה מ-100,000 ספרים — ומוסיף מעל 500,000 פרסומים חדשים בכל שנה. כל הנתונים זמינים לשימוש חופשי תחת רישיון CC0, וכל חודש רושמים שרתי-dblp למעלה מ-40 מיליון צפיות-דף מיותר מ-750,000 משתמשים ברחבי-העולם.

הכרה מוסדית: פרסים לפרויקט וליוצרו

המאגר ויוצרו זכו במהלך השנים בכמה פרסים יוקרתיים ממוסדות-מפתח במדעי-המחשב: פרס-השירות של ACM SIGMOD ב-1997, פרס-ההכרה-המיוחד של VLDB Endowment באותה שנה, פרס-התרומה של ACM SIGMOD ב-2003, ופרס-השירות-המצוין (Distinguished Service Award) של ACM ב-2019. לפי אתר-המכון, המאגר צמח במשך שנים בכוח-אדם מינימלי, וב-2008 כבר מנה יותר ממיליון פרסומים.

בעיה ידועה: כשכמה חוקרים חולקים שם זהה

מאגר בגודל הזה מתמודד עם בעיה מוכרת בשם עמימות-שמות (Name Ambiguity): כשכמה חוקרים שונים חולקים שם זהה במדויק, DBLP מוסיף לכל אחד מהם סיומת מספרית ייחודית — למשל 0001, 0002 — כי מבחינה טכנית לכל אדם ב-DBLP חייב להיות שם שונה משל האחר. לפי בלוג-הצוות של dblp ממרץ 2020, באותו מועד נשאו 38,822 רשומות-מחברים סיומת-הבחנה כזו, על-פני 9,664 שמות-בסיס שונים — הדגמה קונקרטית לכמה נפוצה התופעה במאגר בסדר-גודל כזה.

תקדים בקטגוריה: כלי-רוחב לא-ספציפי ל-AI, בדיוק כמו Semantic Scholar

DBLP אינו כלי-ייעודי לבינה-מלאכותית — הוא מכסה את כל מדעי-המחשב, בדיוק כפי שסמנטיק סקולר (ראו הערך הנפרד) מכסה את כל תחומי-המדע. ההבדל בין השניים הוא בתפקיד: סמנטיק סקולר מדרג ומסכם באמצעות בינה-מלאכותית, בעוד ש-DBLP הוא ביבליוגרפיה גולמית וללא-דירוג — רשימה מדויקת של מה-פורסם-איפה, בלי שכבת-ניתוח או המלצה מעליה.

למה זה חשוב: תשתית לבדיקת טענות-קדימות

כשמדווחים על "פריצת-דרך" חדשה בבינה-מלאכותית, אחת השאלות הראשונות שחוקר-אחר שואל היא האם מישהו כבר פרסם רעיון דומה קודם. DBLP הוא בדיוק הכלי שמאפשר לבדוק את זה במהירות — לא באמצעות ניחוש או זיכרון אישי, אלא באמצעות רשומה ביבליוגרפית מדויקת ומעודכנת של כל מה שפורסם, מתי ואיפה, בכל ענפי מדעי-המחשב, החל ממאמר-כנס בודד ועד לספר שלם.

פיתוחים אחרונים: גרף-ידע סמנטי, ומוסדות כישויות עצמאיות

מעבר לביבליוגרפיה הפשוטה, מפתח צוות dblp מאז 2022 גם "גרף-ידע" (Knowledge Graph) סמנטי, המקשר בין פרסומים, מחברים וכתבי-עת ברמת-מבנה עמוקה יותר; בספטמבר 2024 השיק הצוות שירות-שאילתות SPARQL פומבי המאפשר לחקור את הנתונים האלה ישירות. ב-21 בספטמבר 2026 הוסיף dblp שכבת-נתונים חדשה שהופכת גם מוסדות-מחקר לישויות-עצמאיות-מלאות בתוך המאגר, עם דפי-נחיתה משלהן ואפשרות לסנן פרסומים לפי שיוך-מוסדי — הרחבה טרייה שממחישה שהמאגר ממשיך להתפתח, לא רק לצבור נתונים. בדצמבר 2025 פרסם הצוות קריאה פומבית לתרומות, בציינו שהביקוש למאגר חזק אך תקציבו הנקי הולך ומצטמצם — תזכורת לכך שתשתית-מחקר חינמית-לשימוש אינה פועלת בלי עלות תפעולית ממשית מאחורי הקלעים.

שאלות נפוצות ❓

מי הקים את DBLP, ומתי?

מיכאל ליי, ב-1993, באוניברסיטת טריר שבגרמניה — כפרויקט של אדם בודד שהתרחב בהדרגה לכיסוי כל מדעי-המחשב.

מה משמעות ראשי-התיבות DBLP?

בראשית הפרויקט התייחסו ל-Databases and Logic Programming, שני תת-התחומים היחידים שכוסו בתחילה — היום המאגר מכסה את כל ענפי מדעי-המחשב, כולל AI.

מי מנהל את DBLP כיום?

כיום — מרכז-המחקר Schloss Dagstuhl. אוניברסיטת טריר ו-Schloss Dagstuhl חברו ב-2010 והפעילו את המאגר יחד, ובנובמבר 2018, במלאת 25 שנה ל-dblp, עברה ההפעלה המלאה ל-Schloss Dagstuhl.

האם DBLP מיועד רק לבינה-מלאכותית?

לא — הוא מכסה את כל מדעי-המחשב, בדיוק כמו סמנטיק סקולר (ראו הערך הנפרד), שגם הוא כלי-רוחב ולא כלי-AI-בלבד.

למה DBLP חשוב לבדיקת פריצות-דרך מדווחות?

הוא מאפשר לחוקרים לבדוק במהירות אם רעיון דומה כבר פורסם קודם — כלי-בסיס לבדיקת טענות-קדימות, לא רק ארכיון פסיבי.