The Integral Project ברשתות · בקרוב
המומחיםמילוןפודקאסט

בריאות, נפש וטכנולוגיה

כתבות ומחקרים

AI סימן 55 מפרצות שלא הופיעו בדוח הרדיולוג — אבל נבדק רק במצב ״צל״

מחקר פרוספקטיבי על 3,856 בדיקות CTA מוח מצא שאלגוריתם מאושר FDA זיהה 55 מפרצות נוספות שלא הופיעו בדוחות הרדיולוגים. הבדיקה נערכה בלי להציג את התוצאות לצוות, ורק מקרי אי־הסכמה עברו הכרעה מלאה.

צוות The Integral Project · בעריכת יורי אלטשולרעל העריכה והאחריות המערכתית16.9.20262 דק' קריאה
שיתוף הכתבה
AI סימן 55 מפרצות שלא הופיעו בדוח הרדיולוג — אבל נבדק רק במצב ״צל״
הדמיה: מערכת The Integral Project · נוצרה באמצעות בינה מלאכותית

אלגוריתם שמנתח בדיקות CT אנגיוגרפיה של המוח עשוי לשמש כזוג עיניים נוסף לאיתור מפרצות תוך־גולגולתיות. מחקר פרוספקטיבי חדש ב־Journal of the American College of Radiology בדק כלי מסחרי מאושר FDA על אלפי בדיקות עוקבות — אך עשה זאת במצב ״צל״: המערכת פעלה ברקע, והרדיולוגים לא ראו את התוצאות בזמן הפענוח.

מה בדקו

החוקרים ניתחו 3,856 בדיקות CTA מוח שבוצעו במשך כשישה שבועות. אלגוריתם של Aidoc עיבד את הסריקות, בעוד תוצאות דוחות הרדיולוגים חולצו בעזרת עיבוד שפה. כאשר האדם והמערכת לא הסכימו, נוירורדיולוג הכריע לאחר חשיפת תוצאת ה־AI.

בסך הכול 195 בדיקות, 5.1% מהמדגם, סווגו כחיוביות למפרצת. הרדיולוגים והאלגוריתם הסכימו ב־96.3% מהבדיקות.

יותר רגישות, סגוליות דומה

רגישות האלגוריתם לבדו הייתה 84.6%, לעומת 71.8% לרדיולוגים לבדם. הסגוליות הייתה דומה וגבוהה: 98.7% ל־AI ו־98.5% לרדיולוגים. לאחר הכרעת מקרי אי־ההסכמה, המערכת הוסיפה 55 מפרצות שלא הופיעו בדוחות הרדיולוגים. יותר ממחציתן — 31 מתוך 55 — היו קטנות מ־3 מ״מ.

במונחים תפעוליים, נדרשו בממוצע כ־70 בדיקות כדי למצוא מקרה חיובי נוסף שהרדיולוג לא דיווח עליו. על כל 55 איתורים נכונים נוספים היו 46 סימונים שגויים נוספים. התועלת לא הייתה אחידה: היחס היה חיובי במיוחד בבדיקות של מאושפזים, מאוזן בחדר המיון ופחות טוב בבדיקות חוץ.

ההבדל בין ״צל״ לעבודה קלינית

זהו יתרונו של המחקר וגם הגבול המרכזי שלו. הפעלה פרוספקטיבית על בדיקות עוקבות משקפת עומס עבודה אמיתי טוב יותר ממאגר תמונות שנבחר מראש. אבל הרדיולוגים היו עיוורים לתוצאת האלגוריתם, ולכן המחקר לא בדק כיצד הם מגיבים לסימון בזמן אמת, כמה זמן הוא מוסיף לפענוח, או אם השילוב משנה טיפול ותוצאות בריאות. הרגישות של צוות משולב אדם־AI היא תחזית מתוך הנתונים — לא תוצאה שנמדדה בעבודה משותפת.

גם תקן הייחוס היה היברידי: רק מקרי אי־ההסכמה עברו הכרעה של נוירורדיולוג. המשמעות היא שהמדדים תלויים בהנחה שמקרי ההסכמה אכן סווגו נכון. נוסף על כך, מפרצת קטנה אינה בהכרח ממצא שמחייב התערבות; הערך הקליני תלוי במיקום, במבנה, בגורמי הסיכון ובהשוואה לבדיקות קודמות.

השורה התחתונה

במצב צל, האלגוריתם מצא מפרצות נוספות ושמר על סגוליות דומה לזו של הרדיולוגים — אות מבטיח לכלי בקרת איכות. הצעד הבא צריך להיות מחקר שבו התוצאות מוצגות בזמן אמת ונמדדים גם שינויי החלטות, עומס וסיכון לבדיקות המשך מיותרות. 55 הממצאים הנוספים מראים פוטנציאל; הם עדיין לא מוכיחים שהטמעת המערכת משפרת טיפול.

מה אפשר לקחת מהמחקר?

שינויים קטנים ועקביים בהרגלי התזונה וההתאוששות עשויים להיות משמעותיים לאורך זמן. מומלץ לבחון אותם לצד מדדים אישיים ובהתייעצות מקצועית כשנדרש.

המחקר הפרוספקטיבי ב־Journal of the American College of Radiologyהמקור המחקרי
THE INTEGRAL UPDATE

העדכונים החשובים, ישר למייל

כתבות חדשות, מחקרים ועדכונים כלליים מ־The Integral Project — בלי רעש מיותר.

האימייל נשמר באופן מאובטח ולא יימסר לצדדים שלישיים לצורכי פרסום.

אהבתם את הכתבה?

המשוב שלכם עוזר לנו לבחור את התוכן הבא.

תגובות הקוראים

היו הראשונים להגיב

התגובה תפורסם לאחר בדיקה קצרה.
שאלו את PulseAI על המחקר
היועץ המדעי PulseAI