OpenAI פרסם מחקר חדש שמצביע על בעיות ב-SWE-Bench Pro, מודל ניסוי בקוד פופולרי, וגורם לחששות לגבי विश्वसनीयता והאמת בדירוגים של מודלים בינה מלאכותית.
מקור: OpenAI News — לכתבה המלאה
OpenAI פרסם מחקר חדש שמצביע על בעיות ב-SWE-Bench Pro, מודל ניסוי בקוד פופולרי, וגורם לחששות לגבי विश्वसनीयता והאמת בדירוגים של מודלים בינה מלאכותית.
מקור: OpenAI News — לכתבה המלאה
כתיבת תגובה