माइक्रोसॉफ्ट ने Phi-4 के लिए तकनीकी रिपोर्ट प्रकाशित की, जो एक 14-अरब पैरामीटर भाषा मॉडल है जो प्रशिक्षण भर में सिंथेटिक डेटा की रणनीतिक उपयोग के माध्यम से डेटा गुणवत्ता को प्राथमिकता देता है। पिछले Phi मॉडल्स के विपरीत, जिनने GPT-4 से क्षमताओं को संक्षिप्त किया था, Phi-4 STEM-केंद्रित QA कार्यों में अपने शिक्षक को पार कर जाता है, यह प्रदर्शित करते हुए कि इसका डेटा-जनरेशन और पोस्ट-ट्रेनिंग तकनीक साधारण संक्षेपण से परे हैं।
- मॉडल केवल जैविक वेब सामग्री या कोड के बजाय उच्च गुणवत्ता वाले सिंथेटिक डेटा पर केंद्रित प्रशिक्षण रेसिपी का उपयोग करता है।
- Phi-4 STEM-केंद्रित प्रश्नोत्तरी क्षमताओं में GPT-4 की तुलना में काफी बेहतर प्रदर्शन करता है।
- यह अपने आकार के सापेक्ष मजबूत प्रदर्शन प्राप्त करता है, विशेष रूप से तर्क-केंद्रित बेंचमार्क्स पर, उन्नत डेटा, प्रशिक्षण पाठ्यक्रम और पोस्ट-ट्रेनिंग नवाचारों के कारण।
रिपोर्ट में उल्लेख किया गया है कि phi-3 से न्यूनतम आर्किटेक्चरल परिवर्तनों के बावजूद, डेटा गुणवत्ता पर ध्यान केंद्रित करने से मॉडल विशिष्ट क्षेत्रों में शिक्षक की क्षमताओं को पार कर जाता है।