Jin10 données 10 juillet, ce matin, Microsoft a open source la dernière version de la famille Phi-4, Phi-4-mini-flash-reasoning, sur son site officiel. La version mini-flash conserve les caractéristiques de faible puissance et de haute performance de la famille Phi-4, et est spécifiquement conçue pour les scénarios limités par la puissance de calcul, la mémoire et la latence, fonctionnant sur un seul GPU, et adaptée aux appareils de bord tels que les ordinateurs portables et les tablettes. Par rapport à la version précédente, le mini-flash utilise l'architecture innovante SambaY développée par Microsoft, l'efficacité de l'inférence a connu un big pump de 10 fois, la latence a été en moyenne réduite de 2 à 3 fois, et la performance d'inférence globale a considérablement augmenté.
Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
Microsoft Open Source la nouvelle version Phi-4 : l'efficacité d'inférence big pump de 10 fois, peut être exécutée sur un ordinateur portable.
Jin10 données 10 juillet, ce matin, Microsoft a open source la dernière version de la famille Phi-4, Phi-4-mini-flash-reasoning, sur son site officiel. La version mini-flash conserve les caractéristiques de faible puissance et de haute performance de la famille Phi-4, et est spécifiquement conçue pour les scénarios limités par la puissance de calcul, la mémoire et la latence, fonctionnant sur un seul GPU, et adaptée aux appareils de bord tels que les ordinateurs portables et les tablettes. Par rapport à la version précédente, le mini-flash utilise l'architecture innovante SambaY développée par Microsoft, l'efficacité de l'inférence a connu un big pump de 10 fois, la latence a été en moyenne réduite de 2 à 3 fois, et la performance d'inférence globale a considérablement augmenté.