Le 19 juillet, OpenBMB (Mingxi Intelligent) a publie en open-source MiniCPM-Robot, la premiere serie de modeles d IA incarnee concus pour rendre la technologie Vision-Langage-Action (VLA) accessible aux developpeurs individuels. La publication comprend trois composants principaux : MiniCPM-RobotManip, un modele VLA de 1,5 milliard de parametres pour la manipulation robotique generale ; MiniCPM-RobotTrack, un modele compact pour le suivi de cibles en conditions reelles ; et PhyAI, un framework d inference haute performance dedie aux modeles incarnes.
Jusqu a present, l intelligence incarnee etait largement confinee aux grandes entreprises et aux laboratoires de recherche. La serie MiniCPM-Robot brise cette barriere en permettant aux developpeurs individuels d exploiter des robots reels avec des modeles de 1,5 milliard de parametres deployables sur du materiel grand public.
MiniCPM-RobotManip, le modele phare de la serie, est un modele VLA universel qui traduit les observations visuelles et les instructions linguistiques en actions robotiques precises. Tous les poids et codes du modele sont disponibles publiquement sur GitHub et Hugging Face.




