BlockBeats News, 10. August, laut einem Bericht von LatePost: Die Open-Platform „MaaS“ von ZhiPu hat inzwischen nahezu 7 Millionen registrierte Nutzer; das ist ein Anstieg um rund 2 Millionen seit Anfang Juli, während die Zahl der Unternehmenskunden 23.000 erreicht hat. Sein Entwicklerprodukt ZCode hat innerhalb nur eines Monats mehr als 1 Million Nutzer überschritten. Der Bericht erklärte, dass ZhiPus ARR (Annual Recurring Revenue, jährliche wiederkehrende Einnahmen) seit Jahresbeginn um etwa das 15-fache gewachsen ist. Marktquellen zufolge könnte ZhiPus aktueller ARR bis zu 2 Milliarden US-Dollar erreichen, diese Daten wurden jedoch nicht offiziell bestätigt. Mit dem rasanten Wachstum der Nachfrage nach Modell-Inferenz baut ZhiPu seine heimische Rechenleistungs-Infrastruktur aus. Es wird verstanden, dass ZhiPu über 50.000 inländisch produzierte KI-Computing-Chips eingesetzt hat, um der steigenden Inferenznachfrage zu begegnen. Zuvor gab es Marktrumors, dass ZhiPu eine inländische KI-Computing-Infrastruktur mit einer Kapazität von 1 GW aufgebaut habe. ZhiPus Wachstum wird vor allem durch den sprunghaften Anstieg der Nachfrage nach Programmier-Szenarien getragen. Nach der Veröffentlichung des GLM-5-Modells ist der ARR des Unternehmens stark gewachsen; das API-Geschäft wird mittlerweile zur zentralen Einnahmequelle. ZhiPu optimiert zudem fortlaufend die Inferenz-Effizienz und verbessert die Auslastung der Rechenleistung durch Techniken wie KV-Cache-Splitting und eine Inferenz-Netzwerkarchitektur. Zusätzlich brachte ZhiPu im Juli eine High-Speed-Version des API auf den Markt, mit einer Token-Generierungsrate von 400 pro Sekunde, also etwa 8-mal schneller als die reguläre API. Am 31. Juli eröffnete das Unternehmen den Kauf des Coding Plan erneut und passte die Preise deutlich an: Die monatliche Gebühr der Lite-Version wurde auf 118 Yuan erhöht. Branchenexperten sind der Ansicht, dass mit dem fortgesetzten Wachstum der Nachfrage nach KI-Programmierung die Optimierung der Inferenz-Effizienz zu einem zentralen Wettbewerbsvorteil für Unternehmen großer Modelle werden wird. Wer auf derselben Rechenleistung mehr Tokens generieren kann, hat bei Kosten und Kommerzialisierung einen Vorteil. Derzeit stehen chinesische Anbieter großer Modelle wie ZhiPu, Kimi und DeepSeek vor Engpässen bei der Rechenleistung und unter starkem Wettbewerbsdruck. Der Markt erwartet, dass mehrere Unternehmen im August eine neue Generation von Modellen auf den Markt bringen und damit den Wettbewerb in den KI-Large-Models weiter verschärfen.