Zusammenfassung:
DeepSeek, bekannt für sein „kleines Team und seine hohe Talentdichte“, begann in großem Umfang mit der Rekrutierung von Ingenieurpersonal. Am Abend des 7. September rekrutierte Cui Tianyi, der Leiter des DeepSeek Harness-Teams, öffentlich auf sozialen Plattformen und gab gleichzeitig etwa 150 Stellen frei. Er sagte, dies sei ein „beispielloser Rekrutierungsbedarf für 150 HCs“ und das Unternehmen habe derzeit „viele neue Richtungen, neue Systeme und neue Bedürfnisse, die angegangen werden müssen“.

Screenshot von Cui Tianyis Beitrag
Zwei Tage später kündigte DeepSeek eine Preissenkung für die API der Flash-Serie an, wobei der Preis für die Cache-Hit-Eingabe um bis zu 60 % sank. Im Vergleich zu Preisänderungen spiegelt diese Einstellung besser die Veränderungen wider, mit denen DeepSeek im Zuge der Ausweitung seines Geschäftsumfangs konfrontiert ist.
150 Stellen sind auf Ingenieurpositionen konzentriert
Diese Rekrutierungsrunde konzentriert sich auf leitende Ingenieure mit 2 bis 10 Jahren Berufserfahrung. Es akzeptiert auch neue Absolventen und Kandidaten, die weniger als zwei Jahre gearbeitet haben. Der Arbeitsort ist hauptsächlich Peking, einige Positionen können auch in Hangzhou ausgewählt werden.
Die Positionen sind hauptsächlich in zwei Sequenzen unterteilt: Serverentwicklung und Agent Elastic Computing. Serverseitige Entwicklungsingenieure decken sechs Richtungen ab: große Modellforschungsplattform, Agent-Framework-Komponenten, Infrastruktur für F&E-Effizienz, DeepSeek-API, Online-Dienste und Datentechnik; Die Forschungs- und Entwicklungsingenieure für Agent Elastic Computing sind in zwei Richtungen unterteilt: Plattformentwicklung und -wartung, zugrunde liegende Optimierung und Angriff.
Dies ist die zweite groß angelegte Registrierungserweiterung von DeepSeek in mehr als zwei Monaten. Am 25. Juni schlug das Unternehmen vor, die Größe aller Abteilungen „mindestens zu verdoppeln“, wobei die Rekrutierung mehrere Kategorien abdeckt, wie z. B. Full-Stack-Entwicklung und Algorithmen, Forschung und Entwicklung von KI-Kernsystemen, Betrieb und Wartung, Produkte, Modelldatenstrategie, Deep-Learning-Forschung und funktionale Abteilungen.
Verglichen mit der umfassenden Rekrutierung im Juni sind die rund 150 Stellen dieses Mal hauptsächlich für Back-End-Systeme, APIs und Agenten-Infrastruktur vergeben, Modellforschungsstellen gibt es nicht.
Genauer gesagt handelt es sich hierbei um eine spezielle Erweiterung für Engineering-Systeme.
Auch die Anforderungen an die Erfahrung des Personals haben sich geändert. DeepSeek war in der Vergangenheit dafür bekannt, eine große Anzahl frischer Absolventen und junger Forscher zu beschäftigen. Liang Wenfeng hat zuvor erklärt, dass die meisten technischen Kernpositionen des Unternehmens mit frischgebackenen Absolventen oder Mitarbeitern mit nur ein oder zwei Jahren Berufserfahrung besetzt werden. Diese Einstellung konzentriert sich auf leitende Ingenieure mit 2 bis 10 Jahren Erfahrung.
Cui Tianyi erklärte, dass das „Volumen“, mit dem DeepSeek derzeit konfrontiert ist, schnell zunimmt, einschließlich der Datenmenge, der Anzahl der Maschinen und Container, der Schulungs- und Bewertungsaufgaben, der Agentenumgebung, der Benutzer und des Anforderungsvolumens. Mit zunehmender Skalierung wird auch die Systemkomplexität deutlich zunehmen. Das ursprüngliche Back-End-System kann die Anforderungen möglicherweise nicht mehr erfüllen und muss daher aktualisiert, gewartet oder sogar neu geschrieben werden.
Aus den Rekrutierungsinformationen ging außerdem hervor, dass die Agent-Elastic-Computing-Plattform DSec von DeepSeek „Tausende von Sandbox-Umgebungen“ gehostet hat, um die Modelliteration der nächsten Generation zu fördern. Wenn Agenten Aufgaben ausführen, müssen sie in der Regel Modelle und Tools mehrmals aufrufen und weiterhin Rechen-, Speicher- und Betriebsumgebungen belegen. Wenn die Aufgaben zunehmen, werden Ressourcenplanung, Umgebungsisolation, Fehlerbehebung und Parallelitätsstabilität zu spezifischen technischen Problemen.
Jiang Han, ein leitender Forscher beim Pangu Think Tank, sagte gegenüber Caiwen, dass diese Rekrutierungsausweitung zeigt, dass DeepSeek von einer unternehmerischen Phase, die sich auf Modellforschung konzentriert, zu einer neuen Phase übergeht, die die gleichzeitige Verarbeitung von Benutzeranfragen, die Planung der Rechenleistung und den Aufbau komplexer Systeme erfordert. Neues Personal kann die Back-End-Infrastruktur und die Funktionen der Agentenplattform ergänzen, aber eine schnelle Expansion kann auch die ursprüngliche Effizienz der Zusammenarbeit in kleinen Teams verwässern und höhere Anforderungen an die Organisationsverwaltung und -ausführung stellen.
Die Preissenkung ist eine teilweise Korrektur nach der Preiserhöhung im August
Am 9. September gab DeepSeek bekannt, dass es den Preis der Flash-Serien-API ab dem 10. September um 12:00 Uhr anpassen wird.
Während der Leerlaufzeit sank der Cache-Hit-Eingabepreis pro Million Token von 0,05 Yuan auf 0,02 Yuan, was einem Rückgang von 60 % entspricht; Der Preis für die Cache-Miss-Eingabe sank von 1,5 Yuan auf 1 Yuan, was einem Rückgang von etwa 33 % entspricht. Der Verkaufspreis sank von 4,5 Yuan auf 4 Yuan, was einem Rückgang von etwa 11 % entspricht. Wochentags von 9:00 bis 12:00 Uhr und 14:00 bis 18:00 Uhr sind immer noch Spitzenzeiten, und der Preis ist doppelt so hoch wie in der Ruhezeit; Samstags und sonntags gilt ganztägig der Leerlaufzeitpreis.
Die „Preisreduzierung von bis zu 60 %“ gilt nur für die Cache-Hit-Eingabe und bedeutet nicht, dass die Gesamtanrufkosten für alle Benutzer um 60 % reduziert werden. Der tatsächliche Rückgang hängt von der Cache-Trefferrate, dem Verhältnis von Eingabe- und Ausgabe-Tokens und der Aufrufdauer ab.
Diese Preisanpassung erfolgt weniger als einen Monat nach der letzten Preiserhöhung von DeepSeek. Im Vergleich zu vor der Preiserhöhung im August ist der Leerlaufpreis für Flash-Cache-Hit-and-Miss-Eingaben nach dieser Anpassung im Wesentlichen auf das vorherige Niveau zurückgekehrt, der Ausgabepreis stieg jedoch immer noch von 2 Yuan pro Million Token auf 4 Yuan.
Nach Ansicht von Jiang Han handelt es sich bei der jüngsten Preisanpassung von DeepSeek nicht nur um eine Preissenkung im allgemeinen Sinne, sondern sie berücksichtigt auch die Notwendigkeit, die Rechenleistung anzupassen. Die Aufrechterhaltung höherer Preise während der Hauptverkehrszeiten an Wochentagen und niedrigerer Preise an Wochenenden und anderen Leerlaufzeiten kann dazu führen, dass einige Aufgaben, die keine hohe Pünktlichkeit erfordern, außerhalb der Hauptverkehrszeiten ausgeführt werden und die Auslastungseffizienz der Rechenressourcen verbessert wird. Als DeepSeek im August die Spitzen- und Talpreise einführte, gab es auch an, dass dieser Schritt eine vernünftigere Ressourcenzuteilung bezwecke.
Am Tag vor der Preisanpassung startete DeepSeek auch den Test der Flash-Zwischenversion V4.1, die laut offiziellen Angaben leistungsfähiger, schneller und kostengünstiger sei. Das Unternehmen erklärte jedoch nicht, ob die neue Version in direktem Zusammenhang mit dieser Preissenkung stand, und gab auch nicht bekannt, dass die Preisanpassung hauptsächlich auf Verbesserungen der Modelleffizienz, des Marktwettbewerbs oder von Nachfrageänderungen zurückzuführen war.
Engineering-Fähigkeiten werden zu einem neuen Test
Diese Erweiterung erfolgte, nachdem DeepSeek nacheinander V4 Flash, V4 Pro und Harness aktualisiert hatte. Mit der Zunahme der Modellentwicklung, der Agentenumgebung und der Online-Anfragen müssen Unternehmen nicht nur das Modell selbst, sondern auch Forschungsplattformen, APIs, Datentechnik, Sandboxes und elastisches Computing pflegen.
Jiang Han glaubt, dass die bemerkenswerten aktuellen Änderungen in DeepSeek nicht nur die Iteration einer einzelnen Modellfähigkeit sind, sondern auch den Aufbau einer Back-End-Infrastruktur und Agentenplattformen umfassen. Nach der Erweiterung der Anmeldezahlen wird es in der nächsten Phase des Tests darum gehen, ob die technischen Fähigkeiten mit der Zunahme des Aufgabenvolumens und der Systemkomplexität Schritt halten und sich letztendlich in stabile und kosteneffektive Servicefähigkeiten umsetzen lassen.
Kommentare