Résumé :
DeepSeek, connu pour sa « petite équipe et sa forte densité de talents », a commencé à recruter du personnel d'ingénierie à grande échelle. Dans la soirée du 7 septembre, Cui Tianyi, le chef de l'équipe DeepSeek Harness, a publiquement recruté sur les plateformes sociales, libérant environ 150 places à la fois. Il a déclaré qu'il s'agissait d'une « demande de recrutement sans précédent pour 150 HC » et que l'entreprise avait actuellement « de nombreuses nouvelles orientations, de nouveaux systèmes et de nouveaux besoins qui doivent être pris en compte ».

Capture d'écran du message de Cui Tianyi
Deux jours plus tard, DeepSeek a annoncé une réduction du prix de l'API de la série Flash, le prix d'entrée du cache atteignant jusqu'à 60 %. Par rapport aux changements de prix, ce recrutement reflète mieux les changements auxquels DeepSeek est confronté à mesure que son activité se développe.
150 places sont concentrées dans les postes d'ingénieurs
Cette vague de recrutement se concentre sur des ingénieurs seniors possédant 2 à 10 ans d'expérience professionnelle. Il accepte également les nouveaux diplômés et les candidats ayant travaillé moins de deux ans. Le lieu de travail est principalement Pékin et certains postes peuvent être sélectionnés à Hangzhou.
Les postes sont principalement divisés en deux séquences : développement de serveurs et calcul élastique d'agent. Les ingénieurs de développement côté serveur couvrent six directions : plate-forme de recherche de grands modèles, composants du framework d'agent, infrastructure d'efficacité R&D, API DeepSeek, services en ligne et ingénierie des données ; Les ingénieurs R&D en calcul élastique agent sont divisés en deux directions : le développement et la maintenance de la plate-forme, le réglage sous-jacent et l'attaque.
Il s'agit de la deuxième extension d'inscription à grande échelle de DeepSeek en plus de deux mois. Le 25 juin, la société a proposé de « au moins doubler la taille » de tous les départements, avec un recrutement couvrant plusieurs catégories telles que le développement full-stack et les algorithmes, la recherche et le développement du système central d'IA, l'exploitation et la maintenance, les produits, la stratégie de données de modèle, la recherche en apprentissage profond et les départements fonctionnels.
Par rapport au recrutement global de juin, les quelque 150 places cette fois sont principalement allouées aux systèmes back-end, aux API et à l'infrastructure d'agent, et il n'y a pas de postes de recherche modèles.
Pour être plus précis, il s'agit d'une extension spéciale pour les systèmes d'ingénierie.
Les exigences en matière d'expérience du personnel ont également changé. DeepSeek est connu pour employer un grand nombre de nouveaux diplômés et de jeunes chercheurs dans le passé. Liang Wenfeng a précédemment déclaré que la plupart des postes techniques de base de l'entreprise sont occupés par de nouveaux diplômés ou des employés n'ayant qu'un ou deux ans d'expérience professionnelle. Ce recrutement s'adresse à des ingénieurs seniors ayant 2 à 10 ans d'expérience.
Cui Tianyi a expliqué que le « volume » auquel DeepSeek est actuellement confronté augmente rapidement, notamment la quantité de données, le nombre de machines et de conteneurs, les tâches de formation et d'évaluation, l'environnement de l'agent, les utilisateurs et le volume des demandes. À mesure que l’échelle augmente, la complexité du système augmentera également considérablement. Le système back-end d'origine peut ne pas être en mesure de continuer à répondre aux besoins, il doit donc être mis à niveau, maintenu ou même réécrit.
Les informations de recrutement ont également révélé que la plate-forme informatique élastique Agent de DeepSeek, DSec, a hébergé « des milliers d'environnements sandbox » pour promouvoir l'itération de modèles de nouvelle génération. Lorsque les agents effectuent des tâches, ils doivent généralement appeler des modèles et des outils plusieurs fois et continuent d'occuper les environnements informatiques, de stockage et d'exploitation. À mesure que les tâches augmentent, la planification des ressources, l’isolation de l’environnement, la récupération après panne et la stabilité de la concurrence deviendront des problèmes d’ingénierie spécifiques.
Jiang Han, chercheur principal au Pangu Think Tank, a déclaré à Caiwen que cette expansion du recrutement montre que DeepSeek passe d'une étape entrepreneuriale axée sur la recherche de modèles à une nouvelle étape qui nécessite le traitement simultané des demandes des utilisateurs, la planification de la puissance de calcul et la construction de systèmes complexes. Le nouveau personnel peut compléter l'infrastructure back-end et les capacités de la plateforme d'agents, mais une expansion rapide peut également diluer l'efficacité initiale de la collaboration en petite équipe et imposer des exigences plus élevées en matière de gestion et d'exécution organisationnelles.
La réduction des prix est une correction partielle après l'augmentation des prix en août
Le 9 septembre, DeepSeek a annoncé qu'il ajusterait le prix de l'API de la série Flash à partir de midi le 10 septembre.
Pendant la période d'inactivité, le prix d'entrée du cache par million de jetons est passé de 0,05 yuan à 0,02 yuan, soit une baisse de 60 % ; le prix des intrants manquants dans le cache a chuté de 1,5 yuan à 1 yuan, soit une baisse d'environ 33 % ; le prix à la production est passé de 4,5 yuans à 4 yuans, soit une baisse d'environ 11 %. Les jours de semaine de 9h00 à 12h00 et de 14h00 à 18h00 sont toujours des heures de pointe, et le prix est le double de celui de la période d'inactivité ; le tarif période d'inactivité est appliqué toute la journée du samedi et du dimanche.
La « réduction de prix allant jusqu'à 60 % » s'applique uniquement aux entrées d'accès au cache et ne signifie pas que le coût global des appels pour tous les utilisateurs sera réduit de 60 %. La diminution réelle dépend du taux de réussite du cache, du ratio de jetons d'entrée et de sortie et de la période d'appel.
Cet ajustement de prix intervient moins d'un mois après la dernière augmentation de prix de DeepSeek. Par rapport à avant l'augmentation des prix en août, après cet ajustement, le prix inactif des entrées aléatoires du cache Flash est essentiellement revenu au niveau précédent, mais le prix à la sortie est toujours passé de 2 yuans par million de jetons à 4 yuans.
De l'avis de Jiang Han, le récent ajustement des prix de DeepSeek n'est pas seulement une réduction de prix au sens général, mais prend également en compte la nécessité d'ajuster la puissance de calcul. Le maintien de prix plus élevés pendant les heures de pointe en semaine et de prix plus bas le week-end et autres périodes d'inactivité peut guider certaines tâches qui ne nécessitent pas une grande rapidité pour s'exécuter aux heures creuses et améliorer l'efficacité d'utilisation des ressources informatiques. Lorsque DeepSeek a lancé la tarification de pointe et de vallée en août, il a également déclaré que cette décision visait à allouer les ressources de manière plus raisonnable.
La veille de l'ajustement des prix, DeepSeek a également lancé le test de la version intermédiaire V4.1 Flash, qui, selon les responsables, était plus performante, plus rapide et moins coûteuse. Cependant, la société n'a pas expliqué si la nouvelle version était directement liée à cette réduction de prix, ni révélé que l'ajustement des prix était principalement dû à des améliorations de l'efficacité du modèle, à la concurrence sur le marché ou à des changements dans la demande.
Les capacités d'ingénierie deviennent un nouveau test
Cette extension s'est produite après que DeepSeek ait mis à jour successivement V4 Flash, V4 Pro et Harness. Avec l'augmentation du développement de modèles, de l'environnement d'agent et des demandes en ligne, les systèmes que les entreprises doivent maintenir incluent non seulement le modèle lui-même, mais également les plateformes de recherche, les API, l'ingénierie des données, les bacs à sable et l'informatique élastique.
Jiang Han estime que les changements remarquables actuels dans DeepSeek ne sont pas seulement l'itération d'une capacité de modèle unique, mais incluent également la construction d'une infrastructure back-end et de plates-formes d'agent. Après l'augmentation des inscriptions, la prochaine étape du test consistera à déterminer si les capacités d'ingénierie peuvent suivre l'augmentation du volume des tâches et de la complexité du système, et finalement se traduire par des capacités de service stables et rentables.
Commentaires