About this role
Develop, train, fine-tune and evaluate multilingual, multicultural and multimodal foundation LLMs and build large-scale data and training pipelines. This hosted NTU position involves distributed model training, evaluation, deployment engineering and collaboration with research and industry partners.
Skills for this role
PythonSoftware engineeringGitTestingDocumentationCode reviewPyTorchHugging Face TransformersHugging Face DatasetsHugging Face TokenizersAccelerateTRLLLM pre-trainingContinued pre-trainingFine-tuningInstruction tuningPreference optimisationModel adaptationMultilingual NLPLow-resource language handlingCode-switchingTokenisationDataset creationData pipeline developmentDistributed trainingGPU-based trainingCheckpointingExperiment trackingTraining monitoringDebugging