About this role
Build and own AI systems for judgment-heavy insurance work by shipping agentic workflows end-to-end, extending a durable-execution backbone, and maintaining evaluation and observability infrastructure for LLM behavior while operating production event and data substrates.
Skills for this role
Agentic workflowsDurable-execution enginesPinned worker versioningReplay-compatibilityDeterministic corpus testsEval suitesCharacterization corporaLLM tracingToken/cost observabilityPrompt engineeringTool definitionsEvent busSchema-governed domain eventsObject storageOLTP databasesOLAP databasesFrontier coding agentsLLM agent systemsTool-calling patternsMCPAnthropic SDKStrictly-typed codebasesAPI designData contractsAuthorization boundariesObservabilityPub/SubSchema registryAvroProtobuf''Eval frameworks''LLM observability''Data lake engineering''Data-wa