Tag
caching
4 articles tagged with “caching”
.d.tsA/B-testingACRAIAI-SearchAPI-gatewayAPI-providersAPMASP.NET-CoreAlertmanagerAnthropic-APIArizeAutoGenAzure-APIMAzure-OpenAIBedrockBundlerCICapitalizeClaudeCoTCopilotCosmos-DBCursorDORADefinitelyTypedDocker-HubEvent-GridFinOpsGHCRGPTGeminiGemmaGitFlowGitHubGoogle-DeepMindGroqGroupChatHPAHelmICLIstioJSONJSON-modeLLMLLM-monitoringLLM-securityLangChainLangGraphLangSmithLinkerdMCPMTEBMistralModel-Context-ProtocolNode16OIDCOTELOmitOpenAI-APIOpenTelemetryOutlinesP99PIIPII-filteringPagerDutyPartialPhiPhoenixPickPineconeQdrantRAGRAG-evaluationReActRecordSDKSLISLMSLOSemantic-KernelService-BusTC39TTFTVertex-AIWindsurfa-staragentsaggregationaiai-gatewayaksalertingalgorithmsapi-designapi-gatewayapi-versioningapimapp-routerapp-serviceappsecarchitecturearm-templatesaspnet-coreaspnetcoreassertion-functionsassertsasyncauditauthenticationauthorizationautomationazureazure-content-safetyazure-front-doorazure-functionsazure-openaiazure-policyazure-storagebatch-APIbddbenchmarksbest-practicesbfsbi-encoderbias-detectionbicepbinary-searchbranchingbstcache-componentscachingcap-theoremcapability-taggingcascadingcase-based-reasoningchain-of-thoughtchartschatbotcheckpointingchunkingci-cdci-optimizationcicdclass-decoratorclean-architecturecloudcloud-securitycloudeventscode-reviewcoding-agentscomparisoncompilerOptionscompliancecomposeconcurrencyconcurrent-renderingconditional-typesconsistencyconsistent-hashingconstrained-generationconstraintsconsumer-drivencontainer-registrycontainerscontent-moderationcontent-safetycontextcontext-compressioncontext-windowcontract-testingconversational-agentscosmos-dbcost-allocationcost-controlcost-optimizationcost-performancecoveragecqrscross-sessioncsharpcvecypressdapperdashboardsdastdata-fetchingdatabasesdataloaderddddecision-frameworkdeclaration-filesdecoratorsdependency-injectiondependency-scanningdeployment-slotsdeploymentsdeprecationdesign-patternsdevopsdfsdijkstradiscriminated-unionsdistributed-tracingdistributivedockerdocumentationdotnetdotnet-9drift-detectiondynamic-discoverydynamic-programminge2e-testingef-coreef-core-9embeddingsengineeringenvironmentsepisodic-memoryerror-budgetevaluationevent-drivenevent-gridevent-hubseventingexamplesexperience-replayexperimentalDecoratorsfactualityfail-fastfeature-flagsfederationfew-shotfiberfine-tuningflaky-testsflex-consumptionfrontendfunction-callinggen-ai-semantic-conventionsgenericsgitgithub-actionsgoal-decompositiongolden-signalsgpt-4ogrammargraphgraphqlgroundinggrpcguardrailshallucination-detectionharmful-contenthclhealth-checksheaphookshotchocolatehttphttp2http3hybridcacheiacidempotencyidentityimage-scanningin-context-learningincident-responseindexesinferinferenceinfrastructureinput-validationintegrationintegration-testingintrosortinvariantisolationjailbreakjestjoinsjotaijsonbjwtk8skey-remappingkey-vaultkiotaknapsackknowledge-basekuberneteslanguagelatencylegacy-codelinqload-balancinglong-term-memorylost-in-the-middlelower-boundmTLSmanaged-identitymapped-typesmaterialized-viewsmemoizationmemorymemory-consolidationmergemessage-queuemessagingmetadatametricsmicroservicesmicrosoftminimal-apismockingmocksmodel-routingmoderationmodule-augmentationmodule-resolutionmodulesmongodbmonitoringmswmulti-agentmulti-stage-buildsmulti-tenantmultimodalmvccnarrowingnetwork-securitynextjs-16normalizationnosqloauthoauth2observabilityoidcon-callonline-evalsopaopen-sourceopenapiorchestrationoutput-formatoutput-validationowasppaaspackage-exportspactpactflowpage-objectsparsingpartitioningpathspattern-matchingperformancepersonal-AIpgvectorpineconepipelineplanningplaywrightpluginspolicy-as-codepollypostgresqlpricingproductionproduction-monitoringproject-referencesprompt-designprompt-engineeringprompt-injectionprotobufpulumipythonqualityquality-gatesquality-scorequantizationqueuesragrate-limitingreactreact-19react-compilerreact-internalsreact-queryreact-server-componentsrealtimereasoningrecursionrecursive-typesred-blackred-green-refactorred-teamingredisregression-testingrelease-managementreplanningresource-limitsrestreusable-workflowsrlsrolling-updatesruntime-safetysaga-patternsastsbomscaleschemaschema-designschema-validationsdlcsecrets-managementsecuritysecurity-testingself-consistencysemantic-similarityserializableserver-actionsserverlessservice-busservice-meshshardingshortest-pathsidecar-proxysignalrsnapshot-testingsoftware-designsortingspiessqlstabilitystate-graphstate-managementstreamingstreamsstrict-modestridestring-typesstructured-outputstubssummarisationsupertestsupply-chainsystem-designtail-calltanstack-querytask-framingtddtemplate-literalstemplatesterraformtest-architecturetest-doublestest-pyramidtestcontainerstestingtesting-patternstesting-strategythreat-modelingtoken-buckettoken-budgettoken-economicstoken-limittoken-maskingtoken-trackingtokenstokens-per-secondtool-callingtool-registrytool-usetopological-sorttoxicitytracingtrajectorytransactionstreestrietrunk-basedtsconfigtype-guardstype-narrowingtype-predicatestype-safe-routestype-systemtype-transformstypestypescriptunit-testingusage-metricsuser-feedbackutility-typesvalidationvalkeyvaluesvaultvector-dbvector-searchvector-storevendor-neutralversion-controlversioningvisual-regressionvitestvulnerabilitiesweaviateweb-apiweb-securitywebsocketswindow-functionswiremockworking-memoryworkload-identityworkspacesxunityarpzero-shotzero-trustzodzustand
AI Engineering
The AI Gateway Pattern: Why Every Production LLM Needs One
Intermediate
API Management, rate limiting, semantic caching, and cost control with Azure APIM as an AI Gateway.
10 min
Read →AI Engineering
Token Economics: Understanding and Optimizing LLM Costs
A practical guide to understanding token pricing, measuring real costs, and implementing optimization strategies — caching, prompt compression, model routing.
10 min
Read →System Design
Caching in 2026: Cache-Aside, HybridCache, and the Four Failure Modes
Intermediate
Cache-aside vs write-through, .NET 9 HybridCache (L1+L2 with stampede protection), TTL design with jitter, and the four ways caches actually fail in production.
13 min
Read →Databases
Redis 8 / Valkey in 2026: HybridCache, Streams, and Distributed Locks
Intermediate
Redis 8 SSPL/RSALv2 + Valkey LF fork, Azure Cache Enterprise, .NET 9 HybridCache (L1+L2 + stampede protection), atomic rate limit, SET NX EX + Lua compare-and-delete locks, Streams + consumer groups, sorted-set leaderboards, TTL jitter.
14 min
Read →
