Tag: #2026-03
Writing on GPUs, LLMs, MLOps, Kubernetes — and mindset · 765 posts
Essential English Expressions for Tech Meetings — From Standups to Incident Response
A comprehensive guide to essential English expressions for tech meetings. Covers standups, sprint planning, code reviews, architecture discussions, and incident response with practical templates.
2026-03-09 · 18 min read #english#tech-meeting#business-english#communication#2026-03Morning English Podcast: Handling Scope Creep Politely
Practice English expressions for protecting schedules and relationships when project scope expands, in a podcast format.
2026-03-09 · 4 min read #english#podcast#business-english#scope-creep#communicationCross-Team Collaboration English Expression Guide: Effective Communication with Other Teams
A comprehensive guide to cross-team collaboration English expressions for engineers. Covers kickoff meetings, dependency coordination, blocker escalation, shared API contracts, release synchronization, and conflict resol
2026-03-09 · 19 min read #english#cross-team#collaboration#communication#business-englishCassandra Distributed Wide-Column Database Operations Guide
A comprehensive operations guide for Apache Cassandra distributed wide-column database, covering data modeling, cluster management, and performance tuning.
2026-03-09 · 28 min read #database#cassandra#distributed-database#wide-column#nosqlTimescaleDB Time Series Database Operations Guide
A practical operations guide for TimescaleDB time series database, covering hypertable design, continuous aggregates, compression, and retention policies.
2026-03-09 · 16 min read #database#timescaledb#time-series#postgresql#2026-03Practical Guide to Chaos Engineering: Fault Injection and Resilience Validation in Kubernetes with Litmus and Chaos Mesh
A comprehensive guide to applying Chaos Engineering in Kubernetes environments. Covers architecture comparison of Litmus and Chaos Mesh, ChaosExperiment design, Pod/Network/IO fault injection, GameDay operational process
2026-03-09 · 17 min read #devops#chaos-engineering#litmus#chaos-mesh#kubernetesGitHub Actions Advanced CI/CD Workflows — Matrix Builds, Reusable Workflows, Self-hosted Runners
A comprehensive guide to advanced GitHub Actions CI/CD workflows including matrix builds, reusable workflows, self-hosted runner configuration, caching strategies, and secret management with practical examples.
2026-03-09 · 18 min read #devops#github-actions#ci-cd#workflow#2026-03Slack Bot Building Practical Guide — Python Bolt SDK, Event Handling, Slash Commands
A comprehensive guide to building Slack Bots with Python Bolt SDK, covering app setup, event handling, slash commands, modals, Block Kit, and deployment with practical code.
2026-03-09 · 23 min read #chatbot#slack-bot#python#bolt-sdk#automationChatbot Memory Architecture: Building Personalized Conversation Systems with Long-Term Memory and User Profiles
Comprehensive guide to chatbot memory architecture design. Covers conversation memory types, long-term memory store design, user profile personalization, MemGPT architecture, memory retrieval optimization, privacy consid
2026-03-09 · 29 min read #chatbot#memory-architecture#personalization#long-term-memory#conversation-historyCircuit Breaker and Resilience Patterns Practical Guide — Resilience4j, Istio, Fault Isolation Strategies
A comprehensive guide to implementing resilience patterns including Circuit Breaker, Bulkhead, Retry, and Rate Limiter with Resilience4j and Istio, complete with practical code examples.
2026-03-09 · 17 min read #architecture#circuit-breaker#resilience4j#istio#fault-toleranceMicroservices Data Synchronization with the Outbox Pattern and CDC: A Practical Debezium Guide
A comprehensive guide to microservices data synchronization using the Outbox Pattern and CDC (Change Data Capture). Covers Dual Write problem analysis, Outbox table design, Debezium connector configuration, Kafka Connect
2026-03-09 · 20 min read #architecture#outbox-pattern#cdc#debezium#microservicesFlashAttention Paper Analysis: Revolutionizing Transformer Training and Inference with IO-Aware Exact Attention
An in-depth analysis of the FlashAttention series (v1 through v3). Covers the tiling strategy of the IO-aware algorithm, GPU SRAM/HBM memory hierarchy utilization, backward pass recomputation, parallelism improvements in
2026-03-09 · 22 min read #ai-papers#flash-attention#transformer#gpu-optimization#attention-mechanismDPO (Direct Preference Optimization) Paper Deep Analysis — LLM Alignment Without RLHF
From mathematical principles of DPO to implementation, comparison with RLHF, and variants like IPO/KTO/ORPO — an in-depth analysis of LLM preference optimization from a practical perspective.
2026-03-09 · 20 min read #ai-papers#dpo#rlhf#llm-alignment#preference-optimizationRay Serve Model Serving Platform Building Guide — Autoscaling, Multi-Model, and Production Deployment
A comprehensive overview of Ray Serve architecture, LLM model serving deployment, autoscaling, multi-model patterns, and KubeRay operations with practical code examples.
2026-03-09 · 26 min read #ai-platform#ray-serve#model-serving#kuberay#mlopsComparing LLM Production Monitoring Platforms: A Practical Operations Guide for LangSmith, LangFuse, and Arize Phoenix
A comprehensive comparison guide of three LLM production monitoring platforms (LangSmith, LangFuse, Arize Phoenix). Covers trace collection, prompt version management, evaluation pipelines, cost monitoring, quality dashb
2026-03-09 · 23 min read #ai-platform#llm-monitoring#langsmith#langfuse#arizeObservability Data Pipeline Cost Optimization: Sampling, Filtering, and Tiering Strategies
A strategy guide for solving cost issues from observability data explosion. Covers OpenTelemetry Collector-based sampling policies, log filtering pipelines, metric cardinality management, storage tiering architecture, an
2026-03-08 · 25 min read #observability#cost-optimization#sampling#opentelemetry#telemetry-pipelineLLM Routing and Cascade Strategy: Cost Optimization with Multi-Model Orchestration
Covers how to optimize cost with LLM routing and cascade strategies. Builds everything from query-complexity routing, model cascades, semantic routers and the FrugalGPT approach through to a production multi-model orches
2026-03-08 · 26 min read #llm#routing#cascade#model-orchestration#cost-optimizationTurning Fun Psychology Tests into Self-Awareness: A Practical Playbook
A practical guide for turning popular workplace psychology tests from mere entertainment into genuine self-awareness and improved team communication.
2026-03-08 · 15 min read #psychology#self-awareness#habit#communication#historyTax Basics for Korean Office Workers: Year-End Settlement Operational Guide
An operational guide covering common mistakes in Korean year-end tax settlement, frequently missed deductions, a month-by-month preparation checklist, and document management routines.
2026-03-08 · 13 min read #finance#tax#year-end-settlement#korea#office-workerAlgorithmic Trading System Architecture with Python
A comprehensive guide to building algorithmic trading system architecture with Python, covering system design, order management, and risk controls.
2026-03-08 · 46 min read #finance#algorithmic-trading#python#backtesting#quantitative-finance