رفتن به محتوای اصلی

Pedram Sarani

یادداشت‌های SRE و DevOps

مقاله‌ها
2
نکته‌های سریع
2
مسیرهای یادگیری
1

یادداشت‌های عملیاتی SRE و DevOps

دفترچه‌ای عملیاتی برای پایداری سرویس‌ها، GitOps و زیرساخت Kubernetes.

اینجا درباره اداره سیستم‌های production می‌نویسم: رفتار Kubernetes، طراحی Helm و Argo CD، ساختار GitLab CI/CD، Linux internals، Observability، backup و Incident Management.

نکته‌های سریع

یادداشت‌های کوتاه برای نکته‌هایی که سریع به کار می‌آیند؛ از دستورهای عیب‌یابی تا جزئیات کوچک Kubernetes و Linux.

همه نکته‌ها

تازه‌ترین مقاله‌ها

همه مقاله‌ها

هسته CPU را سریع‌تر نمی‌کند؛ فقط زمان را سهمیه‌بندی می‌کند

از CFS و EEVDF تا cpu.weight، cpu.max، throttling و PSI؛ این مقاله توضیح می‌دهد چرا در کوبرنتیز، CPU بیشتر همیشه برنامه را سریع‌تر نمی‌کند، limit چطور به سهمیه زمانی تبدیل می‌شود و چرا یک پاد با میانگین مصرف پایین هم ممکن است throttle شود.

مشاهده مقاله

مسیرهای یادگیری

مسیرهایی عملی برای دنبال کردن یک مسئله از مدل ذهنی تا تصمیم‌های production؛ از capacity planning و ایمنی release تا troubleshooting و Observability.

همه مسیرها

محورهای محتوایی سایت

محتوای این سایت درباره چیزهایی است که در کار واقعی SRE و DevOps به هم وصل می‌شوند: Linux، Kubernetes، CI/CD، GitOps و Observability. هر مطلب سعی می‌کند یک مشکل production را ساده کند؛ از اینکه سیستم چرا این‌طور رفتار می‌کند تا اینکه چطور باید آن را دید، تغییر داد و عیب‌یابی کرد.

زیر پوست Linux

از process و memory تا cgroup، scheduler و network؛ پایه‌هایی که وقتی سرویس یا کلاستر عجیب رفتار می‌کند، جواب خیلی وقت‌ها همان‌جاست.

Kubernetes در production

درباره workloadها، kubelet، resource pressure، eviction، scheduling و backup؛ چیزهایی که پایداری کلاستر را در عمل می‌سازند یا خراب می‌کنند.

از release تا عیب‌یابی

درباره CI/CD، Helm، Argo CD، rollout، rollback، log، metric و trace؛ یعنی چطور تغییر را امن جلو ببریم و وقتی مشکل پیش آمد، علت را پیدا کنیم.