タグ: SRE
「SRE」に関連する記事を表示しています。
同期TurboModuleは「速い」と思い込むな
React NativeのTurboModuleが実現する同期APIは、通信コストを下げるが、ネイティブ処理そのものは速くならない。その誤解がJSスレッドのブロッキングを生む仕組みを解説します。
コーディングエージェント急拡大が運用監視に与える影響
Codex が5ヶ月で730%成長した背景と、コーディングエージェント普及がクラウド監視・障害対応・コスト管理に与える実務的な影響を解説します。
DoorDashのRAG本番構成から学ぶ可用性設計
DoorDashのRAG本番構成を起点に、AIパイプラインのSLO設計・オブザーバビリティ・サプライチェーンセキュリティをSRE視点で解説します。
分散LLM基盤をクラウドで運用する際の監視と障害設計
Mesh LLMをクラウドで運用する際、障害の形はオンプレと根本的に変わる。分散推論・分散RAG構成で必要な監視設計と障害切り分けの考え方を整理する。
LLM時代に問われるシステム設計の本質
LLMエージェントがAPIを直接呼び出す時代、べき等性・ドメイン境界・オブザーバビリティの設計精度がSLOに直結する理由を解説します。
Netlify+MongoDB+Cloudinaryで作るペースト共有サービスの運用設計
FastAPI・MongoDB・Cloudinaryを組み合わせたPasteDBの構成を通じて、マネージドサービス活用時の監視設計・障害切り分け・外部API依存の管理を整理します。
マルチエージェントAI基盤をGCPで設計する方法
GCPのBigQuery・Vertex AI・ADKを使ったマルチエージェント基盤を、SRE視点でアーキテクチャ分析。SLO設計・障害分離・IaCの観点から解説します。
本番KYC基盤が壊れない設計:障害耐性とSLOの考え方
KYC APIの誤検知率90%超という数値を起点に、外部ベンダー依存の可用性設計・SLO定義・オブザーバビリティ・コスト最適化の考え方を解説します。
AI生成コードをインフラ視点で評価する方法
AI UIツールが生成するコードをCI/CDパイプラインに載せ、オブザーバビリティを確保し、IaCでコストを制御するための設計指針を解説します。
CI障害対応を自律ループで回す「Loop Engineering」の設計思想
CI障害の検知から分類・起票・通知までを人間不在で回す「Loop Engineering」の設計思想と、クラウド運用監視への適用可能性を解説します。
SAST・DASTをCI/CDパイプラインに組み込む設計論
SASTはコミット時点で、DASTはステージング環境で動かすフェーズ分離が、SLIのノイズ排除とMTTR短縮につながる設計論を解説します。