もう一度読むSRE

もう一度読むSRE

By Topotal

「もう一度読むSRE」は、株式会社Topotal(トポタル)の高村と菱田がディスカッション形式で「SRE サイトリライアビリティエンジニアリング」を読み進めるポッドキャストです。

SRE を今から知りたい方はもちろん、SRE の基礎を改めて学びたい方もぜひ視聴ください。Twitter のハッシュタグは #もう一度読むSRE です。
Available on
Apple Podcasts Logo
Pocket Casts Logo
Spotify Logo
Currently playing episode

もう一度読むSRE #127 / SREをはじめよう 3章

もう一度読むSREMay 19, 2026
00:00
42:53
もう一度読むSRE #127 / SREをはじめよう 3章

もう一度読むSRE #127 / SREをはじめよう 3章

3章 SREの文化

May 19, 202642:53
もう一度読むSRE #126 / SREをはじめよう 2章

もう一度読むSRE #126 / SREをはじめよう 2章

2章SREの心構え

May 11, 202647:11
もう一度読むSRE #125 / SREをはじめよう 1章

もう一度読むSRE #125 / SREをはじめよう 1章

SREをはじめよう

1章 はじめに

Apr 21, 202637:27
もう一度読むSRE #124

もう一度読むSRE #124

34章 まとめ

Apr 07, 202625:18
もう一度読むSRE #123

もう一度読むSRE #123

33章 他の業界からの教訓

Mar 30, 202641:09
もう一度読むSRE #122

もう一度読むSRE #122

32章 進化する SREのエンゲージメントモデル ~ 32.7 まとめ

Mar 19, 202619:35
もう一度読むSRE #121

もう一度読むSRE #121

31.4 SRE外でのコラボレーションから 31.6 まとめまで

Mar 12, 202613:39
もう一度読むSRE #120

もう一度読むSRE #120

31.3 SRE内でのコラボレーションのケーススタディ:Viceroy ~ 31.3.3 推奨事項まで

Mar 05, 202626:42
もう一度読むSRE #119

もう一度読むSRE #119

31章SREにおけるコミュニケーションとコラボレーションから31.2.2 効率的な作業のための手法まで

Jan 07, 202633:10
もう一度読むSRE #118

もう一度読むSRE #118

30章 SREの投入による運用過負荷からのリカバリから30.4 まとめ

Dec 24, 202537:03
もう一度読むSRE #117

もう一度読むSRE #117

29.3.3 真剣な解決策から29.3.4.2 顧客と共に自分も尊重することまで

Dec 03, 202516:29
もう一度読むSRE #116

もう一度読むSRE #116

29 章 割り込みへの対処から29.3.2.2 時間の二極化まで

Nov 13, 202520:31
もう一度読むSRE #115

もう一度読むSRE #115

28.3 優れたリバースエンジニアリングと柔軟な思考の育成から28.6 まとめまで

Nov 05, 202523:44
もう一度読むSRE #114

もう一度読むSRE #114

第4部管理 28章 SREの成長を加速する方法:新人からオンコール担当、そしてその先へ 〜 28.2.2 単純作業ではなく、目的のはっきりしたプロジェクトの作業を受け持ってもらうこと まで

Oct 08, 202513:38
もう一度読むSRE #113

もう一度読むSRE #113

27.5 LCEの発展から27.6 まとめまで

Jun 25, 202520:01
もう一度読むSRE #112

もう一度読むSRE #112

27.2.2 収束と単純化の推進 から 27.4.4 過負荷時の挙動とロードテスト まで

Jun 11, 202531:26
もう一度読むSRE #111

もう一度読むSRE #111

27 章 大規模なプロダクトのローンチにおける信頼性 から 27.2 ローンチプロセスのセットアップ まで

Jun 04, 202540:42
もう一度読むSRE #110

もう一度読むSRE #110

26.4.2 Google Music - 2012年3月:暴走した削除の検出から26.6 まとめまで

May 28, 202540:42
もう一度読むSRE #108

もう一度読むSRE #108

26-3-6第3のレイヤーから26-3-6-2通常の処理外でのデータ検証まで

May 21, 202525:04
もう一度読むSRE #109

もう一度読むSRE #109

26.3.6 第3のレイヤー:早期の検出から26.4.1 Gmail - 2011年2月:GTapeからのリストアまで

Apr 30, 202522:43
もう一度読むSRE #107

もう一度読むSRE #107

26.3.3 第2のレイヤー:バックアップと関連するリカバリの方法 から 26.3.5 テラバイト対エクサバイト:大きい「だけ」ではなくなるバックアップ


Apr 23, 202526:18
もう一度読むSRE #106

もう一度読むSRE #106

26.3 データ完全性の課題へのGoogle SREの対処 から 26.3.2 第1のレイヤー:論理削除 まで


Apr 18, 202521:39
もう一度読むSRE #105

もう一度読むSRE #105

26.2.3 データの損失につながる障害の種類から26.2.4.2 リテンションまで

Apr 02, 202529:02
もう一度読むSRE #104

もう一度読むSRE #104

26.1.3 大局的な視点から見たクラウド環境の要件 から 26.2.2 バックアップシステムよりもリカバリのシステムを提供しよう


Mar 26, 202519:50
もう一度読むSRE #103

もう一度読むSRE #103

26章 データの完全性から26.1.2 バックアップとアーカイブまで


Mar 12, 202528:37
もう一度読むSRE #102

もう一度読むSRE #102

25.5.1 定期パイプラインにおけるモニタリングの問題 から 25.6.1 Model-View-ControllerパターンとしてのWorkflow まで

Feb 19, 202529:39
もう一度読むSRE #101-番外編

もう一度読むSRE #101-番外編

もう一度読むSRE #101で話した雑談回です。

Feb 12, 202519:52
もう一度読むSRE #101

もう一度読むSRE #101

25.3 定期的なパイプラインパターンでの課題 から 25.5 分散環境における定期パイプラインの欠点 まで

Feb 05, 202522:25
もう一度読むSRE #100

もう一度読むSRE #100

24.4.5 大規模なcronの実行 から 25.2 シンプルなパイプラインパターンでのビッグデータの

初期の効果 まで

Jan 22, 202524:07
もう一度読むSRE #99

もう一度読むSRE #99

24.4.3.3 部分的な障害の解決 から 24.4.4 状態の保存

Jan 09, 202532:45
 もう一度読むSRE #98

もう一度読むSRE #98

24.4.3 リーダーとフォロワーの役割〜24.4.3.2 フォロワーまで

Dec 18, 202426:45
もう一度読むSRE #97

もう一度読むSRE #97

24.3.2 拡張された要求から24.4.2 Paxosの利用まで

Dec 04, 202433:28
もう一度読むSRE #96

もう一度読むSRE #96

24 章 cronによる分散定期スケジューリング から 24.3.1 拡張されたインフラストラクチャ まで

Oct 30, 202434:45
もう一度読むSRE #95

もう一度読むSRE #95

23.5.3.1 クォーラムの編成 〜 23.7 まとめ

Oct 16, 202420:53
もう一度読むSRE #94

もう一度読むSRE #94

23.5.3 キャパシティとロードバランシング

Jul 27, 202434:52
もう一度読むSRE #93

もう一度読むSRE #93

23.5.2 レプリカの配置

Jul 18, 202424:46
もう一度読むSRE #92

もう一度読むSRE #92

23.5 分散合意ベースのシステムのデプロイ〜 23.5.1 レプリカ数

May 22, 202431:35
もう一度読むSRE #91

もう一度読むSRE #91

23.4.8 ディスクアクセス

Apr 24, 202424:46
もう一度読むSRE #90

もう一度読むSRE #90

23.4.5 パフォーマンスに関する考察:Fast Paxos から 23.4.7 バッチ処理 まで

Apr 10, 202425:15
もう一度読むSRE #89

もう一度読むSRE #89

23.4.2 読み取り負荷が大きいワークロードのスケーリングから23.4.4 分散合意のパフォーマンスとネットワークのレイテンシまで

Mar 27, 202430:52
もう一度読むSRE #88

もう一度読むSRE #88

23.4.1 Multi-Paxos:詳細なメッセージフロー

Mar 11, 202427:43
もう一度読むSRE #87

もう一度読むSRE #87

23.3.5 信頼性を持つ分散キュー及びメッセージング から 23.4 分散合意のパフォーマンス まで

Feb 07, 202429:43
もう一度読むSRE #86

もう一度読むSRE #86

23.3.3 リーダー選出を利用する高可用性を持つ処理 から 23.3.4 分散協調及びロックサービス まで

Jan 31, 202421:58
もう一度読むSRE #85

もう一度読むSRE #85

23.3 分散合意のためのシステムアーキテクチャパターン から 23.3.2 信頼性を持つ複製データストア及び設定ストアまで

Jan 24, 202435:10
もう一度読むSRE #84

もう一度読むSRE #84

23.2 分散合意の動作 から 23.2.1 Paxosの概要: サンプルプロトコル まで

Dec 25, 202346:16
もう一度読むSRE #83

もう一度読むSRE #83

23.1 合意を利用する目的:分散システムの協調障害 から 23.1.3 ケーススタディ 3:問題のあるグループメンバーシップアルゴリズム まで

Oct 25, 202325:37
もう一度読むSRE #82

もう一度読むSRE #82

23章 クリティカルな状態の管理: 信頼性のための分散合意

Oct 18, 202326:27
もう一度読むSRE #81

もう一度読むSRE #81

SRE NEXT 2023 Chair ぐりもおさん をゲストに迎え、SRENEXTのことをお聞きしました。

Sep 14, 202329:36
もう一度読むSRE #80

もう一度読むSRE #80

22.6 カスケード障害に対応するためにすぐに行うべき手順 から 22.7まとめまで

Aug 23, 202332:14
もう一度読むSRE #79

もう一度読むSRE #79

22.4 カスケード障害を引き起こす条件 から 22.5.3 重要度の低いバックエンドのテスト まで

Aug 17, 202327:30