Skip to content

EMQX 5.10 の既知の問題 ​

5.10.2 ​

バージョン問題回避策ステータス
5.1.0クラスターに新しいコアノードが追加された際にレプリカントノードが起動時にハングする可能性がある
クラスター変更で新しいコアノードを追加する場合、追加されたコアノードがレプリカントノードに必要なレプリケーション関連プロセスの起動に失敗することがあります。これにより、アップグレードまたは新規追加されたレプリカントノードが起動時にハングすることがありました。
Kubernetes環境では、レディネスプローブの失敗によりコントローラーがレプリカントポッドを繰り返し再起動する事象が発生しました。
この問題は、既存の2コア+2レプリカントのクラスターに対し、新しいEMQXバージョンの2つのコアノードと2つのレプリカントを追加するアップグレードロールアウト時に典型的に発生します。
(再)デプロイ後に1つ以上のレプリカントノードが起動時にハングした場合、レプリカントの起動が完了するまで新しく追加されたコアノードを1台ずつ強制的に再起動することを検討してください。5.10.3、6.0.1で修正済み
5.7.0クラスターリンクのガベージコレクションがアクティブルートを削除する可能性がある
複数の独立したクラスターリンクを構成し、一部のリンクが比較的長期間ダウンしたままの場合、ガベージコレクション処理が誤って内部ルーティングテーブルからアクティブルートを削除することがあります。これにより、影響を受けたクラスターリンクはメッセージの一部のみを転送したり、メッセージ転送を完全に停止したりする可能性があります。
-5.10.3、6.1.0で修正済み

5.10.0 ​

バージョン問題回避策ステータス
5.0.0クラスター内でルートおよびセッションレジストリが不整合になる可能性がある
ネットワークパーティションの回復、ノードの突然のシャットダウン、クリーンアップ中のRPCタイムアウトなどのクラスターイベント後に、ルートテーブルおよびグローバルセッション(チャネル)レジストリに古いまたは欠落したエントリが残る複数の関連問題があります。具体的な症状は以下の通りです。
- レプリカントノード上のサブスクライバーのルートがネットワークパーティション回復後に完全に再同期されず、一部のサブスクリプションがメッセージを受信しなくなることがあります。影響を受けたノードの再起動までこの状態が続きます。
- レプリカントノードが所有するチャネルがパーティション回復後にグローバルレジストリから削除され、誤ったセッションテイクオーバー(再接続するクライアントが古いセッションを置き換えられない)やダッシュボードのクライアント数の誤表示が発生します。
- セッションの所有プロセスがクリーンな登録解除なしに終了した場合(例えば、登録解除のレプリケーションが妨げられた短時間のネットワーク分断後や、コアのコンセンサスチェックがダウンイベントのクリーンアップ中にタイムアウトした場合)、グローバルセッションレジストリの行が無期限にリークします。同じクライアントIDが再接続しない限り、これらの不要な行が蓄積されます。
これらの修正は5.10の後続パッチリリースおよび新しいリリースラインで適用されています。詳細はemqx/emqxのPR #17076、#17257、#17522を参照してください。
-5.10.4以降、6.1.2以降、または6.2.1以降にアップグレードしてください