forked from rook/rook
This commit is a large refactor on how the operator starts, stops and how it starts various sub-components such as the ceph-csi driver. It also refines the way we cancel orchestrations. We don't use breakpoints anymore but send our self a SIGUP to reload our controller runtime manager. The reload will happen under different circonstances like: * a new adminission controller secret is created/deleted/changed * a CephCluster CR is edited As mentioned earlier, the csi driver now has its own controller, just like flex. It reacts to change in the operator config map for particular ROOK_CSI_ fields. A second new controller for the operator's general config has been created, it manages: * the logging level * the ceph CLI command timeout * the discovery daemon The operator reacts much more rapidly to cancellation events by stopping the manager's context and reloading it. Signed-off-by: Sébastien Han <seb@redhat.com>
173 lines
6.1 KiB
Go
173 lines
6.1 KiB
Go
/*
|
|
Copyright 2021 The Rook Authors. All rights reserved.
|
|
|
|
Licensed under the Apache License, Version 2.0 (the "License");
|
|
you may not use this file except in compliance with the License.
|
|
You may obtain a copy of the License at
|
|
|
|
http://www.apache.org/licenses/LICENSE-2.0
|
|
|
|
Unless required by applicable law or agreed to in writing, software
|
|
distributed under the License is distributed on an "AS IS" BASIS,
|
|
WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
|
|
See the License for the specific language governing permissions and
|
|
limitations under the License.
|
|
*/
|
|
|
|
package operator
|
|
|
|
import (
|
|
"context"
|
|
"strings"
|
|
|
|
"sigs.k8s.io/controller-runtime/pkg/client"
|
|
"sigs.k8s.io/controller-runtime/pkg/controller"
|
|
"sigs.k8s.io/controller-runtime/pkg/handler"
|
|
"sigs.k8s.io/controller-runtime/pkg/manager"
|
|
"sigs.k8s.io/controller-runtime/pkg/reconcile"
|
|
"sigs.k8s.io/controller-runtime/pkg/source"
|
|
|
|
"github.com/coreos/pkg/capnslog"
|
|
"github.com/pkg/errors"
|
|
"github.com/rook/rook/pkg/clusterd"
|
|
opcontroller "github.com/rook/rook/pkg/operator/ceph/controller"
|
|
"github.com/rook/rook/pkg/operator/discover"
|
|
"github.com/rook/rook/pkg/operator/k8sutil"
|
|
v1 "k8s.io/api/core/v1"
|
|
kerrors "k8s.io/apimachinery/pkg/api/errors"
|
|
metav1 "k8s.io/apimachinery/pkg/apis/meta/v1"
|
|
)
|
|
|
|
const (
|
|
controllerName = "rook-ceph-operator-config-controller"
|
|
)
|
|
|
|
// ReconcileConfig reconciles a Ceph Operator config
|
|
type ReconcileConfig struct {
|
|
client client.Client
|
|
context *clusterd.Context
|
|
config opcontroller.OperatorConfig
|
|
opManagerContext context.Context
|
|
}
|
|
|
|
// Add creates a new Operator configuration Controller and adds it to the Manager. The Manager will set fields on the Controller
|
|
// and Start it when the Manager is Started.
|
|
func Add(mgr manager.Manager, context *clusterd.Context, opManagerContext context.Context, opConfig opcontroller.OperatorConfig) error {
|
|
return add(mgr, newReconciler(mgr, context, opManagerContext, opConfig))
|
|
}
|
|
|
|
// newReconciler returns a new reconcile.Reconciler
|
|
func newReconciler(mgr manager.Manager, context *clusterd.Context, opManagerContext context.Context, config opcontroller.OperatorConfig) reconcile.Reconciler {
|
|
return &ReconcileConfig{
|
|
client: mgr.GetClient(),
|
|
context: context,
|
|
config: config,
|
|
opManagerContext: opManagerContext,
|
|
}
|
|
}
|
|
|
|
func add(mgr manager.Manager, r reconcile.Reconciler) error {
|
|
// Create a new controller
|
|
c, err := controller.New(controllerName, mgr, controller.Options{Reconciler: r})
|
|
if err != nil {
|
|
return err
|
|
}
|
|
logger.Infof("%s successfully started", controllerName)
|
|
|
|
// Watch for ConfigMap (operator config)
|
|
err = c.Watch(&source.Kind{
|
|
Type: &v1.ConfigMap{TypeMeta: metav1.TypeMeta{Kind: "ConfigMap", APIVersion: v1.SchemeGroupVersion.String()}}}, &handler.EnqueueRequestForObject{}, predicateController(mgr.GetClient()))
|
|
if err != nil {
|
|
return err
|
|
}
|
|
|
|
// Watch for Secret (admission controller secret)
|
|
err = c.Watch(&source.Kind{
|
|
Type: &v1.Secret{TypeMeta: metav1.TypeMeta{Kind: "Secret", APIVersion: v1.SchemeGroupVersion.String()}}}, &handler.EnqueueRequestForObject{}, predicateController(mgr.GetClient()))
|
|
if err != nil {
|
|
return err
|
|
}
|
|
|
|
return nil
|
|
}
|
|
|
|
// Reconcile reads that state of the cluster for a CephClient object and makes changes based on the state read
|
|
// and what is in the CephClient.Spec
|
|
// The Controller will requeue the Request to be processed again if the returned error is non-nil or
|
|
// Result.Requeue is true, otherwise upon completion it will remove the work from the queue.
|
|
func (r *ReconcileConfig) Reconcile(context context.Context, request reconcile.Request) (reconcile.Result, error) {
|
|
// workaround because the rook logging mechanism is not compatible with the controller-runtime logging interface
|
|
reconcileResponse, err := r.reconcile(request)
|
|
if err != nil {
|
|
logger.Errorf("failed to reconcile %v", err)
|
|
}
|
|
|
|
return reconcileResponse, err
|
|
}
|
|
|
|
func (r *ReconcileConfig) reconcile(request reconcile.Request) (reconcile.Result, error) {
|
|
// Fetch the operator's configmap
|
|
opConfig := &v1.ConfigMap{}
|
|
logger.Debugf("reconciling %s", request.NamespacedName)
|
|
err := r.client.Get(r.opManagerContext, request.NamespacedName, opConfig)
|
|
if err != nil {
|
|
if kerrors.IsNotFound(err) {
|
|
logger.Debug("operator's configmap resource not found. will use default value or env var.")
|
|
} else {
|
|
// Error reading the object - requeue the request.
|
|
return opcontroller.ImmediateRetryResult, errors.Wrap(err, "failed to get operator's configmap")
|
|
}
|
|
} else {
|
|
// Populate the operator's config
|
|
r.config.Parameters = opConfig.Data
|
|
}
|
|
|
|
// Reconcile Ceph CLI timeout, since the clusterd context is passed to by pointer to all CRD
|
|
// controllers they will receive the update
|
|
opcontroller.SetCephCommandsTimeout(r.config.Parameters)
|
|
|
|
// Reconcile Operator's logging level
|
|
err = reconcileOperatorLogLevel(opConfig.Data)
|
|
if err != nil {
|
|
return opcontroller.ImmediateRetryResult, err
|
|
}
|
|
|
|
// Reconcile discovery daemon
|
|
err = r.reconcileDiscoveryDaemon()
|
|
if err != nil {
|
|
return opcontroller.ImmediateRetryResult, err
|
|
}
|
|
|
|
// Reconcile webhook secret
|
|
// This is done in the predicate function
|
|
|
|
logger.Infof("%s done reconciling", controllerName)
|
|
return reconcile.Result{}, nil
|
|
}
|
|
|
|
func reconcileOperatorLogLevel(data map[string]string) error {
|
|
rookLogLevel := k8sutil.GetValue(data, "ROOK_LOG_LEVEL", "INFO")
|
|
logLevel, err := capnslog.ParseLevel(strings.ToUpper(rookLogLevel))
|
|
if err != nil {
|
|
return errors.Wrapf(err, "failed to load ROOK_LOG_LEVEL %q.", rookLogLevel)
|
|
}
|
|
|
|
capnslog.SetGlobalLogLevel(logLevel)
|
|
return nil
|
|
}
|
|
|
|
func (r *ReconcileConfig) reconcileDiscoveryDaemon() error {
|
|
rookDiscover := discover.New(r.context.Clientset)
|
|
if opcontroller.DiscoveryDaemonEnabled(r.config.Parameters) {
|
|
if err := rookDiscover.Start(r.opManagerContext, r.config.OperatorNamespace, r.config.Image, r.config.ServiceAccount, true); err != nil {
|
|
return errors.Wrap(err, "failed to start device discovery daemonset")
|
|
}
|
|
} else {
|
|
if err := rookDiscover.Stop(r.opManagerContext, r.config.OperatorNamespace); err != nil {
|
|
return errors.Wrap(err, "failed to stop device discovery daemonset")
|
|
}
|
|
}
|
|
|
|
return nil
|
|
}
|