DROP_MODEL(model_name)
功能:删除模型。
参数说明:
² model_name:待删除模型的名称.
示例:删除名为kmeans_cust_model的模型。
gccli>call UPEXTDB. DROP_MODEL('kmeans_cust_model');
SHOW_MODELS()
功能:显示所有已存在的模型。
示例:显示模型。
gccli>call UPEXTDB. SHOW_MODELS();
+--------------------+
| model_name |
+--------------------+
| naiveBayes_model |
| gbt_model |
| randomForest_model |
| kmeans_cust_model |
+--------------------+
SHOW_MODEL(model_name)
功能:显示模型的详细信息。
参数说明:
² model_name:模型的名称。
示例:显示kmeans_cust_model模型的信息。
gccli>call UPEXTDB.SHOW_MODEL('kmeans_cust_model'); TRAIN_MODEL(model_name)
功能:训练模型。
参数说明:
² model_name:模型的名称。
示例:训练名为kmeans_cust_model的模型。
gccli>call UPEXTDB.TRAIN_MODEL('kmeans_cust_model');
EVALUATE_MODEL(model_name)
功能:评估模型。
参数说明:
² model_name:模型的名称。
示例:评估名为kmeans_cust_model的模型。
gccli>call UPEXTDB. EVALUATE_MODEL('kmeans_cust_model');
PREDICT(model_name, predict_set, predict_result)
功能:使用模型进行预测。
参数说明:
² model_name:模型的名称
² predict_set:要预测的数据集,可以是表、视图或HDFS文件
² predict_result:预测的结果,可以是表或HDFS文件,如果表不存在会自动创建,如果表已存在内容会被覆盖,如果HDFS文件不存在会自动创建,如果HDFS文件已存在会报错。
示例1:使用kmeans_cust_model模型进行聚类预测。
gccli>call UPEXTDB.PREDICT( 'kmeans_cust_model',
'spark_ml.t_cust_predict_data',
'spark_ml.t_cust_predict_result');
示例2:使用naiveBayes_model模型进行分类预测, /up/sparkml/data/features_predict为预测数据集的HDFS目录,spark_ml.text_classification_result为分类结果表。
gccli>call UPEXTDB.PREDICT( 'naiveBayes_model',
'/up/sparkml/data/features_predict',
'spark_ml.text_classification_result');
ADD_TRAIN_SETTING(model_name , setting_key, setting_value )
功能:以键值对的形式设置模型的训练参数。
参数说明:
² model_name:模型的名称;
² setting_key:参数的名称;
² setting_value:参数的取值;
示例:向kmeans_cust_model模型中设置聚类训练参数。
gccli>call UPEXTDB.ADD_TRAIN_SETTING('kmeans_cust_model','numClusters','8' );
gccli>call UPEXTDB.ADD_TRAIN_SETTING('kmeans_cust_model','numIterations','10' );
gccli>call UPEXTDB.ADD_TRAIN_SETTING('kmeans_cust_model','runTimes','1' );
gccli>call UPEXTDB.ADD_TRAIN_SETTING('kmeans_cust_model','initializationMode','Kmeans||' );
SHOW_TRAIN_SETTINGS(model_name)
功能:显示模型的所有训练参数。
参数说明:
² model_name:模型的名称。
示例:显示kmeans_cust_model模型的训练参数。
gccli>call UPEXTDB.SHOW_TRAIN_SETTINGS('kmeans_cust_model');
+-----------------------------------------------------------------------+
| settings |
+-----------------------------------------------------------------------+
| numClusters=8;numIterations=10;runTimes=1;initializationMode=Kmeans|| |
+-----------------------------------------------------------------------+
DELETE_TRAIN_SETTING(model_name, setting_key)
功能:删除某一项训练参数。如果要修改某一项参数的值,需要先删除该参数后再重新设置。
参数说明:
² model_name:模型的名称;
² setting_key:参数的名称。
示例:删除kmeans_cust_model模型的numClusters参数。
gccli>call UPEXTDB.DELETE_TRAIN_SETTING('kmeans_cust_model', 'numClusters');




