fix comments and fix bug

86b99ac9 · nhzlx · 9d98ca04 · 86b99ac9 · 86b99ac9 · 86b99ac9
5 changed file
--- a/paddle/fluid/inference/tensorrt/convert/conv2d_op.cc
+++ b/paddle/fluid/inference/tensorrt/convert/conv2d_op.cc
@@ -18,7 +18,7 @@ namespace paddle {
 namespace inference {
 namespace tensorrt {
-bool if_skip_merging_optimize(TensorRTEngine* engine_,
+bool to_skip_merging_optimize(TensorRTEngine* engine_,
                              const std::vector<int>& filters,
                              const std::vector<int>& strides,
                              const std::vector<int>& paddings,
@@ -101,7 +101,7 @@ class Conv2dOpConverter : public OpConverter {
    engine_->SetITensor(output_name, layer->getOutput(0));
    if (test_mode ||
-        if_skip_merging_optimize(engine_, {filter_h, filter_w}, strides,
+        to_skip_merging_optimize(engine_, {filter_h, filter_w}, strides,
                                 paddings, op_desc.Input("Input").front())) {
      engine_->DeclareOutput(output_name);
    }

--- a/paddle/fluid/inference/tensorrt/engine.cc
+++ b/paddle/fluid/inference/tensorrt/engine.cc
@@ -133,6 +133,10 @@ void TensorRTEngine::DeclareOutput(const nvinfer1::ILayer *layer, int offset,
  buffer_sizes_[name] = 0;
 }
+bool TensorRTEngine::HasDeclared(const std::string &name) {
+  return buffer_sizes_.count(name) > 0;
+}
 void TensorRTEngine::DeclareOutput(const std::string &name) {
  PADDLE_ENFORCE_EQ(0, buffer_sizes_.count(name), "duplicate output name %s",
                    name);

--- a/paddle/fluid/inference/tensorrt/engine.h
+++ b/paddle/fluid/inference/tensorrt/engine.h
@@ -91,6 +91,8 @@ class TensorRTEngine : public EngineBase {
                     const std::string& name);
  // Set the itensor_map_[name] as the network's output, and set its name.
  void DeclareOutput(const std::string& name);
+  // Check if the ITensor has been declared
+  bool HasDeclared(const std::string& name);
  // GPU memory address for an ITensor with specific name. One can operate on
  // these memory directly for acceleration, for example, output the converted

--- a/paddle/fluid/inference/tests/api/trt_models_tester.cc
+++ b/paddle/fluid/inference/tests/api/trt_models_tester.cc
@@ -96,11 +96,16 @@ void CompareTensorRTWithFluid(int batch_size, std::string model_dirname) {
  }
 }
-TEST(trt_models_test, main) {
+TEST(trt_models_test, mobilenet) {
-  std::vector<std::string> infer_models = {"mobilenet", "resnet50",
+  CompareTensorRTWithFluid(1, FLAGS_dirname + "/mobilenet");
-                                           "resnext50"};
+}
-  for (auto &model_dir : infer_models) {
-    CompareTensorRTWithFluid(1, FLAGS_dirname + "/" + model_dir);
+TEST(trt_models_test, resnet50) {
-  }
+  CompareTensorRTWithFluid(1, FLAGS_dirname + "/resnet50");
 }
+TEST(trt_models_test, resnext50) {
+  CompareTensorRTWithFluid(1, FLAGS_dirname + "/resnext50");
+}
 }  // namespace paddle
--- a/paddle/fluid/operators/tensorrt_engine_op.h
+++ b/paddle/fluid/operators/tensorrt_engine_op.h
@@ -223,8 +223,10 @@ class TensorRTEngineKernel : public framework::OpKernel<T> {
    // Add outputs
    for (auto& output : output_maps) {
+      if (!engine->HasDeclared(output)) {
        engine->DeclareOutput(output);
      }
+    }
    engine->FreezeNetwork();
  }