<?xml version="1.0" encoding="UTF-8"?><!DOCTYPE article  PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "http://dtd.nlm.nih.gov/publishing/3.0/journalpublishing3.dtd"><article xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" dtd-version="3.0" xml:lang="en" article-type="research article"><front><journal-meta><journal-id journal-id-type="publisher-id">OALibJ</journal-id><journal-title-group><journal-title>Open Access Library Journal</journal-title></journal-title-group><issn pub-type="epub">2333-9705</issn><publisher><publisher-name>Scientific Research Publishing</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.4236/oalib.1111352</article-id><article-id pub-id-type="publisher-id">OALibJ-132542</article-id><article-categories><subj-group subj-group-type="heading"><subject>Articles</subject></subj-group><subj-group subj-group-type="Discipline-v2"><subject>Biomedical&amp;Life Sciences</subject><subject> Business&amp;Economics</subject><subject> Chemistry&amp;Materials Science</subject><subject> Computer Science&amp;Communications</subject><subject> Earth&amp;Environmental Sciences</subject><subject> Engineering</subject><subject> Medicine&amp;Healthcare</subject><subject> Physics&amp;Mathematics</subject><subject> Social Sciences&amp;Humanities</subject></subj-group></article-categories><title-group><article-title>
 
 
  Penalized Spline Estimation for Nonparametric Multiplicative Regression Models
 
</article-title></title-group><contrib-group><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Wei</surname><given-names>Chen</given-names></name><xref ref-type="aff" rid="aff1"><sup>1</sup></xref><xref ref-type="corresp" rid="cor1"><sup>*</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Mingzhen</surname><given-names>Wan</given-names></name><xref ref-type="aff" rid="aff2"><sup>2</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Jiahui</surname><given-names>Xu</given-names></name><xref ref-type="aff" rid="aff2"><sup>2</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Jing</surname><given-names>Zhong</given-names></name><xref ref-type="aff" rid="aff2"><sup>2</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Yuying</surname><given-names>Xia</given-names></name><xref ref-type="aff" rid="aff2"><sup>2</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Minmin</surname><given-names>Zhang</given-names></name><xref ref-type="aff" rid="aff2"><sup>2</sup></xref></contrib></contrib-group><aff id="aff2"><addr-line>Suzhou Institute of Technology, Jiangsu University of Science and Technology, Zhangjiagang, China</addr-line></aff><aff id="aff1"><addr-line>School of Zhangjiagang, Jiangsu University of Science and Technology, Zhangjiagang, China</addr-line></aff><pub-date pub-type="epub"><day>01</day><month>04</month><year>2024</year></pub-date><volume>11</volume><issue>04</issue><fpage>1</fpage><lpage>16</lpage><history><date date-type="received"><day>26,</day>	<month>February</month>	<year>2024</year></date><date date-type="rev-recd"><day>16,</day>	<month>April</month>	<year>2024</year>	</date><date date-type="accepted"><day>19,</day>	<month>April</month>	<year>2024</year></date></history><permissions><copyright-statement>&#169; Copyright  2014 by authors and Scientific Research Publishing Inc. </copyright-statement><copyright-year>2014</copyright-year><license><license-p>This work is licensed under the Creative Commons Attribution International License (CC BY). http://creativecommons.org/licenses/by/4.0/</license-p></license></permissions><abstract><p>
 
 
  In this paper, we consider the estimation problem of the unknown link function in the nonparametric multiplicative regression model. Combining the penalized splines technique, the least product relative error estimation method is proposed, where an effective model degree of freedom is de-fined, then the smoothing parameter is chosen by some information criteria. Simulation studies show that these strategies work well. Some asymptotic properties are established. A real data set is analyzed to illustrate the usefulness of the proposed approach. Finally, some possible extensions are discussed.
 
</p></abstract><kwd-group><kwd>Multiplicative Regression</kwd><kwd> Nonparametric Estimation</kwd><kwd> Penalized Splines</kwd><kwd> Relative Error</kwd><kwd> Smoothing Parameter Selection</kwd></kwd-group></article-meta></front><body><sec id="s1"><title>1. Introduction</title><p>In many applications, such as the studies of financial and biomedical data, the response variable usually is positive. For modelling the relationship between the positive response and a set of explanatory variables, a natural idea is that first take an appropriate transformation for the response, e.g., the logarithmic transformation, then some common regression models, such as the linear regression or quantile regression, can be employed based on the transformed data. As argued by [<xref ref-type="bibr" rid="scirp.132542-ref1">1</xref>] , the least square or least absolute deviation criteria are both based on absolute errors, which is not desirable in many practical applications. Rather, the relative errors are more of a concern. In the early literature, many authors have contributed fruitfully to this issue, see [<xref ref-type="bibr" rid="scirp.132542-ref2">2</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref3">3</xref>] and [<xref ref-type="bibr" rid="scirp.132542-ref4">4</xref>] . Especially, since the work of [<xref ref-type="bibr" rid="scirp.132542-ref1">1</xref>] , more attention has focused on the multiplicative regression (MR) model, and various extensions have been investigated, for example, see [<xref ref-type="bibr" rid="scirp.132542-ref5">5</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref6">6</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref7">7</xref>] and references therein.</p><p>It is worth noting that all the existing studies on MR are in the framework of linear (parametric) or semi-parametric MR models. Once the parametric forms or structures are misspecified, the resulting estimation and inference may be biased and the resulting conclusions become unreliable. Rather, nonparametric modelling is conceptually appealing and more robust. To the best of our knowledge, there are seldom studies on this problem. To fill this gap, we will address this problem in detail in this paper.</p><p>When estimating the nonparametric function g(z) in some semi-parametric MR models, such as the partially linear MR model ( [<xref ref-type="bibr" rid="scirp.132542-ref6">6</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref8">8</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref9">9</xref>] ), single index MR model ( [<xref ref-type="bibr" rid="scirp.132542-ref10">10</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref11">11</xref>] [<xref ref-type="bibr" rid="scirp.132542-ref12">12</xref>] ), varying coefficient MR model ( [<xref ref-type="bibr" rid="scirp.132542-ref13">13</xref>] ), and others ( [<xref ref-type="bibr" rid="scirp.132542-ref14">14</xref>] ), almost all the researchers use the local linear smoothing technique and approximate it in a neighborhood of z for obtaining its estimation, where a good choice of the bandwidth is quietly critical and its value is sensitive to the performance of the resulting estimation and inference. Besides, due to the fact that the value of the function at every observation of z is estimated separately, the optimal selection of bandwidth for all observations may be not the same and the numerical problem will become untractable then the sample size is large. As a result, the researchers had to make a compromise and assume that the bandwidths used for estimating g(z) are the same.</p><p>In the nonparametric regression literature, spline-based methods, such as regression splines, smoothing splines, and penalized splines, are also popular and applied extensively in many fields. Recently, [<xref ref-type="bibr" rid="scirp.132542-ref15">15</xref>] proposed the multiplicative additive models based on the least product relative error criterion (LPRE), where the B-spline basis functions are used to estimate the nonparametric functions. Approximating a smooth function by a spline function has many desirable benefits, as presented in [<xref ref-type="bibr" rid="scirp.132542-ref16">16</xref>] and [<xref ref-type="bibr" rid="scirp.132542-ref17">17</xref>] . It is well known that the number and location of internal knots should be well-addressed when using the B-spline approximation approach. Too many knots may cause overfitting, few knots then bring underfitting. Although some information criteria can be adopted to select an appropriate number of knots, the overall computation burden is rather heavy. Fortunately, the penalized spline (P-splines) can avoid this difficulty and have gained remarkable popularity, especially due to computational expediency and easy adaptability to more complex models, see [<xref ref-type="bibr" rid="scirp.132542-ref18">18</xref>] . However, this technique has not been studied in the context of MR, and this is the first work to employ P-splines estimation for MR, although this issue is of importance and meaningful. All these motivate us to conduct this study in a formal manner.</p><p>This paper is organized as follows. In Section 2, we first introduce the nonparametric multiplicative regression model. Combining the penalized splines and the least product relative error criterion, a new estimation method is proposed, and some remarks about the selection of smoothing parameters and knots, and the asymptotic properties of the proposed estimator are given. Some simulation studies are carried out to assess the performance of our method under finite sample situations in Section 3. To illustrate its usefulness, we also apply our method to one real data set in Section 4. Finally, some discussions in Section 5 conclude the paper.</p></sec><sec id="s2"><title>2. Methodology</title><p>In this section, we mainly introduce the model and estimation approach. At the same time, some related issues will be answered in detail.</p><sec id="s2_1"><title>2.1. Model and Estimation</title><p>Consider the following nonparametric multiplicative regression model</p><p>Y = exp ( g ( Z ) ) ε , (1)</p><p>where Y is the response variable, Z is a p-vector of covariates, ε is the positive random error and independent of Z , g ( ⋅ ) is an unknown link function. Without loss of generality and for simplicity, we will assume that p = 1 in the following, i.e., the covariate Z is univariate. But the method discussed later can be easily be extended to the general case. Assume that an i.i.d. sample ( Y i , Z i ) , i = 1, ⋯ , n from model (1) are observed. For model identifiability, it is required that E ( ε ) = E ( ε − 1 ) in [<xref ref-type="bibr" rid="scirp.132542-ref5">5</xref>] . On the other hand, after taking logarithmic transformation on bosh sides of Equation (1), it follows that</p><p>ln ( Y ) = g ( Z ) + ln ( ε ) = ( g ( Z ) + c ) + ( ln ( ε ) − c ) ≜ g ˜ ( Z ) + ln ( ε ˜ ) , (2)</p><p>holds for any real number c, which means that the former requirement is not enough to ensure the nonparametric component unique. This phenomenon has been found by [<xref ref-type="bibr" rid="scirp.132542-ref8">8</xref>] , where they imposed a strong condition on the model, namely, E ( ln ( ε ) ) = 0 . In our opinion, this is not necessary. The unknown constant c can be set to be E ( ln ( ε ) ) such that E ( ln ( ε ˜ ) ) = 0 holds. Thus the function g ( ⋅ ) is identifiable. Meanwhile, suppose that one obtains a initial estimator of g ( ⋅ ) , denoted by g ˜ n ( ⋅ ) . Combining the Equation (2), a more efficient estimator of g ( ⋅ ) , denoted by g ^ n ( ⋅ ) , can be obtained by subtracting the mean of E ( ln ( ε ) ) from the initial estimator g ˜ n ( ⋅ ) , where</p><p>g ^ n ( z ) = g ˜ n ( ⋅ ) − c &#175; , c &#175; = 1 n ∑ i = 1 n [ ln ( Y i ) − g ˜ n ( Z i ) ] . (3)</p><p>In this process, it only needs that E ( ln ( ε ) ) , the expectation of ln ( ε ) is finite, which is allowed to be nonzero. Therefore, our condition is weaker than that stated in [<xref ref-type="bibr" rid="scirp.132542-ref8">8</xref>] .</p><p>Following the LPRE technique used in [<xref ref-type="bibr" rid="scirp.132542-ref5">5</xref>] , the estimator of g ( ⋅ ) in model (1) can be obtained by minimizing the objective function</p><p>S n ( g ) = 1 n ∑ i = 1 n { | Y i − exp ( g ( Z i ) ) Y i | &#215; | Y i − exp ( g ( Z i ) ) exp ( g ( Z i ) ) | } . (4)</p><p>When all Z i ’s are mutually different, the computation involved in Equation (4) can be accomplished individually for each g ( Z i ) . However, the resulting estimator is not continuous, which is unsatisfactory in some applications. To overcome these drawbacks, we approximate g ( ⋅ ) by B-spline functions. Exactly speaking, let − ∞ &lt; a = t 0 &lt; t 1 &lt; ⋯ &lt; t k n &lt; t k n + 1 = b &lt; ∞ be a sequence of knots, where [ a , b ] denotes the support of Z. As discussed in [<xref ref-type="bibr" rid="scirp.132542-ref19">19</xref>] , a set of B-spline basis function of degree d can be constructed and denoted by φ j ( ⋅ ) , j = 1 , ⋯ , K n = k n + 1 + d , where d = 2 or 3 corresponds to the quadratic spline or the cubic spline. Then g ( z ) can be approximated by a linear combination of basis functions, i.e., g ( z ) ≈ ∑ j = 1 K n     α j φ j ( z ) ≜ α Τ B ( z ) , where α = ( α 1 , ⋯ , α K n ) Τ is the spline coefficient vector and B ( z ) = ( φ 1 ( z ) , ⋯ , φ K n ( z ) ) Τ . Further, the model (1) can be rewritten as</p><p>Y = exp ( α Τ B ( Z ) ) ε . (5)</p><p>Meanwhile, α can be estimated by α ⌣ , the minimizer of the loss function</p><p>L n ( α ) = 1 n ∑ i = 1 n { | Y i − exp ( α Τ B i ) Y i | &#215; | Y i − exp ( α Τ B i ) exp ( α Τ B i ) | } = 1 n ∑ i = 1 n [ Y i exp ( − α Τ B i ) + Y i − 1 exp ( α Τ B i ) − 2 ] ,</p><p>where B i = B ( Z i ) . Then the B-spline estimator of g ( ⋅ ) can be obtained through Equation (3), where g ˜ n ( z ) is replaced by α ⌣ Τ B ( z ) .</p><p>However, for reasons discussed in Section 1, here we estimate the nonparametric function in model (1) using penalized splines by adding a roughness penalty to the above minimization problem. In the literature, there are mainly two kinds of definition of roughness. One is based on the integrated squared q-th derivative of the spline function, the other is based on the q-th order difference of the spline coefficient vector, which is more popular for its simplicity and adopted in this paper. Exactly, let Δ denote the backward difference operator. Then we have Δ α j = α j − α j − 1 and Δ 2 α j = α j − 2 α j − 1 + α j − 2 . In General, let Δ q = Δ Δ q − 1 . With these notations, the P-spline estimator of g ( ⋅ ) is defined as g ^ , the corrected spline function in (3), where g ˜ n ( z ) is replaced by α ^ Τ B ( z ) , and α ^ is the minimizer of</p><p>Q n ( α ) = L n ( α ) + λ ∑ j = q + 1 K n | Δ q α j | γ ,</p><p>where γ &gt; 0 and λ &gt; 0 is the smoothing parameter controlling the smoothness of the fitting vurve. If λ = 0 , the resulting estimator becomes the B-spline estimator. In practice, common choices of q and γ are q = 2 and γ = 2 for computational convenience. At this time, the above minimization problem can be rewritten as</p><p>Q n ( α ) = L n ( α ) + λ α Τ D Τ D α , (6)</p><p>where D is the ( K n − 2 ) &#215; K n matrix representation of the second order difference operator Δ 2 .</p></sec><sec id="s2_2"><title>2.2. Computation</title><p>Note that for given smoothing parameter and knots, the loss function (6) is differential and convex, minimizing it is not difficult, and some common algorithms can be applied. In the later simulation studies and real data analysis, we employ the function nmk in the R package dfoptim.</p><p>However, other alternatives are still helpful. As in the least square mean regression and penalized quantile regression (e.g. [<xref ref-type="bibr" rid="scirp.132542-ref20">20</xref>] ), an iterative reweighed least square (IRLS) algorithm can be developed. Meanwhile, the measure for the effective model degree of freedom can be introduced based on the trace of the hat matrix, as used in [<xref ref-type="bibr" rid="scirp.132542-ref20">20</xref>] . In the literature, the degree of freedom usually is adopted as the measure of model complexity to facilitate further model comparison, which has not been discussed for multiplicative regression using local smoothing technique. Thus, the smoothing parameter selection can be achieved naturally using some existing information criteria or cross-validation.</p><p>When the smoothing parameter and knots are prepared, α ^ can also be seen as the root of the first derivative of objective function (6), namely,</p><p>− 1 n ∑ i = 1 n [ Y i exp ( − α ^ Τ B i ) − Y i − 1 exp ( α ^ Τ B i ) ] B i + 2 λ D Τ D α ^ = 0, (7)</p><p>which can be rewritten as</p><p>− 1 n ∑ i = 1 n     2 ( ln Y i − α ^ Τ B i ) W i ( α ^ ) B i + 2 λ D Τ D α ^ = 0, (8)</p><p>where</p><p>W i ( α ^ ) = Y i exp ( − α ^ Τ B i ) − Y i − 1 exp ( α ^ Τ B i ) 2 ( ln Y i − α ^ Τ B i ) . (9)</p><p>Write Y ˜ = ( ln Y 1 , ⋯ , ln Y n ) Τ , B = ( B 1 , ⋯ , B n ) and W ( α ^ ) = d i a g ( W 1 ( α ^ ) , ⋯ , W n ( α ^ ) ) . The IRLS algorithm is implemented as follows.</p><p>Step 0. For given smoothing parameter λ , provide an initial value of α , denoted as α ^ 0 , which can be taken as the unpenalized B-spline estimator, or the ordinary least square estimator based on the logarithmic transformed data. Assume that we have the k-th iterative value α ^ k .</p><p>Step 1. At the k + 1 -th step, update the parameter by</p><p>α ^ k + 1 = ( B W ( α ^ k ) B Τ + 2 λ D Τ D ) − 1 B W ( α ^ k ) Y ˜ .</p><p>Repeat Step 1 until convergence. The value at the terminated step is defined as the final estimator of α , also denoted by α ^ . At the same time, as in the linear regression, the hat matrix here can be defined through</p><p>H λ = B Τ ( B W ( α ^ ) B Τ + 2 λ D Τ D ) − 1 B W ( α ^ ) .</p></sec><sec id="s2_3"><title>2.3. Choice of Smoothing Parameter and Knots</title><p>To implement the estimator, the smoothing parameter λ and the number and location of knots had to be determined in advance. Compared with the knots, the smoothing parameter plays a more significant role in the penalized spline estimation. As done in [<xref ref-type="bibr" rid="scirp.132542-ref20">20</xref>] , we set the trace of the hat matrix mentioned above to be the model degrees of freedom, denoted by d f = t r ( H λ ) , where t r ( A ) denotes the trace of a square matrix A. In spline context, some criterions have been proposed to select the smoothing parameter λ , such as the Bayesian Information Criterion (BIC), Generalized Approximation Cross-Validation criterion (GACV) and Generalized Cross-Validation criterion (GCV). Especially, in this paper, they are implemented by minimizing the functions:</p><p>BIC ( λ ) = ln ( L 1 n ( α ^ ) ) + d f ⋅ ln n 2 n ,</p><p>GACV ( λ ) = L 1 n ( α ^ ) 1 − d f / n ,</p><p>GCV ( λ ) = ∑ i = 1 n W i ( α ^ ) ( ln ( Y i ) − α ^ Τ B i ) / n ( 1 − d f / n ) 2 ,</p><p>respectively.</p><p>[<xref ref-type="bibr" rid="scirp.132542-ref18">18</xref>] suggested some rules for the number and location of knots. In the same spirits, we follow the strategy in [<xref ref-type="bibr" rid="scirp.132542-ref20">20</xref>] , where quadratic B-splines with 20 equally-spaced quantiles knots are used unless otherwise specified. With the BIC, GACV, GCV criterions above, we use 51 equally-spaced log-scaled grid points on log 10 ( λ ) ∈ [ − 5,5 ] for the choice of λ . All these settings work well in the numerical studies and a real example analysis.</p></sec><sec id="s2_4"><title>2.4. Asymptotic Results</title><p>For any probability measure P, define L 2 -norm ‖ f ‖ 2 = ( ∫ f 2 d P ) 1 / 2 . Denote p = d + 1 . To derive the asymptotic results, some regularity conditions are needed and listed as follows.</p><p>(A1) The true function in model (1) is g 0 . Suppose that g 0 ∈ G = { g ∈ C r [ a , b ] : ‖ g ( j ) ‖ ∞ ≤ M 0 , j = 1, ⋯ , r , | g ( r ) ( z 1 ) − g ( r ) ( z 2 ) | ≤ M 1 | z 1 − z 2 | } , where M 0 and M 1 are some positive constants, ‖   ⋅   ‖ ∞ is the superior norm, q ≤ r ≤ d + 1 .</p><p>(A2) Define h i = t i − t i − 1 . Assume that max i | h i + 1 − h i | = o ( 1 / k n ) . Moreover, the ratio of maximum and minimum spacings of knots is uniformly bounded.</p><p>(A3) k n = o ( n ) . (A4) The covariate Z has abounded support [ a , b ] with corresponding density f Z ( . ) , which has second derivative and is bounded away from zero and infinity.</p><p>(A5) ε is independent of Z, and E ( ε ) = E ( ε − 1 ) , E ( ln ( ε ) ) is finite.</p><p>(A6) E ( ε + ε − 1 ) &lt; + ∞ .</p><p>Conditions (A1)-(A3) are common requirements in the penalized spline theory. (A4) is the regularization condition used in the study of MR. (A5) is an identification condition for the LPRE estimation, which is similar to the zero mean condition in the classical linear mean regression. (A6) is required for proof, which is also used in [<xref ref-type="bibr" rid="scirp.132542-ref15">15</xref>] .</p><p>Theorem 2.1 Under conditions (A1)-(A6) mentioned above, we have that</p><p>1) If r = p , k n = O ( n 1 / ( 2 p + 1 ) ) and λ = O ( n − β ) with β &gt; ( 1 + p − q ) / ( 2 p + 1 ) , then it yields that ‖ g ^ − g 0 ‖ 2 2 = O P ( n − 2 p / ( 2 p + 1 ) ) .</p><p>2) If r = q , λ = O ( n − 1 / ( 2 q + 1 ) ) and k n = O ( n β ) with 1 &gt; β &gt; 1 / ( 2 q + 1 ) , then it yields that ‖ g ^ − g 0 ‖ 2 2 = O P ( n − 2 q / ( 2 q + 1 ) ) .</p><p>Proof. Note that</p><p>Q n ( α ) = 1 n ∑ i = 1 n [ Y i exp ( − α Τ B i ) + Y i − 1 exp ( α Τ B i ) − 2 ] + λ α Τ D Τ D α = 1 n ∑ i = 1 n [ ε i exp ( R i + ( g ∗ ( Z i ) − α Τ B i ) ) + ε i − 1 exp ( − R i − ( g ∗ ( Z i ) − α Τ B i ) ) − 2 ]         + λ α Τ D Τ D α ,</p><p>where ε i = Y i / exp ( g 0 ( Z i ) ) , R i = g ( Z i ) − g ∗ ( Z i ) , and g ∗ ( Z ) = α ∗ B ( Z ) denotes the best spline function approximation. Define X = n − 1 ∑ i = 1 n B i B i Τ , G λ = X + λ D Τ D and θ = G λ 1 / 2 ( α ∗ − α ) . Then we have that g ∗ ( Z i ) − α Τ B i = B i Τ ( α ∗ − α ) = B i Τ G λ − 1 / 2 θ . Let a n denote the convergence rate in the Theory. Since θ ^ = a n ( α ^ − α ∗ ) = arg min θ [ Q n ( α ∗ + a n − 1 θ ) − Q n ( α ∗ ) ] , we only need to prove that for every ν &gt; 0 , there exists a large constant δ &gt; such that</p><p>P ( inf ‖ θ ‖ 2 = δ Q n ( α ∗ + a n − 1 θ ) − Q n ( α ∗ ) ) ≥ 1 − ν .</p><p>In the line of the proof of Theorem 1 in the Appendix of [<xref ref-type="bibr" rid="scirp.132542-ref17">17</xref>] , some similar techniques can be applied. Finally, by the Corollary 1 of [<xref ref-type="bibr" rid="scirp.132542-ref16">16</xref>] , the desirable results are derived. The proof is completed.</p></sec></sec><sec id="s3"><title>3. Numerical Studies</title><p>In this section, numerical studies were conducted to evaluate the finite sample performance of our proposed method under various situations. To fairly compare the un-penalized B-spline estimator with the penalized spline estimators obtained by the BIC, GCV, GACV criterions and for simplicity, we set the degree of spline basis to be q = 2 , the number of internal knots k n = 20 , which are located on equally-spaced quantiles for all methods. All results below are based on 500 replicates, where the sample size n = 100 , 300 , 500 , respectively. All simulations are implemented using the software R.</p><sec id="s3_1"><title>3.1. Model A and Results</title><p>Model A. We generated ( Y , Z ) from the following model</p><p>Y = exp ( 1 + 2 sin ( π Z 30 ) ) ε , (10)</p><p>where Z ~ U n i f ( 0,50 ) and is independent with the random error ε . Further, three error distributions are considered, namely,</p><p>Case (i): ε = exp ( U ) , U ~ N ( 0,1 ) ,</p><p>Case (ii): ε = exp ( U ) , U ~ U n i f ( − 2,2 ) ,</p><p>Case (iii): ε ~ U n i f ( 0.0001,4.635506 ) .</p><p>Note that under case (i)-(ii), it holds that E ( ε − ε − 1 ) = 0 and E ( log ( ε ) ) = 0 . But under case (iii), E ( ε − ε − 1 ) = 0 , E ( log ( ε ) ) = 0.5339771 . We use the averaged Integrated Absolute Bias (IABIAS) and Mean Integrated Square Error (MISE), where for one estimator g ^ j ( j = 1 , ⋯ , 500 ) obtained from the j-th sample,</p><p>IABIAS = 1 500 ∑ j = 1 500 [ 1 n g r i d ∑ k = 1 n g r i d | g ^ j ( u k ) − g 0 ( u k ) | ] ,</p><p>MISE = 1 500 ∑ j = 1 500 [ 1 n g r i d ∑ k = 1 n g r i d [ g ^ j ( u k ) − g 0 ( u k ) ] 2 ] ,</p><p>at the fixed grid points { u k } equally-spaced in [0, 50] and n g r i d = 501 . The values below them are the associated sample standard deviation. To study the different smoothing parameter selection methods at a finer scale, we also calculate the mean and standard deviation of effective model degree of freedom (DF).</p><p><xref ref-type="table" rid="table1">Table 1</xref> reported the results. It can be seen that all three penalized estimators</p><table-wrap id="table1" ><label><xref ref-type="table" rid="table1">Table 1</xref></label><caption><title> Results of Model A under cases (i)-(iii) with different sample sizes and criterions (&#215;10<sup>−2</sup>)</title></caption><table><tbody><thead><tr><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (i)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (ii)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (iii)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th></tr></thead><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td></tr><tr><td align="center" valign="middle" >n = 100</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >29.835</td><td align="center" valign="middle" >33.621</td><td align="center" valign="middle" >30.643</td><td align="center" valign="middle" >43.104</td><td align="center" valign="middle" >29.550</td><td align="center" valign="middle" >34.495</td><td align="center" valign="middle" >30.006</td><td align="center" valign="middle" >46.696</td><td align="center" valign="middle" >49.812</td><td align="center" valign="middle" >54.306</td><td align="center" valign="middle" >51.422</td><td align="center" valign="middle" >64.237</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >6.069</td><td align="center" valign="middle" >6.499</td><td align="center" valign="middle" >6.140</td><td align="center" valign="middle" >8.036</td><td align="center" valign="middle" >7.027</td><td align="center" valign="middle" >7.847</td><td align="center" valign="middle" >7.026</td><td align="center" valign="middle" >10.649</td><td align="center" valign="middle" >9.797</td><td align="center" valign="middle" >12.765</td><td align="center" valign="middle" >9.684</td><td align="center" valign="middle" >16.827</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >14.581</td><td align="center" valign="middle" >19.176</td><td align="center" valign="middle" >15.379</td><td align="center" valign="middle" >37.450</td><td align="center" valign="middle" >14.436</td><td align="center" valign="middle" >20.481</td><td align="center" valign="middle" >14.873</td><td align="center" valign="middle" >54.989</td><td align="center" valign="middle" >37.339</td><td align="center" valign="middle" >58.578</td><td align="center" valign="middle" >39.666</td><td align="center" valign="middle" >106.553</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >5.875</td><td align="center" valign="middle" >14.661</td><td align="center" valign="middle" >6.106</td><td align="center" valign="middle" >54.348</td><td align="center" valign="middle" >6.459</td><td align="center" valign="middle" >17.833</td><td align="center" valign="middle" >6.547</td><td align="center" valign="middle" >135.870</td><td align="center" valign="middle" >20.192</td><td align="center" valign="middle" >329.668</td><td align="center" valign="middle" >22.028</td><td align="center" valign="middle" >587.813</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1227.584</td><td align="center" valign="middle" >1409.248</td><td align="center" valign="middle" >1267.132</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1181.893</td><td align="center" valign="middle" >1376.901</td><td align="center" valign="middle" >1204.128</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1260.861</td><td align="center" valign="middle" >1429.779</td><td align="center" valign="middle" >1318.995</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >106.715</td><td align="center" valign="middle" >106.075</td><td align="center" valign="middle" >102.198</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >106.072</td><td align="center" valign="middle" >109.127</td><td align="center" valign="middle" >100.670</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >104.080</td><td align="center" valign="middle" >111.360</td><td align="center" valign="middle" >108.925</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >n = 300</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >17.885</td><td align="center" valign="middle" >19.834</td><td align="center" valign="middle" >18.962</td><td align="center" valign="middle" >23.643</td><td align="center" valign="middle" >15.972</td><td align="center" valign="middle" >17.978</td><td align="center" valign="middle" >16.595</td><td align="center" valign="middle" >22.295</td><td align="center" valign="middle" >33.432</td><td align="center" valign="middle" >36.265</td><td align="center" valign="middle" >36.146</td><td align="center" valign="middle" >40.697</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >3.370</td><td align="center" valign="middle" >3.529</td><td align="center" valign="middle" >3.476</td><td align="center" valign="middle" >3.645</td><td align="center" valign="middle" >3.363</td><td align="center" valign="middle" >3.624</td><td align="center" valign="middle" >3.413</td><td align="center" valign="middle" >3.838</td><td align="center" valign="middle" >6.675</td><td align="center" valign="middle" >6.458</td><td align="center" valign="middle" >6.577</td><td align="center" valign="middle" >6.291</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >5.188</td><td align="center" valign="middle" >6.407</td><td align="center" valign="middle" >5.852</td><td align="center" valign="middle" >9.179</td><td align="center" valign="middle" >4.225</td><td align="center" valign="middle" >5.348</td><td align="center" valign="middle" >4.552</td><td align="center" valign="middle" >8.318</td><td align="center" valign="middle" >18.751</td><td align="center" valign="middle" >21.386</td><td align="center" valign="middle" >21.270</td><td align="center" valign="middle" >26.320</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >1.845</td><td align="center" valign="middle" >2.161</td><td align="center" valign="middle" >2.036</td><td align="center" valign="middle" >2.753</td><td align="center" valign="middle" >1.671</td><td align="center" valign="middle" >2.089</td><td align="center" valign="middle" >1.783</td><td align="center" valign="middle" >2.961</td><td align="center" valign="middle" >9.249</td><td align="center" valign="middle" >9.319</td><td align="center" valign="middle" >9.419</td><td align="center" valign="middle" >9.831</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1196.849</td><td align="center" valign="middle" >1407.369</td><td align="center" valign="middle" >1314.363</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1142.739</td><td align="center" valign="middle" >1354.685</td><td align="center" valign="middle" >1222.428</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1289.492</td><td align="center" valign="middle" >1485.475</td><td align="center" valign="middle" >1471.698</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >68.528</td><td align="center" valign="middle" >76.614</td><td align="center" valign="middle" >78.794</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >68.308</td><td align="center" valign="middle" >77.785</td><td align="center" valign="middle" >69.231</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >77.216</td><td align="center" valign="middle" >75.052</td><td align="center" valign="middle" >88.981</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >n = 500</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >14.356</td><td align="center" valign="middle" >15.654</td><td align="center" valign="middle" >15.113</td><td align="center" valign="middle" >18.230</td><td align="center" valign="middle" >12.5844</td><td align="center" valign="middle" >13.735</td><td align="center" valign="middle" >12.969</td><td align="center" valign="middle" >16.557</td><td align="center" valign="middle" >29.411</td><td align="center" valign="middle" >31.519</td><td align="center" valign="middle" >31.803</td><td align="center" valign="middle" >34.598</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >2.626</td><td align="center" valign="middle" >2.768</td><td align="center" valign="middle" >2.750</td><td align="center" valign="middle" >2.910</td><td align="center" valign="middle" >2.4399</td><td align="center" valign="middle" >2.530</td><td align="center" valign="middle" >2.388</td><td align="center" valign="middle" >2.715</td><td align="center" valign="middle" >7.374</td><td align="center" valign="middle" >6.952</td><td align="center" valign="middle" >7.045</td><td align="center" valign="middle" >6.740</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >3.372</td><td align="center" valign="middle" >4.003</td><td align="center" valign="middle" >3.740</td><td align="center" valign="middle" >5.439</td><td align="center" valign="middle" >2.6288</td><td align="center" valign="middle" >3.130</td><td align="center" valign="middle" >2.788</td><td align="center" valign="middle" >4.567</td><td align="center" valign="middle" >16.395</td><td align="center" valign="middle" >18.093</td><td align="center" valign="middle" >18.354</td><td align="center" valign="middle" >20.913</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >1.184</td><td align="center" valign="middle" >1.354</td><td align="center" valign="middle" >1.303</td><td align="center" valign="middle" >1.651</td><td align="center" valign="middle" >0.9924</td><td align="center" valign="middle" >1.113</td><td align="center" valign="middle" >0.993</td><td align="center" valign="middle" >1.470</td><td align="center" valign="middle" >11.118</td><td align="center" valign="middle" >10.905</td><td align="center" valign="middle" >11.013</td><td align="center" valign="middle" >10.937</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1210.032</td><td align="center" valign="middle" >1426.518</td><td align="center" valign="middle" >1339.452</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1157.6377</td><td align="center" valign="middle" >1365.706</td><td align="center" valign="middle" >1251.546</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1317.323</td><td align="center" valign="middle" >1522.904</td><td align="center" valign="middle" >1553.775</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >61.335</td><td align="center" valign="middle" >68.784</td><td align="center" valign="middle" >73.771</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >52.0414</td><td align="center" valign="middle" >68.176</td><td align="center" valign="middle" >55.066</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >75.347</td><td align="center" valign="middle" >74.644</td><td align="center" valign="middle" >103.840</td><td align="center" valign="middle" >-</td></tr></tbody></table></table-wrap><p>have smaller IABIAS and MISE than those of the unpenalized B-spline estimator. This indicates the benefits of the proposed method. As the sample size increases, the differences between them decrease and become comparable. The model degree using GACV are almost larger than those of using BIC and GCV in all settings, and those using BIC are the smallest, which is also observed in [<xref ref-type="bibr" rid="scirp.132542-ref20">20</xref>] . These imply that GACV tends to select more complex models, BIC tends to select simpler models, GCV makes a compromise and lies between them. <xref ref-type="fig" rid="fig1">Figure 1</xref> displays the average estimated curves and their 95% point-wise confidence band under cases (i) with sample size n = 300 for model A. We can see that all estimated curves are close to the true one, but the B-spline estimation has a drastic deviation near the boundaries. <xref ref-type="fig" rid="fig2">Figure 2</xref> shows the boxplots of the estimates of g ( z ) at z = 15,30,45 , respectively. We can see that most estimates are centered around the true values of ( 3,1, − 1 ) with small deviations, although the BS estimator has a little larger standard deviation. The corresponding QQ-plots of them are presented in <xref ref-type="fig" rid="fig3">Figure 3</xref>, which show that the resulting estimators seem to converge asymptotically to the normal distribution. Estimated curves under other situations are similar, and are not displayed, but are available in the supplementary materials.</p></sec><sec id="s3_2"><title>3.2. Model B and Results</title><p>We generated ( Y , Z ) from the following model</p><p>Y = exp ( | Z − 25 | 3 5000 ) ε , (11)</p><p>where Z ~ U n i f ( 0,50 ) and is independent with the random error ε . Others are the same as defined in Model A. We reported the results in <xref ref-type="table" rid="table2">Table 2</xref> and displayed the average estimated curves and their 95% point-wise confidence band under cases (i) with sample size n = 300 for model B in <xref ref-type="fig" rid="fig4">Figure 4</xref>. Again, results are similar to those presented in <xref ref-type="table" rid="table1">Table 1</xref> and Figures 1-3 are found. More related figures can be available in the supplementary materials.</p></sec></sec><sec id="s4"><title>4. Real Data Analysis</title><p>In this section, we will analyze the ethanol data to illustrate our proposed method. This data is available in the R package lattice, and aims to investigate the relationship between the emissions of nitrogen oxides, denoted by Y, and various settings of the engine compression ratio and equivalence ratio, denoted by Z, when ethanol fuel is burned in a single-cylinder engine. In this data set, 88 observations are collected. [<xref ref-type="bibr" rid="scirp.132542-ref13">13</xref>] analyzed it in the framework of varying coefficient multiplicative regression model based on the LPRE criterion and local linear approximation technique. His results demonstrate that various settings of the engine compression ratio have little effect in Y, as illustrated in page 280 therein. Therefore, here we only consider the covariate Z in the following model.</p><table-wrap id="table2" ><label><xref ref-type="table" rid="table2">Table 2</xref></label><caption><title> Results of Model B under cases (i)-(iii) with different sample sizes and criterions (&#215;10<sup>−2</sup>)</title></caption><table><tbody><thead><tr><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (i)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (ii)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th><th align="center" valign="middle" >Case (iii)</th><th align="center" valign="middle" ></th><th align="center" valign="middle" ></th></tr></thead><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >BS</td></tr><tr><td align="center" valign="middle" >n = 100</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >30.954</td><td align="center" valign="middle" >34.347</td><td align="center" valign="middle" >31.649</td><td align="center" valign="middle" >43.095</td><td align="center" valign="middle" >31.263</td><td align="center" valign="middle" >35.429</td><td align="center" valign="middle" >31.520</td><td align="center" valign="middle" >46.884</td><td align="center" valign="middle" >50.598</td><td align="center" valign="middle" >54.612</td><td align="center" valign="middle" >52.022</td><td align="center" valign="middle" >63.973</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >6.074</td><td align="center" valign="middle" >6.498</td><td align="center" valign="middle" >6.170</td><td align="center" valign="middle" >8.037</td><td align="center" valign="middle" >6.626</td><td align="center" valign="middle" >7.611</td><td align="center" valign="middle" >6.604</td><td align="center" valign="middle" >11.695</td><td align="center" valign="middle" >9.431</td><td align="center" valign="middle" >12.712</td><td align="center" valign="middle" >9.376</td><td align="center" valign="middle" >14.377</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >16.093</td><td align="center" valign="middle" >20.245</td><td align="center" valign="middle" >16.762</td><td align="center" valign="middle" >37.521</td><td align="center" valign="middle" >16.510</td><td align="center" valign="middle" >21.848</td><td align="center" valign="middle" >16.727</td><td align="center" valign="middle" >60.375</td><td align="center" valign="middle" >38.319</td><td align="center" valign="middle" >59.115</td><td align="center" valign="middle" >40.487</td><td align="center" valign="middle" >89.844</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >5.979</td><td align="center" valign="middle" >14.659</td><td align="center" valign="middle" >6.219</td><td align="center" valign="middle" >56.611</td><td align="center" valign="middle" >6.612</td><td align="center" valign="middle" >18.404</td><td align="center" valign="middle" >6.645</td><td align="center" valign="middle" >185.554</td><td align="center" valign="middle" >21.209</td><td align="center" valign="middle" >334.487</td><td align="center" valign="middle" >23.024</td><td align="center" valign="middle" >328.872</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1253.243</td><td align="center" valign="middle" >1429.974</td><td align="center" valign="middle" >1292.463</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1210.361</td><td align="center" valign="middle" >1395.702</td><td align="center" valign="middle" >1228.656</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1281.472</td><td align="center" valign="middle" >1445.200</td><td align="center" valign="middle" >1338.260</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >99.732</td><td align="center" valign="middle" >100.901</td><td align="center" valign="middle" >95.411</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >108.539</td><td align="center" valign="middle" >110.258</td><td align="center" valign="middle" >98.756</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >106.142</td><td align="center" valign="middle" >108.857</td><td align="center" valign="middle" >104.281</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >n = 300</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >18.762</td><td align="center" valign="middle" >20.381</td><td align="center" valign="middle" >19.606</td><td align="center" valign="middle" >23.643</td><td align="center" valign="middle" >16.979</td><td align="center" valign="middle" >18.632</td><td align="center" valign="middle" >17.519</td><td align="center" valign="middle" >22.294</td><td align="center" valign="middle" >34.039</td><td align="center" valign="middle" >36.581</td><td align="center" valign="middle" >36.376</td><td align="center" valign="middle" >40.696</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >3.338</td><td align="center" valign="middle" >3.458</td><td align="center" valign="middle" >3.426</td><td align="center" valign="middle" >3.644</td><td align="center" valign="middle" >3.176</td><td align="center" valign="middle" >3.521</td><td align="center" valign="middle" >3.287</td><td align="center" valign="middle" >3.838</td><td align="center" valign="middle" >6.588</td><td align="center" valign="middle" >6.406</td><td align="center" valign="middle" >6.537</td><td align="center" valign="middle" >6.289</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >5.888</td><td align="center" valign="middle" >6.823</td><td align="center" valign="middle" >6.358</td><td align="center" valign="middle" >9.179</td><td align="center" valign="middle" >4.972</td><td align="center" valign="middle" >5.794</td><td align="center" valign="middle" >5.183</td><td align="center" valign="middle" >8.317</td><td align="center" valign="middle" >19.121</td><td align="center" valign="middle" >21.600</td><td align="center" valign="middle" >21.393</td><td align="center" valign="middle" >26.320</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >1.962</td><td align="center" valign="middle" >2.180</td><td align="center" valign="middle" >2.087</td><td align="center" valign="middle" >2.752</td><td align="center" valign="middle" >1.830</td><td align="center" valign="middle" >2.143</td><td align="center" valign="middle" >1.893</td><td align="center" valign="middle" >2.961</td><td align="center" valign="middle" >9.197</td><td align="center" valign="middle" >9.268</td><td align="center" valign="middle" >9.422</td><td align="center" valign="middle" >9.832</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1258.010</td><td align="center" valign="middle" >1457.920</td><td align="center" valign="middle" >1363.208</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1205.782</td><td align="center" valign="middle" >1408.397</td><td align="center" valign="middle" >1284.380</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1325.434</td><td align="center" valign="middle" >1518.928</td><td align="center" valign="middle" >1496.542</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >65.165</td><td align="center" valign="middle" >70.682</td><td align="center" valign="middle" >71.458</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >67.726</td><td align="center" valign="middle" >71.847</td><td align="center" valign="middle" >63.174</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >70.470</td><td align="center" valign="middle" >71.405</td><td align="center" valign="middle" >87.412</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >n = 500</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >IABIAS</td><td align="center" valign="middle" >15.087</td><td align="center" valign="middle" >16.093</td><td align="center" valign="middle" >15.705</td><td align="center" valign="middle" >18.229</td><td align="center" valign="middle" >13.501</td><td align="center" valign="middle" >14.360</td><td align="center" valign="middle" >13.814</td><td align="center" valign="middle" >16.558</td><td align="center" valign="middle" >29.910</td><td align="center" valign="middle" >31.766</td><td align="center" valign="middle" >31.988</td><td align="center" valign="middle" >34.599</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >2.561</td><td align="center" valign="middle" >2.696</td><td align="center" valign="middle" >2.665</td><td align="center" valign="middle" >2.910</td><td align="center" valign="middle" >2.225</td><td align="center" valign="middle" >2.417</td><td align="center" valign="middle" >2.284</td><td align="center" valign="middle" >2.715</td><td align="center" valign="middle" >7.169</td><td align="center" valign="middle" >6.858</td><td align="center" valign="middle" >6.965</td><td align="center" valign="middle" >6.741</td></tr><tr><td align="center" valign="middle" >MISE</td><td align="center" valign="middle" >3.816</td><td align="center" valign="middle" >4.257</td><td align="center" valign="middle" >4.075</td><td align="center" valign="middle" >5.438</td><td align="center" valign="middle" >3.160</td><td align="center" valign="middle" >3.452</td><td align="center" valign="middle" >3.231</td><td align="center" valign="middle" >4.568</td><td align="center" valign="middle" >16.721</td><td align="center" valign="middle" >18.253</td><td align="center" valign="middle" >18.463</td><td align="center" valign="middle" >20.914</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >1.230</td><td align="center" valign="middle" >1.357</td><td align="center" valign="middle" >1.301</td><td align="center" valign="middle" >1.651</td><td align="center" valign="middle" >1.041</td><td align="center" valign="middle" >1.137</td><td align="center" valign="middle" >1.052</td><td align="center" valign="middle" >1.470</td><td align="center" valign="middle" >11.018</td><td align="center" valign="middle" >10.847</td><td align="center" valign="middle" >10.949</td><td align="center" valign="middle" >10.939</td></tr><tr><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >1281.520</td><td align="center" valign="middle" >1484.408</td><td align="center" valign="middle" >1406.453</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1233.752</td><td align="center" valign="middle" >1437.042</td><td align="center" valign="middle" >1329.486</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1360.986</td><td align="center" valign="middle" >1560.749</td><td align="center" valign="middle" >1586.328</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >56.717</td><td align="center" valign="middle" >62.400</td><td align="center" valign="middle" >68.205</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >54.702</td><td align="center" valign="middle" >65.378</td><td align="center" valign="middle" >57.779</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >70.218</td><td align="center" valign="middle" >67.571</td><td align="center" valign="middle" >92.849</td><td align="center" valign="middle" >-</td></tr></tbody></table></table-wrap><p>Y = exp ( g ( Z ) ) ε .</p><p>The estimated curves of g with 8 and 20 internal knots quadratic P-splines are plotted in <xref ref-type="fig" rid="fig5">Figure 5</xref>, which have similar trends to the plot in [<xref ref-type="bibr" rid="scirp.132542-ref13">13</xref>] except a vertical shift. We can see that all the four curves are almost identical, which maybe caused by the data’s own well fitness to the above model. Scatted plot of Y and the corresponding estimated curves of exp ( g ( Z ) ) are presented in <xref ref-type="fig" rid="fig6">Figure 6</xref>, which indicate the proposed method fits the data well enough. The number of knots has some effects on the estimates of curves, but doesn’t affect the performance substantially, which is also supported by the mean and median of absolute prediction errors | Y i − Y ^ i | and squared prediction errors ( Y i − Y ^ i ) 2 given in the <xref ref-type="table" rid="table3">Table 3</xref>, where Y ^ i = exp ( g ^ ( Z i ) ) .</p><table-wrap id="table3" ><label><xref ref-type="table" rid="table3">Table 3</xref></label><caption><title> Prediction errors and degrees of freedom of the ethanol data</title></caption><table><tbody><thead><tr><th align="center" valign="middle" ></th><th align="center" valign="middle"  colspan="5"  >k<sub>n</sub> = 8</th><th align="center" valign="middle"  colspan="5"  >k<sub>n</sub> = 20</th></tr></thead><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >MAPE</td><td align="center" valign="middle" >MDAPE</td><td align="center" valign="middle" >MSPE</td><td align="center" valign="middle" >MDSPE</td><td align="center" valign="middle" >DF</td><td align="center" valign="middle" >MAPE</td><td align="center" valign="middle" >MDAPE</td><td align="center" valign="middle" >MSPE</td><td align="center" valign="middle" >MDSPE</td><td align="center" valign="middle" >DF</td></tr><tr><td align="center" valign="middle" >BIC</td><td align="center" valign="middle" >0.240</td><td align="center" valign="middle" >0.188</td><td align="center" valign="middle" >0.105</td><td align="center" valign="middle" >0.035</td><td align="center" valign="middle" >7.116</td><td align="center" valign="middle" >0.187</td><td align="center" valign="middle" >0.128</td><td align="center" valign="middle" >0.069</td><td align="center" valign="middle" >0.016</td><td align="center" valign="middle" >12.488</td></tr><tr><td align="center" valign="middle" >GACV</td><td align="center" valign="middle" >0.242</td><td align="center" valign="middle" >0.188</td><td align="center" valign="middle" >0.105</td><td align="center" valign="middle" >0.035</td><td align="center" valign="middle" >8.208</td><td align="center" valign="middle" >0.186</td><td align="center" valign="middle" >0.126</td><td align="center" valign="middle" >0.068</td><td align="center" valign="middle" >0.016</td><td align="center" valign="middle" >13.613</td></tr><tr><td align="center" valign="middle" >GCV</td><td align="center" valign="middle" >0.241</td><td align="center" valign="middle" >0.188</td><td align="center" valign="middle" >0.105</td><td align="center" valign="middle" >0.035</td><td align="center" valign="middle" >7.658</td><td align="center" valign="middle" >0.187</td><td align="center" valign="middle" >0.128</td><td align="center" valign="middle" >0.069</td><td align="center" valign="middle" >0.016</td><td align="center" valign="middle" >12.488</td></tr><tr><td align="center" valign="middle" >BS</td><td align="center" valign="middle" >0.243</td><td align="center" valign="middle" >0.197</td><td align="center" valign="middle" >0.105</td><td align="center" valign="middle" >0.038</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >0.183</td><td align="center" valign="middle" >0.1282</td><td align="center" valign="middle" >0.067</td><td align="center" valign="middle" >0.016</td><td align="center" valign="middle" >-</td></tr></tbody></table></table-wrap><p>Note: k<sub>n</sub>: the nunber of interior knots; MAPE: mean absolute prediction errors; MDAPE: median absolute prediction errors; MSPE: mean squared prediction errors; MASPE: median squared prediction errors.</p></sec><sec id="s5"><title>5. Conclusion and Discussions</title><p>In this study, we used the penalized spline method to estimate the nonparametric function in model (1) based on the LPRE loss function. Inspired by the iteratively reweighted least squares algorithm, we develop the effective model degree of freedom and propose three smoothing parameter selection methods. Some asymptotic results are established. Furthermore, numerical simulation studies and real data analysis found that the proposed approach works well in several settings. As indicated in Section 1, the approaches proposed in this paper may be adapted to the partially linear, even additive, single index or varying coefficients multiplicative regression models. Our future work will also consider extensions to fields with covariates measurement errors, censored data or longitudinal data analysis, which are meaningful for practitioners.</p></sec><sec id="s6"><title>Data Availability Statement</title><p>The data set used in the real data analysis can be available publicly from the R package lattice.</p></sec><sec id="s7"><title>Acknowledgements</title><p>This work was partly supported by a grant from Natural Science Foundation of Jiangsu Province under project ID BK20210889 and Start-up fund for doctoral research of Jiangsu University of Science and technology. The authors also thank the lecturer Feng-Ling Ren, School of Computer and Engineering, Xinjiang University of Finance &amp; Economics, for helpful discussions.</p></sec><sec id="s8"><title>Conflicts of Interest</title><p>The authors declare no conflicts of interest.</p></sec><sec id="s9"><title>Cite this paper</title><p>Chen, W., Wan, M.Z., Xu, J.H., Zhong, J., Xia, Y.Y. and Zhang, M.M. (2024) Penalized Spline Estimation for Nonparametric Multiplicative Regression Models. Open Access Library Journal, 11: e11352. http://doi.org/10.4236/oalib.1111352</p></sec></body><back><ref-list><title>References</title><ref id="scirp.132542-ref1"><label>1</label><mixed-citation publication-type="other" xlink:type="simple">Chen, K., Guo, S., Lin, Y. and Ying, Z. (2010) Least Absolute Relative Error Estimation. Journal of the American Statistical Association, 105, 1104-1112. https://doi.org/10.1198/jasa.2010.tm09307</mixed-citation></ref><ref id="scirp.132542-ref2"><label>2</label><mixed-citation publication-type="other" xlink:type="simple">Khoshgoftaar, T.M., Bhattacharyya, B.B. and Richardson, G.D. (1992) Predicting Software Errors, during Development, Using Nonlinear Regression Models: A Comparative Study. IEEE Transactions on Reliability, 41, 390-395. https://doi.org/10.1109/24.159804</mixed-citation></ref><ref id="scirp.132542-ref3"><label>3</label><mixed-citation publication-type="other" xlink:type="simple">Narula, S.C. and Wellington, J.F. (1977) Prediction, Linear Regression and the Minimum Sum of Relative Errors. Technometrics, 19, 185-190. https://doi.org/10.1080/00401706.1977.10489526</mixed-citation></ref><ref id="scirp.132542-ref4"><label>4</label><mixed-citation publication-type="other" xlink:type="simple">Park, H. and Stefanski, L.A. (1998) Relative-Error Prediction. Statistics and Probability Letters, 40, 227-236. https://doi.org/10.1016/S0167-7152(98)00088-1</mixed-citation></ref><ref id="scirp.132542-ref5"><label>5</label><mixed-citation publication-type="other" xlink:type="simple">Chen, K., Lin, Y., Wang, Z. and Ying, Z. (2016) Least Product Relative Error Estimation. Journal of Multivariate Analysis, 144, 91-98. https://doi.org/10.1016/j.jmva.2015.10.017</mixed-citation></ref><ref id="scirp.132542-ref6"><label>6</label><mixed-citation publication-type="other" xlink:type="simple">Zhang, Q. and Wang, Q. (2013) Local Least Absolute Relative Error Estimating Approach for Partially Linear Multiplicative Model. Statistica Sinica, 23, 1091-1116. https://doi.org/10.5705/ss.2012.133</mixed-citation></ref><ref id="scirp.132542-ref7"><label>7</label><mixed-citation publication-type="other" xlink:type="simple">Hirose, K. and Masuda, H. (2018) Robust Relative Error Estimation. Entropy, 20, Article 632. https://doi.org/10.3390/e20090632</mixed-citation></ref><ref id="scirp.132542-ref8"><label>8</label><mixed-citation publication-type="other" xlink:type="simple">Zhang, J., Feng, Z. and Peng, H. (2018) Estimation and Hypothesis Test for Partial Linear Multiplicative Models. Computational Statistics &amp; Data Analysis, 128, 87-103. https://doi.org/10.1016/j.csda.2018.06.017</mixed-citation></ref><ref id="scirp.132542-ref9"><label>9</label><mixed-citation publication-type="other" xlink:type="simple">Chen, Y. and Liu, H. (2021) A New Relative Error Estimation for Partially Linear Multiplicative Model. Communications in Statistics-Simulation and Computation, 52, 4962-4980.</mixed-citation></ref><ref id="scirp.132542-ref10"><label>10</label><mixed-citation publication-type="other" xlink:type="simple">Liu, H. and Xia, X. (2018) Estimation and Empirical Likelihood for Single-Index Multiplicative Models. Journal of Statistical Planning and Inference, 193, 70-88. https://doi.org/10.1016/j.jspi.2017.08.003</mixed-citation></ref><ref id="scirp.132542-ref11"><label>11</label><mixed-citation publication-type="other" xlink:type="simple">Zhang, J., Zhu, J. and Feng, Z. (2019) Estimation and Hypothesis Test for Single-Index Multiplicative Models. Test, 28, 242-268. https://doi.org/10.1007/s11749-018-0586-2</mixed-citation></ref><ref id="scirp.132542-ref12"><label>12</label><mixed-citation publication-type="other" xlink:type="simple">Zhang, J., Cui, X. and Peng, H. (2020) Estimation and Hypothesis Test for Partial Linear Single-Index Multiplicative Models. Annals of the Institute of Statistical Mathematics, 72, 699-740. https://doi.org/10.1007/s10463-019-00706-6</mixed-citation></ref><ref id="scirp.132542-ref13"><label>13</label><mixed-citation publication-type="other" xlink:type="simple">Hu, D.H. (2019) Local Least Product Relative Error Estimation for Varying Coefficient Multiplicative Regression Model. Acta Mathematicae Applicatae Sinica, English Series, 35, 274-286. https://doi.org/10.1007/s10255-018-0794-2</mixed-citation></ref><ref id="scirp.132542-ref14"><label>14</label><mixed-citation publication-type="other" xlink:type="simple">Chen, Y., Liu, H. and Ma, J. (2022) Local Least Product Relative Error Estimation for Single-Index Varying-Coefficient Multiplicative Model with Positive Responses. Journal of Computational and Applied Mathematics, 415, Article ID: 114478. https://doi.org/10.1016/j.cam.2022.114478</mixed-citation></ref><ref id="scirp.132542-ref15"><label>15</label><mixed-citation publication-type="other" xlink:type="simple">Ming, H., Liu, H. and Yang, H. (2022) Least Product Relative Error Estimation for Identification in Multiplicative Additive Models. Journal of Computational and Applied Mathematics, 404, Article ID: 113886. https://doi.org/10.1016/j.cam.2021.113886</mixed-citation></ref><ref id="scirp.132542-ref16"><label>16</label><mixed-citation publication-type="other" xlink:type="simple">Kalogridis, I. and Van Aelst, S. (2021) M-Type Penalized Splines with Auxiliary Scale Estimation. Journal of Statistical Planning and Inference, 212, 97-113. https://doi.org/10.1016/j.jspi.2020.09.004</mixed-citation></ref><ref id="scirp.132542-ref17"><label>17</label><mixed-citation publication-type="other" xlink:type="simple">Kalogridis, I. and Van Aelst, S. (2021) Robust Penalized Spline Estimation with Difference Penalties. Econometrics and Statistics, 29, 169-188.</mixed-citation></ref><ref id="scirp.132542-ref18"><label>18</label><mixed-citation publication-type="other" xlink:type="simple">Ruppert, D., Wand, M.P. and Carroll, R.J. (2003) Semiparametric Regression. Cambridge University Press, New York. https://doi.org/10.1017/CBO9780511755453</mixed-citation></ref><ref id="scirp.132542-ref19"><label>19</label><mixed-citation publication-type="other" xlink:type="simple">Schumaker, L. (2007) Spline Functions: Basic Theory. Cambridge University Press, New York. https://doi.org/10.1017/CBO9780511618994</mixed-citation></ref><ref id="scirp.132542-ref20"><label>20</label><mixed-citation publication-type="other" xlink:type="simple">Wu, C. and Yu, Y. (2014) Partially Linear Modeling of Conditional Quantiles Using Penalized Splines. Computational Statistics &amp; Data Analysis, 77, 170-187. https://doi.org/10.1016/j.csda.2014.02.020</mixed-citation></ref></ref-list></back></article>