<?xml version="1.0" encoding="UTF-8"?><!DOCTYPE article  PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "http://dtd.nlm.nih.gov/publishing/3.0/journalpublishing3.dtd"><article xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" dtd-version="3.0" xml:lang="en" article-type="research article"><front><journal-meta><journal-id journal-id-type="publisher-id">JAMP</journal-id><journal-title-group><journal-title>Journal of Applied Mathematics and Physics</journal-title></journal-title-group><issn pub-type="epub">2327-4352</issn><publisher><publisher-name>Scientific Research Publishing</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.4236/jamp.2023.114068</article-id><article-id pub-id-type="publisher-id">JAMP-124549</article-id><article-categories><subj-group subj-group-type="heading"><subject>Articles</subject></subj-group><subj-group subj-group-type="Discipline-v2"><subject>Physics&amp;Mathematics</subject></subj-group></article-categories><title-group><article-title>
 
 
  Greedy Randomized Gauss-Seidel Method with Oblique Direction
 
</article-title></title-group><contrib-group><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Weifeng</surname><given-names>Li</given-names></name><xref ref-type="aff" rid="aff1"><sup>1</sup></xref><xref ref-type="corresp" rid="cor1"><sup>*</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Pingping</surname><given-names>Zhang</given-names></name><xref ref-type="aff" rid="aff1"><sup>1</sup></xref></contrib></contrib-group><aff id="aff1"><addr-line>School of Science, Chongqing University of Posts and Telecommunications, Chongqing, China</addr-line></aff><pub-date pub-type="epub"><day>13</day><month>04</month><year>2023</year></pub-date><volume>11</volume><issue>04</issue><fpage>1036</fpage><lpage>1048</lpage><history><date date-type="received"><day>21,</day>	<month>March</month>	<year>2023</year></date><date date-type="rev-recd"><day>24,</day>	<month>April</month>	<year>2023</year>	</date><date date-type="accepted"><day>27,</day>	<month>April</month>	<year>2023</year></date></history><permissions><copyright-statement>&#169; Copyright  2014 by authors and Scientific Research Publishing Inc. </copyright-statement><copyright-year>2014</copyright-year><license><license-p>This work is licensed under the Creative Commons Attribution International License (CC BY). http://creativecommons.org/licenses/by/4.0/</license-p></license></permissions><abstract><p>
 
 
  For the linear least squares problem with coefficient matrix columns being highly correlated, we develop a greedy randomized Gauss-Seidel method with oblique direction. Then the corresponding convergence result is deduced. Numerical examples demonstrate that our proposed method is superior to the greedy randomized Gauss-Seidel method and the randomized Gauss-Seidel method with oblique direction.
 
</p></abstract><kwd-group><kwd>Oblique Direction</kwd><kwd> Linear Least Squares Problem</kwd><kwd> Gauss-Seidel Method</kwd></kwd-group></article-meta></front><body><sec id="s1"><title>1. Introduction</title><p>We focus on the linear least squares problem</p><p>min β ∈ ℝ n ‖ y − X β ‖ 2 2 , (1)</p><p>where X ∈ ℝ m &#215; n ( m ≥ n ) is of full column rank, y ∈ ℝ m and ‖   ⋅   ‖ 2 denotes the Euclidean norm. There is a wide range of applications for the least squares problem in many fields, such as signal processing, image restoration, and so on. As we know, the coordinate descent method is an effective iteration method for (1). It applies the Gauss-Seidel method to the following equivalent normal Equation</p><p>X T X β = X T y , (2)</p><p>leading to the following formula</p><p>β k + 1 = β k + X j k T ( y − X β k ) ‖ X j k ‖ 2 2 e j k ,   j k = ( k mod n ) + 1,</p><p>where X j k denotes the j<sub>k</sub>th column of X , e j k is the j<sub>k</sub>th unit coordinate vector and the superscript T denotes the transpose. The convergence of the Gauss-Seidel method highly depends on the order of the column selected in each step.</p><p>Inspired by the fancy work of Strohmer and Vershynin [<xref ref-type="bibr" rid="scirp.124549-ref1">1</xref>] , Leventhal and Lewis [<xref ref-type="bibr" rid="scirp.124549-ref2">2</xref>] proposed the randomized Gauss-Seidel (RGS) method and proved that it has an expected linear convergence rate. As Bai and Wu [<xref ref-type="bibr" rid="scirp.124549-ref3">3</xref>] pointed out an obvious flaw of the RGS method that the probability for selecting column will be a uniform column sampling if the coefficient matrix is scaled with a diagonal matrix. To tackle this problem, they proposed the greedy randomized coordinate descent (GRCD) or called the greedy randomized Gauss-Seidel (GRGS) method by adopting an effective probability for selecting the working column to capture larger entries of the residual vector with respect to (2). They showed that the GRGS method is significantly superior to the RGS method in terms of both theoretical analysis and numerical experiments. In addition, there are tons of attention about the Gauss-Seidel type methods [<xref ref-type="bibr" rid="scirp.124549-ref4">4</xref>] [<xref ref-type="bibr" rid="scirp.124549-ref5">5</xref>] [<xref ref-type="bibr" rid="scirp.124549-ref6">6</xref>] [<xref ref-type="bibr" rid="scirp.124549-ref7">7</xref>] . However, the convergence rate of the RGS method will be significantly reduced when the coefficient matrix columns are highly correlated. To improve the convergence rate, Wang et al. [<xref ref-type="bibr" rid="scirp.124549-ref8">8</xref>] proposed the randomized Gauss-Seidel method with oblique direction (RGSO) by combining two successive selected unit coordinate directions as the search direction</p><p>d k = e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k . (3)</p><p>They showed that, in terms of both theory and experiments, the RGSO method outperforms the RGS method. For more discussions about the oblique projection, we refer the readers to other literatures [<xref ref-type="bibr" rid="scirp.124549-ref9">9</xref>] [<xref ref-type="bibr" rid="scirp.124549-ref10">10</xref>] and their references.</p><p>However, the RGSO method still exists in the same flaw of the RGS method that the probability for selecting column will be a uniform column sampling if the coefficient matrix is scaled with a diagonal matrix. In addition, it is worth noting that the convergence rate of the GRGS method would significantly decrease when the coefficient matrix columns are close to linear correlation. For the above mentioned limitations, we present a greedy randomized Gauss-Seidel method with oblique direction (GRGSO) for solving (1), by combining the oblique direction and the GRGS method. In theory, it is proved that the iterative solutions generated by the GRGSO method can converge to the least squares solution β * when the coefficient matrix is of full column rank. Numerical results show that compared with the RGSO and GRGS methods, the GRGSO method has a significant advantage over the iteration steps and computing time, especially when the coefficient matrix columns are highly correlated.</p><p>The organization of this paper is as follows. In Section 2, some notation and lemmas are introduced. In Section 3, we propose the GRGSO method for solving (1) and give its convergence analysis. Some examples are used to demonstrate the competitiveness of our proposed method in Section 4. Finally, we draw some brief conclusions in Section 5.</p></sec><sec id="s2"><title>2. Notion and Preliminaries</title><p>In the beginning of this section, we give some notation. For a Hermitian positive definite matrix B and a column vector β with appropriate dimension, we denote ‖ β ‖ B 2 = 〈 B β , β 〉 = ‖ B 1 2 β ‖ 2 2 and β ( i ) the ith entry of β . For a given matrix S ∈ ℝ m &#215; n , σ min ( S ) and ‖ S ‖ F denote the smallest nonzero singular value and the Frobenius norm of matrix S , respectively. Let r k = y − X β k and s k = X T r k , then s k ( j ) = X j T r k represents jth entry of s k . β * is the optimal solution of the corresponding problem. We indicate by E k the expected value conditional on the first k iterations, that is,</p><p>E k [ ⋅ ] = E [ ⋅ | j 0 , j 1 , ⋯ , j k − 1 ] ,</p><p>where j t , t = 0 , 1 , ⋯ , k − 1 is the column selected at the t-th iteration.</p><p>In the following, we give a basic lemma.</p><p>Lemma 1 (See Bai and Wu [<xref ref-type="bibr" rid="scirp.124549-ref11">11</xref>] ) If the vector u is in the column space of A T , it holds</p><p>‖ A u ‖ 2 2 ≥ σ min 2 ( A ) ‖ u ‖ 2 2 .</p></sec><sec id="s3"><title>3. GRGSO Method</title><p>In this section, we design the GRGSO method for solving (1), by combining the oblique direction with the GRGS method. The pseudo-code of GRGSO method is listed in <xref ref-type="table" rid="table1">Table 1</xref>. The difference between the RGSO method and GRGSO method is the selection strategy. The RGSO method utilizes the random selection strategy. Specially, the RGSO method selects j k + 1 th column with probability ‖ X j k + 1 ‖ 2 2 ‖ X ‖ F 2 in the numerical experiments, which can be equivalent to the uniform sampling if the Euclidean norms of all the columns of the matrix X are same; while the GRGSO method aims to grasp the larger entries of the residual vector at each iteration. Compared with the GRGS method, our proposed method considers the oblique projection, which is expected to have better convergence performance in some cases of coefficient matrix columns being highly correlated.</p><p>Remark Let t k = arg max 1 ≤ j ≤ n { | s k ( j ) | 2 2 ‖ X j ‖ 2 2 } , which implies t k ∈ V k . Therefore, for all iterative step k, the index set V k generated by the GRGSO method is nonempty.</p><p>Remark In the GRGSO method, it holds that</p><p>s k + 1 = X T r k + 1 = X T ( y − X β k + 1 ) = X T ( y − X ( β k + η k ( j k ) w j k ) ) = X T ( y − X β k ) − η k ( j k ) X T X w j k = s k − η k ( j k ) X T X w j k ,   ( k ≥ 1 ) (4)</p><table-wrap id="table1" ><label><xref ref-type="table" rid="table1">Table 1</xref></label><caption><title> GRGSO method</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Input: X ∈ ℝ m &#215; n , y ∈ ℝ m , β 0 ∈ ℝ n and l .</th></tr></thead><tr><td align="center" valign="middle" >Output: Approximate β l solving (1).</td></tr><tr><td align="center" valign="middle" >1. Randomly select j 1 ∈ { 1,2, ⋯ , n } with probability ‖ X j 1 ‖ 2 2 ‖ X ‖ F 2 and compute β 1 = β 0 + s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 e j 1 .</td></tr><tr><td align="center" valign="middle" >2. For k = 1 to l − 1 do</td></tr><tr><td align="center" valign="middle" >3. Compute δ k = 1 2 ( 1 ‖ s k ‖ 2 2 max 1 ≤ j ≤ n { | s k ( j ) | 2 ‖ X j ‖ 2 2 } + 1 ‖ X ‖ F 2 ) .</td></tr><tr><td align="center" valign="middle" >4. Construct set V k = { j : | s k ( j ) | 2 ≥ δ k ‖ s k ‖ 2 2 ‖ X j ‖ 2 2 } .</td></tr><tr><td align="center" valign="middle" >5. Compute s ˜ k ( j ) = { s k ( j ) , if   j ∈ V k , 0, otherwise .</td></tr><tr><td align="center" valign="middle" >6. Select j k + 1 ∈ V k with probability | s ˜ k ( j k + 1 ) | 2 ‖ s ˜ k ‖ 2 2 .</td></tr><tr><td align="center" valign="middle" >7. Compute w j k = e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k and h j k = X j k + 1 T X w j k .</td></tr><tr><td align="center" valign="middle" >8. Set β k + 1 = β k + η k ( j k ) w j k , where η k ( j k ) = s ˜ k ( j k + 1 ) h j k .</td></tr><tr><td align="center" valign="middle" >9. End for</td></tr></tbody></table></table-wrap><p>and</p><p>s 1 = X T r 1 = X T ( y − X β 1 ) = X T ( y − X ( β 0 + s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 e j 1 ) ) = X T ( y − X β 0 ) − s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 X T X j 1 = s 0 − s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 X T X j 1 . (5)</p><p>Therefore, the GRGSO method can be executed more effectively if X T X can be computed in an economical manner at the beginning.</p><p>Next, we give some lemmas which are useful to analyze the convergence of the GRGSO method.</p><p>Lemma 2 For the GRGSO method, we have</p><p>s k ( j k ) = 0 ,   ( ∀ k &gt; 0 ) , (6)</p><p>s k ( j k − 1 ) = 0 ,   ( ∀ k &gt; 1 ) . (7)</p><p>Proof. For k = 1 , one has</p><p>s 1 ( j 1 ) = X j 1 T ( y − X β 1 ) = X j 1 T y − X j 1 T X ( β 0 + s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 e j 1 ) = 0. (8)</p><p>For k &gt; 1 , we have</p><p>s k ( j k ) = X j k T ( y − X β k ) = X j k T y − X j k T X ( β k − 1 + η k − 1 ( j k − 1 ) w j k − 1 ) = X j k T y − X j k T X β k − 1 − η k − 1 ( j k − 1 ) ( X j k T X w j k − 1 ) = s ˜ k − 1 ( j k ) − s ˜ k − 1 ( j k ) h j k − 1 h j k − 1 = 0,</p><p>which together with (8) proves (6).</p><p>By (6), it follows for k &gt; 0 that</p><p>s k + 1 ( j k ) = X j k T ( y − X β k + 1 ) = X j k T y − X j k T X ( β k + η k ( j k ) w j k ) = s k ( j k ) − η k ( j k ) ( X j k T X w j k ) = − η k ( j k ) ( X j k T X ( e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k ) ) = 0,</p><p>which leads to (7).</p><p>Remark From (6) and (7), it is obvious that in kth iteration, the GRGSO method dose not select j k , j k − 1 , which means j k + 1 ≠ j k , j k − 1 . Thus, the direction w j k can be the combination of two unit coordinate directions. This is also the advantage of the GRGSO method compared with the RGSO method. Since the RGSO method randomly selects j k + 1 in the kth iteration, which can not avoid selecting j k and j k − 1 while the GRGSO method can avoid.</p><p>Lemma 3 For h j k in the GRGSO method, it satisfies</p><p>h j k = ‖ X w j k ‖ 2 2 = ‖ X j k + 1 ‖ 2 2 − | X j k T X j k + 1 | 2 ‖ X j k ‖ 2 2 ≤ Δ ‖ X j k + 1 ‖ 2 2 ,</p><p>where Δ = max i ≠ j sin 2 〈 X i , X j 〉 .</p><p>Proof. Since j k ≠ j k + 1 , it holds that</p><p>h j k = X j k + 1 T X ( e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k ) = ‖ X j k + 1 ‖ 2 2 − | X j k T X j k + 1 | 2 ‖ X j k ‖ 2 2 = ‖ X j k + 1 ‖ 2 2 − ‖ X j k ‖ 2 2 ‖ X j k + 1 ‖ 2 2 cos 2 〈 X j k , X j k + 1 〉 ‖ X j k ‖ 2 2 = sin 2 〈 X j k , X j k + 1 〉 ‖ X j k + 1 ‖ 2 2 ≤ Δ ‖ X j k + 1 ‖ 2 2</p><p>and</p><p>‖ X w j k ‖ 2 2 = ( e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k ) T X T X ( e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k ) = ‖ X j k + 1 ‖ 2 2 − | X j k T X j k + 1 | 2 ‖ X j k ‖ 2 2 .</p><p>Hence, we complete this proof.</p><p>Lemma 4 The iteration sequence { β k } k = 0 ∞ generated by the GRGSO method satisfies</p><p>‖ X ( β k + 1 − β * ) ‖ 2 2 = ‖ X ( β k − β * ) ‖ 2 2 − ‖ X ( β k + 1 − β k ) ‖ 2 2 ,   k = 0,1,2, ⋯ .</p><p>Proof. For k = 0 , we have</p><p>e j 1 T X T X ( β 1 − β * ) = X j 1 T X ( β 0 − β * + s 0 ( j 1 ) ‖ X j 1 ‖ 2 2 e j 1 ) = X j 1 T X β 0 − X j 1 T X β * + s 0 ( j 1 ) = 0.</p><p>This means that the vector X T X ( β 1 − β * ) is perpendicular to the vector e j 1 . Since β 1 − β 0 is parallel to e j 1 , the vector X T X ( β 1 − β * ) is perpendicular to β 1 − β 0 .</p><p>For k &gt; 0 , It follows from Lemma 3 and Lemma 2 that</p><p>w j k T X T X ( β k + 1 − β * ) = w j k T X T X ( β k − β * + η k ( j k ) w j k ) = w j k T ( − s k + η k ( j k ) X T X w j k ) = − w j k T s k + η k ( j k ) ‖ X w j k ‖ 2 2 = − ( e j k + 1 − X j k T X j k + 1 ‖ X j k ‖ 2 2 e j k ) T s k + s ˜ k ( j k + 1 ) = − s k ( j k + 1 ) + X j k T X j k + 1 ‖ X j k ‖ 2 2 s k ( j k ) + s ˜ k ( j k + 1 ) = 0,</p><p>which means that the vector X T X ( β k + 1 − β * ) is perpendicular to the vector w j k . Since β k + 1 − β k is parallel to w j k , the vector X T X ( β k + 1 − β * ) is perpendicular to β k + 1 − β k . For all k = 0,1, ⋯ , it follows that</p><p>〈 X ( β k + 1 − β * ) , X ( β k + 1 − β k ) 〉 = 〈 X T X ( β k + 1 − β * ) , β k + 1 − β k 〉 = 0,</p><p>which together with Pythagoras theorem leads to the desired result.</p><p>Next, the convergence theory of the GRGSO method is deduced.</p><p>Theorem 5 For the least squares problem (1), the iteration sequence { β k } k = 0 ∞ generated by the GRGSO method from any initial guess β 0 satisfies</p><p>E ‖ X ( β k − β * ) ‖ 2 2 ≤ ∏ t = 0 k − 1     ζ t ‖ X ( β 0 − β * ) ‖ 2 2 ,   for     k = 1,2, ⋯ , (9)</p><p>where ζ 0 = 1 − σ min 2 ( X ) ‖ X ‖ F 2 , ζ 1 = 1 − 1 2 ( 1 γ 1 + 1 ‖ X ‖ F 2 ) σ min 2 ( X ) Δ , ζ t = 1 − 1 2 ( 1 γ 2 + 1 ‖ X ‖ F 2 ) σ min 2 ( X ) Δ ( t &gt; 1 ). Here γ 1 = max 1 ≤ i ≤ n ∑ j = 1 j ≠ i n ‖ X j ‖ 2 2 , γ 2 = max 1 ≤ i , j ≤ n i ≠ j ∑ t = 1 t ≠ i , j n ‖ X t ‖ 2 2 and Δ is given as in Lemma 3.</p><p>Proof. By Lemma 2, it follows for k &gt; 1 that</p><p>δ k ‖ X ‖ F 2 = 1 2 ( ‖ X ‖ F 2 ‖ s k ‖ 2 2 max 1 ≤ j ≤ n { | s k ( j ) | 2 ‖ X j ‖ 2 2 } + 1 ) = 1 2 ( max 1 ≤ j ≤ n { | s k ( j ) | 2 ‖ X j ‖ 2 2 } ∑ j = 1 n ‖ X j ‖ 2 2 ‖ X ‖ F 2 | s k ( j ) | 2 ‖ X j ‖ 2 2 + 1 ) = 1 2 ( max 1 ≤ j ≤ n { | s k ( j ) | 2 ‖ X j ‖ 2 2 } ∑ j = 1 j ≠ j k , j k − 1 n ‖ X j ‖ 2 2 ‖ X ‖ F 2 | s k ( j ) | 2 ‖ X j ‖ 2 2 + 1 ) ≥ 1 2 ( ‖ X ‖ F 2 ∑ j = 1 j ≠ j k , j k − 1 n ‖ X j ‖ 2 2 + 1 ) ≥ 1 2 ( ‖ X ‖ F 2 γ 2 + 1 ) . (10)</p><p>For k = 1 , it follows from (6) that</p><p>δ 1 ‖ X ‖ F 2 = 1 2 ( ‖ X ‖ F 2 ‖ s 1 ‖ 2 2 max 1 ≤ j ≤ n { | s 1 ( j ) | 2 ‖ X j ‖ 2 2 } + 1 ) = 1 2 ( max 1 ≤ j ≤ n { | s 1 ( j ) | 2 ‖ X j ‖ 2 2 } ∑ j = 1 n ‖ X j ‖ 2 2 ‖ X ‖ F 2 | s 1 ( j ) | 2 ‖ X j ‖ 2 2 + 1 ) = 1 2 ( max 1 ≤ j ≤ n { | s 1 ( j ) | 2 ‖ X j ‖ 2 2 } ∑ j = 1 j ≠ j 1 n ‖ X j ‖ 2 2 ‖ X ‖ F 2 | s 1 ( j ) | 2 ‖ X j ‖ 2 2 + 1 ) ≥ 1 2 ( ‖ X ‖ F 2 ∑ j = 1 j ≠ j 1 n ‖ X j ‖ 2 2 + 1 ) ≥ 1 2 ( ‖ X ‖ F 2 γ 1 + 1 ) . (11)</p><p>By Lemma 4, Lemma 3 and Lemma 1, for k ≥ 1 , we have</p><p>E k ‖ X ( β k + 1 − β * ) ‖ 2 2 = ‖ X ( β k − β * ) ‖ 2 2 − E k ‖ X ( β k + 1 − β k ) ‖ 2 2 = ‖ X ( β k − β * ) ‖ 2 2 − ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 ‖ η k ( j k ) ( X w j k ) ‖ 2 = ‖ X ( β k − β * ) ‖ 2 2 − ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 | s ˜ k ( j k + 1 ) | 2 ‖ X w j k ‖ 2 2 | h j k | 2 = ‖ X ( β k − β * ) ‖ 2 2 − ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 | s ˜ k ( j k + 1 ) | 2 h j k</p><p>≤ ‖ X ( β k − β * ) ‖ 2 2 − ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 ∑ j k + 1 ∈ V k | s ˜ k ( j k + 1 ) | 2 | s ˜ k ( j k + 1 ) | 2 Δ ‖ X j k + 1 ‖ 2 2 ≤ ‖ X ( β k − β * ) ‖ 2 2 − δ k Δ ‖ s k ‖ 2 2 = ‖ X ( β k − β * ) ‖ 2 2 − δ k Δ ‖ X T X ( β k − β * ) ‖ 2 2 ≤ ( 1 − δ k σ min 2 ( X ) Δ ) ‖ X ( β k − β * ) ‖ 2 2 ,</p><p>which together with (11) and (10) can lead to</p><p>E 1 ‖ X ( β 2 − β * ) ‖ 2 2 ≤ ζ 1 ‖ X ( β 1 − β * ) ‖ 2 2 (12)</p><p>and</p><p>E k ‖ X ( β k + 1 − β * ) ‖ 2 2 ≤ ζ ‖ X ( β k − β * ) ‖ 2 2 ,   k &gt; 1, (13)</p><p>respectively. For k = 0 , we can similarly get</p><p>E ‖ X ( β 1 − β * ) ‖ 2 2 ≤ ζ 0 ‖ X ( β 0 − β * ) ‖ 2 2 .</p><p>Then taking the full expectation on both sides of (12) and (13) and by induction on the iteration index k, we can easily obtain (9). Thus, we complete the proof.</p><p>Remark Suppose that the upper bound for convergence rate of the GRGS method [<xref ref-type="bibr" rid="scirp.124549-ref3">3</xref>] is defined as</p><p>ρ G R C D = 1 − 1 2 ( 1 γ 1 + 1 ‖ X ‖ F 2 ) σ min 2 ( X ) .</p><p>Since Δ = max i ≠ j sin 2 〈 X i , X j 〉 ∈ ( 0,1 ] , γ 2 &lt; γ 1 &lt; ‖ X ‖ F 2 and 0 &lt; σ min 2 ( X ) ≤ ‖ X ‖ F 2 , we have</p><p>ζ &lt; ζ 1 ≤ ρ G R C D &lt; ζ 0 &lt; 1.</p><p>This implies that the upper bound on the convergence factor of the GRGSO method is smaller, uniformly with respect to the iterative step k, than that of the GRCD method.</p></sec><sec id="s4"><title>4. Numerical Experiments</title><p>Some examples are designed in this section to verify the effectiveness of the GRGSO method. Specially, the GRGSO method is compared with the GRGS method [<xref ref-type="bibr" rid="scirp.124549-ref3">3</xref>] , RGS method [<xref ref-type="bibr" rid="scirp.124549-ref2">2</xref>] and RGSO method [<xref ref-type="bibr" rid="scirp.124549-ref8">8</xref>] . We list the tested results of these methods in terms of the number of iteration steps (denoted by “IT”) and the running time in seconds (denoted by “CPU”).</p><p>The coefficient matrix X ∈ ℝ m &#215; n ( m ≥ n ) in numerical experiments is from two sources. One is the random matrix whose entries are randomly taken from the interval [ c ,1 ] ( c ≥ 0 ) by using the function rand in MATLAB. c being close to 1 implies that the matrix columns are highly correlated. Another is sparse matrices from the literature [<xref ref-type="bibr" rid="scirp.124549-ref12">12</xref>] listed in <xref ref-type="table" rid="table2">Table 2</xref>. We use cond ( X ) to represent the condition number for X , and define the density as</p><p>density = number   of   nonzero   entries   of   an     m &#215; n     matrix   m &#215; n .</p><p>We randomly generate the true vector β * by utilizing the MATLAB function randn and construct the vector y by y = X β * when the linear system is consistent; while for the inconsistent linear systems the right-hand side is set by y = X β * + n o i s e , where n o i s e ∈ n u l l ( X T ) . We take zero vector for the initial approximation of each iteration process. Since</p><p>‖ X ( β k − β * ) ‖ 2 2 = ‖ X β * + n o i s e − r k − X β * ‖ 2 2 = ‖ n o i s e − r k ‖ 2 2 ,</p><p>which was also used in the work of Wang et al. [<xref ref-type="bibr" rid="scirp.124549-ref8">8</xref>] , we terminate the iteration process once</p><p>R S E = ‖ n o i s e − r k ‖ 2 ‖ y ‖ 2 &lt; 10 − 6 .</p><p>We set “-” in the numerical tables if the number of iteration steps exceeds 300,000. All the results are averages from 20 repetitions. All experiments were implemented by using MATLAB (R2021b) on a computer with 2.30 GHz central processing unit (Intel(R) Core(TM) i7-10875H CPU), 16 GB memory.</p><table-wrap id="table2" ><label><xref ref-type="table" rid="table2">Table 2</xref></label><caption><title> Sparse matrix properties of realistic problems [<xref ref-type="bibr" rid="scirp.124549-ref12">12</xref>] </title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Name</th><th align="center" valign="middle" >m &#215; n</th><th align="center" valign="middle" >density</th><th align="center" valign="middle" >cond(X)</th></tr></thead><tr><td align="center" valign="middle" >abtaha1</td><td align="center" valign="middle" >14,596 &#215; 209</td><td align="center" valign="middle" >1.68%</td><td align="center" valign="middle" >12.23</td></tr><tr><td align="center" valign="middle" >Cities</td><td align="center" valign="middle" >55 &#215; 46</td><td align="center" valign="middle" >53.04%</td><td align="center" valign="middle" >207.17</td></tr><tr><td align="center" valign="middle" >WorldCities</td><td align="center" valign="middle" >315 &#215; 100</td><td align="center" valign="middle" >23.87%</td><td align="center" valign="middle" >66.00</td></tr><tr><td align="center" valign="middle" >ash219</td><td align="center" valign="middle" >219 &#215; 85</td><td align="center" valign="middle" >2.35%</td><td align="center" valign="middle" >3.02</td></tr><tr><td align="center" valign="middle" >divorce</td><td align="center" valign="middle" >50 &#215; 9</td><td align="center" valign="middle" >50.00%</td><td align="center" valign="middle" >19.39</td></tr></tbody></table></table-wrap><p>For the randomly generated matrices, with c = 0 , the numerical results for consistent and inconsistent linear systems are listed in <xref ref-type="table" rid="table3">Table 3</xref> and <xref ref-type="table" rid="table4">Table 4</xref>, respectively. It is easy to observe from <xref ref-type="table" rid="table3">Table 3</xref> and <xref ref-type="table" rid="table4">Table 4</xref> that the GRGSO method significantly outperforms the RGS, GRGS and RGSO methods in terms of both IT and CPU.</p><p>In the following, we compare these methods for solving (1) when the randomly generated matrix is with different c. We list the numerical results for the consistent and inconsistent systems in <xref ref-type="table" rid="table5">Table 5</xref> and <xref ref-type="table" rid="table6">Table 6</xref>, respectively. From <xref ref-type="table" rid="table5">Table 5</xref> and <xref ref-type="table" rid="table6">Table 6</xref>, it is easy to observe that the IT and CPU of the RGS and GRGS methods increase significantly with c increasing closer to 1. When c increases to 0.8, the IT of the RGS method exceeds the maximal number of iteration steps. And when c increases to 0.9, the IT of the GRGS method exceeds the maximal number of iteration steps. For the different c values, the methods with the oblique direction outperform the methods without the oblique direction. In addition, compared with the other methods, the GRGSO method performs best in terms of both IT and CPU.</p><p>For the full-rank sparse matrices from literature [<xref ref-type="bibr" rid="scirp.124549-ref12">12</xref>] , the numerical results for the consistent and inconsistent linear systems are listed in <xref ref-type="table" rid="table7">Table 7</xref> and <xref ref-type="table" rid="table8">Table 8</xref>, respectively. It can be seen that for the matrix abtaha1 the performance of the GRGSO method is similar to that of the GRGS method in terms of both IT and CPU, whereas for the other matrices the GRGSO method significantly performs better in terms of both IT and CPU than the other methods.</p><table-wrap id="table3" ><label><xref ref-type="table" rid="table3">Table 3</xref></label><caption><title> The consistent system with c = 0 : different m impacts on IT and CPU</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >m &#215; n</th><th align="center" valign="middle" >1000 &#215; 100</th><th align="center" valign="middle" >2000 &#215; 100</th><th align="center" valign="middle" >3000 &#215; 100</th><th align="center" valign="middle" >4000 &#215; 100</th><th align="center" valign="middle" >5000 &#215; 100</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >9650</td><td align="center" valign="middle" >8082</td><td align="center" valign="middle" >7113</td><td align="center" valign="middle" >7378</td><td align="center" valign="middle" >7209</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.1919</td><td align="center" valign="middle" >0.1858</td><td align="center" valign="middle" >0.1859</td><td align="center" valign="middle" >0.2716</td><td align="center" valign="middle" >0.2953</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >3271</td><td align="center" valign="middle" >2753</td><td align="center" valign="middle" >2266</td><td align="center" valign="middle" >2581</td><td align="center" valign="middle" >2538</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0708</td><td align="center" valign="middle" >0.0664</td><td align="center" valign="middle" >0.0622</td><td align="center" valign="middle" >0.1003</td><td align="center" valign="middle" >0.1078</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >3914</td><td align="center" valign="middle" >3553</td><td align="center" valign="middle" >3243</td><td align="center" valign="middle" >3509</td><td align="center" valign="middle" >3499</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0921</td><td align="center" valign="middle" >0.0980</td><td align="center" valign="middle" >0.1092</td><td align="center" valign="middle" >0.1739</td><td align="center" valign="middle" >0.2113</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >755</td><td align="center" valign="middle" >761</td><td align="center" valign="middle" >739</td><td align="center" valign="middle" >828</td><td align="center" valign="middle" >860</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0190</td><td align="center" valign="middle" >0.0210</td><td align="center" valign="middle" >0.0246</td><td align="center" valign="middle" >0.0412</td><td align="center" valign="middle" >0.0536</td></tr></tbody></table></table-wrap><table-wrap id="table4" ><label><xref ref-type="table" rid="table4">Table 4</xref></label><caption><title> The inconsistent system with c = 0 : different m impacts on IT and CPU</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >m &#215; n</th><th align="center" valign="middle" >1000 &#215; 100</th><th align="center" valign="middle" >2000 &#215; 100</th><th align="center" valign="middle" >3000 &#215; 100</th><th align="center" valign="middle" >4000 &#215; 100</th><th align="center" valign="middle" >5000 &#215; 100</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >9499</td><td align="center" valign="middle" >7926</td><td align="center" valign="middle" >7310</td><td align="center" valign="middle" >7287</td><td align="center" valign="middle" >6910</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.1958</td><td align="center" valign="middle" >0.1821</td><td align="center" valign="middle" >0.1927</td><td align="center" valign="middle" >0.3039</td><td align="center" valign="middle" >0.2766</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >2812</td><td align="center" valign="middle" >2550</td><td align="center" valign="middle" >2530</td><td align="center" valign="middle" >2547</td><td align="center" valign="middle" >2390</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0648</td><td align="center" valign="middle" >0.0610</td><td align="center" valign="middle" >0.0715</td><td align="center" valign="middle" >0.1113</td><td align="center" valign="middle" >0.1018</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >3715</td><td align="center" valign="middle" >3519</td><td align="center" valign="middle" >3464</td><td align="center" valign="middle" >3525</td><td align="center" valign="middle" >3285</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0890</td><td align="center" valign="middle" >0.0985</td><td align="center" valign="middle" >0.1187</td><td align="center" valign="middle" >0.1952</td><td align="center" valign="middle" >0.1966</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >706</td><td align="center" valign="middle" >753</td><td align="center" valign="middle" >787</td><td align="center" valign="middle" >829</td><td align="center" valign="middle" >800</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0171</td><td align="center" valign="middle" >0.0201</td><td align="center" valign="middle" >0.0269</td><td align="center" valign="middle" >0.0472</td><td align="center" valign="middle" >0.0488</td></tr></tbody></table></table-wrap><table-wrap id="table5" ><label><xref ref-type="table" rid="table5">Table 5</xref></label><caption><title> The consistent system with X ∈ ℝ 1000 &#215; 100 : different c impacts on IT and CPU</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >c</th><th align="center" valign="middle" >0.1</th><th align="center" valign="middle" >0.2</th><th align="center" valign="middle" >0.3</th><th align="center" valign="middle" >0.4</th><th align="center" valign="middle" >0.5</th><th align="center" valign="middle" >0.6</th><th align="center" valign="middle" >0.7</th><th align="center" valign="middle" >0.8</th><th align="center" valign="middle" >0.9</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >13902</td><td align="center" valign="middle" >17612</td><td align="center" valign="middle" >26137</td><td align="center" valign="middle" >42060</td><td align="center" valign="middle" >66402</td><td align="center" valign="middle" >98900</td><td align="center" valign="middle" >237339</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.2800</td><td align="center" valign="middle" >0.3624</td><td align="center" valign="middle" >0.5472</td><td align="center" valign="middle" >0.9380</td><td align="center" valign="middle" >1.4841</td><td align="center" valign="middle" >2.2364</td><td align="center" valign="middle" >5.2936</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >4096</td><td align="center" valign="middle" >5436</td><td align="center" valign="middle" >8152</td><td align="center" valign="middle" >11374</td><td align="center" valign="middle" >22992</td><td align="center" valign="middle" >28719</td><td align="center" valign="middle" >75396</td><td align="center" valign="middle" >154734</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0902</td><td align="center" valign="middle" >0.1223</td><td align="center" valign="middle" >0.1814</td><td align="center" valign="middle" >0.2748</td><td align="center" valign="middle" >0.5540</td><td align="center" valign="middle" >0.6953</td><td align="center" valign="middle" >1.8127</td><td align="center" valign="middle" >3.7762</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >4103</td><td align="center" valign="middle" >3864</td><td align="center" valign="middle" >3934</td><td align="center" valign="middle" >4266</td><td align="center" valign="middle" >4264</td><td align="center" valign="middle" >3680</td><td align="center" valign="middle" >4356</td><td align="center" valign="middle" >3860</td><td align="center" valign="middle" >3445</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0985</td><td align="center" valign="middle" >0.0952</td><td align="center" valign="middle" >0.0977</td><td align="center" valign="middle" >0.1127</td><td align="center" valign="middle" >0.1115</td><td align="center" valign="middle" >0.0972</td><td align="center" valign="middle" >0.1158</td><td align="center" valign="middle" >0.1031</td><td align="center" valign="middle" >0.0884</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >765</td><td align="center" valign="middle" >740</td><td align="center" valign="middle" >774</td><td align="center" valign="middle" >800</td><td align="center" valign="middle" >816</td><td align="center" valign="middle" >704</td><td align="center" valign="middle" >834</td><td align="center" valign="middle" >761</td><td align="center" valign="middle" >681</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0203</td><td align="center" valign="middle" >0.0186</td><td align="center" valign="middle" >0.0197</td><td align="center" valign="middle" >0.0213</td><td align="center" valign="middle" >0.0220</td><td align="center" valign="middle" >0.0196</td><td align="center" valign="middle" >0.0226</td><td align="center" valign="middle" >0.0203</td><td align="center" valign="middle" >0.0184</td></tr></tbody></table></table-wrap><table-wrap id="table6" ><label><xref ref-type="table" rid="table6">Table 6</xref></label><caption><title> The inconsistent system with X ∈ ℝ 1000 &#215; 100 : different c impacts on IT and CPU</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >c</th><th align="center" valign="middle" >0.1</th><th align="center" valign="middle" >0.2</th><th align="center" valign="middle" >0.3</th><th align="center" valign="middle" >0.4</th><th align="center" valign="middle" >0.5</th><th align="center" valign="middle" >0.6</th><th align="center" valign="middle" >0.7</th><th align="center" valign="middle" >0.8</th><th align="center" valign="middle" >0.9</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >13212</td><td align="center" valign="middle" >17463</td><td align="center" valign="middle" >25396</td><td align="center" valign="middle" >36517</td><td align="center" valign="middle" >59507</td><td align="center" valign="middle" >113307</td><td align="center" valign="middle" >197337</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.2773</td><td align="center" valign="middle" >0.3815</td><td align="center" valign="middle" >0.5726</td><td align="center" valign="middle" >0.8210</td><td align="center" valign="middle" >1.3082</td><td align="center" valign="middle" >2.5499</td><td align="center" valign="middle" >4.5799</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >4373</td><td align="center" valign="middle" >5373</td><td align="center" valign="middle" >7890</td><td align="center" valign="middle" >11197</td><td align="center" valign="middle" >19498</td><td align="center" valign="middle" >33295</td><td align="center" valign="middle" >60924</td><td align="center" valign="middle" >147676</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.1006</td><td align="center" valign="middle" >0.1272</td><td align="center" valign="middle" >0.1917</td><td align="center" valign="middle" >0.2680</td><td align="center" valign="middle" >0.4583</td><td align="center" valign="middle" >0.8193</td><td align="center" valign="middle" >1.5151</td><td align="center" valign="middle" >3.5326</td><td align="center" valign="middle" >-</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >3949</td><td align="center" valign="middle" >3740</td><td align="center" valign="middle" >3997</td><td align="center" valign="middle" >3692</td><td align="center" valign="middle" >3936</td><td align="center" valign="middle" >4185</td><td align="center" valign="middle" >3729</td><td align="center" valign="middle" >3490</td><td align="center" valign="middle" >3266</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0995</td><td align="center" valign="middle" >0.0998</td><td align="center" valign="middle" >0.1075</td><td align="center" valign="middle" >0.0980</td><td align="center" valign="middle" >0.1027</td><td align="center" valign="middle" >0.1145</td><td align="center" valign="middle" >0.1035</td><td align="center" valign="middle" >0.0929</td><td align="center" valign="middle" >0.0890</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >745</td><td align="center" valign="middle" >716</td><td align="center" valign="middle" >769</td><td align="center" valign="middle" >731</td><td align="center" valign="middle" >762</td><td align="center" valign="middle" >815</td><td align="center" valign="middle" >711</td><td align="center" valign="middle" >691</td><td align="center" valign="middle" >632</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >0.0197</td><td align="center" valign="middle" >0.0193</td><td align="center" valign="middle" >0.0216</td><td align="center" valign="middle" >0.0198</td><td align="center" valign="middle" >0.0207</td><td align="center" valign="middle" >0.0221</td><td align="center" valign="middle" >0.0201</td><td align="center" valign="middle" >0.0183</td><td align="center" valign="middle" >0.0177</td></tr></tbody></table></table-wrap><table-wrap id="table7" ><label><xref ref-type="table" rid="table7">Table 7</xref></label><caption><title> The consistent system: IT and CPU time of test methods for different sparse matrices</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >Name</th><th align="center" valign="middle" >abtaha1</th><th align="center" valign="middle" >Cities</th><th align="center" valign="middle" >WorldCities</th><th align="center" valign="middle" >ash219</th><th align="center" valign="middle" >divorce</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >167141</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >76327</td><td align="center" valign="middle" >3785</td><td align="center" valign="middle" >5312</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >16.6240</td><td align="center" valign="middle" >-</td><td align="center" valign="middle" >1.4365</td><td align="center" valign="middle" >0.0665</td><td align="center" valign="middle" >0.0581</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >27246</td><td align="center" valign="middle" >96279</td><td align="center" valign="middle" >8069</td><td align="center" valign="middle" >654</td><td align="center" valign="middle" >1025</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >2.8197</td><td align="center" valign="middle" >1.3852</td><td align="center" valign="middle" >0.1640</td><td align="center" valign="middle" >0.0129</td><td align="center" valign="middle" >0.0120</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >164535</td><td align="center" valign="middle" >245186</td><td align="center" valign="middle" >56391</td><td align="center" valign="middle" >3598</td><td align="center" valign="middle" >244</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >22.0450</td><td align="center" valign="middle" >3.6255</td><td align="center" valign="middle" >1.2173</td><td align="center" valign="middle" >0.0720</td><td align="center" valign="middle" >0.0031</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >26670</td><td align="center" valign="middle" >25115</td><td align="center" valign="middle" >3163</td><td align="center" valign="middle" >609</td><td align="center" valign="middle" >79</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >3.5948</td><td align="center" valign="middle" >0.3780</td><td align="center" valign="middle" >0.0695</td><td align="center" valign="middle" >0.0122</td><td align="center" valign="middle" >0.0010</td></tr></tbody></table></table-wrap><table-wrap id="table8" ><label><xref ref-type="table" rid="table8">Table 8</xref></label><caption><title> The inconsistent system: IT and CPU time of test methods for different sparse matrices</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Method</th><th align="center" valign="middle" >Name</th><th align="center" valign="middle" >abtaha1</th><th align="center" valign="middle" >Cities</th><th align="center" valign="middle" >WorldCities</th><th align="center" valign="middle" >ash219</th><th align="center" valign="middle" >divorce</th></tr></thead><tr><td align="center" valign="middle" >RGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >166432</td><td align="center" valign="middle" >297734</td><td align="center" valign="middle" >70098</td><td align="center" valign="middle" >3502</td><td align="center" valign="middle" >5554</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >16.9889</td><td align="center" valign="middle" >3.9135</td><td align="center" valign="middle" >1.3268</td><td align="center" valign="middle" >0.0645</td><td align="center" valign="middle" >0.0608</td></tr><tr><td align="center" valign="middle" >GRGS</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >24268</td><td align="center" valign="middle" >92576</td><td align="center" valign="middle" >8204</td><td align="center" valign="middle" >676</td><td align="center" valign="middle" >959</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >2.5255</td><td align="center" valign="middle" >1.3239</td><td align="center" valign="middle" >0.1729</td><td align="center" valign="middle" >0.0140</td><td align="center" valign="middle" >0.0113</td></tr><tr><td align="center" valign="middle" >RGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >168963</td><td align="center" valign="middle" >220109</td><td align="center" valign="middle" >52808</td><td align="center" valign="middle" >3464</td><td align="center" valign="middle" >260</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >22.9293</td><td align="center" valign="middle" >3.2584</td><td align="center" valign="middle" >1.1308</td><td align="center" valign="middle" >0.0723</td><td align="center" valign="middle" >0.0033</td></tr><tr><td align="center" valign="middle" >GRGSO</td><td align="center" valign="middle" >IT</td><td align="center" valign="middle" >23454</td><td align="center" valign="middle" >23230</td><td align="center" valign="middle" >3216</td><td align="center" valign="middle" >632</td><td align="center" valign="middle" >81</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >CPU</td><td align="center" valign="middle" >3.2018</td><td align="center" valign="middle" >0.3560</td><td align="center" valign="middle" >0.0732</td><td align="center" valign="middle" >0.0145</td><td align="center" valign="middle" >0.0010</td></tr></tbody></table></table-wrap></sec><sec id="s5"><title>5. Conclusion</title><p>In this manuscript, we construct the GRGSO method for the linear least squares problem. We have established the convergence analyses of the GRGSO method. Numerical experiments show that the GRGSO method is superior to the RGS, GRGS and RGSO methods in terms of both IT and CPU, especially when the coefficient matrix columns are highly correlated. It is natural to generalize the GRGSO method by introducing a relaxation parameter in its probability criterion. However, the choice of the optimal relaxation parameter is difficult in theory up to now. How to find the optimal relaxation parameter in theory is worthy of further study.</p></sec><sec id="s6"><title>Conflicts of Interest</title><p>The authors declare no conflicts of interest regarding the publication of this paper.</p></sec><sec id="s7"><title>Cite this paper</title><p>Li, W.F. and Zhang, P.P. (2023) Greedy Randomized Gauss-Seidel Method with Oblique Direction. Journal of Applied Mathematics and Physics, 11, 1036-1048. https://doi.org/10.4236/jamp.2023.114068</p></sec></body><back><ref-list><title>References</title><ref id="scirp.124549-ref1"><label>1</label><mixed-citation publication-type="other" xlink:type="simple">Strohmer, T. and Vershynin, R. (2009) A Randomized Kaczmarz Algorithm with Exponential Convergence. Journal of Fourier Analysis and Applications, 15, 262-278. https://doi.org/10.1007/s00041-008-9030-4</mixed-citation></ref><ref id="scirp.124549-ref2"><label>2</label><mixed-citation publication-type="other" xlink:type="simple">Leventhal, D. and Lewis, A.S. (2010) Randomized Methods for Linear Constraints: Convergence Rates and Conditioning. Mathematics of Operations Research, 35, 641-654. https://doi.org/10.1287/moor.1100.0456</mixed-citation></ref><ref id="scirp.124549-ref3"><label>3</label><mixed-citation publication-type="other" xlink:type="simple">Bai, Z.Z. and Wu, W.T. (2019) On Greedy Randomized Coordinate Descent Methods for Solving Large Linear Least-Squares Problems. Numerical Linear Algebra with Applications, 26, e2237. https://doi.org/10.1002/nla.2237</mixed-citation></ref><ref id="scirp.124549-ref4"><label>4</label><mixed-citation publication-type="other" xlink:type="simple">Du, K. (2019) Tight Upper Bounds for the Convergence of the Randomized Extended Kaczmarz and Gauss-Seidel Algorithms. Numerical Linear Algebra with Applications, 26, e2233. https://doi.org/10.1002/nla.2233</mixed-citation></ref><ref id="scirp.124549-ref5"><label>5</label><mixed-citation publication-type="other" xlink:type="simple">Liu, Y., Jiang, X.L. and Gu, C.Q. (2021) On Maximum Residual Block and Two-Step Gauss-Seidel Algorithms for Linear Least-Squares Problems. Calcolo, 58, Article No. 13. https://doi.org/10.1007/s10092-021-00404-x</mixed-citation></ref><ref id="scirp.124549-ref6"><label>6</label><mixed-citation publication-type="other" xlink:type="simple">Zhang, J.H. and Guo, J.H. (2020) On Relaxed Greedy Randomized Coordinate Descent Methods for Solving Large Linear Least-Squares Problems. Applied Numerical Mathematics, 157, 372-384. https://doi.org/10.1016/j.apnum.2020.06.014</mixed-citation></ref><ref id="scirp.124549-ref7"><label>7</label><mixed-citation publication-type="other" xlink:type="simple">Niu, Y.Q. and Zheng, B. (2021) A New Randomzied Gauss-Seidel Method for Solving Linear Least-Squares Problems. Applied Mathematics Letters, 116, Article ID: 107057. https://doi.org/10.1016/j.aml.2021.107057</mixed-citation></ref><ref id="scirp.124549-ref8"><label>8</label><mixed-citation publication-type="other" xlink:type="simple">Wang, F., Li, W.G., Bao, W.D. and Lv, Z.L. (2021) Gauss-Seidel Method with Oblique Direction. Results in Applied Mathematics, 12, Article ID: 100180. https://doi.org/10.1016/j.rinam.2021.100180</mixed-citation></ref><ref id="scirp.124549-ref9"><label>9</label><mixed-citation publication-type="other" xlink:type="simple">Li, W.G., Wang, Q., Bao, W.D. and Xing, L.L. (2022) Kaczmarz Method with Oblique Projection. Results in Applied Mathematics, 16, Article ID: 100342. https://doi.org/10.1016/j.rinam.2022.100342</mixed-citation></ref><ref id="scirp.124549-ref10"><label>10</label><mixed-citation publication-type="other" xlink:type="simple">Wang, F., Li, W.G., Bao, W.D. and Liu, L. (2022) Greedy Randomized and Maximal Weighted Residual Kaczmarz Methods with Oblique Projection. Electronic Research Archive, 30, 1158-1186. https://doi.org/10.3934/era.2022062</mixed-citation></ref><ref id="scirp.124549-ref11"><label>11</label><mixed-citation publication-type="other" xlink:type="simple">Bai, Z.Z. and Wu, W.T. (2018) On Greedy Randomized Kaczmarz Method for Solving Large Sparse Linear Systems. SIAM Journal on Scientific Computing, 40, A592-A606. https://doi.org/10.1137/17M1137747</mixed-citation></ref><ref id="scirp.124549-ref12"><label>12</label><mixed-citation publication-type="other" xlink:type="simple">Davis, T.A. and Hu, Y. (2011) The University of Florida Sparse Matrix Collection. ACM Transactions on Mathematical Software, 38, 1-25. https://doi.org/10.1145/2049662.2049663</mixed-citation></ref></ref-list></back></article>