<?xml version="1.0" encoding="UTF-8"?><!DOCTYPE article  PUBLIC "-//NLM//DTD Journal Publishing DTD v3.0 20080202//EN" "http://dtd.nlm.nih.gov/publishing/3.0/journalpublishing3.dtd"><article xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" dtd-version="3.0" xml:lang="en" article-type="research article"><front><journal-meta><journal-id journal-id-type="publisher-id">OJS</journal-id><journal-title-group><journal-title>Open Journal of Statistics</journal-title></journal-title-group><issn pub-type="epub">2161-718X</issn><publisher><publisher-name>Scientific Research Publishing</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.4236/ojs.2021.111010</article-id><article-id pub-id-type="publisher-id">OJS-107171</article-id><article-categories><subj-group subj-group-type="heading"><subject>Articles</subject></subj-group><subj-group subj-group-type="Discipline-v2"><subject>Physics&amp;Mathematics</subject></subj-group></article-categories><title-group><article-title>
 
 
  Uncovering and Displaying the Coherent Groups of Rank Data by Exploratory Riffle Shuffling
 
</article-title></title-group><contrib-group><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Vartan</surname><given-names>Choulakian</given-names></name><xref ref-type="aff" rid="aff1"><sup>1</sup></xref></contrib><contrib contrib-type="author" xlink:type="simple"><name name-style="western"><surname>Jacques</surname><given-names>Allard</given-names></name><xref ref-type="aff" rid="aff1"><sup>1</sup></xref></contrib></contrib-group><aff id="aff1"><addr-line>Université de Moncton, Moncton, Canada</addr-line></aff><pub-date pub-type="epub"><day>04</day><month>01</month><year>2021</year></pub-date><volume>11</volume><issue>01</issue><fpage>178</fpage><lpage>212</lpage><history><date date-type="received"><day>23,</day>	<month>November</month>	<year>2020</year></date><date date-type="rev-recd"><day>7,</day>	<month>February</month>	<year>2021</year>	</date><date date-type="accepted"><day>10,</day>	<month>February</month>	<year>2021</year></date></history><permissions><copyright-statement>&#169; Copyright  2014 by authors and Scientific Research Publishing Inc. </copyright-statement><copyright-year>2014</copyright-year><license><license-p>This work is licensed under the Creative Commons Attribution International License (CC BY). http://creativecommons.org/licenses/by/4.0/</license-p></license></permissions><abstract><p><html>
 <head></head>
 
  Let 
  n
   respondents rank order 
  d
   items, and suppose that <img src="Edit_c36450fa-1b61-4116-be40-5bede8274d30.bmp" alt="" />
  . Our main task is to uncover and display the structure of the observed rank data by an exploratory riffle shuffling procedure which sequentially decomposes the n voters into a finite number of coherent groups plus a noisy group: where the noisy group represents the outlier voters and each coherent group is composed of a finite number of coherent clusters. We consider exploratory riffle shuffling of a set of items to be equivalent to optimal two blocks seriation of the items with crossing of some scores between the two blocks. A riffle shuffled coherent cluster of voters within its coherent group is essentially characterized by the following facts: 1) Voters have identical first TCA factor score, where TCA designates taxicab correspondence analysis, an L<sub>1</sub> variant of correspondence analysis; 2) Any preference is easily interpreted as riffle shuffling of its items; 3) The nature of different riffle shuffling of items can be seen in the structure of the contingency table of the first-order marginals constructed from the Borda scorings of the voters; 4) The first TCA factor scores of the items of a coherent cluster are interpreted as Borda scale of the items. We also introduce a crossing index, which measures the extent of crossing of scores of voters between the two blocks seriation of the items. The novel approach is explained on the benchmarking SUSHI data set, where we show that this data set has a very simple structure, which can also be communicated in a tabular form.
 
</html></p></abstract><kwd-group><kwd>Borda Score and Scale</kwd><kwd> Exploratory Riffle Shuffle</kwd><kwd> Coherent Group</kwd><kwd> Coherent Cluster</kwd><kwd> Crossing Index</kwd><kwd> Taxicab Correspondence Analysis</kwd></kwd-group></article-meta></front><body><sec id="s1"><title>1. Introduction</title><p>Ordering the elements of a set is a common decision making activity, such as, voting for a political candidate, choosing a consumer product, etc. So there is a huge literature concerning the analysis and interpretation of preference data scattered in different disciplines. Often rank data is heterogenous: it is composed of a finite mixture of components. The traditional methods of finding mixture components of rank data are mostly based on parametric probability models, distance or latent class models, and are useful for sparse data and not for diffuse data.</p><p>Rank data are sparse if there are at most a small finite number of permutations that capture the majority of the preferences; otherwise they are diffuse. As a running example in this paper, we will consider the famous benchmarking SUSHI data set enumerating n = 5000 preferences of d = 10 sushis, see [<xref ref-type="bibr" rid="scirp.107171-ref1">1</xref>]. The SUSHI data set is diffuse, because there are at most three counts for one observed permutation. It has been analyzed, among others by [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref3">3</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref4">4</xref>].</p><p>A second data set that we shall also analyze is the APA dataset of size n = 5738 by d = 5 , see [<xref ref-type="bibr" rid="scirp.107171-ref5">5</xref>]. APA data set is also considered as non-sparse by [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>], because all the 120 permutations exist with positive probability.</p><p>For a general background on statistical methods for rank data, see the excellent monograph by [<xref ref-type="bibr" rid="scirp.107171-ref6">6</xref>] and the book [<xref ref-type="bibr" rid="scirp.107171-ref7">7</xref>].</p><sec id="s1_1"><title>1.1. Riffle Shuffle</title><p>The riffle shuffle, see [<xref ref-type="bibr" rid="scirp.107171-ref8">8</xref>], is considered the most popular method of card shuffling, in which one cuts a deck of d cards (aka items) into two piles of sizes d<sub>1</sub> and d<sub>2</sub>, respectively, and successively drops the cards, one by one, so that the piles are interleaved into one deck again.</p><p>Let V, named a voting profile, be a set of n preferences on d items. Based on riffle shuffling ideas, [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>] proposed the notion of riffled independence to model the joint probability distribution of observed preferences of V. Independently, [<xref ref-type="bibr" rid="scirp.107171-ref9">9</xref>] used it for visual exploration of V, naming it two blocks partition of the Borda scored items with crossing of some scores; this will be further developed here under the following important.</p><p>Assumption: d ≪ n . This means that the sample size n is quite large compared to the number of items d.</p><p>SUSHI and APA data sets satisfy this assumption.</p><p>The most important first step in the application of a riffle shuffling procedure is how to partition the d items into two disjoint subsets. In the probabilistic riffle shuffling approach of [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>], the partitioning step is essentially done using some adhoc approach in the case of the SUSHI data set or based on background second order information of the items in the case of the APA data set. While in the exploratory riffle shuffling approach of this paper an optimal partition is obtained by maximizing the cut norm of row centered data, or equivalently by taxicab correspondence analysis of nega coded data.</p><p>We compare the two formulations of riffle shuffle, probabilistic and exploratory, in section 10.</p></sec><sec id="s1_2"><title>1.2. Aim</title><p>Our aim is to explore and display a given voting profile V by sequentially partitioning it into G coherent groups plus a noisy group; that is,</p><p>V = ∪ g = 1 G c o h G ( g ) ∪ n o i s y G , (1)</p><p>where G represents the number of coherent groups and c o h G ( g ) is the gth coherent group. Furthermore, each coherent group is partitioned into a finite number of coherent clusters; that is,</p><p>c o h G ( g ) = ∪ α = 1 c g c o h C g ( α )     for   g = 1, ⋯ , G , (2)</p><p>where c g represents the number of coherent clusters in the gth coherent group. So the coherent clusters are the building blocks for the coherent groups. We note the following facts:</p><p>Fact 1: The assumption d ≪ n induces the new notion of coherency for the clusters and consequently for the groups; it is a stronger characterization than the notion of interpretability for groups as discussed in [<xref ref-type="bibr" rid="scirp.107171-ref9">9</xref>].</p><p>Fact 2: Each coherent group and its clusters have the same latent variable summarized by the Borda scale.</p><p>Fact 3: Given that the proposed method sequentially peels the data like Occam’s razor, the number of groups G is calculated automatically. Furthermore, outliers or uninformative voters belonging to the n o i s y G are easily tagged.</p><p>Fact 4: The approach is exploratory, visual, data analytic and is developed within the framework of taxicab correspondence analysis (TCA). TCA is an L<sub>1</sub> variant of correspondence analysis developed by [<xref ref-type="bibr" rid="scirp.107171-ref10">10</xref>]. TCA is a dimension reduction technique similar to principal component analysis. In this paper, we shall use only the first TCA factor scores of the items and of the voters.</p><p>Two major advantages of our method are: First, we can easily identify outliers. For the SUSHI data, our method tags 12.36% of the voters as outliers, which form the noisy group. While no outliers in the SUSHI data have been identified in [<xref ref-type="bibr" rid="scirp.107171-ref3">3</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref4">4</xref>]. Second, it provides a tabular summary of the preferences which compose a coherent group. For instance, consider the first mixture component of the SUSHI data given in [<xref ref-type="bibr" rid="scirp.107171-ref4">4</xref>], where the modal ordering is almost the same as the Borda scale ordering of the ten sushis in cohG(1) obtained by our method, see <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref> in this paper. The sample size of their first mixture component is 27.56%, which is much smaller than 48.36%, the sample size of our cohG(1), see <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref>. However, <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref> of this paper provides a tabular-visual summary of the 2418 preferences which form cohG(1). The visual summary describes different kinds of equivalent similar riffle shufflings of the 2418 preferences, and it provides further insight into the structure of the data. Such interesting visual summaries are missing in [<xref ref-type="bibr" rid="scirp.107171-ref3">3</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref4">4</xref>].</p></sec><sec id="s1_3"><title>1.3. Highlights of a Coherent Cluster</title><p>A coherent cluster of voters has interesting mathematical properties and is essentially characterized by the following facts:</p><p>1) Voters have identical unique first TCA factor score.</p><p>2) Any voter preference is easily interpreted as a particular riffle shuffling of its items.</p><p>3) The nature of riffle shuffling of the items can be observed in the structure of the contingency table of the first-order marginals constructed from the Borda scorings of the voters belonging to the coherent cluster.</p><p>4) The first TCA factor scores of the items of a coherent cluster are interpreted as Borda scale of the items.</p><p>5) We also introduce the crossing index, which measures the extent of interleaving or the crossing of scores of voters between two blocks seriation of the items in a coherent cluster.</p></sec><sec id="s1_4"><title>1.4. Organization</title><p>This paper has eleven sections and its contents are organized as follows: Section 2 presents an overview of TCA; section 3 presents some preliminaries on the Borda coding of the data and related tables and concepts; section 4 presents Theorem 1, which shows that the first principal dimension of TCA clusters the voters into a finite number of clusters; section 5 discusses coherent clusters and their mathematical properties; section 6 discusses riffle shuffling in a coherent cluster; section 7 introduces the crossing index; section 8 introduces the coherent groups; section 9 presents the analysis of APA data set; section 10 presents a comparison of the two formulations of riffle shuffle probabilistic and exploratory; and finally we conclude in section 11.</p><p>All mathematical proofs are relegated to the Appendix. Details of the computation are shown only for the first coherent group of SUSHI data set.</p></sec></sec><sec id="s2"><title>2. An Overview of Taxicab Correspondence Analysis</title><p>Consider a n &#215; p matrix X where X i j ≥ 0 . We have ∑ j = 1 p   ∑ i = 1 n   X i j = X ∗ ∗ . Let P = X / X ∗ ∗ be the correspondence matrix associated to X ; and as usual, we define p i ∗ = ∑ j = 1 p   p i j , p ∗ j = ∑ i = 1 n   p i j . Let D n = D i a g ( p i ∗ ) a diagonal matrix with diagonal elements p i ∗ . Similarly D p = D i a g ( p ∗ j ) . Let k = r a n k ( P ) − 1 .</p><p>In TCA the calculation of the dispersion measures ( δ α ) , principal axes ( u α , v α ) , principal basic vectors ( a α , b α ) , and principal factor scores ( f α , g α ) for α = 1, ⋯ , k is done in a stepwise manner. We put P 1 = ( p i j ( 1 ) = p i j − p i ∗ p ∗ j ) . Let P α be the residual correspondence matrix at the α-th iteration.</p><p>The variational definitions of the TCA at the α-th iteration are</p><p>δ α = max u ∈ ℝ p ‖ P α u ‖ 1 ‖ u ‖ ∞ = max v ∈ ℝ n ‖ P ′ α v ‖ 1 ‖ v ‖ ∞ = max u ∈ ℝ p , v ∈ ℝ n v ′ P α u ‖ u ‖ ∞ ‖ v ‖ ∞ = max ‖ P α u ‖ 1     subject   to   u ∈ { − 1, + 1 } p = max ‖ P ′ α v ‖ 1     subject   to   v ∈ { − 1, + 1 } n = max v ′ P a u       subject   to   u ∈ { − 1, + 1 } p , v ∈ { − 1, + 1 } n .</p><p>The α-th principal axes are</p><p>u α = arg max u ∈ { − 1, + 1 } p ‖ P α u ‖ 1     and     v α = arg max v ∈ { − 1, + 1 } n ‖ P ′ α v ‖ 1 , (3)</p><p>and the α-th basic principal vectors are</p><p>a α = P α u α     and     b α = P ′ α v α , (4)</p><p>and the α-th principal factor scores are</p><p>f α = D n − 1 a α     and     g α = D p − 1 b α ; (5)</p><p>furthermore the following relations are also useful</p><p>u α = s g n ( b α ) = s g n ( g α )     and     v α = s g n ( a α ) = s g n ( f α ) , (6)</p><p>where s g n ( . ) is the coordinatewise sign function, s g n ( x ) = 1 if x &gt; 0 , and s g n ( x ) = − 1 if x ≤ 0 . The α-th taxicab dispersion measure δ α can be represented in many different ways</p><p>δ α = ‖ P α u α ‖ 1 = ‖ a α ‖ 1 = a ′ α v α = ‖ D n f α ‖ 1 = u ′ α D n f α , = ‖ P ′ α v α ‖ 1 = ‖ b α ‖ 1 = b ′ α u α = ‖ D p g α ‖ 1 = v ′ α D p g α . (7)</p><p>The ( α + 1 ) -th residual correspondence matrix is</p><p>P α + 1 = P α − D n f α g ′ α D p / δ α . (8)</p><p>An interpretation of the term D n g α f ′ α D p / δ α in (8) is that, it represents the best rank-1 approximation of the residual correspondence matrix P α , in the sense of taxicab norm.</p><p>In CA and TCA, the principal factor scores are centered; that is,</p><p>∑ i = 1 n     f α ( i ) p i ∗ = 0 = ∑ j = 1 p     g α ( j ) p ∗ j       for     α = 1 , ⋯ , k . (9)</p><p>The reconstitution formula in TCA and CA is</p><p>p i j = p i . p . j [ 1 + ∑ α = 1 k f α ( i ) g α ( j ) / δ α ] . (10)</p><p>In TCA, the calculation of the principal component weights, u α and v α , and the principal factor scores, g α and f α , can be accomplished by two algorithms. The first one is based on complete enumeration based on equation (3). The second one is based on iterating the transition formulae (4, 5, 6). This is an ascent algorithm; that is, it increases the value of the objective function at each iteration, see [<xref ref-type="bibr" rid="scirp.107171-ref11">11</xref>]. The iterative algorithm could converge to a local maximum; so it should be restarted from several initial configurations. The rows or the columns of the data can be used as starting values.</p><p>The TCA map is obtained by plotting ( g 1 , g 2 ) or ( f 1 , f 2 ) .</p></sec><sec id="s3"><title>3. Preliminaries</title><p>In this section we review 1) The Borda scoring of a voting profile V into R and the Borda scale; 2) Contingency table of the first order marginals of R; 3) The coded tables R d o u b l e and R n e g a .</p><sec id="s3_1"><title>3.1. Borda Scorings and Borda Scale</title><p>Let A = { a 1 , a 2 , ⋯ , a d } denote a set of d alternatives/candidates/items, and V a set of n voters/individuals/judges. In this paper, we consider the linear orderings/rankings/preferences, in which all d objects are rank-ordered according to their levels of desirability by the n voters. We denote a linear order by a sequence s = ( a k 1 ≻ a k 2 ≻ ⋯ ≻ a k d ) , where a k 1 ≻ a k 2 means that the alternative a k 1 is preferred to the alternative a k 2 . The Borda scoring of s , see [<xref ref-type="bibr" rid="scirp.107171-ref12">12</xref>], is the vector b ( s ) where to the element a k j the score of ( d − j ) is assigned, because a k j is preferred to ( d − j ) other alternatives; or equivalently it is the jth most preferred alternative. Let R = ( r i j ) be the matrix having n rows and d columns, where r i j designates the Borda score of the ith voter’s preference of the jth alternative. We note that theith row of R will be an element of S d the set of permutations of the elements of the set { 0,1,2, ⋯ , d − 1 } . A toy example of R is presented in <xref ref-type="table" rid="table1">Table 1</xref> for n = 4 and d = 3 .</p><p>The Borda scale of the elements of A is β = 1 ′ n R / n , where 1 n is a column vector of 1’s having n coordinates. The Borda scale seriates/orders the d items of the set A according to their average scores: β ( j ) &gt; β ( i ) means item j is preferred to item i, and β ( j ) = β ( i ) means both items ( a i , a j ) are equally preferred. In the toy example of <xref ref-type="table" rid="table1">Table 1</xref>, the Borda scale seriates { A , B } ≻ C .</p><p>Similarly, we define the reverse Borda score of s to be the vector b &#175; ( s ) , which assigns to the element a k j the score of ( j − 1 ) . We denote R &#175; = ( r &#175; i j ) to be the matrix having n rows and d columns, where r &#175; i j designates the reverse Borda score of the ith judge’s nonpreference of the jth alternative. The reverse Borda scale of the d items is β &#175; = 1 ′ n R &#175; / n .</p><p>We note that</p><p>R + R &#175; = ( d − 1 ) 1 n 1 ′ n</p><p>and</p><p>β + β &#175; = ( d − 1 ) 1 ′ d .</p></sec><sec id="s3_2"><title>3.2. Contingency Tableof First-Order Marginals</title><p>The contingency table of first-order marginals of an observed voting profile V on</p><table-wrap id="table1" ><label><xref ref-type="table" rid="table1">Table 1</xref></label><caption><title> Toy example with n = 4 preferences of d = 3 items</title></caption><table><tbody><thead><tr><th align="center" valign="middle" ></th><th align="center" valign="middle" >C</th><th align="center" valign="middle" >B</th><th align="center" valign="middle" >A</th><th align="center" valign="middle" >C</th><th align="center" valign="middle" >B</th><th align="center" valign="middle" >A</th></tr></thead><tr><td align="center" valign="middle" >A ≻ B ≻ C</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td></tr><tr><td align="center" valign="middle" >A ≻ C ≻ B</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >0</td></tr><tr><td align="center" valign="middle" >B ≻ A ≻ C</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >1</td></tr><tr><td align="center" valign="middle" >B ≻ C ≻ A</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td></tr><tr><td align="center" valign="middle" >Borda scale β</td><td align="center" valign="middle" >0.5</td><td align="center" valign="middle" >1.25</td><td align="center" valign="middle" >1.25</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >reverse Borda scale β &#175;</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" >1.5</td><td align="center" valign="middle" >0.75</td><td align="center" valign="middle" >0.75</td></tr><tr><td align="center" valign="middle" >nega n β &#175;</td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >3</td></tr></tbody></table></table-wrap><p>d items is a square d &#215; d matrix M, where M ( i , j ) stores the number of times that itemj has Borda score i for i = 0 , ⋯ , d − 1 , see [ [<xref ref-type="bibr" rid="scirp.107171-ref6">6</xref>], p. 17]. <xref ref-type="table" rid="table2">Table 2</xref> displays the matrix M for the toy example R displayed in <xref ref-type="table" rid="table1">Table 1</xref>. We note the following facts:</p><p>1) It has uniform row and column marginals equal to the sample size.</p><p>2) We can compute the Borda scale β from it.</p><p>3) It reveals the nature of crossing of scores attributed to the items for a given binary partition of the items. For the toy example, consider the partition { C } and { B , A } with attributed scores of { 0 } and { 1,2 } respectively (this is the first step in a riffle shuffle). Then the highlighted cells (marked in bold) in <xref ref-type="table" rid="table2">Table 2</xref> show that there are two crossing of scores, permutation (transposition) of the scores 0 and 1, between the sets { C } and { B , A } , (this is the second step in a random shuffle). Furthermore, the third row of <xref ref-type="table" rid="table2">Table 2</xref> shows that the score 2 is equally attributed to both items of the set { B , A } and it never crossed to { C } .</p></sec><sec id="s3_3"><title>3.3. Coded Tables R<sub>double</sub> and R<sub>nega</sub></title><p>Our methodological approach is based on Benz&#233;cri’s platform, see [ [<xref ref-type="bibr" rid="scirp.107171-ref13">13</xref>], p.1113], that we quote: “the main problem inductive statistics has to face is to build tables that, through appropriate coding and eventual supplementation, give to the available data such a shape that the analysis is able to extract from it the answer to any question that we are allowed to ask”. Italics are ours.</p><p>There are three elements in Benz&#233;cri’s platform: 1) coding, a kind of pre-processing of data, will be discussed in the following paragraph; 2) eventual supplementation consists in applying TCA and not correspondence analysis (CA), because in the CA case we do not have a result similar to Theorem 1; 3) question that we are allowed to ask is to explore and visualize rank data.</p><p>Within the CA framework, there are two codings of rank data R d o u b l e and R n e g a .</p><sec id="s3_3_1"><title>3.3.1. R<sub>double</sub></title><p>The first one is the doubled table of size ( 2 n ) &#215; d</p><p>R d o u b l e = ( R R &#175; )</p><p>proposed independently by [<xref ref-type="bibr" rid="scirp.107171-ref14">14</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref15">15</xref>], where they showed that CA of R d o u b l e is</p><table-wrap id="table2" ><label><xref ref-type="table" rid="table2">Table 2</xref></label><caption><title> The matrix of first-order marginals of R</title></caption><table><tbody><thead><tr><th align="center" valign="middle" ></th><th align="center" valign="middle" >C</th><th align="center" valign="middle" >B</th><th align="center" valign="middle" >A</th><th align="center" valign="middle" >row sum</th></tr></thead><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >4</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >4</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >4</td></tr><tr><td align="center" valign="middle" >column sum</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >Borda scale β</td><td align="center" valign="middle" >0.5</td><td align="center" valign="middle" >1.25</td><td align="center" valign="middle" >1.25</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><p>equivalent to the dual scaling of Nishisato coding of rank data, see [<xref ref-type="bibr" rid="scirp.107171-ref16">16</xref>]. CA of R d o u b l e is equivalent to CA of its first residual correspondence matrix</p><p>P d o u b l e 1 = 1 t ( r i j − d − 1 2 − ( r i j − d − 1 2 ) ) ,</p><p>where t = n d ( d − 1 ) . The structure of P d o u b l e 1 shows that each row is centered as in Carroll’s multidimensional preference analysis procedure, MDPREF, exposed in Alvo and Yu (2014, p. 15). In TCA the objective function to maximize is a combinatorial problem, see Equation (3); and the first iteration in TCA of R d o u b l e corresponds to computing</p><p>δ 1 d o u b l e = max v ∈ { − 1,1 } n ‖ ( v t | − v t ) P d o u b l e 1 ‖ 1 = max v ∈ { − 1,1 } n 2 t ∑ j = 1 d | ∑ i = 1 n ( r i j − d − 1 2 ) v i | (11)</p></sec><sec id="s3_3_2"><title>3.3.2. R<sub>nega</sub></title><p>In the second approach, we summarize R &#175; by its column total; that is, we create a row named n e g a = n β &#175; = 1 ′ n R &#175; , then we vertically concatenate nega to R, thus obtaining</p><p>R n e g a = ( R n e g a )</p><p>of size ( n + 1 ) &#215; d .</p><p>[<xref ref-type="bibr" rid="scirp.107171-ref17">17</xref>] discussed the relationship between TCA of R d o u b l e and TCA of R n e g a : TCA of R n e g a can be considered as constrained TCA of R d o u b l e , because we are constraining the vector − v t = − 1 n t in (11); that is, the objective function to maximize corresponds to computing</p><p>δ 1 = max v ∈ { − 1,1 } n ‖ ( v t | − 1 n t ) P d o u b l e 1 ‖ 1 = max v ∈ { − 1,1 } n ‖ ( v t − 1 ) P n e g a 1 ‖ 1 = max v ∈ { − 1,1 } n 1 t ∑ j = 1 d | ∑ i = 1 n ( r i j − d − 1 2 ) ( v i + 1 ) | (12)</p><p>So, we see that if in (11) the optimal value of v = 1 n , then δ 1 d o u b l e = δ 1 , otherwise δ 1 d o u b l e &gt; δ 1 .</p><p>Let</p><p>v 1 = arg max v ∈ { − 1,1 } n 1 t ∑ j = 1 d | ∑ i = 1 n ( r i j − d − 1 2 ) ( v i + 1 ) | .</p><p>Define the set of indices I + = { i | v 1 i = 1 } and I − = { i | v 1 i = − 1 } , where v 1 = ( v 1 i ) . Then</p><p>δ 1 = 2 t ∑ j = 1 d | ∑ i ∈ I + ( r i j − d − 1 2 ) | (13)</p><p>shows that the summation in (13) is restricted to the subset of assessors that belong to I + . The subset I + indexes the voters having the same direction in their votes. Given that we are uniquely interested in the first TCA dimension, all the necessary information is encapsulated in I + , as discussed in [<xref ref-type="bibr" rid="scirp.107171-ref9">9</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref17">17</xref>] using other arguments.</p><p>Furthermore, δ 1 in (13) equals four times the cut norm of R c e n t e r e d ( i , j ) = 1 t ( r i j − d − 1 2 ) , where the cut norm is defined to be</p><p>‖ R c e n t e r e d ‖ c u t = max S , T 1 t ∑ j ∈ S   ∑ i ∈ T ( r i j − d − 1 2 ) = 1 t ∑ j ∈ S +   ∑ i ∈ I + ( r i j − d − 1 2 ) = δ 1 / 4 ,</p><p>where S ⊆ { 1, ⋯ , d } and T ⊆ I ; it shows that the subsets I + and S + are positively associated, for further details see for instance, [<xref ref-type="bibr" rid="scirp.107171-ref18">18</xref>] [<xref ref-type="bibr" rid="scirp.107171-ref19">19</xref>].</p><p>In the sequel, we will consider only the application of TCA to R n e g a .</p></sec></sec></sec><sec id="s4"><title>4. First TCA Voter Factor Scores of R<sub>nega</sub></title><p>We show the results on the SUSHI data set enumerating n = 5000 preferences of d = 10 sushis, see [<xref ref-type="bibr" rid="scirp.107171-ref1">1</xref>]. Even though, our interest concerns only the first TCA voter factor scores of a voting profile V 1 , it is a common practice in CA circles to present the principal map of the row and column projections.</p><p><xref ref-type="fig" rid="fig1">Figure 1</xref> and <xref ref-type="fig" rid="fig2">Figure 2</xref> display the principal maps obtained from CA and TCA of R n e g a of the SUSHI data denoted by V 1 . We observe that, TCA clusters the voters into a finite number of discrete patterns, while CA does not: This is the main reason that we prefer the use of TCA to the use of the classical well-known dimension reduction technique CA.</p><p>We have the following theorem concerning the first TCA principal factor</p><p>scores of the voters belonging to a profile V 1 , f 1 ( i ) for i = 1 , ⋯ , n , where the first principal axis partitions the d items into d 1 and d 2 parts such that d = d 1 + d 2 .</p><p>Theorem 1</p><p>a) The maximum number of distinct clusters of the n voters belonging to V 1 on the first TCA principal axis (distinct f 1 ( i ) values for i ∈ V 1 ) is d 1 d 2 + 1 .</p><p>b) The maximum value that f 1 ( i ) can attain is 2 d 1 d 2 d ( d − 1 ) .</p><p>c) The minimum value that f 1 ( i ) can attain is − 2 d 1 d 2 d ( d − 1 ) .</p><p>d) If the number of distinct clusters is maximum, d 1 d 2 + 1 , then the gap between two contiguous f 1 ( i ) values is 4 d ( d − 1 ) .</p><p>Remark 1</p><p>a) We fix f 1 ( n e g a ) &lt; 0 to eliminate the sign indeterminacy of the first bilinear term in (10).</p><p>b) We partition V 1 into d 1 d 2 + 1 clusters, V 1 = ∪ α = 1 d 1 d 2 + 1 V 1, α , where the voters of the αth cluster are characterized by their first TCA factor score; that is, V 1 , α = { i ∈ V 1 : f 1 V 1 ( i ) = 2 d 1 d 2 d ( d − 1 ) − ( α − 1 ) 4 d ( d − 1 ) } for α = 1, ⋯ , d 1 d 2 + 1 .</p><p>Example 1: In <xref ref-type="fig" rid="fig2">Figure 2</xref>, d 1 = 4 and d 2 = 6 , and we observe:</p><p>Fact 1: by Theorem 1a, 5000 preferences are clustered into d 1 d 2 + 1 = 25 clusters on the first TCA principal axis.</p><p>Fact 2: by Theorem 1b, the maximum value of f 1 ( i ) = 48 / 90 .</p><p>Fact 3: by Theorem 1c, the minimum value of f 1 ( i ) = − 48 / 90 .</p><p>Fact 4: by Theorem 1d, the gap separating two contiguous clusters of voters on the first TCA principal axis is 4/90.</p><p>A cluster of voters defined in Remark 1b, V 1, α for α = 1 , ⋯ , d 1 d 2 + 1 , can be classified as coherent or incoherent. And this will be discussed in the next section.</p></sec><sec id="s5"><title>5. Coherent Cluster</title><p>The following definition characterizes a coherent cluster.</p><p>Definition 1 (Coherency of a cluster of voters V 1, α for α = 1 , ⋯ , d 1 d 2 + 1 )</p><p>A cluster of voters V 1, α ⊆ V 1 is coherent if f 1 V 1 , α ( v ) = 2 d 1 d 2 d ( d − 1 ) − ( α − 1 ) 4 d ( d − 1 ) for all v ∈ V 1, α , where f 1 V 1 , α ( i ) is the first TCA factor score of the voter i ∈ V 1, α obtained from TCA of subprofile V 1, α .</p><p>Remark 2:</p><p>a) It is important to distinguish between f 1 V 1 ( i ) for i = 1 , ⋯ , | V 1 | where n = | V 1 | , and f 1 V 1 , α ( i ) for i = 1 , ⋯ , | V 1 , α | , where | V 1 , α | represents the sample size of the cluster | V 1 , α | .</p><p>b) Definition 1 implies that a cluster V 1, α is coherent when for all voters i ∈ V 1, α the first TCA factor score f 1 V 1 , α ( i ) does not depend on the voter i, but it depends on ( α , d 1 , d 2 ) .</p><p>Corollary 1: It follows from Remark 1a and Equation (13) that, a necessary condition, but not sufficient, for a cluster V 1, α to be coherent is that its first TCA factor score obtained from TCA of V 1 is strictly positive; that is, 0 &lt; f 1 V 1 ( i ) for i ∈ V 1, α .</p><p>Example 2: Figures 3-9 show the coherency of the clusters of voters V 1, α for α = 1 , ⋯ , 7 , where dots represent clusters of voters; while <xref ref-type="fig" rid="fig1">Figure 1</xref>0 shows the incoherence of the cluster V 1,8 . Further, the first three columns of <xref ref-type="table" rid="table3">Table 3</xref> display the mathematical formulation of the 7 coherent clusters c o h C 1 ( α ) = V 1, α for α = 1 , ⋯ , 7 as defined in Remark 1b and their sample sizes | V 1, α | .</p><p>Proposition 1: For a voting profile V, δ 1 ( V ) ≥ | f 1 ( n e g a ) | , where δ 1 ( V ) is the first TCA dispersion value obtained from TCA of V, and f 1 ( n e g a ) is the first TCA factor score of the row nega.</p><p>The equality in Proposition 1 is attained only for coherent clusters as shown in the following result.</p><p>Proposition 2: The first TCA dispersion value of a coherent cluster c o h C 1 ( α ) satisfies</p><p>δ 1 ( c o h C 1 ( α ) ) = | f 1 V 1 , α ( n e g a ) | = 2 d 1 d 2 d ( d − 1 ) − ( α − 1 ) 4 d ( d − 1 )</p><p>Example 3: propostion 2 can be observed by looking at the columns 3 and 4 of <xref ref-type="table" rid="table3">Table 3</xref> which concern the 7 coherent clusters c o h C 1 ( α ) = V 1, α for α = 1 , ⋯ , 7 .</p><table-wrap id="table3" ><label><xref ref-type="table" rid="table3">Table 3</xref></label><caption><title> Characteristics of c o h C 1 ( α ) = V 1, α of SUSHI data</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >α</th><th align="center" valign="middle" >| V 1, α |</th><th align="center" valign="middle" >description of V 1, α</th><th align="center" valign="middle" >δ 1 ( V 1, α )</th><th align="center" valign="middle" >T v ∈ V 1, α ( τ J 1 ( S 1 ) )</th><th align="center" valign="middle" >C r o s s ( V 1, α )</th></tr></thead><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >314</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 48 / 90 }</td><td align="center" valign="middle" >48/90</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >0</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >235</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 44 / 90 }</td><td align="center" valign="middle" >44/90</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >1/12</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >326</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 40 / 90 }</td><td align="center" valign="middle" >40/90</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >2/12</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >315</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 36 / 90 }</td><td align="center" valign="middle" >36/90</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >3/12</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >452</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 32 / 90 }</td><td align="center" valign="middle" >32/90</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >4/12</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >375</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 28 / 90 }</td><td align="center" valign="middle" >28/90</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >5/12</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >401</td><td align="center" valign="middle" >{ i : f 1 V 1 ( i ) = 24 / 90 }</td><td align="center" valign="middle" >24/90</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >6/12</td></tr></tbody></table></table-wrap><p>While for the incoherent cluster V 1,8 with sample size of | V 1,8 | = 335 , we observe: V 1 , 8 = { i : f 1 V 1 ( i ) = 20 / 90 = 0.222 } , and by Proposition 1, δ 1 ( V 1 , 8 ) = 0.2354 &gt; 2 / 9 . This means that the 335 voters belonging to V 1,8 form a cluster within the whole sample of 5000 voters, but separated as 335 voters they do not form a coherent cluster.</p>Interpretability of a Coherent Cluster<p>The following result shows that for coherent clusters, the first TCA dimension can be interpreted as Borda scaled factor.</p><p>Proposition 3: The first TCA column factor score of the item j, g 1 ( j ) , is an affine function of the Borda scale β ( j ) ; that is, g 1 ( j ) = 2 d − 1 β ( j ) − 1 for j = 1 , ⋯ , d . Or c o r r ( g 1 , β ) = 1 .</p><p>Remark 3:</p><p>The first TCA principal factor score of item j for j = 1 , ⋯ , d is bounded: − 1 ≤ g 1 ( j ) ≤ 1 , because 0 ≤ β ( j ) ≤ d − 1 .</p><p>Example 4: <xref ref-type="table" rid="table4">Table 4</xref> displays the Borda scales of the items, sushis, in the seven coherent clusters c o h C 1 ( α ) = V 1, α for α = 1 , ⋯ , 7 . To identify the sushi type, one has to refer to <xref ref-type="fig" rid="fig2">Figure 2</xref>; for instance, j10 corresponds to 10 cucumber roll in <xref ref-type="fig" rid="fig2">Figure 2</xref>. We observe the following main fact: For each of the seven coherent clusters, the first TCA principal axis produced the same binary partition of the items: J 1 = { j 10 , j 7 , j 4 , j 9 } characterized by 4.5 &gt; β ( j 1 ) for j 1 ∈ J 1 , and J 2 = { j 3 , j 1 , j 2 , j 6 , j 5 , j 8 } characterized by β ( j 1 ) &gt; 4.5 for j 2 ∈ J 2 . The six sushis in J 2 have Borda scales above average score of 4.5 = ( 0 + 9 ) / 2 ; while the four sushis in J 1 have Borda scales below average score of 4.5.</p><p>Now we ask the question what are the differences among the seven coherent clusters? The answer is riffle shuffling of the scores of the items, which we discuss next.</p></sec><sec id="s6"><title>6. Exploratory Riffle Shuffling</title><p>[<xref ref-type="bibr" rid="scirp.107171-ref8">8</xref>] is the seminal reference on riffle shuffling of cards. [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>] generalized the notion</p><table-wrap id="table4" ><label><xref ref-type="table" rid="table4">Table 4</xref></label><caption><title> Borda scales of the 10 sushis in the seven coherent clusters</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >Borda scale</th><th align="center" valign="middle" >j10</th><th align="center" valign="middle" >j7</th><th align="center" valign="middle" >j4</th><th align="center" valign="middle" >j9</th><th align="center" valign="middle" >j3</th><th align="center" valign="middle" >j1</th><th align="center" valign="middle" >j2</th><th align="center" valign="middle" >j6</th><th align="center" valign="middle" >j5</th><th align="center" valign="middle" >j8</th></tr></thead><tr><td align="center" valign="middle" >β ( c o h C 1 ( 1 ) )</td><td align="center" valign="middle" >0.66</td><td align="center" valign="middle" >1.31</td><td align="center" valign="middle" >1.87</td><td align="center" valign="middle" >2.16</td><td align="center" valign="middle" >5.55</td><td align="center" valign="middle" >5.78</td><td align="center" valign="middle" >6.03</td><td align="center" valign="middle" >6.58</td><td align="center" valign="middle" >7.31</td><td align="center" valign="middle" >7.52</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 2 ) )</td><td align="center" valign="middle" >0.69</td><td align="center" valign="middle" >1.29</td><td align="center" valign="middle" >2.44</td><td align="center" valign="middle" >2.59</td><td align="center" valign="middle" >5.47</td><td align="center" valign="middle" >5.43</td><td align="center" valign="middle" >5.50</td><td align="center" valign="middle" >6.35</td><td align="center" valign="middle" >7.38</td><td align="center" valign="middle" >7.86</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 3 ) )</td><td align="center" valign="middle" >0.65</td><td align="center" valign="middle" >1.60</td><td align="center" valign="middle" >3.04</td><td align="center" valign="middle" >2.71</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >5.39</td><td align="center" valign="middle" >6.26</td><td align="center" valign="middle" >7.17</td><td align="center" valign="middle" >7.68</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 4 ) )</td><td align="center" valign="middle" >0.83</td><td align="center" valign="middle" >1.79</td><td align="center" valign="middle" >3.10</td><td align="center" valign="middle" >3.28</td><td align="center" valign="middle" >5.30</td><td align="center" valign="middle" >4.74</td><td align="center" valign="middle" >5.22</td><td align="center" valign="middle" >6.34</td><td align="center" valign="middle" >6.76</td><td align="center" valign="middle" >7.64</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 5 ) )</td><td align="center" valign="middle" >1.12</td><td align="center" valign="middle" >2.02</td><td align="center" valign="middle" >3.26</td><td align="center" valign="middle" >3.60</td><td align="center" valign="middle" >5.70</td><td align="center" valign="middle" >4.74</td><td align="center" valign="middle" >5.27</td><td align="center" valign="middle" >5.75</td><td align="center" valign="middle" >5.99</td><td align="center" valign="middle" >7.60</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 6 ) )</td><td align="center" valign="middle" >1.12</td><td align="center" valign="middle" >2.33</td><td align="center" valign="middle" >3.62</td><td align="center" valign="middle" >3.93</td><td align="center" valign="middle" >5.68</td><td align="center" valign="middle" >4.98</td><td align="center" valign="middle" >5.21</td><td align="center" valign="middle" >5.33</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >7.56</td></tr><tr><td align="center" valign="middle" >β ( c o h C 1 ( 7 ) )</td><td align="center" valign="middle" >1.42</td><td align="center" valign="middle" >2.74</td><td align="center" valign="middle" >3.84</td><td align="center" valign="middle" >4.00</td><td align="center" valign="middle" >5.45</td><td align="center" valign="middle" >4.70</td><td align="center" valign="middle" >5.02</td><td align="center" valign="middle" >5.26</td><td align="center" valign="middle" >5.20</td><td align="center" valign="middle" >7.38</td></tr></tbody></table></table-wrap><p>of independence of two subsets of items to riffled independence to uncover the structure of rank data. Within the framework of data analysis of preferences, exploratory riffle shuffling can be described in the following way. We have two sets: J a set of d distinct items andS a set of d Borda scores. We partition both sets into two disjoint subsets of sizes d 1 and d 2 = d − d 1 ; that is, J = J 1 ∪ J 2 with J 1 = { j 1 , j 2 , ⋯ , j d 1 } and S = S 1 ∪ S 2 with S 1 = { 0 , 1 , ⋯ , d 1 − 1 } . Riffle shuffling consists of two steps. In the first step, we attribute the scores of S 1 to J 1 and the scores of S 2 to J 2 . In the second step, we permute some scores attributed to J 1 with the same number of scores attributed to J 2 . The second step can be mathematically described as an application of a permutation τ , such that τ J ( S 1 , S 2 ) = ( τ J 1 ( S 1 ) , τ J 2 ( S 2 ) ) . We interpret τ J 1 ( S 1 ) as the set of scores attributed to J 1 , and τ J 2 ( S 2 ) as the set of scores attributed to J 2 .</p><p>Example 5: <xref ref-type="table" rid="table5">Table 5</xref> displays a toy example with n = 7 voters’ Borda scorings of d = 10 items with J 1 = { a , b , c , d } and J 2 = { e , f , g , h , i , j } . We observe the following: a) The first four voters have only done the first step in a riffle shuffle: each one of them has attributed the scores in S 1 = { 0 , 1 , 2 , 3 } to the items in J 1 and the scores in S 2 = { 4 , 5 , 6 , 7 , 8 , 9 } to the items in J 2 . This can be described as τ J ( S 1 , S 2 ) = ( S 1 , S 2 ) ; that is the permutation τ is the identity permutation; so there is no crossing of scores between J 1 and J 2 . b) Voters 5, 6 and 7 have done both steps in a riffle shuffle. Voters 5 and 6 have permuted score 3 with 5, so we have τ J 1 ( S 1 ) = { 0 , 1 , 2 , 5 } and τ J 2 ( S 2 ) = { 4 , 3 , 6 , 7 , 8 , 9 } . Voter 7 has permuted the scores { 2 , 3 } with { 4 , 5 } , so we have τ J 1 ( S 1 ) = { 0 , 1 , 4 , 5 } and τ J 2 ( S 2 ) = { 2 , 3 , 6 , 7 , 8 , 9 } .</p><p>Further, we note by | τ J 1 ( S 1 ) | the number of voters who have done the riffle shuffle ( τ J 1 ( S 1 ) , τ J 2 ( S 2 ) ) . So | τ J 1 ( S 1 ) = { 0 , 1 , 2 , 3 } | = 4 , | { 0 , 1 , 2 , 5 } | = 2 and | { 0 , 1 , 4 , 5 } | = 1 . The permuted scores between the two blocks of items are in bold in <xref ref-type="table" rid="table5">Table 5</xref>.</p><p>Remark 4: A useful observation that we get from Example 5 is that we can concentrate our study either on J 1 or on J 2 : For if we know τ J 1 ( S 1 ) , the scores attributed to J 1 , we can deduce τ J 2 ( S 2 ) , the scores attributed to J 2 because of mutual exclusivity constraints ensuring that any two items, say a and</p><table-wrap id="table5" ><label><xref ref-type="table" rid="table5">Table 5</xref></label><caption><title> Borda scorings of 10 items by 7 voters</title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >voter</th><th align="center" valign="middle"  colspan="10"  >items</th></tr></thead><tr><td align="center" valign="middle" >a</td><td align="center" valign="middle" >b</td><td align="center" valign="middle" >c</td><td align="center" valign="middle" >d</td><td align="center" valign="middle" >e</td><td align="center" valign="middle" >f</td><td align="center" valign="middle" >g</td><td align="center" valign="middle" >h</td><td align="center" valign="middle" >i</td><td align="center" valign="middle" >j</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >9</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >9</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >8</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >6</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >9</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >8</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >3</td></tr></tbody></table></table-wrap><p>b, never map to the same rank by a voter.</p><p>A simple measure of magnitude of ( d 1 , d 2 ) riffle shuffling of a voter i is the sum of its Borda scores attributed to the items in J 1 ; that is,</p><p>T i ( τ J 1 ( S 1 ) ) = ∑ j ∈ J 1     r i j ,</p><p>where r i j is the Borda score attributed to item j by voter i. In <xref ref-type="table" rid="table5">Table 5</xref>, for the first four voters, T i ( τ J 1 ( S 1 ) ) = 6 for i = 1 , 2 , 3 , 4 , which is the minimum attainable sum of scores; it implies that for these voters there is no crossing of scores between the two blocks J 1 and J 2 . While for voters 5 and 6, T i ( τ J 1 ( S 1 ) ) = 8 for i = 5 , 6 ; for voter 7, T 7 ( τ J 1 ( S 1 ) ) = 10 . These values show that the crossing of scores between the two blocks J 1 and J 2 of voters 5 and 6 are at a lower level than the crossing of scores for voter 7.</p><p>For relatively small sample sizes, it is easy to enumerate the different types of ( d 1 , d 2 ) riffle shuffles. For relatively large sample sizes, we use the contingency table of first-order marginals, that we discuss next.</p>Types of (d<sub>1</sub>, d<sub>2</sub>) Riffle Shufflings in a Coherent Cluster<p>The contingency table of first order marginals of an observed voting profile V on d items is a square d &#215; d matrix M, where M ( i , j ) stores the number of times that item j has Borda score i for i = 0, ⋯ , d − 1 , see subsection 3.2. It helps us to observe types of ( d 1 , d 2 ) riffle shufflings in a coherent cluster as we explain in Example 6.</p><p>Example 6: Tables 6-12 display M 1, α for α = 1, ⋯ ,7 , the contingency tables of first-order marginals of the seven coherent clusters of the SUSHI data, respectively. We observe the following:</p><p>Each one of them reveals the nature of the riffle shuffles of its coherent cluster,</p><table-wrap id="table6" ><label><xref ref-type="table" rid="table6">Table 6</xref></label><caption><title> M 1,1 , contingency table of first-order marginals of c o h C 1 ( 1 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >174</td><td align="center" valign="middle" >92</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >88</td><td align="center" valign="middle" >88</td><td align="center" valign="middle" >76</td><td align="center" valign="middle" >62</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >78</td><td align="center" valign="middle" >91</td><td align="center" valign="middle" >107</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >110</td><td align="center" valign="middle" >134</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >92</td><td align="center" valign="middle" >78</td><td align="center" valign="middle" >73</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >95</td><td align="center" valign="middle" >77</td><td align="center" valign="middle" >59</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >18</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >47</td><td align="center" valign="middle" >63</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >65</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >62</td><td align="center" valign="middle" >87</td><td align="center" valign="middle" >74</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >20</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >78</td><td align="center" valign="middle" >133</td><td align="center" valign="middle" >314</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >0.66</td><td align="center" valign="middle" >1.31</td><td align="center" valign="middle" >1.87</td><td align="center" valign="middle" >2.16</td><td align="center" valign="middle" >5.55</td><td align="center" valign="middle" >5.78</td><td align="center" valign="middle" >6.03</td><td align="center" valign="middle" >6.58</td><td align="center" valign="middle" >7.31</td><td align="center" valign="middle" >7.52</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap id="table7" ><label><xref ref-type="table" rid="table7">Table 7</xref></label><caption><title> M 1,2 , contingency table of first-order marginals of c o h C 1 ( 3 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >127</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >69</td><td align="center" valign="middle" >82</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >62</td><td align="center" valign="middle" >85</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >55</td><td align="center" valign="middle" >59</td><td align="center" valign="middle" >74</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >15</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >103</td><td align="center" valign="middle" >98</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >60</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >18</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >26</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >15</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >20</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >67</td><td align="center" valign="middle" >101</td><td align="center" valign="middle" >235</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >0.69</td><td align="center" valign="middle" >1.29</td><td align="center" valign="middle" >2.44</td><td align="center" valign="middle" >2.59</td><td align="center" valign="middle" >5.47</td><td align="center" valign="middle" >5.43</td><td align="center" valign="middle" >5.50</td><td align="center" valign="middle" >6.35</td><td align="center" valign="middle" >7.38</td><td align="center" valign="middle" >7.86</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap id="table8" ><label><xref ref-type="table" rid="table8">Table 8</xref></label><caption><title> M 1,3 , contingency table of first-order marginals of c o h C 1 ( 3 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >182</td><td align="center" valign="middle" >97</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >104</td><td align="center" valign="middle" >100</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >76</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >19</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >17</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >62</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >91</td><td align="center" valign="middle" >54</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >65</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >60</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >74</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >55</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >80</td><td align="center" valign="middle" >88</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >95</td><td align="center" valign="middle" >123</td><td align="center" valign="middle" >326</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >0.65</td><td align="center" valign="middle" >1.60</td><td align="center" valign="middle" >3.04</td><td align="center" valign="middle" >2.71</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >5.39</td><td align="center" valign="middle" >6.26</td><td align="center" valign="middle" >7.17</td><td align="center" valign="middle" >7.68</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap-group id="9"><label><xref ref-type="table" rid="table9">Table 9</xref></label><caption><title> M 1,4 , contingency table of first-order marginals of c o h C 1 ( 4 ) </title></caption><table-wrap id="9_1"><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >164</td><td align="center" valign="middle" >93</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >78</td><td align="center" valign="middle" >71</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >58</td><td align="center" valign="middle" >87</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >20</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >15</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >17</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >315</td></tr></tbody></table></table-wrap><table-wrap id="9_2"><table><tbody><thead><tr><th align="center" valign="middle" >5</th><th align="center" valign="middle" >1</th><th align="center" valign="middle" >11</th><th align="center" valign="middle" >61</th><th align="center" valign="middle" >46</th><th align="center" valign="middle" >43</th><th align="center" valign="middle" >42</th><th align="center" valign="middle" >34</th><th align="center" valign="middle" >35</th><th align="center" valign="middle" >26</th><th align="center" valign="middle" >16</th><th align="center" valign="middle" >315</th></tr></thead><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >18</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >54</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >47</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >69</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >17</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >84</td><td align="center" valign="middle" >140</td><td align="center" valign="middle" >315</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >0.83</td><td align="center" valign="middle" >1.79</td><td align="center" valign="middle" >3.10</td><td align="center" valign="middle" >3.28</td><td align="center" valign="middle" >5.30</td><td align="center" valign="middle" >4.74</td><td align="center" valign="middle" >5.22</td><td align="center" valign="middle" >6.34</td><td align="center" valign="middle" >6.76</td><td align="center" valign="middle" >7.64</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap></table-wrap-group><table-wrap id="table10" ><label><xref ref-type="table" rid="table1">Table 1</xref>0</label><caption><title> M 1,5 , contingency table of first-order marginals of c o h C 1 ( 5 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >188</td><td align="center" valign="middle" >99</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >34</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >132</td><td align="center" valign="middle" >109</td><td align="center" valign="middle" >69</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >13</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >69</td><td align="center" valign="middle" >88</td><td align="center" valign="middle" >59</td><td align="center" valign="middle" >67</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >20</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >85</td><td align="center" valign="middle" >92</td><td align="center" valign="middle" >34</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >76</td><td align="center" valign="middle" >81</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >63</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >63</td><td align="center" valign="middle" >64</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >34</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >71</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >64</td><td align="center" valign="middle" >75</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >87</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >62</td><td align="center" valign="middle" >73</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >71</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >47</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >95</td><td align="center" valign="middle" >126</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >89</td><td align="center" valign="middle" >179</td><td align="center" valign="middle" >452</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >1.12</td><td align="center" valign="middle" >2.02</td><td align="center" valign="middle" >3.26</td><td align="center" valign="middle" >3.60</td><td align="center" valign="middle" >5.70</td><td align="center" valign="middle" >4.74</td><td align="center" valign="middle" >5.27</td><td align="center" valign="middle" >5.75</td><td align="center" valign="middle" >5.99</td><td align="center" valign="middle" >7.60</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap id="table11" ><label><xref ref-type="table" rid="table1">Table 1</xref>1</label><caption><title> M 1,6 , contingency table of first-order marginals of c o h C 1 ( 6 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >151</td><td align="center" valign="middle" >81</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >19</td><td align="center" valign="middle" >18</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >112</td><td align="center" valign="middle" >79</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >26</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >19</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >66</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >63</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >26</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >22</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >26</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >67</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >61</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >64</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >70</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >59</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >16</td><td align="center" valign="middle" >66</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >88</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >21</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >72</td><td align="center" valign="middle" >155</td><td align="center" valign="middle" >375</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >1.12</td><td align="center" valign="middle" >2.33</td><td align="center" valign="middle" >3.62</td><td align="center" valign="middle" >3.93</td><td align="center" valign="middle" >5.68</td><td align="center" valign="middle" >4.98</td><td align="center" valign="middle" >5.21</td><td align="center" valign="middle" >5.33</td><td align="center" valign="middle" >5.25</td><td align="center" valign="middle" >7.56</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap id="table12" ><label><xref ref-type="table" rid="table1">Table 1</xref>2</label><caption><title> M 1,7 , contingency table of first-order marginals of c o h C 1 ( 7 ) </title></caption><table><tbody><thead><tr><th align="center" valign="middle"  rowspan="2"  >Borda scores</th><th align="center" valign="middle"  colspan="11"  >items</th></tr></thead><tr><td align="center" valign="middle" >j10</td><td align="center" valign="middle" >j7</td><td align="center" valign="middle" >j4</td><td align="center" valign="middle" >j9</td><td align="center" valign="middle" >j3</td><td align="center" valign="middle" >j1</td><td align="center" valign="middle" >j2</td><td align="center" valign="middle" >j6</td><td align="center" valign="middle" >j5</td><td align="center" valign="middle" >j8</td><td align="center" valign="middle" >sum</td></tr><tr><td align="center" valign="middle" >0</td><td align="center" valign="middle" >129</td><td align="center" valign="middle" >65</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >52</td><td align="center" valign="middle" >2</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle" >122</td><td align="center" valign="middle" >77</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >35</td><td align="center" valign="middle" >14</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >19</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >4</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >2</td><td align="center" valign="middle" >74</td><td align="center" valign="middle" >69</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >41</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >19</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >3</td><td align="center" valign="middle" >36</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >66</td><td align="center" valign="middle" >44</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >30</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >4</td><td align="center" valign="middle" >24</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >71</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >38</td><td align="center" valign="middle" >37</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >18</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >5</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >49</td><td align="center" valign="middle" >56</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >53</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >48</td><td align="center" valign="middle" >32</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >6</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >23</td><td align="center" valign="middle" >73</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >50</td><td align="center" valign="middle" >42</td><td align="center" valign="middle" >33</td><td align="center" valign="middle" >40</td><td align="center" valign="middle" >25</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >7</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >31</td><td align="center" valign="middle" >28</td><td align="center" valign="middle" >85</td><td align="center" valign="middle" >39</td><td align="center" valign="middle" >43</td><td align="center" valign="middle" >54</td><td align="center" valign="middle" >51</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >8</td><td align="center" valign="middle" >1</td><td align="center" valign="middle" >3</td><td align="center" valign="middle" >17</td><td align="center" valign="middle" >5</td><td align="center" valign="middle" >58</td><td align="center" valign="middle" >46</td><td align="center" valign="middle" >47</td><td align="center" valign="middle" >65</td><td align="center" valign="middle" >57</td><td align="center" valign="middle" >102</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >9</td><td align="center" valign="middle" >0</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >29</td><td align="center" valign="middle" >27</td><td align="center" valign="middle" >58</td><td align="center" valign="middle" >45</td><td align="center" valign="middle" >68</td><td align="center" valign="middle" >148</td><td align="center" valign="middle" >401</td></tr><tr><td align="center" valign="middle" >β</td><td align="center" valign="middle" >1.42</td><td align="center" valign="middle" >2.74</td><td align="center" valign="middle" >3.84</td><td align="center" valign="middle" >4.00</td><td align="center" valign="middle" >5.45</td><td align="center" valign="middle" >4.70</td><td align="center" valign="middle" >5.02</td><td align="center" valign="middle" >5.26</td><td align="center" valign="middle" >5.20</td><td align="center" valign="middle" >7.38</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><table-wrap id="table13" ><label><xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref></label><caption><title> Types of riffle shuffles in the 7 coherent clusters of SUSHI data</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >c o h C 1 ( α )</th><th align="center" valign="middle" >scores given to { j 10 , j 7 , j 4 , j 9 }</th><th align="center" valign="middle" >sum of scores</th><th align="center" valign="middle" >count</th><th align="center" valign="middle" >c o h C 1 ( α )</th><th align="center" valign="middle" >scores given to { j 10 , j 7 , j 4 , j 9 }</th><th align="center" valign="middle" >sum of scores</th><th align="center" valign="middle" >count</th></tr></thead><tr><td align="center" valign="middle" >c o h C 1 ( 1 )</td><td align="center" valign="middle" >{ 0,1,2,3 }</td><td align="center" valign="middle" >6</td><td align="center" valign="middle" >314</td><td align="center" valign="middle" >c o h C 1 ( 6 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 8 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >48</td></tr><tr><td align="center" valign="middle" >c o h C 1 ( 2 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 4 }</td><td align="center" valign="middle" >7</td><td align="center" valign="middle" >235</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 7 , 3 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >63</td></tr><tr><td align="center" valign="middle" >c o h C 1 ( 3 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 5 }</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >171</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 6 , 2 , 3 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >53</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 4 , 3 }</td><td align="center" valign="middle" >8</td><td align="center" valign="middle" >155</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 5 , 1 , 2 , 3 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >98</td></tr><tr><td align="center" valign="middle" >c o h C 1 ( 4 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 6 }</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >96</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 4 , 6 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >59</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 5 , 3 }</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >119</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 4 , 2 , 5 }</td><td align="center" valign="middle" >11</td><td align="center" valign="middle" >54</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 4 , 2 , 3 }</td><td align="center" valign="middle" >9</td><td align="center" valign="middle" >100</td><td align="center" valign="middle" >c o h C 1 ( 7 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 9 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >26</td></tr><tr><td align="center" valign="middle" >c o h C 1 ( 5 )</td><td align="center" valign="middle" >{ 0 , 1 , 2 , 7 }</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >79</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 8 , 3 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >26</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 6 , 3 }</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >84</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 7 , 2 , 3 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >33</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 5 , 2 , 3 }</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >85</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 6 , 1 , 2 , 3 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >43</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 4 , 1 , 2 , 3 }</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >119</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 4 , 5 , 3 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >38</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 4 , 5 }</td><td align="center" valign="middle" >10</td><td align="center" valign="middle" >85</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 4 , 2 , 6 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >39</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 4 , 7 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >49</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 0 , 1 , 5 , 6 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >82</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" >{ 4 , 1 , 2 , 5 }</td><td align="center" valign="middle" >12</td><td align="center" valign="middle" >65</td></tr></tbody></table></table-wrap><p>which are summarized in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref>. The number of observed ( 4,6 ) blocks of scores for the seven coherent clusters, ( τ J 1 ( S 1 ) , τ J 2 ( S 2 ) ) , is only 27 in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref> out of the possible total number of 10 ! / ( 4 ! 6 ! ) = 210 . The counts of the observed ( 4,6 ) blocks do not seem to be uniformly distributed in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref>. Furthermore, we observe that as α increases from 1 to 7, the magnitude of riffle shuffles, T v ( τ J 1 ( S 1 ) ) , increases in the coherent clusters from 6 to 12. Integers in bold in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref> are the shuffled-crossed scores.</p><p>The counts in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref> are calculated from M 1, α for α = 1, ⋯ ,7 , by reasoning on the permutation of scores between the sets S 1 and S 2 . Here are the details, where J 1 = { j 10 , j 7 , j 4 , j 9 } .</p><p>a) c o h C 1 ( 1 )</p><p>| { 0,1,2,3 } | = 314 , which is the number of 0 s attributed to J 1 in M 1,1 . Among the M 1, α for α = 1, ⋯ ,7 , note that M 1,1 is the only contingency table of first-order marginals which is block diagonal.</p><p>b) c o h C 1 ( 2 )</p><p>| { 0 , 1 , 2 , 4 } | = 235 , which is the number of 4 s attributed to J 1 in M 1,2 .</p><p>c) c o h C 1 ( 3 )</p><p>| { 0,1,2,5 } | = 171 , which is the number of 5 s attributed to J 1 in M 1,3 .</p><p>| { 0,1, 4 ,3 } | = 155 , which is the number of 4 s attributed to J 1 in M 1,3 .</p><p>d) c o h C 1 ( 4 )</p><p>{ { 0,1,2, 6 } } = 96 , which is the number of 6 s attributed to J 1 in M 1,4 .</p><p>| { 0,1, 5 ,3 } | = 119 , which is the number of 5 s attributed to J 1 in M 1,4 .</p><p>| { 0, 4 ,2,3 } | = 100 , which is the number of 4 s attributed to J 1 in M 1,4 .</p><p>e) c o h C 1 ( 5 )</p><p>| { 0,1,2, 7 } | = 79 , which is the number of 7 s attributed to J 1 in M 1,5 .</p><p>| { 0,1, 6 ,3 } | = 84 , which is the number of 6 s attributed to J 1 in M 1,5 .</p><p>| { 0, 5 ,2,3 } | = 85 , which is the number of 1 s not attributed to J 1 in M 1,5 .</p><p>| { 0,1, 4 , 5 } | + | { 0, 5 ,2,3 } | = 170 , which is the total number of 5 s attributed to J 1 in M 1,5 ; so | { 0,1, 4 , 5 } | = 170 − 85 = 85 .</p><p>| { 4 ,1,2,3 } | = 119 , which is the number of 0 s not attributed to J 1 in M 1,5 .</p><p>f) c o h C 1 ( 6 )</p><p>| { 0,1,2, 8 } | = 48 , which is the number of 8 s attributed to J 1 in M 1,6 .</p><p>| { 0,1, 7 ,3 } | = 63 , which is the number of 7 s attributed to J 1 in M 1,6 .</p><p>| { 5 ,1,2,3 } | = 98 , which is the number of 0 s not attributed to J 1 in M 1,6 .</p><p>| { 0, 4 ,2, 5 } | = 152 − 98 = 54 , where 152 is the total number of 5 s attributed to J 1 in M 1,6 .</p><p>| { 0,1, 4 , 6 } | = 113 − 54 = 59 , where 113 is the total number of 4 s attributed to J 1 in M 1,6 .</p><p>| { 0, 6 ,2,3 } | = 112 − 59 = 53 , where 112 is the total number of 6 s attributed to J 1 in M 1,6 .</p><p>g) c o h C 1 ( 7 )</p><p>| { 0,1,2, 9 } | = 26 , which is the number of 9 s attributed to J 1 in M 1,7 .</p><p>| { 0,1, 8 ,3 } | = 26 , which is the number of 8 s attributed to J 1 in M 1,7 .</p><p>For the remaining counts, we have to solve the following system of 7 linear equations, where, u = | { 0, 7 ,2,3 } | , t = | { 0, 4 , 5 ,3 } | , s = | { 0, 4 ,2, 6 } | , w = | { 0,1, 4 , 7 } | , z = | { 0,1, 5 , 6 } | , x = | { 6 ,1,2,3 } | , and y = | { 4 ,1,2,5 } | .</p><p>x + y = 147 , which is the number of 0 s not attributed to J 1 in M 1,7 .</p><p>u + w = 72 , which is the number of 7 s attributed to J 1 in M 1,7 .</p><p>s + z + x = 169 , which is the number of 6 s attributed to J 1 in M 1,7 .</p><p>t + z + y = 157 , which is the number of 5 s attributed to J 1 in M 1,7 .</p><p>t + s + w + y = 185 , which is the number of 4 s attributed to J 1 in M 1,7 .</p><p>u + t + x = 158 , which is the number of 3 s attributed to J 1 in M 1,7 .</p><p>u + s + x + y = 218 , which is the number of 2 s attributed to J 1 in M 1,7 .</p></sec><sec id="s7"><title>7. Crossing Index</title><p>The following ( d 1 , d 2 ) crossing index is based on the internal dispersion of a voting profile.</p><p>Definition 3: For a voting profile V we define its crossing index to be</p><p>C r o s s ( V ) = 1 − δ 1 ( V d 1 , d 2 ) max V δ 1 ( V d 1 , d 2 ) = 1 − δ 1 ( V d 1 , d 2 ) 2 d 1 d 2 d ( d − 1 ) by Proposition 2.</p><p>where δ 1 ( V d 1 , d 2 ) is the first taxicab dispersion obtained from TCA of V and ( d 1 , d 2 ) represents the optimal TCA binary partition of the d items of V such that d = d 1 + d 2 .</p><p>Proposition 4: The crossing index of a coherent cluster is</p><p>C r o s s ( c o h C ( α ) ) = 2 ( α − 1 ) d 1 d 2 .</p><p>Example 7: The last column in <xref ref-type="table" rid="table3">Table 3</xref> contains the values of the crossing indices of the seven coherent clusters of the first iteration of SUSHI data. We observe: a) C r o s s ( c o h C 1 ( 1 ) ) = 0 , because the structure of its matrix of first-order marginals, M 1,1 , is block diagonal; which means that the permutation τ is the identical permutation, so there are no crossing of scores between the two subsets of items J 1 and J 2 in c o h C 1 ( 1 ) . b) C r o s s ( c o h C 1 ( α ) ) for α = 1 , ⋯ , 7 is a uniformly increasing function of α , similar in spirit to the T v ( τ J 1 ( S 1 ) ) statistic. c) For the incoherent cluster V 1,8 , we have: δ 1 ( V 1,8 ) = 0.2354 given in Example 3; and d 1 = d 2 = 5 from <xref ref-type="fig" rid="fig1">Figure 1</xref>0. So</p><p>C r o s s ( V 1 , 8 ) = 1 − 0.2354 2 &#215; 5 &#215; 5 / ( 10 &#215; 9 ) = 1 − 0.4237 = 0.5763 .</p></sec><sec id="s8"><title>8. Coherent Group</title><p>Our aim is to explore a given voting profile V by uncovering its coherent mixture groups, see Equation (1); that is, V = ∪ g = 1 G c o h G ( g ) ∪ n o i s y G , where G represents the number of coherent groups and c o h G ( g ) is the gth coherent group. The computation is done by an iterative procedure in n G steps for n G ≥ G that we describe:</p><p>For g = 1 ; let V 1 = V ; compute c o h G ( 1 ) from V 1 , then partition V 1 = V 2 ∪ c o h G ( 1 ) ;</p><p>For g = 2 ; compute c o h G ( 2 ) from V 2 , then partition V 2 = V 3 ∪ c o h G ( 2 ) ;</p><p>By continuing the above procedure, after n G steps, we get V = ∪ g = 1 n G c o h G ( g ) .</p><p>However, some of the higher ordered coherent groups may have relatively small sample sizes; so by considering these as outliers, we lump them together thus forming the noisy group denoted by n o i s y G in Equation (1).</p><p>Let us recall the definition of a coherent group given in Equation (2)</p><p>c o h G ( g ) = ∪ α = 1 c g c o h C g ( α )     for   g = 1 , ⋯ , G ;</p><p>that is, a coherent group is the union of its coherent clusters. This implies that the sample size of c o h G ( g ) equals the sum of the sample sizes of its coherent clusters</p><p>| c o h G ( g ) | = ∑ α = 1 c g | c o h C g ( α ) | .</p><p>As an example, for the SUSHI data, from the 2<sup>nd</sup> column of <xref ref-type="table" rid="table3">Table 3</xref> we can compute the sample size of the first coherent group</p><p>| c o h G ( 1 ) | = ∑ α = 1 c g = 7 | c o h C 1 ( α ) | = 2418.</p><p>Furthermore, c o h G ( 1 ) is composed of 27 observed riffle shuffles summarized in <xref ref-type="table" rid="table13"><xref ref-type="table" rid="table1">Table 1</xref>3</xref>, which provides quite a detailed view of its inner structure.</p><p>The next result shows important characteristics of a coherent group inherited from its coherent clusters.</p><p>Theorem 2: (Properties of a coherent group c o h G ( g ) )</p><p>a) The first principal column factor score g 1 of the d items in a coherent group is the weighted average of the first principal column factor score g 1 of the d items of its coherent clusters; that is,</p><p>g 1 ( j ∈ c o h G ( g ) ) = ∑ α = 1 c g | c o h C g ( α ) | | c o h G ( g ) | g 1 ( j ∈ c o h C g ( α ) )     for   j = 1, ⋯ , d</p><p>= 2 d − 1 ∑ α = 1 c g | c o h C g ( α ) | | c o h G ( g ) | β ( j ∈ c o h C g ( α ) ) − 1 by Proposition 3.</p><p>And c o r r ( g 1 ( c o h G ( g ) ) , β ( c o h G ( g ) ) ) = 1 .</p><p>b) The first TCA dispersion value of a coherent group is the weighted average of the first TCA dispersion values of its coherent clusters; that is,</p><p>δ 1 ( c o h G ( g ) ) = ∑ α = 1 c g | c o h C g ( α ) | | c o h G ( g ) | δ 1 ( c o h C g ( α ) ) .</p><p>c) The crossing index of a coherent group is the weighted average of the crossing indices of its coherent clusters; that is,</p><p>C r o s s ( c o h G ( g ) ) = ∑ α = 1 c g | c o h C g ( α ) | | c o h G ( g ) | C r o s s ( c o h C g ( α ) ) .</p><p>Example 8: <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref> summarizes the first four coherent groups of SUSHI data, which emerged after 5 iterations. For g = 1 , we get c o h G ( 1 ) = ∪ α = 1 c 1 = 7 c o h C 1 ( α ) ; that is, the first coherent group of voters, the majority, is composed of 48.36% of the sample with crossing index of 27.3%. Standard errors of the Borda scale of the items in c o h G ( 1 ) in <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref> are:</p><p>( 0.046,0.051,0.042,0.042,0.053,0.047,0.037,0.034,0.037,0.025 ) .</p><p>We can discern the following grouped seriation (bucket ranking) of the items</p><p>j 8 ≻ j 5 ≻ j 6 ≻ { j 3, j 2 } ≻ j 1 ≻ { j 9, j 4 } ≻ { j 7 } ≻ { j 10 } .</p><p>The groupings are based on the standard 95% confidence intervals of the Borda scale of the items.</p><p>The 2<sup>nd</sup> coherent group c o h G ( 2 ) , summarized by its Borda scales in <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref>, is made up of eight coherent clusters; it is composed of 19.0% of the sample with crossing index of 35.38%. The voters in this coherent group disapprove {uni(seaurchin), sake(salmonroe)}, which are considered more “daring sushis”.</p><p>The third coherent group c o h G ( 3 ) , summarized by its Borda scales in <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref>, is made up of eight coherent clusters; it is composed of 13.24% of the sample with crossing index of 27.3%. The voters in this coherent group prefer the three types of tuna sushis with sea urchin sushis.</p><p>The fourth coherent group c o h G ( 4 ) , summarized by its Borda scales in <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref>, is made up of eight coherent clusters; it is composed of 6.94% of the sample with crossing index of 35.27%. The voters disapprove the three types of tuna sushis.</p><p>Remark 6:</p><p>a) Note that the number of preferred sushis in c o h G ( 1 ) and c o h G ( 2 ) are six; that is | J 2 | = 6 . While the number of preferred sushis in c o h G ( 3 ) and c o h G ( 4 ) are four.</p><p>b) The four coherent groups summarized in <xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref> can also be described as two bipolar latent factors: By noting that the only major difference between the first two coherent groups is that (5. uni (sea urchin), 6. sake (salmon roe)) are swapped with (7. tamago (egg), 4. ika (squid)). While the only major difference between the third and fourth coherent groups is that the three tunas are swapped with (4. ika (squid), 5. uni (sea urchin), 1. ebi (shrimp)).</p><p>c) We consider the fifth group as noisy (outliers not shown) composed of 12.36% of the remaining sample: it contains c o h G ( 5 ) = ∪ α = 1 2 c o h C 5 ( α ) whose sample size is 38, a very small number. For the sake of completeness we also provide the sample sizes of its two coherent clusters | c o h C 5 ( 1 ) | = 22 and | c o h C 5 ( 2 ) | = 16 .</p></sec><sec id="s9"><title>9. APA Data Set</title><p>The 1980 American Psychological Association (APA) presidential election had five candidates: { A , C } were research psychologists, { D , E } were clinical</p><table-wrap id="table14" ><label><xref ref-type="table" rid="table14"><xref ref-type="table" rid="table1">Table 1</xref>4</xref></label><caption><title> The first four coherent groups of SUSHI data and related statistics</title></caption><table><tbody><thead><tr><th align="center" valign="middle" >c o h G ( 1 ) = ∪ α = 1 7 c o h C 1 ( α )</th><th align="center" valign="middle" >β</th><th align="center" valign="middle" >c o h G ( 2 ) = ∪ α = 1 8 c o h C 2 ( α )</th><th align="center" valign="middle" >β</th></tr></thead><tr><td align="center" valign="middle" >8. toro (fatty tuna)</td><td align="center" valign="middle" >7.62</td><td align="center" valign="middle" >8. toro (fatty tuna)</td><td align="center" valign="middle" >6.15</td></tr><tr><td align="center" valign="middle" >5. uni (sea urchin)</td><td align="center" valign="middle" >6.31</td><td align="center" valign="middle" >2. anago (sea eel)</td><td align="center" valign="middle" >5.97</td></tr><tr><td align="center" valign="middle" >6. sake (salmon roe)</td><td align="center" valign="middle" >5.92</td><td align="center" valign="middle" >1. ebi (shrimp)</td><td align="center" valign="middle" >5.92</td></tr><tr><td align="center" valign="middle" >3. maguro (tuna)</td><td align="center" valign="middle" >5.49</td><td align="center" valign="middle" >7. tamago (egg)</td><td align="center" valign="middle" >5.76</td></tr><tr><td align="center" valign="middle" >2. anago (sea eel)</td><td align="center" valign="middle" >5.35</td><td align="center" valign="middle" >3. maguro (tuna)</td><td align="center" valign="middle" >5.55</td></tr><tr><td align="center" valign="middle" >1. ebi (shrimp)</td><td align="center" valign="middle" >5.04</td><td align="center" valign="middle" >4. ika (squid)</td><td align="center" valign="middle" >5.41</td></tr><tr><td align="center" valign="middle" >9. tekka-maki (tuna roll)</td><td align="center" valign="middle" >3.27</td><td align="center" valign="middle" >9. tekka-maki (tuna roll)</td><td align="center" valign="middle" >3.80</td></tr><tr><td align="center" valign="middle" >4. ika (squid)</td><td align="center" valign="middle" >3.10</td><td align="center" valign="middle" >10. kappa-maki (cucumber roll)</td><td align="center" valign="middle" >2.56</td></tr><tr><td align="center" valign="middle" >7. tamago (egg)</td><td align="center" valign="middle" >1.94</td><td align="center" valign="middle" >6. sake (salmon roe)</td><td align="center" valign="middle" >2.45</td></tr><tr><td align="center" valign="middle" >10. kappa-maki (cucumber roll)</td><td align="center" valign="middle" >0.97</td><td align="center" valign="middle" >5. uni (sea urchin)</td><td align="center" valign="middle" >1.44</td></tr><tr><td align="center" valign="middle" >C r o s s ( c o h G ( 1 ) ) = 27.3 %</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >C r o s s ( c o h G ( 2 ) ) = 35.38 %</td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >| c o h G ( 1 ) | = 2418   ( 48.36 % )</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >| c o h G ( 2 ) | = 955   ( 19.10 % )</td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >c o h G ( 3 ) = ∪ α = 1 8 c o h C 3 ( α )</td><td align="center" valign="middle" >β</td><td align="center" valign="middle" >c o h G ( 4 ) = ∪ α = 1 8 c o h C 4 ( α )</td><td align="center" valign="middle" >β</td></tr><tr><td align="center" valign="middle" >8. toro (fatty tuna)</td><td align="center" valign="middle" >7.31</td><td align="center" valign="middle" >4. ika (squid)</td><td align="center" valign="middle" >6.67</td></tr><tr><td align="center" valign="middle" >6. sake (salmon roe)</td><td align="center" valign="middle" >6.62</td><td align="center" valign="middle" >5. uni (sea urchin)</td><td align="center" valign="middle" >6.50</td></tr><tr><td align="center" valign="middle" >3. maguro (tuna)</td><td align="center" valign="middle" >6.30</td><td align="center" valign="middle" >6. sake (salmon roe)</td><td align="center" valign="middle" >6.43</td></tr><tr><td align="center" valign="middle" >9. tekka-maki (tuna roll)</td><td align="center" valign="middle" >6.00</td><td align="center" valign="middle" >1. ebi (shrimp)</td><td align="center" valign="middle" >6.16</td></tr><tr><td align="center" valign="middle" >7. tamago (egg)</td><td align="center" valign="middle" >3.76</td><td align="center" valign="middle" >8. toro (fatty tuna)</td><td align="center" valign="middle" >3.69</td></tr><tr><td align="center" valign="middle" >4. ika (squid)</td><td align="center" valign="middle" >3.41</td><td align="center" valign="middle" >7. tamago (egg)</td><td align="center" valign="middle" >3.39</td></tr><tr><td align="center" valign="middle" >2. anago (sea eel)</td><td align="center" valign="middle" >3.00</td><td align="center" valign="middle" >2. anago (sea eel)</td><td align="center" valign="middle" >3.21</td></tr><tr><td align="center" valign="middle" >1. ebi (shrimp)</td><td align="center" valign="middle" >2.92</td><td align="center" valign="middle" >9. tekka-maki (tuna roll)</td><td align="center" valign="middle" >3.14</td></tr><tr><td align="center" valign="middle" >10. kappa-maki (cucumber roll)</td><td align="center" valign="middle" >2.86</td><td align="center" valign="middle" >10. kappa-maki (cucumber roll)</td><td align="center" valign="middle" >2.99</td></tr><tr><td align="center" valign="middle" >5. uni (sea urchin)</td><td align="center" valign="middle" >2.80</td><td align="center" valign="middle" >3. maguro (tuna)</td><td align="center" valign="middle" >2.80</td></tr><tr><td align="center" valign="middle" >C r o s s ( c o h G ( 3 ) ) = 31.37 %</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >C r o s s ( c o h G ( 4 ) ) = 35.27 %</td><td align="center" valign="middle" ></td></tr><tr><td align="center" valign="middle" >| c o h G ( 3 ) | = 662   ( 13.24 % )</td><td align="center" valign="middle" ></td><td align="center" valign="middle" >| c o h G ( 4 ) | = 347   ( 6.94 % )</td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><p>psychologists and B was a community psychologist. In this election, voters ranked the five candidates in order of preference. Among the 15,449 votes, 5738 votes ranked all five candidates. We consider the data set which records the 5738 complete votes; it is available in [ [<xref ref-type="bibr" rid="scirp.107171-ref20">20</xref>], p. 96] and [ [<xref ref-type="bibr" rid="scirp.107171-ref5">5</xref>], <xref ref-type="table" rid="table1">Table 1</xref>]. The winner was candidate C.</p><p><xref ref-type="table" rid="table1">Table 1</xref>5 compares the results obtained by our method and the best distance-based mixture model given in [<xref ref-type="bibr" rid="scirp.107171-ref21">21</xref>]. Distance-based models have two parameters, a central modal ranking and a precision parameter. The precision parameter measures the peakedness of the distribution. [<xref ref-type="bibr" rid="scirp.107171-ref21">21</xref>] found that the Cayley distance produced better results than the Kendall and Spearman distances using BIC (Bayesian information criterion) and ICL (integrated complete likelihood) criteria. Parts a and b of <xref ref-type="table" rid="table1">Table 1</xref>5, are reproduced from [ [<xref ref-type="bibr" rid="scirp.107171-ref21">21</xref>], <xref ref-type="table" rid="table4">Table 4</xref> and <xref ref-type="table" rid="table5">Table 5</xref>].</p><p>Part c of <xref ref-type="table" rid="table1">Table 1</xref>5 summarizes the results of our approach, where we only describe the first four coherent groups: We find only the first two coherent groups as meaningfully interpretable based on the a priori knowledge of the candidates. Voters in c o h G ( 1 ) , with sample size of 31%, prefer the research oriented psychologists { A , C } over the rest. Voters in c o h G ( 2 ) , with sample size of 23.7%, prefer the clinical psychologists { D , E } over the rest. We interpret c o h G ( 3 ) and c o h G ( 4 ) as mixed B with 14.23% and 12% of the voters, respectively. Additionally, there is a n o i s y G making up 19.1% of the sample, which comprises c o h G ( 5 ) displayed in <xref ref-type="table" rid="table1">Table 1</xref>5.</p><p>[<xref ref-type="bibr" rid="scirp.107171-ref5">5</xref>] discussed this data set quite in detail; surprisingly, our results confirm his observations: a) There are two groups of candidates, { A , C } and { D , E } . The voters line up behind one group or the other; b) The APA divides into academicians and clinicians who are on uneasy terms. Voters seem to choose one type or the other, and then choose within; but the group effect predominates; c) Candidate B seems to fall in the middle, perhaps closer to D and E.</p><p>The following important observation emerges from the comparison of results in <xref ref-type="table" rid="table1">Table 1</xref>5. We have two distinct concepts of groups for rank data, categorical and latent variable based. To see this, consider groups 3 and 4 in part a of <xref ref-type="table" rid="table1">Table 1</xref>5:</p><table-wrap id="table15" ><label><xref ref-type="table" rid="table1">Table 1</xref>5</label><caption><title> A summary of results derived from three methods of analysis of APA election data. Parts (a) and (b) are from Murphy and Martin (2003)</title></caption><table><tbody><thead><tr><th align="center" valign="middle"  colspan="9"  >(a) Parameters of the best mixture model selected, Cayley-based, using BIC</th></tr></thead><tr><td align="center" valign="middle"  colspan="2"  >Group</td><td align="center" valign="middle" >sample%</td><td align="center" valign="middle"  colspan="5"  >modal orderings</td><td align="center" valign="middle" >precision</td></tr><tr><td align="center" valign="middle"  colspan="2"  >1</td><td align="center" valign="middle" >42</td><td align="center" valign="middle"  colspan="5"  >D ≻ B ≻ E ≻ C ≻ A</td><td align="center" valign="middle" >0.16</td></tr><tr><td align="center" valign="middle"  colspan="2"  >2</td><td align="center" valign="middle" >31</td><td align="center" valign="middle"  colspan="5"  >C ≻ D ≻ E ≻ A ≻ B</td><td align="center" valign="middle" >0.79</td></tr><tr><td align="center" valign="middle"  colspan="2"  >3</td><td align="center" valign="middle" >12</td><td align="center" valign="middle"  colspan="5"  >B ≻ C ≻ A ≻ D ≻ E</td><td align="center" valign="middle" >1.52</td></tr><tr><td align="center" valign="middle"  colspan="2"  >4</td><td align="center" valign="middle" >8</td><td align="center" valign="middle"  colspan="5"  >B ≻ C ≻ A ≻ E ≻ D</td><td align="center" valign="middle" >1.81</td></tr><tr><td align="center" valign="middle"  colspan="2"  >5</td><td align="center" valign="middle" >7</td><td align="center" valign="middle"  colspan="5"  >B ≻ D ≻ A ≻ E ≻ C</td><td align="center" valign="middle" >1.72</td></tr><tr><td align="center" valign="middle"  colspan="9"  >(b) Parameters of the best mixture model selected, Cayley-based, using ICL</td></tr><tr><td align="center" valign="middle" >Group</td><td align="center" valign="middle"  colspan="2"  >sample%</td><td align="center" valign="middle"  colspan="5"  >modal ordering</td><td align="center" valign="middle" >precision</td></tr><tr><td align="center" valign="middle" >1</td><td align="center" valign="middle"  colspan="2"  >100</td><td align="center" valign="middle"  colspan="5"  >B ≻ C ≻ A ≻ E ≻ D</td><td align="center" valign="middle" >0.25</td></tr><tr><td align="center" valign="middle"  colspan="9"  >(c) The first five coherent groups, each composed of two coherent clusters</td></tr><tr><td align="center" valign="middle" >Group</td><td align="center" valign="middle"  colspan="2"  >sample%</td><td align="center" valign="middle" >β ( C )</td><td align="center" valign="middle" >β ( A )</td><td align="center" valign="middle" >β ( B )</td><td align="center" valign="middle" >β ( E )</td><td align="center" valign="middle" >β ( D )</td><td align="center" valign="middle" >Cross</td></tr><tr><td align="center" valign="middle" >cohG(1) Research</td><td align="center" valign="middle"  colspan="2"  >31.0</td><td align="center" valign="middle" >3.55</td><td align="center" valign="middle" >3.15</td><td align="center" valign="middle" >1.31</td><td align="center" valign="middle" >1.15</td><td align="center" valign="middle" >0.85</td><td align="center" valign="middle" >10.22%</td></tr><tr><td align="center" valign="middle" >cohG(2) Clinical</td><td align="center" valign="middle"  colspan="2"  >23.7</td><td align="center" valign="middle" >0.83</td><td align="center" valign="middle" >1.28</td><td align="center" valign="middle" >1.28</td><td align="center" valign="middle" >3.31</td><td align="center" valign="middle" >3.30</td><td align="center" valign="middle" >12.90%</td></tr><tr><td align="center" valign="middle" >cohG(3) mixed B</td><td align="center" valign="middle"  colspan="2"  >14.2</td><td align="center" valign="middle" >0.66</td><td align="center" valign="middle" >2.70</td><td align="center" valign="middle" >2.96</td><td align="center" valign="middle" >0.71</td><td align="center" valign="middle" >2.97</td><td align="center" valign="middle" >12.45%</td></tr><tr><td align="center" valign="middle" >cohG(4) mixed B</td><td align="center" valign="middle"  colspan="2"  >12.0</td><td align="center" valign="middle" >2.85</td><td align="center" valign="middle" >0.77</td><td align="center" valign="middle" >2.86</td><td align="center" valign="middle" >2.80</td><td align="center" valign="middle" >0.72</td><td align="center" valign="middle" >10.22%</td></tr><tr><td align="center" valign="middle" >cohG(5) outlier</td><td align="center" valign="middle"  colspan="2"  >8.6</td><td align="center" valign="middle" >0.96</td><td align="center" valign="middle" >3.30</td><td align="center" valign="middle" >1.31</td><td align="center" valign="middle" >3.40</td><td align="center" valign="middle" >1.00</td><td align="center" valign="middle" >9.88%</td></tr><tr><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td><td align="center" valign="middle" ></td></tr></tbody></table></table-wrap><p>Group 3 is based on the modal category B ≻ C ≻ A ≻ D ≻ E and group 4 is based on the modal category B ≻ C ≻ A ≻ E ≻ D . The only difference between these two modal categories is the permutation of the least ranked two clinical psychologist candidates { D , E } ; this difference is not important and does not appear in our approach, which is a latent variable approach.</p>Description<p>The eight coherent clusters of the first four coherent groups can simply be described as:</p><p>c o h 1 C ( 1 ) : T v ( τ J 2 ( S 2 ) = τ { A , C } { 3,4 } = { 3,4 } ) = 7 for v = 1, ⋯ ,1233 .</p><p>c o h 1 C ( 2 ) : T v ( τ J 2 ( S 2 ) = τ { A , C } { 3,4 } = { 2 ,4 } ) = 6 for v = 1, ⋯ ,545 .</p><p>c o h 2 C ( 1 ) : T v ( τ J 2 ( S 2 ) = τ { D , E } { 3,4 } = { 3,4 } ) = 7 for v = 1, ⋯ ,834 .</p><p>c o h 2 C ( 2 ) : T v ( τ J 2 ( S 2 ) = τ { D , E } { 3,4 } = { 2 ,4 } ) = 6 for v = 1, ⋯ ,526 .</p><p>c o h 3 C ( 1 ) : T v ( τ J 1 ( S 1 ) = τ { C , E } { 0,1 } = { 0,1 } ) = 1 for v = 1 , ⋯ , 512 .</p><p>c o h 3 C ( 2 ) : T v ( τ J 1 ( S 1 ) = τ { C , E } { 0,1 } = { 0, 2 } ) = 2 for v = 1 , ⋯ , 305 .</p><p>c o h 4 C ( 1 ) : T v ( τ J 1 ( S 1 ) = τ { A , D } { 0,1 } = { 0,1 } ) = 1 for v = 1 , ⋯ , 350 .</p><p>c o h 4 C ( 2 ) : T v ( τ J 1 ( S 1 ) = τ { A , D } { 0,1 } = { 0, 2 } ) = 2 for v = 1 , ⋯ , 338 .</p><p>In this case, we can also visualize all the orderings belonging to a coherent group: <xref ref-type="fig" rid="fig1">Figure 1</xref>1 and <xref ref-type="fig" rid="fig1">Figure 1</xref>2 display all the preferences belonging to the two coherent clusters of the first coherent group. The label CAEBD162 in <xref ref-type="fig" rid="fig1">Figure 1</xref>1 should be interpreted as the preference C ≻ A ≻ E ≻ B ≻ D repeated 162 times.</p></sec><sec id="s10"><title>10. Riffle Independence Model</title><p>Riffle independence is a nonparametric probabilistic modelling method of preferences developed by [<xref ref-type="bibr" rid="scirp.107171-ref2">2</xref>], which generalizes the independence model. It can be described in the following way:</p><p>(a) Partition the set J of d distinct items into two disjoint subsets J 1 of size d 1 and J 2 of size d 2 . Then generate an ordering of items within each subset according to a certain ranking model. This implies that any ordering of the d items can be written as a direct product of two disconnected orderings; which in its turn implies the independence of the two subsets J 1 and J 2 . So the model complexity of this step is of order d 1 ! + d 2 ! .</p><p>(b) Interleave the two independent orderings for these two subsets using a riffle shuffle to form a combined ordering. An interleaving is a binary mapping from the set of orderings to { J 1 , J 2 } . The model complexity of this step is of order d ! / ( d 1 ! d 2 ! ) . The interleaving step generates the riffled independence of the two subsets J 1 and J 2 .</p><p>So the combined model complexity of both steps is d 1 ! + d 2 ! + d ! / ( d 1 ! d 2 ! ) which is much smaller than d ! = ( d 1 + d 2 ) ! .</p><p>For example, consider an ordering of the items in the set J = { A , B , C , D , E , F } from its two subsets J 1 = { A , C } and J 2 = { B , D , E , F } . In the first step, relative orderings of the items in J 1 and J 2 are drawn independently. Suppose we obtain the relative ordering φ ( J 1 ) = ( C ≻ A ) in J 1 , and the relative ordering φ ( J 2 ) = ( B ≻ D ≻ F ≻ E ) in J 2 . Then, in the second step, the two relative orderings are combined by interleaving the items in the two subsets. For instance, if the interleaving process is ω ( J 1 , J 2 ) = ( J 1 , J 2 , J 2 , J 1 , J 2 , J 2 ) , where the relative ordering of the items in each subset remains unchanged, the combined ordering is then determined by the composition</p><p>ω ( J 1 , J 2 ) ∗ ( φ ( J 1 ) , φ ( J 2 ) ) = ( C ≻ B ≻ D ≻ A ≻ F ≻ E ) = φ ( J ) .</p><p>Given the two subsets J 1 and J 2 with their orderings φ ( J 1 ) and φ ( J 2 ) and interleaving ω ( J 1 , J 2 ) generated from models with probability distributions f J 1 , g J 2 and m ω , respectively, the probability of observed ordering under the riffle independence model is</p><p>P ( φ ( J ) ) = m ω ( ω ( J 1 , J 2 ) ) f J 1 ( φ ( J 1 ) ) g J 2 ( φ ( J 2 ) ) .</p><p>There are two formulations of riffle shuffle for rank data in statistics: probabilistic and exploratory. In the riffled independence model, the set of items is partitioned recursively, while in the exploratory approach the set of voters is partitioned recursively.</p></sec><sec id="s11"><title>11. Conclusions</title><p>The main contribution of this paper is the introduction of an exploratory riffle shuffling procedure to reveal and display the structure of diffuse rank data for large sample sizes. The new notion of a coherent cluster, that we developed, is simply based on the geometric notion of taxicab projection of points on the first TCA axis globally and locally; furthermore, it has nice mathematical properties. Coherent clusters of a coherent group represent the same latent variable opposing preferred items to disliked items, and can easily be interpreted and displayed.</p><p>Like Occam’s razor, step by step, our procedure peels the essential structural layers (coherent groups) of rank data.</p><p>Our method was able to discover some other aspects of the rank data, such as outliers or small groups, which are eclipsed or masked by well-established methods, such as distance or random utility-based methods. The major reason for this is that in random utility-based methods the multivariate nature of a preference is reduced to binary preferences (paired comparisons), and in Mallows distance related methods distances between any two preferences are bounded.</p><p>We presented a new index, Cross, that quantifies the extent of crossing of scores between the optimal binary partition of the items that resulted from TCA. The crossing index of a group is based on the first taxicab dispersion measure: it takes values between 0 and 100%, so it is easily interpretable.</p><p>The proposed approach can easily be generalized to the analysis of rankings with ties and partial rankings.</p><p>The package TaxicabCA written in R available on CRAN can be used to do the calculations.</p></sec><sec id="s12"><title>Acknowledgements</title><p>Choulakian’s research has been supported by NSERC grant (RGPIN-2017-05092) of Canada.</p></sec><sec id="s13"><title>Conflicts of Interest</title><p>The authors declare no conflicts of interest regarding the publication of this paper.</p></sec><sec id="s14"><title>Cite this paper</title><p>Choulakian, V. and Allard, J. (2021) Uncovering and Displaying the Coherent Groups of Rank Data by Exploratory Riffle Shuffling. Open Journal of Statistics, 11, 178-212. https://doi.org/10.4236/ojs.2021.111010</p></sec><sec id="s15"><title>Appendix</title><p>Let R = ( r i j ) for i = 1 , ⋯ , n and j = 1 , ⋯ , d represent the Borda scorings for preferences, where r i j takes values 0, ⋯ , d − 1 . Similarly, let R &#175; represent the reverse Borda scorings, whose column sums are the cordinates of the row named n e g a = n β &#175; = 1 ′ n R &#175; . We consider the application of TCA to the data set</p><p>R n e g a = ( R n e g a )</p><p>of size ( n + 1 ) &#215; d . So let</p><p>P = R n e g a / t</p><p>be the correspondence table associated with R n e g a , where t = 2 n ∑ j = 0 d − 1     j = n d ( d − 1 ) . We have</p><p>p i ∗ = 1 2 n       for     i = 1, ⋯ , n (14)</p><p>= 1 2       for     i = n + 1, (15)</p><p>and</p><p>p ∗ j = 1 d         for     j = 1, ⋯ , d . (16)</p><p>The first residuel correspondence matrix will be</p><p>p i j ( 1 ) = p i j − p i ∗ p ∗ j (17)</p><p>= r i j t − 1 2 n . 1 d         for   i = 1, ⋯ , n (18)</p><p>= n e g a j t − 1 2 . 1 d         for   i = n + 1. (19)</p><p>Consider the nontrivial binary partition of the set S = { 0,1, ⋯ , d − 1 } into S = S 1 ∪ S 2 , where | S 1 | = d 1 , | S 2 | = d 2 and d = d 1 + d 2 . To eliminate the sign indeterminacy in the first TCA principal axis, we fix v 1 ( n e g a ) = v 1 ( n + 1 ) = − 1 ; and we designate by S 1 the set of item indices such that the first TCA principal axis coordinates are negative, that is, u 1 ( j ) = − 1 for j ∈ S 1 . It follows that u 1 ( j ) = 1 for j ∈ S 2 .</p><p>Now we have by (4) for i = 1 , ⋯ , n</p><p>a i 1 = ∑ j = 1 d u 1 ( j ) p i j ( 1 ) = ∑ j ∈ S 1 u 1 ( j ) p i j ( 1 ) + ∑ j ∈ S 2 u 1 ( j ) p i j ( 1 ) = − ∑ j ∈ S 1 p i j ( 1 ) + ∑ j ∈ S 2 p i j ( 1 ) = − 2 ∑ j ∈ S 1 p i j ( 1 )   by ( 17 ) = − 2 ∑ j ∈ S 1 ( r i j t − 1 2 n . 1 d )   by ( 18 ) = d 1 n d − 2 t ∑ j ∈ S 1 r i j ; (20)</p><p>and from which we deduce by (5) for i = 1 , ⋯ , n</p><p>f i 1 = a i 1 p i ∗ = 2 d 1 d − 4 d ( d − 1 ) ∑ j ∈ S 1 r i j . (21)</p><p>We have the following Theorem concerning the first TCA principal factor scores of respondents f i 1 for i = 1 , ⋯ , n .</p><p>Theorem 1:</p><p>a) The maximum number of distinct clusters of n respondents on the first TCA principal axis (distinct f i 1 values) is d 1 d 2 + 1 .</p><p>Proof: We consider the two extreme cases of S 1 and calculate the summation term in (21):</p><p>For S 1 = { 0 , 1 , ⋯ , d 1 − 1 } , ∑ j ∈ S 1 r i j = ∑ j = 0 d 1 − 1     j = d 1 ( d 1 − 1 ) 2 .</p><p>For S 1 = { d − d 1 , 1 , ⋯ , d − 1 } , ∑ j ∈ S 1 r i j = ∑ j = d − d 1 d − 1     j = ∑ j = d 2 d − 1     j = d 1 ( d 2 + d − 1 ) 2 .</p><p>It follows that</p><p>d 1 ( d 1 − 1 ) 2 ≤ ∑ j ∈ S 1     r i j ≤ d 1 ( d 2 + d − 1 ) 2 ;</p><p>so ∑ j ∈ S 1     r i j can take at most d 1 ( d 2 + d − 1 ) 2 − d 1 ( d 1 − 1 ) 2 + 1 = d 1 d 2 + 1 values.</p><p>b) The maximum value that f i 1 can attain is 2 d 1 d 2 d ( d − 1 ) .</p><p>Proof: From (21) and Part a, it follows that the maximum value that f i 1 can attain is ( 2 d 1 d − 4 d ( d − 1 ) d 1 ( d 1 − 1 ) 2 ) = 2 d 1 d 2 d ( d − 1 ) .</p><p>c) The minimum value that f i 1 can attain is − 2 d 1 d 2 d ( d − 1 ) .</p><p>Proof: From (21) and Part a, it follows that the minimum value that f i 1 can attain is ( 2 d 1 d − 4 d ( d − 1 ) d 1 ( d 2 + d − 1 ) 2 ) = − 2 d 1 d 2 d ( d − 1 ) .</p><p>d) If the number of distinct clusters is maximum, d 1 d 2 + 1 , then the gap between two contiguous f i 1 values is 4 d ( d − 1 ) .</p><p>Proof: Suppose that the number of distinct clusters is maximum, d 1 d 2 + 1 . We consider the first TCA factor score f i 1 = 2 d 1 d − 4 d ( d − 1 ) ∑ j ∈ S 1     r i j which is different in value from the two extreme values &#177; 2 d 1 d 2 d ( d − 1 ) . Then f i 1 1 = 2 d 1 d − 4 d ( d − 1 ) ( − 1 + ∑ j ∈ S 1     r i j ) will be the contiguous higher value to f i 1 ; and similarly f i 2 1 = 2 d 1 d − 4 d ( d − 1 ) ( 1 + ∑ j ∈ S 1     r i j ) will be the contiguous lower value to f i 1 ; and the required result follows.</p><p>Proposition 1: For a voting profile V, δ 1 ≥ | f 1 ( n e g a ) | .</p><p>Proof: Let a 1 = ( a 11 a 1 ( n e g a ) ) . We need the following three observations.</p><p>First, it is well known that a 1 is centered by (5) and (9),</p><p>1 ′ n + 1 a 1 = 0 = 1 ′ n a 11 + a 1 ( n e g a ) ;</p><p>from which we get,</p><p>| 1 ′ n a 11 | = | a 1 ( n e g a ) | . (22)</p><p>Second, by triangle inequality of the L<sub>1</sub> norm we have</p><p>‖ a 11 ‖ 1 ≥ | 1 ′ n a 11 | . (23)</p><p>Third, the marginal relative frequency of the nega row is p n e g a ∗ = 1 / 2 by (15), and f i 1 = a i 1 / p i ∗ for i = 1 , ⋯ , n + 1 by (5); so we have</p><p>f 1 ( n e g a ) = 2 a 1 ( n e g a ) . (24)</p><p>Now we have by (7)</p><p>δ 1 = ‖ a 1 ‖ 1 = ‖ a 11 ‖ 1 + | a 1 ( n e g a ) | ≥ | 1 ′ n a 11 | + | a 1 ( n e g a ) |   by ( 23 ) = 2 | a 1 ( n e g a ) |   by ( 22 ) = | f 1 ( n e g a ) |   by ( 24 ) (25)</p><p>Propostion 2: Let c o h C m ( α ) = V m , α be the αth coherent cluster of the mth coherent group characterized by f 1 V m , α ( σ ) = f α V m for all σ ∈ c o h C m ( α ) . Then δ 1 = f α V m = − f 1 ( n e g a ) .</p><p>Proof: By Definition 1 of the coherency of the cluster V m , α , we have 0 &lt; f 1 V m , α ( i ) = f α V m for i = 1, ⋯ , | c o h C m ( α ) | ; by (5) it follows that 0 &lt; a i 1 = f α V m / n for i = 1, ⋯ , | c o h C m ( α ) | ; so (25) becomes equality, ‖ a 11 ‖ 1 = ∑ i = 1 n     a i 1 = | 1 ′ n a 11 | , and the required result follows.</p><p>Proposition 3 is a corollary to the following general result</p><p>Theorem 3: If the first TCA principal axis of the columns of R n e g a is v 1 = ( 1 n − 1 ) , then</p><p>the first principal column factor score g 1 of the d items is an affine function of the Borda scale β ; that is, g 1 ( j ) = 2 d − 1 β ( j ) − 1 or c o r r ( g 1 , β ) = 1 .</p><p>Proof: Suppose that v 1 = ( 1 n − 1 ) ; then by (4) for j = 1 , ⋯ , d</p><p>b 1 ( j ) = ∑ i = 1 n + 1     v 1 ( i ) p i j ( 1 ) = ∑ i = 1 n     p i j ( 1 ) − p ( n + 1 ) j ( 1 )</p><p>= 2 ∑ i = 1 n     p i j ( 1 ) by (17)</p><p>= 2 ∑ i = 1 n ( p i j − p i ∗ p ∗ j )</p><p>= 2 ∑ i = 1 n r i j / t − p ∗ j by (14)</p><p>= 2 n β ( j ) / t − p ∗ j</p><p>Thus by (5) for j = 1 , ⋯ , d</p><p>g 1 ( j ) = b 1 ( j ) / p ∗ j = 2 n β ( j ) / t − p ∗ j p ∗ j = 2 β ( j ) d − 1 − 1.</p><p>Proposition 4: The crossing index of a coherent cluster is</p><p>C r o s s ( c o h C ( α ) ) = 2 ( α − 1 ) d 1 d 2 .</p><p>Proof: Easily shown by using Definition 3 and Proposition 2.</p><p>The proof of Theorem 2a easily follows from Theorem 3. The proof of Theorem 2b is similar to the proof of Proposition 1. The proof of Theorem 2c is similar to the proof of Proposition 4.</p></sec></body><back><ref-list><title>References</title><ref id="scirp.107171-ref1"><label>1</label><mixed-citation publication-type="other" xlink:type="simple">Kamishima, T. (2003) Nantonac Collaborative Filtering: Recommendation Based on Order Responses. Proceedings of the 9th ACM SIGKDD International Conference on Knowledge Discovery and Data Mining, Washington DC, August 2003, 583-588.  
https://doi.org/10.1145/956750.956823</mixed-citation></ref><ref id="scirp.107171-ref2"><label>2</label><mixed-citation publication-type="other" xlink:type="simple">Huang, J. and Guestrin, C. (2012) Uncovering the Riffled Independence Structure of Ranked Data. Electronic Journal of Statistics, 6, 199-230.  
https://doi.org/10.1214/12-EJS670</mixed-citation></ref><ref id="scirp.107171-ref3"><label>3</label><mixed-citation publication-type="other" xlink:type="simple">Lu, T. and Boutilier, C. (2014) Effective Sampling and Learning for Mallows Models with Pairwise Preference Data. Journal of Machine Learning Research, 15, 3783-3829.</mixed-citation></ref><ref id="scirp.107171-ref4"><label>4</label><mixed-citation publication-type="other" xlink:type="simple">Vitelli, V., S&amp;oslash;renson, &amp;Oslash;., Crispino, M., Frigessi, A. and Arjas, E. (2018) Probabilistic Preference Learning with the Mallows Rank Model. Journal of Machine Learning Research, 18, 1-49.</mixed-citation></ref><ref id="scirp.107171-ref5"><label>5</label><mixed-citation publication-type="other" xlink:type="simple">Diaconis, P. (1989) A Generalization of Spectral Analysis with Application to Ranked Data. Annals of Statistics, 17, 949-979.  
https://doi.org/10.1214/aos/1176347251</mixed-citation></ref><ref id="scirp.107171-ref6"><label>6</label><mixed-citation publication-type="other" xlink:type="simple">Marden, J.I. (1995) Analyzing and Modeling of Rank Data. Chapman &amp; Hall, London</mixed-citation></ref><ref id="scirp.107171-ref7"><label>7</label><mixed-citation publication-type="other" xlink:type="simple">Alvo, M. and Yu, P. (2014) Statistical Methods for Ranking Data. Springer, New York. https://doi.org/10.1007/978-1-4939-1471-5</mixed-citation></ref><ref id="scirp.107171-ref8"><label>8</label><mixed-citation publication-type="other" xlink:type="simple">Bayer, D. and Diaconis, P. (1992) Trailing the Dovetail Shuffle to Its Lair. Annals of Probability, 2, 294-313. https://doi.org/10.1214/aoap/1177005705</mixed-citation></ref><ref id="scirp.107171-ref9"><label>9</label><mixed-citation publication-type="other" xlink:type="simple">Choulakian, V. (2016) Globally Homogenous Mixture Components and Local Heterogeneity of Rank Data. arXiv:1608.05058</mixed-citation></ref><ref id="scirp.107171-ref10"><label>10</label><mixed-citation publication-type="other" xlink:type="simple">Choulakian, V. (2006) Taxicab Correspondence Analysis. Psychometrika, 71, 333-345.  
https://doi.org/10.1007/s11336-004-1231-4</mixed-citation></ref><ref id="scirp.107171-ref11"><label>11</label><mixed-citation publication-type="other" xlink:type="simple">Choulakian, V. (2016) Matrix Factorizations Based on Induced Norms. Statistics, Optimization and Information Computing, 4, 1-14.  
https://doi.org/10.19139/soic.v4i1.160</mixed-citation></ref><ref id="scirp.107171-ref12"><label>12</label><mixed-citation publication-type="journal" xlink:type="simple"><name name-style="western"><surname>De Borda</surname><given-names> J. </given-names></name>,<etal>et al</etal>. (<year>1781</year>)<article-title>Mémoire sur les élections au scrutin</article-title><source> Histoire de L’Académie Royale des Sciences</source><volume> 102</volume>,<fpage> 657</fpage>-<lpage>665</lpage>.<pub-id pub-id-type="doi"></pub-id></mixed-citation></ref><ref id="scirp.107171-ref13"><label>13</label><mixed-citation publication-type="other" xlink:type="simple">Benzécri, J.P. (1991) Comment on Leo A. Goodman’s Invited Paper. Journal of the American Statistical Association, 86, 1112-1115.  
https://doi.org/10.1080/01621459.1991.10475157</mixed-citation></ref><ref id="scirp.107171-ref14"><label>14</label><mixed-citation publication-type="book" xlink:type="simple">Van de Velden, M. (2000) Dual Scaling and Correspondence Analysis of Rank Order Data. In: Heijmans, R.D.H., Pollock, D.S.G. and Satorra, A. Eds., Innovations in Multivariate Statistical Analysis, Vol. 36, Kluwer Academic Publishers, Dordrecht, 87-99. https://doi.org/10.1007/978-1-4615-4603-0_6</mixed-citation></ref><ref id="scirp.107171-ref15"><label>15</label><mixed-citation publication-type="other" xlink:type="simple">Torres, A. and Greenacre, M. (2002) Dual Scaling and Correspondence Analysis of Preferences, Paired Comparisons and Ratings. International Journal of Research in Marketing, 19, 401-405. https://doi.org/10.1016/S0167-8116(02)00101-5</mixed-citation></ref><ref id="scirp.107171-ref16"><label>16</label><mixed-citation publication-type="other" xlink:type="simple">Nishisato, S. (1980) Analysis of Categorical Data: Dual Scaling and Its Applications. University of Toronto Press, Toronto. https://doi.org/10.3138/9781487577995</mixed-citation></ref><ref id="scirp.107171-ref17"><label>17</label><mixed-citation publication-type="journal" xlink:type="simple"><name name-style="western"><surname>Choulakian</surname><given-names> V. </given-names></name>,<etal>et al</etal>. (<year>2014</year>)<article-title>Taxicab Correspondence Analysis of Ratings and Rankings</article-title><source> Journal de la Société Franaise de Statistique</source><volume> 155</volume>,<fpage> 1</fpage>-<lpage>23</lpage>.<pub-id pub-id-type="doi"></pub-id></mixed-citation></ref><ref id="scirp.107171-ref18"><label>18</label><mixed-citation publication-type="other" xlink:type="simple">Khot, S. and Naor, A. (2012) Grothendieck-Type Inequalities in Combinatorial Optimization. Communications on Pure and Applied Mathematics, 65, 992-1035.  
https://doi.org/10.1002/cpa.21398</mixed-citation></ref><ref id="scirp.107171-ref19"><label>19</label><mixed-citation publication-type="other" xlink:type="simple">Choulakian, V. and Abou-Samra, G. (2020) Mean Absolute Deviations about the Mean, Cut Norm and Taxicab Correspondence Analysis. Open Journal of Statistics, 10, 97-112. https://doi.org/10.4236/ojs.2020.101008</mixed-citation></ref><ref id="scirp.107171-ref20"><label>20</label><mixed-citation publication-type="other" xlink:type="simple">Diaconis, P. (1988) Group Representations in Probability and Statistics. Institute of Mathematical Statistics, Hayward, CA.</mixed-citation></ref><ref id="scirp.107171-ref21"><label>21</label><mixed-citation publication-type="other" xlink:type="simple">Murphy, T.B. and Martin, D. (2003) Mixtures of Distance-Based Models for Ranking Data. Computational Statistics and Data Analysis, 41, 645-655.  
https://doi.org/10.1016/S0167-9473(02)00165-2</mixed-citation></ref></ref-list></back></article>