<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>topic Re: Finding duplicate rows using DAX in DAX Commands and Tips</title>
    <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3223111#M117918</link>
    <description>&lt;P&gt;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="301940" data-lia-user-login="cwollett" class="lia-mention lia-mention-user"&gt;cwollett&lt;/a&gt;&amp;nbsp;&lt;BR /&gt;&lt;BR /&gt;Can you explain you did you caculate 1 for Group A and 0 for Group B?&lt;BR /&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;/P&gt;</description>
    <pubDate>Sat, 06 May 2023 07:28:01 GMT</pubDate>
    <dc:creator>Fowmy</dc:creator>
    <dc:date>2023-05-06T07:28:01Z</dc:date>
    <item>
      <title>Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3222901#M117890</link>
      <description>&lt;P&gt;My scenario is a much larger dataset with longer strings for the two columns, but this should be generalizable so for simplicity, let's say I have a base table with the following data:&lt;/P&gt;&lt;TABLE border="1"&gt;&lt;TBODY&gt;&lt;TR&gt;&lt;TD&gt;&lt;STRONG&gt;Group Name&lt;/STRONG&gt;&lt;/TD&gt;&lt;TD&gt;&lt;STRONG&gt;Member Name&lt;/STRONG&gt;&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group A&lt;/TD&gt;&lt;TD&gt;Alex&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group A&lt;/TD&gt;&lt;TD&gt;Betty&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group A&lt;/TD&gt;&lt;TD&gt;Charles&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group B&lt;/TD&gt;&lt;TD&gt;Alex&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group B&lt;/TD&gt;&lt;TD&gt;Betty&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group C&lt;/TD&gt;&lt;TD&gt;Alex&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group C&lt;/TD&gt;&lt;TD&gt;Betty&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group C&lt;/TD&gt;&lt;TD&gt;Charles&lt;/TD&gt;&lt;/TR&gt;&lt;/TBODY&gt;&lt;/TABLE&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;I know how to make a measure that concatenates the members into a single string:&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;LI-CODE lang="javascript"&gt;Member List = 
CONCATENATEX(
    VALUES(Example[Member Name]),
    Example[Member Name],
    ", ",
    Example[Member Name],
    ASC
)&lt;/LI-CODE&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;TABLE border="1"&gt;&lt;TBODY&gt;&lt;TR&gt;&lt;TD&gt;&lt;STRONG&gt;Group Name&lt;/STRONG&gt;&lt;/TD&gt;&lt;TD&gt;&lt;STRONG&gt;Member List&lt;/STRONG&gt;&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group A&lt;/TD&gt;&lt;TD&gt;Alex, Betty, Charles&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group B&lt;/TD&gt;&lt;TD&gt;Alex, Betty&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group C&lt;/TD&gt;&lt;TD&gt;Alex, Betty, Charles&lt;/TD&gt;&lt;/TR&gt;&lt;/TBODY&gt;&lt;/TABLE&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;What I would like to be able to do is have a way to do a distinct on that Member List column so that I can find duplicates. I'd also like to do it using a temp table and not one in storage since I actually have something that's thousands of rows and the Member List string is going to be thousands of characters, hence the DAX preference.&lt;/P&gt;&lt;P&gt;So I'm looking for something like:&lt;/P&gt;&lt;TABLE border="1"&gt;&lt;TBODY&gt;&lt;TR&gt;&lt;TD&gt;&lt;STRONG&gt;Group Name&lt;/STRONG&gt;&lt;/TD&gt;&lt;TD&gt;&lt;STRONG&gt;isDuplicate&lt;/STRONG&gt;&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group A&lt;/TD&gt;&lt;TD&gt;1&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group B&lt;/TD&gt;&lt;TD&gt;0&lt;/TD&gt;&lt;/TR&gt;&lt;TR&gt;&lt;TD&gt;Group C&lt;/TD&gt;&lt;TD&gt;1&lt;/TD&gt;&lt;/TR&gt;&lt;/TBODY&gt;&lt;/TABLE&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;Any suggestions? I've tried to use ADDCOLUMNS(SUMMARIZE( ... where I add the concatenatex as an additional column, but when I try to do something like DISTINCTCOUNT on that new column, I get errors.&lt;/P&gt;</description>
      <pubDate>Fri, 05 May 2023 22:02:33 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3222901#M117890</guid>
      <dc:creator>cwollett</dc:creator>
      <dc:date>2023-05-05T22:02:33Z</dc:date>
    </item>
    <item>
      <title>Re: Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3223111#M117918</link>
      <description>&lt;P&gt;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="301940" data-lia-user-login="cwollett" class="lia-mention lia-mention-user"&gt;cwollett&lt;/a&gt;&amp;nbsp;&lt;BR /&gt;&lt;BR /&gt;Can you explain you did you caculate 1 for Group A and 0 for Group B?&lt;BR /&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;/P&gt;</description>
      <pubDate>Sat, 06 May 2023 07:28:01 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3223111#M117918</guid>
      <dc:creator>Fowmy</dc:creator>
      <dc:date>2023-05-06T07:28:01Z</dc:date>
    </item>
    <item>
      <title>Re: Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3223308#M117943</link>
      <description>&lt;P&gt;Hi&amp;nbsp;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="301940" data-lia-user-login="cwollett" class="lia-mention lia-mention-user"&gt;cwollett&lt;/a&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;I hope this works. However, I followed the same methodology of using CONCATENATEX but didn't have the chance to test it. My guess is that even if it works it won't be so efficient. I think other approaches are possible but I need to be on my PC to test.&amp;nbsp;&lt;BR /&gt;Duplicate =&lt;BR /&gt;VAR MemberList =&lt;BR /&gt;CONCATENATEX (&lt;BR /&gt;VALUES ( Example[Member Name] ),&lt;BR /&gt;Example[Member Name],&lt;BR /&gt;", ",&lt;BR /&gt;Example[Member Name], ASC&lt;BR /&gt;)&lt;BR /&gt;RETURN&lt;BR /&gt;SUMX (&lt;BR /&gt;ALL ( Example[Group Name] ),&lt;BR /&gt;INT (&lt;BR /&gt;CONCATENATEX (&lt;BR /&gt;CALCULATETABLE (&lt;BR /&gt;VALUES ( Example[Member Name] ),&lt;BR /&gt;ALLEXCEPT ( Example, Example[Group Name] )&lt;BR /&gt;),&lt;BR /&gt;Example[Member Name],&lt;BR /&gt;", ",&lt;BR /&gt;Example[Member Name], ASC&lt;BR /&gt;) = MemberList&lt;BR /&gt;)&lt;BR /&gt;) - 1&lt;BR /&gt;&lt;BR /&gt;&lt;/P&gt;</description>
      <pubDate>Sat, 06 May 2023 19:15:34 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3223308#M117943</guid>
      <dc:creator>tamerj1</dc:creator>
      <dc:date>2023-05-06T19:15:34Z</dc:date>
    </item>
    <item>
      <title>Re: Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3224944#M118076</link>
      <description>&lt;P&gt;I would like to be able to return a way to say the Member List column from the table above that one is a duplicate. So since both A &amp;amp; C are "Alex, Betty, Charles" they are duplicates of one another. Since Group B is unique, it should not be shown as a duplicate.&lt;/P&gt;</description>
      <pubDate>Mon, 08 May 2023 12:46:57 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3224944#M118076</guid>
      <dc:creator>cwollett</dc:creator>
      <dc:date>2023-05-08T12:46:57Z</dc:date>
    </item>
    <item>
      <title>Re: Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3225067#M118082</link>
      <description>&lt;P&gt;Hello! So this does work perfectly on the smaller example scenario. But, as you mentioned, using the larger real data, performance is bad. I might have to make a related table with the list in a column and see what that does to the model size.&lt;/P&gt;&lt;P&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;Thanks for trying!&lt;/P&gt;</description>
      <pubDate>Mon, 08 May 2023 14:04:38 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3225067#M118082</guid>
      <dc:creator>cwollett</dc:creator>
      <dc:date>2023-05-08T14:04:38Z</dc:date>
    </item>
    <item>
      <title>Re: Finding duplicate rows using DAX</title>
      <link>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3225284#M118095</link>
      <description>&lt;P&gt;&lt;a href="javascript:void(0)" data-lia-user-mentions="" data-lia-user-uid="301940" data-lia-user-login="cwollett" class="lia-mention lia-mention-user"&gt;cwollett&lt;/a&gt;&amp;nbsp;&lt;/P&gt;
&lt;P&gt;This is probably faster&amp;nbsp;&lt;/P&gt;
&lt;P&gt;Duplicate =&lt;BR /&gt;VAR MemberList =&lt;BR /&gt;VALUES ( Example[Member Name] )&lt;BR /&gt;RETURN&lt;BR /&gt;SUMX (&lt;BR /&gt;ALL ( Example[Group Name] ),&lt;BR /&gt;INT (&lt;BR /&gt;ISEMPTY (&lt;BR /&gt;EXCEPT (&lt;BR /&gt;CALCULATETABLE (&lt;BR /&gt;VALUES ( Example[Member Name] ),&lt;BR /&gt;ALLEXCEPT ( Example, Example[Group Name] )&lt;BR /&gt;),&lt;BR /&gt;MemberList&lt;BR /&gt;)&lt;BR /&gt;)&lt;BR /&gt;)&lt;BR /&gt;) - 1&lt;/P&gt;</description>
      <pubDate>Mon, 08 May 2023 15:55:46 GMT</pubDate>
      <guid>https://community.fabric.microsoft.com/t5/DAX-Commands-and-Tips/Finding-duplicate-rows-using-DAX/m-p/3225284#M118095</guid>
      <dc:creator>tamerj1</dc:creator>
      <dc:date>2023-05-08T15:55:46Z</dc:date>
    </item>
  </channel>
</rss>

