整数のリスト内の重複を見つけて、重複の別のリストを作成するにはどうすればよいですか?
ベストアンサー1
重複を削除するには を使用しますset(a)
。重複を印刷するには、次のようにします。
a = [1,2,3,2,1,5,6,5,5,5]
import collections
print([item for item, count in collections.Counter(a).items() if count > 1])
## [1, 2, 5]
特に効率的ではないことに注意してくださいCounter
(タイミング) はおそらくやり過ぎです。set
パフォーマンスが向上します。このコードは、ソース順序で一意の要素のリストを計算します。
seen = set()
uniq = []
for x in a:
if x not in seen:
uniq.append(x)
seen.add(x)
あるいは、もっと簡潔に言うと:
seen = set()
uniq = [x for x in a if x not in seen and not seen.add(x)]
後者のスタイルは、何が行われるかが明確ではないためお勧めしませんnot seen.add(x)
(setadd()
メソッドは常に を返すNone
ため、 が必要になりますnot
)。
ライブラリなしで重複要素のリストを計算するには:
seen = set()
dupes = []
for x in a:
if x in seen:
dupes.append(x)
else:
seen.add(x)
あるいは、もっと簡潔に言うと:
seen = set()
dupes = [x for x in a if x in seen or seen.add(x)]
リスト要素がハッシュ可能でない場合は、sets/dicts を使用できず、二次時間ソリューション (それぞれを比較する) に頼る必要があります。例:
a = [[1], [2], [3], [1], [5], [3]]
no_dupes = [x for n, x in enumerate(a) if x not in a[:n]]
print no_dupes # [[1], [2], [3], [5]]
dupes = [x for n, x in enumerate(a) if x in a[:n]]
print dupes # [[1], [3]]