Chuyển đến nội dung chính
EVOA Toolbox

Xóa dòng trùng lặp

Xóa các dòng trùng lặp khỏi danh sách, giữ lần xuất hiện đầu hoặc cuối, bỏ qua chữ hoa/thường, cắt khoảng trắng và sắp xếp. Xem đã xóa bao nhiêu dòng.

Được xử lý cục bộ trong trình duyệt. Văn bản của bạn không được tải lên.

Đang tải công cụ…

Công cụ này làm gì

Dán một danh sách và nhận lại chỉ các dòng duy nhất. Công cụ hoạt động với mọi dữ liệu theo dòng: địa chỉ email, URL, từ khóa, mục nhập log, SKU, danh sách tên miền hay ID đã xuất. Một bản tóm tắt cho biết bạn bắt đầu với bao nhiêu dòng, đã xóa bao nhiêu và còn lại bao nhiêu.

Bạn kiểm soát cách so sánh các dòng. Có thể tắt phân biệt chữ hoa/thường để 'Apple' và 'apple' được tính là cùng một dòng, cắt khoảng trắng bỏ qua dấu cách thừa ở hai đầu dòng, và bạn có thể chọn giữ lần xuất hiện đầu tiên hoặc cuối cùng của mỗi dòng trùng. Dòng trống có thể được giữ nguyên hoặc bỏ hoàn toàn, và kết quả có thể được sắp xếp từ A đến Z hoặc Z đến A theo thứ tự số tự nhiên (item2 trước item10).

Thứ tự được giữ nguyên theo mặc định, điều quan trọng với dữ liệu có thứ tự. Kiểu xuống dòng Windows (CRLF) và Unix đều được tôn trọng, và công việc được thực hiện bằng tra cứu tập hợp nên ngay cả hàng trăm nghìn dòng cũng hoàn tất nhanh trong trình duyệt của bạn.

Cách sử dụng

  1. 1Dán danh sách vào ô nhập (hoặc nhấn Ví dụ).
  2. 2Đặt các tùy chọn: phân biệt chữ hoa/thường, cắt khoảng trắng, xử lý dòng trống, giữ đầu hay cuối, và sắp xếp.
  3. 3Xem bản tóm tắt để biết đã xóa bao nhiêu dòng trùng lặp.
  4. 4Sao chép kết quả hoặc tải xuống dưới dạng tệp .txt.

Định dạng được hỗ trợ

Văn bản thuần, mỗi dòng một mục. Kiểu xuống dòng (LF, CRLF) được phát hiện và giữ nguyên.

Quyền riêng tư

Công cụ này chạy trong trình duyệt của bạn. Dữ liệu bạn cung cấp được xử lý trên thiết bị và không được gửi đến máy chủ của chúng tôi.

Hạn chế

  • Các dòng được so sánh như cả chuỗi; không có so khớp mờ hay một phần.
  • So sánh không phân biệt chữ hoa/thường dùng cách đưa về chữ thường đơn giản, không hoàn hảo với mọi ngôn ngữ.
  • Sắp xếp dùng quy tắc ngôn ngữ của trình duyệt, nên thứ tự các chữ cái có dấu có thể khác nhau giữa các trình duyệt.
  • Ở chế độ 'giữ dòng trống', dòng trống không bao giờ bị tính là trùng lặp, dù có nhiều dòng như vậy.
  • Dữ liệu nhập rất lớn (hàng chục megabyte) có thể chậm vì mọi thứ được giữ trong bộ nhớ.

Câu hỏi thường gặp

Công cụ có giữ nguyên thứ tự ban đầu không?

Có, trừ khi bạn chọn một thứ tự sắp xếp. Theo mặc định, lần xuất hiện đầu tiên của mỗi dòng vẫn ở nguyên vị trí.

Làm sao để giữ lần xuất hiện cuối thay vì đầu?

Chọn 'Giữ bản cuối' trong tùy chọn. Bản sao cuối cùng của mỗi dòng giữ nguyên vị trí và các bản trước đó bị xóa.

Cắt khoảng trắng làm gì?

Dấu cách và tab ở đầu và cuối được loại bỏ khỏi mọi dòng, kể cả trong kết quả, nên ' apple' và 'apple ' được tính là trùng lặp.

Công cụ có xử lý được hàng nghìn dòng không?

Có. Một danh sách 200.000 dòng được lọc trùng trong chưa đến một giây trên một máy tính thông thường.

Công cụ liên quan