Radräknare

Klistra in text, källkod, en loggfil eller en CSV så returnerar räknaren totalt antal rader, icke-tomma rader, tomma rader, unika rader och dubblettrader. Praktiskt när en rekryterare frågar “hur många LOC i det här repot?”, när du behöver veta hur många rader en CSV har utan att öppna den i Excel, eller när du vill kontrollera en ordlista för dubbletter innan du matar in den i ett skript.

Så räknar du rader

  1. 1

    Klistra in innehållet

    Upp till några megabyte text: logg, källfil, markdown, lista.

  2. 2

    Läs av uppdelningen

    Antal totala, icke-tomma, tomma, unika och dubbletter visas på en gång.

  3. 3

    Bestäm vad som räknas

    Kommentarer, avslutande nyrader, tomrum mellan avsnitt: ditt användningsfall avgör.

  4. 4

    Agera på antalet

    Dimensionera importen, deduplicera, trimma eller rapportera siffran som bevis.

Vad som faktiskt räknas som en rad

Olika verktyg ger olika “radantal” för samma fil eftersom de gör olika val på tre punkter.

De tre tvetydigheterna

  1. Avslutande nyrad. POSIX-textfiler slutar med \n. Lägger den sista nyraden till en extra tom rad? wc -l räknar nyrader, så en fil med innehåll på en rad plus en avslutande nyrad rapporterar 1; en fil med innehåll och ingen avslutande nyrad rapporterar 0 (vilket är överraskande). Den här räknaren rapporterar “rader med innehåll” och ignorerar den sista tomma raden efter en terminator.

  2. Tom kontra endast blanksteg. En rad med mellanslag eller tabbar men inget synligt tecken, är den tom eller inte? Räknaren behandlar rader med endast blanksteg som tomma, vilket matchar de flesta editorer.

  3. Enradiga filer. En enradig fil utan avslutande nyrad är fortfarande 1 rad.

Räknarens utdata förklarad

Mått Definition
Totalt antal rader Alla rader, inklusive tomma, upp till den sista icke-tomma raden
Icke-tomma Rader med minst ett tecken som inte är blanksteg
Tomma Rader som är tomma eller endast innehåller blanksteg
Unika Distinkta icke-tomma rader, skiftlägeskänsligt
Dubbletter Icke-tomma rader som förekommer mer än en gång (antal dubbletter)

Vanliga användningsfall

  • Deduplicering av ordlista, klistra in en ordlista, se antalet dubbletter och kör den sedan genom en deduplicerare.
  • CSV-radantal, klistra in filinnehållet; dra av 1 för rubriken för att få datarader.
  • Loggtolkning, kontrollera att en roterad logg har det förväntade antalet poster.
  • LOC i källfil, snabbt “hur många rader i den här filen” utan att öppna en IDE.
  • Hygien för e-postlistor, se hur många adresser som är dubbletter innan du skickar en kampanj.

LOC är inte produktivitet

Radantalet i källkod är ett trubbigt mått. En tät, välstrukturerad modul på 100 rader kan vara svårare att skriva och underhålla än en utbredd på 1 000 rader. Använd radantal för omfångsuppskattningar (rymmas i ett kontextfönster, paginera utdata, jämföra filstorlekar) snarare än prestationsutvärdering.

Unicode och radterminatorer

Räknaren normaliserar \r\n, \r och \n till en enda nyrad innan den räknar, så Windows-, klassiska Mac- och Unix-radslut ger alla samma resultat. Unicode-radseparatorer (U+2028) och styckeseparatorer (U+2029) behandlas också som brytningar.

Vanliga frågor

wc -l räknar nyradstecken, så en fil med innehåll och ingen avslutande nyrad rapporterar en mindre. Den här räknaren rapporterar “antal rader med innehåll”, vilket matchar de flesta editorers statusrader.

Ja, rader som endast innehåller mellanslag eller tabbar räknas som tomma, inte icke-tomma. Det matchar VS Code, Sublime och de flesta Git-arbetsflöden.

Ja. “Hello” och “hello” räknas som distinkta unika rader. Om du vill ha skiftlägesokänslig deduplicering, gör först din inmatning gemen med en skiftlägesomvandlare.

Nej, räknaren läser inmatningen lokalt och inget laddas upp eller loggas.

Relaterade verktyg

Verktyget finns på andra språk