Top-Themen

Aktuelle Themen (A bis Z)

Administrator.de FeedbackApache ServerAppleAssemblerAudioAusbildungAuslandBackupBasicBatch & ShellBenchmarksBibliotheken & ToolkitsBlogsCloud-DiensteClusterCMSCPU, RAM, MainboardsCSSC und C++DatenbankenDatenschutzDebianDigitiales FernsehenDNSDrucker und ScannerDSL, VDSLE-BooksE-BusinessE-MailEntwicklungErkennung und -AbwehrExchange ServerFestplatten, SSD, RaidFirewallFlatratesGoogle AndroidGrafikGrafikkarten & MonitoreGroupwareHardwareHosting & HousingHTMLHumor (lol)Hyper-VIconsIDE & EditorenInformationsdiensteInstallationInstant MessagingInternetInternet DomäneniOSISDN & AnaloganschlüsseiTunesJavaJavaScriptKiXtartKVMLAN, WAN, WirelessLinuxLinux DesktopLinux NetzwerkLinux ToolsLinux UserverwaltungLizenzierungMac OS XMicrosoftMicrosoft OfficeMikroTik RouterOSMonitoringMultimediaMultimedia & ZubehörNetzwerkeNetzwerkgrundlagenNetzwerkmanagementNetzwerkprotokolleNotebook & ZubehörNovell NetwareOff TopicOpenOffice, LibreOfficeOutlook & MailPapierkorbPascal und DelphiPeripheriegerätePerlPHPPythonRechtliche FragenRedHat, CentOS, FedoraRouter & RoutingSambaSAN, NAS, DASSchriftartenSchulung & TrainingSEOServerServer-HardwareSicherheitSicherheits-ToolsSicherheitsgrundlagenSolarisSonstige SystemeSoziale NetzwerkeSpeicherkartenStudentenjobs & PraktikumSuche ProjektpartnerSuseSwitche und HubsTipps & TricksTK-Netze & GeräteUbuntuUMTS, EDGE & GPRSUtilitiesVB for ApplicationsVerschlüsselung & ZertifikateVideo & StreamingViren und TrojanerVirtualisierungVisual StudioVmwareVoice over IPWebbrowserWebentwicklungWeiterbildungWindows 7Windows 8Windows 10Windows InstallationWindows MobileWindows NetzwerkWindows ServerWindows SystemdateienWindows ToolsWindows UpdateWindows UserverwaltungWindows VistaWindows XPXenserverXMLZusammenarbeit

Datensätze ordnen

Mitglied: xfrostx

xfrostx (Level 1) - Jetzt verbinden

10.10.2007, aktualisiert 17.10.2007, 3182 Aufrufe, 6 Kommentare

Hallo zusammen,
da ich fast keine ahnung von programmierung habe und mich hier auch nicht durchlesen konnte. muss ich euch um einen kleinen rat, vielleicht sogar um eine lösung bitten.
also ich habe einen kunden der 8000000 Datensätze hat die total ungeordnet in eienr .txt datei abgelegt sind. diese datensätze sehen so aus! diese sollen oder können in irgend ein programm eingelesen werden zum verarbeiten, nur muss nach dem ordnen diese dateien wieder in einer .txt datei ausgegeben werden.

225356373
a2 1
a3 1
b4 2
aaa 1


22345643
fsf 1
djud 1
uzt 1
tae 2
gtw 1
kts 1
dtr 1

Man sieht, das z.b. vor der 22345643 ein leerzeichen ist, dies ist bei jedem datensatz unterschiedlich, mal ist ein leerzeichen da mal ist kein vorhanden...
dadrunter diese --> fsf djud und 1 etc. müssen nun hinter diese lange zahl angeordnet werden.

z.b. so...
225356373 a21 a31 b42 aaa1
22345643 fsf1 djud1 uzt1 tae2 etc.

es ist egal ob diese durch ein leerzeichen oder in komma getrennt werden.

es wär sehr schön von euch wenn ihr mir eine lösung vorschlagen oder schon schreiben könntet.

vielen dank schonmal

frosty
Mitglied: bastla
12.10.2007 um 22:08 Uhr
Hallo xfrostx!

Unter der Annahme, dass je Datensatz eine gleich bleibende Anzahl von Zeilen (lt Deinem Beispiel etwa 8) in der Textdatei steht, könntest Du es mit folgendem VBScript versuchen:
01.
Const Ein = "D:\Daten.txt"
02.
Const Aus = "D:\Daten.csv"
03.
Const Zeilen = 8
04.
Const Delim = ","
05.
 
06.
Set fso = CreateObject("Scripting.FileSystemObject")
07.
Set oEin = fso.OpenTextFile(Ein, 1)
08.
set oAus = fso.OpenTextFile(Aus, 2, True)
09.
 
10.
Do While Not oEin.AtEndOfStream
11.
	sZeile = Trim(oEin.ReadLine)
12.
	For i = 1 To Zeilen - 1
13.
		If Not oEin.AtEndOfStream Then
14.
			sZeile = sZeile & Delim & Replace(oEin.ReadLine, " ", "")
15.
		End If
16.
	Next
17.
	oAus.WriteLine sZeile
18.
Loop
19.
oEin.Close
20.
oAus.Close
21.
WScript.Echo "Fertig."
Das gewünschte Trennzeichen kannst Du in der Zeile
01.
Const Delim = ","
festlegen.

Grüße
bastla
Bitte warten ..
Mitglied: Biber
15.10.2007 um 21:55 Uhr
Moin xfrostx,

ich weiß ja nicht, ob Du vorhast ein Feedback zu liefern - viele machen das ja von sich aus.
Da ich auch Dir ja nur die besten Absichten unterstelle, lass mich doch gleich nochmal nachfragen:

Du erwähntest, dass Du zwar schon mindestens einen Kunden hast, aber keinen Plan, wie Du diese mäßig strukturierten Daten ordnen willst.

Bei 8 Millionen Datensätzen hast Du doch aber vermutlich wenigstens eine ungefähre Vorstellung, wo Du damit hinwillst...

Diese Rumsortiererei in eine Zeile pro "Datensatz" ist ja schon ganz rührend und schadet ja auch bestimmt nichts, aber wenn Dein gepostetes Beispielfragment halbwegs lebensnah ist, dann steht doch nach der identifizierenden Nummer auch Zeugs, das doch wohl auch Äpfel und Birnen beschreibt. Und so kaum in Datenbankfelder eingelesen werden kann.

So wie gepostet macht jedenfalls der ganze Aufwand keinen Sinn - magst Du nicht lieber den ganzen Sachverhalt schildern und Deinen Plan, damit umzugehen?

Denn die Übertragbarkeit einer auf die obige Beschreibung zusammengeharkten Skriptlösung auf eventuelle Probleme anderer Forumsmitglieder sehe ich bis jetzt eher gering.

Grüße
Biber
Bitte warten ..
Mitglied: xfrostx
16.10.2007 um 12:26 Uhr
Hallo,

sorry erstmal das ich erst so spät zurückschreibe, habe aber momentan soviel um die ohren. aber ich kann euch verstehen .

ja ne, das funktioniert so auch nicht, weil mit einer konstanten von acht zu arbeiten ist sinnlos. die zeilen varieren... man muss mit ner freien variablen arbeiten. aber die idee es in eine csv datei auszugeben ist schon ganz gut. vielleicht habt ihr da ja noch ne ahnung wie wir das hinbekommen könnten.
Bitte warten ..
Mitglied: SvenGuenter
17.10.2007 um 09:22 Uhr
Hast du keinen fixen Delemiter den man nehmen kann um zu erkennen wann der eine Datensatz aufhört udn der andere anfängt? Normalerweise wird das doch gemacht. Also ein <CR> oder ein <CRLF>

Wenn da keiner ist fällt mir kein Weg ein auch nur ansatzweise eine sichere Lösung zu finden die sauber die Datensätze trennt.

Gruß

Sven
Bitte warten ..
Mitglied: Biber
17.10.2007 um 09:30 Uhr
Moin Sven,

der nächstschlechtere Plan wäre dann der Versuch der Identifizierung der Pseudo-IDs ( oben im Bsp "22345643" oder so ähnlich) - wenn das die einzigen Zeilen sind, die nur aus Ziffern (und trailing blanks) bestehen.

Nichtsdestotrotz - ich sehe dennoch noch nichts, was ich einem potentiellen Kunden gegenüber auch nur scherzhaft als Konzept verkaufen könnte.

Erstmal alle Datensätze in eine Zeile zu bringen und dann mal sehen... wenn das der ganze Plan für 8 Mio Datensätze ist, dann warte ich lieber auf Plan B.

Grüße
Biber
Bitte warten ..
Mitglied: SvenGuenter
17.10.2007 um 09:40 Uhr
Hi Biber,

die Idee kam mir auch schon aber sicher ist dies nicht wenn in der Folgezeile auch auf Einmal was mit einer Zahl beginnt.


Dieses nur nach Zahlen schauen kann sehr in die Hose gehen und ist wie gesagt sehr ungenau meines erachtens. Ich weiß nicht wie du dadrüber denkst.
Man müßte mal einen Teil der Datei im Original sehen dann kann man sich da besser Gedanken drüber machen, da ich schon oft erlebt habe das Poster nicht alle Dateiinformationen gepostet haben oder diese nicht sehen konnten weil sie nicht mit UltraEdit32 oder ähnlichen Tools gearbeitet haben.


Gruß

Sven
Bitte warten ..
Ähnliche Inhalte
Microsoft Office
Serienbrief Nächster Datensatz Wenn
Frage von Druide83Microsoft Office2 Kommentare

Hallo, ist das erste mal dass ich mit Serienbriefen in Word zu tun habe und mir fehlt auch nur ...

Backup
Locky - Backup Exec Datensatz sichern
Frage von EisernBackup6 Kommentare

Hallo, trotz Warnungen, persönlicher Gespräche und immer aktueller Signaturen hat es ein Kollege geschafft sich den Trojaner Locky einzufangen. ...

Datenbanken

Datensatz hinzufügen, nicht überschreiben Access

gelöst Frage von Dr.CornwallisDatenbanken19 Kommentare

Liebe Gemeinde, ich habe folgenden Code (bei Button klick): Wähle ich mit diesem Code einen anderen Wert im Kombifeld ...

Datenbanken

Datensatz mit 2 Felder anfügen Access

gelöst Frage von Dr.CornwallisDatenbanken2 Kommentare

Hallo, ich habe 2 Felder: 1. Kombifeld - PersNr zum auswählen 2. Textfeld - hier kann man beliebigen Text ...

Neue Wissensbeiträge
iOS
IOS hat nen Cursor !!!
Tipp von Criemo vor 2 StundeniOS

Nette Funktion im iOS. iPhone-Mauszeiger aktivieren „Nichts ist nerviger, als bei einem Tippfehler zu versuchen, den iOS-Cursor an die ...

Off Topic
Avengers 4: Endgame - Erster Trailer
Information von Frank vor 2 TagenOff Topic1 Kommentar

Ich weiß es ist Off Topic, aber ich freue mich auf diesen Film und vielleicht geht es anderen hier ...

Webbrowser
Microsoft bestätigt Edge mit Chromium-Kern
Information von Frank vor 2 TagenWebbrowser5 Kommentare

Microsoft hat nun in seinem Blog bestätigt, dass die nächste Edge Version kein EdgeHTML mehr für die Darstellung benutzen ...

Sicherheit

MikroTik: Sicherheitslücke wird ausgenutzt obwohl ein Update seit langem verfügbar ist

Information von sabines vor 2 TagenSicherheit

Obwohl ein Update, dass die nun massenhaft ausgenutzte Lücke schließt, seit langem (März 2018) verfügbar ist, wird es offensichtlich ...

Heiß diskutierte Inhalte
Exchange Server
Exchange Server 2010: Keine Eingehenden E-MAils
Frage von gabeBUExchange Server13 Kommentare

Hallo Zusammen Ich habe das kurzen auf dem Exchange 2010 Server das Problem, dass ich keine externen E-Mails mehr ...

Rechtliche Fragen
Systemhaus auf Abwegen
Frage von rocco61Rechtliche Fragen13 Kommentare

Hallo zusammen, bin derzeit ratlos bei dem folgenden Scenario: In einen Seniorenheim wurde beschlossen, die IT an eine andere ...

Router & Routing
MikroTik - Routing, Bridging, Switching
gelöst Frage von Alex29Router & Routing9 Kommentare

Hallo in die Runde, als Hobby-Admin würde ich bitte mal wieder Eure Hilfe benötigen. Seit der Umstellung auf RouterOS ...

Outlook & Mail
Kalendersync mit Android und Outlook
Frage von Stefan007Outlook & Mail8 Kommentare

Hi Leute, kennt jemand eine Möglichkeit um Termine zwischen installiertem Outlook auf dem PC und dem Kalender auf einem ...