sv

PDF till Word

Omvandla en PDF lokalt till ett redigerbart Word-dokument (DOCX): rubriker, listor, fet/kursiv stil, tabeller och bilder ingår. Ingen uppladdning.

Körs lokalt på din enhet ...

Dina filer

    Körs lokalt på din enhet ...

    0%

    Laddas min fil upp?

    Nej. Allt körs i din webbläsare - din fil lämnar aldrig din enhet. Så går det att verifiera

    Ingen uppladdning100% lokalt
    Innehållet stannar hos digingen åtkomst för tredje part
    Hosted in GermanyGlobal Content Delivery
    Granskat externtTLS A+ · HTTP-rubriker A+

    En PDF är en färdig layout, inte redigerbar text: stycken är svåra att markera, meningar går inte att skriva om smidigt och en tabell går inte att räkna vidare på. Det här verktyget läser ut den faktiska strukturen i din PDF (rubriker, stycken, listor, tabeller, fotnoter och bilder) och bygger av den, lokalt på din egen enhet, en riktig DOCX-fil i formatet Office Open XML, redo att öppnas direkt i Word, i LibreOffice Writer eller i vilket annat program som helst som förstår .docx-filer. Ingen vattenstämpel, inget konto, ingen dagsgräns: omvandlingen sker i webbläsarfliken och inte på en server.

    På stycke- och teckennivå bevaras betydligt mer än bara fet och kursiv stil. Rubriker blir riktiga Word-rubriker på nivå 1 till 6, med dispositionsnivå, så att navigeringsfönstret och den automatiska innehållsförteckningen fungerar direkt. Nästlade punktlistor behåller sina nivåer som en riktig flernivålista. Understrykningar och genomstrykningar känns igen på de linjer som faktiskt är ritade på sidan, upphöjd och nedsänkt text på sin förskjutna baslinje, och en färgad textöverstrykning förs till den närmaste av de 16 överstrykningsfärger som Word-formatet över huvud taget känner till. Hänvisningar från PDF-filen blir klickbara Word-hyperlänkar, och anmärkningar längst ned på sidan hamnar som riktiga Word-fotnoter i fotnothanteringen i stället för som lös text i slutet av sidan.

    Tabeller känns igen på tre skilda sätt: på faktiskt ritade ramlinjer, där kolumnbredderna kommer från den uppmätta linjegeometrin och enkla sammanfogade celler förblir sammanfogade; på ett tydligt återkommande mellanrum mellan kolumnerna när tabellen saknar linjer helt; och på en följd av minst tre rader i rad av typen «fält: värde», som formulär-PDF:er producerar. Sidstorlek, stående eller liggande format, marginaler och antalet textkolumner hämtas från sidans verkliga geometri i stället för från en A4-gissning, vid varje ursprunglig sidgräns står en ren sidbrytning, och bilder bäddas in på sin plats i läsflödet med bevarade proportioner, även diagram som är ritade helt i vektorform känns igen som figurer. Återkommande sidhuvuden och sidfötter blir riktiga Word-sidhuvuden och sidfötter med tabbstopp för vänster, mitten och höger; ett löpande sidnummer blir då ett levande Word-fält i stället för en fastfrusen siffra, och en återkommande vattenstämpel följer med.

    När det gäller typsnitt tar verktyget den direkta vägen: de typsnittsprogram som är inbäddade i käll-PDF:en förs oförändrade över till Word-filen, separat för normal, fet, kursiv och fet kursiv skärning. Ett fetstilt stycke får därmed formgivarens verkliga konturer och ingen förtjockning som ordbehandlaren räknat fram i efterhand. Bara där PDF:en inte alls levererar ett typsnitt träder ett metriskt kompatibelt, öppet licensierat ersättningstypsnitt in, som också bäddas in i filen, så att dokumentet ser rätt ut även på en annan dator utan de typsnitten installerade. Text utanför det latinska alfabetet får dessutom rätt skrift- och språkmärkning, så att Word formar kinesiska, japanska, koreanska, arabiska eller hebreiska korrekt, sätter från höger till vänster där det hör hemma och stavningskontrollen väljer rätt språk.

    Mycket av arbetet ligger i de PDF-filer som faller utanför ramen. En sida som är sparad på tvären analyseras i sin egen läsriktning, så att en tabell på den inte kommer fram vriden och en rubrik inte plötsligt står lodrätt. PDF:er som skrivits ut från webbläsaren, till exempel via «Skriv ut som PDF» i Chrome eller Edge, ritar punkterna i en lista som pyttesmå vektorfyrkanter i stället för som teckentext och klistrar ihop en hel tabellrad till en enda textrad: båda känns igen på geometrin och delas upp igen i riktiga listor och enskilda tabellceller. Ett sidnummer blir sidhuvud eller sidfot bara när det verkligen räknar vidare genom dokumentet; en enstaka rad som bara ser ut som ett sidnummer står kvar i texten, och växlande sidbeteckningar som «K-6» eller «K-86» bevaras i stället för att kastas som utfyllnad.

    Två saker säger verktyget öppet i stället för att tiga om dem. Om det i käll-PDF:en fanns text bakom en ogenomskinlig svart balk men den ändå gick att läsa ut som text, det klassiska misstaget att maskera med en påmålad rektangel, så följer den texten inte med till Word-filen och du får veta på vilka sidor det inträffade. Och om tecken i PDF:en inte bär något Unicode-värde alls, vilket också är det som gör att kopiering från vilken PDF-läsare som helst misslyckas, så beräknas deras andel och du hänvisas till «PDF OCR» i stället för att lämnas med en tyst lucka. Analysen och uppbyggnaden av filen sker helt i webbläsarfliken: din PDF lämnar inte din enhet, och efter första laddningen fungerar verktyget även offline.

    Tekniska data

    Tekniska data
    IndataformatPDF
    Automatisk konverteringPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    UtdataformatDOCX
    BatchbearbetningNej
    BearbetningLokalt i webbläsaren (JavaScript)
    FiluppladdningIngen

    I 3 steg

    1. Släpp din PDF: ingenting laddas upp.
    2. Struktur, tabeller, typsnitt och bilder känns igen lokalt och förs över till en DOCX.
    3. Ladda ned DOCX-filen och fortsätt redigera i Word eller LibreOffice.

    Begränsningar: Strukturerad återgivning, inte en pixelexakt kopia av PDF:en. Följande förs över: rubriker med dispositionsnivå, stycken, numrerade och punktade listor i flera nivåer, fet, kursiv, understruken, genomstruken text, upphöjd och nedsänkt text, textöverstrykningar (avrundade till Words överstrykningsfärger), klickbara hyperlänkar, riktiga fotnoter, bilder och vektorritade diagram i läsflödet, riktiga sidhuvuden och sidfötter med levande sidnummerfält samt sidformat, orientering, marginaler och kolumnantal från den verkliga sidgeometrin. Tabeller känns igen på ramlinjer, på ett återkommande kolumnmellanrum eller på rader av typen «fält: värde»; för närvarande utvärderas bara ett sammanhängande tabellområde per sida, så flera separat inramade tabeller staplade på samma sida går medvetet igenom som löpande text i stället för att sättas ihop fel, och kraftigt nästlade eller mångfaldigt sammanfogade tabeller förblir svaga. Varje cell innehåller ett stycke. Fler ärliga gränser: ett färgat avsnitt inuti ett sammanhängande satt textparti tappar sin egen färg, och en överstrykning som bara täcker en del av det färgar hela partiet; en hänvisning utan måladress sparad i PDF:en hoppas över; en länk inuti en fotnotstext förblir inte klickbar; en punktlista nästlad inuti en numrerad lista tar på sin nivå det numrerade tecknet (innehåll och nästling stämmer, bara tecknet gör det inte); byter sidhuvudet mellan kapitlen står det kvar som vanlig text i dokumentet i stället för att bli ett eget sidhuvud per kapitel. Sidor med mycket påkostad formgivning där texten löper runt figurer approximeras, och på sidor med flera tusen linje- eller vektorelement hoppas tabell- och grafikigenkänningen över. Skannade PDF:er eller PDF:er med bara bilder har inget textlager: då visas en hänvisning till «PDF OCR» i stället för ett tomt resultat. Öppna lösenordsskyddade PDF:er först med «Lås upp PDF».

    Vanliga frågor

    Laddas PDF:en upp?

    Nej. PDF:en öppnas i webbläsarfliken, analyseras där och Word-filen byggs också där; det finns ingen server som någonsin får se filen. Efter ditt första besök fortsätter verktyget att fungera till och med i flygplansläge, det enklaste beviset på att ingenting laddas upp.

    Ser Word-filen exakt ut som PDF:en?

    Nej, och det är avsiktligt. En PDF är en fast layout, ett Word-dokument är flödande text: en kopia punkt för punkt skulle inte längre gå att redigera vettigt i Word. Därför är det innebörden som förs över: rubriker, stycken, listor, tabeller, fotnoter, bilder, sidhuvuden och sidfötter samt sidformat och marginaler. Sidor med mycket påkostad formgivning där texten löper runt figurer approximeras.

    Förblir rubriker riktiga Word-rubriker?

    Ja. Rader som är satta större och kraftigare känns igen som rubriker på nivå 1 till 6 och får motsvarande dispositionsnivå. Därmed fungerar inte bara formatmallarna, utan även navigeringsfönstret och den automatiskt genererade innehållsförteckningen i Word, direkt och utan att du själv behöver formatera om något.

    Bevaras originaltypsnittet från PDF:en?

    Ja, om PDF:en levererar det. De typsnittsfiler som är inbäddade i käll-PDF:en förs oförändrade över till Word-filen, separat för normal, fet, kursiv och fet kursiv skärning. Först när ett typsnitt saknas i PDF:en träder ett metriskt kompatibelt, öppet licensierat ersättningstypsnitt in, som också bäddas in, så att dokumentet ser rätt ut även på en dator där de typsnitten inte är installerade.

    Bevaras tabeller?

    Tabeller med synliga ramlinjer blir riktiga Word-tabeller, med kolumnbredder från den uppmätta linjegeometrin och enkla sammanfogade celler intakta. Även tabeller utan ram med ett tydligt återkommande kolumnmellanrum och formulärrader av typen «fält: värde» känns igen. För närvarande utvärderas bara ett sammanhängande tabellområde per sida: står flera separat inramade tabeller staplade går de medvetet igenom som löpande text i stället för att sättas ihop fel.

    Fungerar det med roterade eller liggande sidor?

    Ja. En sida som är sparad roterad i PDF:en analyseras i sin egen läsriktning och inte i resten av dokumentets. En tabell på en sådan sida behåller därmed sina rader och kolumner åt rätt håll, och en rubrik behandlas inte felaktigt som lodrätt satt text.

    Känns punktlistor igen i en PDF som skrivits ut från webbläsaren?

    Ja. Vid utskrift till PDF ritar Chrome och Edge punkterna i en lista inte som teckentext utan som pyttesmå vektorfyrkanter, vilket gör listmarkörerna osynliga för en ren textläsare. Verktyget känner igen dem på storleken och på att de ligger i linje i en och samma kolumn, och återställer listan med alla dess nivåer. Från samma källa delas ihopklistrade tabellrader upp i enskilda celler igen.

    Förs bilder, länkar och fotnoter över?

    Ja, alla tre. Inbäddade bilder infogas på sin plats i läsflödet, med begränsad bredd och bevarade proportioner; även diagram som är ritade helt i vektorform känns igen som figurer. Hänvisningar med ett sparat mål blir klickbara Word-hyperlänkar, och anmärkningar längst ned på sidan blir riktiga Word-fotnoter. En hänvisning utan måladress hoppas över, och en länk inuti en fotnotstext förblir inte klickbar.

    Vad händer med text som är övertäckt med en svart balk i käll-PDF:en?

    Den förs inte över till Word-filen. Om maskeringen gjordes genom att måla en svart rektangel över texten i stället för att verkligen ta bort den, förblir texten fullt läsbar inuti PDF:en, ett vanligt misstag med stora konsekvenser. Verktyget känner igen text som ligger helt bakom en ogenomskinlig mörk yta, utelämnar den och talar om för dig på vilka sidor det inträffade.

    Vad händer med en skannad PDF?

    En skanning består av bilder och har inget textlager. Verktyget säger det ärligt och hänvisar till «PDF OCR» i stället för att skapa en tom Word-fil. Om en fil visserligen bär text men dess tecken saknar sparat Unicode-värde beräknas den berörda andelen: då misslyckas även kopiering från en PDF-läsare, och OCR är vägen tillbaka till texten.

    Relaterade verktyg

    DOCX till PDF · PDF till EPUB · PDF till Markdown · PDF OCR sökbar · PDF till text