Wat is het DIC-bestandsformaat?
Een .dic-bestand is een woordenboekbestand dat wordt gebruikt door tekstverwerkers en spellingcontrole-instrumenten als een woordenlijstdatabase voor spellingcorrectie. Woordenboekbestanden dienen al lang als de ruggengraat van spellingcontroles, en tegenwoordig is de dominante standaard het Hunspell-formaat - een platte-tekstbestand dat altijd gepaard gaat met een gelijknamig .aff affix-regelbestand (bijvoorbeeld en_US.dic naast en_US.aff).
In het Hunspell-formaat opent een .dic-bestand met een regel die het geschatte aantal woorden bevat, gevolgd door één stamwoord per regel. Woorden kunnen optionele vlagcodes bevatten na een /-teken (bijv. walk/DGS), die verwijzen naar prefix- en suffixregels gedefinieerd in het bijbehorende .aff-bestand. De codering wordt in .aff gedeclareerd via de SET-richtlijn; UTF-8 is nu de standaard, hoewel oudere woordenboeken nog steeds ISO-8859-coderingen gebruiken. Hunspell-woordenboeken worden geleverd in LibreOffice- en Apache OpenOffice-extensies (.oxt), Firefox- en Chrome-add-ons (.xpi), en zijn ingebed in macOS en Android.
Gebruikerswoordenboeken zijn een veelvoorkomende variant - platte-tekst .dic-bestanden die door de gebruiker zijn gemaakt om woorden op te slaan die niet in de hoofddatabase voorkomen. Het hoofdwoordenboek bevat doorgaans tienduizenden tot honderdduizenden woordstammen, met bestanden variërend van ongeveer 100 KB tot 5 MB.
.dic-bestanden kunnen ook voorkomen in lokalisatieworkflows van software, waar bronteksten naar vertalers worden gestuurd of worden opgeslagen als referentieglossaria. Sommige woordenboekbestanden worden gedistribueerd door ontwikkelaars van woordenboeksoftware als integratiehulpmiddelen voor programmeurs die spellingcontrole in hun eigen applicaties inbouwen.
Beveiliging & veiligheid
RISICO: LOWEen .dic is een woordenlijst in platte tekst en bevat geen uitvoerbare code, dus het bestand zelf is veilig. De enige realistische waarschuwing is de leveringsmethode: woordenboeken voor spellingcontrole worden vaak geïnstalleerd als LibreOffice-extensies (.oxt) of browser-add-ons, en extensies kunnen code bevatten - installeer taalpakketten alleen van de officiële LibreOffice/AOO-extensiesite of de add-on-winkel van uw browser, niet van willekeurige downloadportals. Het woordenlijstbestand zelf kunt u zonder risico in elke teksteditor openen en lezen.
Formaatdetails
in een notendop- Microsoft Office aangepast woordenboek - CUSTOM.DIC - een gebruikerswoordenlijst in platte tekst met termen die zijn toegevoegd via «Toevoegen aan woordenboek» in Word/Office; één woord per regel, geen affix-bestand.
- CLEX / programmeer- of CAD-woordenboek - Sommige applicaties (bijv. bepaalde CAD-, IDE- of teksttools) gebruiken .dic als een generieke trefwoord- of termenlijst; de structuur is app-specifiek.
Programma's die DIC-bestanden openen
Technische details
diepe specificaties| Formaat-type | Woordenlijst in platte tekst; geen binaire handtekening of magic bytes |
| Bijbehorend bestand | Altijd gekoppeld aan een gelijknamig `.aff` affix-regelbestand (bijv. `en_US.dic` + `en_US.aff`) |
| Bestandsstructuur | Eerste regel: geheel getal voor het aantal woorden; elke volgende regel: één woordstam, optioneel gevolgd door `/vlaggen` |
| Affix-vlagsyntaxis | Vlaggen toegevoegd na `/` op een stamregel verwijzen naar prefix/suffix-regels in `.aff` (bijv. `walk/DGS`); vlagformaat ingesteld door de FLAG-richtlijn in `.aff` |
| Tekstcodering | Gedeclareerd in de bijbehorende `.aff` via de `SET`-richtlijn; UTF-8 voor moderne woordenboeken; verouderde bestanden kunnen ISO-8859-x gebruiken |
| MIME-type | `text/plain`; informeel `application/x-hunspell-dictionary` |
| Typische bestandsgrootte | 100 KB - 5 MB voor volledige taalwoordenboeken (tienduizenden tot honderdduizenden woordstammen) |
| Distributieverpakking | Gebundeld in LibreOffice/OpenOffice `.oxt`-extensies of Firefox/Chrome `.xpi`-add-ons; geïnstalleerd in app-specifieke taalmappen |
| Platformondersteuning | Cross-platform: Windows, macOS, Linux, Android, en elke applicatie die de Hunspell-bibliotheek bevat |
| Formaat-oorsprong | Hunspell-formaat (superset van MySpell, dat Ispell uitbreidde); ontwikkeld door László Németh in 2002, oorspronkelijk voor het Hongaars |
| Variant gebruikerswoordenboek | Vereenvoudigde `.dic`-bestanden die alleen een eenvoudige woordenlijst bevatten (geen affix-vlaggen), gebruikt door Microsoft Word om door de gebruiker toegevoegde woorden op te slaan |
| Referentie-spellingcontrole-engine | Hunspell; ingebed in LibreOffice, Apache OpenOffice, Firefox, Chrome en de ingebouwde spellingcontrole van macOS |
| Taaldekking | Meer dan 100 taalwoordenboeken beschikbaar in Hunspell-formaat, onderhouden door taalgemeenschappen en het LibreOffice-project |
| Bewerkbaarheid | Volledig menselijk leesbaar; kan worden geopend en gewijzigd in elke teksteditor - wijzigingen worden van kracht na het herstarten van de host-applicatie |
| Uitgebracht | 2002 (Hunspell; building on MySpell/Ispell lineage from the 1980s-90s) |
| Laatste versie | N/A (no version on the .dic format; tracked per language dictionary release) |
| Open standaard | Ja · royaltyvrij |
| Specificatie | manpages.ubuntu.com |
DIC conversies
Community V&A
gevraagd door gebruikersNog geen vragen - wees de eerste om iets te vragen over DIC-bestanden.