Cohere Parse gör dokument redo för RAG och AI-agenter
Modellen med 2,3 miljarder parametrar läser tabeller, formulär och sidstruktur – men svenska saknar ännu stabilt språkstöd och JSON-utdata uteblir.
Cohere lanserade den 27 augusti Parse v5.0, en dokumentmodell som gör PDF:er, presentationer och bilder till strukturerad Markdown för sök, RAG och AI-agenter. Modellen läser inte bara löptext. Den hittar också tabeller, listor, formulär, bildtexter, sidgränser och var visuella element ligger på sidan.
Enligt Coheres lansering är Parse byggd för dokument som vanliga textutdragare ofta tappar ordningen i. Resultatet kan innehålla Markdown, HTML-formaterade tabeller, bildbeskrivningar och koordinater för objekt. Tanken är att en agent ska få ett dokument som redan är uppdelat i användbara delar, i stället för en lång ström av lösryckta tecken.

Dokument blir råvara för agenter
Det praktiska värdet ligger före själva språkmodellen. När tabeller och formulär behåller sin struktur blir det lättare att indexera en rapport, hitta rätt stycke och skicka en begränsad del vidare till en agent. Parse kan därför fungera som ett första steg i en RAG-kedja eller i ett system som granskar fakturor, avtal och tekniska manualer.
Dokumentationen anger 2,3 miljarder parametrar, cirka 4,6 gigabyte modellstorlek och ett kontextfönster på 8 192 token. Modellen finns via Coheres Parse-API, Microsoft Foundry, AWS SageMaker och bolagets enkelkundsmiljö Model Vault. Den publika demon visar dessutom arbetsflödet direkt i webbläsaren.
Svenskan står utanför stödlistan
Cohere beskriver stabilt stöd för nio språk: arabiska, engelska, franska, tyska, japanska, koreanska, italienska, portugisiska och spanska. Svenska finns inte med. Övriga språk körs enligt bolaget utan särskild träning, och precisionen kan därför bli lägre. För nordiska dokumentflöden är det den viktigaste reservationen.

Det finns fler tydliga gränser. Parse lämnar inga konfidenspoäng, känner inte igen sidhuvuden, sidfötter eller typsnittshierarkier och kan bara lämna Markdown – inte ett förutbestämt JSON-schema. Därför behövs fortfarande validering innan modellen får styra processer där ett missat fält har ekonomiska eller juridiska följder.
Cohere lanserade Parse v5.0, en 2,3-miljarders multimodal modell och ett API som omvandlar komplexa dokument till strukturerad Markdown med tabeller, formulär, bilder och positionsdata.
Dokumenttolkning är ofta den svaga länken före sök, RAG och AI-agenter. En liten specialiserad modell som bevarar sidans struktur kan göra fler företagsdokument användbara utan att hela filen måste behandlas manuellt.
Parse är mer intressant som infrastruktur än som fristående demo. Om modellen håller ihop tabeller och formulär i verkliga arkiv kan den minska mängden specialkod före en agent. Men svenska är ännu ett osäkert nollskottsfall, och avsaknaden av konfidenspoäng och JSON betyder att mänskliga kontroller inte kan tas bort.




