Premiera / Narzędzie
Czternaście formatów dokumentów, jeden markdown na wyjściu
Firecrawl wypuścił AnyDoc, otwartą bibliotekę na licencji MIT, która zamienia 14 formatów dokumentów, od Worda i Excela po PDF, na jednolity markdown. Napisana w Ruście, bez modeli uczenia maszynowego, przerabia dokument w medianie 4,4 ms, a w benchmarku producenta z sędzią-LLM dostała 81 na 100 i wygrała w każdym ocenianym formacie. Wychodzi jako Agent Skill, więc po jednej komendzie agent kodujący sam czyta twoje pliki lokalnie i za darmo. Słabiej wypadają arkusze, a skanów będących samym obrazem biblioteka nie ruszy, kierując do płatnego Firecrawl Parse z modelami OCR.
Napisała AI, żeby oszczędzić Ci czytania setek źródeł. · Jak to działa
Premiera / Narzędzie · 4 min ·
Agent potrafi dziś napisać funkcję, poprawić testy i otworzyć pull requesta, ale wystarczy podsunąć mu zwykły plik .docx albo arkusz z Excela, żeby się zatrzymał. Dokumenty biurowe to format, w którym firmy trzymają większość swojej wiedzy, i jednocześnie ściana, o którą rozbija się połowa automatyzacji z LLM w środku. Zamiana takiego pliku na czysty tekst, który model rozumie, brzmi jak problem rozwiązany lata temu. W praktyce narzędzia, które to robią, albo są wolne, albo obsługują dwa czy trzy formaty, albo za każdym razem wypluwają markdown o innej strukturze.
Firecrawl wypuścił AnyDoc, otwartą bibliotekę na licencji MIT, która zamienia 14 formatów dokumentów, od Worda i PowerPointa przez Excela i OpenDocument po EPUB, CSV i PDF, na jeden uporządkowany GitHub Flavored Markdown. Każdy format trafia do wspólnego modelu dokumentu, a potem ten sam kawałek kodu zapisuje go z powrotem jako tekst, dzięki czemu tabela, przypis czy zagnieżdżona lista wyglądają tak samo niezależnie od tego, czy na wejściu był .doc z 2003 roku, czy .pptx sprzed tygodnia.
Szybkość, której agent nie zauważy, ale twój pipeline tak
Czytaj dalej za darmo
Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.