Konsultacja/doradztwo odnośnie modelu AI/OCR do analizy rysunków technicznych
Jestem w trakcie budowy systemu gdzie jednym z etapów jest analiza złożonych rysunków oraz dokumentów technicznych. Rysunki pochodzą z branży stolarki otworowej, są to okna, drzwi, drzwi balkonowe i podobne. Formaty dokumentów są różne:
- złożone wyceny generowane przez programy do wycen - kilku stronicowy plik pdf z rysunkiem okna oraz tabelą informacyjną,
- rysunki tworzone przez architektów,
- odręczne szkice (często niezbyt dokładne).
To na czym mi zależy to uzyskanie jak najwyższej dokładności w analizie samego rysunku okna (liczba kwater, sposób otwierania, kierunek otwierania, itd.). Aktualne rozwiązanie to model Gemini 3 PRO + few-shots oraz bardzo szczegółowy prompt. To rozwiązanie uzyskuje dokładność około 70% w zależności od inputu.
Szukam różnych rozwiązań, które mogłyby poprawić ten wynik. Fine-tuning modelu, pre-processing, segmentacja dokumentów, bonding-box dla rysunków.
W odpowiedzi na ogłoszenie proszę o informację o doświadczeniu w podobnych projektach oraz ewentualnie zaproponowanie rozwiązania. Do wybranych osób wyślę materiały, które podlegają analizie w budowanym systemie.
Nie szukam wykonawcy. Wstępnie widzę to jako 2-3 spotkania online z nakierowaniem na konkretne rozwiązanie. Proszę również o wycenę takich 2-3 spotkań (zakładając 2-3 godziny całość + rozwiązanie).