Какво публикуваме
Публикуваме метод, не статии
Нямаме академични публикации и няма да намекваме обратното. Това, което публикуваме, е работният материал зад проектите ни: как съставяме тестови набори, какво сме измерили и къде даден метод спира да се изплаща. Тези бележки се пишат в момента.
Нищо тук не е зад форма и нищо тук не претендира за академично рецензиране, каквото не сме правили.

Един метод е полезен тук само ако издържи срещата с реалните, непълни данни на клиента.
Какво се подготвя
Четири обобщения са в работа. Всяко посочва метода, данните, върху които е валидиран, и честната граница, до която се пренася.
Как съставяме тестов набор, преди да строим модел
Методът, обяснен разбираемо, и мястото, където се отплаща: малките, шумни и частично сгрешени набори данни, с които средният бизнес реално разполага, а не чистият benchmark.
Оценка на модел там, където уверено грешният отговор е скъп
Клинично моделиране на риск и какво ни научи то за оценяването на модел там, където уверено грешният отговор струва скъпо — навикът зад всеки тестов набор, който правим днес.
Тестови набори за извличане от документи на български
Как сглобяваме тестов набор от реални фактури, договори и товарителници — включително почти дубликатите, лошите сканове и страниците със смесена азбука, които публичните benchmark-ове тихо изключват.
Модели с отворени тегла при квантизация
Измерена загуба на точност при структурирано извличане с падане на прецизността и моментът, в който по-евтиното внедряване спира да бъде по-евтино, щом отчетем времето за преглед.
Работите по нещо съседно или искате статия, преди обобщението да е готово? Пишете ни.

Имате проблем, който прилича на изследователски въпрос?
Понякога наистина е такъв. Ако задачата иска проучване, а не внедряване, ще го кажем, ще обхванем проучването и ще опишем как би изглеждал отрицателният резултат.
Публикуваме под собствените си имена и цитираме хората, с които работим.