Startup Community Poznań · Poznań, Poland
Trzy bramki, zanim wydasz budżet
30-minutowa prelekcja otwierająca meetup Startup Community Poznań o szybkiej walidacji z AI. Trzy bramki po dwa dni każda, które zabijają albo przepuszczają pomysł na AI, zanim wyda się budżet. Bramka 1 — czy AI jest tu właściwym mechanizmem: reguły deterministyczne to formularz, brak danych to najpierw zebrać dane, wystarczy wyszukiwanie pełnotekstowe to wyszukiwanie pełnotekstowe; potem drabina prompt → prompt z kontekstem → RAG → workflow → agent i case 150 000 polis w PDF miesięcznie w Insly jako workflow (Claude Haiku 4.5 na Bedrocku w regionie EU, 98,5% skuteczności ekstrakcji, 5 500 USD miesięcznie). Bramka 2 — czy to domyka się na kartce: użytkownicy × zapytania × koszt zapytania, czyli 4000 zapytań miesięcznie to ~$0,60 na modelu open hostowanym w EU, ~$70 na modelu frontier i $942 na GPU w chmurze 24/7 — rozrzut 250× za tę samą funkcję, plus koszty ukryte, których nikt nie liczy (system prompt na dwie strony, retry, rosnąca historia czatu, embeddingi w pętli, cold start 30–60 s). Bramka 3 — czy to działa na MOICH danych: na zamkniętej domenie model ogólny odpowiada pewnie i błędnie, więc jedyny wiarygodny test to własny — 30 pytań, oczekiwane odpowiedzi, punktacja, licznik halucynacji, próg zaliczenia ustalony przed testem. Wynik u nas: model 7B pobił 11B (0,949 vs 0,915, ~1,5× szybciej end-to-end), a harness złapał wersję wstrzykującą śmieciowe tokeny, niewidoczną przy ręcznym klikaniu. Puenta: trzy prototypy RAG po dwa tygodnie, dwie decyzje o zabiciu, produkcja na trzecim — sześć tygodni zamiast 6+ miesięcy klasycznego R&D.