Przejdź do treści
Darmowy audyt

Wdrożenia AI Problem i rozwiązanie

Rachunek za API OpenAI rośnie za szybko - przyczyny i jak obniżyć koszty

Autor: Bartosz Gromek Zaktualizowano: 4 min czytania

W skrócie

  • Objaw: miesięczny rachunek za API modelu językowego rośnie szybciej niż liczba obsłużonych spraw albo nagle skacze bez wyraźnego powodu.
  • Przyczyna: najczęściej zbyt długi kontekst wysyłany w każdym zapytaniu, najdroższy model użyty do prostych zadań, zapętlenia i brak limitów wydatków.
  • Rozwiązanie: sprawdź zużycie tokenów według zadania, skróć kontekst, dobierz tańszy model do prostych kroków, ustaw limity i alerty oraz zabezpiecz klucze API.

Nie masz czasu? Zrobimy to za Ciebie - Automatyzacja procesów AI od 2 000 zł netto

Jak to wygląda

Pierwszy miesiąc wdrożenia kosztował niewiele, a kolejne rachunki są coraz wyższe, choć liczba klientów czy dokumentów się nie zmieniła. Czasem koszt rośnie skokowo w ciągu jednego dnia. W panelu dostawcy widać dużą liczbę tokenów wejściowych, a nikt w firmie nie wie, który proces je zużywa.

  • koszt jednej rozmowy z chatbotem rośnie z każdą kolejną wiadomością,
  • w panelu zużycia widać nagłe skoki w nocy lub w weekend,
  • jeden klucz API jest używany przez kilka projektów i nie da się ich rozdzielić.

Dlaczego tak się dzieje

Dostawcy modeli rozliczają się za tokeny, czyli fragmenty tekstu, osobno za tokeny wysłane do modelu (wejściowe) i wygenerowane przez model (wyjściowe). Ceny różnią się w zależności od modelu, a aktualne stawki publikuje dostawca w cenniku. Rachunek rośnie więc z każdą dodatkową linijką kontekstu, każdym zbędnym wywołaniem i każdym zadaniem obsługiwanym przez droższy model, niż to konieczne.

Zbyt długi kontekst

Chatbot, który przy każdej wiadomości wysyła całą historię rozmowy i całe dokumenty z bazy wiedzy, płaci za te same tokeny wiele razy. Koszt rozmowy rośnie wtedy szybciej niż jej długość.

Jeden model do wszystkiego

Klasyfikacja maila, wyciągnięcie numeru zamówienia czy krótkie streszczenie nie wymagają najmocniejszego modelu. Użycie go do wszystkiego jest najprostszym sposobem na wysoki rachunek.

Zapętlenia, nadużycia i wycieki kluczy

Agent bez limitu kroków, scenariusz wywołujący się sam albo publiczny chatbot bez ograniczeń mogą generować tysiące zapytań. Klucz API zapisany w kodzie strony może zostać przechwycony i wykorzystany na Twój koszt.

Ponawianie zapytań po błędach

Automatyzacja, która po błędzie lub przekroczeniu czasu ponawia zapytanie bez limitu prób, potrafi wysłać ten sam długi dokument do modelu wiele razy. Każda próba jest rozliczana osobno, nawet jeśli wynik zostanie odrzucony przez kolejny krok procesu.

Brak podziału kosztów na projekty

Gdy wszystkie automatyzacje, chatbot i testy programistów korzystają z jednego klucza, rachunek jest jedną liczbą bez wyjaśnienia. Nie wiadomo wtedy, które zadanie jest drogie, więc optymalizacja odbywa się na ślepo. Osobne klucze lub projekty dla każdego zastosowania pozwalają policzyć koszt każdego procesu.

Najczęstsze źródła kosztów i sposoby ich ograniczenia:

  • kontekst: przekazuj tylko potrzebne fragmenty dokumentów i streszczenie historii zamiast całej rozmowy,
  • model: proste kroki wykonuj tańszym modelem, a mocniejszy zostaw do zadań wymagających rozumowania,
  • odpowiedzi: ustaw limit tokenów wyjściowych i poproś o zwięzłe odpowiedzi,
  • powtórki: zapisuj wyniki powtarzalnych zapytań, zamiast generować je ponownie,
  • zadania wsadowe: przetwarzanie, które nie musi być natychmiastowe, uruchamiaj wsadowo, jeśli dostawca oferuje tańszy tryb.

Jeśli koszt skoczył nagle, a klucz API mógł trafić do kodu strony, repozytorium lub współdzielonego dokumentu, unieważnij go od razu i wygeneruj nowy. Dopiero potem szukaj przyczyny.

Ten problem jest jednym z naszej listy 100 problemów z wdrożeniem AI i automatyzacją. Pełne koszty wdrożenia, nie tylko API, omawiamy we wpisie automatyzacja procesów AI - koszty i etapy wdrożenia.

Bezpłatny audyt AI

Sprawdź gotowość firmy na AI

Wpisz adres, a przeniesiemy Cię do bezpłatnego skanu na stronie CodeScriptum.

Jak to rozwiązać krok po kroku

Rachunek za API OpenAI rośnie za szybko - przyczyny i jak obniżyć koszty - https://codescriptum.pl/blog/wysokie-koszty-api-openai-jak-obnizyc/

  1. Otwórz panel zużycia u dostawcy i sprawdź, w które dni, dla jakich modeli i kluczy zużycie jest najwyższe. Jeśli wszystko idzie przez jeden klucz, utwórz osobne klucze lub projekty dla każdej automatyzacji.
  2. Policz koszt jednostkowy: ile kosztuje jedna rozmowa, jeden przetworzony dokument lub jeden lead. Porównaj go z wartością, jaką daje zadanie.
  3. Skróć kontekst: wysyłaj tylko potrzebne fragmenty bazy wiedzy, ogranicz historię rozmowy do ostatnich wiadomości lub jej streszczenia i usuń z promptu powtórzenia.
  4. Przypisz modele do zadań: tańszy do klasyfikacji i wyciągania danych, mocniejszy tylko tam, gdzie test pokazuje wyraźnie lepsze wyniki.
  5. Ustaw limit tokenów odpowiedzi, maksymalną liczbę kroków agenta i limit długości rozmowy w publicznym chatbocie.
  6. Ustaw w panelu dostawcy limity wydatków i alerty o przekroczeniu progu, a klucze przechowuj wyłącznie po stronie serwera.

Jak sprawdzić, że zadziałało

Po tygodniu porównaj koszt jednostkowy (na rozmowę, dokument lub lead) z wartością sprzed zmian i sprawdź na zestawie testowym, czy jakość odpowiedzi się nie pogorszyła. Alert o przekroczeniu progu powinien przyjść na firmowy adres e-mail osoby odpowiedzialnej.

Usługa CodeScriptum

Automatyzacja procesów AI

od 2 000 zł netto

  • Analiza procesów i plan wdrożenia
  • Chatboty, agenci AI i integracje
  • Człowiek zatwierdza kluczowe decyzje

Najczęściej zadawane pytania

Czy ChatGPT Plus obejmuje koszty API?

Nie. Subskrypcja ChatGPT i API to osobne usługi rozliczane osobno. Automatyzacje i chatboty na stronie korzystają z API, które rozlicza się za zużyte tokeny.

Czy tańszy model pogorszy jakość odpowiedzi?

W prostych zadaniach, takich jak klasyfikacja czy wyciąganie danych, często nie. Sprawdź to na zestawie testowym z prawdziwych przykładów, zanim zmienisz model w produkcji.

Jak oszacować koszt API przed wdrożeniem?

Przetestuj proces na kilkudziesięciu prawdziwych przykładach, odczytaj średnie zużycie tokenów na zadanie z panelu dostawcy, pomnóż przez przewidywaną liczbę zadań w miesiącu i zastosuj aktualne stawki z cennika.

Źródła

  1. Cennik OpenAI API (otwiera się w nowej karcie) openai.com
  2. Dokumentacja OpenAI API (otwiera się w nowej karcie) platform.openai.com

Podobne problemy

O autorze

Bartosz Gromek

Założyciel CodeScriptum, technologia i rozwój

Założyciel CodeScriptum - firmy technologicznej z Łodzi, działającej od 2022 roku. Odpowiada za technologię i rozwój, a projekty realizuje razem z zespołem specjalistów od stron, sklepów internetowych, systemów CRM, integracji, AI i marketingu. Na blogu opisuje problemy, z którymi zgłaszają się klienci CodeScriptum, i sprawdzone sposoby ich rozwiązania.

Newsletter

Konkretne porady raz na jakiś czas

Nowe problemy i rozwiązania z bloga, zmiany w przepisach dla sklepów i stron oraz sprawdzone sposoby na więcej klientów z internetu. Bez spamu, wypis jednym kliknięciem.