Mentionsy Mentionsy
Rozmowy na Autopilocie
Rozmowy na Autopilocie

Budowanie Asystenta AI

25.07.2023 ·42 min 7 s · 8 rozdziałów

W tym odcinku rozmawiamy o tym, jak zaprojektowaliśmy i stworzyliśmy asystenta AI dla serwisu eduweb, napędzanego 25 milionami znaków transkryptów i innych naszych materiałów oraz jak sprawiliśmy, że potrafi odpowiadać kontekstowo z uwzględnieniem konkretnej lekcji czy kursu, ale też całej ogólnej wiedzy. To przełom w edukacji, który pozwoli na bardziej spersonalizowaną naukę. Przetestujcie na eduweb.pl!

0:00 · Wprowadzenie i opis projektu Asystenta AI 2

Cześć wszystkim, witajcie. Witamy w kolejnym odcinku Rozmów na Autopilocie. Z tej strony Grzegorz Ruk, jest ze mną Adam Gospodarczyk i jeszcze szereg osób, które dołączyły do nas na żywo na naszej społeczności Ahoj, do której was serdecznie zapraszamy. Tutaj zawsze jako pierwsi możecie wysłuchać naszego podcastu, a także porozmawiać z nami na dowolny temat chwilę później. Często rozszerzamy te rzeczy, które omawiamy w podcaście i podajemy różne nasze doświadczenia czy praktyczne przykłady Wszelkie prawa zastrzeżone. Eduweb.

Został wdrożony na Edu. Jak to zrobiliśmy? Adam w zasadzie zajmował się całym tym projektem i dalej go rozwija, bo obecnie asystent jest w wersji beta. No i powiedz nam Adam, może na początku, do czego w ogóle służy asystent i co można dzięki niemu osiągnąć w ramach Eduweba? Tak, to cześć przede wszystkim. Jeżeli chodzi o sam projekt Asystenta, myślę, że on realizuje taką jedną z popularniejszych koncepcji, przynajmniej na tym etapie, dotyczącej wykorzystania dużych modeli językowych, takich jak np. GPT-4. Czyli po prostu podłączenie się do naszej bazy wiedzy i odpowiadanie na pytania z tą bazą wiedzy. Czyli można tak w jednym zdaniu powiedzieć, że asystent umożliwia porozmawianie z treścią Eduweba, niebawem też z treścią Ahoy, oczywiście jakieś wybrane wątki oraz także z naszymi newsletterami i innymi publikacjami.

10:17 · Organizacja treści i odpowiedzi asystenta 2

Po drugie, korzysta on ze swoich zasobów jakby wiedzy ogólnej, którą tak nazywamy, czyli de facto wszystkiego tego, co możecie zapytać na przykład chat GPT i wam udzieli odpowiedzi i to jest też wiedza, którą taki asystent ma. I po trzecie, w wybranych przypadkach korzysta z zasobów internetowych, bo nie w każdym przypadku dajemy mu dostęp do wszystkich zasobów. Ale do stron, co do których mamy pewność, że mamy uprawnienia, mamy prawa autorskie, możemy wziąć na przykład fragmenty dokumentacji, na te strony też asystent może zajrzeć i udzielić nam odpowiedzi, która w kontekście zawiera te informacje. Po drugie, przy udzielaniu odpowiedzi asystent Nie korzysta z takiego gotowego modelu, tak jak Adam powiedział, przygotowanego techniką fine-tuningu czy inną, która pozwala po prostu zbudować jakiś zamknięty nowy model danych, z którego korzysta taki asystent, tylko korzysta właśnie z tych rzeczy na bieżąco.

Te rzeczy są w pewien sposób skatalogowane, ta cała wiedza w pewien sposób jest ułożona, otagowana, w pewien sposób dostępna dla niego na bieżąco. I to, co robi asystent, to po prostu wysyła odpowiednie zapytanie czy odpowiedni prompt. My korzystamy z API OpenAI, najczęściej z GPT-4, ale nie zawsze, o tym pewnie Adam też powie, do tego, żeby właśnie te informacje przesłać i uzyskać odpowiednią odpowiedź. W tej odpowiedzi kontekstem jest po pierwsze to, co znajdzie na Eduwebie. Ale drugą rzeczą, którą uwzględnia, są też te dane z zewnątrz, o których wspomnieliśmy, czyli np. z ogólnej wiedzy czy z dokumentacji. I takie dwa komponenty na ogół odpowiedzi asystent stara się przygotować po to, żeby nie tylko dać kontekst z Eduweba, ale też jakiś kontekst z zewnątrz na zadane pytanie.

22:41 · Wyzwania i zabezpieczenia 1

Jak te dane przygotować, opracować, to wszystko wpływa też na czas odpowiedzi, na jakość odpowiedzi, na wszystkie te rzeczy, o które musimy tutaj zadbać, więc jest to samo w sobie dosyć trudne zadanie, ale przeszliśmy od tej części właśnie technicznej do tej, która jest równie ważna, a może nawet ważniejsza, czyli części użytkowej, mówiąc o tym, że tak naprawdę asystent to Pewnego rodzaju cały upgrade do edukacji, którą planujemy polepszać właśnie czy wykorzystywać te mechanizmy po to, żeby nauka była jeszcze bardziej sprytna i przede wszystkim też na wyciągnięcie ręki oraz dopasowana do użytkownika. I to o czym wspomniał Adam, czyli to trochę takie dopasowanie czy profilowanie, czyli to, że asystent będzie za jakiś czas wiedział coś o nas, na przykład czego uczyliśmy się, jak długo, jakie odpowiedzi udzieliliśmy na jakiś quiz, który nam zadał lub też na przykład jakie rzeczy wynotowaliśmy sobie na Eduwebie do rozmaitych lekcji i oczywiście ta wiedza będzie prywatna dla asystenta.

36:46 · Wyzwania i możliwości 3

Okej, widzę, że Adam nie ma nic tutaj więcej do dodania i chyba... Nie, wydaje mi się, że nie mam i nie chcę też tak przeciągać, ale chciałem tylko tak od siebie dodać, że właśnie to projektowanie narzędzi wykorzystujących czy integrujących duże modele językowe w tym momencie jest bardzo tak na topie. Natomiast z punktu widzenia produkcyjnego jest tam wiele, nawet nie tyle wyzwań, co pytań, które nie mają odpowiedzi, w sensie odpowiedzi, których nie mają nawet twórcy z OpenAI, twórcy GPT-4. I jesteśmy takie naprawdę pozostawieni trochę sami sobie z tym, żeby na przykład dostosować nawet takie proste pytanie.

Ten sam wątek, czy ten sam temat, czy tą samą To samo zagadnienie do zrozumienia przez tą osobę będzie można na przykład osobie zaawansowanej przedstawić w 5 kroków, a osobie początkującej w 20 kroków, ale dalej będzie to ten sam content i ten sam materiał. Jest to mega ciekawe, super ważne w kontekście tego, co może stać się rzeczywiście zupełnie nową, kolejną wersją nauki online, która w mojej ocenie, myślę, że Adama też, nie mówiąc za Adama, ale jest najlepszą rzeczą, czyli jakby Internet jest najlepszym miejscem do edukacji, ale chyba jeszcze Nikt nie wymyślił najlepszej wersji edukacji w internecie i nasze starania do tego, do wymyślenia takiej najlepszej wersji są od wielu lat i tak właśnie projektujemy też Eduweb, aby zawierał te wszystkie istotne komponenty, ale teraz w zasadzie mamy chyba takie trochę wrażenie, że dopiero będzie to

Jeszcze we wczesnej wersji w becie i go ulepszamy na dziś. To chyba wszystko. Dziękuję Wam bardzo za uwagę w tym trochę wydłużonym odcinku, ale niezwykle ciekawym. Jeśli będziecie chcieli więcej dowiedzieć się na ten temat, proszę piszcie na naszej społeczności, na Ahoy, a my też oczywiście będziemy nagrywać o tym więcej podcastów. Dzięki, Adam.

Pokazano wszystkie 8 dopasowań. Transkrypcja generowana automatycznie i niesprawdzana ręcznie — może zawierać błędy.