Zbudujemy dla Ciebie rozwiązanie Computer Vision
Tworzymy własne modele - projektujemy je i trenujemy pod Twoje potrzeby biznesowe, w oparciu o najnowsze badania naukowe.
Omówmy projekt
Computer Vision

Czym jest Computer Vision?

Computer Vision to dziedzina sztucznej inteligencji, która polega na analizie obrazów lub filmów. Umożliwia zautomatyzowanym systemom wykonywanie złożonych zadań, takich jak rozpoznawanie obiektów, wykrywanie ruchu czy odczytywanie tekstu (OCR).
Przykłady zastosowań
Widzenie komputerowe obejmuje szeroki zakres technik umożliwiających analizę i zrozumienie obrazów w różnych formach. Poniższe przykłady stanowią jedynie niewielką część niezliczonych możliwych zastosowań: od prostego rozpoznawania obiektów po szczegółową interpretację złożonych scen.
Przykład detekcji obiektów
Detekcja obiektów polega na automatycznym rozpoznawaniu i lokalizowaniu elementu na obrazie. Operacja ta często zapewnia większą precyzję niż sama klasyfikacja – pozwala na wygenerowanie ramki ograniczającej (bounding box) wokół wykrytego obiektu. Posiadanie tej wizualnej lokalizacji może być kluczowe w niektórych zastosowaniach, takich jak monitoring wideo czy identyfikacja produktów w sklepie.
Segmentacja semantyczna ma na celu automatyczne przypisanie kategorii – lub maski – do każdego piksela obrazu, co pozwala na bardzo precyzyjne wyodrębnienie różnych obszarów. Model segmentacji jest szczególnie istotny w dziedzinach takich jak precyzyjna kartografia dla systemów nawigacyjnych czy szczegółowa analiza tkanek w sektorze medycznym.
Przykład estymacji pozy
Estymacja pozy polega na analizie i lokalizacji kluczowych punktów ludzkiego ciała, takich jak stawy, w celu określenia postawy i wywnioskowania ruchów. Takie podejście okazuje się kluczowe w wielu dziedzinach – od monitorowania ćwiczeń sportowych, przez rehabilitację funkcjonalną, aż po tworzenie animacji w czasie rzeczywistym w branży rozrywkowej.
Przykład Visual Question Answering
Visual Question Answering polega na automatycznym odpowiadaniu na pytanie zadane na podstawie obrazu, co wymaga połączenia widzenia komputerowego i przetwarzania języka naturalnego. W niektórych kontekstach, dzięki precyzyjnym zapytaniom, model Visual Question Answering jest w stanie wydobyć dokładniejsze informacje niż te dostarczane przez Image Captioning.

Nasze doświadczenie pracuje na Twój projekt

Service Picture
Korzystamy z najskuteczniejszych gotowych modeli Deep Learning dostępnych na rynku - klasyfikatorów ResNet, modelu detekcji YOLO czy segmentacji SAM. Model dobieramy pod Twój produkt i potrzeby biznesowe, a potem dotrenowujemy go na Twoich danych, żeby działał jak najlepiej.

Model ma działać wewnątrz Twojej aplikacji biznesowej? Obsługiwać setki albo tysiące użytkowników bez rosnących kosztów hostingu? A może musi zmieścić się w systemie wbudowanym o ograniczonej mocy obliczeniowej? Galadrim poprowadzi Cię przez każdy etap - mamy inżynierów doświadczonych we wdrażaniu i integracji złożonych modeli AI.

Zespół

Jesteśmy zespołem 30 inżynierów i konsultantów, pasjonujących się sztuczną inteligencją oraz praktycznym zastosowaniem najnowszych osiągnięć badawczych. Naszą misją jest demokratyzacja i uproszczenie wykorzystania AI dla wszystkich naszych klientów.
Omówmy Twój projekt
Założyciele
Pablo, Partner & Head of AI
Benjamin, Partner & CTO AI

Nasze realizacje

Obraz
Groupe Guillin
Rozpoznawanie modeli opakowań

Rozwój i fine-tuning modelu umożliwiającego rozpoznawanie jednego z 25 000 wzorów opakowań Guillin na podstawie zdjęcia.

  • Stworzenie dedykowanej aplikacji mobilnej do zbierania danych i operacyjnego wykorzystania modelu przez 250 przedstawicieli handlowych Grupy.
  • Adaptacja i fine-tuning wstępnie wytrenowanych modeli klasyfikacji i detekcji.
  • Wdrożenie aplikacji i modeli na dostosowanej infrastrukturze.

Wideo
Chanel
Analiza wideo gestu kosmetycznego

We współpracy z działem neuronauki Chanel, opracowanie algorytmów rozpoznawania wideo w celu naukowej obiektywizacji aplikacji produktów kosmetycznych przez klientów.

  • Implementacja algorytmów rozpoznawania wideo w Python z użyciem MediaPipe do identyfikacji głowy, dłoni i palców.
  • Śledzenie i rejestracja ruchów podczas aplikacji produktu (masaż półkolisty, wklepywanie itp.).
  • Wykorzystanie AI do zliczania i kategoryzacji ruchów w celu ekstrakcji metryk fizycznych (liczba, rodzaj, czas trwania).
  • Cel produktu: ocena łatwości stosowania kosmetyku na podstawie mierzalnych danych.

Semantyczne
YourArt
Wyszukiwanie obrazów

We współpracy z YourArt, projekt i rozwój funkcji AI zintegrowanej z platformą yourart.art, umożliwiającej wyszukiwanie dzieł sztuki na podstawie zapytań tekstowych lub graficznych.

  • Implementacja modeli semantycznego osadzania obrazu i tekstu w celu generowania reprezentacji wektorowych.
  • Rozwój algorytmu wyszukiwania najbliższych sąsiadów (wyszukiwanie ANN).

Nasze technologie

TensorFlow
TensorFlow
PyTorch
PyTorch
OpenCV
OpenCV
Tesseract OCR
Tesseract OCR
Segment Anything
Segment Anything
GPT-4o
GPT-4o
Masz projekt?
Porozmawiajmy