Scribd uz Gemini Enterprise klasifikuje više od 400 miliona dokumenata
Scribd koristi Gemini batch inference u okviru Gemini Enterprise kako bi automatizovao klasifikaciju ogromne biblioteke dokumenata i smanjio potrebu za ručnim pregledom sadržaja.

Automatizacija velikog dokumentnog korpusa
Scribd i SlideShare zajedno imaju stotine miliona korisnički postavljenih PDF-ova, prezentacija i drugih dokumenata koji moraju da budu pravilno klasifikovani i organizovani.
Kompanija je zbog obima podataka tražila način da poveća automatizaciju, a Google Cloud navodi da se za taj zadatak koristi Gemini batch inference unutar Gemini Enterprise okruženja.
Zašto je klasifikacija zahtevna
Kako kolekcija raste, povećava se i potreba da se dokumenti pregledaju, označe i usklade sa pravilima zajednice, što postaje sve skuplje kada se oslanja samo na ručni rad.
Scribd kombinuje automatizovane sisteme i ljudski pregled, a cilj je da AI model preuzme veći deo rutinske klasifikacije uz zadržavanje kontrole nad pravilima i izuzecima.
Google Cloud slučaj kao primer primene Gemini-ja
Google Cloud ovaj projekat predstavlja kao primer rada sa korpusom većim od 400 miliona dokumenata, gde batch obrada omogućava da se veliki broj stavki analizira bez pojedinačnog pokretanja svakog zahteva.
Ovaj rezultat je studija slučaja konkretne kompanije i ne znači da će isti učinak biti automatski ponovljiv u svakom okruženju, ali pokazuje kako se Gemini koristi u velikim produkcionim tokovima podataka.
Izvori
Prikazani su izvorni linkovi korišćeni za proveru objavljenih činjenica.

Komentari
Komentari se objavljuju nakon moderacije.
Još nema objavljenih komentara.