Prijeđite na glavni sadržaj

Rješavanje problema s izvorima znanja za Mira AI

Što učiniti kada katalog proizvoda ili web scraping ne uspije — česte greške, njihovi uzroci i rješenja.

Napisao/la Michal Jindra

Mira AI odgovara na temelju izvora znanja koje povežete — web scrapinga, XML kataloga proizvoda, tekstualnog sadržaja i prilagođenih odgovora. Kada izvor ne radi, Mira može prestati odgovarati na pitanja o proizvodima ili odgovarati zastarjelim informacijama. Ove upute obuhvaćaju najčešće greške i načine njihova rješavanja. Stanje svakog izvora možete vidjeti u odjeljku Baza znanja — ikona statusa uz naziv izvora prikazuje pojedinosti kada preko nje prijeđete pokazivačem.


Zahtjevi za katalog proizvoda

  • URL kataloga mora biti javno dostupan (bez prijave). Ako vaš poslužitelj koristi vatrozid, dopustite naše IP adrese 94.130.187.58 i 188.245.65.74.

  • Maksimalna veličina je 50 MB, u formatu XML ili CSV (struktura Google Merchant Center ili Heureka).

  • Svaka stavka mora imati obavezne oznake: id, name, description, price i link. Stavke kojima nedostaje bilo koja od njih preskaču se tijekom obrade.

  • Svakoj stavci treba biti dodijeljena kategorija — stavke bez kategorije mogu biti izostavljene, pa Mira tada ne može odgovarati na pitanja o proizvodima i kategorijama.

Savjet: Prije dodavanja kataloga provjerite ga alatom za provjeru valjanosti kataloga kako biste na vrijeme otkrili oznake koje nedostaju. Kada obrada kataloga stalno ne uspijeva, rezultati provjere obično pokazuju točno koje stavke uzrokuju problem. Valjanost svojeg kataloga možete provjeriti ovdje.


Česte greške u katalogu proizvoda

"Obrada podataka nije uspjela" / učitavanje nikad ne završava

Uobičajeni uzroci: katalog je veći od 50 MB, obavezne oznake nedostaju ili su neispravno oblikovane ili URL nije javno dostupan. Provjerite valjanost kataloga i njegovu veličinu te provjerite otvara li se URL u anonimnom prozoru preglednika bez prijave. Ako vaš poslužitelj filtrira promet, dopustite naše gore navedene IP adrese.

"Isteklo je vremensko ograničenje za preuzimanje datoteke"

Poslužitelj na kojem se nalazi vaš katalog odgovorio je presporo pa je isteklo vrijeme za preuzimanje. Pokušajte ponovno dodati katalog — provjera se pokreće iznova pri svakom pokušaju — i provjerite brzinu veze svojeg poslužitelja. Ako se greška stalno ponavlja, obratite se našoj podršci i istražit ćemo problem.

Upozorenje o kategorijama koje nedostaju

Stavke bez kategorije preskaču se i Mira na temelju njih ne može odgovarati na pitanja o proizvodima ili kategorijama. Najprije dodajte kategoriju svakoj stavci u katalogu. Ako prva obrada kataloga završi upozorenjem o kategorijama iako vaše stavke imaju kategorije, otvorite katalog i odaberite Ažurirati — druga obrada obično se uspješno dovrši. Ako ne uspije, obratite se našoj podršci.

Katalog je u stanju Spremno, ali Mira ne može pronaći neke proizvode

Stavke kojima nedostaje obavezna oznaka (id, name, description, price, link) preskaču se bez obavijesti, pa katalog može biti u stanju Spremno iako neki proizvodi nisu u njemu. Provjerite valjanost kataloga, ispravite označene stavke i odaberite Ažurirati.

Ažuriranje je zapelo u stanju Na čekanju

Obrada velikih kataloga može potrajati. Ako ažuriranje ostane u stanju Na čekanju dulje od nekoliko sati, obratite se našoj podršci — možemo ponovno pokrenuti obradu za vas.


Problemi s web scrapingom

Mira ne može pronaći stranice moje web stranice

Provjerite jesu li stranice javno dostupne bez prijave i dopušta li vaš vatrozid naše IP adrese (94.130.187.58, 188.245.65.74). Jedan web scraping obuhvaća do 20 stranica — odaberite ključne (često postavljana pitanja, dostavu, uvjete, glavne stranice proizvoda), a ne sve. Ako web stranica potpuno blokira alate za indeksiranje, svejedno možete dovršiti postavljanje svojeg AI agenta — opišite svoje poslovanje u tekstualnom polju ponuđenom tijekom početnog postavljanja i taj će se opis spremiti kao uobičajeni izvor Tekstualni sadržaj.

Web scraping traje satima

Web scraping koji traje satima je zapeo. Obratite se našoj podršci i navedite URL koji pokušavate skenirati, a mi ćemo provjeriti obradu na našoj strani.

Mira odgovara zastarjelim informacijama

Izvori se osvježavaju prema svojem intervalu ažuriranja — možete ga vidjeti i promijeniti izravno u tablici izvora (web scraping: svaki mjesec ili svaka 2 tjedna; katalog proizvoda: svaki tjedan, svaki dan ili svakih 12 sati). Interval se može postaviti i na Isključeno — izvor kojem je interval ažuriranja postavljen na Isključeno nikad se ne osvježava sam, pa ako Mira počne odgovarati na temelju zastarjelih podataka, najprije provjerite stupac Interval ažuriranja. Kada su automatska ažuriranja kataloga isključena, iznad popisa kataloga pojavljuje se narančasta traka upozorenja s gumbom za ponovno uključivanje ažuriranja.

Za nove izvore automatska ažuriranja su uključena prema zadanim postavkama, a automatska ažuriranja dostupna su uz pretplatu na Mira AI. Nakon što promijenite svoju web stranicu ili katalog, pričekajte sljedeće automatsko ažuriranje ili otvorite izvor i upotrijebite opciju Ažurirati ručno.


Objavljivanje i stanja izvora

Jedan izvor čija obrada nije uspjela ne blokira objavljivanje vašeg AI agenta. Objavljivanje je blokirano samo kada agent nema nijedan spreman izvor (web scraping ili tekstualni sadržaj) ili dok se odabrani izvori još stvaraju ili ažuriraju. Ako je gumb Objaviti onemogućen, u odjeljku Baza znanja provjerite koji su izvori još u obradi.


Što dalje?

Jesmo li odgovorili na vaše pitanje?