Bugetul de accesare este limita pe care Google o stabilește pentru câte pagini va accesa pe site-ul dvs.
Pe lângă postările și paginile dvs., WordPress generează mai multe URL-uri suplimentare pe care motoarele de căutare le pot accesa și indexa. Acest lucru înseamnă că Google ar putea să-și cheltuiască bugetul de accesare pe pagini inutile, în loc de conținutul dvs. important.
În acest articol, vă vom arăta cum să vă optimizați bugetul de accesare în WordPress, astfel încât Google să găsească mai întâi conținutul dvs. important.

Răspuns rapid: Cum să remediați bugetul de accesare în WordPress
Blocarea URL-urilor inutile cu setările de curățare a accesării ale pluginului dvs. SEO sau cu fișierul robots.txt asigură că bugetul dvs. de accesare nu este irosit.
Majoritatea site-urilor web mici s-ar putea să nu rămână niciodată fără buget de accesare. Cu toate acestea, WordPress creează mult mai multe URL-uri decât publicați. Google ar putea ajunge să irosească bugetul de accesare pe aceste URL-uri, iar paginile dvs. importante s-ar putea să nu fie accesate rapid sau frecvent.
Utilizați linkurile rapide de mai jos pentru a sări direct la remedierea de care aveți nevoie:
- Ce este bugetul de accesare și cum îl verificați?
- Blocați URL-urile care irosesc accesarea cu fișierul robots.txt sau pluginul dvs. SEO
- Deindexați conținutul subțire – Arhivele de etichete, date și autori
- Păstrați harta site-ului XML curată
- Remediați erorile de accesare și lanțurile de redirecționare
- Accelerați serverul pentru a crește rata de accesare
- Blocați roboții AI care vă irosesc resursele serverului
- Întrebări frecvente despre bugetul de accesare WordPress
Ce este bugetul de accesare și cum îl verificați?
Bugetul de accesare este numărul de pagini pe care un motor de căutare precum Google le va accesa pe site-ul dvs. într-un anumit interval de timp. Există doi factori principali:
- Capacitate de accesare (Crawl Capacity): Câte cereri poate face Google fără a vă bloca sau încetini serverul. Dacă serverul dvs. este rapid și fiabil, capacitatea dvs. este mare.
- Cere de accesare (Crawl Demand): Cât de mult dorește Google să acceseze site-ul dvs., în funcție de popularitatea acestuia, calitatea generală și cât de des publicați conținut nou.
Când paginile de valoare scăzută sau serverele lente vă consumă bugetul de accesare, Google accesează mai puțin și durează mai mult indexarea conținutului dvs. nou.
Merită să acordați un moment pentru a examina raportul Statistici de accesare (Crawl Stats) din Google Search Console. Acesta vă spune când și cât de des vizitează Googlebot site-ul dvs. web. Pur și simplu deschideți Google Search Console și accesați Setări » Statistici de accesare » Deschideți raportul pentru a-l vizualiza.

Odată ajuns în raport, Google descompune cererile de accesare în patru moduri. Iată ce arată fiecare:
- După răspuns. Cum a răspuns serverul dvs. la fiecare cerere, inclusiv „OK (200)”, „Nu s-a găsit (404)”, redirecționări și erori de server (5XX).
- După tipul fișierului. Ce a descărcat Googlebot din paginile HTML, imagini, CSS și JavaScript.
- După scop. „Descoperire” înseamnă că Google accesează o adresă URL pentru prima dată, în timp ce „Reîmprospătare” înseamnă că re-accesează pagini pe care le cunoaște deja.
- După tipul Googlebot. Arată ce crawler a făcut cererea. O cotă mare de „Smartphone” este normală, deoarece Google accesează în principal versiunea mobilă a site-ului dvs.

Faceți clic pe orice rând din aceste rapoarte pentru a vizualiza adresele URL specifice și statisticile lor individuale de accesare. Aceste date vă vor arăta, de asemenea, exact ce remedieri necesită site-ul dvs.:
- O cotă mare de răspunsuri „Nu s-a găsit (404)” sau „Eroare de server (5XX)” înseamnă că adresele URL nefuncționale consumă cereri. Puteți rezolva acest lucru prin curățarea lanțurilor dvs. de redirecționare și remedierea linkurilor nefuncționale.
- Un număr mare de „Sindicalizare” înseamnă că Google consumă cereri pe fluxuri în loc de conținutul dvs. Puteți opri cu ușurință această risipă prin blocarea acelor adrese URL inutile.
- Dacă statistica dvs. de accesare „Descoperire” rămâne ridicată chiar și atunci când nu publicați conținut nou, Google probabil pierde timp pe adrese URL generate automat, cum ar fi paginile de sortare și filtrare. Puteți opri acest lucru prin aplicarea acelorași reguli de blocare robots.txt.
- Timpul mediu lent de răspuns sau erorile repetate ale serverului limitează întregul dvs. buget. Acesta este un semn clar că este timpul să accelerați serverul dvs.
În final, verificați metrica „Descoperite – momentan neindexate” din raportul dvs. de Indexare a paginilor. Google folosește acest lucru atunci când întârzie o accesare pentru a evita blocarea serverului dvs. Un număr mare aici este un indicator direct că accesarea site-ului dvs. este limitată.
Blocați URL-urile care irosesc accesarea cu fișierul robots.txt sau pluginul dvs. SEO
Cea mai mare parte a bugetului de accesare irosit provine din adrese URL pe care WordPress și pluginurile dvs. le generează automat, nu din articolele pe care le scrieți.
Aceste adrese URL inutile includ fluxuri, linkuri de răspuns la comentarii, rezultate interne de căutare, parametri de urmărire din campaniile și reclamele dvs. și parametri de filtrare WooCommerce.
Înainte de a începe să refuzați adrese URL, țineți cont de două lucruri:
- Nu interzice niciodată CSS sau JS. Google trebuie să încarce aceste fișiere pentru a afișa corect paginile tale.
- Nu bloca un URL pe care intenționezi să-l noindexezi. O etichetă noindex cere Google să păstreze o pagină în afara rezultatelor căutării. Cu toate acestea, Google trebuie să acceseze pagina WordPress pentru a vedea acea etichetă, așa că blocarea URL-ului în robots.txt înseamnă că Google nu o citește niciodată.
Scrieți regulile fișierului robots.txt manual
Fișierul robots.txt este un fișier text simplu care se află la rădăcina site-ului tău web. Acesta spune roboților motoarelor de căutare ce URL-uri să nu viziteze.
Poți edita manual fișierul robots.txt prin contul tău de hosting. Cu toate acestea, utilizarea editorului încorporat în pluginul tău SEO este mult mai ușoară.
De exemplu, în All in One SEO, îl vei găsi sub All in One SEO » Tools » Robots.txt Editor.

Alte pluginuri populare precum Yoast SEO și Rank Math oferă editori similari pentru robots.txt.
Începe prin a identifica modelele de URL pe care nu dorești să le accesezi, cum ar fi /?s= pentru căutarea internă, ?replytocom= adăugat la URL-urile postărilor pentru linkurile de răspuns la comentarii și /feed/ pentru fluxurile RSS.
Înainte de a bloca fluxurile tale RSS, asigură-te că nu ai nevoie de ele pentru un podcast, un newsletter automatizat prin e-mail sau cititoare de fluxuri. Odată ce știi că nu sunt utilizate, adaugă o regulă Disallow pentru fiecare.
User-agent: *
Disallow: /*?s=
Disallow: /*?replytocom=
Disallow: /*/feed/
Odată ce ai salvat regulile, verifică-le cu raportul robots.txt din Google Search Console înainte de a continua.

Confirmă că noile tale reguli Disallow apar acolo, fără erori de sintaxă semnalate.
Configurați Curățarea accesării în pluginul dvs. SEO
Dacă preferi să nu scrii manual reguli robots.txt, atunci setările de curățare a accesării (crawl cleanup) ale pluginului tău SEO pot face aceeași treabă cu comutatoare simple.
Dacă folosești AIOSEO, îl vei găsi sub All in One SEO » Search Appearance » Advanced. Apoi activează „Crawl Cleanup”. Instrumentul Crawl Cleanup îți permite să dezactivezi fluxurile RSS inutile (cum ar fi cele pe care WordPress le generează automat pentru comentarii, autori și atașamente), să blochezi roboții nedoriți și să oprești accesarea URL-urilor de căutare interne.
Asigură-te că lași fluxul principal al site-ului activ. De aceea AIOSEO îl marchează ca „nerecomandat de dezactivat”.

Yoast SEO are aceeași funcționalitate sub Yoast SEO » Settings » Advanced » Crawl optimization, cu propriile opțiuni de eliminare a fluxurilor și curățare a parametrilor URL.
Odată ce ai activat aceste opțiuni, verifică fișierul tău robots.txt pentru a confirma că noile reguli sunt de fapt active.
Cum să gestionați parametrii de urmărire
Campaniile de e-mail, reclamele și instrumentele de marketing adaugă adesea parametri de urmărire la URL-urile tale (cum ar fi utm_source, fbclid sau gclid) pentru a vedea de unde provin vizitatorii.
AIOSEO’s Query Arg Monitoring îți arată ce dintre acești parametri de interogare (valorile suplimentare după un semn întrebare într-un URL) Googlebot accesează de fapt. Îl vei găsi în partea de jos a aceleiași ecrane „Advanced” din AIOSEO.

În majoritatea cazurilor, nu este necesar să blochezi sau să redirecționezi linkurile de urmărire.
Deși AIOSEO oferă o opțiune „Optimizează parametrii UTM” care rescrie aceste linkuri prin redirecționări, recomandăm cu tărie să o lăsați dezactivată pentru a nu rupe accidental datele de urmărire.
Cu toate acestea, dacă observați argumente de interogare în monitorul dvs. care nu au absolut niciun scop, le puteți adăuga în siguranță în lista de blocare din această secțiune. Utilizatorii avansați pot folosi, de asemenea, Regex (expresii regulate) pentru a bloca simultan mai multe URL-uri similare.
Curățați URL-urile de filtrare și coș WooCommerce
Magazinele WooCommerce adaugă proprii parametri care irosesc resursele de indexare peste toate cele de mai sus, în principal orderby=, filter_, min_price= și max_price=, și add-to-cart=.
Puteți bloca pe cele fără valoare de căutare folosind aceeași abordare robots.txt sau le puteți adăuga ca argumente de interogare în Monitorizarea Argumentelor de Interogare din secțiunea de mai sus.

Blocarea add-to-cart= este sigură, deoarece declanșează o acțiune, mai degrabă decât să servească conținut unic.
Faceți același lucru pentru filtrele de sortare și interval de prețuri, cu o excepție – un filtru care generează trafic de căutare de la sine, cum ar fi o singură mărime sau culoare populară.
Deindexați conținutul subțire – Arhivele de etichete, date și autori
Deindexarea înseamnă eliminarea unei pagini din rezultatele căutării Google. O faceți adăugând o etichetă noindex, care cere motoarelor de căutare să nu afișeze acea pagină atunci când oamenii caută.
WordPress creează automat pagini de arhivă care grupează postările dvs. după etichetă, dată și autor. Aceste arhive repetă în mare parte conținutul care există deja pe site-ul dvs., motiv pentru care experții SEO le numesc pagini „subțiri”.
Iată patru tipuri de arhive care sunt de obicei sigure de indexat cu noindex:
- Arhive de autor, dacă site-ul dvs. are un singur scriitor
- Arhive de etichete care nu funcționează ca pagini de destinație reale
- Arhive de date, care rareori au valoare de căutare de la sine
- Pagini de atașament, pe care site-urile WordPress mai vechi le creează pentru fiecare imagine încărcată (WordPress 6.4 a încetat să le mai creeze pentru instalațiile noi în noiembrie 2023)
Puteți seta fiecare dintre tipurile de arhive să fie indexate cu noindex din setările de arhivă ale pluginului dvs. SEO. Majoritatea pluginurilor SEO WordPress includ această setare în versiunile lor gratuite.
În AIOSEO, o veți găsi sub All in One SEO » Aspect Căutare » Arhive.

Înainte de a salva, verificați de două ori dacă nu ați indexat accidental o pagină importantă sau un tip de postare întreg.
Păstrați harta site-ului XML curată
Harta site-ului dvs. XML îi spune Google ce URL-uri considerați importante și proaspete. Păstrând harta site-ului dvs. fără aglomerație, vă asigurați că motoarele de căutare se concentrează pe conținutul dvs. cel mai valoros, în loc să irosească timp pe arhive paginate.
În mod implicit, WordPress creează o hartă a site-ului XML pentru site-ul dvs. Pentru mai mult control, recomandăm generarea unei hărți a site-ului personalizate cu un plugin SEO.
O hartă a site-ului personalizată adaugă datele modificate ultima dată și elimină paginile pe care le setați la noindex din ea. AIOSEO, Yoast SEO și Rank Math vă permit să creați o hartă a site-ului în versiunile lor gratuite.
Remediați erorile de accesare și lanțurile de redirecționare
URL-urile moarte și redirecționate vă costă în continuare cereri de indexare, deoarece Google află că un URL este mort doar prin preluarea acestuia. Pe un site WordPress tipic, aceste cereri de indexare irosite provin de obicei din trei cauze principale:
- Lanțuri de redirecționare. Acest lucru se întâmplă atunci când URL-ul A redirecționează către B, care apoi redirecționează către C. Pentru a remedia acest lucru, comprimați lanțul rutând URL-ul original direct către destinația finală cu o singură redirecționare 301 (permanentă).
- Erori Soft 404. Acest lucru apare atunci când o pagină este eliminată, dar serverul dvs. returnează în continuare un cod de succes normal „200 OK”. Google va continua să acceseze URL-ul deoarece serverul nu a indicat explicit că conținutul a dispărut. Puteți remedia acest lucru asigurându-vă că paginile șterse returnează un cod de stare 404 (Not Found) sau 410 (Gone) corespunzător.
- Linkuri interne învechite. De fiecare dată când Google urmează un link intern care duce la o pagină ruptă sau la o redirecționare, acesta consumă din bugetul dvs. de accesare. Ar trebui să vă auditați în mod regulat linkurile interne și fie să le eliminați, fie să le actualizați pentru a indica direct către URL-ul final, activ.
Puteți, de asemenea, să citiți ghidul nostru despre cum să creați o redirecționare în WordPress, care vă ghidează prin întregul proces.
Accelerați serverul pentru a crește rata de accesare
Un server rapid încurajează Google să acceseze mai multe pagini, în timp ce un server care se luptă îl forțează să se retragă. Pentru a vă îmbunătăți timpii de răspuns, aveți nevoie de două lucruri: o găzduire WordPress robustă și o configurație de caching activă.
Cu toate acestea, erorile de server pot afecta bugetul dvs. de accesare chiar mai mult decât viteza paginii. Dacă Googlebot întâmpină frecvent timeout-uri, acesta reduce drastic accesarea și este lent la recuperare.
Puteți monitoriza timpii de răspuns și erorile de server în raportul Statistici de accesare din Google Search Console. Erorile sunt de obicei cauzate de un plan de găzduire la limită sau de un plugin defectuos.
Consultați ghidul nostru despre remedierea erorilor interne de server 500 pentru ajutor cu jurnalele de erori și limitele de găzduire.
Blocați roboții AI care vă irosesc resursele serverului
Crawlerele AI precum GPTBot, ClaudeBot și PerplexityBot nu folosesc bugetul dvs. de accesare Google. Cu toate acestea, ele accesează același server, iar scraping-ul agresiv poate încetini suficient de mult site-ul dvs. pentru a vă reduce rata de accesare Google.
Cea mai rapidă soluție pentru a remedia această problemă este curățarea accesării, care vine cu majoritatea pluginurilor SEO. Crawl Cleanup de la AIOSEO include setări de blocare a roboților care opresc roboții AI nedoriți la nivelul WordPress.
Pentru o protecție mai puternică, controlul gratuit AI Crawl de la Cloudflare vă permite să blocați roboți individuali din fila Roboți. Acesta blochează roboții înainte ca aceștia să ajungă la serverul dvs. de găzduire.

Cu toate acestea, fiți precaut atunci când vă configurați lista de blocare. Multe dintre acești „roboți” pot fi asistenți de căutare AI care generează trafic pe site-ul dvs., așa că blocarea lor nediscriminatorie vă va afecta vizibilitatea generală.
Întrebări frecvente despre bugetul de accesare WordPress
Iată întrebările pe care le primim cel mai des despre bugetul de accesare.
Puteți seta sau crește bugetul de accesare a site-ului?
Nu există un număr fix pe care îl puteți seta. Puteți crește capacitatea de accesare cu un server mai rapid și mai fiabil și puteți crește cererea de accesare cu conținut proaspăt, non-duplicat, pe care Google dorește de fapt să-l reviziteze.
Cum pot împiedica Google să acceseze URL-urile /feed/ care apar ca duplicate în Search Console?
Dezactivați fluxurile redundante cu Crawl Cleanup de la AIOSEO sau adăugați o regulă Disallow pentru URL-urile fluxurilor dvs. în robots.txt. Acel conținut este deja indexat în altă parte pe site-ul dvs., așa că blocarea fluxurilor nu vă costă nimic în termeni de trafic organic.
Eticheta noindex economisește bugetul de accesare a site-ului?
Nu direct, deoarece Google trebuie în continuare să acceseze pagina pentru a vedea eticheta. În schimb, oprește Google din accesare printr-un fișier robots.txt.
O pagină 404 personalizată cu linkuri utile va îmbunătăți bugetul meu de accesare a site-ului?
Nu, îmbunătățește experiența utilizatorului. Pentru a vă asigura că bugetul de accesare a site-ului nu este irosit, asigurați-vă că serverul dvs. trimite codul de stare corect 404 sau 410 pentru o pagină care nu mai există.
Sperăm că acest articol v-a ajutat să găsiți și să remediați ceea ce vă irosește bugetul de accesare. Acordați câteva săptămâni modificărilor, apoi verificați din nou statisticile de accesare pentru a vedea îmbunătățirea.
De asemenea, ați putea dori să citiți ghidul nostru WordPress SEO suprem sau cum să oprești motoarele de căutare din a accesa un site WordPress.
Dacă v-a plăcut acest articol, atunci vă rugăm să vă abonați la Canalul nostru de YouTube pentru tutoriale video despre WordPress. Ne puteți găsi, de asemenea, pe Twitter și Facebook.


Mrteesurez
Acest lucru este cu adevărat nou pentru mine, deoarece nu știam ce se numește buget de crawl SEO. După ce am citit acest ghid, mi-am dat seama de motivele pentru care unele dintre schimbările pe care le-am făcut uneori durează timp pentru a se reflecta în căutarea Google. Fiecare blogger trebuie să știe acest lucru, să-l învețe și să știe cum să-și folosească cel mai bine bugetul de crawl SEO.
Acesta este un articol educativ, am învățat un concept nou aici, mulțumesc
Jiří Vaněk
Am o pagină personalizată 404 configurată și aici, pe lângă scuzele adresate cititorilor, am și linkuri către conținut interesant de pe site care i-ar putea interesa. Poate această opțiune să ajute?
Suport WPBeginner
O pagină 404 nu v-ar afecta bugetul de scanare SEO.
Admin
Jiří Vaněk
Mulțumesc pentru răspuns. Nu știam asta, așa că din nou am învățat ceva nou datorită ție.
Moinuddin Waheed
Acesta este un concept complet nou pentru mine și am ajuns să aflu despre bugetul de crawl și importanța acestuia.
Deoarece bugetul de crawl este oferit de Google însuși și indexează paginile web pe baza acestuia, care sunt criteriile pentru site-urile mari și mici și care sunt factorii care contribuie la bugetul de crawl?
Suport WPBeginner
Pentru moment, aceasta nu este o informație publică, motiv pentru care recomandăm să arunci o privire la raportul de Crawl pentru a-ți face o idee despre ce ai pentru site-ul tău.
Admin
ASHIKUR RAHMAN
cum pot să îi spun lui Google să nu indexeze linkurile /feed/ ? majoritatea postărilor noastre sunt indexate. dar un număr egal sau mai mare de postări/feed/ sunt indexate de Google. în GSC aceste linkuri devin linkuri duplicate.
Suport WPBeginner
Ați dori să noindexați fluxul dvs. pentru a împiedica Google să-l acceseze; dacă aveți un plugin SEO pe site-ul dvs., acesta ar avea în mod normal setări pentru a noindexa rapid fluxul dvs.
Admin