Google tocmai a rescris regulile despre crawl budget. Iată ce înseamnă pentru tine.
Pe 22 iulie 2026, Google a actualizat documentația oficială despre crawl budget↗ — pagina care explică cât de des și cât de mult îți explorează Google site-ul. Documentul poartă acum eticheta „Last updated 2026-07-22 UTC" și a fost mutat într-o secțiune nouă, „Crawling infrastructure". Vechea adresă (.../search/docs/crawling-indexing/large-sites/crawl-budget-management) dă acum 404 — deci, dacă aveai un link salvat, actualizează-l.
Nu e o schimbare cosmetică. Google a clarificat trei lucruri care schimbă felul în care ar trebui să-ți gândești site-ul. Le explicăm pe limba omului, fără jargon.
Ce e, de fapt, crawl budget-ul?
Gândește-te la Googlebot (robotul care citește internetul) ca la un curier cu ore limitate în fiecare zi. Nu poate vizita la nesfârșit toate paginile de pe toate site-urile — are resurse finite. „Crawl budget" (bugetul de crawl) e, simplu spus, câtă atenție îți alocă Google: câte pagini vine să citească și cât de des.
Doi factori decid bugetul:
- Cât suportă serverul tău (crawl capacity limit): dacă serverul e rapid și nu se plânge, Google explorează mai mult; dacă e lent sau dă erori, Google încetinește ca să nu-l dărâme.
- Cât e „cerut" conținutul tău (crawl demand): paginile populare și cele care se schimbă des sunt cerute mai des.
Cine trebuie să-și facă griji (și cine nu)
Vestea bună pentru majoritatea: dacă ai un site mic sau mediu — sub câteva mii de pagini — crawl budget-ul nu e problema ta. Google însuși spune că site-urile mici sunt, de regulă, explorate eficient. Un cabinet, o pensiune, un magazin cu câteva sute de produse: paginile se indexează fără să te lupți cu bugetul de crawl.
Crawl budget devine o problemă reală doar pentru site-urile mari și foarte dinamice: magazine cu zeci de mii de produse, portaluri, platforme cu filtre și parametri care generează pagini la nesfârșit. Dacă ești acolo, restul articolului e pentru tine.
Clarificarea 1:Toți pornesc de la aceeași linie
Prima precizare nouă, citată exact din documentația Google:
Every site starts with the same default, conservative crawl capacity limit.
(Fiecare site pornește de la aceeași limită de capacitate de crawl, prudentă și prestabilită.)
Cu alte cuvinte: bugetul de crawl nu se cumpără. Nu există un buton „plătește ca Google să te citească mai des". Toți plecăm de la aceeași capacitate conservatoare, iar de acolo o câștigi — pe măsură ce serverul dovedește că e rapid și stabil, iar conținutul dovedește că merită cerut. E măsurat, nu promis: Google observă cum se comportă site-ul tău, apoi ajustează.
Clarificarea 2:Boții AI împart aceeași farfurie cu Googlebot
A doua precizare e cea mai importantă pentru 2026, fiindcă leagă crawl budget-ul de era AI:
While each crawler has a different crawl demand, the crawl capacity limit is shared across all crawlers. This means that high demand from one crawler can reduce the capacity available for others.
(Deși fiecare robot are o cerere de crawl diferită, limita de capacitate e împărțită între toți roboții. Asta înseamnă că o cerere mare din partea unui robot poate reduce capacitatea disponibilă pentru ceilalți.)
Pe românește: Google nu mai are un singur robot. Are Googlebot clasic (pentru Căutare) și roboți precum Google-Extended (pentru produsele lui AI). Toți împart aceeași capacitate a serverului tău. Dacă un robot îți solicită intens serverul, mai puțină capacitate rămâne pentru ceilalți — inclusiv pentru cel care contează la indexarea în Căutare.
De aici, o decizie devine strategică: dacă vrei să stabilești ce roboți AI au voie pe site, o faci din robots.txt (am scris separat despre roboții AI și Google-Extended). Dar atenție — a limita un robot nu îți garantează că bugetul „economisit" trece automat la altul; decizia se ia în cunoștință de cauză, nu din reflex.
Clarificarea 3:Codul 304, prietenul nebăgat în seamă
A treia precizare e cea mai concretă și cea mai ușor de aplicat:
Support 304 (Not Modified) HTTP status codes. If a page hasn't changed since Google last crawled it, returning a 304 code tells Google to reuse the cached version, saving your server bandwidth and resources.
(Susține codurile HTTP 304 „Not Modified". Dacă o pagină nu s-a schimbat de la ultima explorare, un cod 304 îi spune lui Google să refolosească versiunea din cache, economisind lățime de bandă și resurse de server.)
Ce înseamnă asta, practic: când Googlebot revine la o pagină neschimbată, serverul tău poate răspunde scurt — „nimic nou aici, folosește ce ai deja" — în loc să retrimită toată pagina. Se activează cu antetele ETag și Last-Modified. E o economie tăcută: serverul muncește mai puțin, iar Google folosește capacitatea câștigată ca să citească paginile care chiar s-au schimbat. Pe un site mare, diferența e reală.
Ce îți irosește bugetul de crawl
Dacă ești un site mare, bugetul se scurge cel mai des prin:
- Pagini duplicate — același conținut la mai multe adrese.
- Parametri în URL — filtre de tip
?culoare=rosu&marime=Mcare nasc mii de combinații aproape identice. - Soft 404 — pagini care par valide (răspund „200 OK") dar sunt, de fapt, goale sau moarte. Google le explorează degeaba.
- Lanțuri de redirecționări — A duce la B, B la C, C la D. Fiecare pas costă (vezi ghidul de redirecționări 301/302).
- JavaScript greu — pagini care obligă Google să execute mult cod ca să vadă conținutul consumă mai multe resurse per pagină.
Ce faci concret
Nu e o listă de promisiuni, e o listă de reparații măsurabile:
- Server rapid și stabil. E fundația. Un server care răspunde prompt și nu dă erori câștigă capacitate de la Google, exact cum spune clarificarea 1.
- Activează 304 / ETag. Lasă Google să refolosească ce nu s-a schimbat — cea mai directă aplicare a noii documentații.
- Sitemap curat. Doar pagini reale, de valoare, care returnează 200. Fără gunoi, fără redirecturi, fără pagini
noindexîn sitemap. - Elimină duplicatele. Canonical corect pe variații,
noindexsau blocare înrobots.txtpentru paginile de parametri inutile. - Repară lanțurile de redirect și soft 404-urile. Un singur pas, nu trei. O pagină moartă returnează 410, nu un 200 gol.
- Leagă paginile importante cu link-uri interne. Ce nu e linkat, Google consideră neimportant — iar structura internă îți dirijează bugetul acolo unde vrei (vezi internal linking și crawl budget).
Legătura cu indexarea și „Descoperită – neindexată în prezent"
Aici se închide cercul. Când bugetul de crawl e irosit pe gunoi, paginile bune rămân neexplorate — și în Search Console apar cu statusul „Descoperită – neindexată în prezent": Google știe că există, dar n-a ajuns să le citească. Nu e un bug, e o consecință a priorităților. Cureți gunoiul, câștigi capacitate, iar paginile care contează primesc crawl-ul pe care-l meritau. Am detaliat rezolvarea în ghidul despre „Descoperită – neindexată", iar diagnosticul îl urmărești din Search Console.
Noi facem exact acest audit tehnic pentru site-urile mari — măsurat, nu promis. Vezi SEO inginerit și de ce lucrăm din Cugir.
Crawl budget nu se cumpără, se câștigă: un server rapid și un site curat conving Google să te citească mai des. Restul e igienă, nu magie.
Scalează-ți Ecosistemul
Discovery call 30 min — fără cost, fără pitch. Auditul arhitecturii tale digitale și un plan operațional clar.
- 01Mesaj scurt cu contextul afacerii tale
- 02Răspuns în 24h cu o propunere de discovery call
- 03Plan operațional + recomandare de scope
FAQ.PROTOCOL
