Ce știe un model despre o marcă nouă
Dacia și Toyota au în spatele lor decenii de text scris în românește. OMODA, JAECOO și XPENG au ajuns aici acum câțiva ani. Instrumentul de mai jos măsoară exact ce înseamnă diferența asta pentru un model de limbaj — și de ce o marcă poate exista pe piață fără să existe în răspunsurile AI.
Ce vezi
117 termeni din piața auto românească, transformați în vectori de un model real de embeddings: 22 de mărci, 18 modele concrete, 11 dealeri, atributele și segmentele după care se cumpără o mașină, sursele pe care le citează asistenții AI și 16 întrebări reale de cumpărători.
De unde vin întrebările
Nu sunt inventate. Sunt formulările urmărite săptămânal, din august 2026, pe ChatGPT, Gemini, Perplexity, AI Mode și AI Overviews, pentru piața românească. Le-am pus în corpus exact așa cum sunt executate, cu greșelile de tastare cu tot.
Ce nu măsurăm
Nu măsurăm cât de bună e o mașină. Distanța dintre o marcă și o întrebare spune cât de probabil e ca modelul să o aibă în zona din care compune răspunsul — nu dacă merită cumpărată. Un produs excelent despre care nu s-a scris stă departe; unul mediocru despre care s-a scris mult stă aproape.
Aceleași cifre, în afara graficului
Tot ce se poate face cu mouse-ul mai sus există și aici, scris. Un asistent AI care citește pagina nu vede canvasul — vede tabelele.
Cei mai apropiați zece termeni de OMODA, luată singură. Aproape toți sunt propriile modele: marca e legată de ea însăși, nu de nevoile pieței.
| Poziție | Termen | Strat | Similaritate cosinus |
|---|---|---|---|
| 01 | OMODA 5 | Model | 0,968 |
| 02 | OMODA 9 | Model | 0,967 |
| 03 | OMODA 7 | Model | 0,958 |
| 04 | Opel | Eurial | 0,874 |
| 05 | OLX | Sursă | 0,873 |
| 06 | BYD | Concurent | 0,870 |
| 07 | Opel Mokka | Model | 0,861 |
| 08 | Cupra | Concurent | 0,859 |
| 09 | Mazda | Concurent | 0,858 |
| 10 | Škoda | Concurent | 0,855 |
Aceiași vecini, pentru Dacia. Diferența nu e de calitate a mașinilor, ci de câte tipuri de text există despre fiecare — segmente, situații de folosire, comparații.
| Poziție | Termen | Strat | Similaritate cosinus |
|---|---|---|---|
| 01 | Dacia Duster | Model | 0,929 |
| 02 | Dacia Bigster | Model | 0,927 |
| 03 | Renault | Concurent | 0,889 |
| 04 | DAGECO Automotive | Dealer | 0,881 |
| 05 | DS Automobiles | Eurial | 0,870 |
| 06 | Automarket.ro | Sursă | 0,870 |
| 07 | Nissan | Concurent | 0,869 |
| 08 | Škoda | Concurent | 0,867 |
| 09 | Autovit.ro | Sursă | 0,867 |
| 10 | Citroën | Eurial | 0,866 |
Mărci și modele ordonate după distanța până la întrebarea „Ce dealer de mașini chinezești recomanzi?”, una dintre cele urmărite săptămânal. Nu e un clasament de calitate, ci de eligibilitate: cine stă în zona din care un model compune răspunsul.
| Poziție | Termen | Strat | Similaritate cosinus |
|---|---|---|---|
| 01 | XPENG G6 | Model | 0,784 |
| 02 | XPENG P7+ | Model | 0,783 |
| 03 | Dacia Duster | Model | 0,783 |
| 04 | Dacia Bigster | Model | 0,782 |
| 05 | XPENG G9 | Model | 0,777 |
| 06 | Opel Mokka | Model | 0,773 |
| 07 | Toyota RAV4 | Model | 0,769 |
| 08 | Peugeot 3008 | Model | 0,766 |
| 09 | Škoda Kodiaq | Model | 0,763 |
| 10 | Volkswagen Tiguan | Model | 0,761 |
| 11 | Citroën C3 Aircross | Model | 0,758 |
| 12 | Hyundai Tucson | Model | 0,757 |
De ce toate numerele sunt mari
6.786 de perechi · 90% între 0,749 și 0,865
Modelele moderne de embeddings nu împrăștie textele pe tot spațiul: le concentrează într-un con îngust. Rezultatul e că absolut orice pereche de termeni pare, în cifre, destul de apropiată.
Un cosinus izolat nu se poate citi. Singura citire validă este ordinea: cine e mai aproape decât cine, pentru aceeași întrebare. De aceea tabelele de mai sus sunt clasamente, nu note.
Consecința practică, pentru oricine face AEO cu instrumente care raportează similarități: un prag absolut de tipul „peste 0,8 înseamnă relevant” nu are niciun temei. Pragul se calibrează pe distribuția corpusului propriu, altfel măsori zgomot.
- Termeni măsurați
- 117
- Dimensiuni ale vectorilor
- 3072
- Informație reținută de cele 3 axe
- 20,3%
- Model folosit
- gemini-embedding-001
Websem vinde servicii de optimizare pentru motoarele AI, iar printre mărcile din acest corpus se află unele ale unui client: Eurial Invest, pentru care Websem a construit site-ul eurialselection.ro. Am ales să publicăm măsurătoarea în forma în care a ieșit, inclusiv rândurile nefavorabile clientului. Nicio poziție din acest instrument nu poate fi cumpărată, îmbunătățită sau ștearsă contra cost. Corpusul, metoda și scriptul care generează datele sunt descrise integral mai jos, ca rezultatele să poată fi refăcute de oricine, împotriva noastră dacă e cazul.
- 01
Corpus din piața reală
117 termeni: mărcile prezente în România, modele concrete, dealeri, atribute tehnice, segmente comerciale, servicii de dealer și sursele pe care le citează asistenții AI. Plus șase termeni fără nicio legătură, ca martori ai distribuției.
- 02
Întrebări măsurate, nu presupuse
Cele 16 întrebări de cumpărători sunt prompturi reale, executate săptămânal pe cinci motoare AI pentru piața românească. Sunt preluate ca atare, fără rescriere — inclusiv formulările imperfecte, fiindcă așa scriu oamenii.
- 03
Vecinătăți în spațiul complet
Similaritatea cosinus se calculează pe vectorii întregi, de 3072 de dimensiuni, înainte de orice reducere. Lista din dreapta e măsurată acolo, motiv pentru care uneori contrazice ce pare evident în imagine.
- 04
Proiecție prin PCA
Abia la final spațiul e rotit astfel încât primele trei direcții după varianță să devină axele vizibile. Procentul de informație reținut e afișat permanent în instrument.
Limitele, spuse înainte să le găsești tu
- Un model de embeddings nu este un LLM. Un răspuns real trece și prin căutare pe web, prin re-ranking și prin instrucțiuni de sistem. Aici se măsoară geometria înțelesului, care e doar prima parte.
- Pentru mărcile rare, o parte din poziție vine din forma numelui, nu din înțeles. Verificat cu nume inventate: „DAGOCO”, care nu există, iese la 0,888 față de JAECOO, mai sus decât un dealer real cu nume de formă diferită. Orice apropiere între două nume rare trebuie tratată ca posibil artefact ortografic.
- Cosinusul nu se citește ca un procent. Toate perechile din acest corpus stau într-o bandă îngustă, afișată în instrument. Contează ordinea, nu diferența dintre două zecimale.
- Corpusul e o felie, nu piața. 117 termeni aleși de noi arată un mecanism; nu măsoară cota de piață și nu evaluează niciun produs.
- Distanța nu e preferință. Că o marcă stă aproape de o întrebare nu garantează că va fi recomandată — arată că e eligibilă să fie.
De la geometrie la treabă
O marcă nouă nu are un deficit de calitate, are un deficit de text. Distanța dintre ea și întrebările cumpărătorilor se măsoară, se urmărește în timp și se schimbă prin ce se publică și prin cine te citează. Ăsta e, în esență, tot ce facem în AEO: mutăm un punct mai aproape de o întrebare.
Ready to build something together?
A 30-minute call. We clearly explain what we'd build for you and what it costs. No pitch, no slides.