Perplexity срещу ChatGPT: повече източници не значи по-точен отговор

|Автор: Редакционният екип на QUASA|6 мин. четене| 1
Perplexity срещу ChatGPT: повече източници не значи по-точен отговор

Perplexity е по-полезен, когато търсите широк набор от страници за уеб проучване: в измерено сравнение цитира повече източници от ChatGPT. Това обаче не установява кой дава по-точни отговори. За проверим резултат има значение дали връзката води към конкретната страница и дали тя подкрепя твърдението, до което е поставена.

ChatGPT може да търси в мрежата и да показва цитати, а Perplexity поставя източниците в центъра на отговора. Ако избирате между тях за работа на български, разграничете три въпроса: потърсена ли е актуална информация, открива ли се първичният документ и съвпадат ли неговите дата, обхват и условия с написаното от асистента. Повече връзки дават повече възможности за проверка, но не заместват самата проверка.

Кога търсят и как показват страниците

Инструкцията на OpenAI за ChatGPT Search посочва, че ChatGPT може да започне уеб търсене автоматично при въпрос, който се нуждае от актуална информация, или след ръчен избор на Search. Отговорите с уеб търсене могат да съдържат цитати, които се отварят към страниците; изгледът Sources, когато е наличен, показва и други подходящи връзки. OpenAI предупреждава, че резултатите и цитатите могат да са непълни, остарели или неточни. При въпрос за действащо правило ръчният избор на Search прави намерението за търсене ясно, но отново не удостоверява получения отговор.

Описанието на Perplexity Pro Search посочва множество уеб търсения и директни връзки към първоначалните източници в отговорите. Услугата може да събира сведения от публикации, научни материали, форуми и видео според избраната област на търсене. Това улеснява проучване с няколко части, при което са нужни различни отправни страници. Самата Perplexity препоръчва сведенията да се сверяват чрез свързаните източници. Pro Search е конкретна функция на потребителския продукт; измерването по-долу използва API конфигурация и не бива да се чете като пряк тест на този интерфейс.

Какво измерва разликата в цитатите

В измерването на Prefer от септември 2026 г. четири услуги получават по 80 въпроса, повторени три пъти, или общо 960 API отговора; Perplexity търси в мрежата при всичките си 240 отговора, а ChatGPT при 216, като средно цитират съответно 19,48 и 3,05 уникални URL адреса на отговор. Уеб търсене е поискано при всяко извикване, но услугите сами решават дали да го използват. Средните стойности включват и отговорите без цитирани страници. Така числата описват честота на търсене и видими препратки при тези настройки, а не дял на верните твърдения.

Повторенията на един и същ въпрос споделят средно 96% от цитираните сайтове при Perplexity срещу 37% при ChatGPT. Това е припокриване между повторни отговори на една услуга, не процент на съвпадение между двете услуги. Между всички разгледани асистенти голяма част от сайтовете се появяват само при един, но най-често цитираните сайтове по-често се споделят. Следователно „различни източници“ може да означава различен подбор на редки сайтове, без непременно да означава различна основа за всеки важен факт.

Въпросите в измерването са за AI търсене и свързани маркетингови теми, а заявките са изпратени през API в кратък период. Използваните конфигурации са sonar-pro за Perplexity и gpt-5.6-luna за ChatGPT; резултатът в потребителските приложения може да се различава. Тестът не оценява дали отговорите са верни и не включва задачи за български институции или местни услуги. Затова разликата в броя цитати е добра отправна точка за сравнение на поведението при търсене, но не е класация по точност за България.

Защо работещата връзка може да не доказва изречението

Цитатът установява път към страница, а не логическа връзка между нейното съдържание и всяка част от отговора. Страницата може да е за предишна редакция на правило, за друга държава или за близък, но различен продукт. Може да потвърждава основното число, но да пропуска условието, при което то важи. При български административен въпрос разликата между предложение за промяна и действащ текст е по-важна от дължината на списъка с линкове.

Изследване в ACL Anthology разглежда отделно достоверността на намерените сайтове и доколко отговорите се основават на цитираните страници. В разгледаните задачи Perplexity има най-висока оценка за достоверност на източниците, но задачите и показателят са различни от броенето на цитати в измерването на Prefer. Дори авторитетна страница трябва да съдържа точното твърдение в правилния му контекст; репутацията на сайта сама по себе си не запълва липсващо условие или дата.

Сравнение с еднакви задачи на български

За собствен избор подгответе няколко въпроса, които приличат на действителната ви работа: действащо изискване на институция, условия на услуга с различни тарифи и местна информация, която се променя. Това са примерни задачи, а не резултати от проведен тест. Задайте еднаква формулировка на български и на двете услуги, уточнете мястото и периода и поискайте връзка до всяко съществено твърдение. Ако искате да сравните отговори след изрично уеб търсене, включете Search ръчно в ChatGPT и запишете използвания режим в Perplexity.

  1. Отбележете дали има данни за извършено уеб търсене и дали всяка препратка отваря конкретна страница, вместо начална страница или общ списък с резултати. Липсата на цитат оставя съответното твърдение без видим път за проверка.
  2. Разделете отговора на отделни проверими твърдения: например кой има право на услуга, от кога важи условието, каква е сумата и има ли изключение. За всяко отворете поставената до него връзка и потърсете същото условие в първоначалния контекст.
  3. Запишете дали страницата подкрепя твърдението изцяло, само частично или изобщо не го подкрепя. При правило или срок проверете органа, територията, датата на публикацията и дали текстът е действащ; при цена проверете към кой план и период се отнася.
  4. Повторете въпросите в нов разговор и вижте дали се сменят страниците или изводът. Разликата между повторенията е полезна за оценка на устойчивостта, а съвпадението на линковете все още изисква проверка на съдържанието им.

Така сравнявате покритието на въпроса, директността на връзките и подкрепата за твърденията поотделно. Един кратък отговор с точен линк към действащ институционален документ може да е по-полезен от подробен отговор с много вторични публикации. За проучване на различни гледни точки по-широкият подбор на Perplexity може да спести време при намирането на материали, ако ключовите изводи издържат проверка в тях.

Кой избор следва от сравнението

Perplexity има предимство като отправна точка за събиране на повече възможни източници; ChatGPT дава възможност изрично да включите търсене и в измерения набор е представял по-сбит списък. Нито едно от тези свойства не решава предварително кой ще отговори вярно на конкретен български въпрос. Когато решение зависи от точна формулировка, дата или условие, предпочетете отговора, чиито съществени твърдения могат да се намерят в отворените страници и се отнасят до търсения случай.

Споделяне:

Абонирайте се за нашия бюлетин

Получавайте най-новите новини за Web3, AI и криптовалути директно във входящата си поща.

0