Hoppa till huvudinnehåll

FreeAI::Alice - Scraper för AI:n Alice

Alice

Översikt över scrapern​

Scrapern Alice hämtar svar från AI:n Alice från webbplatsen alice.yandex.ru samt en lista över källor som den baseras på. Resultatet inkluderar svarstexten och källkort: adress, rubrik och beskrivning.

Frågor skrivs på vanligt språk, precis som ett meddelande i Alice-chatten. Ingen registrering krävs: scrapern öppnar själv startsidan och hämtar sessions-ID därifrån.

Om ett färdigt svar inte har kommit inom 2 minuter upprepas förfrågan. Antalet försök bestäms av den allmänna inställningen Proxy retries.

Resultaten kan sparas i önskat format via mallhanteraren Template Toolkit: text, CSV eller JSON.

Data som samlas in​

  • Svarstext
  • Länkar, rubriker och beskrivningar av källor

Funktioner​

  • Frågor på naturligt språk
  • Avancerat svarsläge
  • Insamling av källor separat från svarstexten

Användningsfall​

  • Insamling av svar på tematiska frågor för kunskapsbaser, innehållsplaner och FAQ
  • Extrahering av länkar till källor med rubriker och beskrivningar
  • Övervakning av ämnen med koppling till de sidor som Alice refererar till
  • Snabb kontroll av vilka webbplatser Alice anser vara källor för en viss fråga

Frågor​

Som frågor anges text precis som om den skrivits i Alice-chatten, till exempel:

Dollarkurs mot rubeln idag
Kan du ge länkar till nya filmer 2026 vilka filmer som helst
Vad är en scraper?

Resultat​

Som standard visas frågan och svaret:

$query
$answer

Exempel:

Kan du ge länkar till nya filmer 2026 vilka filmer som helst
Självklart! Här är några intressanta filmer som förväntas under 2026:

1. **Josephine (Josephine)** - drama, USA
2. **Wild Horse (Wild Horse)** - drama, Storbritannien
3. **Spider-Man: Brand New Day (Spider-Man: Brand New Day)** - action, USA
...

Källor ingår inte i denna text. De finns i arrayen $p1.sources.

Exempel på resultatutmatning​

Svar och källor​

Resultatformat:

ANSWER:
$p1.answer

SOURCES:
$p1.sources.format('Type:$type \n Link: $link \n $anchor \n Snippet:$snippet\n')

Exempel på resultat:

ANSWER:
Självklart! Här är några intressanta filmer som förväntas under 2026:
...

SOURCES:
Type:source
Link: https://www.film.ru/a-z/movies/2026
Bästa filmerna 2026
Snippet:Vi har samlat 2026 års filmer åt dig baserat på betyg från skribenterna på Film.ru
Type:source
Link: https://www.afisha.ru/movie/y2026/
Filmer och serier 2026 - Afisha-Kino
Snippet:Filmer och serier 2026: välj film efter genre eller betyg...

Export av länklista​

Resultatformat:

$p1.sources.format('$link\n')

Exempel på resultat:

https://www.film.ru/a-z/movies/2026
https://www.afisha.ru/movie/y2026/
https://www.kinoafisha.info/releases/2026/
https://ru.wikipedia.org/wiki/Категория:Фильмы_2026_года

Utmatning till CSV av länkar, rubriker och beskrivningar​

Resultatformat:

[% FOREACH item IN p1.sources;
tools.CSVline(loop.count, item.link, item.anchor, item.snippet);
END %]

Exempel på resultat:

1,https://www.film.ru/a-z/movies/2026,"Bästa filmerna 2026","Vi har samlat 2026 års filmer åt dig baserat på betyg från skribenterna på Film.ru"
2,https://www.afisha.ru/movie/y2026/,"Filmer och serier 2026 - Afisha-Kino","Filmer och serier 2026: välj film efter genre eller betyg"

Ange filändelsen csv i filnamnet för resultaten.

En enskild fråga väntar på svar i högst 2 minuter. Ställ in en marginal i uppgiftens timeout som är större än 2 minuter multiplicerat med antalet försök.