ATVĒRTA INICIATĪVA LATVIEŠU VALODAI

Labs rezultāts. Par kādu cenu?

Atrodi savam budžetam piemērotu LLM. Salīdzini rezultātu, USD par jautājumu, tokenu patēriņu un izmaksas par precīzu atbildi.

Fokusā latviešu valoda Veidots izstrādātājiem Pārskatāma novērtēšana

Izmaksas un rezultāti

Multi QA LV · salīdzini lasītprasmi un cenu par jautājumu.

Ko salīdzināt?

Salīdzina modeļa atbildes vārdus ar benchmarka atbildi visos 500 jautājumos. Daļēja sakritība dod daļēju vērtējumu; izlaisti vai lieki vārdi to samazina. Piemēram, “Rīga ir galvaspilsēta” pret “Rīga” nav pilna sakritība. F1 ir vidējais vārdu pārklājuma vērtējums 0–100, nevis pareizo atbilžu procents.

Nodrošinātāji · vari atlasīt vairākus
Modeļa pieejamība
Izmaksu mērogs
18 no 18 novērtētām izpildēm · 7 ar salīdzināmu cenu
Kārtot pēc

Aprēķināts pēc saglabātā tokenu patēriņa un standarta maksas tarifiem USD. Tarifu bāzes datums: 2026-10-10; atsevišķu modeļu pārbaudes datumi norādīti izpildes detaļās. Šī ir aplēse; atkārtoti pieprasījumi, nodokļi, kredīti, bezmaksas kvotas un konta atlaides nav iekļautas. Pārskatītā pareizība izmanto vienādu jautājumu apakškopu visiem modeļiem; neskaidrie jautājumi ir izslēgti. Izmaksas aptver visas 500 atbildes. USD par precīzu atbildi joprojām izmanto sākotnējo precīzo sakritību skaitu; tokenu F1 nav pareizo atbilžu procents.

Zemākā cena atlasē
0,000206 $
gpt-6-luna · par jautājumu
Labākais rezultāts
81,6
gpt-6.1-sol · 0,003508 $
Saglabātais tokenu patēriņš
13 275 140
18 izpildes · 7 salīdzināmas grafikā

Rezultāts pret izmaksām

Augstāk un pa kreisi — labāks rezultāts ar mazākām izmaksām. Izvēlies punktu, lai skatītu izpildi.

Lasītprasme · tokenu F1 · 0–10002550751000,0000 $0,002795 $0,00559 $0,008386 $0,011181 $Izmaksas par jautājumu · USDgpt-6-luna · 70,4 · 0,000206 $claude-haiku-5-5 · 71,5 · 0,000241 $gpt-5.6-luna · 72 · 0,000357 $gpt-6.1-sol · 81,6 · 0,003508 $claude-sonnet-5-5 · 54,2 · 0,00461 $gpt-5.6-sol · 79,9 · 0,006861 $claude-opus-5-5 · 77,3 · 0,009983 $
OpenAIClaude

Katrs punkts ir viena modeļa izpilde. Tabulā pieejami arī punkti, kas pārklājas.

Multi QA LV · augoši pēc izvēlētās cenas
Modelis / izpildeRezultātsAtbildesKopā · USDPar jautājumuPar precīzu atbildiTokeni
70,4500/5000,103239 $0,000206 $0,000524 $722 087500/500 atbildēm
71,5500/5000,120529 $0,000241 $0,00052 $1 047 318500/500 atbildēm
72500/5000,178297 $0,000357 $0,000825 $690 526500/500 atbildēm
81,6500/5001,754039 $0,003508 $0,005622 $691 012500/500 atbildēm
54,2500/5002,305108 $0,00461 $0,025612 $1 036 770500/500 atbildēm
79,9500/5003,430537 $0,006861 $0,011829 $687 135500/500 atbildēm
77,3500/5004,991436 $0,009983 $0,017763 $1 055 831500/500 atbildēm
76,3500/500—Cena nav pieejama——1 044 441500/500 atbildēm
85,2500/500—Cena nav pieejama——1 013 347500/500 atbildēm
51,6500/500—Cena nav pieejama——734 394500/500 atbildēm
59,7500/500—Cena nav pieejama——731 580500/500 atbildēm
40,5500/500—Cena nav pieejama——743 094500/500 atbildēm
66,6500/500—Cena nav pieejama——734 119500/500 atbildēm
57,2500/500—Cena nav pieejama——685 772500/500 atbildēm
68,5500/500—Trūkst tokenu datu——00/500 atbildēm
78,1500/500—Trūkst tokenu datu——766 350459/500 atbildēm
58500/500—Cena nav pieejama——891 364500/500 atbildēm
75500/500—Trūkst tokenu datu——00/500 atbildēm

Salīdzinājumā iekļautas izpildes ar pilnu vērtējumu; nepilnas izpildes ir izslēgtas. Trūkstoša cena netiek aizstāta ar nulli. USD par precīzu sakritību = pilnas izpildes izmaksas / precīzo benchmarka sakritību skaits. F1 un kopējais vērtējums netiek izmantots kā pareizo atbilžu procents.