# searchit — ценова листа на моделите

> Вашата цена на токен за езиковите модели, които searchit предлага за AI извличане и AI Agent, за вграждането и за анализа на изображения — извън и в рамките на ЕС.

## Вижте всяка цена на модел.

Тази листа показва вашата цена на токен за езиковите модели, които предлагаме със searchit — за AI извличането и за AI Agent —, за вграждането при семантичното търсене и за анализа на изображения.

Към 25 септември 2026 г.

## Езикови модели

Подбор: езикови модели, които са особено подходящи за AI извличане — т.е. за получаване на резюме, обекти и връзки от Вашите документи. За всеки модел цената на токен при обработка извън и в рамките на ЕС, подредени по резултата от нашето собствено измерване на извличането. Тире означава: на това място не предлагаме модела.

**Цени за 1 млн. токена, в евро без ДДС**

| Модел | Извличане | Собствен хостинг | В ЕС: Вход | В ЕС: От кеша | В ЕС: Изход | Извън ЕС: Вход | Извън ЕС: От кеша | Извън ЕС: Изход |
|---|---:|---|---:|---:|---:|---:|---:|---:|
| GPT-6 astra (OpenAI, от САЩ) | 7,7 | не | — | — | — | 10,51 € | 1,05 € | 52,54 € |
| DeepSeek V4.1 Flash (DeepSeek, от Китай) | 6,8 | не | — | — | — | 0,3152 € | 0,0063 € | 1,26 € |
| DeepSeek V4 Pro (DeepSeek, от Китай) | 6,4 | да | 1,84 € | — | 3,68 € | 1,00 € | — | 2,01 € |
| Mistral Medium 3.5 (Mistral AI, от Франция) | 6,1 | да | 1,80 € | — | 7,20 € | 1,50 € | 0,1500 € | 7,68 € |
| Kimi K2.6 (Moonshot AI, от Китай) | 6,0 | да | 0,7920 € | 0,2640 € | 4,50 € | 0,7200 € | — | 3,60 € |
| Qwen3.5-27B (Alibaba Cloud, от Китай) | 5,5 | да | — | — | — | 0,2049 € | — | 1,64 € |
| GLM-5 (Z.ai, от Китай) | 4,9 | да | 1,14 € | — | 3,48 € | 0,6305 € | — | 2,02 € |
| Mistral Large 2.1 (Mistral AI, от Франция) | 4,6 | да | — | — | — | 2,10 € | — | 6,30 € |
| Qwen3.5-397B-A17B (Alibaba Cloud, от Китай) | 4,5 | да | 0,6050 € | — | 3,63 € | 0,5779 € | — | 3,68 € |
| Gemma 4 31B (Google, от САЩ) | 4,3 | да | 0,2400 € | — | 0,4200 € | 0,0946 € | — | 0,3573 € |
| Qwen3.7-Plus (Alibaba Cloud, от Китай) | 3,3 | не | — | — | — | 0,4203 € | 0,0420 € | 1,68 € |
| Qwen3.6-35B-A3B (Alibaba Cloud, от Китай) | 3,3 | да | 0,1800 € | — | 0,6000 € | 0,1576 € | — | 1,05 € |
| Qwen3.5-9B (Alibaba Cloud, от Китай) | 2,9 | да | 0,1008 € | — | 0,1513 € | 0,1051 € | — | 0,1576 € |

- Извличане: оценка за качество от 0 до 10 от нашето собствено измерване — средният дял на попаденията за разпознати обекти и връзки спрямо независимо изготвен еталон, разделен на десет. Служи за сравнение на моделите помежду им. Измерено през 2026 г. върху осем примерни документа — важи за тези документи, не за всяка съвкупност от данни.
- Собствен хостинг: теглата на модела са свободно достъпни; моделът може да работи и на собствен хардуер.
- В ЕС: предлагаме модел там само чрез доставчици, които обработват Вашите данни в ЕС и нито съхраняват Вашите входни и изходни данни, нито ги използват за обучение — документирано в техните условия. Където това не е документирано, стои тире.

**Профил на представяне по модели**

| Модел | Разпознати обекти | Разпознати връзки | Контекстен прозорец | Размер на модела |
|---|---:|---:|---|---|
| GPT-6 astra | 8,1 | 7,4 | не е публикуван | не е публикуван |
| DeepSeek V4.1 Flash | 7,7 | 5,9 | 1 000 000 токена | 763,2 млрд., от тях 16 млрд. активни |
| DeepSeek V4 Pro | 7,5 | 5,2 | 1 048 576 токена | 1,6 трлн., от тях 49 млрд. активни |
| Mistral Medium 3.5 | 7,0 | 5,3 | 262 144 токена | 127,7 млрд. |
| Kimi K2.6 | 7,5 | 4,5 | 262 144 токена | 1 трлн., от тях 32 млрд. активни |
| Qwen3.5-27B | 6,7 | 4,3 | 262 144 токена | 27,8 млрд. |
| GLM-5 | 6,0 | 3,8 | 204 800 токена | 753,9 млрд., от тях 40 млрд. активни |
| Mistral Large 2.1 | 6,1 | 3,1 | 131 072 токена | 123 млрд. |
| Qwen3.5-397B-A17B | 6,0 | 3,0 | 262 144 токена | 403,4 млрд., от тях 17 млрд. активни |
| Gemma 4 31B | 5,5 | 3,1 | 262 144 токена | 31 млрд. |
| Qwen3.7-Plus | 4,3 | 2,3 | 1 000 000 токена | 397 млрд., от тях 17 млрд. активни |
| Qwen3.6-35B-A3B | 4,7 | 1,8 | 262 144 токена | 36 млрд., от тях 3 млрд. активни |
| Qwen3.5-9B | 4,7 | 1,1 | 262 144 токена | 9,7 млрд. |

- Оценка за качество от 0 до 10 за всяка подзадача, от нашето собствено измерване на извличането през 2026 г. върху осем примерни документа.
- Профил на представяне: контекстният прозорец показва колко токена моделът обработва наведнъж; размерът на модела е броят на параметрите му — при модели, които за всеки токен изчисляват само част от тях, след него стои активната част.

## Вграждане

За семантичното търсене всеки текстов раздел се превръща веднъж във вектор; таксува се само входът. Кой модел използва вашият индекс, определяме при настройката — смяна означава индексът да се изгради наново. Отгоре са двата стандартни модела, под тях всички останали по производител.

**Цени на вграждането за 1 млн. входни токена, в евро без ДДС**

| Модел | Търсене на немски | Собствен хостинг | В ЕС | Извън ЕС |
|---|---:|---|---:|---:|
| Qwen3 Embedding 8B (Alibaba Cloud, от Китай) — стандарт извън ЕС | 0,80 | да | 0,0105 € | 0,0105 € |
| BGE-M3 (BAAI, от Китай) — стандарт в ЕС | 0,69 | да | 0,0120 € | 0,0105 € |
| Qwen Text Embedding v4 (Alibaba Cloud, от Китай) | — | не | — | 0,0736 € |
| Qwen3-VL Embedding 8B (Alibaba Cloud, от Китай) | — | да | 0,0960 € | — |
| Amazon Titan Text Embeddings V2 (Amazon, от САЩ) | — | не | 0,2102 € | 0,0210 € |
| BGE Multilingual Gemma2 (BAAI, от Китай) | — | да | 0,0120 € | — |
| Cohere Embed 4 (Cohere, от Канада) | 0,81 | не | — | 0,1261 € |
| Gemini Embedding 2 (Google, от САЩ) | — | не | — | 0,2102 € |
| E5-Mistral-7B (Microsoft, от САЩ) | 0,72 | да | 0,0240 € | — |
| Codestral Embed (Mistral AI, от Франция) | — | не | — | 0,1800 € |
| Mistral Embed (Mistral AI, от Франция) | — | не | — | 0,1200 € |
| text-embedding-3-large (OpenAI, от САЩ) | 0,75 | не | — | 0,1366 € |
| text-embedding-3-small (OpenAI, от САЩ) | 0,71 | не | — | 0,0210 € |
| Voyage 4 (Voyage AI, от САЩ) | 0,83 | не | — | 0,0630 € |
| Voyage 4 large (Voyage AI, от САЩ) | 0,84 | не | — | 0,1261 € |
| Voyage 4 lite (Voyage AI, от САЩ) | 0,80 | не | — | 0,0210 € |

- Търсене на немски: средна стойност от четирите немски задачи за търсене на публичния бенчмарк MTEB (nDCG@10, от 0 до 1) — колкото по-висока, толкова по-добре моделът намира текстовите раздели, отговарящи на даден въпрос. Служи за сравнение на моделите помежду им, не като обещание за Вашите данни. Тире: за модела няма публикувана стойност.
- Стандарт извън ЕС / стандарт в ЕС: използваме този модел, ако не изберете друг — без или с изцяло европейска експлоатация.
- В ЕС: предлагаме модел там само чрез доставчици, които обработват Вашите данни в ЕС и нито съхраняват Вашите входни и изходни данни, нито ги използват за обучение — документирано в техните условия. Където това не е документирано, стои тире.

**Профил на представяне по модели**

| Модел | Общи текстове | Здравеопазване | Право | Правни въпроси | Дължина на вектора | Контекстен прозорец | Размер на модела |
|---|---:|---:|---:|---:|---:|---|---|
| Qwen3 Embedding 8B | 0,97 | 0,88 | 0,70 | 0,67 | 4096 | 32 768 токена | 7,6 млрд. |
| BGE-M3 | 0,92 | 0,72 | 0,61 | 0,50 | 1024 | 8192 токена | 568 млн. |
| Qwen Text Embedding v4 | — | — | — | — | 1024 | 8192 токена | не е публикуван |
| Qwen3-VL Embedding 8B | — | — | — | — | 4096 | 32 768 токена | не е публикуван |
| Amazon Titan Text Embeddings V2 | — | — | — | — | 1024 | 8192 токена | не е публикуван |
| BGE Multilingual Gemma2 | — | — | — | — | 3584 | 8192 токена | 9,2 млрд. |
| Cohere Embed 4 | 0,95 | 0,85 | 0,73 | 0,72 | 1536 | 128 000 токена | не е публикуван |
| Gemini Embedding 2 | — | — | — | — | 3072 | 8192 токена | не е публикуван |
| E5-Mistral-7B | 0,97 | 0,79 | 0,69 | 0,44 | 4096 | 4096 токена | 7,1 млрд. |
| Codestral Embed | — | — | — | — | 1536 | 8192 токена | не е публикуван |
| Mistral Embed | — | — | — | — | 1024 | 8192 токена | не е публикуван |
| text-embedding-3-large | 0,98 | 0,81 | 0,67 | 0,56 | 3072 | 8192 токена | не е публикуван |
| text-embedding-3-small | 0,96 | 0,70 | 0,62 | 0,55 | 1536 | 8192 токена | не е публикуван |
| Voyage 4 | 0,98 | 0,88 | 0,75 | 0,71 | 1024 | 32 000 токена | не е публикуван |
| Voyage 4 large | 0,98 | 0,91 | 0,76 | 0,72 | 1024 | 32 000 токена | не е публикуван |
| Voyage 4 lite | 0,97 | 0,83 | 0,73 | 0,68 | 1024 | 32 000 токена | не е публикуван |

- Качество на търсенето за всяка немска задача от публичния бенчмарк MTEB (nDCG@10, от 0 до 1); средното им е стойността „Търсене на немски“.
- Профил на представяне: контекстният прозорец показва колко токена моделът обработва наведнъж; размерът на модела е броят на параметрите му — при модели, които за всеки токен изчисляват само част от тях, след него стои активната част.

## Модели за изображения

При анализа на изображения модел за изображения прочита всяко изображение и описва съдържанието му. За всеки модел цената на токен при обработка извън и в рамките на ЕС, подредени по публичния бенчмарк MMMU-Pro. Тире означава: на това място не предлагаме модела.

**Цени на моделите за изображения за 1 млн. токена, в евро без ДДС**

| Модел | MMMU-Pro | Собствен хостинг | В ЕС: Вход | В ЕС: Изход | Извън ЕС: Вход | Извън ЕС: Изход |
|---|---:|---|---:|---:|---:|---:|
| Kimi K2.6 (Moonshot AI, от Китай) | 79,4% | да | 0,8400 € | 4,20 € | 0,7200 € | 3,60 € |
| Qwen3.5-397B-A17B (Alibaba Cloud, от Китай) | 79,0% | да | 0,6050 € | 3,63 € | 0,4098 € | 2,46 € |
| MiniMax M3 (MiniMax, от Китай) | 78,1% | да | 0,4203 € | 2,10 € | 0,3152 € | 1,26 € |
| Gemma 4 31B (Google, от САЩ) — стандарт извън ЕС, стандарт в ЕС | 76,9% | да | 0,1200 € | 0,3600 € | 0,0946 € | 0,3573 € |
| Qwen3.6-27B (Alibaba Cloud, от Китай) | 75,8% | да | 0,5400 € | 0,7800 € | 0,3152 € | 2,10 € |
| Qwen3.6-35B-A3B (Alibaba Cloud, от Китай) | 75,3% | да | 0,3600 € | 1,44 € | 0,1051 € | 0,9457 € |
| Gemma 4 26B A4B (Google, от САЩ) | 73,8% | да | 0,1200 € | 0,6000 € | 0,0736 € | 0,3573 € |
| Qwen3.5-9B (Alibaba Cloud, от Китай) | 70,1% | да | 0,1008 € | 0,1513 € | 0,1051 € | 0,1576 € |

- MMMU-Pro: публичен бенчмарк с въпроси за изображения, диаграми и страници от документи; посочен е делът на правилно решените задачи, както е публикуван от съответния производител. Служи за сравнение на моделите помежду им, не като обещание за Вашите изображения.
- Стандарт извън ЕС / стандарт в ЕС: използваме този модел, ако не изберете друг — без или с изцяло европейска експлоатация.
- В ЕС: предлагаме модел там само чрез доставчици, които обработват Вашите данни в ЕС и нито съхраняват Вашите входни и изходни данни, нито ги използват за обучение — документирано в техните условия. Където това не е документирано, стои тире.

**Профил на представяне по модели**

| Модел | MMMU-Pro | Контекстен прозорец | Размер на модела |
|---|---:|---|---|
| Kimi K2.6 | 79,4% | 262 144 токена | 1 трлн., от тях 32 млрд. активни |
| Qwen3.5-397B-A17B | 79,0% | 262 144 токена | 403,4 млрд., от тях 17 млрд. активни |
| MiniMax M3 | 78,1% | 1 048 576 токена | 427 млрд., от тях 23 млрд. активни |
| Gemma 4 31B | 76,9% | 262 144 токена | 31,3 млрд. |
| Qwen3.6-27B | 75,8% | 262 144 токена | 27,8 млрд. |
| Qwen3.6-35B-A3B | 75,3% | 262 144 токена | 36 млрд., от тях 3 млрд. активни |
| Gemma 4 26B A4B | 73,8% | 262 144 токена | 25,8 млрд., от тях 4 млрд. активни |
| Qwen3.5-9B | 70,1% | 262 144 токена | 9,7 млрд. |

- Дял на правилно решените задачи в публичния бенчмарк MMMU-Pro, както е публикуван от производителя.
- Профил на представяне: контекстният прозорец показва колко токена моделът обработва наведнъж; размерът на модела е броят на параметрите му — при модели, които за всеки токен изчисляват само част от тях, след него стои активната част.

Всички цени са в евро без ДДС.
