
Pixtral 12B 24.09Atvira multimodala 12B modelis, prieinama keliame vaizdų ir tekstų su 128K konteksto langeliu.
Apžvalga
Pagrindinės funkcijos
- 12B parametru vaizdų-anglų modelis
- Viduriuje patekantis tekstas ir vaizdas
- 128K simbolių konteksto ilgumas
- Natūralus pokytis vaizdo dydžių užtvaris
- Atviro žingslio išleidimas
- Tvirtina OCR, VQA, ir nukreipinius tekstus
Kainos
- Modelis
- Free
- Kategorija
- MOL
- Įvertinimas
- 4.6 / 5 (5)
Naudojimo atvejai
Multimodala mintis
Pixtral 12B labai galinga suprastyti naturalų vaizdų ir dokumentų, atstovaujantys aukščiausių pasiekimų per MMMU minties tyrimo punktą ir virėją didesnėm modeliams
Priemonės vykdyti
Pixtral 12B labai galinga vykdyti komandas, ypač multimoda ir tekstų-only žingslyse, pasiskolint 20% tekstų IF-Eval ir MT-Bench tyrimo punktai ir kartais net atžvilgių atvirąjį šaltinį
Multimodala klausimai klausyti
Pixtral 12B rodo labai stipręs multimoda klausimų klausyti, taip pat tekstų klausimų klausyti dokumentų bei vaizdų ir grafikų supažindinimo
Privalumai ir trūkumai
Privalumai
- Atviro žingslio šalis, leidžia savo hostinti
- Šilta viršyti kelias vaizdus vienoje komandoje
- Didelis 128K konteksto langelis
- Plačiai skirta kelias vaizdų raiškos spalvų arba proporcingumai
Trūkumai
- Reikalauja svarbių GPU ištekių
- Mažesnis už prieangą uždaro modelio
- Ribota tiesiogija palyginus su savinėmis API priemonėmis
Mūšių rekordas
1 mūšyje Panteone.
Last battle
Atsiliepimai
Vidurkis iš 5 įvertinimų.
Prisijunk, kad paliktum atsiliepimą.
Does the job
Pretty happy overall. Open-weight release just works and large 128K context window. but no dealbreakers — I'd recommend it to a friend without hesitating.
Does the job
Pretty happy overall. Open-weight release just works and handles multiple images per prompt. but no dealbreakers — I'd recommend it to a friend without hesitating.
Years in this space
I've evaluated a lot of these over the years. What stands out here is interleaved image and text inputs — handled better than most — and handles multiple images per prompt. Smaller than frontier closed models is my one real gripe. Worth the time if this is your use case.
Solid for our team
We rolled this out across the team last quarter and open weights for self-hosting. Open-weight release fits neatly into how we already work, and interleaved image and text inputs removed a step we used to do by hand. Smaller than frontier closed models, which is the main caveat, but it has held up under daily use.
Years in this space
I've evaluated a lot of these over the years. What stands out here is 12B parameter vision-language model — handled better than most — and open weights for self-hosting. Smaller than frontier closed models is my one real gripe. Worth the time if this is your use case.
Klausimai
How many images and how much text can I include in a single prompt?
Pixtral supports interleaved image and text inputs within a single 128 K token context, allowing any number of images (at their natural resolution) alongside long‑form text in one prompt.
Asked by Lorenzo Bianchi · Nov 20, 2025
Is Pixtral 12B still maintained, and are there newer alternatives?
Pixtral 12B is deprecated and no longer maintained; Mistral AI recommends using its newer, more powerful vision‑language models that supersede Pixtral for production use.
Asked by Carlos Mendoza · Nov 10, 2025
What hardware is needed to run Pixtral 12B effectively?
The model requires substantial GPU memory due to its 12 billion parameters and 400 M‑parameter vision encoder; typical deployments use high‑end GPUs (e.g., A100 40 GB or comparable) to handle the 128 K token context and multiple images.
Asked by Ivo Novotný · Nov 6, 2025
Can I self‑host Pixtral 12B, and under what license?
Yes, Pixtral 12B is released under the Apache 2.0 open‑source license, allowing you to download the weights and run the model locally on your own hardware.
Asked by Priya Nair · Oct 12, 2025
Užduoti klausimą
MOL alternatyvos

Perdaugintos paslaugų aukštosios performacijos LLM priėmimo priemonė, jungiantis 1000+ modelius vienas API.

Naujos kartos žmogiškuju asmenybe nukreipta DeepSeek modelis

Atviras mėginių modelis, siūlantysis GPT-4 lygio priežastingumą vos nežemesnei kainai.

Žaidėjų žaidėjas, sukurtas iš xAI, yra skirtas išvadinimams, mokslui ir tiesioginiam atsakymams.

Meta LLM multilingviškas atviroji sverįjantis modelis pritaikytas efektyviui aukštos kokybės tekstų generavimui.

Aparatizuoti AI-galite MP3 į tekstą konverteris, paversiongai garso į skaistus, praskanti tekstus.

Atvirųjų šaltinių didelis žiūrių modelis, pagerintis problemų išsprendimą, matematiką ir kodus, naudojantis MIT licenzija sąlygomis neiįprastai be mokesčių.

OpenAI priemonių koncentruoto modelis, sukurtas kompleksiems, daugialypiui problemai sprendžiant
Trending now

Savitai Homelaida Pomoja su Pilnomisės Paaiškinimais

Documentų inteligentijos API, kuris skaidrysta, skaido, OCR-a ir ištrina išsiaugstiną duomenų medžiagą iš kompleksinių PDF, presentacijų ir lentelių, kuris išsaugo sprendimus ir grafikai iš lentelių ir grafo duomenų.

Sponsoriai atsakymai, mokama už kliktą.

Lyderis platforma užsakinti agentų procesinį automatizavimą, naudojantis savanaudiškas intelekto agentus, kad pagerintų darbo srauto skersijas įvairiuose ūkių sektoriuose.
