
omniparser-autogui-mcpSamodejno upravljanje GUI na zaslonu.
Pregled
Ključne funkcije
- Analiza zaslona
- Avtomatizacija GUI
- Konfigurabilno ciljno okno
- Določitev naslova strežnika
- SSE komunikacija
Cene
- Model
- Free
- Kategorija
- strežniki MCP
- Ocena
- Še brez ocen
Primeri uporabe
Samodejno iskanje v brskalniku
Iskanje besedila v brskalniku na zaslonu
Avtomatizacija GUI
Samodejno upravljanje GUI na podlagi analize zaslona
Prednosti in slabosti
Prednosti
- Samodejno delovanje GUI
- Analiza zaslona z OmniParser
- Konfigurabilno prek spremenljivk okolja
Slabosti
- Omejeno na Windows
- Zahteva konfiguracijo datoteke claude_desktop_config.json
- Odvisno od modelov OmniParser z različnimi licencami
Ocene
Prijavi se za oddajo ocene.
Še ni ocen. Bodi prvi!
Vprašanja
Ali lahko prilagodim ciljano okno?
Da, lahko določite ciljano okno prek okoljske spremenljivke TARGET_WINDOW_NAME.
Asked by Gunnar Eriksson · Oct 9, 2025
Katere nastavitve so potrebne?
Orodje zahteva namestitev z git clone in konfiguracijo datoteke claude_desktop_config.json.
Asked by Ximenez Alvarado · Aug 28, 2025
Kako je licencirano?
Licencirano je pod MIT, izključene so podmoduli in podpaketi.
Asked by Esther Adeyemi · Aug 21, 2025
Postavi vprašanje
Alternative za strežniki MCP

Odprtokodni MCP strežnik, ki omogoča LLM-om, da upravljajo pravi brskalnike s pomočjo Playwrighta in zajemov dostopnosti.

Python agent framework ekipe Pydantic za gradnjo tipovno varnih GenAI aplikacij.

Prilagodljiva plast pomnilnika, ki AI agentom pomaga učiti se iz konteksta skozi čas.

AI e-poštni pomočnik, ki organizira, pripravi odzive in vam pomaga hitreje doseči inbox zero.

Odprtokodna 24/7 lokalna snemanja zaslona in zvoka za ustvarjanje kontekstno ozaveščenih AI aplikacij

TypeScript knjižnica za gradnjo in orkestracijo AI agentov z orodji, pomnjo in več-agentnimi delovnimi tokovi.

Prinašamo bankless onchain API v MCP

Orodje Python za pretvarjanje datotek in pisarniških dokumentov v Markdown.
Trending now

Natančna pomoč pri domači nalogi z celovito razlago

API za dokumentno inteligenco, ki razčleni, deli, OCR-uje in izvaja strukturirane podatke iz zapletenih PDF-jev, predstavitev in preglednic.

Odprti multimodalni 12B model, ki obravnava mešane slike in besedilo z oknom konteksta 128K.

Sponzorirana odgovora, plačano po kliku
