Mennyt taisto · 2023-12-19 UTC
Code Generation Yhteenotto — 19. joulukuuta 2023
Kategoriasta Code Generation. 26 merkkiä asetettu 7 taistelijan kesken. Codename Goose otti kruunun.
Lopulliset sijoitukset
Kokoonpano
Taistelijat
Profiilit jokaisesta työkalusta, joka kilpaili tässä taistossa, järjestettynä lopullisen pistemääränsä mukaan.

Codename Goose
Avoin lähdekoodipohjainen, laitteelle asennettava AI-agentti, joka automatisoi monimutkaista tekniikkatyötä kasvattamassa kehittäjien tuotannontuottoa.

Nimimerkillä Goose eli Goose, on avoin lähdekoodi - tietokoneen sisäinen AI-ohjelma, jonka tarkoitus on automatisoida monimutkaisia insinööritehtäviä ja parantaa kehittäjien tuottavuutta. Se on yleiskäyttöinen AI -ohjelma, joka voidaan käyttää monenlaiseen tehtävään ulkopuolella koodia mukaan lukien tutkimus, kirjoittaminen, automaatio ja tietoaineistojen analyysi. Goose AI-agenssi on saatavilla kotitalousohjelmana macOS-, Linux- ja Windows-yhteydellä, täysipainoinen käyttöliittymä komentorivi-työtiloille sekä API, jota voi integroida mistä tahansa kohdeeseen. Ohjelma on rakennettu Rustiin, mikä tarjoaa suorituskyvyn ja uudelleensoiselman mahdollisuuksia. Goose toimii yli 15 tukijan kanssa, mukaan lukien Anthropic, OpenAI, Google ja Azure, ja tukee API-tunnuksia tai olemassa olevia tilausmääriä ACP-yhteydellä. Yhden tärkeimmistä ominaisuuksista, joilla goose erilee muista, on sen kyky yhdistää yli 70 laajennusta Model Context Protocol -avointen standardeja käyttäen. Tämä mahdollistaa kehittäjien laajentaa AI-agenteen funktioita ja integroida sen muihin työkaluihin ja palveluihin. Goose kuuluu myös Agentic AI Foundation (AAIF) - hankkeeseen Linux Foundationissa, joka tarjoaa kriteereitä AI-agenteiden kehitykseen ja hallintaan. Codename Goose -agentyypin voit käyttää automaation suorittamiseen erilaisia tehtäviä, kuten ohjelmakoodin ehdotus, asennus, suoritus, muokkaus ja testaus suurten kieliopistojen käyttäminen (LLM). Se on suunniteltu laajennettaviksi, jolloin kehittäjät voivat rakentaa omia sääntelemättömiä jakelupaikkoja omalla suosituksilla ja sijaintitiedolle suunniteltuine laajennuksineen. Yleisesti sanottuna, goosi on avoin lähdekoodi AI-agentti, joka voi merkittävästi parantaa kehittäjien tuottavuutta ja automatisoida monimutkaisia inseniöörityökeit. Sen kestävyys, ulkoistettavuus ja monipuolisuus, joka mahdollistaa sen toimivan useiden toimittajien ja laajennusten kanssa, tekee siitä tehokkaan työkalun sekä kehittäjille että tutkimusihmisille.
Kriteerien jakautuminen
- Tuki yli 15 palveluntarjoajalle
- Embeediminen API:n kautta
- Yhteys 70+ laajennuksen kautta MCP-avoin standardi
- Käyttäytyminen olemassa olevilla tilauspalveluilla ACP:n kautta
- Muukatettavuus kustomoiduilla jakelumuodoin ja palveluntarjoajan muokkausratkaisuin

Kiro AI
Tekoälypohjainen IDE, joka vie projektit konseptista tuotantovalmiiseen koodiin.

Kiro AI on tekoälykäyttöinen IDE, joka mahdollistaa kehittäjille ja tiimeille projektien tehokkaan muuttamisen valmiiksi tuotantokelpoiseksi koodiksi. Tämä saavutetaan määritysten ohjaamalla kehittämismenetelmällä, jossa ohjaukset muutetaan rakenteellisiksi vaatimuksiksi, arkkitehtuurityöksi ja tehtäviksi, joita rinnakkaiset agentit toteuttavat. Kiro AI todentaa myös koodin oikeellisuuden ominaisuuspohjaisilla testeillä, vähentäen ongelmia, jotka pääsevät läpi yksikkötesteistä, mutta rikkoutuvat tuotannossa. Alusta on suunniteltu tuomaan jäntevyyttä tekoälykoodaukseen, varmistaen, että koodi on turvallisempaa, ylläpidettävää ja vastaa tarkoitettua lopputulosta. Kiro tukee laajaa ominaisuusvalikkoa, käsittäen suunnittelun määritysten kanssa, toteuttamisen rinnakkaisilla agenteilla, virheiden havaitsemisen ominaisuuksiin perustuvilla testeillä sekä yhteyden muodostamisen GitHubiin tai GitLabiin katselua varten. Se mahdollistaa kehittäjien valita parhaan mallin jokaiseen tehtävään ja perustuu suosittuihin malleihin, kuten Anthropic Claude. Alusta on rakennettu avoimien standardien päälle ja on valmis käyttöön yrityksissä, tarjoten maksamismallin, jossa ei ole päivittäisiä tai viikoittaisia käyttörajoituksia, IAM- ja SSO-tunnistautumisen sekä hallintaoikeudet. Kiroa on ylistänyt maailmanlaajuinen insinöörikunta sen kyvystä oikeuttaa ajan käyttö liiketoimintakriittisten varojen kehittämiseen omalla tuotannolla, kiihdyttää maksuominaisuuksien kehittämistä ja vähentää aikaa asiakasarvoon. Se on vahva liittolainen start-upeille, luonnostaan muuttaen huomioimattomat asiakirjat ja määritykset vankkoiksi varoiksi, saaden kasvun sulavammaksi ja tulevaisuuden skaalautumisen tehokkaammaksi. Kokonaisuutena Kiro AI on tehokas työkalu kehittäjille ja tiimille, jotka haluavat muuttaa projektit tehokkaasti valmiiksi koodiksi, ja sen painopiste spec-ohjatussa kehittämisessä, koodin oikeellisuudessa ja yritysten vaatimusten täyttämisessä tekee siitä houkuttelevan vaihtoehdon niille, jotka etsivät parannuksia koodausprosesseihinsa.
Kriteerien jakautuminen
- Tekoälyavusteinen koodin generointi
- Kontekstuaaliset koodiehdotukset
- Uudelleenjärjestelyn ja virheenkorjausavun tarjoaminen
- Projektin rungon luominen ohjelmointikomennoista
- Integroitu kehitystyökaluprosessi
- Useiden kielen tuki

OpenAI Codex
AI-koodausassistentti, joka kääntää luonnollisen kielen toimivaksi koodiksi lukuisissa ohjelmointikielissä.

OpenAI Codex on ohjelmistokehitykseen hienosäädetty kielimalli, joka osaa tulkita tavallisia englanninkielisiä ohjeita ja tuottaa toimivaa koodia. GPT-arkkitehtuuriin perustuva malli ymmärtää kontekstia useiden tiedostojen välillä ja tukee laajaa valikoimaa ohjelmointikieliä, erityisesti vahvuutena Python, JavaScript, TypeScript, Go, Ruby ja Shell. Kehittäjät voivat käyttää Codexia luodakseen mallikoodia, kirjoittaa funktioita kuvauksista, refaktoroida olemassa olevaa koodia, selittää tuntemattomia koodinpätkiä ja automatisoida toistuvia tehtäviä. Se ohjaa työkaluja kuten GitHub Copilot ja voidaan integroida mukautettuihin työnkulkuihin OpenAI API:n kautta, mikä tekee siitä hyödyllisen sekä yksittäisille koodareille että insinööritiimeille, jotka haluavat nopeuttaa kehitystä. Vaikka Codex nopeuttaa monia koodaustehtäviä, sen tuottama koodi edellyttää edelleen ihmisen tarkistusta oikeellisuuden, turvallisuuden ja projektistandardien noudattamisen varmistamiseksi. Se toimii parhaiten yhteistyökumppanina eikä korvaajana insinöörin arvostelulle.
Kriteerien jakautuminen
- Luonnollisen kielen muuntaminen koodiksi
- Monikielinen ohjelmointituki
- Koodin täydennys ja ehdotukset
- Koodin refaktorointi ja selitys
- API-pääsy mukautettuihin integraatioihin
- Kontekstitietoinen monitiedostoymmärtäminen

Anima | UX Design Agent
UX-suunnitteluagentti, joka oppelee tuotesidonnaisuutesi ja muotoilujärjestelmän tarjoamaan tarkkailtavia suunnittelukuvausten sisältöjä.

Anima on AI-pohjainen UX-suunnitteluagentti, joka toimii tuotesiämisjoukon laajassa mielessä. Se imuroi yhtiöesiä brand-opasohjeita, komponenttiluetteloita sekä jo olemassa olevaa muotoilujärjestelmää. Sen jälkeen se käyttää tällaista tietoa tuottamaan ruutuja, sujuvuutta ja UI-variantioita, jotka pysyvät yhtenäiset säännöillä asetettujen mukaisesti. Anima-pohjaiseet eivät päästisi tuottamaan yleisiä hahmotelmia, vaan tuottavat valmiit työnoikeet, joiden on integroitu yleiset muotoilu- ja kehitystyötöiden työvaiheet. Joukkoon se voi auttaa nopeuttamaan varhaisia kehittämiä, täydentymään toistuvia ruteja tai suunnitelmien vähentämiseen ymmärryksen poliittisesti täydentävine suunnitelman muodossa ilman työtä aloittamatta. Anima-pohjaiseet ovat suunnitelmansa mukaista yleiskäyttöisyys ja tuotteena se tarjoaa tukea eri toimintatyövoimilla.
Kriteerien jakautuminen
- Brand- ja muotoilujärjestelmien liitännäiset
- AI-tuottama UX-ruutuihin ja sujuvyyteen
- Koodattavissa komponenttiohjeet
- Tukeminen monille kohteille yhtenäisyys
- Designereiden editointioikeudet sisältäneet yhteisöissä
- Tuki työntäytteisyydelle kehittämiseen

DeepCoder-14B-Preview
Avoin lähdekoodi 14B-koodin perustelu malli, joka on purkauduttu DeepSeek-R1:sta ja Qwen-14B:st eteenpäin edistyksellisenä koodin generoimiseksi.
DeepCoder-14B-Preview on avoimen lähdekoodin suuri kielen malli, joka keskittyy ohjelmointiin ja ohjelmointiohjelmien perusteleminen. Kehityksessä käytetyssä DeepSeek-R1-Distilled-Qwen-14B-pohjassa se perii ketjuhahmoinnin perustelukäytäntöjä ja on optimoiduttu niin, että se toimii eri ohjelmointikielten kehitystahtiohjelmina. Malli kohdistaa kehittäjiin, jotka tarvitsevat itsenäisen toiminnan koodiavustimina. Se voi hoitaa tehtäviä, kuten luomisesta funktioita luonnollisista kieliyllä antamista kutsuista, tuomisesta virheistä olemassa olevassa koodissa, selittämästä koodipaloista, sekä auttamisesta algoritmisesta ongelmajärjestelmäytöstä. Sen 14 miljardin parametrimäärä tarjoaa tasapainon kyvystä ja sitä varten tarvittavasta kehittämisen edellytykset lähiverkkoon tai epätäydellisten pilvipohjamaisten GPU:iden suorittamiseen. Tässä ennakoivassa julkaisussa DeepCoder-14B on sopivin kohteeksi kokeilu, tutkimus ja kehitystyökalujen integraatio, eikä se ole valmis käytöstä keskeisiin tuotannon sovelluksiin ilman lisäarviointia.
Kriteerien jakautuminen
- Koodin generointi luonnollisesta kielestä
- Monikielinen ohjelmointituki
- Ketjuajattelureasonointi virheiden korjaamiseksi
- Tislattu DeepSeek-R1:stä ja Qwen-14B:stä
- Avoin paino lokaalille käyttöönotolle
- Sopii hienosäätöön ja tutkimukseen

Keringit
Syötä aloitussyöte, käynnistä toimiva sovellus, jonka voit omistaa ja mukauttaa.

Keringit on alusta, joka mahdollistaa käyttäjille luoda ja käyttöön ottaa omia sovelluksiaan, mukaan lukien agentit, tokenit ja muut blockchain-pohjaiset hankkeet. Alusta tarjoaa laajaa valikoimaa mallinaisia ratkaisuja ja ideiaita, joilla alkuun saa kärjet, kuten rakentaa siirtymälaite rinnakkain ketjurekiin, luoda ennusteemarkkinat tai käynnistää decentralisoitu vaihto (DEX). Alusta väittää tarjoavan 10kertaiseksi nopeampia tuloksia, mahdollistaen käyttäjien nopeasti muuntaa ajatuksia todellisuudeksi. Se tarjoaa myös ominaisuuksia kuten suojatun tunnusneuvojen siltaaminen, syvän likviditeetin ja kilpailukykyiset lainaamisvaihtoehdot. Keringit vaikuttaa kohdistuvan unelmiin ja liikemiehiin jotka haluavat laittaa projektit nopeasti ja tehokkaasti valmiiksi. Alustan keskityminen nopeuteen ja helppokäytökytheen ehdottaa, että se on suunniteltu käyttäjille jotka eivät välttämättä ole saaneet laajaa teknistä asennetta. Yksi Keringitin maineista ominaisuuksista on sen painottaminen yhdessäyhteisöllisyydestä, ja sen tarjoaman mahdollisuuden lähettää kannattajien takaamia tokeneja. Tämä suosittelee sitä, että alusta on tarkoitettu tuomaan tukea ekosysteemin luomiseksi erilaisia projekteja kasvattavaksi ja kehittyväksi. Platformin kehitystyö on tällä hetkellä jo toisella versiolla, ja käyttäjät voivat liittyä odotustilaan saadakseen ensimmäisenä kokeilla uutta. Käytännössä Keringit tuntuu olevan seuraavan näkemys, jossa käyttäjien on mahdollista luoda ja ottaa käyttöön oma blockchain- perustuva projekti kätevästi ja nopeasti, niin, että niiden toteuttaminen ja käyttöönotto on helppoa.
Kriteerien jakautuminen
- Teksti-sovellusgeneraatio
- Muokattava, omistettava tuloste
- Nopea käynnistysprosessi
- Sopii MVP:iden ja prototyyppien luomiseen
- Iteratiivinen aloitussyötteen tarkennus

SWE-1 ai coding model
Surffaa tuulea Windsurf'n sisäisen AI-malliperheen, joka on rakennettu koko softan käsittelystä kytkeytyviä ohjelmistokehitys työmaille.

SWE-1 on Windsurfin kehittämä AI-koodimallien perhe, joka käyttää apuna assistiivisia ja agentteja ohjelmistokehityskyselyjä tuottamassa IDE:tä ja liittyviä tuotteita. Sen sijaan, että mallit keskittyvät ainoastaan koodin loppuunvedossa, ne on säätynyt laajempaa insinöörikilpailun kehitys, myös tietojen syyntakeita, suuriin arkistoihin, ja yhteistyötä ihmiskehittäjien kanssa pidemmän ajanjakson Linjaus yleensä kattaa erilaisia kokoja ja kykytasoja, joiden avulla Windsurf reitittelee kevyitä tehtäviä, kuten autototeutuksen, nopeampiin muunnelmiin, kun taas suurempia kykyjä käyttää kompleksisten muutosten, refaktoroitujen ja agenttitoiminnon tasoille. Malleja on kouluttanut todellisen kehittäjän toiminnalla oleva tieto, joten ne pyrkivät hoitamaan valmiustilan puutteita, useita muutospasoja ja työkalun käyttöä käytännäisämmin kuin yleiskäyttöiset LLM-luokitukset. SWE-1 on parhaiten sopiva niille tiimeille, jotka jo ovat työskennelleet Windsurfin sisällä, ja jotka haluavat tiukasti integroituksen koodaamiseen verrattuna yleiseen chatbotiin, joka on kiinnitetty editoimiseen.
Kriteerien jakautuminen
- Malliperhe, joka on säädetty koodaukseen
- Repo-tietoisuus ja logiikka
- Tuki agenteista ja monivaiheisten muokkausten hallinnasta
- Optimoitu itsehallinto ja keskustelu -tiedostomuodot
- Integraatio Windsurf'n Cascade-käyttöliittymän kanssa
- Kulku raskaissa ja kevyissä variantteissa






