Hvad Mantis er ifølge kilden
MarkTechPost skriver, at Google har open-sourcet Mantis som et stak-agnostisk toolkit af sikkerheds-skills til kodegennemgang. Ifølge artiklen lader Mantis en AI-kodende agent køre hele sårbarhedslivscyklussen: finde en mistænkt fejl, sortere falske positiver fra, reproducere fejlen i en sandkasse, foreslå en minimal patch, angribe patchen igen og score den resterende risiko. Alt dette er beskrevet som kildens gennemgang af projektet.
Kilden præciserer, at Mantis ikke er en scanner, man blot peger mod et repository og går væk fra. I stedet beskrives det som en række slash-kommandoer, som en eksisterende coding-agent kan indlæse, kombineret med stramme regler for, hvor agenten må eksekvere kode. Det er således en modulær tilgang, hvor hvert trin er en særskilt skill.

Udrulning og rammer ifølge kilden
MarkTechPost adresserer direkte, om Mantis er klar til brug: “Is it deployable? Yes for local and internal evaluation, not yet for production.” Samme artikel skriver også, at man kan klone projektet og køre det med Gemini CLI, Antigravity CLI, Google ADK eller sammenlignelige agent-rammer. Denne afgrænsning sætter rammen for anvendelse her og nu.
I kildens formulering tegner Mantis en tydelig skillelinje mellem evaluering og produktion. Den pointerer også, at Mantis’ funktioner forudsætter en eksisterende agent, der kan indlæse og kalde de udgivne skills med slash-kommandoer i en kontrolleret session.
Pipeline og arkitektur som beskrevet
Artiklen gennemgår en pipeline, hvor hvert stadie udgives som et separat skill-directory, der kaldes via en slash-kommando og kan kædes sekventielt. Et supervisor-skill, “/mantis-meta-agent”, kan styre hele løkken i en lang session. Denne struktur er central i kildens fremstilling af Mantis’ modularitet.

I den tidlige fase beskrives følgende skills: “/mantis-history” (miner versionshistorik for tidligere sikkerhedsrettelser), “/mantis-summarize” (skriver katalog-kort), “/mantis-architecture” (bygger en Markdown-vidensbase), “/mantis-threat-model” (udleder trust-grænser) og “/mantis-plan” (producerer en målrettet plan). Alle navne og roller er gengivet fra kilden.
Midterfase med filtrering
Ifølge MarkTechPost går “/mantis-researcher” koden igennem i forhold til planen. Derefter beskrives “/mantis-dedupe”, “/mantis-review” og “/mantis-critic” som trin, der samler dubletter, anvender negative regler og frasorterer fund, der ikke kan forekomme i en release-build. Pointen i kilden er at mindske støj før man bruger tid på reproduktion.
Det samlede billede i denne fase er, som kilden beskriver det, en reduktion af unødvendige spor, så de efterfølgende bevis- og patchtrin kan fokusere på verificerbare fund.

Reproduktion, patch og risikoscore
I den sene fase beskriver MarkTechPost, at “/mantis-reproduce” eksekverer payloads i gVisor eller en VM med netværk slået fra. “/mantis-chain” samler flertrins exploit-kæder ud fra bekræftede del-fund, “/mantis-patch” anvender og verificerer et fix, “/mantis-calibrate” tildeler en risikoscore fra 1 til 10, “/mantis-reflect” skriver læringer tilbage, og “/mantis-report” genererer en menneskelæselig rapportpakke.
Kilden nævner desuden et nyere skill, “/mantis-advise”, der slår op i den akkumulerede trusselsmodel, tidligere bug-linjer og verificerede patchmønstre før der skrives kode, så samme bug-klasse ikke lander to gange. Også her er terminologi og funktion direkte hentet fra MarkTechPost.
Praktisk betydning som udledt af kilden
Kildens beskrivelse peger på en pipeline, der eksplicit søger at skære falske positiver og dubletter væk, før der bruges tid på reproduktion. I den forstand kan forløbet give mere fokuseret triage og mere konsistente rapporter, fordi der udstedes en menneskelæselig “review packet”. Disse vurderinger følger af den måde trinene er beskrevet i MarkTechPost, ikke af egne målinger.

Artiklen i MarkTechPost rummer ikke primære benchmarks for præcision, tid eller lignende. Der præsenteres derfor ingen kvantitative påstande her; gennemgangen holder sig til den funktionalitet og det anvendelsesområde, kilden explicit beskriver.
Opsummering af dokumenterede skills
For overblik gengives de navngivne skills og roller, som MarkTechPost oplister: tidlige stadier “/mantis-history”, “/mantis-summarize”, “/mantis-architecture”, “/mantis-threat-model”, “/mantis-plan”; midterste stadier “/mantis-researcher”, “/mantis-dedupe”, “/mantis-review”, “/mantis-critic”; sene stadier “/mantis-reproduce”, “/mantis-chain”, “/mantis-patch”, “/mantis-calibrate”, “/mantis-reflect”, “/mantis-report”; samt supervisoren “/mantis-meta-agent” og det nyere “/mantis-advise”.
MarkTechPost skriver samtidig, at hvert pipeline-stadie er udgivet som et selvstændigt skill-directory, der kaldes som en slash-kommando og kædes i sekvens. Det er den direkte forklaring på toolkittets modularitet i kilden.

Rækkevidde og begrænsning
Som beskrevet i kilden kan Mantis klones og køres i dag med flere agent-CLI’er og rammer, men er målrettet lokal og intern evaluering. MarkTechPost opsummerer det som “not yet for production.” Denne afgrænsning er central for at forstå modenheden og hvor Mantis placerer sig.
Det efterlader læseren med et klart anvendelsesrum, der ifølge kilden er afprøvning og intern test. Videre skridt mod produktion er ikke beskrevet eller anbefalet i MarkTechPost.
Konklusion
På baggrund af MarkTechPost fremstår Mantis som et open-sourcet, modulært toolkit, der kæder forløb fra mistanke til reproduktion, patch og rapportering, med kontrolleret sandkassekørsel som et centralt element. Kilden anfører, at det kan køres lokalt med gængse agent-rammer, men at brugen er afgrænset til intern evaluering og ikke produktion.
Artiklen her gengiver de funktioner, navne og forløb, som MarkTechPost dokumenterer, uden at tilføje egne resultater eller målinger. Det er det aktuelle videngrundlag for Mantis i den offentligt tilgængelige dækning, der er citeret.