Snilld

Claude Opus 4.7 er en fokuseret opgradering

Anthropic har lanceret Claude Opus 4.7 som direkte efterfølger til Opus 4.6. Ifølge den citerede rapportering er der ikke tale om et fuldt generationsskifte, men om en fokuseret opgradering med dokumenterede løft i kodning, længere agentforløb og vision.

19. april 2026 Peter Munkholm

Anthropic har lanceret Claude Opus 4.7 som ny frontier-model og direkte efterfølger til Opus 4.6. Ifølge den citerede rapportering bliver den præsenteret som en fokuseret forbedring frem for et fuldt generationsskifte. Det er den centrale ramme om lanceringen. Og det passer også med de kilder, der er lagt frem her.

Ifølge MarkTechPost handler forbedringerne især om agentisk software engineering, multimodal ræsonnering og lange autonome opgaver. Det er også her, de konkrete påstande i materialet ligger. Så det er dér historien er stærkest, ikke i brede løfter om alt muligt andet.

Placeringen i modelserien

Anthropic beskrives i kilden som en modelserie med Haiku, Sonnet og Opus. Opus er laget med højest kapacitet. Opus 4.7 ligger ifølge samme rapportering øverst i den stak, kun under den previewede Claude Mythos, som fortsat er i restriktiv adgang.

Det er værd at have med, fordi det afgrænser, hvad Opus 4.7 faktisk er. Det er ikke en sidegren eller en mindre variant. Det er den model, Anthropic ifølge kilden selv placerer som topniveau i den åbne familie lige nu.

Kilderne peger også i samme retning på selve versionsskiftet. MarkTechPost kalder det en fokuseret forbedring, og The Algorithmic Bridge beskriver det som den type ændring, man kan forvente af en 0.1-opgradering fra Opus 4.6. Den del er altså forholdsvis godt understøttet.

Banner
Udvikler arbejder med kode og flertrins-workflow på to skærme i et kontormiljø.

Kodning er den bedst dokumenterede del

Den mest konkrete dokumentation i materialet handler om software engineering. Ifølge MarkTechPost forbedrede Opus 4.7 task resolution med 13 procent på et benchmark med 93 kodeopgaver sammenlignet med Opus 4.6. Samme kilde skriver også, at modellen løste fire opgaver, som hverken Opus 4.6 eller Sonnet 4.6 kunne løse.

Der er også et andet tal, som skiller sig ud. På CursorBench nåede Opus 4.7 ifølge kilden 70 procent mod 58 procent for Opus 4.6. Det er en af de mere håndfaste sammenligninger i det fremlagte materiale.

MarkTechPost skriver desuden, at Opus 4.7 er en tydelig forbedring over Opus 4.6 i avanceret software engineering, især på de sværeste opgaver. Det er vigtigt at holde fast i formuleringen her. Det er kildens vurdering, men den understøttes af de benchmarktal, der også bliver gengivet.

Testere peger på adfærd i lange forløb

Ifølge den citerede rapportering siger brugere og testere, at Opus 4.7 er bedre til komplekse og langvarige kodningsopgaver. Kilden beskriver også tættere instruktionsefterlevelse og en adfærd, hvor modellen verificerer sine egne outputs, før den svarer tilbage. Den pointe går igen flere steder i kildegrundlaget.

Det er ikke det samme som uafhængig, bred dokumentation på tværs af mange miljøer. Men i den foreliggende dokumentation er det en central del af historien. Derfor bør den også stå som attribueret rapportering og ikke som et endeligt facit.

MarkTechPost knytter også en mere konkret testerobservation til lange agentforløb. Her beskrives en forbedring på 14 procent i komplekse flertrins-workflows over Opus 4.6, med færre tokens og omkring en tredjedel så mange tool errors. Samme tester siger ifølge kilden, at Opus 4.7 var den første model i deres setup, som bestod implicit-need-tests og fortsatte gennem tool failures, der tidligere stoppede Opus-modeller.

Det dokumenterede potentiale og grænsen for det

Det stærke ved materialet er, at det ikke kun taler i generelle vendinger. Der er konkrete benchmarktal og ret præcise testerudsagn. Det gør lanceringen mere håndgribelig end mange modelnyheder, hvor man mest får løse superlativer.

Banner

Men grænsen går også ret klart. Det fremlagte materiale dokumenterer, hvad kilden og testere rapporterer om benchmarks, instruktionsefterlevelse, selvverifikation og tool failures. Det dokumenterer ikke i sig selv brede effekter i drift, totaløkonomi eller implementering på tværs af virksomheder.

Derfor er det mest nøgterne læsning nok, at Opus 4.7 ifølge kilderne ser stærkere ud på netop de områder, Anthropic fremhæver, især kodning og lange agentiske forløb. Om det også holder i andre miljøer, ligger uden for det, der kan fastslås her.

Lille team gennemgår modeltest og implementering foran en stor skærm i et mødelokale.
Skærm med højopløseligt billede og visuelt analyseworkflow under en produktgennemgang.

Vision er med, men tyndere belagt

Vision-delen er også en del af lanceringen. MarkTechPost beskriver den som forbedret og omtaler den som tre gange højere opløsning end tidligere. Det punkt er med i de verificerede claims, men med mindre detaljeret dokumentation end kodningsdelen.

Det betyder, at man godt kan sige, at vision er forbedret og ifølge kilden løftet markant i opløsning. Man bør til gengæld ikke lægge flere tekniske specifikationer ovenpå, når de ikke er dokumenteret i det materiale, der ligger her. Den sikre formulering er derfor den simple: kilden beskriver vision som cirka tre gange højere opløsning end før.

Det ændrer ikke ved, at vision fylder mindre i den dokumenterede del af historien end software engineering. Her er der ganske enkelt færre verificerede detaljer at arbejde med. Så vægten i artiklen bør også ligge derefter.

En lille versionsopgradering med klare signaler

Når man samler det verificerede materiale, står billedet ret klart. Opus 4.7 bliver præsenteret som en fokuseret opgradering, ikke som et nyt spring til en helt anden generation. Det udsagn støttes af både hovedkilden og den supplerende kilde.

Samtidig peger de konkrete tal i retning af forbedringer, som især handler om svære kodeopgaver, længere agentiske workflows og mere robust opgaveløsning i de tests, der omtales. Det er den del af lanceringen, som er bedst underbygget. Resten bør læses med større forsigtighed.

Så den nøgterne konklusion er enkel. Claude Opus 4.7 ligner på det foreliggende grundlag en reel, men afgrænset opgradering over Opus 4.6, med den stærkeste dokumentation på kodning og rapporteret adfærd i lange forløb. Man opdager først forskellen, når man sidder med det i hænderne.

Kilder

    Gør brugeroplevelsen bedre.
    Hvilket firma arbejder du for?