Nye prisreduktioner og hastighedsgevinster
Antropic udgav tirsdag Claude Opus 5.5, som ifølge virksomheden når state-of-the-art-niveau inden for kodning og vidensarbejde. Modellen overgår den større Fable-model på flere benchmarks og løser en række opgaver, som Fable ikke kunne gennemføre.
Prisstrukturen er også væsentligt forbedret: output-tokens koster nu 20 dollar pr. million tokens, sammenlignet med 25 dollar for den forrige version. Øvrige prismetrikker falder tilsvarende. Modellen kører desuden hurtigere, hvilket afspejler en samlet reduktion i beregningstaksten.
Udgivelsen kommer blot to måneder efter Claude Opus 5’s lancering 24. juli. Anthropic varsler, at Sonnet 5.5 og Haiku 5.5 vil blive udgivet “i de kommende uger” med tilsvarende forbedringer.
Ændret kommunikationsstil og sikkerhedsvurdering
Opus 5.5 kommunikerer anderledes end sin forgænger: modellen bruger mindre fagterminologi og placerer vigtige informationer først i sine svar – en designændring, der sigter mod større brugervenlighed.
Anthropic klassificerer Opus 5.5 på niveau med deres Fable-model inden for biologi og cybersikkerhed, hvilket betyder, at samme sikkerhedsbegrænsninger gælder. Disse grænsesætninger begrænser, hvor meget modellerne kan bruges til at opdage exploits i kompilerede programmer eller udvikle genkendelige biologiske våben.
Lanseringen finder sted på baggrund af, at Anthropics administrerende direktør Dario Amodei har tilsluttet sig opfordringer til at bremse teknologien. “Jeg er blevet overbevist om, at en fuldstændig behandling af risiciene kræver endnu større forsigtighed,” skrev Amodei tidligere denne måned, “ikke blot investeringer i risikoforebyggelse, men også nedsættelse af hastigheden for kapabilitetsfremskridt, så risikoforesbyggelsen får tid til at følge med.”
Sikkerhedsudvikling og fremtidigt politisk arbejde
Opus 5.5’s sikkerhedstræning ligner udgangspunktet fra tidligere modeller, med alignment-test og pre-release-evaluering fra eksterne organisationer som METR og Frontier Design. Anthropic understreger imidlertid, at mere avancerede trænings- og evalueringssystemer allerede forberedes til fremtidige modeller, herunder forbedret sikkerhed og overvågning.
“Som kunstig intelligens bliver mere kapabel, bør offentlig politik spille en større rolle i at sikre, at de systemer, folk er afhængige af, er sikre. Denne kapacitet tager tid at opbygge, og vi er begyndt at lægge infrastruktur på plads for at understøtte den,” står der i blogindlægget. “Vi forventer at dele flere detaljer om disse bestræbelser snart.”
