Anthropic-მა უკვე ოფიციალურად წარადგინა Claude 5.5 ოჯახის მეორე წევრი, Claude Sonnet 5.5, რომელიც წინამორბედ Sonnet 5-თან შედარებით მნიშვნელოვანი გაუმჯობესებაა. ახალი გამოირჩევა 30%-ზე მეტი სიჩქარით და უმეტეს სამუშაოებში 30%-ით დაბალი თვითღირებულებით. თუ Opus 5.5 რთულ, ფრთხილ მსჯელობასა და ანალიზს მოითხოვს, Sonnet 5.5 შექმნილია ყოველდღიური, კარგად განსაზღვრული ამოცანების სწრაფად შესასრულებლად, ხარვეზების აღმოსაფხვრელად და დახვეწილი დოკუმენტების, პრეზენტაციებისა თუ ცხრილების შესაქმნელად.
გარდა ამისა, მას შესანიშნავი ვიზუალური და დიზაინერული თვალი აქვს. უახლოეს კვირებში ამ ოჯახს მაღალი მოცულობისა და ბიუჯეტური აპლიკაციებისთვის განკუთვნილი Claude Haiku 5.5-ც შეუერთდება.
შედეგები და ნიშნულები
წარმოების თვალსაზრისით, Sonnet 5.5 შესამჩნევ ნახტომს აფიქსირებს. აგენტური კოდირების ბენჩმარკზე Terminal-Bench 4.0, Sonnet 5.5-მა 70.6%-იანი შედეგი აჩვენა, მაშინ როდესაც Sonnet 5 მხოლოდ 10.3%-ს ჯერდებოდა. რეალური პროფესიული სამუშაოების ტესტში GDPval-AA, ის სულ რაღაც ორი ქულით ჩამორჩება ფლაგმანურ Opus 5.5-ს. აღსანიშნავია, რომ ეს არის პირველი Sonnet , რომელმაც მხოლოდ სქრინშოთებზე დაყრდნობით შეძლო ვიდეოთამაშ Pokémon Red-ის გავლით წარმატებისთვის მიეღწია. კოდირების მიმართულებით, FrontierCode-ის მაღალი დატვირთვის რეჟიმში მან 10 ქულით აჯობა წინამორბედს და ეს ყველაფერი დაახლოებით მეთხუთმეტედი დანახარჯით შეძლო. CursorBench-ზე კი მისი საუკეთესო შედეგი Opus 5.5-ის მაჩვენებელს სულ რამდენიმე ქულით ჩამორჩება.

ცოდნა და ანალიტიკა
ცოდნასა და ანალიტიკაზე დამყარებულ სამუშაოებში Sonnet 5.5 უზარმაზარ პროგრესს აჩვენებს. GDPval-AA ტესტში ის თითქმის უტოლდება Opus 5.5-ს და დაახლოებით 400 ქულით უსწრებს ძველ Sonnet 5-ს. ადრეული ტესტერები ხაზს უსვამენ მის ადამიანურ, ბუნებრივ საკომუნიკაციო სტილსა და დიზაინის უნიკალურ უნარს: არა მხოლოდ სძენს ვიზუალურ დახვეწილობას ინტერფეისებს, არამედ მარტივად მიჰყვება სლაიდების შაბლონებს და ქმნის ისეთ პრეზენტაციებს, რომლებსაც პრაქტიკულად არ სჭირდება დამატებითი რედაქტირება. შიდა ექსპერიმენტში, სადაც მოდელს საჯარო კომპანიის კვარტლური ანგარიში და შაბლონი გადასცეს, ექსპერტებმა პირველივე ვერსია მზა სახით გამოსაყენებლად მიიჩნიეს.
ფასები და ხელმისაწვდომობა
ფასების პოლიტიკა წინა თაობის დონეზეა შენარჩუნებული — მილიონ შემავალ ტოკენზე $2, გამავალზე $10, ხოლო ქეშის წაკითხვაზე $0.20. თუმცა, იმის გამო, რომ Sonnet 5.5 იმავე სამუშაოს შესასრულებლად გაცილებით ნაკლებ ტოკენს მოითხოვს, მისი საერთო თვითღირებულება თითოეულ დავალებაზე 30%-ით იაფია. გენერაციის სიჩქარე 30%-ზე მეტით გაიზარდა, რაც მას დღემდე ყველაზე სწრაფ Sonnet მოდელად აქცევს. მომხმარებლებს შეუძლიათ ძალისხმევის დონის (effort level) რეგულირებით დააბალანსონ სიჩქარე, ფასი და ხარისხი. პლატფორმაზე ნაგულისხმევად მაღალი (High) რეჟიმია ჩართული, ხოლო აპლიკაციებსა და Claude Code-ში — საშუალო (Medium).
უსაფრთხოება
უსაფრთხოების კუთხით, Sonnet 5.5-მა გაიარა ავტომატური ქცევითი აუდიტი, სადაც ის უმეტეს პარამეტრებში იმეორებს ან აუმჯობესებს Sonnet 5-ის შედეგებს. ვინაიდან მისი კიბერუსაფრთხოების შესაძლებლობები საგრძნობლად გაიზარდა, ეს არის პირველი Sonnet , რომელსაც ემატება კიბერუსაფრთხოების მკაცრი ბარიერები და ავტომატური გადართვები (fallbacks), მსგავსად Opus 5.5-ისა. გარდა ამისა, დისტილაციისგან დასაცავად ინტეგრირებულია უსაფრთხოების კლასიფიკატორები და გაფართოებული „preserved thinking“ ფუნქცია, რომელიც ბლოკავს მოდელის მსჯელობის ლოგიკის უკანონო გამოწოვას. უკვე ხელმისაწვდომია ყველა ძირითად პლატფორმაზე (AWS, Google Cloud, Microsoft Azure), ხოლო დეველოპერებს მისი გამოყენება Claude Platform-ზე claude-sonnet-5-5იდენტიფიკატორით შეუძლიათ.



