გადასვლა შიგთავსზე
AnthropicAI2 წთ

Anthropic-მა Claude Sonnet 5.5 წარადგინა

კომპანია Anthropic-მა 5.5 თაობის მეორე მოდელის — Claude Sonnet 5.5 -ის გამოშვება დააანონსა. მაშინ, როდესაც დიდი ენობრივი მოდელები ხშირად პარამეტრებს სიჩქარის ხარჯზე ზრდიან, Anthropic ინფერენსის ოპტიმიზაციის გზით წავიდა. მოდელმა არა მხოლოდ გააუმჯობესა მაჩვენებლები ბენჩმარკებში, არამედ ტოკენების…

გაზიარება

კომპანია Anthropic-მა 5.5 თაობის მეორე მოდელის — Claude Sonnet 5.5-ის გამოშვება დააანონსა.

მაშინ, როდესაც დიდი ენობრივი მოდელები ხშირად პარამეტრებს სიჩქარის ხარჯზე ზრდიან, Anthropic ინფერენსის ოპტიმიზაციის გზით წავიდა. მოდელმა არა მხოლოდ გააუმჯობესა მაჩვენებლები ბენჩმარკებში, არამედ ტოკენების ალგორითმული ეკონომიის ხარჯზე რეალურ გამოყენებაში უფრო იაფიც გახდა.

Sonnet-ის ოჯახი პოზიციონირებს როგორც „ოქროს შუალედი“ მძიმეწონიან Opus-სა და მსუბუქ Haiku-ს შორის.

ინფერენსის ოპტიმიზაცია და ღირებულება

დეველოპერების მტკიცებით, 1 მილიონ ტოკენზე საბაზისო ფასი Sonnet 5.5-ში Sonnet 5-ის იდენტური დარჩა. თუმცა, კონტექსტის უკეთესი გაგებისა და უფრო მკვრივი გენერაციის წყალობით, მოდელს იმავე მოცულობის სამუშაოს შესასრულებლად გაცილებით ნაკლები ტოკენი სჭირდება. პრაქტიკაში ეს ერთი ამოცანის გადაჭრის ღირებულებას (cost-per-task) 30%-მდე ამცირებს.

ტოკენების გაცემის სიჩქარეც (time to first token და გენერაციის საერთო სიჩქარე) 30%-ზე მეტით გაიზარდა, რაც Sonnet 5.5-ს ამ შტოში ყველაზე სწრაფ მოდელად აქცევს.

ბენჩმარკები: ღირებულების 1/10 საუკეთესო შედეგისთვის

სინთეტიკურ და პრაქტიკულ ტესტებში მოდელი არსებით ზრდას აჩვენებს.

აღსანიშნავია, რომ Sonnet 5.5-ს Low ან Medium effort პარამეტრებზე ზოგჯერ შეუძლია დაამარცხოს Sonnet 5-ის მაქსიმალური (best score) შედეგი და ამაზე გამოთვლითი სიმძლავრეების ძველი ღირებულების დაახლოებით 10% დახარჯოს.

დაპროგრამება, დიზაინი და დოკუმენტებთან მუშაობა

მოდელი სპეციალიზდება შემდეგ მიმართულებებზე:

  1. მოწყვლადობების ძიებასა და ბაგების გასწორებაზე legacy-კოდში.
  2. სტრუქტურირებული დოკუმენტების ფორმირებაზე (Markdown, ცხრილები, JSON მასივები).
  3. UI/UX ინტერფეისების დახვეწაზე.

ნეიროქსელმა შაბლონების უფრო მკაცრად დაცვა ისწავლა. მაგალითად, პრეზენტაციებისთვის სლაიდების შექმნისას გენერირდება კოდი ან სტრუქტურა, რომელიც პრაქტიკულად არ საჭიროებს ხელით ჩარევას.

„Opus 5.5-ის მსგავსად, ახალი Sonnet 5.5 წერს უფრო მკაფიოდ, ვიდრე მოდელების წინა თაობა. მისი სიჩქარე მას იდეალურს ხდის სწრაფი იტერაციებისა და ნაკლებად რთულ ამოცანებზე ერთობლივი მუშაობისთვის“, — Anthropic-ის ოფიციალური განცხადებიდან.

უსაფრთხოება და alignment

ავტომატიზებულ ქცევით აუდიტში Sonnet 5.5-მა გააუმჯობესა ან შეინარჩუნა მეხუთე ვერსიის მაჩვენებლები პატიოსნებისა და სისტემური პრომპტების შესრულების კუთხით.

მნიშვნელოვანი სიახლე enterprise-სექტორისთვის: ეს არის Sonnet-ის დონის პირველი მოდელი, რომელმაც მიიღო იგივე კიბერუსაფრთხოების მექანიზმები და fallback-სისტემები, რაც Anthropic-ის ფლაგმანურ მოდელებს აქვთ. დეველოპერები ცალკე უსვამენ ხაზს, რომ ჩვეულებრივი პროგრამული უზრუნველყოფის წერაზე ამ ფილტრებს უარყოფითი გავლენა არ მოუხდენია.

ოჯახის შემდეგი, ყველაზე მსუბუქი მოდელის, Claude Haiku 5.5-ის რელიზი უახლოეს კვირებშია მოსალოდნელი.