ERPLMSAI ავტომატიზაციავებკვირებში, არა კვარტლებში
ZUKA.GE

Claude-ის API-ში შესაძლოა20-ჯერ მეტს იხდიდე — რატომ?

ვიდეო · 2026-08-15 · 4 წთ · claude, api, ფასი
YouTube · @zukachakhnashvili

რაზეა ვიდეო

ვიდეოს ავტორი განიხილავს, რატომ შეიძლება Claude Code-ის ან Claude API-ის მომხმარებელი ტოკენებში საჭიროზე 20-ჯერ მეტს იხდიდეს. მისი მთავარი თემა პრომპტის ქეშირებაა (prompt caching) — უკვე დამუშავებული კონტექსტის დროებით შენახვა და ხელახლა გამოყენება.

ავტორი ხარჯის შემცირების ხუთ გზას ასახელებს. მათ შორის ყველაზე დიდ გავლენას ქეშირების სწორად გამოყენებას მიაწერს.

ტოკენები და ქეში — როგორ უკავშირდება ერთმანეთს

მოდელისთვის გაგზავნილი ტექსტი ტოკენებად იყოფა. საუბრის გასაგებად Claude-ს მხოლოდ ახალი შეტყობინება არ ჰყოფნის — მას წინა მიმოწერაც სჭირდება. ამიტომ საუბრის გაგრძელებასთან ერთად დასამუშავებელი ტექსტის მოცულობაც იზრდება: 5,000 ტოკენიდან 10,000-მდე, შემდეგ 100,000-მდე და მეტიც.

ვიდეოში კონტექსტის ფანჯარა შედარებულია ბიუჯეტთან: ეს არის ინფორმაციის მოცულობა, რომლის გათვალისწინებაც მოდელს ერთდროულად შეუძლია. ავტორი განხილული მოდელებისთვის — Opus, Fable და Sonnet — ერთ მილიონ ტოკენს ასახელებს.

ქეში უკვე დამუშავებული კონტექსტის ხელახლა გამოყენების საშუალებას იძლევა, რაც მის თავიდან დამუშავებაზე იაფია. თუმცა ქეშს შენახვის ვადა აქვს. ვიდეოში განხილული ერთსაათიანი ქეშის შემთხვევაში ეს ვადა ყოველი გამოყენებისას ახლდება. თუ ერთი საათის განმავლობაში აღარ გამოიყენებ, შენახული კონტექსტის ხელახლა დამუშავება გახდება საჭირო.

ვიდეოში მოყვანილი ფასები

ავტორი ერთმანეთისგან განასხვავებს მოდელისთვის გაგზავნილ შემავალ ტოკენებს (input) და მის მიერ პასუხად შექმნილ გამომავალ ტოკენებს (output). ვიდეოში მოყვანილი ფასებით, გამომავალი ტოკენები შემავალზე ხუთჯერ ძვირია: Fable-ისთვის — $50 მილიონ ტოკენზე, Opus-ისთვის კი — $25 მილიონ ტოკენზე.

ქეშირების მაგალითში ავტორი შემდეგ ტარიფებს იყენებს:

  • შემავალი ტოკენების საბაზისო ფასი — $10 მილიონ ტოკენზე;
  • ერთსაათიან ქეშში ჩაწერა (cache write) — $20 მილიონ ტოკენზე;
  • ქეშიდან წაკითხვა (cache hit) — $1 მილიონ ტოკენზე.

ამ მაგალითში ქეშში ჩაწერასა და იქიდან წაკითხვას შორის ფასის სხვაობა ოცმაგია. სწორედ ამას ეხება ვიდეოს სათაური. ავტორი ასევე ახსენებს API-ში ხელმისაწვდომ ხუთწუთიან ქეშს.

500,000-ტოკენიანი საუბრის ქეშიდან წაკითხვა ამ ტარიფით დაახლოებით 50 ცენტი ღირს. ახალ, დაახლოებით 1,000-ტოკენიან შეტყობინებას ცალკე ემატება ქეშში ჩაწერის საფასური. თუ ძველ ქეშს ვადა გაუვიდა, მთელი ისტორიის ხელახლა ჩაწერა დაახლოებით $10 ჯდება.

ავტორის თქმით, ქეშის ხელახლა გამოყენებაზე სხვა მოქმედებებიც შეიძლება აისახოს: მოდელის, მსჯელობის დონის (effort level) ან სწრაფი რეჟიმის (fast mode) შეცვლა, MCP სერვერებისა და პლაგინების დამატება თუ გათიშვა, ინსტრუმენტის გამოყენებაზე უარი, საუბრის შეჯამება და Claude Code-ის განახლება.

რა გზებს განიხილავს ავტორი

ვიდეოში საუბრის განახლების სამი ვარიანტია განხილული:

  • /clear — საუბრის გასუფთავება. ავტორი ამ გზას მაშინ განიხილავს, როცა სამუშაოს გასაგრძელებლად საჭირო ინფორმაცია კოდის ბაზაშია შენახული.
  • /compact — საუბრის შეჯამება. ავტორი ურჩევს მაყურებელს, გრძელი საუბარი წინასწარ შეაჯამოს, რადგან, მისი შეფასებით, 600,000–800,000 ტოკენის ფარგლებში კონტექსტის ხარისხი უარესდება. მიღებული შეჯამება მუშაობის გაგრძელების საფუძველი ხდება.
  • სამუშაოს გადაბარების ჩანაწერი (custom handoff) — შეჯამება ცალკე Markdown ფაილში ინახება, რათა ახალ საუბარში მისი წაკითხვა და სამუშაოს გაგრძელება იყოს შესაძლებელი.

მოდელის შერჩევა და კონტექსტის მოწესრიგება

მესამე მიდგომა დავალებების სხვადასხვა მოდელზე განაწილებაა (model routing). ავტორის მაგალითში უფრო ძლიერი მოდელი — Fable ან Opus — გეგმავს, ხოლო შედარებით იაფი Sonnet ასრულებს. მისი შეფასებით, ასეთ განაწილებას შეუძლია ხარჯის შემცირება და შედეგის გაუმჯობესება.

ვიდეოში განხილულია დავალებების Claude Code-ის გარეთ შესრულებაც, მაგალითად, Codex-ის პლაგინით GPT მოდელებზე გადატანა. ავტორი გამოყოფს ორ მოდელს, რომლებსაც „Luna“-სა და „Terra“-ს უწოდებს, და მათი ფასის შემცირებას აღნიშნავს.

მეოთხე რჩევა /doctor ბრძანებას ეხება. ავტორი მას CLAUDE.md-ის, გამოუყენებელი უნარებისა (skills) და MCP კავშირების შემოწმების კონტექსტში ახსენებს. მის მაგალითში საუბარი ჯერ არც დაწყებულა, მაგრამ ინსტრუქციებს, უნარებსა და მეხსიერების ფაილებს უკვე 40,000 ტოკენი ეკავა.

ბოლო მიდგომა დამატებითი ინსტრუმენტებით გამომავალი ტოკენების შემცირებაა. ვიდეოში ნახსენებია „ponytail“, რომლის შედეგსაც ავტორი Fable-ზეც აღნიშნავს, და „caveman“, რომელიც გამომავალი ტოკენების 65%-ით შემცირებას აცხადებს. თუმცა ავტორის აზრით, მხოლოდ პასუხის შემცირება ხარჯის სრულ სურათს ვერ ასახავს — დიდი მნიშვნელობა კვლავ ქეშირებას აქვს.

რას ნიშნავს ეს ქართული ბიზნესისთვის

თუ გუნდი Claude Code-ს ან Claude API-ს ავტომატიზაციისთვის იყენებს, ხარჯის შეფასებისას მხოლოდ შეტყობინებების რაოდენობას არ უნდა უყუროს. მნიშვნელოვანია საუბრის სიგრძეც და ისიც, შენახული კონტექსტი ხელახლა გამოიყენება თუ თავიდან მუშავდება.

ვიდეოს მთავარი აზრია, რომ გრძელი საუბრებისა და დაგროვილი ინსტრუქციების მართვა ხარჯის დაგეგმვის ნაწილია. ავტორი ხანგრძლივი პაუზის წინ /clear-ს ან /compact-ს განიხილავს, ხოლო კონტექსტის რეგულარული შემოწმებისთვის — /doctor-ს. ზემოთ მოყვანილი ფასები და ოცმაგი სხვაობა ვიდეოში განხილულ კონკრეტულ მაგალითს ეხება.

ზუკა ჩახნაშვილი

ვაშენებ სისტემებს · ვასწავლი AI-ის გამოყენებას

შესაბამისი სერვისი

AI ავტომატიზაცია

დაგეგმეთ საუბარი ⚡