1

سال گذشته، آنتروپیک مدل Claude Haiku 4.5 را به‌عنوان سریع‌ترین و ارزان‌ترین مدل هوش مصنوعی خود معرفی کرد و توسعه‌دهندگانی را هدف قرار داد که به اجرای حجم بالایی از بارهای کاری هوش مصنوعی نیاز دارند. امروز، آنتروپیک مدل Claude Haiku 5.5 را معرفی کرد که بهبودهای چشمگیری در زمینه هوشمندی و سرعت ارائه می‌دهد. به گفته آنتروپیک، Claude Haiku 5.5 سریع‌ترین، ارزان‌ترین و توانمندترین مدل کوچک هوش مصنوعی است که این شرکت تاکنون عرضه کرده است.

Haiku 5.5 جدید نیز مانند Haiku 4.5 برای وظایف حجیم مانند خلاصه‌سازی، دسته‌بندی و موارد دیگر طراحی شده است. آنتروپیک برای Claude Haiku 5.5 قیمت‌گذاری تهاجمی‌ای در نظر گرفته است. برای درخواست‌هایی که حداکثر 100,000 توکن دارند، هزینه این مدل تنها 0.10 دلار به ازای هر یک میلیون توکن ورودی و 0.50 دلار به ازای هر یک میلیون توکن خروجی است. برای درخواست‌های بزرگ‌تر، این قیمت‌ها به‌ترتیب به 0.50 دلار و 2.50 دلار افزایش می‌یابند.

برای مقایسه، GPT-6 Luna از OpenAI همان قیمت استاندارد توکن‌های ورودی و خروجی را دارد که Haiku 5.5 در رده قیمت پایین‌تر ارائه می‌دهد. آنتروپیک ادعا می‌کند که با این ساختار قیمت‌گذاری دو‌سطحی، هزینه اجرای مدل Claude Haiku 5.5 به‌طور میانگین حدود 75 درصد کمتر از Haiku 4.5 است. در اینجا مقایسه‌ای میان Claude Haiku 5.5، نسخه پیشین آن و مدل GPT-6 Luna (محصول OpenAI که به‌تازگی معرفی شده) ارائه شده است:

معیار ارزیابی Haiku 5.5 Haiku 4.5 GPT-6 Luna
GDPval-AA v2.1 1620 735 1437
AA-Briefcase v1.1 1578 614 1336
OSWorld 2.1 72.4% 15.7% 48.9%
Terminal-Bench 4.0 39.2% 0% 16.4%
FrontierCode 1.1 46.4% — 42.4%
Chartography 46.4% 6.4% 29.1%

همان‌طور که در جدول بالا دیده می‌شود، Claude Haiku 5.5 در هر شش معیار ارزیابی عملکرد بهتری از GPT-6 Luna دارد. این تفاوت به‌ویژه در استفاده از رایانه و کدنویسی عامل‌محور چشمگیر است که Haiku 5.5 در آن‌ها بهبودهای قابل‌توجهی نسبت به نسل قبلی ارائه می‌دهد. بااین‌حال، این عملکرد بهتر هزینه‌ای نیز دارد: مصرف بیشتر توکن. طبق آزمایش‌های مستقلی که Artificial Analysis انجام داده، Claude Haiku 5.5 برای تکمیل وظایف معیارهای ارزیابی، در مقایسه با GPT-6 Luna توکن‌های بسیار بیشتری مصرف می‌کند:

معیار Artificial Analysis Haiku 5.5 (Max) GPT-6 Luna (Max)
Intelligence Index 43 38
میانگین توکن‌های خروجی به ازای هر وظیفه 162K 50K
میانگین توکن‌های استدلال به ازای هر وظیفه 129K 39K
میانگین هزینه به ازای هر وظیفه 0.21 دلار 0.07 دلار
سرعت خروجی 243 توکن 128 توکن
میانگین زمان به ازای هر وظیفه 427s 390s

در حالی که Haiku 5.5 امتیاز هوشمندی بالاتری ارائه می‌دهد، در این مقایسه تقریباً 3.5 برابر توکن خروجی و نزدیک به 3.5 برابر توکن استدلال بیشتری برای هر وظیفه مصرف می‌کند. در نتیجه، میانگین هزینه هر وظیفه آن 3 برابر بیشتر از GPT-6 Luna است (آن هم با وجود قیمت‌گذاری یکسان به ازای هر توکن). Haiku 5.5 همچنین توکن‌ها را بیش از 2 برابر سریع‌تر از Luna تولید می‌کند، اما مصرف بالاتر توکن باعث می‌شود تکمیل یک وظیفه معیار به‌طور میانگین زمان بیشتری ببرد.

آنتروپیک همچنین ادعا می‌کند Claude Haiku 5.5 در مقایسه با Haiku 4.5 بهبودهای چشمگیری در زمینه ایمنی ارائه می‌دهد و موارد کمتری از رفتار ناهماهنگ با اهداف مورد انتظار و تمایل کمتری به همکاری در درخواست‌های بالقوه مضر دارد. Anthropic هم‌زمان با عرضه Haiku 5.5، اعتبار API ماهانه را برای مشترکان Claude Max و Team معرفی کرده است. کاربران Max 5x ماهانه 100 دلار اعتبار دریافت خواهند کرد، کاربران Max 20x مبلغ 200 دلار و مشترکان Team نیز حداکثر 500 دلار اعتبار تجمیعی دریافت خواهند کرد.

این اعتبارها را می‌توان برای ساخت برنامه‌ها و عامل‌ها در مدل‌های مختلف آنتروپیک استفاده کرد. Claude Haiku 5.5 هم‌اکنون از طریق Claude Platform، Amazon Web Services، Google Cloud و Microsoft Azure در دسترس است.