سال گذشته، آنتروپیک مدل Claude Haiku 4.5 را بهعنوان سریعترین و ارزانترین مدل هوش مصنوعی خود معرفی کرد و توسعهدهندگانی را هدف قرار داد که به اجرای حجم بالایی از بارهای کاری هوش مصنوعی نیاز دارند. امروز، آنتروپیک مدل Claude Haiku 5.5 را معرفی کرد که بهبودهای چشمگیری در زمینه هوشمندی و سرعت ارائه میدهد. به گفته آنتروپیک، Claude Haiku 5.5 سریعترین، ارزانترین و توانمندترین مدل کوچک هوش مصنوعی است که این شرکت تاکنون عرضه کرده است.
Haiku 5.5 جدید نیز مانند Haiku 4.5 برای وظایف حجیم مانند خلاصهسازی، دستهبندی و موارد دیگر طراحی شده است. آنتروپیک برای Claude Haiku 5.5 قیمتگذاری تهاجمیای در نظر گرفته است. برای درخواستهایی که حداکثر 100,000 توکن دارند، هزینه این مدل تنها 0.10 دلار به ازای هر یک میلیون توکن ورودی و 0.50 دلار به ازای هر یک میلیون توکن خروجی است. برای درخواستهای بزرگتر، این قیمتها بهترتیب به 0.50 دلار و 2.50 دلار افزایش مییابند.
برای مقایسه، GPT-6 Luna از OpenAI همان قیمت استاندارد توکنهای ورودی و خروجی را دارد که Haiku 5.5 در رده قیمت پایینتر ارائه میدهد. آنتروپیک ادعا میکند که با این ساختار قیمتگذاری دوسطحی، هزینه اجرای مدل Claude Haiku 5.5 بهطور میانگین حدود 75 درصد کمتر از Haiku 4.5 است. در اینجا مقایسهای میان Claude Haiku 5.5، نسخه پیشین آن و مدل GPT-6 Luna (محصول OpenAI که بهتازگی معرفی شده) ارائه شده است:
| معیار ارزیابی | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 |
| OSWorld 2.1 | 72.4% | 15.7% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | 0% | 16.4% |
| FrontierCode 1.1 | 46.4% | — | 42.4% |
| Chartography | 46.4% | 6.4% | 29.1% |
همانطور که در جدول بالا دیده میشود، Claude Haiku 5.5 در هر شش معیار ارزیابی عملکرد بهتری از GPT-6 Luna دارد. این تفاوت بهویژه در استفاده از رایانه و کدنویسی عاملمحور چشمگیر است که Haiku 5.5 در آنها بهبودهای قابلتوجهی نسبت به نسل قبلی ارائه میدهد. بااینحال، این عملکرد بهتر هزینهای نیز دارد: مصرف بیشتر توکن. طبق آزمایشهای مستقلی که Artificial Analysis انجام داده، Claude Haiku 5.5 برای تکمیل وظایف معیارهای ارزیابی، در مقایسه با GPT-6 Luna توکنهای بسیار بیشتری مصرف میکند:
| معیار Artificial Analysis | Haiku 5.5 (Max) | GPT-6 Luna (Max) |
|---|---|---|
| Intelligence Index | 43 | 38 |
| میانگین توکنهای خروجی به ازای هر وظیفه | 162K | 50K |
| میانگین توکنهای استدلال به ازای هر وظیفه | 129K | 39K |
| میانگین هزینه به ازای هر وظیفه | 0.21 دلار | 0.07 دلار |
| سرعت خروجی | 243 توکن | 128 توکن |
| میانگین زمان به ازای هر وظیفه | 427s | 390s |
در حالی که Haiku 5.5 امتیاز هوشمندی بالاتری ارائه میدهد، در این مقایسه تقریباً 3.5 برابر توکن خروجی و نزدیک به 3.5 برابر توکن استدلال بیشتری برای هر وظیفه مصرف میکند. در نتیجه، میانگین هزینه هر وظیفه آن 3 برابر بیشتر از GPT-6 Luna است (آن هم با وجود قیمتگذاری یکسان به ازای هر توکن). Haiku 5.5 همچنین توکنها را بیش از 2 برابر سریعتر از Luna تولید میکند، اما مصرف بالاتر توکن باعث میشود تکمیل یک وظیفه معیار بهطور میانگین زمان بیشتری ببرد.
آنتروپیک همچنین ادعا میکند Claude Haiku 5.5 در مقایسه با Haiku 4.5 بهبودهای چشمگیری در زمینه ایمنی ارائه میدهد و موارد کمتری از رفتار ناهماهنگ با اهداف مورد انتظار و تمایل کمتری به همکاری در درخواستهای بالقوه مضر دارد. Anthropic همزمان با عرضه Haiku 5.5، اعتبار API ماهانه را برای مشترکان Claude Max و Team معرفی کرده است. کاربران Max 5x ماهانه 100 دلار اعتبار دریافت خواهند کرد، کاربران Max 20x مبلغ 200 دلار و مشترکان Team نیز حداکثر 500 دلار اعتبار تجمیعی دریافت خواهند کرد.
این اعتبارها را میتوان برای ساخت برنامهها و عاملها در مدلهای مختلف آنتروپیک استفاده کرد. Claude Haiku 5.5 هماکنون از طریق Claude Platform، Amazon Web Services، Google Cloud و Microsoft Azure در دسترس است.
هنوز نظری ثبت نشده
نظرات شما درباره «آنتروپیک مدل Claude Haiku 5.5 را...»اولین نفری باشید که نظر میدهید!
نظرات شما میتواند به بهبود محتوا و کمک به دیگران کمک کند.
ثبت اولین نظر