Anthropic ogłosiło premierę modeli Claude Fable 5.1 oraz Mythos 5.1. Producent informuje, że nowe wersje rozwiązują problemy z kosztami eksploatacji, przechowywaniem danych oraz nadmiernie restrykcyjnymi mechanizmami bezpieczeństwa.
Szczegóły ogłoszenia nowych modeli
Anthropic przedstawiło dwa nowe modele językowe: Claude Fable 5.1 oraz Mythos 5.1. Claude Fable 5.1 jest już dostępny na wszystkich platformach, podczas gdy Mythos 5.1 trafił wyłącznie do uczestników programu Project Glasswing. Firma podkreśla, że aktualizacje stanowią odpowiedź na wcześniejsze uwagi klientów dotyczące kosztów oraz zbyt rygorystycznych filtrów bezpieczeństwa. Wczesne opinie użytkowników, w tym Dana Shippera, dyrektora generalnego Every, wskazują na poprawę efektywności przetwarzania tokenów i bardziej naturalny styl komunikacji modelu. Sprawa praw autorskich pokazuje, że Anthropic nadal musi mierzyć się z wyzwaniami regulacyjnymi przy rozwoju technologii.
Zmiany w modelu cenowym
Nowe modele wprowadzają znaczące obniżki cen, szczególnie widoczne w przypadku zadań realizowanych przez agentów AI. Anthropic podaje, że Fable 5.1 jest zazwyczaj o 25 procent tańszy niż poprzednia wersja, a przy złożonych procesach agentycznych oszczędności mogą sięgać 45 procent dzięki obniżkom za dane przechowywane w pamięci podręcznej. Cena za tokeny w pamięci podręcznej (cached) została zredukowana w sposób, który bezpośrednio wpływa na koszty długich interakcji. Analitycy rynku wskazują, że takie zmiany mogą przyspieszyć wdrażanie agentów AI w firmach przetwarzających duże wolumeny danych. Jednocześnie nie opublikowano jeszcze szczegółowych cenników dla planów korporacyjnych. Model Standardowa cena Cena agentyczna Zmiana vs 5.0 Fable 5.1 -25% -45% niższa Mythos 5.1 brak danych brak danych porównywalna
Opinie użytkowników i wyniki testów wydajności
Wczesne testy wskazują na poprawę wydajności w zadaniach programistycznych. Aaron Levie, dyrektor generalny Box, zauważył, że agent korzystający z Fable 5.1 lepiej radzi sobie z niejednoznacznościami w danych niż poprzednia wersja. Użytkownik Lisan al Gaib zwrócił uwagę, że Mythos 5.1 przy niskim poziomie rozumowania osiąga wyniki porównywalne z poprzednikiem ustawionym na tryb maksymalny. Najskuteczniejszy model do kodowania - tak opisał Fable 5.1 Dan Shipper. Te opinie sugerują, że Anthropic skupiło się nie tylko na obniżeniu kosztów, ale również na efektywności obliczeniowej.
Zmiany w zabezpieczeniach i prywatności
Anthropic wprowadziło bardziej precyzyjne filtry bezpieczeństwa. Fable 5.1 rzadziej blokuje podstawowe pytania z zakresu biologii niż Fable 5, natomiast Mythos 5.1 zachowuje wcześniejsze ograniczenia w tej dziedzinie. Firma zapowiedziała też funkcję Enterprise Frontier Safeguards, która ma zapewnić przechowywanie danych wyłącznie na serwerach klienta. Pełna prywatność danych ma zostać osiągnięta poprzez rezygnację z ich przetrzymywania na infrastrukturze Anthropic. Rozwiązanie zacznie być wdrażane jesienią bieżącego roku.
Ograniczenia w zastosowaniach z zakresu cyberbezpieczeństwa
Fable 5.1 otrzymało możliwość identyfikacji luk w oprogramowaniu. Jednocześnie Anthropic nadal przekierowuje niektóre zadania związane z cyberbezpieczeństwem do modeli z rodziny Opus. Dotyczy to między innymi testów penetracyjnych, generowania exploitów oraz skanowania luk na poziomie binarnym. Przekierowanie do modeli Opus ma ograniczyć ryzyko nadużyć. Decyzja ta pokazuje ostrożne podejście firmy do zastosowań o wysokim potencjale szkodliwości.
Znaczenie dla rynku i dalszy rozwój
Obniżki cen oraz zmiany w zabezpieczeniach mogą wpłynąć na konkurencję na rynku dużych modeli językowych. Firmy rozwijające agentów AI zyskują narzędzie o niższych kosztach operacyjnych, co może przyspieszyć wdrożenia w sektorach wymagających intensywnego przetwarzania danych. Ostrzeżenia OpenAI dotyczące ataków z użyciem agentów wskazują, że podobne ograniczenia mogą stać się standardem branżowym. Pozostaje pytanie, jak szybko konkurenci odpowiedzą na zmiany cenowe Anthropic i czy nowe modele rzeczywiście zmniejszą liczbę bezzasadnych blokad bez zwiększania ryzyka nadużyć.
Źródła:
The Verge, https://www.theverge.com/ai-artificial-intelligence/987830/anthropic-claude-fable-mythos-5-1