SmartDigest.ai Tworzone przez AI, żeby nadążyć za AI
Zapisz się

Zapisz się do newslettera

Co tydzień najważniejsze newsy AI prosto na Twój e-mail. Wybierz tematy, które Cię interesują.

Premiera / Narzędzie

Jedna faktura czy pełne API? Claude w Azure każe wybrać

Od 29 czerwca modele Claude'a są ogólnie dostępne w Microsoft Foundry, a Anthropic każe zespołom z Azure wybrać jedne z dwojga drzwi. Wariant "hosted on Azure" zamyka rozliczenie na jednej fakturze i wpina model w firmowy nadzór, ale daje tylko Opus 4.8 i Haiku 4.5 przez Messages API. Druga ścieżka, przez Anthropic, oferuje pełne API i wszystkie modele kosztem osobnego rozliczenia. Za wygodę jednej faktury płaci się więc kompletnością, choć prompt caching i rozszerzone myślenie działają od startu. Anthropic zapowiada zrównanie obu ścieżek, ale terminu nie podaje.

Napisała AI, żeby oszczędzić Ci czytania setek źródeł.  ·  Jak to działa

Premiera / Narzędzie  ·  4 min  · 

Jedna faktura czy pełne API? Claude w Azure każe wybrać
Ilustrację przygotowała AI.

Modele Claude można od 29 czerwca uruchamiać bezpośrednio w Microsoft Foundry, katalogu modeli, z którego korzysta się przy budowaniu aplikacji na Azure. Na pierwszy rzut oka to kolejny wpis z gatunku "model X trafił do chmury Y", z obowiązkowym cytatem o serwerowych kartach NVIDIA GB300 w tle, tych, na których takie modele w ogóle działają. Ale dla zespołu, który już rozlicza się z Microsoftem, jest tu realna decyzja do podjęcia: Anthropic otwiera dwoje drzwi do tego samego modelu i każe wybrać jedne z nich. To ten wybór, a nie logo w komunikacie, jest właściwą treścią tego ogłoszenia.

Pierwsze drzwi to wariant "hosted on Azure" i to on jest sednem premiery. Claude działa wtedy w twoim środowisku Azure i podłącza się pod to, czym już zarządzasz: logowanie, sieć, reguły dostępu. Rozliczenie idzie na jedną fakturę Azure, a firmy, które mają z Microsoftem umowę ramową Enterprise Agreement i już zobowiązały się wydać u niego z góry ustaloną kwotę, mogą wliczyć w to zobowiązanie także wydatki na Claude'a. Każdy, kto kiedyś przepychał nowego dostawcę AI przez firmowy dział zakupów i bezpieczeństwa, wie, że to nie kosmetyka. Wpięcie modelu w rozliczenie i nadzór bywa większym bólem niż samo wywołanie API i dokładnie ten ból zdejmuje właśnie ten wariant. Inferencję prowadzi Anthropic jako podmiot przetwarzający dane, a całe przetwarzanie można zamknąć w amerykańskiej strefie danych, jeśli firma ma wymogi co do tego, gdzie fizycznie lądują dane.

Uwaga dla zespołów z Europy: ta amerykańska strefa danych rozwiązuje problem firm, które muszą trzymać przetwarzanie w USA, a niekoniecznie tych, które muszą je trzymać w Unii. Zanim uznasz sprawę za załatwioną, sprawdź, czy dostępna strefa odpowiada temu, czego wymaga akurat twój dział prawny.

Czytaj dalej za darmo

Podaj e-mail, aby odblokować pełną treść i cały serwis. Zapiszemy Cię do newslettera.

Powiązane

Cennik zamiast premiery: co strona z modelami Anthropic naprawdę mówi deweloperowi Model / Badania

Cennik zamiast premiery: co strona z modelami Anthropic naprawdę mówi deweloperowi

4 min

Strona z przeglądem modeli Anthropic to nie zapowiedź, tylko cennik: Claude Fable 5, najmocniejszy szeroko dostępny model, kosztuje 10 dolarów za milion tokenów wejścia i 50 za wyjścia, dwa razy tyle co domyślnie polecany Opus 4.8 przy identycznym oknie miliona tokenów. We Fable znika suwak sterujący długością myślenia, model zawsze sam decyduje, ile czasu poświęcić. Bliźniaczy Mythos 5 ma te same parametry, ale trafia tylko do klientów programu Project Glasswing. Benchmarków brak, więc czy podwójna stawka się zwraca, każdy musi sprawdzić na własnym kodzie.

Harness decyduje o rachunku za agenta bardziej niż sam model Premiera / Narzędzie

Harness decyduje o rachunku za agenta bardziej niż sam model

5 min

TrueFoundry wypuściło 19 sierpnia TrueForge, otwarty harness agentowy na licencji MIT, obiecując o połowę niższe koszty, choć takiej liczby nie ma w benchmarku opublikowanym razem z kodem. Na 14 zadaniach z Enterprise-Bench przy tym samym Opusie 4.8 TrueForge dorównał skutecznością Claude Managed Agents za 8,5 dolara na uruchomienie zamiast 11,8, bo przycina kontekst i zużył 4 miliony tokenów zamiast 10. Drugą oszczędność, do 2,9 dolara, zrobiła podmiana modelu na otwarty GLM-5.2, a nie sam harness, a obiecana kontrola kosztów i uprawnień działa dopiero przez komercyjny AI Gateway.

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu Model / Badania

Anthropic radzi w pierwszym akapicie, żeby zostać przy tańszym modelu

5 min

Anthropic wypuścił 1 września Claude Fable 5.1 i już w pierwszym akapicie notatek o wydaniu poradził, żeby do większości zadań zostać przy tańszym Opusie 5. Cennik wejścia zostaje na 10 dolarach za milion tokenów, a prawdziwy koszt przesiadki leży w kodzie, bo model podpisuje bloki rozumowania stanem rozmowy i wycięcie starej tury czy odświeżenie daty w prompcie kończy się trwałym błędem 400. Nowe konta mają tę kontrolę domyślnie, starsze jeszcze nie, więc twój klucz może działać bez zarzutu, a pierwszy użytkownik z nowego konta zobaczy błąd, którego nigdy nie widziałeś.