AI Compute Stack for Training and Inference | Dweve Core
Dweve Core is a complete AI compute stack for training and inference across supported CPU, GPU, FPGA and browser paths, with explicit determinism contracts.
Asystent kodowania i wsparcie operatora. Metryki demonstracyjne mają charakter poglądowy.
Terminal, wyszukiwanie, lint, testy, git i więcej.
Zapamiętuje kontekst Twojej bazy kodu i zespołu.
Wyspecjalizowani agenci współpracują w różnych obszarach.
Każdy krok jest rejestrowany z datą i godziną.
Zasady, kontrole i testy są zawsze uruchamiane.
Przeglądaj diffy, żądaj zmian, finalnie zatwierdzaj.
Odtwórz dowolną sesję bit po bicie, gdy coś wymaga przeglądu.
Przeczytaj retry.ts, wykryto błąd przekroczenia limitu czasu
Wyodrębnij guard + ogranicz liczbę ponowień
Autonomiczne agenty, które piszą kod i zostawiają ślad
do obsługi limitów czasu sieci, odpowiedzi 5xx i warunków bezpiecznych dla idempotencji. Czysta funkcja pomocnicza, w pełni pokryta testami jednostkowymi.
Deployment target, synthesis scaffolding
Runtime dispatcher, picks per call by target and policy
One operator definition, hand tuned kernels per ISA. If your silicon shipped in the last eight years, Core has a path to it.
Możliwość i determinizm określone dla każdej komórki
Bezpośrednie działanie na infrastrukturze kontrolowanej przez klienta
Jeden model, kilka ścieżek kontrolowanych przez dostawcę
definicja i wykonanie powoli się rozjeżdżają
Jedna powierzchnia operatora dla frameworka, silnika i kompilatora. Bez zewnętrznego kleju.
Core działa na Kera, deterministycznej reprezentacji pośredniej. Kera jest samym IR, nie nakładką na MLIR i nie jest zbudowany na LLVM. Wielopoziomowe obniżanie sprowadza graf neuronowy do kodu natywnego specyficznego dla sprzętu z fuzją.
Kompletny silnik treningowy z treningiem uwzględniającym kwantyzację, destylacją wiedzy, progresywną precyzją i treningiem rozproszonym. Silnik wnioskowania oferuje trzy tryby determinizmu i serwowanie produkcyjne.
DSL z bezpieczeństwem typów dla dowolnej architektury i dowolnej szerokości bitów. Komponuj z prymitywów lub istniejących warstw i dodawaj własne, korzystając z tej samej infrastruktury testowej co wbudowane.
Lub natywne jądra Rust dla każdego środowiska uruchomieniowego
Własne operacje, ten sam harness testowy
Dowolny typ danych, dowolna szerokość bitów
Autorowanie modelu z bezpieczeństwem typów
Runs on ordinary computers, where supported
Dowód rozpoczęty przez zarządzany Fabric może stanowić podstawę późniejszego przejścia na licencjonowane działanie Core, w tym fizycznie izolowanego licencjonowanego środowiska. Sam zarządzany Fabric nie obejmuje Core.
jedna ścieżka dowodu, dwa licencjonowane tryby działania
Obowiązki dotyczące danych określone dla każdego trybu
Prawa do przeniesienia tylko tam, gdzie przewidziano w umowie
Fizycznie izolowane licencjonowane wdrożenie dla środowisk, które nie tolerują połączenia zewnętrznego. Prawa do transferu technologii i niezależności są dostępne tylko tam, gdzie wybrany poziom Government and Critical Infrastructure je określa.
Obsługuj licencjonowany Core na własnych serwerach we własnym centrum danych. Twoi operatorzy trzymają klucze; escrow kodu źródłowego i prawa do kodu pozostają oddzielne, chyba że umowa wyraźnie je obejmuje.
Brak projektu sprzętowego do rozpoczęcia
Zbudowany w Holandii; granica operacyjna określona w umowie
Zarządzany Fabric to osobna usługa w publicznym Mesh i nie obejmuje dostępu do Core ani działania Core. Bezpośrednie działanie Core rozpoczyna się od licencji na infrastrukturę kontrolowaną przez klienta.
Dowód zarządzanego Fabric, bez dostępu do Core
Determinizm to ustawienie, a nie aspiracja. Zestaw testów go potwierdza, nie jest obiecany w opisie.
Przełączanie na żądanie, bez ponownego wdrażania.
wysyłanie: ten sam model całkowitoliczbowy/stałoprzecinkowy w każdym trybie
próbkowanie: temperatura 0.8, top p 0.95
core.infer(model, x, determinism="creative", temp=0.8)
Pełny niedeterminizm tam, gdzie jest pożądany. Próbkowanie z temperaturą, top k i top p. Ten sam model wysyłania ze złagodzonym determinizmem, bez osobnej ścieżki kodu.
ziarno: 42, to samo ziarno daje ten sam wynik
core.infer(model, x, determinism="seeded", seed=42)
Powtarzalny przy tym samym ziarnie, różne ziarna dają różne wyniki. Przydatny do testów A/B, przebiegów Monte Carlo i każdego przepływu pracy, w którym pożądana jest kontrolowana zmienność.
hash wyniku: stabilny na każdej platformie
odtworzenie: identyczne bity na każdej architekturze
core.infer(model, x, determinism="hard")
Kieruje przez zadeklarowaną arytmetykę całkowitoliczbową i stałoprzecinkową, eliminując zależny od platformy dryf arytmetyczny. Wyniki identyczne co do bitu na wszystkich obsługiwanych platformach. Tryb używany, gdy umowa lub organ regulacyjny wymaga powtarzalności.
Core liczy w prostszy, lżejszy sposób niż większość AI. Dlatego nie potrzebuje pokoju pełnego energochłonnych układów. Wystarczy komputer, który już masz.
Ponieważ działa na Twoim własnym urządzeniu, Twoje pytania i dokumenty nie muszą podróżować do odległej firmy. To, co wpisujesz, zostaje tam, gdzie możesz to zobaczyć.
Gdy Core udziela odpowiedzi, może pokazać kroki, które doprowadziły do niej, jak nauczyciel matematyki rozpisywujący działanie. Nie musisz przyjmować jej na wiarę.
Nigdy nie dotykasz silnika. Ale wszystko, co czujesz, prędkość, płynność, cisza, pochodzi od tego, jak dobrze został zbudowany. Większość AI opiera się na silnikach kupowanych z półki. Dweve zbudowało własny, więc działa dobrze na zwykłych komputerach i trzyma Twoje rzeczy przy Tobie.
Core, cichy silnik pod każdym produktem Dweve
Prosty w obsłudze, przyjazny dla portfela i zostaje Twój
Dweve powstał w Holandii, a tworzą go ludzie, którzy podlegają prawu europejskiemu. Za silnikiem, którego używasz, stoi prawdziwa firma i prawdziwe miejsce.
Zużywa znacznie mniej prądu niż sztuczna inteligencja, która wymaga ogromnych maszyn. Dzięki temu cena pozostaje niska, a darmowa wersja w ogóle może istnieć.
Gdy coś Ci powie, może pokazać, jak do tego doszedł, krok po kroku. Jeśli nie jest czegoś pewien, mówi to wprost, zamiast zgadywać i liczyć na szczęście.
Ponieważ silnik działa na Twoim własnym urządzeniu, działa nawet wtedy, gdy połączenie zniknie. Jak kalkulator, nie musi dzwonić do nikogo, aby wykonać swoją pracę.
Twoje listy, zdjęcia i pytania nie są wysyłane do odległego komputera. Zostają z Tobą, w Europie, na europejskich zasadach.
Nie musisz kupować niczego nowego ani drogiego. Jeśli Twój laptop może wyświetlić wideo, może uruchomić Dweve. Sprytna część jest wbudowana w silnik, a nie w kosztowną maszynę.
zapisano komórkę wykonawczą i kontrakt powtórki
12 rodzin docelowych, odniesienie skalarne
od binarnego do konwencjonalnego zmiennoprzecinkowego
Core zmienia podłoże, nie interfejs, który już znasz.
Twarda determinizm odtwarza wynik bit po bicie, na żądanie.
Zgodność jest montowana po tym, jak pojawią się trudne pytania.
Tylko ścieżki danych w UE, budowane i uruchamiane z Holandii.
Dane trafiają na zagraniczny hyperscaler pod obcym prawem.
96% mniej energii niż stos GPU, te same odpowiedzi za ułamek kosztów eksploatacji.
Generatywny stos GPU pobiera energię w megawatach.
CPU najpierw, na serwerach, które już posiadasz.
Klastry GPU, o które licytujesz z hyperscalerami.
Badania nad krawędziami i niskimi bitami. Część historii o 96% mniejszym zużyciu energii.
Kwantyzowany GEMM, notacja Q, płaszczyzna bitowa
Kwantyzowana inferencja i deterministyczny punkt stały.
Wewnętrzne trenowanie i warstwy wrażliwe na dokładność.
Szeroki punkt stały lub dokładny przez Numerus
Kontrakty determinizmu i kontrolne odniesienia.
25 rodzin numerycznych, bez wewnętrznej ścieżki FP
Wybierz wewnętrzną pamięć, akumulator i politykę wysyłki dla każdego operatora. Zewnętrzne dane zmiennoprzecinkowe są konwertowane na granicy, zanim kompilator zredukuje mieszankę do celu.
Każda wewnętrzna reprezentacja jest pełnoprawnym obywatelem, wbudowanym w operatora, a nie konfigurowanym po fakcie.
Zbudowany na Kera, deterministyczny z założenia
Ta sama praca, wykonana przez jeden silnik, który posiadasz, zamiast stosu narzędzi od różnych dostawców sklejonych razem.
Pięć cykli aktualizacji, pięć powierzchni bezpieczeństwa, pięć miejsc, w których może się zepsuć.
Każdy wynik można odtworzyć i sprawdzić.
Dane pozostają w Europie, na infrastrukturze, którą kontrolujesz.
Bez zakupu procesorów GPU, bez wojny przetargowej z dostawcami chmury.
Jedna umowa, jedna linia wsparcia, jeden cykl aktualizacji.
Format przechowywania nie jest typem akumulatora
Dweve Core to kompletny stos obliczeniowy AI do trenowania i wnioskowania. Większość platform AI obejmuje tylko wycinek, a resztę zostawia innym dostawcom. Core utrzymuje tworzenie modeli, trenowanie, wnioskowanie, jądra, dyspozytora i wdrażanie w jednym spójnym systemie. Przy obsługiwanych obciążeniach binarnych Core zużywa o 96% mniej energii niż stos GPU.
25 zarejestrowanych rodzin formatów numerycznych
Przy obsługiwanych obciążeniach binarnych.
Systemy częściowe tworzą trwałą zależność
Definicja i wykonanie powoli się rozjeżdżają.
Kompresja żyje w czyimś innym narzędziu.
Nowy sprzęt, nowy system obsługi, nowe zachowanie.
Mapa drogowa dostawcy staje się Twoją mapą drogową.
Żaden pojedynczy system nie wyjaśnia wyniku.