AI Compute Stack for Training and Inference | Dweve Core

Dweve Core is a complete AI compute stack for training and inference across supported CPU, GPU, FPGA and browser paths, with explicit determinism contracts.

Asystent kodowania i wsparcie operatora. Metryki demonstracyjne mają charakter poglądowy.

Terminal, wyszukiwanie, lint, testy, git i więcej.

Zapamiętuje kontekst Twojej bazy kodu i zespołu.

Wyspecjalizowani agenci współpracują w różnych obszarach.

Każdy krok jest rejestrowany z datą i godziną.

Zasady, kontrole i testy są zawsze uruchamiane.

Przeglądaj diffy, żądaj zmian, finalnie zatwierdzaj.

Odtwórz dowolną sesję bit po bicie, gdy coś wymaga przeglądu.

Przeczytaj retry.ts, wykryto błąd przekroczenia limitu czasu

Wyodrębnij guard + ogranicz liczbę ponowień

Autonomiczne agenty, które piszą kod i zostawiają ślad

do obsługi limitów czasu sieci, odpowiedzi 5xx i warunków bezpiecznych dla idempotencji. Czysta funkcja pomocnicza, w pełni pokryta testami jednostkowymi.

Deployment target, synthesis scaffolding

Runtime dispatcher, picks per call by target and policy

One operator definition, hand tuned kernels per ISA. If your silicon shipped in the last eight years, Core has a path to it.

Możliwość i determinizm określone dla każdej komórki

Bezpośrednie działanie na infrastrukturze kontrolowanej przez klienta

Jeden model, kilka ścieżek kontrolowanych przez dostawcę

definicja i wykonanie powoli się rozjeżdżają

Jedna powierzchnia operatora dla frameworka, silnika i kompilatora. Bez zewnętrznego kleju.

Core działa na Kera, deterministycznej reprezentacji pośredniej. Kera jest samym IR, nie nakładką na MLIR i nie jest zbudowany na LLVM. Wielopoziomowe obniżanie sprowadza graf neuronowy do kodu natywnego specyficznego dla sprzętu z fuzją.

Kompletny silnik treningowy z treningiem uwzględniającym kwantyzację, destylacją wiedzy, progresywną precyzją i treningiem rozproszonym. Silnik wnioskowania oferuje trzy tryby determinizmu i serwowanie produkcyjne.

DSL z bezpieczeństwem typów dla dowolnej architektury i dowolnej szerokości bitów. Komponuj z prymitywów lub istniejących warstw i dodawaj własne, korzystając z tej samej infrastruktury testowej co wbudowane.

Lub natywne jądra Rust dla każdego środowiska uruchomieniowego

Własne operacje, ten sam harness testowy

Dowolny typ danych, dowolna szerokość bitów

Autorowanie modelu z bezpieczeństwem typów

Runs on ordinary computers, where supported

Dowód rozpoczęty przez zarządzany Fabric może stanowić podstawę późniejszego przejścia na licencjonowane działanie Core, w tym fizycznie izolowanego licencjonowanego środowiska. Sam zarządzany Fabric nie obejmuje Core.

jedna ścieżka dowodu, dwa licencjonowane tryby działania

Obowiązki dotyczące danych określone dla każdego trybu

Prawa do przeniesienia tylko tam, gdzie przewidziano w umowie

Fizycznie izolowane licencjonowane wdrożenie dla środowisk, które nie tolerują połączenia zewnętrznego. Prawa do transferu technologii i niezależności są dostępne tylko tam, gdzie wybrany poziom Government and Critical Infrastructure je określa.

Obsługuj licencjonowany Core na własnych serwerach we własnym centrum danych. Twoi operatorzy trzymają klucze; escrow kodu źródłowego i prawa do kodu pozostają oddzielne, chyba że umowa wyraźnie je obejmuje.

Brak projektu sprzętowego do rozpoczęcia

Zbudowany w Holandii; granica operacyjna określona w umowie

Zarządzany Fabric to osobna usługa w publicznym Mesh i nie obejmuje dostępu do Core ani działania Core. Bezpośrednie działanie Core rozpoczyna się od licencji na infrastrukturę kontrolowaną przez klienta.

Dowód zarządzanego Fabric, bez dostępu do Core

Determinizm to ustawienie, a nie aspiracja. Zestaw testów go potwierdza, nie jest obiecany w opisie.

Przełączanie na żądanie, bez ponownego wdrażania.

wysyłanie: ten sam model całkowitoliczbowy/stałoprzecinkowy w każdym trybie

próbkowanie: temperatura 0.8, top p 0.95

core.infer(model, x, determinism="creative", temp=0.8)

Pełny niedeterminizm tam, gdzie jest pożądany. Próbkowanie z temperaturą, top k i top p. Ten sam model wysyłania ze złagodzonym determinizmem, bez osobnej ścieżki kodu.

ziarno: 42, to samo ziarno daje ten sam wynik

core.infer(model, x, determinism="seeded", seed=42)

Powtarzalny przy tym samym ziarnie, różne ziarna dają różne wyniki. Przydatny do testów A/B, przebiegów Monte Carlo i każdego przepływu pracy, w którym pożądana jest kontrolowana zmienność.

hash wyniku: stabilny na każdej platformie

odtworzenie: identyczne bity na każdej architekturze

core.infer(model, x, determinism="hard")

Kieruje przez zadeklarowaną arytmetykę całkowitoliczbową i stałoprzecinkową, eliminując zależny od platformy dryf arytmetyczny. Wyniki identyczne co do bitu na wszystkich obsługiwanych platformach. Tryb używany, gdy umowa lub organ regulacyjny wymaga powtarzalności.

Core liczy w prostszy, lżejszy sposób niż większość AI. Dlatego nie potrzebuje pokoju pełnego energochłonnych układów. Wystarczy komputer, który już masz.

Ponieważ działa na Twoim własnym urządzeniu, Twoje pytania i dokumenty nie muszą podróżować do odległej firmy. To, co wpisujesz, zostaje tam, gdzie możesz to zobaczyć.

Gdy Core udziela odpowiedzi, może pokazać kroki, które doprowadziły do niej, jak nauczyciel matematyki rozpisywujący działanie. Nie musisz przyjmować jej na wiarę.

Nigdy nie dotykasz silnika. Ale wszystko, co czujesz, prędkość, płynność, cisza, pochodzi od tego, jak dobrze został zbudowany. Większość AI opiera się na silnikach kupowanych z półki. Dweve zbudowało własny, więc działa dobrze na zwykłych komputerach i trzyma Twoje rzeczy przy Tobie.

Core, cichy silnik pod każdym produktem Dweve

Prosty w obsłudze, przyjazny dla portfela i zostaje Twój

Dweve powstał w Holandii, a tworzą go ludzie, którzy podlegają prawu europejskiemu. Za silnikiem, którego używasz, stoi prawdziwa firma i prawdziwe miejsce.

Zużywa znacznie mniej prądu niż sztuczna inteligencja, która wymaga ogromnych maszyn. Dzięki temu cena pozostaje niska, a darmowa wersja w ogóle może istnieć.

Gdy coś Ci powie, może pokazać, jak do tego doszedł, krok po kroku. Jeśli nie jest czegoś pewien, mówi to wprost, zamiast zgadywać i liczyć na szczęście.

Ponieważ silnik działa na Twoim własnym urządzeniu, działa nawet wtedy, gdy połączenie zniknie. Jak kalkulator, nie musi dzwonić do nikogo, aby wykonać swoją pracę.

Twoje listy, zdjęcia i pytania nie są wysyłane do odległego komputera. Zostają z Tobą, w Europie, na europejskich zasadach.

Nie musisz kupować niczego nowego ani drogiego. Jeśli Twój laptop może wyświetlić wideo, może uruchomić Dweve. Sprytna część jest wbudowana w silnik, a nie w kosztowną maszynę.

zapisano komórkę wykonawczą i kontrakt powtórki

12 rodzin docelowych, odniesienie skalarne

od binarnego do konwencjonalnego zmiennoprzecinkowego

Core zmienia podłoże, nie interfejs, który już znasz.

Twarda determinizm odtwarza wynik bit po bicie, na żądanie.

Zgodność jest montowana po tym, jak pojawią się trudne pytania.

Tylko ścieżki danych w UE, budowane i uruchamiane z Holandii.

Dane trafiają na zagraniczny hyperscaler pod obcym prawem.

96% mniej energii niż stos GPU, te same odpowiedzi za ułamek kosztów eksploatacji.

Generatywny stos GPU pobiera energię w megawatach.

CPU najpierw, na serwerach, które już posiadasz.

Klastry GPU, o które licytujesz z hyperscalerami.

Badania nad krawędziami i niskimi bitami. Część historii o 96% mniejszym zużyciu energii.

Kwantyzowany GEMM, notacja Q, płaszczyzna bitowa

Kwantyzowana inferencja i deterministyczny punkt stały.

Wewnętrzne trenowanie i warstwy wrażliwe na dokładność.

Szeroki punkt stały lub dokładny przez Numerus

Kontrakty determinizmu i kontrolne odniesienia.

25 rodzin numerycznych, bez wewnętrznej ścieżki FP

Wybierz wewnętrzną pamięć, akumulator i politykę wysyłki dla każdego operatora. Zewnętrzne dane zmiennoprzecinkowe są konwertowane na granicy, zanim kompilator zredukuje mieszankę do celu.

Każda wewnętrzna reprezentacja jest pełnoprawnym obywatelem, wbudowanym w operatora, a nie konfigurowanym po fakcie.

Zbudowany na Kera, deterministyczny z założenia

Ta sama praca, wykonana przez jeden silnik, który posiadasz, zamiast stosu narzędzi od różnych dostawców sklejonych razem.

Pięć cykli aktualizacji, pięć powierzchni bezpieczeństwa, pięć miejsc, w których może się zepsuć.

Każdy wynik można odtworzyć i sprawdzić.

Dane pozostają w Europie, na infrastrukturze, którą kontrolujesz.

Bez zakupu procesorów GPU, bez wojny przetargowej z dostawcami chmury.

Jedna umowa, jedna linia wsparcia, jeden cykl aktualizacji.

Format przechowywania nie jest typem akumulatora

Dweve Core to kompletny stos obliczeniowy AI do trenowania i wnioskowania. Większość platform AI obejmuje tylko wycinek, a resztę zostawia innym dostawcom. Core utrzymuje tworzenie modeli, trenowanie, wnioskowanie, jądra, dyspozytora i wdrażanie w jednym spójnym systemie. Przy obsługiwanych obciążeniach binarnych Core zużywa o 96% mniej energii niż stos GPU.

25 zarejestrowanych rodzin formatów numerycznych

Przy obsługiwanych obciążeniach binarnych.

Systemy częściowe tworzą trwałą zależność

Definicja i wykonanie powoli się rozjeżdżają.

Kompresja żyje w czyimś innym narzędziu.

Nowy sprzęt, nowy system obsługi, nowe zachowanie.

Mapa drogowa dostawcy staje się Twoją mapą drogową.

Żaden pojedynczy system nie wyjaśnia wyniku.