Alle Modelle, die du im Chat und über die API nutzen kannst - mit ihren technischen Eckdaten. Ein Teil läuft bei uns auf Wynentaler Boden, der Rest über Schweizer Partner.
Wyna AI Produkte
Stabile Namen, keine fixen Modelle: Im Chat und über die API nutzt du Wyna AI Pro und Wyna AI Lite - wir halten das Modell dahinter aktuell und tauschen es im Hintergrund aus, deine Konfiguration läuft unverändert weiter. Die Specs der derzeit hinterlegten Modelle stehen unten.
| Produkt | derzeit |
|---|---|
wyna-pro - Wyna AI ProUnser jeweils stärkstes Modell für anspruchsvolle Aufgaben |
DeepSeek V4 Flash |
wyna-lite - Wyna AI LiteUnser schlankes, günstiges Modell für Alltagsaufgaben |
Qwen 3.6 35B |
Bei uns gehostet
Läuft auf unserer eigenen Infrastruktur in Unterkulm - keine Daten verlassen die Schweiz, keine Weitergabe an Dritte.
| Modell | Parameter | Kontext | Modalitäten | Reasoning |
|---|---|---|---|---|
deepseek-v4-flash - DeepSeek V4 FlashMoE-Modell mit 1 Mio. Token Kontext - stark in Analyse, Code und grossen Dokumenten |
284 Mrd. 13 Mrd. aktiv (MoE) |
1 Mio. Token | Text | Ja |
qwen36-35b - Qwen 3.6 35BSchnelles MoE-Modell mit Bildverständnis - effizient für Alltagsaufgaben |
35 Mrd. 3 Mrd. aktiv (MoE) |
128K Token | Text & Bild | Optional |
Bildgenerierung
wyna-image - Bildgenerierung - Text-zu-Bild, ebenfalls bei uns in Unterkulm gehostet - derzeit Qwen-Image-2512.
20 Mrd. Parameter (Diffusion-Transformer) - freie Auflösung bis 2 Megapixel - besonders stark bei Text im Bild. Abrechnung pro Megapixel (siehe Preise) - auch per API nutzbar (A1111-kompatibel).
Embeddings, Reranking & Transkription
Die Bausteine hinter Dokumenten-Analyse und Diktat - ebenfalls bei uns gehostet und auch direkt per API nutzbar.
| Modell | Aufgabe | Abrechnung |
|---|---|---|
wyna-embed - EmbeddingsWandelt Text in Vektoren für Suche und RAG - BGE-M3 (multilingual, 1024 Dimensionen) - auch per API nutzbar |
Embeddings | pro 1 Mio. Tokens |
wyna-rerank - RerankerSortiert Suchtreffer nach Relevanz zur Anfrage - BGE-Reranker-v2-M3 - auch per API nutzbar |
Reranking | pro 1 Mio. Tokens |
wyna-stt-german - Transkription (Schweizerdeutsch)Übersetzt gesprochenes Schweizerdeutsch und weitere Sprachen in Deutschen Text - FlixAI Swissgerman - auch per API nutzbar |
Speech-to-Text | pro Minute Audio |
wyna-stt - Transkription (Multilingual)Transkribiert Englisch, Deutsch, Französisch, usw. ohne Übersetzung - Whisper Large v3 Turbo - auch per API nutzbar |
Speech-to-Text | pro Minute Audio |
Über unsere Schweizer Partner
Zusätzliche Modelle über Schweizer Partner - für Fälle, in denen ein anderes Modell besser passt.
| Modell | Parameter | Kontext | Modalitäten | Reasoning |
|---|---|---|---|---|
mistral-small-4 - Mistral Small 4Vielseitig, mit Bildverständnis |
119 Mrd. 6,5 Mrd. aktiv (MoE) |
256K Token | Text & Bild | Optional |
kimi-k2.6 - Kimi K2.6Für anspruchsvolle & agentische Aufgaben |
1 Bio. 32 Mrd. aktiv (MoE) |
256K Token | Text & Bild | Ja |
apertus-70b - Apertus 70BOffenes Schweizer Modell (ETH Zürich & EPFL) |
70 Mrd. dicht (dense) |
64K Token | Text | Nein |
Legende. Parameter: Gesamtgrösse; bei MoE-Modellen ist nur ein Teil pro Anfrage aktiv (schneller & günstiger). Kontext: maximale Länge von Ein- und Ausgabe zusammen, in Token (1 Mio. Token ≈ 700'000 Wörter). Reasoning: das Modell kann vor der Antwort „nachdenken" - Optional heisst zuschaltbar.
Aktuelle Live-Liste jederzeit über GET /v1/models. Wie du Modelle im Code auswählst und die stabilen Tags nutzt, steht in der API-Anleitung.