Am 18. Juli 2025 präsentieren unser Innovation Hacking Team im Rahmen unserer Kooperation mit dem Zentrum für Kunst und Medien (ZKM) in Karlsruhe beim Open Hertzlab einen...
Am 18. Juli 2025 präsentieren unser Innovation Hacking Team im Rahmen unserer Kooperation mit dem Zentrum für Kunst und Medien (ZKM) in Karlsruhe beim Open Hertzlab einen...
Heute veröffentlichen wir das neue DeepSeek-TNG R1T2 Chimera als ein Tri-Mind Assembly-of-Experts Large Language Model mit drei Elternmodellen: DeepSeek R1-0528, R1 und V3-0324.
Heute veröffentlichen wir DeepSeek-TNG R1T2 Chimera.
Das neue Chimera ist ein Tri-Mind Assembly-of-Experts Large Language Model mit drei Elternmodellen: DeepSeek R1-0528, R1 und...
Heute stellen wir World Foundational Models (WFMs) vor: umfangreiche generative KI-Systeme, die die Dynamik der realen Welt, einschließlich physikalischer und räumlicher...
Heute stellen wir World Foundational Models (WFMs) vor: umfangreiche generative KI-Systeme, die die Dynamik der realen Welt, einschließlich physikalischer und räumlicher...
Das neue Paper ist nun veröffentlich erklärt, wie wir unser 671B R1T Chimera Tochtermodell in weniger als einer Stunde CPU-Zeit aus bekannten Basismodellen konstruiert haben.
Unser neues Paper „Assembly of Experts: Linear-time construction of the Chimera LLM variants with emergent and adaptable behaviors” ist jetzt sowohl auf arXiv als auch auf Hugging...
Bei TNG verarbeiten unsere LLMs täglich mehr als 100 Millionen Token, um über 10 Millionen Token für 50+ verschiedene Anwendungen zu generieren. Um dies effizient zu verarbeiten...
Bei TNG verarbeiten unsere LLMs täglich mehr als 100 Millionen Token, um über 10 Millionen Token für 50+ verschiedene Anwendungen zu generieren. Um dies effizient zu verarbeiten...
Unser neuer Artikel zeigt, wie Sie veralteten Legacy-Code mit Künstlicher Intelligenz modernisieren und auf eine neue Java-Version migrieren können.
Unser Artikel „KI-gestützte Java-Migration“ zeigt Ihnen, wie Sie veralteten Legacy-Code mit Künstlicher Intelligenz modernisieren und auf eine neue Java-Version migrieren können.
Unser 24-Stunden Follow the Sun Hackathon brachte 19 Kolleginnen und Kollegen aus Australien, Deutschland, Ungarn und dem Vereinigten Königreich zusammen. Einen ganzen Tag lang...
Unser 24-Stunden Follow the Sun Hackathon brachte 19 Kolleginnen und Kollegen aus Australien, Deutschland, Ungarn und dem Vereinigten Königreich zusammen. Einen ganzen Tag lang...
Unser Roboter "G1PO" hat mit Hilfe von Reinforcement Learning erfolgreich das Laufen beigebracht bekommen.
In den vergangenen Wochen hat unser Innovation Hacking Team unserem Unitree G1 Roboter "G1PO" mit Hilfe von Reinforcement Learning erfolgreich das Laufen beigebracht....
Acht neue AMD MI325X GPUs haben unser bestehendes Rechencluster aus 24 H100 GPUs erweitert. Der neue Supermicro-Server ist ein hochleistungsfähiger KI-Server mit 2 Terabyte...
Acht neue AMD MI325X GPUs haben unser bestehendes Rechencluster aus 24 H100 GPUs erweitert. Der neue Supermicro-Server ist ein hochleistungsfähiger KI-Server mit 2 Terabyte...
Das DeepSeek-R1T-Chimera, ein Open-Weights-Modell, das die Reasoning-Fähigkeiten von R1 zu DeepSeek AI V3-0324 hinzufügt, wurde veröffentlicht.
Am Wochenende haben wir DeepSeek-R1T-Chimera veröffentlicht. Dabei handelt es sich um ein Open-Weights-Modell, das die Reasoning-Fähigkeiten von R1 zu DeepSeek AI V3-0324...
Zur Automatisierung von internen Arbeitsabläufe haben wir kürzlich ein KI-gestütztes Fine-Tuning vorgenommen.
Wir haben kürzlich ein Fine-Tuning eines auf olmOCR basierenden KI-Modells für optische Zeichenerkennung (OCR) vorgenommen, um unsere internen Arbeitsabläufe bei der Verarbeitung...