Heute veröffentlichen wir das neue DeepSeek-TNG R1T2 Chimera als ein Tri-Mind Assembly-of-Experts Large Language Model mit drei Elternmodellen: DeepSeek R1-0528, R1 und V3-0324.
Heute veröffentlichen wir DeepSeek-TNG R1T2 Chimera.
Das neue Chimera ist ein Tri-Mind Assembly-of-Experts Large Language Model mit drei Elternmodellen: DeepSeek R1-0528, R1 und...
Das neue Paper ist nun veröffentlich erklärt, wie wir unser 671B R1T Chimera Tochtermodell in weniger als einer Stunde CPU-Zeit aus bekannten Basismodellen konstruiert haben.
Unser neues Paper „Assembly of Experts: Linear-time construction of the Chimera LLM variants with emergent and adaptable behaviors” ist jetzt sowohl auf arXiv als auch auf Hugging...
Wir haben UnitTestGen entwickelt, ein spezialisiertes Tool für die automatisierte und effiziente Generierung von Unit Tests.
Wir haben UnitTestGen entwickelt, ein spezialisiertes Tool für die automatisierte und effiziente Generierung von Unit Tests. Unit Tests sind wichtig, um Code-Qualität und...
Unser neuer Artikel zeigt, wie Sie veralteten Legacy-Code mit Künstlicher Intelligenz modernisieren und auf eine neue Java-Version migrieren können.
Unser Artikel „KI-gestützte Java-Migration“ zeigt Ihnen, wie Sie veralteten Legacy-Code mit Künstlicher Intelligenz modernisieren und auf eine neue Java-Version migrieren können.
Unser Atlassian-Apps Team hat die App „Rotate Images for Confluence“ zu „Dark Mode and Rotation for Confluence Images“ weiterentwickelt.
Unser Atlassian-Apps Team hat die App „Rotate Images for Confluence“ zu „Dark Mode and Rotation for Confluence Images“ weiterentwickelt. Nutzerinnen und Nutzer profitieren jetzt...
Unser 24-Stunden Follow the Sun Hackathon brachte 19 Kolleginnen und Kollegen aus Australien, Deutschland, Ungarn und dem Vereinigten Königreich zusammen. Einen ganzen Tag lang...
Unser 24-Stunden Follow the Sun Hackathon brachte 19 Kolleginnen und Kollegen aus Australien, Deutschland, Ungarn und dem Vereinigten Königreich zusammen. Einen ganzen Tag lang...
Unser Roboter "G1PO" hat mit Hilfe von Reinforcement Learning erfolgreich das Laufen beigebracht bekommen.
In den vergangenen Wochen hat unser Innovation Hacking Team unserem Unitree G1 Roboter "G1PO" mit Hilfe von Reinforcement Learning erfolgreich das Laufen beigebracht....
Acht neue AMD MI325X GPUs haben unser bestehendes Rechencluster aus 24 H100 GPUs erweitert. Der neue Supermicro-Server ist ein hochleistungsfähiger KI-Server mit 2 Terabyte...
Acht neue AMD MI325X GPUs haben unser bestehendes Rechencluster aus 24 H100 GPUs erweitert. Der neue Supermicro-Server ist ein hochleistungsfähiger KI-Server mit 2 Terabyte...
Das DeepSeek-R1T-Chimera, ein Open-Weights-Modell, das die Reasoning-Fähigkeiten von R1 zu DeepSeek AI V3-0324 hinzufügt, wurde veröffentlicht.
Am Wochenende haben wir DeepSeek-R1T-Chimera veröffentlicht. Dabei handelt es sich um ein Open-Weights-Modell, das die Reasoning-Fähigkeiten von R1 zu DeepSeek AI V3-0324...
Zur Automatisierung von internen Arbeitsabläufe haben wir kürzlich ein KI-gestütztes Fine-Tuning vorgenommen.
Wir haben kürzlich ein Fine-Tuning eines auf olmOCR basierenden KI-Modells für optische Zeichenerkennung (OCR) vorgenommen, um unsere internen Arbeitsabläufe bei der Verarbeitung...
Das neueste Mitglied des TNG-Teams stellt sich vor🤖 Das ist unser Unitree G1 Roboter „G1PO“. Angetrieben von insgesamt 43 Motoren, navigiert er mit einer Geschwindigkeit von 2...
Das neueste Mitglied des TNG-Teams stellt sich vor🤖 Das ist unser Unitree G1 Roboter „G1PO“. Angetrieben von insgesamt 43 Motoren, navigiert er mit einer Geschwindigkeit von 2...