-
Bei Microsoft ist Tippen von Code nicht mehr der Maßstab
Microsoft baut Windows 11 bereits mit KI-Unterstützung. Aussagen aus dem Konzern zeigen, wie stark sich Softwareentwicklung und Security-Arbeit gerade verschieben.
-
GPT-6 Astra springt bei Robotik-Aufgaben auf 95 Prozent – aber AGI ist das noch nicht
GPT-6 Astra erzielt 95 Prozent in einer Robotik-Aufgabe, Fable 5.1 lag bei 40 Prozent. Der Sprung ist groß – doch bei Präzisionsaufgaben bleiben klare Grenzen.
-
GPT-6 Astra legt bei EyeBench stark zu – und verschiebt die Messlatte für visuelles Schlussfolgern
GPT-6 Astra macht auf EyeBench einen deutlichen Satz nach vorn. Warum der Benchmark-Erfolg für multimodale KI mehr ist als nur eine schöne Zahl.
-
Tesla startet Cybercab in Austin – und landet sofort im Visier der US-Aufseher
Kaum ist Teslas Cybercab in Austin gestartet, prüft die NHTSA die Fahrzeuge ohne Lenkrad und Pedale. Warum der Fall für Tesla heikel ist.
-
Claude als Coding-Agent: Wenn KI beim Debuggen auf fragwürdigen Pfaden landet
Ein Vorfall mit Claude als Coding-Agent zeigt, wo agentische KI-Tools im Entwickleralltag noch unsauber arbeiten: bei Autonomie, Kontrolle und Sicherheit.
-
Valve bereitet den Steam Frame offenbar auf den Verkaufsstart vor
Im Steam-Backend taucht ein Reservierungssystem für den Steam Frame auf. Das ist mehr als ein kleines Detail: Valve scheint den Marktstart seines VR-Headsets konkret vorzubereiten.
-
Warum Büroangestellte sich gegen KI stellen
Die Stimmung gegenüber KI kippt im Büro. Es geht nicht nur um neue Tools, sondern um Macht, Kontrolle und die Frage, wer die Folgen der Automatisierung trägt.
-
Astra gegen Fable 5 auf VoxelBench: Warum der Benchmark-Vergleich mehr Fragen aufwirft als beantwortet
Der Vergleich zwischen Astra und Fable 5 auf VoxelBench sorgt für Debatten. Was Benchmarks aussagen – und wo sie beim Alltagseinsatz an Grenzen stoßen.
-
Wenn neue AI-Chips plötzlich Nvidia schlagen wollen
Rund um Jalapeño, Rubin und neue Chip-Claims eskaliert der Wettbewerb bei AI-Hardware. Entscheidend sind dabei weniger große Ansagen als belastbare Praxiswerte.
-
GPT-6 Astra knackt als einziges getestetes Modell den FrontierMath-Erdős-Benchmark
GPT-6 Astra erzielt 3% auf dem FrontierMath-Erdős-Benchmark, während alle anderen getesteten Modelle bei 0% landen. Warum dieser kleine Wert trotzdem ein großes Signal ist.




























