NEWS aus der KI-Welt
-
Netflix testet Sprachmodell als Alternative zur handgebauten Empfehlungslogik
WeiterlesenNetflix hat sein über Jahre optimiertes Empfehlungssystem gegen ein eigenes Sprachmodell namens GenRec antreten lassen und dabei nach eigenen Angaben bessere Ergebnisse erzielt. Statt Tausende handgefertigte Merkmale zu nutzen, übersetzt GenRec Sehverhalten in Fließtext. Netflix spricht selbst von einem "frühen, aber vielversprechenden Schritt". Der Artikel Netflix testet…
-
Netflix tests language model as alternative to hand-built recommendation logic
WeiterlesenNetflix pitted its years-old recommendation engine against an in-house language model called GenRec and says it got better results. Instead of relying on thousands of hand-crafted features, GenRec converts viewing behavior into plain text. Netflix itself calls it "an early but promising step." The article Netflix tests language model as alternative to hand-built recommendation…
-
Methoden aus der Psychologie decken massive Schwächen in KI-Sicherheitstests auf
WeiterlesenForscher des UK AI Security Institute zeigen mit psychometrischen Methoden, dass gängige Sicherheitsbenchmarks für Sprachmodelle keine einheitliche Eigenschaft messen. Ein pauschales Blockieren von Anfragen kann den Safety-Score künstlich heben, während das Modell im Alltag unbrauchbarer wird. Zugleich liefert die Studie ein Verfahren, das Modelle entlarvt, die sich bei Tests…
-
Psychological methods reveal major weaknesses in AI security testing
WeiterlesenResearchers at the UK AI Security Institute used psychometric methods to show that popular safety benchmarks for language models don't measure one consistent trait. Blanket blocking of requests can artificially inflate a safety score even as the model gets less useful day to day. The study also offers a method for catching models that act more cautious during tests than they do…
-
AI für SRE: Warum Automatisierung das Ziel ist und KI nur ein Werkzeug
WeiterlesenSeverin Neumann kritisiert das Schlagwort „AI SRE“ und plädiert für ein CNCF-Modell, das Reliability-Aufgaben statt Menschen automatisiert.
Quelle: heise.de - zum Originalartikel: www.heise.de/hintergrund/AI-fuer-SRE-Warum-Automatisierung-das-Ziel-ist-und-KI-nur-ein-Werkzeug-11364776.html
-
Anthropic’s Opus 4.6 is a smut-machine
WeiterlesenAnthropic forbids its Claude models from generating sexually explicit content. But a series of tests conducted by TechCrunch found that it didn't take much to get past the restriction.
Quelle: techcrunch.com - zum Originalartikel: techcrunch.com/2026/08/21/anthropics-opus-4-6-is-a-smut-machine/
-
Nvidia partners with data center developer Cloverleaf
WeiterlesenNvidia continues to pour money into data center development — just as AI data centers bring lots of money into Nvidia.
Quelle: techcrunch.com - zum Originalartikel: techcrunch.com/2026/08/21/nvidia-partners-with-data-center-developer-cloverleaf/
-
Nvidia just showed that the harness, not the AI model, is now the real hero
WeiterlesenNvidia research shows that AI agents can perform well, and not go off the deep end, through fine-tuning, even if the AI model isn't that great at the task.
Quelle: techcrunch.com - zum Originalartikel: techcrunch.com/2026/08/21/nvidia-just-showed-that-the-harness-not-the-ai-model-is-now-the-real-hero/
-
Anthropic puts its most powerful model Claude Mythos 5 to work for cyber defense
WeiterlesenAnthropic is now running its security scanner Claude Security on Claude Mythos 5. The tool scans codebases for vulnerabilities, provides severity ratings with CWE classifications, and suggests patches. Anthropic is also plugging Mythos 5 into partner security products protecting critical infrastructure. The article Anthropic puts its most powerful model Claude Mythos 5 to work…
-
Anthropic macht sein stärkstes Modell Claude Mythos 5 erstmals für die Cyber-Verteidigung verfügbar
WeiterlesenAnthropic lässt seinen Sicherheitsscanner Claude Security ab sofort auf dem Modell Claude Mythos 5 laufen. Das Tool prüft Codebases auf Schwachstellen, liefert Schweregrad-Bewertungen mit CWE-Klassifizierung und schlägt Patches vor. Parallel integriert Anthropic Mythos 5 in Sicherheitsprodukte von Partnern, die kritische Infrastruktur wie Krankenhäuser und Versorger schützen.…