cyberivy

Suchergebnisse für „AI Safety“

Volltextsuche über alle Artikel: Titel, Zusammenfassung, Klartext-Erklärung und kompletter Text – archivierte Beiträge inklusive. Tippfehler sind kein Problem.

91 Treffer für „AI Safety“

  1. AISPA zeigt, was versteckte System-Prompts über Nutzer verraten

    #AISPA#System Prompts#AI Governance

    Worum es geht AISPA steht für Artificial Intelligence System Prompt Assurance. Die am 30. Juli 2026 eingereichte Studie untersucht einen Teil von KI-Produkten, den Nutzer normalerweise nie sehen: System-Prompts. Das sind

  2. Mehr als 300 KI-Kontrollverluste in einem Monat gemeldet

    #AI Agents#AI Safety#Agent Security

    fast doppelt so viele wie im Juni. Das vom britischen AI Security Institute geförderte Projekt beobachtet seit November 2025 öffentlich gemeldete Vorfälle. Für 2026 zählte es bislang mehr als 1.600 Meldungen. Die meisten

  3. Google zeigt die Lücke bei Haut-KI: Erkennen reicht nicht

    #Google Research#Health AI#Dermatology AI

    am 12. Juni 2026 neue Ergebnisse dazu zusammengefasst, wie AI Menschen bei Fragen zu Haut, Haaren und Naegeln helfen kann. Das Interessante ist nicht die uebliche Produktfrage, ob ein Modell ein Bild erkennt. Interessant

  4. xAI klagt gegen Minnesotas Verbot von Nudify-Apps

    #xAI#AI Regulation#Deepfakes

    Minnesotas erstes Gesetz gegen KI-Nudification wird zum Verfassungstest. xAI hält das Verbot für zu breit, während der Staat Betroffene besser schützen will.

  5. US-Gesetzesentwurf will KI-Vorfälle meldepflichtig machen

    #AI Regulation#Frontier AI#AI Safety

    Abgeordnete Nathaniel Moran hat am 25. Juni 2026 den AI Incident Reporting Act vorgestellt. Der Entwurf würde Entwickler der leistungsfähigsten KI-Modelle verpflichten, bestimmte gefährliche Fähigkeiten,

  6. Claude Opus 5 macht Spitzenleistung zur Kostenfrage

    #Anthropic#Claude Opus 5#Claude API

    macht Opus 5 ist Anthropic zufolge heute über API, Claude.ai, Claude Code und mehrere Cloud-Partner verfügbar. In den Claude-Platform-Release-Notes nennt Anthropic einen Kontext von 1 Million Token, 128.000 maximale

  7. Overthinking-Paper zeigt ein neues Risiko bei Reasoning-Modellen

    #AI Security#Reasoning Models#Model Auditing

    ursprünglichen Reasoning-Modell. Warum das wichtig ist AI-Sicherheit verlässt sich oft auf Black-Box-Tests: Man fragt ein Modell und schaut, ob es gefährliche, private oder unerwünschte Antworten gibt. Das Paper zeigt,

Alle KI-News im Archiv