cyberivy

Suchergebnisse für „AI Safety“

Volltextsuche über alle Artikel: Titel, Zusammenfassung, Klartext-Erklärung und kompletter Text – archivierte Beiträge inklusive. Tippfehler sind kein Problem.

91 Treffer für „AI Safety“

  1. AI Safety Index gibt Frontier-Labs schwache Noten

    #AI Safety#Future of Life Institute#AI Governance

    hat Anfang Juli 2026 die Summer-2026-Ausgabe seines AI Safety Index veroeffentlicht. Der Bericht bewertet neun Unternehmen, die allgemeine KI-Systeme entwickeln: Anthropic, Alibaba Cloud, DeepSeek, Google DeepMind, Meta,

  2. Neue Studie: Agentenregeln verändern das Risiko massiv

    #AI Safety#AI Agents#Red Teaming

    Rules, Not Just Models, Causally Shape Multi-Agent AI Safety von Yujiao Chen. Die Arbeit stellt eine unbequeme Frage: Was passiert, wenn nicht das Modell, sondern die Regelumgebung eines Multi-Agenten-Systems das Risiko

  3. Studie: Rückstand macht KI-Rennen riskanter

    #AI Safety#AI Governance#arXiv

    Der Befund passt zu breiteren Analysen. Der International AI Safety Report 2026 beschreibt Wettbewerbsdruck als Grund, warum Firmen zwischen schneller Veröffentlichung und Investitionen in Risikoreduktion abwägen.

  4. UN-Panel warnt vor Kontrollverlust bei KI-Agenten

    #AI Agents#AI Safety#AI Governance

    es geht Das Independent International Scientific Panel on AI der Vereinten Nationen hat am 21. September 2026 seinen ersten thematischen Kurzbericht veröffentlicht. Im Mittelpunkt steht ein Versuch von OpenAI und Hugging

  5. OpenAI startet GPT-5.6 nur als begrenzte Vorschau

    #OpenAI#GPT-5.6#AI Safety

    laut OpenAI aber nicht die Schwelle für "High" bei AI Self-Improvement und nicht die kritischere Stufe in den beschriebenen Cyber-Tests. Die Modelle sollen waehrend der Preview weiter mit Partnern getestet werden, bevor

  6. MIT testet riskante Bildmodelle ohne verbotene Inhalte

    #AI Safety#MIT#Model Auditing

    2025 gingen dort mehr als 1,5 Millionen Meldungen zu AI-generiertem CSAM ein, nach 67.000 im Jahr 2024. Wenn Hosting-Plattformen solche Modelle frueher erkennen, kann das reale Schaeden begrenzen. Einfach erklaert Es ist

  7. KI-Ratschläge verdrängen das ehrliche „Ich weiß es nicht“

    #AI Safety#AI Hallucinations#Human Judgment

    die Studie tatsächlich macht Die Arbeit trägt den Titel „AI advice suppresses people's willingness to say "I don't know", even when the advice is wrong and accuracy is incentivized“. In fünf Experimenten mit insgesamt

Alle KI-News im Archiv