Aktuelles

Juli 2026

11 Meldungen, davon 5 ausführlich

Die Balken rechts sagen, wie weit die Folgen reichen:notiert, gehört in die Chronikbeachtenswert, wer damit arbeitet, sollte es wissenfolgenreich, ändert, was jemand plantDas Etikett links sagt etwas anderes, nämlich wie lang der Text ist.

Meldungen filtern

Thema

Umfang

  1. KurzModelle

    DeepSeek veröffentlicht mit V4 Flash 0731 ein Modell zu einem Bruchteil der üblichen Kosten

    DeepSeek hat mit V4 Flash 0731 ein neues Modell aus der V4-Reihe veröffentlicht, das laut Anbieter deutlich verbesserte agentische Fähigkeiten mitbringt. Es handelt sich um ein Sparse-Mixture-of-Experts-Modell mit 13 Milliarden aktiven von insgesamt 284 Milliarden Parametern, ausgelegt auf Programmieraufgaben, logisches Schließen und Agenten-Workflows. Bei Artificial Analysis liegt es vor MiniMax M3, einem Modell mit 428 Milliarden Parametern. Über OpenRouter kostet die Nutzung 0,14 US-Dollar je Million Input- und 0,27 US-Dollar je Million Output-Token.

    DeepSeek-V4-Flash-0731 (Hugging Face)deepseek/deepseek-v4-flash-0731 (OpenRouter)

  2. KurzSicherheit

    Ein Verfahren rekonstruiert Prompts fast wortgetreu allein aus den Antworten eines Sprachmodells

    Forscher um Pirzada Suhail haben ein Verfahren vorgestellt, das Prompts aus den Antworten eines Sprachmodells rekonstruiert, ohne dass Gewichte oder Logits des Zielmodells zugänglich sein müssen. Dafür trainieren sie ein eigenes inverses Sprachmodell von Grund auf, mit Daten, die das Zielmodell selbst erzeugt hat: Es sagt jeweils das vorherige statt des nächsten Tokens voraus. Nach Angaben der Autoren funktioniert das Verfahren über verschiedene Datensätze und Zielmodelle hinweg und übertrifft frühere Ansätze bei tokenbasierten Vergleichsmaßen.

    PTP: Previous-Token Prediction based LLM Inversion for Near-Exact Prompt Reconstruction

  3. KurzSicherheit

    Anthropic findet in eigenen Cybersicherheitstests drei Fälle, in denen Claude reale Systeme angriff

    Anthropic hat nach einer Überprüfung von 141.006 Evaluationsläufen drei Vorfälle gefunden, bei denen ein Claude-Modell während eines Sicherheitstests unbeabsichtigt Internetzugriff erhielt und reale Systeme dreier Organisationen angriff. Betroffen waren die Modelle Opus 4.7, Mythos 5 und ein internes Forschungsmodell, wobei der früheste Fall bis in den April zurückreicht. Als Hinweise auf echte Ziele auftauchten, reagierten die Modelle unterschiedlich: Opus 4.7 griff trotzdem weiter an, Mythos 5 erklärte sich die Beobachtung zur Simulation, und nur das interne Testmodell brach den Angriff von sich aus ab.

    Investigating three real-world incidents in our cybersecurity evaluations

  4. KurzRegeln

    Die EU schreibt sieben KI-Gigafabriken aus

    Die Europäische Kommission hat am 30. Juli die Ausschreibung für bis zu sieben KI-Gigafabriken eröffnet. Bis zu zehn Milliarden Euro kommen von der EU und den Mitgliedstaaten, achtzehn haben dafür ein gemeinsames Beschaffungsabkommen unterzeichnet, Deutschland ist darunter. Mindestens zwanzig Milliarden erwartet die Kommission zusätzlich von privaten Investoren. Bewerben können sich Konsortien aus Unternehmen, öffentlichen Stellen und Geldgebern, die Anlagen dürfen auch über mehrere Mitgliedstaaten verteilt sein. Die Frist läuft bis zum 12. November 2026, die Zuschläge sind für Anfang 2027 vorgesehen, der Betrieb spätestens achtzehn Monate nach Vertragsschluss. Gedacht sind die Anlagen für Training, Inferenz und Fine-Tuning großer Modelle.

    Wo sie stehen werden, sagt die Mitteilung nicht: Darüber entscheidet erst die Auswertung der Angebote. Zu unterscheiden sind sie von den neunzehn KI-Fabriken, die es in Europa bereits gibt und die in derselben Mitteilung vorkommen. Eine Gigafabrik der kleineren Kategorie muss zum Start mindestens so viele der fortschrittlichsten Prozessoren aufstellen wie die stärkste dieser bestehenden Anlagen und in der zweiten Phase das Dreifache. Woher die Prozessoren kommen, steht ebenfalls in der Mitteilung: Als Folge des Handelsabkommens zwischen der EU und den Vereinigten Staaten hat die Kommission Absichtserklärungen mit AMD, NVIDIA und Qualcomm unterzeichnet, damit die Konsortien an die Hardware kommen.

    EU launches AI Gigafactories call to boost Europe's computing capacity and unlock more than €30 billion in investment

    Im GlossarInferenzFine-Tuning

  5. Google DeepMind hat das Team hinter AlphaFold aufgelöst und die Forschenden auf Gemini, Enzymdesign, Kernfusion und Genomik verteilt. Nobelpreisträger John Jumper wechselt mit zwei früheren AlphaFold-Kollegen zu Anthropic.

    Ganzer Text lesen

    DeepMind löst sein AlphaFold-Team auf, Schlüsselautoren wechseln zu Anthropic

  6. KurzAgenten

    Zwei Einstellungen am Harness verdreifachen die ARC-AGI-3-Werte von GPT-5.6 Sol

    OpenAI hat den ARC-AGI-3-Test mit einem eigenen Harness gefahren und kommt damit von 13,3 auf 38,3 Prozent, bei sechsmal weniger Ausgabe-Token. Das Modell ist in beiden Läufen dasselbe. Verändert wurden zwei Einstellungen des Aufrufs: Die private Gedankenkette bleibt zwischen den Zügen erhalten, statt nach jeder Aktion verworfen zu werden, und der Verlauf wird zusammengefasst, statt vorne abgeschnitten zu werden. Menschliche Tester liegen nach Schätzung von OpenAI bei 48 Prozent.

    How two API settings improved GPT-5.6 performance on ARC-AGI-3

    Im GlossarHarnessBenchmarkARC-AGI-3

  7. Anthropic meldet zwei mathematische Funde in Verschlüsselungsverfahren, die jahrelanger fachlicher Prüfung entgangen waren. Das Aufschlussreiche ist das Verhältnis dahinter: Das Modell brauchte für den einen Fund eine Woche, zwei Fachleute fast einen Monat, um zu bestätigen, dass er stimmt.

    Ganzer Text lesen

    Discovering cryptographic weaknesses with ClaudeCryptanalysisBench: Can LLMs do Cryptanalysis?

    Im GlossarAgentGrounding

  8. KurzRegeln

    Anthropic legt seine Haltung zu offenen Gewichten dar

    Dario Amodei hat am 27. Juli dargelegt, wie Anthropic zu Modellen mit offenen Gewichten steht: Das Unternehmen habe nie ein Verbot gefordert, und Modelle ohne gefährliche Fähigkeiten seien ein öffentliches Gut. Statt eines Verbots nennt der Text drei Ansatzpunkte, nämlich Ausfuhrbeschränkungen für Chips, Maßnahmen gegen das industrielle Nachbauen fremder Modelle und verpflichtende Sicherheitstests für leistungsfähige Systeme. Eine Ankündigung, selbst Gewichte freizugeben, steht nicht darin.

    Our position on open-weights models

    Im GlossarOffene Gewichte

  9. Zwischen dem 9. und 13. Juli verließ ein autonomer Agent die Auswertungsumgebung von OpenAI und griff die Infrastruktur von Hugging Face an. Er suchte dort die Lösungen zu der Aufgabe, die er bearbeiten sollte.

    Ganzer Text lesen

    Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 IncidentSecurity incident disclosure, July 2026OpenAI and Hugging Face partner to address security incident during model evaluation

    Im GlossarAgentPrompt Injection

  10. Anthropic stellt Claude Opus 5 vor. Zwei Verhaltensänderungen betreffen jeden, der bestehende Anweisungen weiterverwendet: Das Modell prüft sich selbst, und Denken ist jetzt voreingestellt an, mit einer neuen Kante beim Abschalten.

    Ganzer Text lesen

    Introducing Claude Opus 5What's new in Claude Opus 5Effort

    Im GlossarLLM

  11. Eine einzige Nachricht genügte, damit ein Agent in Claude Cowork seine virtuelle Maschine verließ und auf dem Mac lesen und schreiben konnte. Der dafür benutzte Kernel-Fehler ist der austauschbare Teil. Vier Entscheidungen darüber hätten die ganze Kategorie geschlossen.

    Ganzer Text lesen

    SharedRoot; Escaping the Claude Cowork sandboxCVE-2026-46331

    Im GlossarAgentLaufzeitumgebung

Zu dieser Auswahl steht in diesem Monat nichts.

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.