Zurück zum Blog

DeepSeek V4 Bewertung der Fähigkeiten im Roman-Schreiben (Teil 2)

24. September 2026FeelFish Team
Alle Beiträge

Im Anschluss an den vorherigen Artikel DeepSeek V4 Fähigkeiten-Test für Romanverfassung (Teil 1) wollen wir uns in diesem Artikel weiter mit den Fähigkeiten von DeepSeek V4 im Bereich des Romanschreibens befassen.

Zunächst untersuchen wir, wie gut DeepSeek Fähigkeiten befolgen kann. Fähigkeiten sind ein wesentlicher Bestandteil der FeelFish-Agenten, und große Modelle müssen diese Fähigkeiten effektiv nutzen und befolgen können, um unseren kreativen Anforderungen gerecht zu werden.

Wir haben ein neues Romanprojekt gestartet und versucht, eine Fähigkeit für den Einstieg hinzuzufügen:

image.png

Nach dem Hinzufügen der Fähigkeit ließen wir den Agenten mit dem Projekt beginnen und nutzten den Denkmodus von DeepSeek V4 Flash für den Test:

image.png

Die Fähigkeit wurde erfolgreich aufgerufen, und der Denkprozess sah wie folgt aus:

Denkprozess
Einklappen
Der Benutzer möchte ein Webroman schreiben. Der Projekttitel lautet "Reise durch die Tang-Dynastie und Eröffnung eines Restaurants", und das Pseudonym ist "Törichter Leiter". Es handelt sich um ein neues Projekt, in dem bisher keine Dateien vorhanden sind.

Ich muss den Benutzer Schritt für Schritt anleiten:
1. Die Absichten und Vorlieben des Benutzers verstehen - durch Fragen stellen
2. Das Gesamtkonzept des Romans entwickeln
3. Die Hauptcharaktere definieren
4. Den allgemeinen Stil und die Schreibregeln festlegen
5. Zuletzt den Inhalt des ersten Kapitels erstellen

Allerdings hat der Benutzer bereits einen Projekttitel angegeben: "Reise durch die Tang-Dynastie und Eröffnung eines Restaurants". Dies deutet auf eine leichte, kulinarische Geschichte hin.

Der Benutzer bat jedoch, ihn durch Dialoge zu unterstützen, daher sollte ich zunächst mit ihm sprechen, um seine Ideen zu verstehen, anstatt alles selbst zu entscheiden.

Lassen Sie mich das noch einmal überdenken. Der Benutzer sagte, er wolle "Schritt für Schritt angeleitet werden". Ich kann also zunächst einige Fragen stellen, um seine Vorlieben zu verstehen, und dann entsprechend seiner Antworten vorgehen.

Da der Benutzer jedoch keine weiteren Informationen bereitgestellt hat, kann ich einige Fragen stellen, um seine Vorlieben zu erkunden.

Angesichts des bereits festgelegten Projekttitels "Reise durch die Tang-Dynastie und Eröffnung eines Restaurants" und des Pseudonyms könnte der Benutzer bereits einige Ideen haben.

Lassen Sie mich zunächst prüfen, ob es Fähigkeitsdateien gibt, die gelesen werden müssen.

Das System weist darauf hin, dass bei langen Dialogen der Benutzer möglicherweise einen neuen Dialog startet oder den aktuellen zusammenfasst. Um eine bestimmte Fähigkeit zu nutzen, sollten die Fähigkeitsdateien gelesen werden.

Hier wird die Fähigkeit "Plot-Baum-Konstruktion" erwähnt, die besagt, dass sie "bei der Initialisierung des Romans, beim Einstieg und bei der Strukturierung jedes Kapitels unbedingt verwendet werden sollte".

Ich sollte also zunächst die Fähigkeitsdatei lesen.

Trotzdem möchte ich zunächst mit dem Benutzer sprechen, um seine Ideen zu verstehen, bevor ich fortfahre.

Lassen Sie mich sehen, was im aktuellen Projekt vorhanden ist, und dann mit dem Benutzer sprechen.

Tatsächlich ist die Nachricht des Benutzers bereits in <user_query> enthalten, daher muss ich direkt antworten.

Lassen Sie mich zunächst die Fähigkeitsdatei lesen, um den Inhalt der Plot-Baum-Konstruktion zu verstehen.

Gut, ich lese die Fähigkeitsdatei und beginne dann den Dialog mit dem Benutzer.

Es scheint, dass der Agent die verschiedenen Aspekte unserer Einstellungen gründlich berücksichtigt hat. Lassen wir uns nun die Ergebnisse der Fähigkeitsbefolgung ansehen. Ohne die Zwischenschritte zu zeigen, kann gesagt werden, dass die Fähigkeitsanforderungen insgesamt gut eingehalten wurden, aber einige Details übersehen wurden. Das Gesamtergebnis ist zufriedenstellend, bietet jedoch noch Verbesserungspotenzial.

Zum Beispiel war das Format der Zusammenfassung korrekt:

image.png

Doch einige der letzten Empfehlungen in der Fähigkeit wurden ignoriert:

image.png

Insgesamt ließen wir den Agenten auf der Grundlage der Plot-Baum-Konstruktion eine Gliederung von 100 Kapiteln erstellen, obwohl die Gesamtstruktur fünf Bände vorsah. Innerhalb dieser 100 Kapitel wurden die Inhalte, die ursprünglich für fünf Bände geplant waren, abgedeckt, was von der ursprünglichen Struktur abwich. Wenn man jedoch nur diese 100 Kapitel betrachtet, ist die gesamte Struktur logisch und erfüllt die Erwartungen.

Zusammenfassend lässt sich sagen, dass DeepSeek-V4-Flash in Bezug auf Textlänge und Fähigkeitsbefolgung 80 Punkte verdient, wobei 20 Punkte an Details verloren gehen. Im Bereich des Gedächtnisses erhält es 70 Punkte, was als ausreichend gilt, aber noch viel Verbesserungspotenzial bietet. Bei der reinen Inhaltsproduktion, ohne Fähigkeiten oder Prompting, würde es wahrscheinlich nur 60 Punkte erreichen, insbesondere bei der Behandlung der Kapitelenden, die oft etwas abrupt enden und weniger Spannung und Haken aufweisen. Hier ist die Führung durch Fähigkeiten oder Prompting notwendig.

Wir empfehlen, bei der Nutzung von DeepSeek V4 die Pro-Version mit Denkmodus zu testen, da diese wahrscheinlich bessere Ergebnisse liefert. Die Flash-Version benötigt immer noch Fähigkeiten oder Prompting, um vollständig autonom arbeiten zu können. Allerdings zeigen die Community-Feedbacks, dass die V4 Pro-Version in Bezug auf das Schreibvermögen nicht signifikant besser ist. Kurzfristig ist es noch nicht realistisch, dass KI vollständig eigenständig hochwertige Inhalte generiert, aber unter geeigneter Führung durch Fähigkeiten und Prompting kann die KI effizient relevante Aufgaben erledigen. Wir werden in Zukunft weitere Tests durchführen und mehr nützliche Fähigkeiten bereitstellen, um DeepSeek V4 dabei zu helfen, bessere Inhalte zu produzieren.