Einsatz des Self-Enforcing Networks für das Clustering von Pflichtenhefttexten in der Softwareentwicklung mithilfe von TF-IDF und Doc2Vec
摘要
Der Aufwand für die Softwareentwicklung ist ein entscheidender Faktor für die Durchführung eines Projekts. Dies führt zu einer großen Sammlung von Textdokumenten in einem Unternehmen, die besser genutzt oder wiederverwendet werden könnten. In diesem Beitrag wird ein Framework für die Identifikation ähnlicher Anforderungen bzw. Textformulierungen von Experten unter Verwendung von TF-IDF und Doc2Vec, als klassische Ansätze des Natural Language Processing (NLP), vorgestellt. Die verwendeten Texte stammen aus Pflichtenheften der LIT Beratung GmbH; das durchgeführte Projekt zeigt den Einsatz von Self-Enforcing Networks (SEN) zum Textclustering anhand eines Praxisbeispiels und soll als Basis für die Aufwandschätzung in Softwareprojekten dienen.