Der Aufwand für die Softwareentwicklung ist ein entscheidender Faktor für die Durchführung eines Projekts. Dies führt zu einer großen Sammlung von Textdokumenten in einem Unternehmen, die besser genutzt oder wiederverwendet werden könnten. In diesem Beitrag wird ein Framework für die Identifikation ähnlicher Anforderungen bzw. Textformulierungen von Experten unter Verwendung von TF-IDF und Doc2Vec, als klassische Ansätze des Natural Language Processing (NLP), vorgestellt. Die verwendeten Texte stammen aus Pflichtenheften der LIT Beratung GmbH; das durchgeführte Projekt zeigt den Einsatz von Self-Enforcing Networks (SEN) zum Textclustering anhand eines Praxisbeispiels und soll als Basis für die Aufwandschätzung in Softwareprojekten dienen.

错误:搜索内容不能为空,请输入英文关键词
错误:关键词超出字数限制,请精简
高级检索

Einsatz des Self-Enforcing Networks für das Clustering von Pflichtenhefttexten in der Softwareentwicklung mithilfe von TF-IDF und Doc2Vec

  • Lauritz Loy

摘要

Der Aufwand für die Softwareentwicklung ist ein entscheidender Faktor für die Durchführung eines Projekts. Dies führt zu einer großen Sammlung von Textdokumenten in einem Unternehmen, die besser genutzt oder wiederverwendet werden könnten. In diesem Beitrag wird ein Framework für die Identifikation ähnlicher Anforderungen bzw. Textformulierungen von Experten unter Verwendung von TF-IDF und Doc2Vec, als klassische Ansätze des Natural Language Processing (NLP), vorgestellt. Die verwendeten Texte stammen aus Pflichtenheften der LIT Beratung GmbH; das durchgeführte Projekt zeigt den Einsatz von Self-Enforcing Networks (SEN) zum Textclustering anhand eines Praxisbeispiels und soll als Basis für die Aufwandschätzung in Softwareprojekten dienen.