输出结果与预期不一致。
重新检查输入、所选选项和下方限制;执行删除或强规范化操作前保留原文。 不做词干提取、词形还原或同义词合并。
该工具按 Unicode 字母识别单词,并允许数字、连字符或撇号出现在词内部;可选择忽略大小写和最小词长。结果按频率降序输出,每行使用“次数 + Tab + 单词”的 TSV 结构。它不会把不同词形自动合并。
粘贴文本,设置统计规则并检查分词质量。
最多 500,000 个字符: 0 / 500000
暂无结果
粘贴要分析的文本。
设置是否忽略大小写和最小词长。
检查连字符、撇号、数字及语言分词,再复制 TSV 结果。
重新检查输入、所选选项和下方限制;执行删除或强规范化操作前保留原文。 不做词干提取、词形还原或同义词合并。
减少输入并分成更小批次处理,同时关闭占用大量内存的其他标签页。重试前请保留原文。
检查目标应用、字体与字符编码。部分应用会自动规范空白或以不同方式渲染 Unicode。
该工具按 Unicode 字母识别单词,并允许数字、连字符或撇号出现在词内部;可选择忽略大小写和最小词长。结果按频率降序输出,每行使用“次数 + Tab + 单词”的 TSV 结构。它不会把不同词形自动合并。
不会。当前工具按表面词形计数,不做词形还原。
现有 Unicode 规则能识别字符,但没有验证中文分词;逐字或连续字符串结果可能不符合中文词语边界。
不做词干提取、词形还原或同义词合并。 中文等不以空格分词的语言可能需要专用分词器。 高频不等于主题重要性或 SEO 质量。
粘贴文本,设置统计规则并检查分词质量。