G - 单词数

本文介绍了一种方法,用于统计给定文章中不同单词的总数。通过详细解析单词的提取过程及计数策略,解决了重复单词的问题。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

             lily的好朋友xiaoou333最近很空,他想了一件没有什么意义的事情,就是统计一篇文章里不同单词的总数。下面你的任务是帮助xiaoou333解决这个问题。

Input
有多组数据,每组一行,每组就是一篇小文章。每篇小文章都是由小写字母和空格组成,没有标点符号,遇到#时表示输入结束。
Output
每组只输出一个整数,其单独成行,该整数代表一篇文章里不同单词的总数。
Sample Input
you are my friend
#
Sample Output
4



我觉得这一道题比较关键的就是,如何提取单词,如何数究竟有多少个单词。



首先我们对于提取单词,有以下想法:


1、利用stringstream流来进行操作
2、利用pos1和pos2来定位一个单词的头字母对应下标和末字母对应的下标
3、流入stringstream后传给一个字符串,然后保留到另外一个字符串数组里(注意stringstream的清空操作!百度一下!)
4、关于数单词,我本来是打算,直接的在句子里面找的!利用find函数!
但是!这里有一个很大的问题!
do dog g
这里应该有3个单词对吧
我一开始的思路就是,找到了就erase(删除),直到找不到了,就sum++!
但是!我们这样子做输出就是2!
因为我们进行了第一次关于“do“的操作后,整个字符串就是g g,这个时候再操作!那就是2个了!
所以我改变了一种思维!那就是我们先储存我们的单词,再在后面在整个字符串数组里面进行一次遍历,这样子有方便!又不容易出错!!!good!!!


下面谈一下如何实现

对于提取单词,pos1(单词头字母怎么找

情况1 它是个小写字母,然后它的左边是空格

情况2 它是个小写字母,而且它的下标是0;

之所以有情况2,是因为一个普通的句子i love you,按照情况1你的下标就会-1,越界了!


对于pos2(单词的末字母怎么找


情况1 它是个小写字母,然后它的右边是个空格

情况2 它是个小写字母,而且它的下标刚好就是字符串.size()-1;

你发现了吗!我们都是对于边界有一些特殊的考虑!


具体的代码实现

#include<iostream>
#include<sstream>
#include<string>
using namespace std;

int main()
{
    stringstream ss;
    string s;
    while (getline(cin, s))
    {
        if (s == "#")
            break;
        else
        {
            string a[1000];
            int k = 0;
            for (int i = 0; i < 1000; i++)
                a[i] = " ";
            int pos1 = 0;
            int pos2 = 0;
            int pos3 = 0;
            for (int i = 0; i < s.size(); i++)
            {
                
                if (s[i] >= 'a'&&s[i] <= 'z'&&i == 0)
                {
                    pos1 = i;

                }
                if (i >= 1 && s[i] >= 'a'&&s[i] <= 'z'&&s[i - 1] == ' ')
                {
                    pos1 = i;
                }
                if (i == s.size() - 1 && s[i] >= 'a'&&s[i] <= 'z')
                {

                    pos2 = i;
                    for (int i = pos1; i <= pos2; i++)
                    {
                        ss << s[i];
                    }
                    string tmp = ss.str();
                    ss.str("");
                    a[k] = tmp;
                    k++;
                    continue;
                }
                if (i < s.size() - 1 && s[i] >= 'a'&& s[i] <= 'z'&& s[i + 1] == ' ')
                {

                    pos2 = i;
                    for (int i = pos1; i <= pos2; i++)
                    {
                        ss << s[i];
                    }
                    string tmp = ss.str();

                    ss.str("");
                    a[k] = tmp;
                    k++;
                    continue;
                }
            }
            int sum = 0;
            for (int i = 0; i < 1000; i++)
            {
                for (int j = i + 1; j < 1000; j++)
                {
                    if (a[j] == a[i])
                        a[j] = " ";
                }
            }
            for (int i = 0; i < 1000; i++)
            {
                if (a[i] != " ")
                    sum++;
            }
            cout << sum << endl;
        }
    }
}


评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值