使用Python 统计高频字数的方法

脚本专栏 2026/8/1 佚名

3 2 1

问题

(来自Udacity机器学习工程师纳米学位预览课程)

用 Python 实现函数 count_words()，该函数输入字符串 s 和数字 n，返回 s 中 n 个出现频率最高的单词。返回值是一个元组列表，包含出现次数最高的 n 个单词及其次数,即 [(<单词1>, <次数1>), (<单词2>, <次数2>), ... ]，按出现次数降序排列。

可以假设所有输入都是小写形式，并且不含标点符号或其他字符（只包含字母和单个空格）。如果出现次数相同，则按字母顺序排列。

例如：

print count_words("betty bought a bit of butter but the butter was bitter",3)

输出

[('butter', 2), ('a', 1), ('betty', 1)]

解法

"""Count words."""

def count_words(s, n):
  """Return the n most frequently occuring words in s."""
  w = {}
  sp = s.split()
  # TODO: Count the number of occurences of each word in s
  for i in sp:
    if i not in w:
      w[i] = 1
    else:
      w[i] += 1

  # TODO: Sort the occurences in descending order (alphabetically in case of ties)
  top = sorted(w.items(), key=lambda item:(-item[1], item[0]))
  top_n = top[:n]
  # TODO: Return the top n most frequent words.
  return top_n


def test_run():
  """Test count_words() with some inputs."""
  print count_words("cat bat mat cat bat cat", 3)
  print count_words("betty bought a bit of butter but the butter was bitter", 3)


if __name__ == '__main__':
  test_run()

小结

主要两个小技巧：

用split()将输入字符串按空格分开；

用sorted()函数对字典先按值，再按键进行排序，尤其是item:(-item[1], item[0])) 代表先对item的第二个元素降序排列（item 之前用了-），然后对第一个元素升序排列。多个元素的元组亦然。

以上这篇使用Python 统计高频字数的方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

Python,统计,字数

标签：

Python,统计,字数

免责声明：本站文章均来自网站采集或用户投稿，网站不提供任何软件下载或自行开发的软件！如有用户或公司发现本站内容信息存在侵权行为，请邮件告知！ 858582#qq.com

评论“使用Python 统计高频字数的方法”

使用Python 统计高频字数的方法

暂无“使用Python 统计高频字数的方法”评论...

www.imxmx.com 杰晶网络

8,675无损音乐

1,324高清电影

213破解软件

120,141站长资源

最新文章

群星《奔赴！万人现场第2期》[FLAC/分轨][5

2026/8/1

群星《奇妙浪一夏 (上海迪士尼度假区音乐)》

2026/8/1

群星《奇妙浪一夏 (上海迪士尼度假区音乐)》

2026/8/1

【古典音乐】詹姆斯·高威《季节》1993[WAV+

2026/8/1

贝拉芳蒂《卡里普索之王》SACD[WAV+CUE]

2026/8/1

一句话新闻

苹果官宣WWDC 2024！预计会有大批AI功能 - 2026/8/1

3月27日消息，苹果宣布2024年全球开发者大会（WWDC）将于6月10日至6月14日举行，巧合的是，这次大会与端午假期重合。

苹果官方表示：

在线参加 Apple 每年规模最大的开发者盛会。亲眼见证 Apple 最新平台、技术和工具的发布。了解如何创建和改进你的 App 和游戏。与 Apple 设计师和工程师互动交流，与全球开发者社区建立联系。以上活动均免费在线举行。

探索各种新的工具、框架和功能，助力你打造出理想的 App 和游戏。通过视频讲座学习新技能，与 Apple 专家进行一对一会面，以推进你的项目，完善你的构思。

Swift Student Challenge 旨在支持和鼓舞下一代开发者、创作者和企业家。太平洋时间 3 月 28 日，我们将公布今年的获奖者名单。获奖者将有资格参加在 Apple Park 举办的特别活动。我们还会选出 50 名杰出获胜者，他们将受邀前往库比提诺，获得为期三天的非凡体验，包括参加 Apple Park 的特别活动。

使用Python 统计高频字数的方法

Python,统计,字数

python实现词法分析器

python3正则提取字符串里的中文实例

评论“使用Python 统计高频字数的方法”

RTX 5090要首发性能要翻倍！三星展示GDDR7显存

更新动态

友情链接

使用Python 统计高频字数的方法

Python,统计,字数

python实现词法分析器

python3正则提取字符串里的中文实例

评论“使用Python 统计高频字数的方法”

RTX 5090要首发 性能要翻倍！三星展示GDDR7显存

更新动态

友情链接

RTX 5090要首发性能要翻倍！三星展示GDDR7显存