[DeeplearningAI笔记]序列模型3.2有条件的语言模型与贪心搜索的不可行性

a^{<0>}

是 0 向量，但是在机器翻译模型中 decoder 的输入是 encoder 的输出。所以称机器翻译中的 decoder 为 condition language model 有条件的语言模型

生成第一个词的分布以后，它会根据你的条件语言模型挑选出最有可能的第一个词，进入机器翻译模型中，在挑选出第一个词后，它会继续挑选出第二个最有可能的词，然后继续挑选出第三个最有可能的词，这种算法就叫做 贪心搜索
但是你真正需要的是整个单词序列从 y^{<1>},y^{<2>},...,y^{}
对于句子：[1] “Jane is visiting Africa in September” [2] "Jane is going to be visiting Africa in September" 很明显第一个句子的翻译更好，因为第一句话相对于第二句话来说更加简洁。
首先翻译出 Jane is 在英语中 going to 相对于 visiting 出现频率更多，如果使用 贪心搜索 方法,则有更高的概率会选择 going to 作为翻译的结果。这样得到的翻译结果并不是最佳的。
Note 所以此时应该考虑一种近似全局的搜索方式，从词典中挑选需要单词的组合近似的使 条件概率最大

[1]

吴恩达老师课程原地址: https://mooc.study.163.com/smartSpec/detail/1001319001.htm

0 人点赞