【动态规划】【二分查找】C++算法 466 统计重复个数

简介: 【动态规划】【二分查找】C++算法 466 统计重复个数

力扣:466 统计重复个数

定义 str = [s, n] 表示 str 由 n 个字符串 s 连接构成。

例如,str == [“abc”, 3] ==“abcabcabc” 。

如果可以从 s2 中删除某些字符使其变为 s1,则称字符串 s1 可以从字符串 s2 获得。

例如,根据定义,s1 = “abc” 可以从 s2 = “abdbec” 获得,仅需要删除加粗且用斜体标识的字符。

现在给你两个字符串 s1 和 s2 和两个整数 n1 和 n2 。由此构造得到两个字符串,其中 str1 = [s1, n1]、str2 = [s2, n2] 。

请你找出一个最大整数 m ,以满足 str = [str2, m] 可以从 str1 获得。

示例 1:

输入:s1 = “acb”, n1 = 4, s2 = “ab”, n2 = 2

输出:2

示例 2:

输入:s1 = “acb”, n1 = 1, s2 = “acb”, n2 = 1

输出:1

提示:

1 <= s1.length, s2.length <= 100

s1 和 s2 由小写英文字母组成

1 <= n1, n2 <= 106

动态规划

inxs[i] 记录s1中’a’+i的下标,升序。

分两步:

一,动态规划求dp[i]。dp[i]的含义是:s1[i,m_c1)+s1+s1… 包括s2的最短前缀长度。

dp[i]独立计算:

通过ch遍历s2, ii是s1对应的下标。如果s1不存在ch,则直接返回0。

如果inxs[ch-‘a’]存在大于等于ii的下标ij,则ch和ij对应。ii=ij+1。

如果不存在 ,iTurn ++ ii = inxs[ch-‘a’].front()+1

dp[i] = m_c1*iTurn + ii - i ;

这一步时间复杂度:O(nnlogn)

二,循环i,看[s1,n1]能否包括i个s2。

极端情况,时间复杂度O(108)

s1是100个a,n1是106。s2是’a’。

代码

核心代码

class Solution {
public:
  int getMaxRepetitions(string s1, int n1, string s2, int n2) {
    m_c1 = s1.length();
    m_c2 = s2.length();
    vector<int> inxs[26];
    for (int i = 0; i < m_c1; i++)
    {
      inxs[s1[i] - 'a'].emplace_back(i);
    }
    vector<int> dp(m_c1);//dp[i]的含义是:s1[i,m_c1)+s1+s1.... 包括s2的最短前缀长度
    for (int i = 0; i < m_c1; i++)
    {
      int ii = i;
      int iTrun = 0;
      for (int j = 0; j < m_c2; j++)
      {
        const auto& inx = inxs[s2[j] - 'a'];
        if (inx.empty())
        {//某个字符不存在
          return 0;
        }
        const auto it = std::lower_bound(inx.begin(), inx.end(), ii);
        if (inx.end() != it )
        {
          ii = *it+1;
        }
        else
        {
          ii = inx.front() + 1;
          iTrun++;
        }
      }
      dp[i] = m_c1 * iTrun + ii-i;
    }
    const int iHas = m_c1 * n1;
    int iNeed = 0;
    int inx = 0;
    for (int i = 0; ; i++)
    {
      iNeed += dp[inx];
      inx = (inx + dp[inx]) % m_c1;
      if (iNeed > iHas)
      {
        return i/n2;//i最多包括多少个s2
      }
    }
    return 0;
  }
  int m_c1,m_c2;
};

测试用例

template<class T>
void Assert(const T& t1, const T& t2)
{
  assert(t1 == t2);
}
template<class T>
void Assert(const vector<T>& v1, const vector<T>& v2)
{
  if (v1.size() != v2.size())
  {
    assert(false);
    return;
  }
  for (int i = 0; i < v1.size(); i++)
  {
    Assert(v1[i], v2[i]);
  }
}
int main()
{
  string s1, s2; 
  int n1, n2;
  {
    Solution sln;
    s1 = "acb", n1 = 4, s2 = "ab", n2 = 2;
    auto res = sln.getMaxRepetitions(s1, n1, s2, n2);
    Assert(2, res);
  }
  {
    Solution sln;
    s1 = "acb", n1 = 1, s2 = "acb", n2 = 1;
    auto res = sln.getMaxRepetitions(s1, n2, s2, n2);
    Assert(1, res);
  }
}

优化

inx 取值范围[0,m_c1),所以m_c1+1次必定重复。 重复的部分只计算一次。

vBuf[inx],消耗了first个s2 时,s1消耗了second个字符 ,即s1消耗了second/m_c1个 ,还消耗了s1[0,second%m_c1)。

class Solution {
public:
  int getMaxRepetitions(string s1, int n1, string s2, int n2) {
    m_c1 = s1.length();
    m_c2 = s2.length();
    vector<int> inxs[26];
    for (int i = 0; i < m_c1; i++)
    {
      inxs[s1[i] - 'a'].emplace_back(i);
    }
    vector<int> dp(m_c1);//dp[i]的含义是:s1[i,m_c1)+s1+s1.... 包括s2的最短前缀长度
    for (int i = 0; i < m_c1; i++)
    {
      int ii = i;
      int iTrun = 0;
      for (int j = 0; j < m_c2; j++)
      {
        const auto& inx = inxs[s2[j] - 'a'];
        if (inx.empty())
        {//某个字符不存在
          return 0;
        }
        const auto it = std::lower_bound(inx.begin(), inx.end(), ii);
        if (inx.end() != it )
        {
          ii = *it+1;
        }
        else
        {
          ii = inx.front() + 1;
          iTrun++;
        }
      }
      dp[i] = m_c1 * iTrun + ii-i;
    }
    const int iTotal = m_c1 * n1;
    int iHas = 0;
    int inx = 0;
    vector<pair<int,int>> vBuf(m_c1,std::pair<int,int>(-1,-1));//消耗了first个s2 时,s1消耗了second个字符
    vBuf[0] = std::pair<int, int>(0, iHas);
    for (int i = 0; ; i++)
    {
      iHas += dp[inx];
      inx = (inx + dp[inx]) % m_c1;
      if (iHas > iTotal)
      {
        return i/n2;//i最多包括多少个s2
      }
      if (-1 == vBuf[inx].first)
      {
        vBuf[inx] = std::make_pair(i+1, iHas);
      }
      else
      {
        const int subHas =iHas -  vBuf[inx].second ;
        const int subI = (i+1) - vBuf[inx].first;
        i += (iTotal-iHas) / subHas * subI;
        iHas += (iTotal - iHas) / subHas*subHas;
      }
    }
    return 0;
  }
  int m_c1,m_c2;
};

再次优化:动态规划

dp[i][j]的含义是:s1[i,m_c1)+s1+s1… 包括s2[j,m_c2)的最短前缀长度

class Solution {
public:
  int getMaxRepetitions(string s1, int n1, string s2, int n2) {
    m_c1 = s1.length();
    m_c2 = s2.length();
    vector<vector<int>> dp(m_c1, vector<int>(m_c2));//dp[i][j]的含义是:s1[i,m_c1)+s1+s1.... 包括s2[j,m_c2)的最短前缀长度
    for (int j = m_c2 - 1; j >= 0; j--)
    {
      vector<int> inxs;
      for (int i = 0; i < m_c1; i++)
      {
        if (s2[j] == s1[i])
        {
          inxs.emplace_back(i);
        }
      }
      if (inxs.empty())
      {
        return 0;
      }
      for (int i = 0, k = 0; i < m_c1; i++)
      {
        while ((k < inxs.size()) && (inxs[k] < i))
        {
          k++;
        }
        dp[i][j] = (inxs.size() == k) ? (m_c1 - i + inxs.front() + 1) : (inxs[k] - i + 1);
        if (m_c2 - 1 == j)
        {
          continue;
        }
        const int inx = (i + dp[i][j]) % m_c1;
        dp[i][j] += dp[inx][j + 1];
      }
    }
    const int iTotal = m_c1 * n1;
    int iHas = 0;
    int inx = 0;
    vector<pair<int, int>> vBuf(m_c1, std::pair<int, int>(-1, -1));//消耗了first个s2 时,s1消耗了second个字符
    vBuf[0] = std::pair<int, int>(0, iHas);
    for (int i = 0; ; i++)
    {
      iHas += dp[inx][0];
      inx = (inx + dp[inx][0]) % m_c1;
      if (iHas > iTotal)
      {
        return i / n2;//i最多包括多少个s2
      }
      if (-1 == vBuf[inx].first)
      {
        vBuf[inx] = std::make_pair(i + 1, iHas);
      }
      else
      {
        const int subHas = iHas - vBuf[inx].second;
        const int subI = (i + 1) - vBuf[inx].first;
        i += (iTotal - iHas) / subHas * subI;
        iHas += (iTotal - iHas) / subHas * subHas;
      }
    }
    return 0;
  }
  int m_c1, m_c2;
};

2023年1月 版

class Solution {
public:
int getMaxRepetitions(string s1, int n1, string s2, int n2) {
int iCnt1 = 0, iCnt2 = 0, index = 0;
std::unordered_map> mIndexToCnt;
while (true)
{
for (const auto& ch : s1)
{
if (ch == s2[index])
{
index++;
if (s2.length() == index)
{
index = 0;
iCnt2++;
}
}
}
iCnt1++;
if (iCnt1 == n1)
{//已经匹配完毕
return iCnt2 / n2;
}
if (mIndexToCnt.count(index))
{//找到循环节
break;
}
else
{
mIndexToCnt[index] = { iCnt1, iCnt2 };
}
}
int iLoopCnt1 = iCnt1 - mIndexToCnt[index].first;
int iLoopCnt2 = iCnt2 - mIndexToCnt[index].second;
int iRet = iCnt2 + (n1 - iCnt1) / iLoopCnt1 * iLoopCnt2;
int iRemain = (n1 - iCnt1) % iLoopCnt1;
for (int i = 0; i < iRemain; i++)
{
for (const auto& ch : s1)
{
if (ch == s2[index])
{
index++;
if (s2.length() == index)
{
index = 0;
iRet++;
}
}
}
}
return iRet/n2;
}
};


扩展阅读

视频课程

有效学习:明确的目标 及时的反馈 拉伸区(难度合适),可以先学简单的课程,请移步CSDN学院,听白银讲师(也就是鄙人)的讲解。

https://edu.csdn.net/course/detail/38771

如何你想快

速形成战斗了,为老板分忧,请学习C#入职培训、C++入职培训等课程

https://edu.csdn.net/lecturer/6176

相关

下载

想高屋建瓴的学习算法,请下载《喜缺全书算法册》doc版

https://download.csdn.net/download/he_zhidan/88348653

测试环境

操作系统:win7 开发环境: VS2019 C++17

或者 操作系统:win10 开发环境: VS2022 **C+

+17**

如无特殊说明,本算法用**C++**实现。

相关文章
|
2月前
|
机器学习/深度学习 存储 算法
动态规划算法深度解析:0-1背包问题
0-1背包问题是经典的组合优化问题,目标是在给定物品重量和价值及背包容量限制下,选取物品使得总价值最大化且每个物品仅能被选一次。该问题通常采用动态规划方法解决,通过构建二维状态表dp[i][j]记录前i个物品在容量j时的最大价值,利用状态转移方程避免重复计算子问题,从而高效求解最优解。
445 1
|
6月前
|
存储 监控 算法
基于 C++ 哈希表算法实现局域网监控电脑屏幕的数据加速机制研究
企业网络安全与办公管理需求日益复杂的学术语境下,局域网监控电脑屏幕作为保障信息安全、规范员工操作的重要手段,已然成为网络安全领域的关键研究对象。其作用类似网络空间中的 “电子眼”,实时捕获每台电脑屏幕上的操作动态。然而,面对海量监控数据,实现高效数据存储与快速检索,已成为提升监控系统性能的核心挑战。本文聚焦于 C++ 语言中的哈希表算法,深入探究其如何成为局域网监控电脑屏幕数据处理的 “加速引擎”,并通过详尽的代码示例,展现其强大功能与应用价值。
158 2
|
4月前
|
存储 监控 算法
基于跳表数据结构的企业局域网监控异常连接实时检测 C++ 算法研究
跳表(Skip List)是一种基于概率的数据结构,适用于企业局域网监控中海量连接记录的高效处理。其通过多层索引机制实现快速查找、插入和删除操作,时间复杂度为 $O(\log n)$,优于链表和平衡树。跳表在异常连接识别、黑名单管理和历史记录溯源等场景中表现出色,具备实现简单、支持范围查询等优势,是企业网络监控中动态数据管理的理想选择。
148 0
|
6月前
|
监控 算法 数据处理
基于 C++ 的 KD 树算法在监控局域网屏幕中的理论剖析与工程实践研究
本文探讨了KD树在局域网屏幕监控中的应用,通过C++实现其构建与查询功能,显著提升多维数据处理效率。KD树作为一种二叉空间划分结构,适用于屏幕图像特征匹配、异常画面检测及数据压缩传输优化等场景。相比传统方法,基于KD树的方案检索效率提升2-3个数量级,但高维数据退化和动态更新等问题仍需进一步研究。未来可通过融合其他数据结构、引入深度学习及开发增量式更新算法等方式优化性能。
181 17
|
5月前
|
机器学习/深度学习 存储 算法
基于 C++ 布隆过滤器算法的局域网上网行为控制:URL 访问过滤的高效实现研究
本文探讨了一种基于布隆过滤器的局域网上网行为控制方法,旨在解决传统黑白名单机制在处理海量URL数据时存储与查询效率低的问题。通过C++实现URL访问过滤功能,实验表明该方法可将内存占用降至传统方案的八分之一,查询速度提升约40%,假阳性率可控。研究为优化企业网络管理提供了新思路,并提出结合机器学习、改进哈希函数及分布式协同等未来优化方向。
160 0
|
7月前
|
存储 监控 算法
基于 C++ 哈希表算法的局域网如何监控电脑技术解析
当代数字化办公与生活环境中,局域网的广泛应用极大地提升了信息交互的效率与便捷性。然而,出于网络安全管理、资源合理分配以及合规性要求等多方面的考量,对局域网内计算机进行有效监控成为一项至关重要的任务。实现局域网内计算机监控,涉及多种数据结构与算法的运用。本文聚焦于 C++ 编程语言中的哈希表算法,深入探讨其在局域网计算机监控场景中的应用,并通过详尽的代码示例进行阐释。
161 4
|
9月前
|
编译器 C++ 开发者
【C++篇】深度解析类与对象(下)
在上一篇博客中,我们学习了C++的基础类与对象概念,包括类的定义、对象的使用和构造函数的作用。在这一篇,我们将深入探讨C++类的一些重要特性,如构造函数的高级用法、类型转换、static成员、友元、内部类、匿名对象,以及对象拷贝优化等。这些内容可以帮助你更好地理解和应用面向对象编程的核心理念,提升代码的健壮性、灵活性和可维护性。
|
5月前
|
人工智能 机器人 编译器
c++模板初阶----函数模板与类模板
class 类模板名private://类内成员声明class Apublic:A(T val):a(val){}private:T a;return 0;运行结果:注意:类模板中的成员函数若是放在类外定义时,需要加模板参数列表。return 0;
158 0
|
5月前
|
存储 编译器 程序员
c++的类(附含explicit关键字,友元,内部类)
本文介绍了C++中类的核心概念与用法,涵盖封装、继承、多态三大特性。重点讲解了类的定义(`class`与`struct`)、访问限定符(`private`、`public`、`protected`)、类的作用域及成员函数的声明与定义分离。同时深入探讨了类的大小计算、`this`指针、默认成员函数(构造函数、析构函数、拷贝构造、赋值重载)以及运算符重载等内容。 文章还详细分析了`explicit`关键字的作用、静态成员(变量与函数)、友元(友元函数与友元类)的概念及其使用场景,并简要介绍了内部类的特性。
249 0
|
7月前
|
编译器 C++ 容器
【c++11】c++11新特性(上)(列表初始化、右值引用和移动语义、类的新默认成员函数、lambda表达式)
C++11为C++带来了革命性变化,引入了列表初始化、右值引用、移动语义、类的新默认成员函数和lambda表达式等特性。列表初始化统一了对象初始化方式,initializer_list简化了容器多元素初始化;右值引用和移动语义优化了资源管理,减少拷贝开销;类新增移动构造和移动赋值函数提升性能;lambda表达式提供匿名函数对象,增强代码简洁性和灵活性。这些特性共同推动了现代C++编程的发展,提升了开发效率与程序性能。
293 12