【问题标题】:Method that fetch data from multiple databases running slow从运行缓慢的多个数据库中获取数据的方法
【发布时间】:2015-06-16 15:56:18
【问题描述】:

我有一些方法需要从多个数据库中获取统计数据。关键思想是每个表都包含一个 DBName,然后我从它向下钻取到客户端主数据库,调用具有所需数据库名称的存储过程。最后我再次下钻,从客户的项目数据库中获取数据。

总结一下:

  1. 我获得了所有云用户的列表。

  2. 对于每个用户,我使用其主数据库上的存储过程来获取他的客户 -> 标记为 userClients。

  3. 对于每个客户,我使用客户项目数据库中的存储过程来获取他的统计信息。

对于非常少的数据执行大约需要 5-6 秒。

public List<CloudAnalysisDTO> GetCloudAnalysisForPeriod(DateTime FromDate, DateTime ToDate)
    {
        var users = FindAll();
        List<CloudAnalysisDTO> resultsList = new List<CloudAnalysisDTO>();
        HashSet<string> userclients = new HashSet<string>();

        using (var db = new ProjSQLDataContext(conn))
        {
            foreach (var user in users)
            {
                if (user.ID == 0)
                    continue;

                var ids = string.Join(",", db.UserClients.Where(uc => uc.UserId == user.ID).Select(uc => uc.ClientId.ToString()).ToArray());
                var mainDB = user.MainDB;

                if (mainDB.Length == 0 || ids.Length == 0)
                    continue;

                List<CloudAnalysisDTO> userClients =
                        db.ExecuteQuery<CloudAnalysisDTO>(@"EXEC CloudUsersAnalysis {0},{1}", mainDB, ids).ToList<CloudAnalysisDTO>();

                List<CloudAnalysisDTO> needRemove = new List<CloudAnalysisDTO>();

                foreach (var client in userClients)
                {
                    if (!userclients.Contains(user.MainDB + client.ClientID.ToString()))
                        userclients.Add(user.MainDB + client.ClientID.ToString());
                    else
                    {
                        needRemove.Add(client);
                        continue;
                    }

                    ClientAnalysisDTO clientAnalysisDTO =
                    db.ExecuteQuery<ClientAnalysisDTO>(@"EXEC CloudClientAnalysis {0},{1},{2}", client.ProjectDB, FromDate, ToDate).SingleOrDefault<ClientAnalysisDTO>();

                    if (clientAnalysisDTO != null)
                    {
                        client.ClientAnalysisDTO = clientAnalysisDTO;
                    }

                    client.UserID = user.ID;
                    client.MainDB = user.MainDB;
                }

                foreach (var removeDTO in needRemove)
                {
                    userClients.Remove(removeDTO);
                }

                if (userClients != null && userClients.Count > 0)
                    resultsList.AddRange(userClients);
            }



        }
        return resultsList;
    }

关于我可以做些什么来提高性能的任何想法?

【问题讨论】:

  • 看起来我有很多 db 调用。
  • 对我来说也是如此,但还有其他方法吗?我不知道足够的 sql 技巧来完成它。也许数据库管理员所做的是每隔一段时间缓存统计信息,但我什至不知道如何做到这一点。
  • 您将统计信息拉入 .NET 并在 .NET 中进行循环。
  • 如果我没记错的话,这就是我现在正在做的事情。
  • 不是你不是。您正在循环调用 DB。这与在一次 DB 调用中获取所需的所有信息然后在 .NET 集合中循环不同。

标签: c# sql algorithm linq linq-to-sql


【解决方案1】:

我要做的第一件事是启用 .NET 跟踪,并在每次调用之前和之后在跟踪日志中写入一行。

https://msdn.microsoft.com/en-us/library/zs6s4h68(v=vs.110).aspx

这行让我怀疑您可能在其中一个查询中秘密运行“in”子句,这可能会低于性能:

 var ids = string.Join(",", db.UserClients.Where(uc => uc.UserId == user.ID).Select(uc => uc.ClientId.ToString()).ToArray());

下一步一旦你找到表现不佳的人(上面这行只是我的猜测),你应该启用数据库分析以确定哪里需要新的索引或数据库维护。

【讨论】:

  • 我确实在我的第一个存储过程中使用了“in”子句!相反,我可以做的是创建一个循环并从.Net 中以常规位置一一获取用户客户端。但我不认为这就是它运行得这么慢的原因。这意味着调用 sproc 的次数更多。
  • 您可以在 JOIN 语句中引用每个数据库,例如视图或单个存储过程。您只需引用 databasename.schema.table,例如:“myDB.dbo.myTable”。将其放入单个过程中将使服务器处理优化。 (看起来你在一个服务器实例上,如果我错了,你需要添加一个链接服务器)。除此之外,请确保您在加入的任何内容中都引用了索引字段。
  • 我不知道该怎么做,因为每个用户行都有不同的 mainDB 列。并且连接需要在该列的值上。所以加入 [this is value]->(mainDB).dbo.myTable ON(这里发生了什么?)
猜你喜欢
  • 1970-01-01
  • 2018-09-08
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2023-02-16
  • 2013-01-12
相关资源
最近更新 更多