我需要得到的域名,没有顶级域名后缀的给定网址。
e.g
www.google.com然后output=googlehttp://www.google.co.uk/path1/path2然后output=googlehttp://google.co.uk/path1/path2然后output=googlehttp://google.com然后output=googlehttp://google.co.in然后output=googlehttp://mail.google.co.in然后output=google为此,我尝试使用以下代码
var uri = new Uri("http://www.google.co.uk/path1/path2");
var sURL = uri.Host;
string[] aa = sURL.Split('.');
MessageBox.Show(aa[1]);但是每次我都无法得到正确的输出(没有www的专用url )。在那之后,我没有搜索谷歌,并试图解决它,但这是没有帮助。我也看到了关于堆栈溢出的问题,但它对我不起作用。
发布于 2013-10-16 10:18:32
这个答案只是为了完整,因为我认为这将是一个有效的方法,如果它不会那么复杂,本质上滥用DNS系统。请注意,这也不是100%的万无一失(并且需要访问DNS)。
http://somepart.subdomain.example.org/some/files为例。我们会得到somepart.subdomain.example.org。{"somepart", "subdomain", "example", "org"}。org),看看它是否是已知的(顶级)域名。example.org)。
发布于 2013-10-16 10:24:49
你的问题的正确答案是:,不,你不能。
在、脏和中几乎可以实现这一目标的唯一解决方案是使用维护方式不容易的方式是有一个包含所有存在的TopLevelDomain的列表(您可以在这个SO answer中找到一个不完整的)。
var allTld = new[] {".com", ".it",".co.uk"}; //there you have find a really big list of all TLD
string urlToCheck = "www.google.com";//sports-ak.espn.go.com/nfl/ http://www.google.co.uk/path1/path2
if (!urlToCheck.StartsWith("http", StringComparison.OrdinalIgnoreCase))
{
urlToCheck = string.Concat("http://", urlToCheck);
}
var uri = new Uri(urlToCheck);
string domain = string.Empty;
for (int i = 0; i < allTld.Length; i++)
{
var index = uri.Host.LastIndexOf(allTld[i], StringComparison.OrdinalIgnoreCase);
if (index>-1)
{
domain = uri.Host.Substring(0, index);
index = domain.LastIndexOf(".", StringComparison.Ordinal);
if (index>-1)
{
domain = domain.Substring(index + 1);break;
}
}
}
if (string.IsNullOrEmpty(domain))
{
throw new Exception(string.Format("TLD of url {0} is missing", urlToCheck));
}你应该问问自己:我真的需要没有TLD的名字吗?
发布于 2013-10-16 09:43:37
这是你能得到的最好的。这不是一个可维护的解决方案,也不是一个“快速”解决方案。(应该优化GetDomain.GetDomainFromUrl)。
TldPatterns.EXACT中添加"co.uk" (我不知道它最初为什么不存在)它应该是这样的:
using System;
using System.Collections.Generic;
using System.Text.RegularExpressions;
class TldPatterns
{
private TldPatterns()
{
// Prevent instantiation.
}
/**
* If a hostname is contained in this set, it is a TLD.
*/
static public string[] EXACT = new string[] {
"gov.uk",
"mil.uk",
"co.uk",
//...
public class Program
{
static void Main(string[] args)
{
string[] urls = new[] {"www.google.com", "http://www.google.co.uk/path1/path2 ", "http://google.co.uk/path1/path2 ",
"http://google.com", "http://google.co.in"};
foreach (var item in urls)
{
string url = item;
if (!Regex.IsMatch(item, "^\\w+://"))
url = "http://" + item;
var domain = GetDomain.GetDomainFromUrl(url);
Console.WriteLine("Original : " + item);
Console.WriteLine("URL : " + url);
Console.WriteLine("Domain : " + domain);
Console.WriteLine("Domain Part : " + domain.Substring(0, domain.IndexOf('.')));
Console.WriteLine();
}
}
}产出:
Original : www.google.com
URL : http://www.google.com
Domain : google.com
Domain Part : google
Original : http://www.google.co.uk/path1/path2
URL : http://www.google.co.uk/path1/path2
Domain : google.co.uk
Domain Part : google
Original : http://google.co.uk/path1/path2
URL : http://google.co.uk/path1/path2
Domain : google.co.uk
Domain Part : google
Original : http://google.com
URL : http://google.com
Domain : google.com
Domain Part : google
Original : http://google.co.in
URL : http://google.co.in
Domain : google.co.in
Domain Part : googlehttps://stackoverflow.com/questions/19399139
复制相似问题