50

我收到此错误消息:

java.net.URISyntaxException: Illegal character in query at index 31: http://finance.yahoo.com/q/h?s=^IXIC

My_Url = http://finance.yahoo.com/q/h?s=^IXIC

当我将它复制到浏览器地址字段时,它显示了正确的页面,它是有效的URL,但我无法用这个解析它:new URI(My_Url)

我试过了:My_Url=My_Url.replace("^","\\^"),但是

  1. 这不是我需要的网址
  2. 它也不起作用

如何处理?

坦率

4

10 回答 10

60

您需要对 URI 进行编码,以将非法字符替换为合法编码字符。如果您首先创建一个 URL(因此您不必自己进行解析),然后使用五参数构造函数创建一个 URI ,那么构造函数将为您进行编码。

import java.net.*;

public class Test {
  public static void main(String[] args) {
    String myURL = "http://finance.yahoo.com/q/h?s=^IXIC";
    try {
      URL url = new URL(myURL);
      String nullFragment = null;
      URI uri = new URI(url.getProtocol(), url.getHost(), url.getPath(), url.getQuery(), nullFragment);
      System.out.println("URI " + uri.toString() + " is OK");
    } catch (MalformedURLException e) {
      System.out.println("URL " + myURL + " is a malformed URL");
    } catch (URISyntaxException e) {
      System.out.println("URI " + myURL + " is a malformed URL");
    }
  }
}
于 2009-04-15T00:17:28.300 回答
23

对字符使用%编码^,即。http://finance.yahoo.com/q/h?s=%5EIXIC

于 2009-04-14T23:32:33.150 回答
15

您必须对参数进行编码。

这样的事情会做:

import java.net.*;
import java.io.*;

public class EncodeParameter { 

    public static void main( String [] args ) throws URISyntaxException ,
                                         UnsupportedEncodingException   { 

        String myQuery = "^IXIC";

        URI uri = new URI( String.format( 
                           "http://finance.yahoo.com/q/h?s=%s", 
                           URLEncoder.encode( myQuery , "UTF8" ) ) );

        System.out.println( uri );

    }
}

http://java.sun.com/javase/6/docs/api/java/net/URLEncoder.html

于 2009-04-15T01:33:13.050 回答
4

您可以执行以下操作,而不是事先对 URL 进行编码

String link = "http://example.com";
URL url = null;
URI uri = null;

try {
   url = new URL(link);
} catch(MalformedURLException e) {
   e.printStackTrace();
}

try{
   uri = new URI(url.toString())
} catch(URISyntaxException e {
   try {
        uri = new URI(url.getProtocol(), url.getUserInfo(), url.getHost(),
                      url.getPort(), url.getPath(), url.getQuery(), 
                      url.getRef());
   } catch(URISyntaxException e1 {
        e1.printStackTrace();
   }
}
try {
   url = uri.toURL()
} catch(MalfomedURLException e) {
   e.printStackTrace();
}

String encodedLink = url.toString();
于 2016-04-13T14:33:00.830 回答
2

通用解决方案需要将 URL 解析为符合 RFC 2396 的 URI(请注意,这是 URI 标准的旧版本,java.net.URI 使用该标准)。

我编写了一个 Java URL 解析库来实现这一点:galimatias。使用此库,您可以使用以下代码实现所需的行为:

String urlString = //...
URLParsingSettings settings = URLParsingSettings.create()
  .withStandard(URLParsingSettings.Standard.RFC_2396);
URL url = URL.parse(settings, urlString);

请注意,galimatias 处于非常早期的阶段,一些功能是实验性的,但对于这个用例来说已经相当可靠了。

于 2014-01-02T00:06:21.040 回答
2

空格在 URL 中编码为 %20,在表单提交数据中编码为 +(内容类型 application/x-www-form-urlencoded)。你需要前者。

使用番石榴:

dependencies {
     compile 'com.google.guava:guava:28.1-jre'
}

您可以使用 UrlEscapers:

String encodedString = UrlEscapers.urlFragmentEscaper().escape(inputString);

不要使用 String.replace,这只会对空间进行编码。改用图书馆。

于 2019-11-20T08:41:10.147 回答
1

没有什么比
http://server.ru:8080/template/get?type=mail&format=html&key=ecm_task_assignment&label =Согласовать с контрагентом&descr=Описание&objectid=2231 更好的
了:

public static boolean checkForExternal(String str) {
    int length = str.length();
    for (int i = 0; i < length; i++) {
        if (str.charAt(i) > 0x7F) {
            return true;
        }
    }
    return false;
}

private static final Pattern COLON = Pattern.compile("%3A", Pattern.LITERAL);
private static final Pattern SLASH = Pattern.compile("%2F", Pattern.LITERAL);
private static final Pattern QUEST_MARK = Pattern.compile("%3F", Pattern.LITERAL);
private static final Pattern EQUAL = Pattern.compile("%3D", Pattern.LITERAL);
private static final Pattern AMP = Pattern.compile("%26", Pattern.LITERAL);

public static String encodeUrl(String url) {
    if (checkForExternal(url)) {
        try {
            String value = URLEncoder.encode(url, "UTF-8");
            value = COLON.matcher(value).replaceAll(":");
            value = SLASH.matcher(value).replaceAll("/");
            value = QUEST_MARK.matcher(value).replaceAll("?");
            value = EQUAL.matcher(value).replaceAll("=");
            return AMP.matcher(value).replaceAll("&");
        } catch (UnsupportedEncodingException e) {
            throw LOGGER.getIllegalStateException(e);
        }
    } else {
        return url;
    }
}
于 2013-03-22T12:45:38.440 回答
1

在检查用户实际访问的 URL 的测试中,我遇到了这个异常。

并且 URL 有时包含非法字符并因此错误而挂起。

所以我做了一个函数来只对 URL 字符串中的字符进行编码,就像这样。

String encodeIllegalChar(String uriStr,String enc)
  throws URISyntaxException,UnsupportedEncodingException {
  String _uriStr = uriStr;
  int retryCount = 17;
  while(true){
     try{
       new URI(_uriStr);
       break;
     }catch(URISyntaxException e){
       String reason = e.getReason();
       if(reason == null ||
         !(
          reason.contains("in path") ||
          reason.contains("in query") ||
          reason.contains("in fragment")
         )
       ){
         throw e;
       }
       if(0 > retryCount--){
         throw e;
       }
       String input = e.getInput();
       int idx = e.getIndex();
       String illChar = String.valueOf(input.charAt(idx));
       _uriStr = input.replace(illChar,URLEncoder.encode(illChar,enc));
     }
  }
  return _uriStr;
}

测试:

String q =  "\\'|&`^\"<>)(}{][";
String url = "http://test.com/?q=" + q + "#" + q;
String eic = encodeIllegalChar(url,'UTF-8');
System.out.println(String.format("  original:%s",url));
System.out.println(String.format("   encoded:%s",eic));
System.out.println(String.format("   uri-obj:%s",new URI(eic)));
System.out.println(String.format("re-decoded:%s",URLDecoder.decode(eic)));
于 2015-03-20T10:05:40.967 回答
0

如果您使用RestangularV2在 java 中发布到 spring 控制器,如果您使用RestangularV2.one()而不是RestangularV2.all()

于 2016-10-11T15:53:40.607 回答
0

用 + 替换 URL 中的空格 如果 url 包含 dimension1=Incontinence Liners,则将其替换为 dimension1=Incontinence+Liners。

于 2017-11-14T06:44:14.853 回答