QQ泡沫乐园 · 免费提供游戏辅助,破解软件,活动资讯,喜欢记得收藏哦!
综合软件_线报活动_游戏辅助_最新电影_最优质的的辅助分享平台

短URL基础原理短链接的生成服务世界上的压缩算法

网络 2023-02-02 05:05

获取4T学习资料

面试官:你平常是否留心过一些邮件中包含短链接

小菜鸡:有的,喏,就是这样的!

面试官:为什么选择这些方法?有哪些益处?如果让你实现一个短链接的生成服务,你会如何设计?

url的用处有:

1、短. 短信和许多平台(微博)有字数限制,太长的链接加进去都没有办法写正文了.2、好看. 比起一大堆不知所以的参数,短链接愈发简练友好.3、方便做一些统计.你点了链接会有人记录之后剖析的.4、安全. 不曝露访问参数.

这就是为何我们如今收到的垃圾邮件大多数都是短URL的诱因了.

那么短URL是如何做到的呢?

短URL基础原理

短URL从生成到使用分为以下几步.

1、有一个服务,将要发送给你的长URL对应到一个短URL上.例如 www.baidu.com->www.t.cn/1

2、把短url拼接到邮件等的内容上发送

3、用户点击短URL,浏览器用301/302进行重定向,访问到对应的长URL

4、展示对应的内容

本文主要集中于第一步,即怎样将一个长URL对应到短URL上

服务设计

如果你在往长短URL真实的对应关系上想,那么就走远了.

最理想的情况是: 我们用一种算法,对每一个长URL,唯一的转换成短URL.还能保持反向转换的能力.

但是这是不可能的,如果有这样的算法,世界上的所有压缩算法都可以原地逝世了.

正确的思路是构建一个发号器,每次有一个新的长URL进来,我们就降低一,并且将新的数值返回.第一个来的url返回" www.x.cn/0",第二个返回" www.x.cn/1".

接下来以QA方式写几个小问题:

对应关系怎么储存?

这个对应数据肯定是要落盘的,不能每次系统重启就重新认筹,所以可以采用mysql等数据库来储存.而且假如数据量小且qps低,直接使用数据库的自增字段就可以实现.

如何保证长短链接一一对应?

按照前面的发号器策略,是不能保证长短链接的一一对应的,你连续用同一个URL恳求两次,结果值都是不一样的.

为了实现长短链接一一对应,我们须要付出很大的空间代价,尤其是为了快速响应,我们可以须要在显存中做一层缓存,这样子太浪费了.

但是可以实现一些变种的,来实现部份的一一对应, 比如将近来/最热门的对应关系储存在K-V数据库中,这样子可以节约空间的同时,加快响应速率.

长链接转换短链接_短址统计_可以统计的短链接

短URL的储存

我们返回的短URL通常是将数字转换成32补码,这样子可以愈发有效的减短URL宽度,那么32补码的数字对计算机来说只是字符串,怎么储存呢?直接储存字符串对等值查找好找,对范围查找等太不友好了.

其实可以直接储存10补码的数字,这样除了占用空间少,对查找的支持较好,同时还可以愈加便捷的转换到更多/更少的补码来进一步减短URL.

高并发

如果直接储存在MySQL中,当并发恳求减小,对数据库的压力太大,可能会导致困局,这时候是可以有一些优化的.

缓存

上面保证长短链接一一对应中也提及过缓存,这里我们是为了推动程序处理速率.可以将热门的长链接(需要对长链接进来的次数进行计数),最近的长链接(可以使用redis保存最近一个小时的)等等进行一个缓存,保存在显存中或者类似redis的内存数据库中,如果恳求的长URL命中了缓存,那么直接获取对应的短URL进行返回,不需要再进行生成操作.

批量发号

每一次发号都须要访问一次MySQL来获取当前的最大号码,并且在获取以后更新最大号码,这个压力是比较大的.

短址统计_可以统计的短链接_长链接转换短链接

我们可以每次从数据库获取10000个号码,然后在显存中进行领取,当剩余的号码不足1000时,重新向MySQL恳求下10000个号码.在上一批号码领取完了以后,批量进行写入.

这样可以将对数据库持续的操作移到代码中进行,并且异步进行获取和写入操作,保证服务的持续高并发.

分布式

上面设计的系统是有单点的,那就是发号器是个单点,容易死掉.

可以采用分布式服务,分布式的话,如果每一个发号器进行发号以后都须要同步给其他发号器,那未必也太麻烦了.

换一种思路,可以有两个发号器,一个发单号,一个发双号,发号以后不再是递增1,而是递增2.

类比可得,我们可以用1000个服务,分别领取0-999尾号的数字,每次发号以后递增1000.这样做很简单,服务相互之间基本都不用通讯,做好自己的事情就好了.

实现

由于我懒得写JDBC代码,更懒得弄Mybatis,所以代码中使用到MySQL的地方都使用了Redis.

  1. package util;


  2. import redis.clients.jedis.Jedis;


  3. /**

  4. * Created by pfliu on 2019/06/23.

  5. */

  6. public class ShortUrlUtil {


  7. private static final String SHORT_URL_KEY = "SHORT_URL_KEY";

  8. private static final String LOCALHOST = "http://localhost:4444/";

  9. private static final String SHORT_LONG_PREFIX = "short_long_prefix_";

  10. private static final String CACHE_KEY_PREFIX = "cache_key_prefix_";

  11. private static final int CACHE_SECONDS = 1 * 60 * 60;


  12. private final String redisConfig;

  13. private final Jedis jedis;


  14. public ShortUrlUtil(String redisConfig) {

  15. this.redisConfig = redisConfig;

  16. this.jedis = new Jedis(this.redisConfig);

  17. }


  18. public String getShortUrl(String longUrl, Decimal decimal) {

  19. // 查询缓存

  20. String cache = jedis.get(CACHE_KEY_PREFIX + longUrl);

  21. if (cache != null) {

  22. return LOCALHOST + toOtherBaseString(Long.valueOf(cache), decimal.x);

  23. }


  24. // 自增

  25. long num = jedis.incr(SHORT_URL_KEY);

  26. // 在数据库中保存短-长URL的映射关系,可以保存在MySQL中

  27. jedis.set(SHORT_LONG_PREFIX + num, longUrl);

  28. // 写入缓存

  29. jedis.setex(CACHE_KEY_PREFIX + longUrl, CACHE_SECONDS, String.valueOf(num));

  30. return LOCALHOST + toOtherBaseString(num, decimal.x);

  31. }


  32. /**

  33. * 在进制表示中的字符集合

  34. */

  35. final static char[] digits = {'0', '1', '2', '3', '4', '5', '6', '7', '8',

  36. '9', 'A', 'B', 'C', 'D', 'E', 'F', 'G', 'H', 'I', 'J', 'K', 'L',

  37. 'M', 'N', 'O', 'P', 'Q', 'R', 'S', 'T', 'U', 'V', 'W', 'X', 'Y',

  38. 'Z', 'a', 'b', 'c', 'd', 'e', 'f', 'g', 'h', 'i', 'j', 'k', 'l', 'm', 'n', 'o', 'p', 'q', 'r', 's', 't', 'u', 'v', 'w', 'x', 'y', 'z'};


  39. /**

  40. * 由10进制的数字转换到其他进制

  41. */

  42. private String toOtherBaseString(long n, int base) {

  43. long num = 0;

  44. if (n < 0) {

  45. num = ((long) 2 * 0x7fffffff) + n + 2;

  46. } else {

  47. num = n;

  48. }

  49. char[] buf = new char[32];

  50. int charPos = 32;

  51. while ((num / base) > 0) {

  52. buf[--charPos] = digits[(int) (num % base)];

  53. num /= base;

  54. }

  55. buf[--charPos] = digits[(int) (num % base)];

  56. return new String(buf, charPos, (32 - charPos));

  57. }


  58. enum Decimal {

  59. D32(32),

  60. D64(64);


  61. int x;


  62. Decimal(int x) {

  63. this.x = x;

  64. }

  65. }


  66. public static void main(String[] args) {


  67. for (int i = 0; i < 100; i++) {

  68. System.out.println(new ShortUrlUtil("localhost").getShortUrl("www.baidudu.com", Decimal.D32));

  69. System.out.println(new ShortUrlUtil("localhost").getShortUrl("www.baidu.com", Decimal.D64));

  70. }

  71. }

  72. }