专栏首页量子位AI帮你写Python,安装只需5步,还能任你调教 | 开源

AI帮你写Python,安装只需5步,还能任你调教 | 开源

鱼羊 发自 凹非寺 量子位 报道 | 公众号 QbitAI

一行一行地敲代码就像是徒手搬砖,聪明的程序猿们表示:我们要解放生产力!

比如像这样:

在机器学习的时代,AI智能补全代码早已不是梦想,各种IDE和插件都在努力帮助程序猿减少击键次数,延长键盘寿命(雾。

有位来自斯里兰卡的程序猿也加入了关爱键盘协会,他尝试用简单的深度学习模型来实现自动补全Python代码这个目标,效果意外的不错。该项目现已开源

简单的模型也强大

抱着实验的心态,在这个项目中,斯里兰卡小哥用到的只是一个简单的LSTM(Long Short-Term Memory)模型。

用来进行预测的算法是集束搜索(beam search),这是一种启发式图搜索算法。在进行每一步深度扩展时,集束搜索仅保留一些质量较高的节点,减少空间消耗,提高时间效率。采用集束搜索算法最多可以实现10个字符的预测。

而投喂给模型的数据是标记化的Python代码,这些代码里的注释、字符串和空行事先清理掉了。

训练效果是这样的:

绿色的字母就是自动补全开始的位置,按下TAB键选择补全,高亮标注为灰色的部分就是AI补充的代码。

小哥表示,如此简单的模型下,使用深度学习来自动补全Python代码,仍可以减少30-50%的击键次数,真的是surprise!

在GitHub上,小哥提供了一个Python的解析器,而只要写一个其他语言的解析器,这个方案完全可以推广到其他语言上,实现Java自动补全,C自动补全等等。

使用方法

想要亲测一下效果?

没问题,只需五步,你就可以训练自己的自动补全模型。

1、安装进行机器学习的实验环境(lab,地址见文末)。

2、将数据复制到 ./data/source。

3、运行 extract_code.py 来收集所有的python文件,编码并将其合并到 all.py。

4、运行 evaluate.py 对模型进行评估。

5、运行 train.py 训练模型。

仍需成长

方法简单,效果还挺好,听上去这个项目很有潜力啊。不过理想很丰满,现实还是有点骨感的。这个新生的AI还是面临着许多成长挑战的。

挑战一:效率太低

首先是它的性能尚未能满足实际使用的需要。由于编辑集成器的限制,集束搜索算法效率低下,有等它补全代码的时间,手动都可以敲好几行代码了。

对此斯里兰卡小哥表示,下一步他们会尝试用不同的架构来提高推理性能,也欢迎大家向他们分享想法和建议。

挑战二:前辈强大

Reddit网友们还指出,用机器学习来补全代码这个想法早已有比较成功的实现方案,比如获得了Trith Ventures投资的Kite

全球有超过3万名Python开发人员使用Kite,它被誉为当前最好用的Python自动补全工具。不仅能补全代码,Kite还能帮你跳过文档了解到别人是如何实时使用函数的,同时,它也能提供你的自定义代码库里的定义和用法。

连Python之父都忍不住为Kite点赞:这可真够酷的。

比起Kite这位前辈,小哥的这个项目还是非常稚嫩的,不过Kite并没有开源,其作为补充使用的云引擎也引起了有关安全性的质疑,有网友表示:

要是在工作上用了Kite,贵公司的法务部门怕不是要疯。

此外,还有网友好奇AI跟Pycharm比起来又如何?毕竟Pycharm的自动补全就已经挺好用了。

传送门

Github:https://github.com/vpj/python_autocomplete

Lab:https://github.com/vpj/lab

本文分享自微信公众号 - 量子位(QbitAI),作者:关注前沿科技

原文出处及转载信息见文内详细说明,如有侵权,请联系 yunjia_community@tencent.com 删除。

原始发表时间:2019-07-08

本文参与腾讯云自媒体分享计划,欢迎正在阅读的你也加入,一起分享。

我来说两句

0 条评论
登录 后参与评论

相关文章

  • 全球最大的3D数据集公开了!标记好的10800张全景图 | 附论文

    原作:Matt Bell 安妮 编译自 Hacker Noon 量子位 出品 | 公众号 QbitAI 你一定不想错过这个全球最大的公开3D数据集。 本文作者为...

    量子位
  • 洗车房,无人车的噩梦

    安妮 编译自 CNN Tech 量子位 出品 | 公众号 QbitAI ? 抛弃人工洗车已多年,洗车房早就鸟枪换炮变成自动洗车了。 但是,无人车可能还需依赖最古...

    量子位
  • 融资13亿后突然死亡!首款产品被苹果点赞,与谷歌竞赛的明星创业公司Anki倒闭

    两个月前,刚被Fast Company评为“2019年度全球最具创新力企业”机器人领域No.1的Anki,突然死亡。

    量子位
  • 用深度学习模型实现自动补全Python代码 (开源)

    在机器学习的时代,AI智能补全代码早已不是梦想,各种IDE和插件都在努力帮助程序猿减少击键次数,延长键盘寿命(雾。

    商业新知
  • 这个库厉害了,自动补全Python代码,节省50%敲码时间

    根据介绍,该项目基于 LSTM 模型,训练后,负责对代码的缺失部分进行补全。评价模型的方法是判断节省了多少的按键信息——即模型给出长度为 L 的代码建议,如果和...

    用户2769421
  • 这个库厉害了,自动补全Python代码,节省50%敲码时间

    根据介绍,该项目基于 LSTM 模型,训练后,负责对代码的缺失部分进行补全。评价模型的方法是判断节省了多少的按键信息——即模型给出长度为 L 的代码建议,如果和...

    一墨编程学习
  • Eclipse使用技巧 - 2. Eclipse自动补全功能轻松设置

    本文介绍如何设置Eclipse代码自动补全功能。轻松实现输入任意字母均可出现代码补全提示框。

    landv
  • 【Rust日报】 2020-02-25 KAS GUI 0.3 发布

    KAS 0.3 版本发布, 此版本已经在主题,图形和绘图API上进行了大量工作,包括用于Mandlebrot分形的交互式查看器(通过WebGPU着色器),模拟钟...

    MikeLoveRust
  • python ipaddress模块使用

    py3study
  • SpringBoot应用篇Bean之注销与动态注册实现服务mock

    前面一篇博文介绍了动态注册Bean的姿势,看完之后难免会有个疑问,在我n年的业务开发中,还真没遇到过需要自己来注册bean的场景(常年的if-else, cur...

    一灰灰blog

扫码关注云+社区

领取腾讯云代金券