AI帮你写Python

发布时间：2021-04-28 16:39:40 所属栏目：动态来源：互联网

导读：器学习的时代，AI智能补全代码早已不是梦想，各种IDE和插件都在努力帮助程序猿减少击键次数，延长键盘寿命。有位来自斯里兰卡的程序猿也加入了关爱键盘协会，他尝试用简单的深度学习模型来实现自动补全Python代码这个目标，效果意外的不错。该项目现已开源

器学习的时代，AI智能补全代码早已不是梦想，各种IDE和插件都在努力帮助程序猿减少击键次数，延长键盘寿命。

有位来自斯里兰卡的程序猿也加入了关爱键盘协会，他尝试用简单的深度学习模型来实现自动补全Python代码这个目标，效果意外的不错。该项目现已开源！

简单的模型也强大

抱着实验的心态，在这个项目中，斯里兰卡小哥用到的只是一个简单的LSTM（Long Short-Term Memory）模型。

用来进行预测的算法是集束搜索（beam search)，这是一种启发式图搜索算法。在进行每一步深度扩展时，集束搜索仅保留一些质量较高的节点，减少空间消耗，提高时间效率。采用集束搜索算法最多可以实现10个字符的预测。

而投喂给模型的数据是标记化的Python代码，这些代码里的注释、字符串和空行事先清理掉了。色的字母就是自动补全开始的位置，按下TAB键选择补全，高亮标注为灰色的部分就是AI补充的代码。

小哥表示，如此简单的模型下，使用深度学习来自动补全Python代码，仍可以减少30-50%的击键次数，真的是surprise！

在GitHub上，小哥提供了一个Python的解析器，而只要写一个其他语言的解析器，这个方案完全可以推广到其他语言上，实现Java自动补全，C自动补全等等。

使用方法

想要亲测一下效果？

没问题，只需五步，你就可以训练自己的自动补全模型。

1、安装进行机器学习的实验环境（lab，地址见文末）。

2、将数据复制到 ./data/source。

3、运行 extract_code.py 来收集所有的python文件，编码并将其合并到 all.py。

4、运行 evaluate.py 对模型进行评估。

5、运行 train.py 训练模型。

仍需成长

方法简单，效果还挺好，听上去这个项目很有潜力啊。不过理想很丰满，现实还是有点骨感的。这个新生的AI还是面临着许多成长挑战的。

挑战一：效率太低

首先是它的性能尚未能满足实际使用的需要。由于编辑集成器的限制，集束搜索算法效率低下，有等它补全代码的时间，手动都可以敲好几行代码了。

对此斯里兰卡小哥表示，下一步他们会尝试用不同的架构来提高推理性能，也欢迎大家向他们分享想法和建议。

挑战二：前辈强大

Reddit网友们还指出，用机器学习来补全代码这个想法早已有比较成功的实现方案，比如获得了Trith Ventures投资的Kite。

（编辑：唐山站长网）

【声明】本站内容均来自网络，其相关言论仅代表作者个人观点，不代表本站立场。若无意侵犯到您的权利，请及时与联系站长删除相关内容!

充电桩安装难交付4万	OPPO 小布助手现已支持
开通倒计时，京港高铁	14代酷睿赶不上了？消