存储库:https://github.com/ray-d-song/guesslang-js
演示:https://ray-d-song.github.io/guesslang-js/
最近在做一个叫EchoRSS的项目,有一个非常想要的功能,就是拦截订阅中的外部链接(阅读全文、引用等)并直接显示在当前页面上。
存在返回的HTML代码块丢失语言标注的问题(或者原代码块中的pre和code标签上没有标注语言),因此无法使用shiki或prism.js等工具进行高亮显示。
我找到了三种检测代码语言的解决方案:
1. 语言学家
这是一个部署在服务器上的Ruby项目,Github使用它来检测存储库的语言构成。如果你需要极高的精度并且可以在服务器上计算,这是最好的解决方案。
2. HLJS
highlight.js 是一个非常著名的网页代码高亮库,也是唯一提供自动代码检测的库。
原理很简单,就是枚举该语言的关键词,然后将它们与文本一一匹配,最后看哪一个匹配度最高。
hljs 有四个问题。
- 需要非常长的代码长度,大多数语言至少需要300个字符才能达到相对较好的准确性。
- 检测语言的部分并不是一个单独的模块,而是与解析器和渲染器紧密耦合,而且代码也非常命令式,很难提取出有用的部分。
- 如果不提取检测模块,在使用hljs高亮时,代码的原始格式(换行和缩进)将会丢失。
- 需要大量正则匹配,性能较差,并且由于原因2,无法在Web Worker中运行。
3. 猜测
guesslang是一个基于tensorflow.js的机器学习项目。
微软在2021年将此项目移植到node.js,并在vscode中添加了自动语言检测功能。
三年前有个越南小伙hieplpvip也把这个项目移植到浏览器上,但是也存在三个问题:
- 内存泄漏,内存泄漏...
- 仅支持; tag引入umd格式,不支持esm,不支持bundle
- 同样,由于原因2,它不支持Web Worker
这家伙还没有维护这个项目,三月份支持esm的壮举请求也没有得到回复。
于是我从hljs中提取了检测模块,并fork了guesslang-js来修复上述问题,最终guesslang获胜,结果是这样的:
https://github.com/ray-d-song/guesslang-js
我觉得说的太多了,也许以后有人需要,所以我就发一下。
如果有人了解tensorflow.js,希望能推荐一些学习资料,我想进一步修改为web gpu计算以提高效率。
以上是如何检测浏览器中的代码语言的详细内容。更多信息请关注PHP中文网其他相关文章!

不同JavaScript引擎在解析和执行JavaScript代码时,效果会有所不同,因为每个引擎的实现原理和优化策略各有差异。1.词法分析:将源码转换为词法单元。2.语法分析:生成抽象语法树。3.优化和编译:通过JIT编译器生成机器码。4.执行:运行机器码。V8引擎通过即时编译和隐藏类优化,SpiderMonkey使用类型推断系统,导致在相同代码上的性能表现不同。

JavaScript在现实世界中的应用包括服务器端编程、移动应用开发和物联网控制:1.通过Node.js实现服务器端编程,适用于高并发请求处理。2.通过ReactNative进行移动应用开发,支持跨平台部署。3.通过Johnny-Five库用于物联网设备控制,适用于硬件交互。

我使用您的日常技术工具构建了功能性的多租户SaaS应用程序(一个Edtech应用程序),您可以做同样的事情。 首先,什么是多租户SaaS应用程序? 多租户SaaS应用程序可让您从唱歌中为多个客户提供服务

本文展示了与许可证确保的后端的前端集成,并使用Next.js构建功能性Edtech SaaS应用程序。 前端获取用户权限以控制UI的可见性并确保API要求遵守角色库

JavaScript是现代Web开发的核心语言,因其多样性和灵活性而广泛应用。1)前端开发:通过DOM操作和现代框架(如React、Vue.js、Angular)构建动态网页和单页面应用。2)服务器端开发:Node.js利用非阻塞I/O模型处理高并发和实时应用。3)移动和桌面应用开发:通过ReactNative和Electron实现跨平台开发,提高开发效率。

JavaScript的最新趋势包括TypeScript的崛起、现代框架和库的流行以及WebAssembly的应用。未来前景涵盖更强大的类型系统、服务器端JavaScript的发展、人工智能和机器学习的扩展以及物联网和边缘计算的潜力。

JavaScript是现代Web开发的基石,它的主要功能包括事件驱动编程、动态内容生成和异步编程。1)事件驱动编程允许网页根据用户操作动态变化。2)动态内容生成使得页面内容可以根据条件调整。3)异步编程确保用户界面不被阻塞。JavaScript广泛应用于网页交互、单页面应用和服务器端开发,极大地提升了用户体验和跨平台开发的灵活性。

Python更适合数据科学和机器学习,JavaScript更适合前端和全栈开发。 1.Python以简洁语法和丰富库生态着称,适用于数据分析和Web开发。 2.JavaScript是前端开发核心,Node.js支持服务器端编程,适用于全栈开发。


热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

AI Hentai Generator
免费生成ai无尽的。

热门文章

热工具

Dreamweaver Mac版
视觉化网页开发工具

SublimeText3 Mac版
神级代码编辑软件(SublimeText3)

SublimeText3 Linux新版
SublimeText3 Linux最新版

WebStorm Mac版
好用的JavaScript开发工具

SecLists
SecLists是最终安全测试人员的伙伴。它是一个包含各种类型列表的集合,这些列表在安全评估过程中经常使用,都在一个地方。SecLists通过方便地提供安全测试人员可能需要的所有列表,帮助提高安全测试的效率和生产力。列表类型包括用户名、密码、URL、模糊测试有效载荷、敏感数据模式、Web shell等等。测试人员只需将此存储库拉到新的测试机上,他就可以访问到所需的每种类型的列表。