JavaScript基于ChatGPT API实现划词翻译浏览器脚本

更新时间：2023年08月09日 15:55:50 作者：狂奔滴小马

最近 GitHub 上有个基于 ChatGPT API 的浏览器脚本，openai-translator，短时间内 star 冲到了 9.7k，抛开 tauri 是使用 rust 部分，那浏览器部分实现还是比较简单的，今天我们就来手动实现一下

前言

最近 GitHub 上有个基于 ChatGPT API 的浏览器脚本，短时间内 star 冲到了 9.7k，功能上除了支持翻译外，还支持润色和总结功能，除了浏览器插件外，还使用了 tauri 打包了一个桌面客户端，那抛开 tauri 是使用 rust 部分，那浏览器部分实现还是比较简单的，今天我们就来手动实现一下。

openAI 提供的接口

比如我们可以复制以下代码，在浏览器控制台中发起请求，就可以完成翻译

//这是示例
const OPENAI_API_KEY = "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";

const prompt = `Translate this into Chinese:
        hello world`;
const res = await fetch("https://api.openai.com/v1/completions", {
  method: "POST",
  headers: {
    "Content-Type": "application/json",
    authorization: `Bearer ${OPENAI_API_KEY}`,
  },
  body: JSON.stringify({
    model: "text-davinci-003",
    prompt,
    max_tokens: 1000,
    temperature: 0,
  }),
});
const response = await res.json();

const result = response.choices[0].text;

上述代码中 OPONAI_API_KEY 需要替换成你自己的。

实现划词翻译

划词翻译是一种常见的网页功能，用户选择一个单词或一段文本时，自动弹出一个小窗口，显示该单词或文本的翻译。

1.首先，在 HTML 页面中添加一个空的 DIV 元素和一个触发翻译的按钮

let keyword;
const translation = document.createElement("div"); 
translation.id ="translation"; 
const icon = document.createElement("img"); 
icon.style.width ="30px";
icon.style.height = "30px";
icon.src ="http://example.com/icon.png";
translation.appendChild(icon)

2.为页面添加一个鼠标抬起事件监听器，当用户选择一段文本时，设置搜索关键词。

document.addEventListener("mouseup", (event) => {
  const selection = window.getSelection().toString().trim();
  if (selection) {
    keyword=selection；
  }
});

3.鼠标点击执行翻译逻辑。可以使用 AJAX 请求从后台获取翻译结果并将其显示在 DIV 元素中。

function translate(){
  if(keyword){
    // 执行翻译逻辑
  }
}
icon.addEventListener("mouseover", translate);

4.在 CSS 样式表中为 DIV 元素添加样式，使其浮动在页面上显示。

#translation {
  position: fixed;
  top: 10px;
  right: 10px;
  max-width: 300px;
  padding: 5px;
  background-color: #f7f7f7;
  border: 1px solid #ccc;
  box-shadow: 0px 2px 5px rgba(0, 0, 0, 0.1);
  z-index: 9999;
}

以上这些步骤就能实现划词翻译的基本功能，一起来看下效果。

react + antd 实现

上面的代码只是实现了一个最简单的版本，样式也不够美观，因此我们可以使用 webpack + react + antd 来实现一个现代化的插件，这里我使用一个之前创建的模版tampermonkey-starter。

使用 antd 的 Popover 组件来显示，使用 react 重构下js代码，我们就可以实现如下效果。

点击翻译按钮，就会通过接口请求，将翻译结果显示在下方。但是翻译结果需要等 api 完全返回，才会显示出来，这样会等待较慢，我们可以使用 Stream，OpenAI 的接口支持流渲染吗，这样结果就会一个字一个字蹦出来。

import { createParser } from "eventsource-parser";

const translate = async (text: string) => {
    const resp = await fetch("https://api.openai.com/v1/completions", {
      method: "POST",
      headers: {
        "Content-Type": "application/json",
        authorization:
          `Bearer ${OPENAI_API_KEY}`,
      },
      body: JSON.stringify({
        model: "text-davinci-003",
        prompt: `Translate this into Chinese:
          ${text}`,
        max_tokens: 1000,
        temperature: 0,
        frequency_penalty: 0,
        stream: true,
      }),
    });
    if (resp.status !== 200) {
      const res = await resp.json();
      setLoading(false);
      console.error(res);
      return;
    }
    const parser = createParser((event) => {
      if (event.type === "event") {
        const data = event.data;
        if (data === "[DONE]") {
          setLoading(false);
        }
        try {
          let json = JSON.parse(event.data);
          setResult((prev) => {
            return prev + json.choices[0].text;
          });
        } catch (error) {
          console.log(error);
        }
      }
    });
    const data = resp.body;
    if (!data) {
      console.log("Error: No data received from API");
      return;
    }
    const reader = resp.body.getReader();
    try {
      while (true) {
        const { done, value } = await reader.read();
        if (done) {
          setLoading(false);
          break;
        }
        const str = new TextDecoder().decode(value);
        parser.feed(str);
      }
    } finally {
      reader.releaseLock();
    }
  };

在上面代码中，我们使用 fetch API 发送了一个 HTTP 请求，并在响应中获取了一个可读流。我们可以使用 getReader 方法获取一个读取器对象，并使用它来处理流数据，使用了 eventsource-parser这个包来解析服务器推送（Server-sent events）的数据。

这样响应的内容就会根据Server-sent events（服务器发送的事件）逐个显示了。

文本转语音

一般翻译插件都有语音播放的功能，我们可以利用可以使用Web Speech API。此API提供了两个语音合成接口：SpeechSynthesis和SpeechSynthesisUtterance

function speak(text) {
  if ('speechSynthesis' in window) {
    const utterance = new SpeechSynthesisUtterance(text);
    utterance.voice = speechSynthesis.getVoices()[0];
    utterance.pitch = 1;
    utterance.rate = 1;
    speechSynthesis.speak(utterance);
  }
}

然后直接调用这个函数，传入需要朗读的文本，就可以实现语音播放

speak('Hello, world!');

小结

本文介绍了如何实现划词翻译的基本功能，包括使用 OpenAI 提供的接口进行翻译、在 HTML 页面中添加触发翻译的按钮和鼠标抬起事件监听事件、使用 AJAX 请求从接口获取翻译结果并将其显示在 DIV 元素中等。同时还介绍了如何使用 webpack + react + antd 实现一个现代化的插件，并利用 Web Speech API 实现语音播放功能。

以上就是JavaScript基于ChatGPT API实现划词翻译浏览器脚本的详细内容，更多关于JavaScript ChatGPT API现划词翻译浏览器的资料请关注脚本之家其它相关文章！

您可能感兴趣的文章:

详解JavaScript中数组的reduce方法
js函数中有三个在特定场合很好用的函数:reduce(),map(),filter()。而数组经常用到的方法有push、join、indexOf、slice等等，但是有一个经常被我们忽略的方法：reduce，这个方法简直强大的不要不要的。下面通过这篇文章来一起学习学习吧。
2016-12-12
JavaScript作用域示例详解
作用域是JavaScript最重要的概念之一，想要学好JavaScript就需要理解JavaScript作用域和作用域链的工作原理。今天这篇文章对JavaScript作用域示例详解的介绍，非常不错，感兴趣的朋友一起看下吧
2016-07-07
uniapp使用uni自带websocket进行即时通讯详细步骤
在开发程序过程中通信功能还是比较常用到的,下面这篇文章主要给大家介绍了关于uniapp使用uni自带websocket进行即时通讯的详细步骤,文中通过代码介绍的非常详细,需要的朋友可以参考下
2023-11-11
Javascript实现重力弹跳拖拽运动效果示例
本文为大家详细介绍下使用Javascript实现重力弹跳拖拽运动的具体调用方法，感兴趣的朋友可以参考下哈
2013-06-06
使用JavaScript制作待办事项列表的示例代码
这篇文章主要介绍了如何使用 JavaScript创建待办事项列表HTML的完整信息和教程，文中但是示例代码讲解详细，感兴趣的同学可以动手试一试
2022-01-01
npm后面的-S和-D参数举例详解
这篇文章主要给大家介绍了关于npm后面的-S和-D参数举例详解的相关资料,文中还介绍了npm -s和-d的一些区别,对大家的学习或者工作具有一定的参考阶级价值,需要的朋友可以参考下
2024-01-01
JS字符串拼接在ie中都报错的解决方法
最近用js拼接字符串时遇到问题了，不论怎么拼接在ie中都报错，于是找到了一个不错的解决方法，在此与大家分享下
2014-03-03
基于Javascript倒计时效果
这篇文章主要为大家详细介绍了基于Javascript倒计时效果，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2016-12-12
input 输入框内的输入事件详细分析
input 输入框内的输入事件详细分析,需要的朋友可以参考下。
2010-03-03
Bootstrap框架结合jQuery仿百度换肤功能实例解析
这篇文章主要为大家详细介绍了Bootstrap框架结合jQuery仿百度换肤功能实现代码解析,具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2016-09-09