语音变成电脑操作
用ATOM Echo C008-C和USB数据线制作01 Light桌面开发版,把按键语音传给电脑上的01 Server,试做文本生成与文件操作。免焊接,固定USB供电路线;已有电脑和模型服务是必要条件。本项目为实验性Agent接口,附独立制作者记录,不保证所有应用都能自动操作。
alan000
确认包装SKU为C008-C(ATOM Echo/ATOM Voice),保留原壳。将支持数据同步的USB线插入模组和电脑,确认系统出现串口;没有串口时先换数据线、安装原厂驱动。此路线不接电池、不焊线。

按[官方安装说明](https://01.openinterpreter.com/setup/installation)安装Python 3.11、Git、Poetry和FFmpeg。克隆<https://github.com/OpenInterpreter/01,进入01/software并执行poetry> install;记录git rev-parse HEAD的结果。遇到证书错误应修复证书,不关闭TLS校验。
在测试账户下运行poetry run 01 --help核对当前参数,然后按[Light Server说明](https://01.openinterpreter.com/server/light)运行poetry run 01 --server light。按所选版本配置模型、语音识别及合成服务。API密钥只放本地,不写入公开文档。记下电脑局域网IP、服务端端口与启动日志;先不要使用公网暴露参数。
按[官方ESP32客户端指南](https://01.openinterpreter.com/client/esp32)安装Arduino IDE、对应ESP32板包及M5Atom、WebSockets、AsyncTCP、ESPAsyncWebServer依赖。打开同一仓库提交的software/source/clients/esp32/src/client/client.ino,选择M5Atom板型与实际串口后编译上传。编译失败先核对该提交依赖版本,不盲目升级所有库。
按该客户端指南设置Wi-Fi和服务器地址。若所选版本提供01-light配置热点,连接热点后填入自家Wi-Fi及电脑的局域网服务地址;电脑与模组必须可互通。观察串口和Server日志,确认客户端建立连接;仅点亮电源灯不算连接成功。
在电脑空测试文件夹中,按住ATOM按钮说“创建一个test.txt,内容是你好ORecord”,说完松开。检查服务端确实收到音频、识别结果合理,人工打开文件核对内容,并检查设备能够播报。先取得一个可重复的小任务成功记录,再尝试更多功能。
[独立制作者的实机操作与视频](https://blog.lab.sugimototatsuo.com/entry/2024/05/13/175111)可用于对照预期效果;历史命令不直接替代当前文档。
保存仓库SHA、Arduino板包与库版本、模型名称、服务端日志摘要、演示视频及实际采购费用。无音频检查麦克风与客户端;识别正常但无动作检查Agent日志与权限;动作正常但无声检查TTS及扬声器。移除密钥、Wi-Fi密码和私人语音后再分享复现记录。当前页为资料整理路线,本站尚未实机复测当前依赖组合。