豆包对话采集示例

380

主题

193

回帖

2397

积分

管理员

积分
2397
豆包对话采集示例

1.png

2.png

3.png

  1. // AIWROK 自动化流程:启动豆包 → 输入问题 → 点击发送 → 等待AI回答 → 采集回答内容 → 保存到文件
  2. // 全程使用 agent.getXml() 获取界面源码
  3. // 包名:com.larus.nova(豆包)
  4. //
  5. // 使用说明:
  6. //   1. 修改下方【配置区】中的"要发送的问题列表"
  7. //   2. 采集结果保存到 /sdcard/豆包对话记录.txt

  8. print.log("===== 豆包对话采集流程启动 =====");
  9. print.time();

  10. // ========== 配置区 ==========
  11. var 豆包包名 = "com.larus.nova";

  12. // 输出文件路径
  13. var 输出文件路径 = "/sdcard/豆包对话记录.txt";

  14. // 要发送的问题列表(按顺序发送)
  15. var 要发送的问题列表 = [
  16.     "你好,请用一句话介绍你自己",
  17.     "中国平安股票最近走势如何?",
  18.     "招商银行持有3年卖出需要交股息税吗?"
  19. ];

  20. // 发送后等待AI回答的最大秒数(整体超时,最长10秒)
  21. var 等待回答超时秒 = 10;

  22. // 检测到新回答出现后,再等待多少秒让回答尽量输出完整(然后直接返回)
  23. var 回答输出等待秒 = 8;

  24. // 每个问题之间的间隔秒数
  25. var 问题间隔秒 = 2;

  26. // ========== 获取设备信息 ==========
  27. var 屏幕宽 = screen.getScreenWidth();
  28. var 屏幕高 = screen.getScreenHeight();
  29. print.log("屏幕尺寸:" + 屏幕宽 + " x " + 屏幕高);
  30. print.log("代理状态:" + (agent.isOpen() ? "已开启" : "未开启"));

  31. // ========== 工具函数 ==========

  32. // 获取 UI XML 字符串(使用 agent.getXml(),强制转为字符串)
  33. function 获取UI() {
  34.     var xml = agent.getXml();
  35.     // agent.getXml() 返回对象,需强制转为字符串
  36.     return "" + xml;
  37. }

  38. // 字符串长度兼容函数(避免 Java String 对象 .length() 方法问题)
  39. function 字符串长度(s) {
  40.     var str = "" + s;
  41.     return str.length;
  42. }

  43. // HTML实体解码(豆包TextView中的换行符等会被编码为 
 ' 等)
  44. function 解码HTML实体(s) {
  45.     var str = "" + s;
  46.     str = str.replace(/
/g, "\n");
  47.     str = str.replace(/
/g, "\r");
  48.     str = str.replace(/	/g, "\t");
  49.     str = str.replace(/'/g, "'");
  50.     str = str.replace(/"/g, '"');
  51.     str = str.replace(/"/g, '"');
  52.     str = str.replace(/'/g, "'");
  53.     str = str.replace(/&/g, "&");
  54.     str = str.replace(/&lt;/g, "<");
  55.     str = str.replace(/&gt;/g, ">");
  56.     return str;
  57. }

  58. // 采集豆包 message_list 中所有 content_view 下的 TextView 文本(即AI回答)
  59. // 参数 严格过滤: true=排除短文本按钮等, false=不过滤(用于检测新回答出现,更灵敏)
  60. function 采集AI回答列表(xml, 严格过滤) {
  61.     if (严格过滤 === undefined) 严格过滤 = true;
  62.     var xmlStr = "" + xml;
  63.     var 回答列表 = [];

  64.     // 定位 message_list 节点
  65.     var listIdx = xmlStr.indexOf('id/message_list"');
  66.     if (listIdx === -1) {
  67.         print.log("⚠ 未找到消息列表节点,可能不在豆包对话页面");
  68.         return 回答列表;
  69.     }

  70.     // 截取 message_list 之后的部分
  71.     var 后面 = xmlStr.substring(listIdx);

  72.     // 遍历所有 content_view 节点
  73.     var 位置 = 0;
  74.     while (true) {
  75.         var cvIdx = 后面.indexOf('id/content_view"', 位置);
  76.         if (cvIdx === -1) break;

  77.         // 从 content_view 起始位置截取一段,找它内部第一个有非空 text 的 TextView
  78.         var 段 = 后面.substring(cvIdx);
  79.         // 找到 content_view 节点开始标签的结束位置 ">"
  80.         var 标签结束 = 段.indexOf(">");
  81.         if (标签结束 === -1) break;
  82.         var 子段 = 段.substring(标签结束 + 1);

  83.         // 在子段中查找第一个有非空 text 的 TextView 节点
  84.         var 文本匹配 = 子段.match(/<node[^>]*?text="([^"]+)"[^>]*?class="android\.widget\.TextView"[^>]*?\/?>/);
  85.         if (!文本匹配) {
  86.             // 备选顺序:先 class 再 text
  87.             文本匹配 = 子段.match(/<node[^>]*?class="android\.widget\.TextView"[^>]*?text="([^"]+)"[^>]*?\/?>/);
  88.         }

  89.         if (文本匹配 && 文本匹配[1]) {
  90.             var 原始文本 = 文本匹配[1];
  91.             var 解码文本 = 解码HTML实体(原始文本);
  92.             if (严格过滤) {
  93.                 // 严格模式:排除按钮文案(复制、分享等),AI回答特征:含换行 或 长度>30
  94.                 if (解码文本.indexOf("\n") !== -1 || 字符串长度(解码文本) > 30) {
  95.                     回答列表.push(解码文本);
  96.                 }
  97.             } else {
  98.                 // 宽松模式:只要有非空文本就算,用于灵敏检测新回答出现
  99.                 if (字符串长度(解码文本) > 0) {
  100.                     回答列表.push(解码文本);
  101.                 }
  102.             }
  103.         }

  104.         位置 = cvIdx + 30;
  105.     }

  106.     return 回答列表;
  107. }

  108. // 查找输入框中心坐标(resource-id 含 input_text 的 EditText)
  109. function 查找输入框中心(xml) {
  110.     var xmlStr = "" + xml;
  111.     var idx = xmlStr.indexOf('id/input_text"');
  112.     if (idx === -1) return null;

  113.     var 段 = xmlStr.substring(idx);
  114.     var m = 段.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  115.     if (!m) return null;

  116.     var x1 = parseInt(m[1]);
  117.     var y1 = parseInt(m[2]);
  118.     var x2 = parseInt(m[3]);
  119.     var y2 = parseInt(m[4]);
  120.     return {
  121.         x: (x1 + x2) / 2,
  122.         y: (y1 + y2) / 2
  123.     };
  124. }

  125. // 查找发送按钮坐标
  126. // 豆包输入框右侧的 action_speak 节点,输入文字后会变成发送按钮
  127. // 也查找文字"发送"或 resource-id 含 action_send 的节点
  128. function 查找发送按钮中心(xml) {
  129.     var xmlStr = "" + xml;

  130.     // 1. 优先查找文字"发送"
  131.     var sendTextIdx = xmlStr.indexOf('text="发送"');
  132.     if (sendTextIdx !== -1) {
  133.         var 段 = xmlStr.substring(sendTextIdx);
  134.         var m = 段.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  135.         if (m) {
  136.             return {
  137.                 x: (parseInt(m[1]) + parseInt(m[3])) / 2,
  138.                 y: (parseInt(m[2]) + parseInt(m[4])) / 2
  139.             };
  140.         }
  141.     }

  142.     // 2. 查找 resource-id 含 action_send
  143.     var sendIdIdx = xmlStr.indexOf('id/action_send"');
  144.     if (sendIdIdx !== -1) {
  145.         var 段2 = xmlStr.substring(sendIdIdx);
  146.         var m2 = 段2.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  147.         if (m2) {
  148.             return {
  149.                 x: (parseInt(m2[1]) + parseInt(m2[3])) / 2,
  150.                 y: (parseInt(m2[2]) + parseInt(m2[4])) / 2
  151.             };
  152.         }
  153.     }

  154.     // 3. 兜底:使用 action_speak 节点坐标(输入文字后该按钮变为发送功能)
  155.     var speakIdx = xmlStr.indexOf('id/action_speak"');
  156.     if (speakIdx !== -1) {
  157.         var 段3 = xmlStr.substring(speakIdx);
  158.         var m3 = 段3.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  159.         if (m3) {
  160.             return {
  161.                 x: (parseInt(m3[1]) + parseInt(m3[3])) / 2,
  162.                 y: (parseInt(m3[2]) + parseInt(m3[4])) / 2
  163.             };
  164.         }
  165.     }

  166.     return null;
  167. }

  168. // 粘贴文本到当前焦点输入框(剪贴板法,兼容中文)
  169. function 粘贴文本(文本) {
  170.     try {
  171.         Clipboard.copy("" + 文本);
  172.     } catch (e) {
  173.         print.log("⚠ Clipboard.copy 失败:" + e.message);
  174.     }
  175.     sleep.millisecond(毫秒 = 300);

  176.     // 双保险:通过 shell 写剪贴板
  177.     try {
  178.         agent.shell("service call clipboard 3 i32 1 s16 '" + 文本 + "' i32 0");
  179.     } catch (e2) {
  180.         // 忽略错误
  181.     }
  182.     sleep.millisecond(毫秒 = 300);

  183.     // 触发粘贴:KEYCODE_PASTE = 279
  184.     agent.shell("input keyevent 279");
  185.     sleep.second(秒 = 1);
  186.     print.log("✓ 已粘贴文本:" + 文本);
  187. }

  188. // 查找并点击AI回答底部的展开按钮(向下箭头)
  189. // 豆包长回答会折叠显示,需要点击展开箭头才能看到完整内容
  190. // 从XML中动态定位,不依赖硬编码坐标
  191. function 查找并点击展开按钮(xml) {
  192.     var xmlStr = "" + xml;
  193.    
  194.     // 1. 查找 content-desc 含"展开"或"更多"的按钮
  195.     var expandIdx = xmlStr.indexOf('content-desc="展开"');
  196.     if (expandIdx === -1) {
  197.         expandIdx = xmlStr.indexOf('content-desc="更多"');
  198.     }
  199.     if (expandIdx === -1) {
  200.         expandIdx = xmlStr.indexOf('content-desc="收起"');
  201.     }
  202.    
  203.     if (expandIdx !== -1) {
  204.         var 段 = xmlStr.substring(expandIdx);
  205.         var m = 段.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  206.         if (m) {
  207.             var x = (parseInt(m[1]) + parseInt(m[3])) / 2;
  208.             var y = (parseInt(m[2]) + parseInt(m[4])) / 2;
  209.             agent.click(x, y);
  210.             print.log("✓ 已点击展开按钮(content-desc),坐标(" + Math.round(x) + "," + Math.round(y) + ")");
  211.             sleep.second(秒 = 1);
  212.             return true;
  213.         }
  214.     }

  215.     // 2. 查找文本"展开"或"更多"的按钮
  216.     var textExpandIdx = xmlStr.indexOf('text="展开"');
  217.     if (textExpandIdx === -1) {
  218.         textExpandIdx = xmlStr.indexOf('text="更多"');
  219.     }
  220.     if (textExpandIdx !== -1) {
  221.         var 段2 = xmlStr.substring(textExpandIdx);
  222.         var m2 = 段2.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  223.         if (m2) {
  224.             var x2 = (parseInt(m2[1]) + parseInt(m2[3])) / 2;
  225.             var y2 = (parseInt(m2[2]) + parseInt(m2[4])) / 2;
  226.             agent.click(x2, y2);
  227.             print.log("✓ 已点击展开按钮(文本匹配),坐标(" + Math.round(x2) + "," + Math.round(y2) + ")");
  228.             sleep.second(秒 = 1);
  229.             return true;
  230.         }
  231.     }

  232.     // 3. 兜底:从XML解析最后一个 content_view 的底部中心位置(展开箭头通常在回答底部中间)
  233.     var lastCVIdx = xmlStr.lastIndexOf('id/content_view"');
  234.     if (lastCVIdx !== -1) {
  235.         var cv段 = xmlStr.substring(lastCVIdx);
  236.         var cvM = cv段.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  237.         if (cvM) {
  238.             var cvX1 = parseInt(cvM[1]);
  239.             var cvY1 = parseInt(cvM[2]);
  240.             var cvX2 = parseInt(cvM[3]);
  241.             var cvY2 = parseInt(cvM[4]);
  242.             // 点击 content_view 底部中间位置(展开箭头通常在这里)
  243.             var centerX = (cvX1 + cvX2) / 2;
  244.             var bottomY = cvY2 - 50; // 稍微往上一点,避开边缘
  245.             agent.click(centerX, bottomY);
  246.             print.log("✓ 已点击content_view底部(兜底展开),坐标(" + Math.round(centerX) + "," + Math.round(bottomY) + ")");
  247.             sleep.second(秒 = 1);
  248.             return true;
  249.         }
  250.     }

  251.     // 4. 最终兜底:使用屏幕百分比坐标(仅作为最后备选)
  252.     var pctX = 屏幕宽 / 2;
  253.     var pctY = 屏幕高 * 0.85;
  254.     agent.click(pctX, pctY);
  255.     print.log("✓ 已点击屏幕底部(最终兜底),坐标(" + Math.round(pctX) + "," + Math.round(pctY) + ")");
  256.     sleep.second(秒 = 1);
  257.     return true;
  258. }

  259. // 从XML解析 message_list 的边界,然后在其中滑动到底部
  260. // 不依赖硬编码坐标,换手机也能运行
  261. function 滑动消息列表到底部(xml) {
  262.     var xmlStr = "" + xml;
  263.     var listIdx = xmlStr.indexOf('id/message_list"');
  264.     if (listIdx === -1) {
  265.         print.log("⚠ 未找到message_list,使用屏幕百分比滑动");
  266.         agent.swip(屏幕宽 / 2, 屏幕高 * 0.3, 屏幕宽 / 2, 屏幕高 * 0.8, 500);
  267.         return;
  268.     }

  269.     var 段 = xmlStr.substring(listIdx);
  270.     var m = 段.match(/bounds="\[(\d+),(\d+)\]\[(\d+),(\d+)\]"/);
  271.     if (!m) {
  272.         print.log("⚠ 未找到message_list边界,使用屏幕百分比滑动");
  273.         agent.swip(屏幕宽 / 2, 屏幕高 * 0.3, 屏幕宽 / 2, 屏幕高 * 0.8, 500);
  274.         return;
  275.     }

  276.     var x1 = parseInt(m[1]);
  277.     var y1 = parseInt(m[2]);
  278.     var x2 = parseInt(m[3]);
  279.     var y2 = parseInt(m[4]);

  280.     // 在 message_list 区域内滑动:从上半部分滑到下半部分
  281.     var startX = (x1 + x2) / 2;
  282.     var startY = y1 + (y2 - y1) * 0.2; // 区域上方20%位置
  283.     var endX = startX;
  284.     var endY = y1 + (y2 - y1) * 0.8;   // 区域下方20%位置

  285.     agent.swip(startX, startY, endX, endY, 500);
  286.     print.log("✓ 已在message_list内滑动,区域[" + x1 + "," + y1 + "][" + x2 + "," + y2 + "]");
  287. }
  288. // 等待AI回答完成
  289. // 逻辑:
  290. //   阶段1:宽松检测 - 等待最后一条回答文本变化(新回答出现)
  291. //   阶段2:检测到新回答后,先点击展开按钮,再等待回答输出等待秒,然后直接返回
  292. //   超时兜底:若整体超时但能采到非空文本,也返回当前内容
  293. // 参数:发送前的最后一条AI回答文本(用于对比检测新回答)
  294. // 返回:新回答的文本内容
  295. function 等待AI回答完成(发送前的最后文本) {
  296.     var 已耗时 = 0;
  297.     var 检查间隔秒 = 2;
  298.     var 已检测到新回答 = false;
  299.     var 检测到的时间点 = 0;
  300.     var 已点击展开按钮 = false;

  301.     while (已耗时 < 等待回答超时秒) {
  302.         sleep.second(秒 = 检查间隔秒);
  303.         已耗时 += 检查间隔秒;

  304.         var xml = 获取UI();

  305.         if (!已检测到新回答) {
  306.             // 阶段1:宽松模式检测新回答是否出现
  307.             var 宽松列表 = 采集AI回答列表(xml, false);
  308.             if (宽松列表.length === 0) {
  309.                 continue;
  310.             }
  311.             var 当前最后文本 = 宽松列表[宽松列表.length - 1];
  312.             if (当前最后文本 !== 发送前的最后文本 && 字符串长度(当前最后文本) > 0) {
  313.                 print.log("✓ 检测到新回答出现(" + 已耗时 + "秒),等待" + 回答输出等待秒 + "秒后采集");
  314.                 已检测到新回答 = true;
  315.                 检测到的时间点 = 已耗时;
  316.             }
  317.         } else {
  318.             // 阶段2:已检测到新回答
  319.             var 已等待 = 已耗时 - 检测到的时间点;
  320.             
  321.             // 先点击展开按钮(只点击一次)
  322.             if (!已点击展开按钮 && 已等待 >= 2) {
  323.                 查找并点击展开按钮(xml);
  324.                 已点击展开按钮 = true;
  325.             }
  326.             
  327.             // 再等回答输出等待秒后直接返回
  328.             if (已等待 >= 回答输出等待秒) {
  329.                 var 严格列表 = 采集AI回答列表(xml, true);
  330.                 if (严格列表.length > 0) {
  331.                     var 最终回答 = 严格列表[严格列表.length - 1];
  332.                     if (最终回答 !== 发送前的最后文本 && 字符串长度(最终回答) > 0) {
  333.                         print.log("✓ 已等待" + 已等待 + "秒,返回采集结果");
  334.                         return 最终回答;
  335.                     }
  336.                 }
  337.                 // 严格模式没采到,用宽松模式
  338.                 var 宽松列表2 = 采集AI回答列表(xml, false);
  339.                 if (宽松列表2.length > 0) {
  340.                     var 最终回答2 = 宽松列表2[宽松列表2.length - 1];
  341.                     if (最终回答2 !== 发送前的最后文本 && 字符串长度(最终回答2) > 5) {
  342.                         print.log("✓ 已等待" + 已等待 + "秒(宽松模式),返回采集结果");
  343.                         return 最终回答2;
  344.                     }
  345.                 }
  346.             }
  347.         }
  348.     }

  349.     // 超时兜底:尽量返回当前能采集到的最后一条回答
  350.     print.log("⚠ 等待AI回答超时(" + 等待回答超时秒 + "秒),尝试返回当前内容");
  351.     var xml = 获取UI();
  352.     var 兜底列表 = 采集AI回答列表(xml, true);
  353.     if (兜底列表.length > 0) {
  354.         var 兜底文本 = 兜底列表[兜底列表.length - 1];
  355.         if (兜底文本 !== 发送前的最后文本) {
  356.             print.log("✓ 超时兜底:返回当前采集到的回答");
  357.             return 兜底文本;
  358.         }
  359.     }
  360.     var 兜底宽松 = 采集AI回答列表(xml, false);
  361.     if (兜底宽松.length > 0) {
  362.         var 兜底文本2 = 兜底宽松[兜底宽松.length - 1];
  363.         if (兜底文本2 !== 发送前的最后文本 && 字符串长度(兜底文本2) > 5) {
  364.             print.log("✓ 超时兜底(宽松):返回当前采集到的回答");
  365.             return 兜底文本2;
  366.         }
  367.     }
  368.     return null;
  369. }

  370. // 获取当前页面最后一条AI回答文本(用于发送前记录基线)
  371. function 获取当前最后AI回答(xml) {
  372.     var 回答列表 = 采集AI回答列表(xml);
  373.     if (回答列表.length === 0) return "";
  374.     return 回答列表[回答列表.length - 1];
  375. }

  376. // 格式化对话内容输出
  377. function 格式化对话(对话列表) {
  378.     var 输出 = "";
  379.     输出 += "========================================\n";
  380.     输出 += "豆包对话采集记录\n";
  381.     输出 += "采集时间:" + new Date().toString() + "\n";
  382.     输出 += "对话轮数:" + 对话列表.length + "\n";
  383.     输出 += "========================================\n\n";

  384.     for (var i = 0; i < 对话列表.length; i++) {
  385.         var 对话 = 对话列表[i];
  386.         if (对话.角色 === "用户") {
  387.             输出 += "【用户提问 " + (i + 1) + "】\n";
  388.         } else {
  389.             输出 += "【豆包回答 " + (i + 1) + "】\n";
  390.         }
  391.         输出 += 对话.内容 + "\n";
  392.         输出 += "----------------------------------------\n\n";
  393.     }

  394.     输出 += "\n===== 采集结束 =====\n";
  395.     return 输出;
  396. }

  397. // 写入文件(UTF-8 BOM格式,兼容Windows记事本)
  398. function 写入文件(文件路径, 内容) {
  399.     try {
  400.         var fos = new java.io.FileOutputStream(文件路径);
  401.         var osw = new java.io.OutputStreamWriter(fos, "UTF-8");
  402.         osw.write('\ufeff');
  403.         osw.write(内容);
  404.         osw.flush();
  405.         osw.close();
  406.         fos.close();
  407.         print.log("✓ 已写入文件(UTF-8 BOM):" + 文件路径);
  408.         
  409.         var catResult = agent.shell("cat " + 文件路径 + " | head -3");
  410.         print.log("✓ cat验证结果:" + catResult);
  411.         
  412.         var fileSize = agent.shell("ls -la " + 文件路径);
  413.         print.log("✓ 文件信息:" + fileSize);
  414.         
  415.         return true;
  416.     } catch (e) {
  417.         print.log("⚠ UTF-8 BOM写入异常:" + e.message);
  418.     }

  419.     try {
  420.         var fos2 = new java.io.FileOutputStream(文件路径);
  421.         fos2.write(239);
  422.         fos2.write(187);
  423.         fos2.write(191);
  424.         fos2.write(内容.getBytes("UTF-8"));
  425.         fos2.close();
  426.         print.log("✓ 已写入文件(字节写入BOM):" + 文件路径);
  427.         return true;
  428.     } catch (e2) {
  429.         print.log("⚠ 字节写入异常:" + e2.message);
  430.     }

  431.     print.log("✗ 写入文件失败:" + 文件路径);
  432.     return false;
  433. }

  434. // ========== 主流程开始 ==========

  435. // 步骤1:启动豆包APP
  436. print.log("\n========== 步骤1:启动豆包APP ==========");
  437. try {
  438.     app.openApp(豆包包名);
  439.     print.log("✓ 已启动豆包");
  440. } catch (e) {
  441.     print.log("⚠ 启动失败:" + e.message);
  442. }
  443. sleep.second(秒 = 5);

  444. // 步骤2:确认进入对话页面
  445. print.log("\n========== 步骤2:确认进入对话页面 ==========");
  446. var xml = 获取UI();
  447. if (xml.indexOf("message_list") === -1) {
  448.     print.log("⚠ 当前页面可能不是豆包对话页,再次等待");
  449.     sleep.second(秒 = 3);
  450.     xml = 获取UI();
  451. }

  452. if (xml.indexOf("message_list") !== -1) {
  453.     print.log("✓ 已进入豆包对话页面");
  454. } else {
  455.     print.log("⚠ 未检测到消息列表,继续尝试");
  456. }

  457. // 步骤3:循环发送问题并采集回答
  458. print.log("\n========== 步骤3:循环发送问题并采集回答 ==========");

  459. // 完整对话列表(包含用户问题和AI回答)
  460. var 完整对话 = [];

  461. // 先采集当前页面已有的AI回答
  462. var 已有回答 = 采集AI回答列表(xml);
  463. print.log("✓ 当前页面已有AI回答数量:" + 已有回答.length);
  464. for (var i = 0; i < 已有回答.length; i++) {
  465.     完整对话.push({
  466.         角色: "AI",
  467.         内容: 已有回答[i]
  468.     });
  469. }

  470. // 开始发送问题
  471. for (var q = 0; q < 要发送的问题列表.length; q++) {
  472.     var 当前问题 = 要发送的问题列表[q];
  473.     print.log("\n---- 第 " + (q + 1) + " / " + 要发送的问题列表.length + " 个问题 ----");
  474.     print.log("问题:" + 当前问题);

  475.     // 3.1 重新获取UI,定位输入框
  476.     xml = 获取UI();
  477.     var 输入框 = 查找输入框中心(xml);
  478.     if (!输入框) {
  479.         print.log("⚠ 未找到输入框,跳过此问题");
  480.         sleep.second(秒 = 问题间隔秒);
  481.         continue;
  482.     }

  483.     // 3.2 记录发送前的最后一条AI回答文本(作为检测新回答的基线)
  484.     var 发送前最后文本 = 获取当前最后AI回答(xml);

  485.     // 3.3 点击输入框获取焦点
  486.     agent.click(输入框.x, 输入框.y);
  487.     sleep.second(秒 = 1);

  488.     // 3.4 粘贴问题文本
  489.     粘贴文本(当前问题);

  490.     // 3.5 重新获取UI,查找发送按钮
  491.     xml = 获取UI();
  492.     var 发送按钮 = 查找发送按钮中心(xml);

  493.     if (发送按钮) {
  494.         agent.click(发送按钮.x, 发送按钮.y);
  495.         print.log("✓ 已点击发送按钮");
  496.     } else {
  497.         // 兜底:按回车键发送
  498.         agent.shell("input keyevent 66");
  499.         print.log("⚠ 未找到发送按钮,已尝试按回车发送");
  500.     }

  501.     // 3.6 记录用户问题
  502.     完整对话.push({
  503.         角色: "用户",
  504.         内容: 当前问题
  505.     });

  506.     // 3.7 等待AI回答完成(基于"最后一条回答文本变化"判断,不依赖数量递增)
  507.     print.log("等待AI回答,发送前最后文本长度:" + 字符串长度(发送前最后文本));

  508.     var 新回答文本 = 等待AI回答完成(发送前最后文本);
  509.     if (新回答文本 && 字符串长度(新回答文本) > 0) {
  510.         完整对话.push({
  511.             角色: "AI",
  512.             内容: 新回答文本
  513.         });
  514.         print.log("✓ 采集到新回答,当前总对话条数:" + 完整对话.length);
  515.         print.log("--- 采集内容开始 ---");
  516.         print.log(新回答文本);
  517.         print.log("--- 采集内容结束 ---");
  518.     } else {
  519.         print.log("⚠ 未能采集到新回答");
  520.     }

  521.     sleep.second(秒 = 问题间隔秒);
  522. }

  523. // 步骤4:保存对话到文件
  524. print.log("\n========== 步骤4:保存对话到文件 ==========");
  525. var 输出内容 = 格式化对话(完整对话);
  526. var 写入成功 = 写入文件(输出文件路径, 输出内容);

  527. if (写入成功) {
  528.     print.log("✓ 对话已保存到:" + 输出文件路径);
  529.     print.log("✓ 总对话条数:" + 完整对话.length);
  530. } else {
  531.     print.log("✗ 保存失败,请检查存储权限");
  532. }

  533. // 步骤5:打印全部采集到的对话内容
  534. print.log("\n========== 全部采集内容 ==========");
  535. print.log(输出内容);
  536. print.log("========== 内容结束 ==========");

  537. print.log("\n===== 豆包对话采集流程结束 =====");
复制代码


举报 回复