X科技时光轴

用时间轴记录世界科技前沿与开发实践

全部 AI (13) Github (9) Mac (4) Web (5) 分享 (4) 创意 (3) 提示词 (5) 设计 (9)

标签「AI Agent」下的文章

2026
09
2026
29 · 周二
09-29 10:58
#AI
Claude Opus 5.5公布官方的Prompt指南了 几个要点: 1. 思考强度默认开medium即可 2. 注意这个模型不支持关闭思考 3. 长任务里,模型发进度消息不代表任务已经完成。 4. 可以在提示词里明确要求:事情没做完就继续做,不要只总结下一步。 5. 如果想让用户看到执行进度,需要正确接收和展示 progress updates。 6. 做跨邮件、文档、表格等多应用任务时,先把相关上下文找全再行动。 7. 多 Agent 任务可以给时间预算,让模型更积极并行处理。 8. 聊天场景里不用再写“请仔细思考”,可能只会增加延迟。 9. 用户粘贴进来的内容最好单独标记,避免把里面的文字误当成用户指令。 10. 模型看图能力更强了;复杂图表和技术图纸仍可以配合裁剪、放大等工具。 11. 做前端时,不要只说“不要 AI 味”,要明确写出不想要哪些具体设计风格。 13. 注意新的安全机制,尤其不要要求模型输出完整内部思考过程。
展开全文
09-29 10:35
#Github
开源的Grok Bot替代品Openbot,一个月前就有了,没有移动版。 官网挺好看的。 Github :https://github.com/CopilotKit/openbot
展开全文
24 · 周四
09-24 16:40
#AI
JEV 的案例合集怎么用?200多个实战案例,JEV 使用场景与玩法整理 视频封面
大家速度太快了,这个网站已经收纳了200多个JEV的案例了。值得学习下。 最多的是案例是教程、评测和各种脑洞实验(54 条,约 27%),其次是游戏与实时控制(40 条,约 20%)。 分类打标 26 条,编码审查压缩 21 条,浏览器电脑和路由选模型各 16 条。 地址见评论👇 https://render.qmuse.pub/p/muse/8079593307628562/index.html
展开全文
09-24 16:40
#Github
雨哥向前冲 雨哥向前冲 2026年09月24日 16:40
BrowserSkill 怎么用?腾讯开源浏览器连接工具,复用 Chrome 登录态操作教程 视频封面
腾讯刚开源的 BrowserSkill也太给力了啊! 我用 WorkBuddy 实测了一遍。 装好以后,WorkBuddy 可以直接操作你已经登录的 Chrome,自己打开网页、搜索内容、点击页面、读取数据和截图。 以前让 Agent 操作浏览器,经常会启动一个全新的环境。账号没有登录,浏览器里原来的页面和状态也用不上。BrowserSkill 可以直接复用现有的浏览器登录状态,同时把任务放在单独的 Agent Window 里运行,不会打乱你正在使用的窗口。 它由三个部分组成。 Skill 告诉 WorkBuddy 怎样操作浏览器,bsk CLI 负责在本机传递命令,浏览器插件负责连接 Chrome。只要 Agent 能调用 Shell,就可以接入这套工具,所以除了 WorkBuddy,它也支持 Codex、Cursor、Claude Code 等 Agent。 这类工具很适合做网页资料调研、社交媒体热点搜索、重复的后台操作,也可以拿来检查网页和测试前端。 我这次用 WorkBuddy 做了几项测试: • bsk doctor 七项检查全部通过 • 识别出 Chrome 当前打开的 17 个标签页 • 找到了其中的 3 个 X 页面 • 新开页面搜索 “Gemini 4” • 读取并整理了 Top 排序里的 7 条结果 整个过程中,我原来打开的浏览器页面没有受到影响。任务结束以后,BrowserSkill 创建的 session 也正常关闭了。 安装同样很简单。 第一步,在 WorkBuddy 里手动安装 BrowserSkill。 第二步,让 WorkBuddy 帮你安装 bsk CLI,下载、配置和检查环境都交给它。 第三步,在 Chrome 商店安装 BrowserSkill 插件,然后确认连接成功。 需要自己动手的地方,基本只有安装 Skill 和浏览器插件。剩下的安装与测试都可以直接交给 WorkBuddy。 我把完整的安装和实测过程录下来了,想试的可以跟着视频走一遍。 项目地址 https://github.com/Tencent/BrowserSkill Chrome 插件 https://chromewebstore.google.com/detail/browserskill/hhcmgoofomhgciiibhipgmgkgnoenaoi
展开全文
23 · 周三
09-23 20:10
#Github
Jev 大家用上没有啊,可太好用了 整理了一批 Jev 项目,大家可以参考啊。 1. fast-jev-compaction Claude Code 插件。每次工具调用后,用 Jev 判断哪些内容该保留、压缩或丢弃,减少上下文膨胀。 https://github.com/tamaratran/fast-jev-compaction 2. jev-browser 让 LLM 负责规划,Jev 负责浏览器里的具体选择。支持 CLI、Library 和 MCP。 https://github.com/Ying-Kai-Liao/jev-browser 3. jev-search 把 Jev 用在搜索流程里,负责理解查询、选择信息源、筛选结果。 https://t.co/fm3NEdRMk9 4. Reticle 给 Web 和桌面应用增加运行时感知能力,帮助 Agent 理解自己正在操作的界面。 https://github.com/superagents-lab/jev-search 5. NanoJev 一个 Jev 的轻量复现项目,包含并行决策、动态候选项和完整训练流程。 https://github.com/TianyuCodings/NanoJev 6. open-alternative-jev 尝试用开源模型复现 Jev 风格的 System One 决策层,并提供基准测试。 https://github.com/ikermoel/open-alternative-jev 7. pi-jev 把 Jev 接入 Pi coding agent,用来控制工具调用,也支持类型化、带置信度的回答。 https://github.com/y0usaf/pi-jev 8. hermes-jev-skills 直接把 Jev 接进 Hermes、Claude Code 和 Codex,覆盖模型路由、记忆、上下文压缩、Skill 选择和浏览器操作。 https://github.com/kerpopule/hermes-jev-skills 这个列表感觉收藏吧,早晚用的上。
展开全文
09-23 20:10
#Github
Power|资料过滤器 Power|资料过滤器 2026年09月23日 20:10
这个项目我觉得是历史爱好者最容易低估的一套“史记导航系统”。 有人用 AI 把《史记》约 57.7 万字,拆成了一张可以点击、搜索、跳转的知识图谱。 里面有 1.4 万+实体、3200+历史事件、7000+事件关系、130条“地铁图式”时间线、2万+ Wiki 页面。 最值钱的不是数据多,而是你点开一个人,就能顺着 人物 → 事件 → 地点 → 时间 → 原文 一路挖下去。 以前读《史记》最痛苦的是:人物太多、篇章太散、时间容易乱。这个项目直接把两千多年前的史书,做成了一张能点进去翻的关系网。 尤其推荐它的“史记地铁图”,每篇像一条线路,事件像站点,查“谁和谁同时在干什么”特别直观。 在线版: https://shiji.memify.wiki/ GitHub: https://github.com/baojie/shiji-kb 喜欢《史记》、历史研究、知识图谱的人,这个真的值得收藏。
展开全文
09-23 20:09
#AI
Tiger Chen & 前端之虎陈随易 Tiger Chen & 前端之虎陈随易 2026年09月23日 20:09
这是我累计在上面消耗了70多亿token的agent工具,建议大家试试,下载地址:https://finchwork.app/zh
展开全文