AI 资讯 Tessary开源:双层架构监控AI代理生产轨迹 admin 2026-10-10 18 次阅读 Tessary是开源的AI代理可靠性平台,通过L1分类器低成本标记错误轨迹,L2代理定位根因,据称在百万轨迹下比采样评测便宜5倍,支持自托管与OTLP接入。 开源 AI代理 可观测性 评测 可靠性 阅读全文
AI 资讯 前Meta工程师发布TypeScript开源AI代理Chloe admin 2026-10-08 55 次阅读 一位前Meta工程师推出开源AI代理Chloe,主张用TypeScript编写全部逻辑、本地掌控代码与数据,并避免不必要的LLM调用。项目当前版本0.25.1,已发布npm包。 开源 AI代理 TypeScript npm 阅读全文
AI 资讯 HieraticBench:用古埃及僧侣体测试大模型识别能力 admin 2026-10-07 73 次阅读 开发者构建 HieraticBench 基准,包含 268 个古埃及僧侣体项目,用于测试大模型识别与翻译古文字的能力,初步结果显示模型在真实文献上识别率尚可但解读准确率极低。 开源 基准测试 大模型评测 古文字识别 阅读全文
AI 资讯 OpenChart 开源:让 AI 代理直接操作金融图表 admin 2026-10-07 74 次阅读 OpenChart 是 TradingView 的开源替代方案,支持 Claude、Codex 等 AI 代理在图表中批注、编写指标、创建预警并保存研究,目前仅支持 Apple Silicon 版 macOS。 开源 AI代理 开发者工具 金融图表 阅读全文
AI 资讯 AgentTerm:为 AI CLI 打造的扩展终端工具 admin 2026-10-02 126 次阅读 开发者发布 AgentTerm,将 AI CLI 会话扩展为可视化工作区,保留终端界面与现有功能,支持计划编写、代码审查与手机续接会话。 开源 AI CLI 终端工具 AI编程 阅读全文
AI 资讯 新基准测试显示AI难以主动发现代码缺陷 admin 2026-10-02 142 次阅读 Meta、斯坦福等机构研究者发布SWE-Sweep基准,覆盖100个代码库和4000个真实缺陷。测试显示最佳模型修复率仅4.7%,且成本高达7230美元,主动发现缺陷仍是难题。 开源 基准测试 AI 智能体 软件工程 SWE-bench 阅读全文
AI 资讯 Relay 发布:让 AI 编程代理在失败中重试并验证 admin 2026-09-30 155 次阅读 Hacker News 上出现一款名为 Relay 的 AI 编程代理工具,通过循环尝试、隔离沙箱验证和错误学习,帮助代理在失败后恢复并以 Git PR 形式交付可读改动。 开源 开发者工具 AI编程代理 沙箱验证 阅读全文
AI 资讯 GitHub开源AI安全智能体助力发现24个Android漏洞 admin 2026-09-29 153 次阅读 GitHub利用其开源AI安全智能体在Android系统中发现了24个漏洞,展示了AI在自动化漏洞挖掘方面的潜力,相关细节已公开。 开源 AI安全智能体 漏洞挖掘 GitHub 阅读全文
AI 资讯 FAB基准发布:AI智能体财务尽调能力仍待提升 admin 2026-09-28 171 次阅读 前安永团队推出开源基准FAB,测试AI智能体在财务尽职调查中的表现,发现其能查找事实但难以完成可靠分析。 开源 AI智能体 基准测试 金融科技 阅读全文
AI 资讯 开源项目 Ogre MCP:让 AI 智能体读取魔兽世界经典版游戏状态 admin 2026-09-27 202 次阅读 GitHub 项目 Ogre MCP 在 Hacker News 的 Show HN 板块亮相,尝试通过 MCP 协议让 AI 智能体获取《魔兽世界》经典版的游戏状态信息。 开源 AI智能体 MCP 游戏 Hacker News 阅读全文
AI 资讯 Brig 开源:为 AI 编程代理提供 microVM 沙箱 admin 2026-09-23 217 次阅读 NOFire AI 开源 Brig,在 Mac 与 Linux 上以 microVM 隔离运行 AI 编程代理,代理拥有独立 Linux 内核,组件均为 Apache 2.0 许可。 开源 AI代理 沙箱 虚拟化 开发工具 阅读全文
AI 资讯 开源项目AI Employees发布:八种角色、60项例行任务 admin 2026-09-21 242 次阅读 开发者发布开源仓库AI Employees,提供覆盖SEO、销售、客服等八种业务角色的纯文本例行任务集,可在用户自己的机器和浏览器上运行。 AI Agent 开源 浏览器智能体 AI 员工 自动化 阅读全文