情报动态 15

工具 🟢

career-ops:本地运行的 AI 求职 Agent 工具

career-ops 开源 AI 求职工具:扫描职位门户、按 A-F 结构化评分、定制简历、跟踪申请,完全本地运行于 Claude Code、Codex、OpenCode 等 Agent CLI。

工具 🟢

OpenMed:开源医疗 AI 项目 5000+ stars 上榜 Trending

开源医疗 AI 项目 OpenMed 宣布 GitHub stars 突破 5000 并登上 Trending 榜单,反映垂直领域 Agent 应用的开源热度持续上升。

工具 🟢

OpenViking:开源统一 Agent 记忆/知识/技能层(29K stars)

字节跳动火山引擎开源 OpenViking:把 Agent 记忆、知识 RAG 与技能合并为自进化上下文层,Apache 许可,提供 Python 库与火山引擎托管 API,可接入任意 Agent 框架。

工具 🟢

DeepSeek Harness:插件化 AI Agent 运行时正式开源

DeepSeek 开源 Agent 运行时 DeepSeek Harness:基于 Node.js、MIT 许可,提供四种执行模式,"一切皆插件",支持 Anthropic、OpenAI、AWS Bedrock、Azure 与 Gemini 平台,并可把子任务直派给 Claude Code 与 Codex。

GitHub 🟢

modular/modular:Mojo 语言仓库持续高热(27.5K stars)

Mojo 语言 GitHub 仓库继续保持热度,27.5K stars,单日新增约 340,面向高性能 AI 计算编程语言生态持续壮大。

GitHub 🟢

mattpocock/skills:超 22 万 stars 的 Agent 技能合集

mattpocock/skills 集合了大量可供 AI 编程 Agent 直接调用的技能文件,star 数已超 22.4 万,成为 Agent 技能生态的标杆仓库。

GitHub 🟢

ai-memory:Rust 编写的 Agent 记忆库(单日 +335 stars)

akitaonrails/ai-memory 用 Rust 实现轻量 Agent 记忆存储,3.4K stars 且单日新增 335,主打高性能本地记忆管理。

GitHub 🟢

career-ops:开源 AI 求职助手(66K stars)

santifer/career-ops 以 AI 驱动求职全流程:扫描职位门户、按 A-F 结构评分、定制简历并跟踪申请,本地运行于 Claude Code、Codex、OpenCode 等 Agent CLI。

GitHub 🟢

Prime Agent:把 Agent 放进 Python Shell 的开源项目(11.4K stars)

Prime Intellect 开源 Prime Agent,单日冲上 GitHub Trending 第一(2319 stars)。核心思路是让模型持有持久 Python 解释器会话,把文件、命令与上下文管理全部当作代码来写,基于递归语言模型理念。

GitHub 🟢

OpenViking:字节跳动开源 AI 智能体统一上下文层(29K stars)

字节跳动火山引擎开源 OpenViking,将 Agent 记忆、知识 RAG 与技能整合为自进化上下文层,Apache 许可,单日新增 213 stars,社区已出现 OpenClaw 插件。

GitHub 🟢

DeepSeek Harness 破 GitHub 史上最快涨星纪录(14 万+ stars)

DeepSeek 于 8 月 13 日开源 AI 智能体运行时 DeepSeek Harness,一小时内突破 2 万 stars,刷新 Grok-1 保持的最快纪录,四天超过 13 万 stars。采用"一切皆插件"设计,支持多种执行模式与 Anthropic、OpenAI、AWS、Azure、Gemini 等平台。

行业 🟢

Together AI融资8亿美元,估值83亿美元

开源AI基础设施公司Together AI完成8亿美元融资,估值达83亿美元。作为AI推理和训练平台,Together AI持续获得资本追捧,反映市场对AI基础设施的强劲需求。

学习 🟢

AgentLens: 评估AI编程Agent的完整轨迹而非只看结果

🔍 发生了什么:提出AgentLens基准测试,不再用单一通过/失败评判代码Agent,而是评估整个交互轨迹——包括指令遵循、工具使用、自我验证、错误恢复和用户沟通质量。结合形式化验证与LLM轨迹评审,生成可读的评分解释。 💡 技术原理:将形式化验证(客观检查存在时)与LLM编写的轨迹评审和并排对比相结合。每个运行产生一个可读的评分解释文档,支持模型行为诊断、版本回归检测和夜间评估流水线。 🔧 快速上手:开源项目 github.com/agent-lens/agent-lens-bench,可直接集成到CI/CD流水线中,用于持续监控编程Agent质量。 🎯 应用场景:AI编程助手(Copilot/Cursor/Cline)的质量评估、Agent版本迭代监控、产品回归检测。 🔗 相似技术:SWE-bench、HumanEval、BigCodeBench(但这些只看结果不看过程)。 💴 商业潜力:★★★★☆ Agent评估是刚需市场,尤其在AI编程助手竞争白热化的当下。 📚 学习路径:了解SWE-bench → 研究轨迹评估方法论 → 部署AgentLens → 构建自定义评估pipeline。

security_alert 🟢

GitHub将在npm 12中默认禁用安装脚本以防供应链攻击

GitHub宣布npm 12将默认关闭install脚本,阻断通过npm生命周期钩子执行恶意代码的供应链攻击手法。这是应对近期供应链攻击激增的重大架构性变革。

security_alert 🟢

GitHub默认禁用npm安装脚本以遏制供应链攻击

GitHub宣布将默认禁用npm包的安装脚本(preinstall/postinstall),这是针对npm生态系统供应链攻击频发的防御措施。开发者需显式信任才能启用脚本执行。该变更将分阶段实施,预计影响数百万开源项目。