情报流
安全漏洞 · AI动态 · 加密 · 工具 · 行业情报
Agent 记忆与上下文层设计:从 OpenViking 学最佳实践
拆解 OpenViking 的统一上下文层设计:把 Agent 记忆、知识 RAG 与技能合并为一层自进化数据库,比"文件+向量库+散落配置"的方案更利于跨框架复用。
Top AI Product为什么 Agent 计费方式决定你的架构选型
Agent 应用按循环消耗 token:读文件、工具结果、改方案、生成代码,单次请求即多个回合。Sonnet 5 价格冻结让以完成任务成本评估模型变得可行,选型应从提示词单价转向端到端成本。
RuntimeWire递归语言模型(RecLM):Agent 上下文即代码的新范式
基于 arXiv:2512.24601 的递归语言模型思想:让 Agent 用持久 Python 会话管理自身上下文,文件、命令与子 Agent 全部以代码表达,Prime Agent 已将其产品化。
DEV CommunityAI Agent 成本控制实战:会话级预算与支出上限全解析
详解 2026 年 8 月的 Agent 成本控制方案:Anthropic 会话级美元硬预算、AWS Bedrock AgentCore 网关限流、Google 月度支出上限与 OpenAI 429 硬限制,以及 LiteLLM 的会话迭代预算做法,含边界与超支分析。
Nerd Level Techcareer-ops:本地运行的 AI 求职 Agent 工具
career-ops 开源 AI 求职工具:扫描职位门户、按 A-F 结构化评分、定制简历、跟踪申请,完全本地运行于 Claude Code、Codex、OpenCode 等 Agent CLI。
GitHubOpenMed:开源医疗 AI 项目 5000+ stars 上榜 Trending
开源医疗 AI 项目 OpenMed 宣布 GitHub stars 突破 5000 并登上 Trending 榜单,反映垂直领域 Agent 应用的开源热度持续上升。
ABAB Newsbrowser-use 发布 macOS harness:浏览器 Agent 直接操作 Mac
browser-use 推出实验性 macos-harness,让浏览器 Agent 直接控制 macOS 桌面,MIT 许可,99.8% Python,发布首日三连发三个版本,定位"实验性、仅 macOS"。
MoClawOpenViking:开源统一 Agent 记忆/知识/技能层(29K stars)
字节跳动火山引擎开源 OpenViking:把 Agent 记忆、知识 RAG 与技能合并为自进化上下文层,Apache 许可,提供 Python 库与火山引擎托管 API,可接入任意 Agent 框架。
Top AI ProductPrime Agent:把 Agent 装进 Python 解释器的新范式
Prime Intellect 的 Prime Agent 让模型持有持久 Python 会话,把上下文管理变成代码本身,单日 2319 stars 登顶 Trending。基于 2025 年 10 月的递归语言模型(arXiv:2512.24601)思想。
DEV CommunityDeepSeek Harness:插件化 AI Agent 运行时正式开源
DeepSeek 开源 Agent 运行时 DeepSeek Harness:基于 Node.js、MIT 许可,提供四种执行模式,"一切皆插件",支持 Anthropic、OpenAI、AWS Bedrock、Azure 与 Gemini 平台,并可把子任务直派给 Claude Code 与 Codex。
Digital Today微软 Copilot 换用自研模型:降本还是生态重构?
在 OpenAI/Anthropic 涨价背景下,微软 Copilot 已用更便宜的自研模型替换部分高价第三方模型,反映出大型平台厂商正加速模型自主化以控制 Agent 规模成本。
The Decoder美国拟强化前沿 AI 出口管制,企业面临模型选型合规风险
随着中国开源模型在企业端走强,美国官员警告可能对前沿 AI 技术实施更强出口管制;中国也考虑收紧自身技术出口以作反制。企业模型选型需同时权衡性能、成本与监管风险。
TechRepublic企业 AI 计费走向"消费化":Forrester 解读 Anthropic 定价模型
Forrester 分析指出,AI 厂商正从固定席位费转向"访问+按 token 消费"双轨计费,Anthropic 的平台访问与 Agent SDK 积分分离模式成为行业方向,企业预算压力转向用量治理。
ForresterAI 定价战升级:OpenAI、Anthropic 齐降前沿模型价格
OpenAI 与 Anthropic 两周内相继下调前沿模型价格,OpenAI 7 月 30 日对 GPT-5.6 家族降价,Anthropic 8 月 10 日宣布 Sonnet 5 价格冻结。开源权重模型与成本审计压力是主因。
The StackAnthropic 提交 IPO S-1 草案,估值瞄准 9650 亿美元
Anthropic 已向监管机构提交 IPO S-1 草案,此前 5 月完成 650 亿美元融资,投后估值 9650 亿美元。若顺利上市将成为史上最大 IPO,估值与 OpenAI(目标超 1 万亿美元)同处万亿美元量级。
Reuters开源权重模型挤压闭源定价:DoorDash、Airbnb、Coinbase 转用中国模型
硅谷数据显示 7 月中旬以来企业推理 token 支出正从闭源流向开源权重模型,DoorDash、Airbnb、Coinbase 等确认使用中国开源模型处理部分生产负载。OpenRouter 等路由服务加速了这一迁移。
TechRepublicOpenAI 硬性支出上限全量上线:超限返回 429
7 月 23 日起 OpenAI API 平台为所有账户提供组织/项目级硬性月度支出上限,超限请求返回 429(spend limit exceeded)。注意执行并非瞬时,可能存在轻微超额。
OpenAIAnthropic 上线会话级硬预算:单个 Agent 会话设美元上限
8 月 7 日 Anthropic 为 Claude Managed Agents 会话新增硬性美元预算(按美分整数),到达上限后暂停模型请求。AWS Bedrock AgentCore 前一日也上线网关级消费上限,Agent 成本控制进入会话粒度时代。
Nerd Level TechOpenAI 悄悄测试 $8 "付费重置配额" 功能
部分 ChatGPT Plus($20/月)用户在配额耗尽后看到黑色"支付 $8 重置"按钮。此前 6 月曾推出 Codex 重置机制,此举显示 OpenAI 正探索按用量二次变现。
Business InsiderOpenAI 推出 ChatGPT Business Premium Seats:$125/月/人
OpenAI 为 ChatGPT Business 新增 Premium Seats,$125/月(年付 $100),提供 5 倍用量且不受 5 小时限制,普通席位维持 $25。Agent 型工作负载消耗 token 剧增是涨价的直接原因。
The DecoderAnthropic 冻结 Sonnet 5 价格:$2/$10 永久化,取消 9 月涨价
Anthropic 于 8 月 10 日宣布 Claude Sonnet 5 的 $2/$10 每百万 token 首发价永久生效,取消原定 9 月 1 日涨至 $3/$15 的计划。对 Agent 应用而言,1 亿输入+2000 万输出 token 的月成本从 $6000 降至 $4000。
RuntimeWireOpenAI 大幅下调 GPT-5.6 Luna/Terra 价格:Luna 降价 80%
7 月 30 日 OpenAI 将最低端 GPT-5.6 Luna 价格下调 80%(0.20/1.2 美元每百万 token),中端 Terra 降价 20%(2/12 美元)。官方称源于底层效率提升,反映开源权重模型竞争压力。
The Stackmodular/modular:Mojo 语言仓库持续高热(27.5K stars)
Mojo 语言 GitHub 仓库继续保持热度,27.5K stars,单日新增约 340,面向高性能 AI 计算编程语言生态持续壮大。
GitHubbrowser-use/macos-harness:让浏览器 Agent 直接操作 macOS(发布即上榜)
browser-use 联合创始人发布 macos-harness,让 AI 浏览器 Agent 直接接管 macOS 桌面操作,MIT 许可,发布首日即上 Trending,定位实验性 macOS 自动化。
GitHubmattpocock/skills:超 22 万 stars 的 Agent 技能合集
mattpocock/skills 集合了大量可供 AI 编程 Agent 直接调用的技能文件,star 数已超 22.4 万,成为 Agent 技能生态的标杆仓库。
GitHubai-memory:Rust 编写的 Agent 记忆库(单日 +335 stars)
akitaonrails/ai-memory 用 Rust 实现轻量 Agent 记忆存储,3.4K stars 且单日新增 335,主打高性能本地记忆管理。
GitHubcareer-ops:开源 AI 求职助手(66K stars)
santifer/career-ops 以 AI 驱动求职全流程:扫描职位门户、按 A-F 结构评分、定制简历并跟踪申请,本地运行于 Claude Code、Codex、OpenCode 等 Agent CLI。
GitHubreverse-skill:面向攻防的智能体技能路由器(20K stars)
reverse-skill 登上 GitHub Trending 榜首,是一个面向逆向工程、授权渗透测试与 CTF 的技能路由器,为 AI 编程 Agent 编排范围设定、剧本、工具链与报告,支持 Claude Code、Codex CLI、Cursor 等。
GitHubPrime Agent:把 Agent 放进 Python Shell 的开源项目(11.4K stars)
Prime Intellect 开源 Prime Agent,单日冲上 GitHub Trending 第一(2319 stars)。核心思路是让模型持有持久 Python 解释器会话,把文件、命令与上下文管理全部当作代码来写,基于递归语言模型理念。
GitHubOpenViking:字节跳动开源 AI 智能体统一上下文层(29K stars)
字节跳动火山引擎开源 OpenViking,将 Agent 记忆、知识 RAG 与技能整合为自进化上下文层,Apache 许可,单日新增 213 stars,社区已出现 OpenClaw 插件。
GitHubDeepSeek Harness 破 GitHub 史上最快涨星纪录(14 万+ stars)
DeepSeek 于 8 月 13 日开源 AI 智能体运行时 DeepSeek Harness,一小时内突破 2 万 stars,刷新 Grok-1 保持的最快纪录,四天超过 13 万 stars。采用"一切皆插件"设计,支持多种执行模式与 Anthropic、OpenAI、AWS、Azure、Gemini 等平台。
GitHubNginx 等主流 Web 组件 7 月发布多项安全更新
Nginx 与多家主流 Web 组件厂商于 7 月下旬发布安全更新,修复多个可导致信息泄露与拒绝服务的问题。线上服务应核对自身版本并安排升级窗口。
NginxCISA KEV 持续扩容:在野利用漏洞清单更新提醒
CISA 持续更新已知被利用漏洞目录 (KEV),8 月新增多款在野利用的 Windows、浏览器与开源组件漏洞。建议安全团队周期性同步 KEV 清单,对照自身资产优先处置。
CISA龙芯 LoongArch 处理器被曝侧信道攻击风险
安全研究人员公开针对龙芯 LoongArch 架构处理器的侧信道攻击研究,可结合漏洞利用获取敏感数据。国产芯片生态的安全审计与微码更新需同步推进。
SecurityWeekCoca-Cola Fairlife 遭 Anubis 勒索软件攻击,约 1TB 数据泄露
Coca-Cola 旗下 Fairlife 业务遭 Anubis 勒索软件攻击,攻击者窃取约 1TB 数据。事件再次凸显供应链与巨头企业的勒索风险,相关行业的备份与响应预案需要复盘。
BleepingComputerIntel 471:供应链攻击正转向 AI 编程助手与智能体生态
Intel 471 报告指出,攻击者正将投毒目标从传统 npm/PyPI 转向 AI 编程助手生态,包括恶意 skill、插件与"流行包代理"手法,针对 Cursor、Claude Desktop 等 Agent 环境。企业应对 Agent 引入的第三方组件执行来源审计。
Intel 4718月星期二补丁:微软修复 415 个漏洞,含 62 个严重级与 AFD 零日
微软 8 月补丁日共修复 415 个漏洞,其中 62 个为严重级;CVE-2026-68820(AFD for Winsock 提权)已确认遭在野利用,另有多个 CVSS 9.8 的 QUIC、DNS、iSCSI、WDS 远程代码执行漏洞。建议优先修复被利用漏洞与关键网络服务。
The Hacker NewsJadePuffer:首个由 AI 智能体驱动的勒索软件攻击链
Sysdig 披露 JadePuffer 攻击活动:攻击者利用 Claude 等 AI 智能体自动化侦查、横向移动与勒索部署,被认为是首个以 AI 智能体为核心编排的勒索软件攻击链。防御重点转向对 Agent 行为的检测与沙箱隔离。
Sysdig360:2026年7月勒索软件流行态势分析,五大新家族登场
360 发布 2026 年 7 月勒索软件流行态势分析:新增 ExfilSquad、CRPxO、GSG、Section9、Gammax 等勒索家族,BrzCrypt 与 Wmansvcs 判定为同一团伙所为。企业应重点强化备份、补丁与口令治理。
360"Sorry" 勒索软件大规模攻击暴露的 Linux Web 服务器(利用 cPanel CVE-2026-41940)
CVERC 发布预警:名为 "Sorry" 的勒索软件利用 cPanel 授权绕过漏洞 (CVE-2026-41940 / CNNVD-202604-5641) 攻击暴露在公网的 Linux Web 服务器,加密文件并索要赎金。Go 语言编写,运行于 Linux 环境。管理员应尽快修补 cPanel 并收敛公网暴露面。
CVERCWindows 用户配置文件服务 LegacyHive 提权漏洞 (PoC 已公开)
Windows 用户配置文件服务 (User Profile Service) 存在被命名为 LegacyHive 的本地提权漏洞,概念验证代码已公开。建议尽快应用补丁并监控异常账户行为。
NVDApache Struts JSON 资源耗尽拒绝服务漏洞 (CVE-2026-73633)
Apache Struts 在处理 JSON 请求时存在资源耗尽漏洞,攻击者可通过构造恶意 JSON 请求导致拒绝服务。Struts 用户应升级到官方修复版本。
NVDMicrosoft Edge 堆缓冲区溢出漏洞 (CVE-2026-72970)
Microsoft Edge 存在堆缓冲区溢出漏洞,CVSS 评分 8.4,攻击者可利用特制网页导致内存破坏并可能执行任意代码。请更新 Edge 至最新版本。
NVDPowerShell 命令注入漏洞 (CVE-2026-50523)
PowerShell 存在命令注入漏洞,攻击者可通过特制输入注入并执行任意命令。建议将 PowerShell 升级到最新版本并审查自动化脚本的输入来源。
NVDApache Tapestry classpath 下载漏洞 (CVE-2026-61899)
Apache Tapestry 存在可下载 classpath 相关文件的漏洞,攻击者可能借此获取敏感配置与字节码。Java Web 应用请升级 Apache Tapestry 到安全版本。
NVDAWS SDK for C++ Base64 越界读取漏洞 (CVE-2026-19642/CVE-2026-643)
AWS SDK for C++ 的 Base64 解码实现存在越界读取漏洞,可能导致内存信息泄露或拒绝服务。使用 AWS C++ SDK 的应用应升级到修复版本。
NVDKVM 虚拟机逃逸漏洞 Januscape
Linux KVM 虚拟化组件存在被命名为 Januscape 的虚拟机逃逸漏洞,攻击者可从虚拟机内逃逸影响宿主机。云厂商与虚拟化环境需尽快评估并打补丁。
NVDLinux 内核 GhostLock 本地提权漏洞
Linux 内核存在被命名为 GhostLock 的本地提权漏洞,攻击者可在受影响系统上获取更高权限。请及时升级内核并关注发行版安全公告。
NVDLinux 内核 RefluXFS 本地提权漏洞
Linux 内核 RefluXFS 文件系统存在本地提权漏洞,攻击者可通过特制文件系统操作在系统上提升权限。建议服务器尽快升级内核版本。
NVDvm2 沙箱逃逸远程代码执行漏洞 (GHSA-cfcw-xp6x-25gj)
Node.js 沙箱库 vm2 存在沙箱逃逸漏洞,CVSS 评分 9.8,攻击者可在沙箱内执行任意代码逃逸到宿主机。项目已停止维护,强烈建议迁移到其他沙箱方案。
GitHub AdvisoryWindows 内核权限提升漏洞 (CVE-2026-62788)
Windows 内核存在权限提升漏洞,CVSS 评分 9.8,本地攻击者可利用该漏洞获取系统最高权限。建议尽快应用 8 月安全更新。
NVDMicrosoft Teams 远程代码执行漏洞 (CVE-2026-65667)
Microsoft Teams 存在远程代码执行漏洞,CVSS 评分 10.0,属于企业协作场景的高危风险。建议尽快更新 Teams 客户端并留意官方通告。
NVDAzure Confidential Ledger 远程代码执行漏洞 (CVE-2026-68823)
Azure Confidential Ledger 存在远程代码执行漏洞,CVSS 评分 9.1。机密账本服务用于高安全场景,一旦被攻破影响严重,应关注微软官方更新。
NVDAzure Service Bus 远程代码执行漏洞 (CVE-2026-50515)
Azure Service Bus 存在远程代码执行漏洞,CVSS 评分 9.9。使用 Service Bus 的云架构应关注微软的租户隔离加固措施,并评估自身消息服务暴露面。
NVDSharePoint Server 远程代码执行漏洞 (CVE-2026-63520)
SharePoint Server 存在远程代码执行漏洞,CVSS 评分 8.1,由 Rapid7 发现并可与 CVE-2026-55040 链式利用。建议尽快更新至最新累积更新并关注官方缓解措施。
NVDExchange Server 权限提升漏洞 (CVE-2026-62911)
微软 Exchange Server 存在权限提升漏洞,CVSS 评分 8.0,由 Pwn2Own Berlin 大赛披露。攻击者可提升权限进一步横向移动,建议尽快应用补丁。
NVDWindows iSCSI 目标远程代码执行漏洞 (CVE-2026-65791)
Windows iSCSI 目标组件存在远程代码执行漏洞,CVSS 评分 9.8,攻击者可远程利用实现任意代码执行。存储场景下影响面广,建议优先升级。
NVDWindows DNS Server 远程代码执行漏洞 (CVE-2026-62878)
Windows DNS Server 存在远程代码执行漏洞,CVSS 评分 9.8。域控制器上的 DNS 服务一旦被利用可直接接管内网,属于 8 月补丁日优先级最高的修复项之一。
NVDWindows 部署服务 TFTP 远程代码执行漏洞 (CVE-2026-62893)
Windows 部署服务 (WDS) 的 TFTP 协议实现存在远程代码执行漏洞,CVSS 评分 9.8。WDS 用于批量部署操作系统,在域内网络中风险面较大,应尽快更新。
NVDMicrosoft QUIC 远程代码执行漏洞 (CVE-2026-62815)
微软 QUIC 协议栈存在远程代码执行漏洞,CVSS 评分 9.8,攻击者可远程利用该漏洞在目标系统上执行任意代码。建议尽快应用 8 月安全更新。
NVDWindows AFD.sys 提权漏洞已被在野利用 (CVE-2026-68820)
Windows 内核 Winsock AFD 驱动存在权限提升漏洞,微软确认已遭在野利用,攻击者获得低权限后可通过该漏洞提升至 SYSTEM。属于 8 月补丁日唯一被利用的零日,务必优先修复。
NVD/CISA KEVMindsDB Minds Platform 未授权远程代码执行漏洞 (CVE-2026-73678)
MindsDB 的 Minds Platform 存在未授权远程代码执行漏洞,攻击者可无需认证直接在服务器上执行任意命令,CVSS 评分高达 10.0。属于 AI 数据基础设施的严重风险,应尽快修复。
NVDFirefox/Thunderbird JavaScript GC 缓解绕过漏洞 (CVE-2026-74938)
Firefox 与 Thunderbird 的 JavaScript 垃圾回收缓解机制存在绕过漏洞,攻击者可通过特制网页触发内存破坏进而远程代码执行,CVSS 评分 9.8。建议尽快升级至最新版本。
NVDOracle Helidon 认证绕过漏洞 (CVE-2026-73939)
Oracle Helidon 存在认证绕过漏洞,攻击者可无需认证利用 HTTP 请求绕过身份验证访问受保护资源,CVSS 评分 8.6。建议受影响版本尽快升级并检查访问日志中的异常请求。
NVDCursor编辑器沙箱逃逸与任意文件写入漏洞 (CVE-2026-50548/50549)
AI代码编辑器Cursor在3.0之前版本存在两个严重沙箱逃逸漏洞,Agent终端命令可突破沙箱限制写入任意文件或通过路径规范化绕过检查。CVSS 9.8,影响广泛使用的AI编程工具。
NVDNode.js TLS主机名嵌入空字符绕过验证漏洞 (CVE-2026-48930)
Node.js在TLS主机名处理中存在嵌入式空字符(NUL)导致C字符串截断的漏洞,攻击者可利用此缺陷实现静默的权威重绑定,绕过TLS证书验证。影响所有受支持的Node.js版本。
NVDFeast特征平台gRPC反序列化RCE漏洞 (CVE-2026-56121)
开源特征存储平台Feast在0.63.0之前版本中存在不安全的反序列化漏洞,未经认证的攻击者通过发送恶意gRPC请求可实现远程代码执行。影响Red Hat OpenShift AI等AI基础设施。
NVDJoomla iCagenda附件上传任意代码执行漏洞 (CVE-2026-48939)
Joomla iCagenda扩展的文件附件功能存在任意文件上传漏洞,攻击者可上传PHP文件并执行任意代码,CVSS 9.8。已被CISA加入KEV目录,截止修复日期2026-07-13。
NVD/CISA KEVJoomla SP Page Builder未限制文件上传致RCE漏洞 (CVE-2026-48908)
Joomla的SP Page Builder扩展存在任意文件上传漏洞,未经认证的攻击者可上传并执行PHP代码,CVSS 9.8。已被CISA列入已知被利用漏洞目录(KEV),截止修复日期2026-07-10。
NVD/CISA KEVn8n MCP端点未认证远程代码执行漏洞 (CVE-2026-54309)
n8n工作流自动化平台的MCP浏览器模块在HTTP传输模式下,端点接受未经认证的会话初始化和工具调用,导致远程代码执行。影响2.25.7/2.26.2之前版本,CVSS满分10.0。
NVDTraefik StripPrefix中间件未经认证任意文件读取漏洞 (CVE-2026-48020)
Traefik反向代理的StripPrefix中间件存在严重漏洞,未经认证的攻击者可绕过路径限制读取任意文件,影响2.11.48/3.6.19/3.7.3之前所有版本。该漏洞CVSS满分10.0,已在Red Hat OpenShift等企业环境中广泛部署。
NVDNovita AI免费提供腾讯Hy3推理 — $0/MTok
腾讯Hy3在Novita AI上以$0/MTok免费提供。295B MoE/21B active,256K上下文,支持函数调用/结构化输出/推理控制。发布期间零成本。
alpha-feedRegolo.ai Builder Program — 欧洲60天无限tokens免费
欧洲AI推理平台Regolo.ai推出Builder Program: 60天无限tokens免费+100+开源模型+EU数据驻留+零数据保留。后续可申请€2000 voucher。OpenAI兼容。
alpha-feedAgnes AI周API调用达4.66万亿tokens + 推出Pavo创意工作室
Agnes AI报告免费API周调用量达4.66万亿tokens。6月29日推出Pavo创意工作室(web端免费AI创作平台)。新加坡AI Lab Top10,永久免费多模态API。
alpha-feedHappyHorse 1.0 — 阿里淘天开源AI视频生成模型#1排名
阿里淘天集团开源HappyHorse 1.0,15B参数AI视频模型,Artificial Analysis T2V/I2V双榜#1。原生1080p+音频同步,50+风格,~10秒生成。Apache 2.0。
alpha-feedFelo AI免费提供Gemini 4.0 Pro — 无需信用卡
Felo AI将免费集成Gemini 4.0 Pro,支持搜索和LLM Playground。200万token上下文,Deep Think博士级推理,原生多模态。无需信用卡。
alpha-feedV-API公益站上线 — Linux.do社区免费AI API网关
Linux.do社区公益项目V-API上线,聚合DeepSeek/GLM等模型,OpenAI兼容。首发100份×$10兑换码+每日签到奖励。非营利,无商业赞助。
alpha-feed腾讯Hy3正式版发布 — 295B MoE开源+多平台免费评测
腾讯Hy3(295B/21B active, Apache 2.0)正式发布。SWE-bench 74.4%,Agent任务解决率90%。定价¥1/¥4 per MTok。OpenRouter免费评测至7/21,Novita AI当前$0/MTok。
alpha-feedPoolside Laguna XS.2 — 免费API+开源33B MoE编程模型
Poolside发布Laguna XS.2,33B MoE(3B active)开源编程模型,Apache 2.0。SWE-bench Pro 44.5%。OpenRouter和Poolside API限时免费。131K上下文。
alpha-feedSMetric: Agent场景下LLM调度的重新思考
首次系统研究Agent工作负载的调度特性,发现KV复用率>80%(vs人类对话54-62%)。提出会话中心调度策略,TPS提升10-34%,调度器保持无状态。对LLM服务集群有直接工程价值。
arxivDominoTree: 路径条件草稿树实现6.6x推理解码加速
在Qwen3-4B上实现最高6.6x加速,平均接受长度10.7token/轮。CUDA原生构建器保证比特级一致,Alpaca上throughput +22%。直接可部署的推理加速方案。
arxivUltraX: 程序化编辑大规模精炼预训练数据
Scaling Law收益递减背景下,从「要更多数据」转向「要更好数据」。用程序化监督实现细粒度实例级编辑,更少token实现更好性能。对所有LLM预训练数据管线有方法论价值。
arxivProjAgent: 过程相似性检索革新仓库级代码生成
不只看代码像不像,还看实现逻辑像不像。将目标函数分解为推理步骤,检索过程行为相似的仓库函数,REPOCOD Pass@1达41.14%,超越现有基线。对AI编程助手产品有直接指导价值。
arxivRemember When It Matters: 主动记忆Agent解决长时程任务衰减
分离记忆Agent与动作Agent,通过选择性记忆注入解决「行为状态衰减」,Terminal-Bench +8.3pp。即插即用设计可接入任何Agent框架,是Agent记忆工程的最佳实践。
arxivWebSwarm: 递归多智能体编排实现深度+广度网页搜索
提出渐进式递归委派框架,每个搜索节点可自行解决或递归委派子节点,在 BrowseComp-Plus 等基准全面超越单智能体基线。核心价值:搜索 Agent 基础设施级创新,可直接集成到企业知识管理和研究助手产品中。
arxivCVE-2026-53488 | containerd CRI标签注入致宿主机命令执行 (CVSS 8.8)
containerd的CRI插件将镜像LABEL指令中的标签未经验证直接传播到容器,攻击者可通过恶意镜像在宿主机上执行任意命令。影响containerd 1.7.33/2.3.2/2.2.5/2.1.9/2.0.10之前版本,容器安全重大风险。
NVDCVE-2026-45659 | Microsoft SharePoint反序列化RCE (CVSS 8.8, CISA KEV)
Microsoft SharePoint Server存在反序列化不可信数据漏洞,授权攻击者可通过网络执行代码。CISA已确认该漏洞在野被利用,影响SharePoint 2016/2019/Subscription Edition,需紧急安装修补程序。
NVD/CISA KEVCVE-2026-22872 | Capsule Kubernetes多租户提权 (CVSS 9.1)
Kubernetes多租户框架Capsule的Controller以cluster-admin权限运行,租户管理员可通过集群级资源绕过命名空间隔离获取集群管理权限。影响0.13.0之前版本,对多租户K8s环境构成严重威胁。
NVDCVE-2026-5241 | HuggingFace Transformers模型加载RCE (CVSS 9.6)
HuggingFace Transformers的LightGlue模型加载路径存在远程代码执行漏洞,trust_remote_code参数被绕过,攻击者可通过恶意模型仓库在模型初始化时执行任意代码。影响transformers 5.2.0,波及Red Hat OpenShift AI。
NVDCVE-2026-49185 | Acer路由器MDM远程命令注入 (CVSS 9.8)
Acer Connect M6E 5G便携路由器的FieldX MDM功能将未验证的有效负载直接传入Runtime.exec(),导致远程命令注入攻击。攻击者可通过ADB消息通道在设备上执行任意命令,影响所有固件版本。
NVDCVE-2026-42074 | OpenClaude沙箱逃逸致RCE (CVSS 9.8)
OpenClaude编码代理CLI的沙箱禁用参数(dangerouslyDisableSandbox)暴露给LLM,恶意模型可设置该参数逃逸沙箱执行任意系统命令。影响0.5.1之前所有版本,AI编码工具安全风险突出。
NVDCVE-2026-48282 | Adobe ColdFusion路径遍历致RCE (CVSS 10.0, CISA KEV)
Adobe ColdFusion存在路径遍历漏洞,可导致任意代码执行,无需用户交互。CISA已将其加入已知被利用漏洞目录,确认在野利用。影响ColdFusion 2025.9及2023.20之前所有版本,需紧急修补。
NVD/CISA KEVCVE-2026-10611 | MISP认证绕过漏洞 (CVSS 10.0)
MISP在LDAP混合认证+OTP强制模式下存在认证绕过漏洞,攻击者可绕过双因素认证直接访问系统。该漏洞CVSS满分10.0,影响所有使用LDAP混合认证的MISP部署,建议立即升级或禁用mixedAuth配置。
NVDDeepLearning.AI - Generative AI for Everyone
吴恩达2024年推出的生成式AI课程,讲解ChatGPT原理和Prompt设计,面向所有人群。
CourseraMicrosoft Learn - Azure AI Fundamentals (AI-900)
微软官方AI基础学习路径,涵盖CV/NLP/ML核心知识,为AI-900认证备考。
Microsoft Learnfast.ai - Practical Deep Learning for Coders
完全免费的深度学习实战课程,Jeremy Howard主讲,从零开始训练模型,强调动手实践。
fast.aiGoogle AI Essentials (Coursera) - 免费旁听
Google官方AI基础课程,涵盖Prompt Engineering与AI应用,零基础入门首选。免费旁听,付费可获Google证书。
Coursera🔍 STRACE:从Agent混乱执行轨迹中精准定位根因,成功率提升1.4倍
## 🔍 发生了什么 长程Agent优化依赖反思机制,但真实执行轨迹冗余异质,直接优化效率低且易过拟合。STRACE框架在批次级别挖掘失败模式过滤冗余轨迹,在轨迹级别通过因果定位去除非因果步骤,精准识别根因模块。在形式验证任务VeruSAGE-Bench上成功率从42.5%提升至58.5%(1.4倍)。 ## 💡 技术原理 - 批次级:失败模式挖掘 → 过滤冗余轨迹 → 保留代表性失败案例 - 轨迹级:构建文本依赖图 → 因果定位 → 去除非因果步骤 - 根因模块识别:找到真正需要优化的Agent组件 - 高信噪比优化上下文 → 精准有效的策略改进 ## 🔧 快速上手 代码已开源。集成到现有Agent优化循环中,在调用LLM优化Agent策略前,用STRACE预处理执行轨迹。支持任意文本化执行trace。 ## 🎯 应用场景 - Agent调试与优化(自动定位失败原因) - 复杂工作流Agent的持续改进 - 形式验证Agent优化 - 生产环境Agent故障诊断 ## 🔗 相似技术 Reflexion、Self-Refine、AgentOptimizer、Trace-based debugging ## 💴 商业潜力 ⭐⭐⭐⭐ Agent调试是当前最大痛点之一。1.4倍成功率提升+自动化根因分析,对Agent平台公司有直接价值。 ## 📚 学习路径 Agent基础 → Reflexion论文 → 因果推断入门 → STRACE代码
🔬 AI自我改进全景:1250篇论文综述揭示递归自我改进的边界
## 🔍 发生了什么 综合调研1250篇arXiv论文(2024-2026),从两个维度(改进对象×闭环程度)建立统一分类框架。关键发现:已证明的自我改进强度严格遵循验证层级(形式验证器→内在自评估),失败模式(自确认循环、模型崩溃、多样性崩溃)源于对验证层级的违反。「研究方向设定」是当前保持人类在环的最大瓶颈。 ## 💡 技术原理 - 四类改进对象:部署行为、训练策略、评估器、研究过程本身 - 验证层级:形式验证器(最强) > 过程奖励模型 > 评判器 > 内在自评估(最弱) - 受限自我改进:收敛、可评估、已工业化 - 开放递归自我改进(RSI):受接地要求、崩溃动力学和计算约束限制 - 核心洞察:自我改进能力上限 = 评估信号质量 ## 🔧 快速上手 这是综述论文,无需代码。重点关注验证层级框架——在设计自我改进系统时,优先使用强验证信号(可执行测试 > LLM评判 > 自我评估)。 ## 🎯 应用场景 - 设计自我改进系统时选择正确的验证机制 - 评估AI系统自主研究能力的上限 - AI安全治理框架设计 - Meta-learning和AutoML系统设计 ## 🔗 相似技术 Self-Refine、Self-Reward、Self-Play、Constitutional AI、STaR ## 💴 商业潜力 ⭐⭐⭐⭐ 对所有构建自我改进AI系统的团队(OpenAI、Anthropic、DeepMind)具有直接指导意义。验证层级框架可直接应用于系统设计。 ## 📚 学习路径 RLHF基础 → Self-Refine综述 → Constitutional AI → 本文
🎯 Diffusion RLHF效率提升6倍:选择性时间步加权+优势回放
## 🔍 发生了什么 RLHF应用于扩散模型时反馈效率极低。本文发现奖励信息在扩散轨迹中分布不均,提出两个互补策略:(1)逐时间步加权方案,(2)基于优势的轨迹回放机制。在相同超参数下实现6倍样本效率提升。CVPR 2026 Workshop入选。 ## 💡 技术原理 - 关键洞察:并非所有去噪时间步/轨迹对学习奖励信号的贡献相等 - 逐时间步加权:在策略优化中强调信息量大的去噪步骤,理论连接PPO最优收敛 - 优势回放:优先回放高信息量轨迹,减少重复查询奖励模型 - 两个策略协同:加权聚焦 + 高效复用 ## 🔧 快速上手 在现有Diffusion RLHF框架(如Diffusion-DPO等)基础上集成两个模块:per-timestep weighting + advantage-based replay buffer。无需修改模型架构。 ## 🎯 应用场景 - 文生图模型人类偏好对齐 - 视频生成模型优化 - 3D资产生成对齐 - 减少人工评分/奖励模型查询成本 ## 🔗 相似技术 Diffusion-DPO、DPPO、DDPOH、RLHF for diffusion ## 💴 商业潜力 ⭐⭐⭐⭐ 6倍效率提升直接降低对齐训练成本。对图像/视频生成公司(Midjourney、Stability等)实用价值高。 ## 📚 学习路径 扩散模型基础 → RLHF原理 → Diffusion-DPO → 本文
🧠 CO-LMLM:360M参数模型在SimpleQA上媲美GPT-4o-mini和Claude Sonnet 4.5
## 🔍 发生了什么 有限记忆语言模型(LMLM)将事实知识外置到知识库而非权重中。CO-LMLM创新性地将连续键与文本知识值配对,摆脱了此前对关系型KB的依赖。仅360M参数的CO-LMLM在困惑度上超越了40倍数据量训练的常规LLM,在SimpleQA上达到GPT-4o-mini水平、超越Claude Sonnet 4.5。 ## 💡 技术原理 - 知识库使用连续向量键 + 可读文本值的配对 - 生成灵活向量查询,低成本检索 - 标注流水线:自动标注任意文本中的事实跨度(不限于维基百科) - 推理时按需从KB检索知识融入生成 ## 🔧 快速上手 预训练阶段需要构建带标注的知识库。推理时与常规LLM接口兼容,底层自动检索。适合对知识可控性要求高的场景。 ## 🎯 应用场景 - 知识可控的对话系统(医疗、法律、金融) - 轻量级但知识密集的端侧模型 - 知识热更新(改KB即更新知识,无需重训) - 减少幻觉 ## 🔗 相似技术 RETRO、kNN-LM、LMLM (最新方向)、RAG ## 💴 商业潜力 ⭐⭐⭐⭐⭐ 360M达到GPT-4o-mini级别事实精度 + 知识可控 + 热更新,对端侧AI和垂直领域落地极具价值。 ## 📚 学习路径 RAG基础 → RETRO/kNN-LM → LMLM论文 → CO-LMLM
📚 SkillCenter:21万+结构化技能库,自主AI Agent的知识底座
## 🔍 发生了什么 AI Agent常缺乏落地所需的操作知识,导致输出「可执行但不正确」。SkillCenter构建了已知最大的开放Agent技能库:216,938个结构化技能,横跨24个领域。核心创新是「来源溯源」保证——每条技能可追溯至原始文献精确引用。所有技能以SQLite FTS5格式离线可搜索。 ## 💡 技术原理 - 多源采集:同行评审期刊、ArXiv、24000+技术源 + GitHub/ClawHub社区 - SkillGate质量门:LLM驱动的多级质量过滤 - 模板驱动生成 + 迭代溯源校验 - 来源溯源(Traceability):每个保留声明映射到源文精确引文 - SQLite FTS5离线全文检索 ## 🔧 快速上手 直接使用:下载HuggingFace上的skillcenter-bundles数据集。集成:加载SQLite数据库,通过FTS5查询相关技能。GitHub: LabRAI/SkillCenter。 ## 🎯 应用场景 - Agent知识增强(代码生成、运维、数据分析等24个领域) - 企业知识管理系统 - RAG系统的结构化知识源 - Agent技能发现与组合 ## 🔗 相似技术 Voyager(Minecraft技能库)、ToolBench、AgentBench、Reflexion ## 💴 商业潜力 ⭐⭐⭐⭐ 直接提升Agent任务成功率和输出质量。对企业级Agent平台是即插即用的知识增强层。 ## 📚 学习路径 Agent基础 → RAG系统 → 技能发现机制 → SkillCenter代码
🏆 Agon:两个模型互为裁判的对弈式推理训练,GRPO性能翻倍
## 🔍 发生了什么 当前推理模型(如GRPO)只评判最终答案,导致模型在难题上「写得更多而非想得更好」。Agon让两个模型互为对手:交替解题并评判对方,隐式奖励推理过程质量,无需过程标签或奖励模型。在DeepMath难题集上pass@1翻倍,在竞赛编程和多模型家族(Qwen3.5、Gemma 4)上均复现。 ## 💡 技术原理 - 两个行为不同的模型交替扮演draft和reader角色 - 每次一方draft解题方案,另一方阅读后再解题 - 奖励信号:是否比对手解得更好 - 双方同步优化 → 对手持续变强 → 自我博弈式进步 - 推理时:stage1 draft → stage2 reader-based answer ## 🔧 快速上手 需要两个可比较强度但行为不同的模型(如Qwen3-7B和Qwen3-8B)。配置交替训练循环,定义可验证奖励函数。代码预期将开源。 ## 🎯 应用场景 - 数学推理模型训练 - 代码竞赛AI - 科研推理助手 - 任何需要深度推理的agent ## 🔗 相似技术 GRPO、AlphaGo自博弈、Debate (Irving et al.)、Self-Play Fine-Tuning (SPIN) ## 💴 商业潜力 ⭐⭐⭐⭐⭐ 推理能力翻倍+无需标注数据,对AI推理公司(OpenAI、DeepSeek等)核心竞争力有直接影响。成本仅为双模型训练。 ## 📚 学习路径 RLHF基础 → GRPO论文 → 自博弈理论 → Agon论文
🔑 Transformer线性化终极方案:分析驱动的线性化方法,已扩展至32B参数
## 🔍 发生了什么 因果自注意力的二次计算成本严重制约长上下文推理。本文在冻结骨干网络严格条件下,隔离了状态更新设计的影响,提出了sink token、短卷积和固定预算缓存路由等结构化干预,将线性化方法扩展至LLaMA和Qwen 32B模型,在MMLU上超越所有事后线性化基线。 ## 💡 技术原理 - 揭示softmax依赖key相关的rank-1正交投影,解释为何delta-style网络优于纯门控累加 - 引入sink token处理注意力分配异常 - 短卷积补偿线性化过程中的信息损失 - 固定预算缓存路由实现动态资源分配 ## 🔧 快速上手 无需训练,在已有LLaMA/Qwen模型上直接应用线性化pipeline。关键是正确设置sink token和缓存路由策略。 ## 🎯 应用场景 - 降低大模型推理成本(32B模型长文本推理) - 边缘设备部署大模型 - 实时长文档处理系统 ## 🔗 相似技术 Mamba(状态空间模型)、RWKV、GLA(Gated Linear Attention)、Lightning Attention ## 💴 商业潜力 ⭐⭐⭐⭐⭐ 直接降低推理成本数倍,对所有LLM服务商和部署方都有立竿见影的价值。无需重新训练即可应用。 ## 📚 学习路径 Transformer基础 → 线性注意力综述 → Mamba/GLA论文 → 本文
CVE-2026-40079: Cacti escape_command函数命令注入(CVSS 9.8)
开源监控框架Cacti 1.2.30及更早版本中lib/rrd.php的escape_command()函数实质为空操作,导致图形模板中的text_format值未经充分转义直接传入shell_exec,攻击者可注入任意命令。
NVDCVE-2025-67038: Lantronix EDS5000 OS命令注入(CVSS 9.8)
Lantronix EDS5000 2.1.0.0R3的HTTP RPC模块在认证失败时直接将用户名拼接到shell命令中,未经任何过滤处理,攻击者可注入任意操作系统命令实现远程控制。
CISA KEV / NVDCVE-2026-12569: PTC Windchill/FlexPLM 反序列化RCE(CVSS 9.8)
PTC Windchill PDMlink和FlexPLM存在关键远程代码执行漏洞,攻击者可通过反序列化不可信数据实现远程代码执行。该漏洞影响PLM/PDM工业管理系统,潜在影响面广泛。
CISA KEV / NVDCVE-2026-34910: Ubiquiti UniFi OS 命令注入漏洞(CVSS 10.0)
Ubiquiti UniFi OS存在输入验证不当漏洞,具有网络访问权限的恶意行为者可利用该漏洞执行命令注入攻击,实现远程代码执行。影响大量企业级网络设备。
CISA KEV / NVDCVE-2026-48558: SimpleHelp OIDC认证绕过漏洞(CVSS 10.0)
SimpleHelp 5.5.15及更早版本和6.0预发布版在OIDC认证流程中存在身份验证绕过漏洞,系统接受未验证密码学签名的身份令牌,攻击者可冒充任意用户登录远程管理平台。
CISA KEV / NVDCVE-2026-48282: Adobe ColdFusion 路径遍历致任意代码执行(CVSS 10.0)
Adobe ColdFusion 2025.9及2023.20及更早版本存在路径遍历漏洞,未经身份验证的远程攻击者可在当前用户上下文中执行任意代码。该漏洞无需用户交互即可被利用,已被CISA收录。
CISA KEV / NVDCVE-2026-48908: JoomShaper SP Page Builder 未授权文件上传导致RCE(CVSS 10.0)
JoomShaper SP Page Builder存在未授权任意文件上传漏洞,攻击者无需认证即可上传并执行PHP代码,实现远程代码执行。该漏洞已被CISA列入已知被利用漏洞目录,影响所有未升级版本。
CISA KEV / NVDDeepLearning.AI - Fast & Efficient LLM Inference with vLLM
学习使用vLLM进行高效LLM推理部署,涵盖PagedAttention、批处理优化等生产级技术。免费短课程,适合有LLM基础的工程师。
DeepLearning.AICoursera - Machine Learning Specialization (Andrew Ng)
Andrew Ng经典机器学习专项课程2024新版,涵盖监督学习、无监督学习和推荐系统。斯坦福出品,免费旁听,ML入门首选。
Coursera/DeepLearning.AIHuggingFace LLM Course - 大语言模型实战教程
HuggingFace官方LLM课程,从Transformer基础到微调部署全流程实战。使用最新HF生态工具链,完全免费开源。
HuggingFaceCoursera - Introduction to Artificial Intelligence (AI) by IBM
IBM出品的AI入门课程,涵盖AI基础概念、机器学习、深度学习和自然语言处理。免费旁听,适合零基础学习者建立AI知识框架。
Coursera/IBMFast.ai - Practical Deep Learning for Coders (2024版)
业界口碑最好的免费深度学习入门课程,从零开始用PyTorch构建完整DL项目。Jeremy Howard主讲,面向有编程基础的学习者,完全免费无门槛。
fast.aiDeepLearning.AI - AI Agents for Image and Video Generation
Andrew Ng团队最新课程,讲解如何用AI Agent生成图像和视频,涵盖多模态生成管线。Coursera平台免费旁听,付费可获证书。
DeepLearning.AIHuggingFace Agents Course - 免费AI智能体实战课程
HuggingFace官方免费AI Agent课程,涵盖LLM工具调用、多智能体协作等前沿内容。课程含实战项目,完成后可获社区认证徽章。
HuggingFacecodeburn — AI 编程 Token 用量追踪器
免费本地工具,追踪 31 种 AI 编程工具的 Token 用量和费用,按模型、项目、任务维度统计。无需注册,数据本地存储。
GitHub Trendingherdr — 终端 AI Agent 多路复用器
在终端中同时管理多个 AI 编程 Agent 的多路复用器,支持并行调度、任务分发。适合需要同时操作多个 Agent 协作开发的场景。
GitHub TrendingOpenCLI — 把任意网站变成命令行工具
将任意网页转化为 CLI 命令,并可利用浏览器已登录状态进行 AI Agent 操作。解决需要登录态的 API 场景,无需手动管理 Cookie。
GitHub Trendingcodebase-memory-mcp — 高性能代码智能 MCP 服务
将代码库索引为持久化知识图谱的 MCP 服务器,支持 158 种语言,毫秒级查询,Token 消耗减少 99%。单静态二进制,零依赖,适合大规模代码库。
GitHub TrendingAgent-Reach — AI Agent 全网信息采集 CLI
赋予 AI Agent 访问 Twitter、Reddit、YouTube、GitHub、Bilibili、小红书等平台的能力,一行命令、零 API 费用。让 Agent 具备实时联网搜索和内容抓取能力。
GitHub TrendingGraphify — 代码库知识图谱生成器
将任意代码仓库、SQL Schema、脚本一键转化为可查询的知识图谱,支持 Claude Code / Codex / Cursor 等主流 AI 编程工具。让 AI Agent 真正理解你的项目结构。
GitHub Trendingrtk — LLM Token 消耗优化 CLI 代理
用 Rust 编写的 CLI 代理,可将常用开发命令的 LLM Token 消耗降低 60-90%。单二进制文件零依赖,开箱即用,适合重度使用 AI 编程助手的开发者节省成本。
GitHub Trending苹果20亿美元收购AI公司Q.ai,加码AI战略布局
苹果公司以20亿美元收购AI公司Q.ai,这是苹果在AI领域最大规模的收购之一。此举显示苹果正加速追赶Google和微软在AI领域的领先地位。
投资界金融科技公司Ramp融资7.5亿美元,估值440亿美元
企业支出管理平台Ramp完成7.5亿美元融资,估值飙升至440亿美元。Ramp凭借AI驱动的财务管理功能获得投资者青睐,体现AI赋能金融科技的巨大市场潜力。
TechCrunchShield AI收购Aechelon并融资20亿美元,估值127亿美元
防务AI公司Shield AI宣布收购仿真软件公司Aechelon,同时完成20亿美元融资,估值达127亿美元。此次收购将增强其自主飞行系统的模拟能力,防务AI整合趋势加速。
Shield AITogether AI融资8亿美元,估值83亿美元
开源AI基础设施公司Together AI完成8亿美元融资,估值达83亿美元。作为AI推理和训练平台,Together AI持续获得资本追捧,反映市场对AI基础设施的强劲需求。
ReutersAI芯片公司SambaNova融资10亿美元,估值达110亿美元
NVIDIA挑战者SambaNova完成10亿美元融资,估值达110亿美元,距上一轮仅5个月。投资者持续看好AI芯片替代方案,芯片赛道竞争加剧。
TechCrunch / CNBC防务科技巨头Anduril融资50亿美元,估值翻倍至610亿美元
美国防务科技公司Anduril完成50亿美元融资,估值从300亿美元翻倍至610亿美元,同时拓展太空业务支持特朗普'金穹'防御计划。防务科技赛道持续火热。
SiliconANGLE马斯克将SpaceX与xAI合并,打造太空+AI超级集团
Elon Musk正式将SpaceX与其AI初创公司xAI进行合并,xAI此前已完成200亿美元融资。此举将太空探索能力与AI技术深度整合,创建前所未有的太空AI超级集团。
The New York TimesAnthropic融资650亿美元逼近万亿美元估值,秘密提交IPO申请
AI巨头Anthropic完成650亿美元融资,估值达9650亿美元,已秘密向SEC提交IPO申请文件。这是AI行业有史以来最大单轮融资,标志着Anthropic正式超越OpenAI成为最有价值的AI初创公司。
TechCrunch / FortuneWhen Does In-Context Search Help? 反思驱动推理的采样复杂度理论
🔍 发生了什么:Amnon Shashua(Mobileye创始人)团队给出in-context search的理论分析——当反思能可靠定位早期错误时,上下文内搜索可实现指数级改进;反之则与并行采样无异。证明了这些增益是可学习的。 💡 技术原理:将in-context search建模为推理轨迹上的近似推理,基础模型定义先验,自我反思提供后验更新的反馈。关键定理:当反思能定位早期错误时,多项式次尝试即可解决零-shot通过率指数小的问题。跨熵训练搜索轨迹可恢复所需行为。 🔧 快速上手:理论指导实践——设计反思机制时,确保它能准确指出"哪一步出了错",而不仅仅是"答案不对"。这比简单的self-consistency投票更有效。 🎯 应用场景:推理模型训练策略设计、test-time compute优化、反思机制工程、reasoning model评估。 🔗 相似技术:Tree-of-Thought、Self-Refine、STaR、Reflection agents。 💴 商业潜力:★★★★☆ 理论成果对推理模型(o1/o3/DeepSeek-R1类)的训练和部署策略有直接指导意义。 📚 学习路径:理解贝叶斯推理基础 → 学习in-context learning理论 → 研究reasoning model训练 → 实践反思机制设计。
ARC-AGI-1上高效Agent: 无需微调用架构设计提升52分
🔍 发生了什么:在ARC-AGI-1基准上,不进行任何ARC特定微调,仅通过Agent编排架构设计,用DeepSeek V3.2(非思考模式)将一次基准从15.50%提升到67.25% pass@2,每任务仅$0.62。揭示了Agent是"生成受限"而非"选择受限"的关键洞察。 💡 技术原理:Explorer-Definer Pipeline将模式发现与可执行变换合成分离为两阶段;Reflective Orchestrator在假设失败时自主探索新变换。关键发现:选择机制可捕获~95%的候选上限,真正的瓶颈是生成多样性。反思型编排器通过自适应重新探索确认了这一预测。 🔧 快速上手:将复杂推理任务分解为"模式发现"和"程序合成"两个阶段,失败时增加生成多样性而非改进排序,think工具是重要组件。 🎯 应用场景:抽象推理、模式识别、数据变换任务、Agent架构设计最佳实践。 🔗 相似技术:ARC-AGI挑战赛其他方案、FunSearch、AlphaProof。 💴 商业潜力:★★★★☆ 虽然ARC是基准测试,但其架构设计原则(分离探索/定义、反思重试)对所有Agent系统都有参考价值。 📚 学习路径:了解ARC-AGI挑战 → 学习程序合成 → 研究Agent编排模式 → 实践反思型架构。
Large Behavior Model: 用LLM构建零售客户数字孪生
🔍 发生了什么:提出大型行为模型(LBM),直接从大规模零售交易数据中学习客户决策模式,构建可提示的客户数字孪生。通过持续预训练+监督微调+可验证奖励强化学习三阶段训练,在购买预测、篮子完成、促销响应等任务上超越通用大模型。 💡 技术原理:用Person-Environment统一公式建模客户行为——客户状态由历史购买行为画像表示,产品上下文通过RAG引入。三阶段训练:行为数据持续预训练→决策生成SFT→基于行为证据的RL校准。 🔧 快速上手:核心是将交易历史转化为自然语言行为描述,用LLM学习其中的决策模式。关键发现是持续预训练是行为泛化的主要驱动力,RAG在训练和推理时都应使用。 🎯 应用场景:个性化推荐、精准营销、促销策略优化、客户流失预测、零售仿真模拟。 🔗 相似技术:用户行为序列建模、DIFM、基于Transformer的推荐系统。 💴 商业潜力:★★★★★ 零售AI是万亿级市场,数字孪生概念在营销领域极具吸引力,且模型展示了跨零售商零样本迁移能力。 📚 学习路径:了解推荐系统基础 → 学习用户行为建模 → 研究RLHF/RLEF → 实践LBM。
MILES: 模块化指令记忆实现LLM推理自我提升
🔍 发生了什么:提出MILES框架,让LLM在推理过程中动态积累可复用的经验记忆,而非像现有方法那样每次从零开始。通过粗-细两级检索机制和可学习的选择头,在测试时持续优化推理能力。 💡 技术原理:维护模块化记忆单元——由子目标嵌入和子指令的非对称对组成,每个关联一个可学习的选择头。粗粒度检索用于记忆扩展和监督采集,细粒度检索用学习到的选择头重排候选并引导推理。 🔧 忥速上手:核心思想是将成功的推理步骤抽象为可检索的记忆片段,新问题到达时先检索相关经验再推理,逐步积累形成Agent的"经验库"。 🎯 应用场景:数学推理、代码生成、复杂问答等需要逐步推理的任务,特别适合问题持续到来的流式场景。 🔗 相似技术:Reflexion、Voyager技能库、MemGPT、ExpeL。 💴 商业潜力:★★★★☆ 测试时自我提升是降低推理成本的关键方向,记忆复用可显著减少重复计算。 📚 学习路径:理解CoT推理 → 学习检索增强生成(RAG) → 研究记忆机制设计 → 实践MILES框架。
AgentLens: 评估AI编程Agent的完整轨迹而非只看结果
🔍 发生了什么:提出AgentLens基准测试,不再用单一通过/失败评判代码Agent,而是评估整个交互轨迹——包括指令遵循、工具使用、自我验证、错误恢复和用户沟通质量。结合形式化验证与LLM轨迹评审,生成可读的评分解释。 💡 技术原理:将形式化验证(客观检查存在时)与LLM编写的轨迹评审和并排对比相结合。每个运行产生一个可读的评分解释文档,支持模型行为诊断、版本回归检测和夜间评估流水线。 🔧 快速上手:开源项目 github.com/agent-lens/agent-lens-bench,可直接集成到CI/CD流水线中,用于持续监控编程Agent质量。 🎯 应用场景:AI编程助手(Copilot/Cursor/Cline)的质量评估、Agent版本迭代监控、产品回归检测。 🔗 相似技术:SWE-bench、HumanEval、BigCodeBench(但这些只看结果不看过程)。 💴 商业潜力:★★★★☆ Agent评估是刚需市场,尤其在AI编程助手竞争白热化的当下。 📚 学习路径:了解SWE-bench → 研究轨迹评估方法论 → 部署AgentLens → 构建自定义评估pipeline。
The Harness Effect: 编排层设计决定企业AI Agent的Token经济学
🔍 发生了什么:Writer团队发布大规模实证研究,证明在企业Agent系统中,编排层(harness)比模型选择本身更能影响成本。同一个编排框架让6个不同模型的单任务成本降低33-61%,Token消耗降低38%,延迟降低44%,且质量持平。 💡 技术原理:编排层通过6大机制降本——缓存形状优化、上下文窗口管理、工具调用编排、任务分解、失败治理、token预算控制。核心发现是"质量每美元"提升82%,且效率增益与模型无关。 🔧 快速上手:检查你的Agent编排层是否存在token浪费——上下文重复、冗余工具调用、无token预算上限。优化这些比换模型更有效。 🎯 应用场景:企业级Agent平台、SaaS AI产品、客服/营销/数据分析Agent。对所有按token计费的AI产品都有直接参考价值。 🔗 相似技术:LangChain/LlamaIndex编排层、Semantic Kernel、CrewAI。 💴 商业潜力:★★★★★ 论文直接量化了编排层的ROI,对所有AI产品团队都有决策参考价值。 📚 学习路径:理解Agent编排架构 → 学习token经济学 → 研究prompt caching → 实践编排层优化。
EvoSOP: 让AI Agent自动将原子操作进化为标准操作流程
🔍 发生了什么:提出EvoSOP框架,让LLM Agent从执行轨迹中自动提取标准操作流程(SOP),通过构建→合并→评估→裁剪的生命周期实现工具集的自我进化,任务成功率显著提升且交互轮次大幅减少。 💡 技术原理:将原子操作(如文件IO、单轮搜索)合成为封装多步逻辑的高阶SOP工具。通过执行轨迹提取SOP,迭代优化工具集——包括构建新SOP、合并相似SOP、评估SOP效果、裁剪低效SOP。 🔧 快速上手:论文开源,核心思路是记录Agent执行轨迹,用LLM从中提取可复用的多步流程模板,然后在新任务中直接调用这些SOP代替逐步推理。 🎯 应用场景:企业级AI Agent开发、自动化工作流编排、DevOps自动化、RPA增强。任何需要Agent反复执行类似任务的场景都能受益。 🔗 相似技术:Voyager(Minecraft技能库)、Toolformer、AutoGPT工具链。 💴 商业潜力:★★★★★ 直接降低企业Agent的推理成本和失败率,是最具落地价值的Agent自进化方向之一。 📚 学习路径:了解ReAct/Toolformer → 研究Agent执行轨迹记录 → 学习SOP抽象与复用 → 实践EvoSOP。
AwanLLM: 免费Lite层,无限Token,自有数据中心
LLM推理API平台,免费Lite层:无限Token,200次/天(小模型),10次/天(中大模型),20 RPM。自有数据中心,不记录日志。订阅制而非按Token计费。
alpha-feedVoyage AI: 2亿免费Token嵌入API,voyage-4系列
顶级嵌入模型提供商。voyage-4系列每个账户免费2亿Token(含voyage-4-large/4/4-lite/context-3/code-3)。多模态模型额外送2亿文本Token+1500亿像素。
alpha-feedJina AI: 100万免费Token,多模态嵌入/Reader API
顶级多模态多语言长上下文嵌入API。新用户送100万Token(CC-BY-NC非商用),原型开发可获10亿Token。Reader API可将网页转为LLM友好格式。OpenAI兼容。
alpha-feedDeepInfra: $5免费推理额度,40+开源模型,1M tokens/天
AI推理云平台,注册送$5额度(促销可达$20)。支持40+开源模型(Llama 3.3/Mistral/DeepSeek等),免费模型每天1M tokens。OpenAI兼容API。已完成$1.07亿B轮融资。
alpha-feedFreeTokenRouter.cn: 100万免费Token,国内大模型聚合平台
国内AI Token聚合平台,注册送100万Token,每日签到可续,邀请好友翻倍。支持DeepSeek/通义千问/智谱AI/月之暗面/腾讯混元/百度文心/MiniMax等国内主流大模型。OpenAI兼容API,企业赞助Token模式。
alpha-feed📢 火山引擎(豆包): 每日200万token永久免费,支持DeepSeek/Kimi
火山引擎豆包API每日200万token永久免费(支持豆包系列/DeepSeek-V3.2/Kimi-K2等主流模型)。每个新开通模型赠送50万token新人包。新增Doubao-Seed-2.0 Lite免费变体。
alpha-feed📢 Google Gemini: 新增3.5 Flash/4.0/3.1 Flash TTS,Pro移除免费层
Google Gemini新增Gemini 3.5 Flash(289tps/1M上下文)、Gemini 4.0(原生多模态)、3.1 Flash-Lite预览版(15RPM/500RPD)、3.1 Flash TTS(免费文本转语音)。⚠️ Gemini 2.5 Pro及3.1 Pro自2026-04-01移除免费层。
alpha-feed📢 阿里云百炼: 有效期延至180天,上架第三方模型
阿里云百炼免费额度有效期从90天延长至180天。已上架智谱GLM-5.1/MiniMax M2.7/Kimi K2.6等第三方模型。新增Qwen3.5-Omni/Qwen3-Coder-Plus。Coding Plan Lite首月7.9元无限调用Qwen3-Coder。
alpha-feed⚠️ 腾讯混元: HY 2.0等46个旧模型今日下线,平台9月30日停服
腾讯混元HY 2.0等46个旧模型已于2026-06-22下线。原平台将于2026-09-30全面停服,迁移至TokenHub。HY2.0输入价格涨463%。Hunyuan-Lite永久免费不限量。微信小程序成长计划赠1亿混元token(2026年底前)。
alpha-feed🆕 Kilo Code: 开源AI编码Agent可免费使用
Kilo Code是开源AI编码Agent(VS Code/JetBrains/CLI),300万+开发者。可通过自带API Key免费使用5个模型。Apache 2.0开源。
alpha-feed🆕 LLM7.io: 统一AI API网关6个免费模型
LLM7.io统一AI API网关,6个免费模型(全部在线),无需信用卡,一个endpoint接入多个模型。
alpha-feed🆕 Aion Labs: 以色列AI永久免费API(角色扮演/叙事)
以色列AI公司Aion Labs提供永久免费推理API,15 RPM/20K tokens/天,5个免费模型,无需信用卡。专注于角色扮演和叙事场景。OpenAI兼容。
alpha-feed🆕 OVHcloud AI Endpoints: 欧洲云40+开源模型免费Beta推理
欧洲云厂商OVHcloud推出AI Endpoints服务端推理API,Beta期间免费。40+开源模型(Llama/Qwen/DeepSeek等),欧洲数据驻留,OpenAI兼容接口,无需信用卡。12个免费模型。
alpha-feedCompletions.me更新:支持GPT-5.4/Claude Sonnet 4/Opus 4.x
免费无限AI API Completions.me更新模型列表,现支持GPT-5.4、Claude Sonnet 4、Claude Opus 4.x、Gemini 3.1 Pro等15+模型。无需验证。
alpha-feedNVIDIA NIM免费模型增至139个
NVIDIA NIM免费模型从100+增至139个,含DeepSeek-V4 Pro/Kimi-K2.5/GLM-5.1/Llama-4/MiniMax-M3等。纯速率限制(40 RPM),OpenAI兼容。
alpha-feed🆕 Exa Web Search API:每月20,000次免费请求
AI web search API提供商Exa免费层提供20,000请求/月。2026-06-16推出Exa Agent产品。支持语义搜索、内容提取。exa.ai
alpha-feed⚠️ LongCat(美团龙猫)下线6个旧模型,免费额度大幅缩减
2026-05-29 LongCat下线Flash-Chat/Flash-Thinking/Flash-Lite/Flash-Omni等6个旧模型。Flash-Lite原提供每日5000万Token免费,已不可用。仅保留LongCat-2.0-Preview(限量beta)。原每日5500万Token免费政策已失效。
alpha-feedTogether AI免费额度存疑: 官方称无免费试用,第三方报道$25
Together AI额度信息冲突:pricepertoken.com报道$25新用户额度,yangmao.ai报道$5,官方文档称不提供免费试用(需最低$5充值)。此前记录的$100可能已过期。83个免费模型仍可用。创业加速器$15K-$50K额度。
alpha-feedAgnes AI升级: 1M上下文+4K图片,首周消耗3.12万亿Token
已跟踪的Agnes AI(全球Top10 AI Lab)免费API升级:文本模型支持1M上下文,图片模型支持4K输出。6月1日免费开放后首周统计:1T tokens+200万张图+200万秒视频。全模态免费不限量。
alpha-feedNoumena: 限时1周免费Kimi K2.7推理(PrimeIntellect GB300)
Entropix创始人_xjdr推出Noumena,提供1周免费Kimi K2.7推理。PrimeIntellect在GB300 NVL72硬件上托管,通过ncode TUI工具使用。限时活动。
alpha-feedMixRoute: 统一AI API网关,$5免费credits注册即送
新发现的统一AI API网关平台MixRoute,200+模型(含Claude/ChatGPT/Gemini等),OpenAI兼容接口,零markup费。新用户注册即送$5免费credits,首充100%返利。30秒设置,无需信用卡。
alpha-feedDeepSeek V4-Pro 75%降价永久生效:$0.87/MTok输出,比GPT-5.5便宜34倍
DeepSeek于2026-05-22宣布V4-Pro的75%促销折扣变为永久价格。新价:输入$0.435/MTok,输出$0.87/MTok,缓存命中$0.003625/MTok。比GPT-5.5便宜34倍,比Claude Opus 4.7便宜17倍,SWE-bench仅差3-7个百分点。V4-Flash仍完全免费。
alpha-feed百川智能: 注册送500万tokens,Baichuan 4旗舰模型128k上下文
百川智能(Baichuan)注册送500万tokens,Baichuan 4旗舰模型支持128k上下文。M3-Plus医疗增强模型可通过海纳百川计划免费调用。国产平台大陆直连,5 RPM限制。
alpha-feedNovita AI: 注册送$0.50-$1免费credits,初创企业$10,000额度
Novita AI提供10000+模型(image/video/LLM)的OpenAI兼容API。新用户注册送$0.50-$1 credits,referral计划$20(3个月)。初创企业计划最高$10,000免费额度。SDXL/Flux图像生成为主。novita.ai
alpha-feedTogether AI新用户额度上调至$100(从$25-$50)
Together AI再次上调新用户注册credits至$100(此前$25-$50),200+开源模型可用。创业加速器计划最高$50,000额度
alpha-feed共绩算力MaaS上线:最高1亿免费tokens,支持GLM/DeepSeek/MiniMax
共绩算力2026-06-16推出大模型云服务(MaaS),首批企业用户可申请最高1亿免费tokens。支持GLM/DeepSeek/MiniMax/Moonshot/Qwen等主流国产模型,OpenAI兼容API,maas.suanli.cn
alpha-feed小米MiMo V2.5开源 + Orbit 100万亿token计划
MiMo-V2.5系列已开源(MIT),发布Orbit 100万亿token计划。MiMo-V2-Flash/TTS将于6月18日自动路由至V2.5(新定价),6月30日废弃旧版本。UltraSpeed版本突破1000 TPS。
alpha-feedAI.cc: 新加坡统一AI API平台,400+模型降本80%
新加坡AI.cc统一API平台,接入400+模型(GPT/Claude/Gemini/Grok/DeepSeek/Qwen等),单一OpenAI兼容端点,企业级降本80%。2026年4月上线。
alpha-feed贵州算家算桥API平台开放: 日均3亿token,DeepSeek/QWEN/智谱全系列
贵州算家计算自主研发算桥API词元平台正式开放,已上线DeepSeek/QWEN/智谱/Kimi/MiniMax等主流模型,日均调用量3亿token且持续增长。2026年6月12日对外发布。
alpha-feedSecond Zero AI中转站: 200份×30元免费额度注册即领
新上线AI API中转站,200份×30元免费额度先到先得,OpenAI兼容接口,注册即领无需邀请码。2026年5月26日上线。注意:新站稳定性待验证,建议先用完免费额度再评估。
alpha-feedFree.ai: 每日30,000免费tokens,400+工具统一API
Free.ai提供统一OpenAI兼容端点,346+模型(含Qwen2.5/GPT/Claude等),每日30,000免费tokens,无需信用卡。同时提供初创企业免费credits申请(3年内、融资<500万美元)。
alpha-feedTogether AI Startup Accelerator — 最高$50,000免费推理额度
Together AI推出创业加速器计划,为符合条件的AI原生初创企业提供最高$50,000推理额度,含专属端点和工程支持。新用户注册送$25-$50(从$10/$25多次上调)。覆盖200+开源模型,OpenAI兼容接口。
alpha-feedResemble AI Chatterbox Multilingual v3 — MIT TTS免费通过NVIDIA NIM
Resemble AI发布Chatterbox Multilingual v3,MIT开源0.5B参数TTS模型,支持25种语言(含中文),内置PerTh水印技术。已在NVIDIA NIM平台提供免费推理(NIM 2026年起取消Credits改为纯速率限制)。训练数据从25.6k扩展到36.7k小时,支持零样本语音克隆。EU AI Act Article 50合规。
alpha-feedBraiv Speech:Beta期间完全免费TTS,80+语言无上限
Braiv Speech推出AI TTS API,Beta期间完全免费,无月度字符上限,无水印,支持80+语言。需关注Beta结束后的定价策略。
alpha-feedBosonAI Higgs Audio v3 TTS:免费公开预览,100+语言语音合成
BosonAI发布Higgs Audio v3 TTS,4B参数,支持100+语言,零样本语音克隆,内联控制情感/风格/韵律/停顿。API免费公开预览中(有速率限制)。在Seed-TTS/CV3/MiniMax-Multilingual等基准测试中超越所有竞品。
alpha-feedNVIDIA NIM取消Credits限制:100+模型纯速率限制免费调用
NVIDIA NIM自2026年起取消Credits限制,改为纯速率限制模式。100+免费模型包括DeepSeek-V4 Pro、Kimi-K2.5、GLM-5.1、Llama-4、Nemotron-3等顶级模型,无需绑定信用卡,OpenAI兼容接口,5分钟接入。
alpha-feed火山引擎豆包2.0发布:免费每日最高500万Tokens/模型
火山引擎发布豆包大模型2.0(Doubao-Seed-2.0),包含Pro/Lite/Mini/Code四款模型。免费每日领取单模型最高500万Tokens,安心体验模式每个模型50万tokens免费。Mini版仅¥0.3/百万token,几乎是市场最低价。通过火山方舟平台提供API服务。
alpha-feedOpenRouter免费模型增至60+个
OpenRouter免费模型从27个增至60+个(含Kimi K2.6)。免费层200次/天,充值10 credits后1000次/天。
alpha-feed白山智算: 新用户450元体验金(GLM-5)
白山智算AI推理平台,邀请码+实名认证送150元,首次调用再送350元(共450元)。以GLM-5为主,限速10请求/分钟。
alpha-feed联通云 Coding Plan: 免费GLM-5/Qwen3.5/MiniMax
联通云推出0元Coding Plan,支持GLM-5、Qwen3.5、MiniMax模型。Lite版1.8万次/月,Pro版9万次/月。12000个免费名额先到先得,每日1200次上限。
alpha-feed腾讯混元 Hunyuan-Lite 升级为永久免费不限量
腾讯混元Hunyuan-Lite模型永久免费不限量调用。原平台2026年9月30日停服迁移至TokenHub。微信小程序成长计划赠1亿混元token(2026年底前)。
alpha-feed⚠️ DeepSeek deepseek-chat/reasoner 将于2026-07-24停用
DeepSeek将于2026年7月24日停用deepseek-chat和deepseek-reasoner模型。V3-Lite永久免费不限量替代。开发者需尽快迁移。
alpha-feedanthropics/defending-code-reference-harness — Security threat modeling skills
Anthropic开源的安全威胁建模、扫描、分类、修补技能集,5.7K stars。
MemPalace/mempalace — Best open-source AI memory system
基准测试最强的开源AI记忆系统,55K stars,基于ChromaDB,Python实现。
paperclipai/paperclip — Open-source agent management app
企业级开源AI Agent管理平台,70K stars,TypeScript实现,MIT协议。
JuliusBrussee/caveman — Claude Code skill that cuts 65% of tokens
Claude Code技能插件,用'穴居人'风格提示词减少65%的token消耗,71K stars,MIT协议。
小米MiMo-V2.5-Pro-UltraSpeed发布:1T参数模型突破1000 TPS
小米与TileRT合作发布MiMo-V2.5-Pro-UltraSpeed,首次在1万亿参数模型上实现1000 tokens/s解码速度。API通过百炼平台开放,需申请。百炼平台100万tokens免费(90天)。
alpha-feedNVIDIA NIM 2026年取消Credits限制改为纯速率限制模式
NVIDIA NIM自2026年起取消此前的1000 Credits注册赠送模式,改为纯速率限制。支持100+免费模型包括DeepSeek-V4 Pro、Kimi-K2.5、GLM-5.1、Llama-4、Nemotron-3等,OpenAI 100%兼容格式,无需绑信用卡。
alpha-feed讯飞星辰MaaS开放Qwen3.6/Qwen3.5免费不限量调用
讯飞星辰MaaS平台开放Qwen3.6-35B-A3B和Qwen3.5-35B-A3B两款模型免费不限量调用,token无上限。Qwen3.6为阿里千问2026年4月开源的MoE模型,350亿参数。限时免费至6月底。讯飞星辰三方开发者日均Tokens调用量同比涨4241%。
alpha-feedGitHub将在npm 12中默认禁用安装脚本以防供应链攻击
GitHub宣布npm 12将默认关闭install脚本,阻断通过npm生命周期钩子执行恶意代码的供应链攻击手法。这是应对近期供应链攻击激增的重大架构性变革。
Langflow AI平台漏洞CVE-2026-5027遭野外利用实现未授权RCE
开源低代码AI应用构建平台Langflow的高危路径遍历漏洞(CVSS 8.8)已遭野外利用。攻击者可通过/api/v2/端点写入任意文件实现远程代码执行。
Ivanti Sentry最大严重漏洞披露24小时内遭野外利用
Ivanti Sentry最大严重级别漏洞在披露后仅24小时即遭攻击者利用。攻击模式表明攻击者提前测绘了目标资产,漏洞公开后立即行动。CISA已将相关CVE加入已知被利用漏洞目录。
GreatXML漏洞绕过Windows BitLocker加密保护
安全研究员Nightmare-Eclipse发现Windows BitLocker绕过方法GreatXML,利用恢复分区XML文件。此前该研究员还发布了Microsoft Defender漏洞利用。微软尚未修复。
The Gentlemen勒索软件已致478个受害者,蠕虫式传播能力曝光
Check Point报告The Gentlemen勒索组织以90/10分成招募附属成员,已成为受害者数量第二多的勒索团伙。Krebs追踪到其管理员Alexander Andreevich Yapaev位于俄罗斯伊热夫斯克。该组织利用Fortinet SSL-VPN凭据作为初始入口,AI辅助开发勒索工具。
微软6月补丁星期二创纪录修复206个漏洞,含3个零日
微软发布史上最大规模补丁更新,修复206个安全漏洞,其中39个为严重级别。包含63个提权漏洞、56个远程代码执行漏洞,至少3个漏洞已有公开利用代码。AI加速漏洞发现或成常态。
ShinyHunters利用Oracle PeopleSoft零日漏洞(CVE-2026-35273)入侵大学
Google Mandiant确认ShinyHunters勒索组织(UNC6240)利用Oracle PeopleSoft未修补漏洞,在5月27日至6月9日期间入侵高校企业系统并窃取数据进行勒索。Oracle于6月10日才发布安全公告。
Defending Code Reference Harness — Anthropic安全防御框架 (5.7K⭐)
Anthropic官方出品,威胁建模、扫描、分类、修补的完整安全技能集,加上可定制的自动化扫描引擎。
Open Code Review — 阿里巴巴开源代码审查 (6.2K⭐)
阿里巴巴开源的混合架构代码审查工具:确定性流水线+LLM Agent。内置NPE、线程安全、XSS、SQL注入等规则集,支持OpenAI/Anthropic兼容API。
html-anything — Agent驱动HTML编辑器 (6.6K⭐)
AI Agent自动编写HTML,支持75种技能×9种输出格式(杂志、海报、数据报告等)。零API Key,兼容Claude Code/Cursor/Codex等主流Agent。
ds4 — DeepSeek本地推理引擎 by antirez (13.5K⭐)
Redis作者antirez新作,DeepSeek 4 Flash/PRO本地推理引擎。支持Metal/CUDA/ROCm三大GPU后端,C语言实现,极简高性能。
CodexPlusPlus — Codex增强工具 (17.4K⭐)
Rust编写的Codex增强工具,提升Codex使用体验。支持自动补全、上下文优化、多模型路由。中文社区主导开发。
Odysseus — 自托管AI工作空间 (67.8K⭐)
自托管AI工作空间,支持本地部署LLM、知识库、Agent工作流。Python实现,AGPL-3.0许可。11天内获67848星,GitHub本月最热项目。
GitHub默认禁用npm安装脚本以遏制供应链攻击
GitHub宣布将默认禁用npm包的安装脚本(preinstall/postinstall),这是针对npm生态系统供应链攻击频发的防御措施。开发者需显式信任才能启用脚本执行。该变更将分阶段实施,预计影响数百万开源项目。
Miasma供应链蠕虫渗透73个微软代码仓库
新型供应链蠕虫Miasma被发现已渗透73个微软官方代码仓库。该蠕虫通过依赖关系链自动传播,可在构建过程中注入恶意代码。微软安全团队已启动应急响应,建议开发者审查项目依赖。
Ivanti、Fortinet、SAP集中发布多个严重漏洞补丁
三大企业级厂商同日发布安全补丁:Ivanti修复Endpoint Manager多个RCE漏洞,Fortinet修补FortiOS SSL VPN组件缺陷,SAP修复NetWeaver平台权限提升漏洞。企业应优先评估暴露面并制定补丁计划。
Check Point VPN漏洞自5月初遭野外利用,影响企业远程接入安全
Check Point Security Gateway存在认证绕过漏洞CVE-2026-50751,自2026年5月初即遭攻击者利用。该漏洞影响企业VPN网关,攻击者可绕过认证获取未授权访问。Check Point已发布热修复,建议立即应用。
CISA将Cisco、Chrome、Arista漏洞加入KEV目录,确认遭主动利用
美国CISA将多个漏洞添加到已知被利用漏洞(KEV)目录,包括Cisco Catalyst SD-WAN Manager(CVE-2026-20245)、Chromium V8(CVE-2026-11645)和Arista EOS(CVE-2026-7473)。联邦机构需在规定时间内完成修补。
Langflow未修补漏洞CVE-2026-5027被野外利用,可实现未授权RCE
AI工作流编排平台Langflow存在未修补的严重漏洞CVE-2026-5027,攻击者可在无需认证的情况下远程执行代码。该漏洞已被野外利用,影响所有使用Langflow构建AI应用的企业。CVSS评分9.8,厂商尚未发布修复补丁。
微软6月补丁星期二修复206个漏洞,含3个零日和多个严重RCE
微软发布2026年6月安全更新,创纪录修复206个漏洞,其中包括3个已被利用的零日漏洞(CVE-2026-XXXX系列)。Windows内核、Exchange Server、Defender等核心组件均受影响,其中一个零日RoguePlanet可授予SYSTEM权限。CISA已将相关漏洞加入KEV目录。
h4ckf0r0day/obscura — Headless browser for AI agents and web scraping
面向AI agent的无头浏览器,Rust编写,15K stars,专为自动化网页操作和数据采集设计。
esengine/DeepSeek-Reasonix — DeepSeek-native AI coding agent for terminal
专为DeepSeek模型优化的终端AI编程助手,Go编写,21K stars,利用prefix-cache机制实现高效代码生成。
googleworkspace/cli — One CLI for Drive, Gmail, Calendar, Sheets
Google官方Workspace CLI工具,Rust编写,27K stars,一条命令行搞定Drive、Gmail、Calendar、Sheets等所有Google服务。
MemPalace/mempalace — Best-benchmarked open-source AI memory system
开源AI记忆系统,基准测试领先,55K stars,为AI agent提供持久化、可检索的长期记忆能力。
pewdiepie-archdaemon/odysseus — Self-hosted AI workspace
自托管AI工作空间,68K stars,Python实现,AGPL-3.0协议。
paperclipai/paperclip — The open-source app to manage agents at work
企业级AI agent管理平台,TypeScript编写,70K stars,帮助团队统一管理和监控多个AI agent工作流。
ultraworkers/claw-code — Agent-managed museum exhibit built in Rust
Rust编写的agent管理框架,193K stars,用于构建由AI agent驱动的交互式展示和应用。
karpathy/autoresearch — AI agents running research on single-GPU nanochat training automatically
Karpathy开源的自动研究框架,用AI Agent在单GPU上自动执行nanochat训练研究,86K stars,Python实现。
FreeLLMAPI更新: 聚合16个提供商,~1.7B tokens/月
开源FreeLLMAPI项目从14个提供商扩展到16个,每月可获约1.7B tokens免费额度(从800M提升),单一OpenAI兼容endpoint。
alpha-feedGenbo.ai: 免费无限AI图像/视频/聊天模型API
免费无限使用开源模型,覆盖图像生成、视频创建、语言模型。GPU计算H100 $2.835/h,付费模型低价透明计费。
alpha-feedCreativeAI: OpenAI兼容图像/视频/语音API,$10免费credits
Sora/DALL-E替代方案,OpenAI兼容API支持图像、视频、语音生成。使用promo code DALLE1000可获$10免费credits,无需复杂配置。
alpha-feedDMXAPI: 22+款免费大模型API聚合平台(国内直连)
LangChain中文网提供的AI模型聚合平台,22+款免费模型包括MiniMax-M2.7-free、GLM-5-free、Gemma 4、qwen-flash-free等,OpenAI兼容接口,国内直连无需翻墙。
alpha-feedUnoRouter: 134个免费AI模型聚合为单一endpoint
UnoRouter聚合15个免费提供商(Groq/Gemini/Cerebras/SambaNova/Mistral/Cloudflare/GitHub Models等)的134个免费模型,提供OpenAI兼容endpoint,$0/token,自动故障转移。2026-06-08上线。
alpha-feed中国关联JDY僵尸网络扩展至1500+设备用于网络侦察
Lumen研究人员警告JDY僵尸网络已扩张至1500+台SOHO和IoT设备,作为中心化控制的高性能扫描器持续映射暴露服务。该网络与中国国家级威胁组织关联。
Check Point VPN漏洞CVE-2026-50751自5月初遭持续利用
Check Point Security Gateway的IKEv1密钥交换协议存在认证绕过漏洞(CVE-2026-50751),CISA确认该漏洞自2026年5月初即遭攻击者利用。企业VPN设备的认证绕过可能导致内网全面暴露,影响范围广泛。
WinRAR漏洞被俄关联组织利用向乌克兰部署窃密木马
俄罗斯关联的APT组织被发现利用WinRAR软件漏洞,在针对乌克兰组织的攻击中部署信息窃取恶意软件。攻击通过鱼叉式钓鱼邮件投递恶意RAR压缩包触发漏洞,窃取浏览器凭证和加密货币钱包数据。
Langflow AI平台未授权RCE漏洞CVE-2026-5027遭在野利用
开源AI工作流平台Langflow被曝存在未授权远程代码执行漏洞(CVE-2026-5027),攻击者无需认证即可在服务器上执行任意命令。该漏洞已被积极利用,影响大量部署了Langflow的AI开发环境。目前补丁尚未发布。
Miasma供应链蠕虫入侵73个微软GitHub仓库
名为Miasma的供应链蠕虫病毒被发现已渗透73个微软官方GitHub仓库。该蠕虫通过依赖注入方式传播,微软正在逐步恢复受影响的仓库,部分仓库仍处于离线状态。这一事件凸显了软件供应链安全的严峻挑战。
微软6月补丁星期二创纪录修复206个漏洞,含3个零日和关键RCE
微软6月安全更新修复了创纪录的206个漏洞,其中3个已被在野利用的零日漏洞,包括Microsoft Defender RoguePlanet漏洞(可获取SYSTEM权限)和Exchange邮件欺骗漏洞。多个关键远程代码执行漏洞影响Windows、Office等核心产品。
Chrome V8零日漏洞CVE-2026-11645在野利用,CISA紧急纳入KEV目录
Google Chromium V8引擎被发现存在越界读写漏洞(CVE-2026-11645),攻击者可远程执行任意代码。该漏洞已在野利用,CISA于6月9日将其加入已知被利用漏洞目录(KEV),要求联邦机构限期修复。Google已发布Chrome紧急更新。
agent-governance-toolkit — 微软AI Agent治理工具包,4.2K⭐
微软出品AI Agent治理工具包,零信任身份、执行沙箱、可靠性工程,覆盖OWASP Agentic Top 10全部10项。
defending-code-reference-harness — Anthropic安全扫描框架,5.6K⭐
Anthropic官方安全工具,威胁建模、扫描、分诊、补丁技能+自主扫描harness。
gstack — Garry Tan的Claude Code工具集,108K⭐
Y Combinator总裁Garry Tan公开的Claude Code配置,23个工具覆盖CEO、设计师、工程管理、发布管理、文档、QA角色。
clawcode — Agent管理的Rust博物馆展览,193K⭐
Rust构建的agent管理博物馆展览,完全无人干预开发维护。193K星,Gajae-Code/LazyCodex驱动。
protobuf.js 六个 Proto6 漏洞暴露 Node.js 应用于 RCE 和 DoS 风险
广泛使用的 protobuf.js 库被发现存在6个严重漏洞,影响采用 Protocol Buffers 的 Node.js 应用。攻击者可利用这些漏洞实现远程代码执行或拒绝服务攻击。
WinRAR 漏洞 (CVE-2025-8088) 遭俄罗斯关联组织利用,向乌克兰投递窃密木马
俄罗斯关联 APT 组织利用 WinRAR 已知漏洞 CVE-2025-8088,通过精心构造的压缩包向乌克兰目标投递窃密恶意软件。该漏洞已有补丁但大量用户未更新。
Veeam Backup & Replication 严重 RCE 漏洞 (CVE-2026-44963) 允许域用户远程执行代码
Veeam Backup & Replication 被曝存在严重远程代码执行漏洞 CVE-2026-44963,拥有域用户权限的攻击者可在备份服务器上远程执行任意代码,对企业数据安全构成重大威胁。
ServiceNow 漏洞遭利用,攻击者获取客户实例未授权访问
ServiceNow 平台漏洞在野遭利用,攻击者借此获得对客户实例的未授权访问权限。ServiceNow 已确认事件并发布安全公告,受影响客户正被逐一通知。
Microsoft Defender RoguePlanet 零日漏洞可获取 SYSTEM 权限
Microsoft Defender 被发现存在名为 RoguePlanet 的零日漏洞组合(CVE-2026-33825、CVE-2026-45498、CVE-2026-41091),攻击者可利用该漏洞在已更新的 Windows 系统上获取 SYSTEM 最高权限。
微软6月补丁日修复206个漏洞,含3个零日和多个严重RCE
微软发布2026年6月安全更新,修复创纪录的206个安全漏洞,包括3个已被利用的零日漏洞(CVE-2025-10263、CVE-2026-8863等)和多个严重远程代码执行缺陷。
Chrome V8 Zero-Day CVE-2026-11645 在野利用,Google 紧急发布补丁
Google Chrome V8 JavaScript 引擎被发现存在零日漏洞 CVE-2026-11645,攻击者已在野外积极利用该内存损坏漏洞实现远程代码执行。Google 已发布紧急补丁,建议用户立即更新。
Obscura — Headless browser for AI agents and web scraping
Rust-based headless browser with anti-detect capabilities for AI agents and web scraping. Supports CDP, Playwright, Puppeteer compatibility. 14K+ stars. Apache-2.0 licensed.
DeepSeek-Reasonix — DeepSeek-native AI coding agent for terminal
Go-based AI coding agent optimized for DeepSeek models with prefix-cache stability. TUI interface built with Ink. 20K+ stars. MIT licensed.
Nuwa Skill — Distill anyone's thinking patterns
🧠 Distill anyone's thinking — mental models, decision heuristics, expression DNA. 23K+ stars. Chinese-first, MIT licensed. Clone how experts think, not just what they say.
MemPalace — Best-benchmarked open-source AI memory system
The best-benchmarked open-source AI memory system. Free. 55K+ stars. Uses ChromaDB for vector storage, supports MCP protocol. MIT licensed.
Open Design — Local-first open-source Claude Design alternative
🎨 Native desktop app for AI-powered design. 259+ skills, 142+ design systems. Local-first, open-source alternative to Claude Design. 62K+ stars. Apache-2.0 licensed.
Graphify — AI coding assistant skill with knowledge graphs
AI coding assistant skill compatible with Claude Code, Codex, OpenCode, Cursor, Gemini CLI. Turns codebases into knowledge graphs using tree-sitter parsing and Leiden community detection. 64K+ stars. MIT licensed.
Odysseus — Self-hosted AI workspace
Self-hosted AI workspace platform. 65K+ stars in just 10 days (created 2026-05-31). AGPL-3.0 licensed. Full-featured workspace for AI agents with Python backend.
caveman — Claude Code skill that cuts 65% of tokens by talking like caveman
🪨 A Claude Code skill that reduces token consumption by 65% through caveman-style prompting. 70K+ stars in 2 months. Uses fewer tokens to achieve the same output quality, saving significant API costs for Claude Code users.
claw-code — Agent-managed Rust开发工具,193K星
用Rust构建的AI agent管理开发环境,集成Gajae-Code/LazyCodex,支持自动化代码生成与管理
Google Gemini:2.0系列关闭,升级至3.5 Flash
2026年6月1日起,Gemini 2.0系列模型已关闭。请使用Gemini 3.5 Flash或3.1 Flash Lite。免费层仍可用,但需更新模型版本。
alpha-feed昆仑万维SkyClaw-v1.0:Agent专用模型免费试用
天工AI发布的Agent专用大语言模型,100万上下文窗口,原生Agent训练范式。2-4周免费试用期,在APIFree平台提供。
alpha-feeddeAPI.ai:图像转视频API $5免费额度
图像转视频生成API,注册送$5免费额度。支持Wan 2.2、AnimateDiff等模型,成本低于传统方案20倍,适合SaaS和创意工具集成。
alpha-feedEmbercloud:初创企业$100免费API额度
面向初创企业和独立开发者,提供$100免费API额度。支持GLM-5、GLM-4.7等模型,OpenAI兼容接口,零冷启动,需申请审核。
alpha-feedModulate Velma API:语音情感分析免费开放
2026年6月3日开放的语音情感分析API,1000免费credits。支持实时情绪检测、欺诈识别、合规监控等,无需企业合同。
alpha-feed美团龙猫LongCat API:每日5500万Token免费
美团自研560B MoE架构大模型开放平台,OpenAI兼容接口。Flash-Lite每日5000万Token,Flash系列共享500万,2.0-Preview 500万(可通过反馈刷至1.2亿)。支持代码生成、Agent推理、数字人视频生成等。
alpha-feedRust编写的IronWorm攻击NPM供应链
使用Rust语言编写的新型蠕虫IronWorm成功入侵NPM包管理器供应链。该恶意软件利用Rust的跨平台特性,在Windows和Linux系统上均可执行。
Meta AI客服机器人被黑客利用劫持Instagram账户
安全研究人员发现攻击者利用Meta平台的AI客服机器人漏洞,通过社工手段劫持用户Instagram账户。攻击者通过精心构造的提示注入绕过AI安全检查,成功获取账户恢复权限。Meta已修复该问题。
Silent Ransom组织升级攻击美国律所,敲诈勒索愈演愈烈
Silent Ransom Group加大对美国律师事务所的攻击力度,采用升级的敲诈勒索手段。法律行业因其敏感客户数据成为高价值目标。
SolarWinds Serv-U拒绝服务漏洞被CISA加入KEV目录
CISA将SolarWinds Serv-U的拒绝服务漏洞加入已知被利用漏洞(KEV)目录,确认该漏洞正遭在野利用。使用SolarWinds Serv-U的组织需立即打补丁。
Miasma蠕虫攻击73个微软GitHub仓库,供应链攻击升级
名为Miasma的蠕虫病毒成功入侵73个微软GitHub仓库,构成重大供应链攻击事件。该蠕虫通过代码仓库传播,可能影响下游依赖项目。
AI代理发现FFmpeg 21个零日漏洞;Chrome创纪录修复429个Bug
AI安全代理在FFmpeg中发现21个零日漏洞,同时Google Chrome在最新更新中创纪录地修复了429个安全缺陷。这标志着AI在漏洞挖掘领域的重大突破。
Check Point VPN关键漏洞遭在野利用,可绕过IKEv1密码认证
Check Point VPN被发现存在严重漏洞,攻击者可绕过IKEv1配置中的密码认证机制。该漏洞自2026年5月初即遭在野利用,CISA已将其加入已知被利用漏洞目录。
Linux内核单字符漏洞允许本地提权,PoC已公开
Linux内核发现一个单字符缺陷,攻击者可利用该漏洞实现本地root权限提升。目前漏洞利用代码已公开发布,影响范围广泛。安全研究人员建议立即更新内核补丁。
OpenRouter免费模型扩展至27个(含Kimi K2.6)
OpenRouter免费模型数量从11+扩展至27个(2026年6月),新增Kimi K2.6、Gemma 3等。200次/天免费,充值10 credits后可解锁1000次/天。
alpha-feedWan 2.7 — 阿里通义免费AI视频+图像生成平台
阿里通义驱动的Wan 2.7全面上线,支持AI视频(1080p/15秒/原生音频)和图像生成(千人千面/调色盘配色/3K文本渲染),800K+活跃用户,Wan 2.1开源无审查。
alpha-feedGradium语音AI创业计划 — $2,000+免费额度6个月
Gradium为语音AI创业公司提供免费Startup Program:6个月M计划(5400万credits,价值$2,000+),覆盖TTS/STT/语音克隆,含工程支持和新模型抢先体验。
alpha-feedWisGate创业计划 — 最高$2,000免费API额度
WisGate面向AI创业团队开放限时Startup Credits计划(2026.5.26-6.26),审核通过可获最高$2,000 API额度,覆盖LLM/图像/编码模型,OpenAI兼容。
alpha-feedAIMLAPI — 400+ AI模型免费试用,单一API Key
AIMLAPI聚合400+ AI模型(GPT-5.1、Claude 4.5、Gemini 3、Grok 4.1、DeepSeek V3.2等),一个API Key免费试用,无需信用卡。支持文本和图像生成。
alpha-feedKimi K2.6 在 OpenRouter 完全免费开放
月之暗面Kimi K2.6模型在OpenRouter上线免费版(:free),支持262K上下文窗口,原生多模态,专为长程编程和多Agent编排设计。输入输出全免费。
alpha-feedZeroLimitAI — 永久免费AI API,自动路由最佳模型
ZeroLimitAI提供永久免费AI API,OpenAI兼容接口,200+模型,ZeroOptimize™自动将请求路由到最佳免费模型(Gemini 2.5 Flash/Llama 4/DeepSeek R1)。无需信用卡。
alpha-feedAtomesus Cipher 8B API — $300-$10,000 Free Credits
印度AI公司Atomesus发布Cipher 8B模型,面向开发者开放API,申请即可获得$300-$10,000免费额度,无需支付信息。模型支持100种语言,33T tokens训练,代码能力突出(HumanEval 88.4)。
alpha-feedBazaarLink: OpenAI兼容免费API(auto:free零成本)
BazaarLink提供auto:free零成本的OpenAI兼容API接口,无需付费即可使用
alpha-feedAgnes AI 永久免费开放全部API — 新加坡排名Top10的AI Lab
Agnes AI(Sapiens AI旗下)宣布2026年6月1日起永久免费开放多模态API(文本/图片/视频),无订阅无配额限制。全球AI Lab排名第9,TokenPlan最低$4/月起。支持OpenClaw兼容模型。
alpha-feed硅基流动 SiliconCloud 免费模型聚合
硅基流动提供14个免费模型,2000万tokens免费额度。支持DeepSeek、Qwen、GLM、MiniMax等。
alpha-feed智谱AI GLM-4.7-Flash 完全免费不限量
GLM-4.7-Flash完全免费不限量,200K上下文,QPS=30。新用户送2000万tokens。GLM-5.1已上线。
alpha-feedGoogle Gemini Flash 免费层升级至1500RPD
Gemini Flash免费层15RPM/1500RPD(之前1000RPD),Flash-Lite 30RPM GA上线。Pro已移除免费层。
alpha-feed硅基流动 SiliconCloud 9B以下小模型永久免费
硅基流动注册送2000万tokens,9B以下小模型永久免费(限并发)。支持DeepSeek-R1、Qwen3.5、GLM-4、MiniMax等全栈开源模型。
alpha-feed国内大模型价格战加剧 | 豆包收费、DeepSeek永久降价
2026年5月国产大模型格局大洗牌:豆包开始收费,DeepSeek永久降价,通义千问3.7杀入全球前15。免费额度窗口正在缩小。
alpha-feedStable Diffusion API 免费层20张图/天
Stable Diffusion API提供免费层,每天20张图片生成。付费方案$8/月起。支持SDXL、SD3等模型。
alpha-feedDeepSeek V4系列发布 | V4-Flash免费 | V4-Pro付费
DeepSeek V4系列发布,V4-Flash完全免费,V4-Pro付费。支持思考模式切换。阿里云百炼也可调用DeepSeek V4。
alpha-feedTogether AI 免费额度升至$100 | 200+开源模型
Together AI新用户免费额度从$25升至$100,覆盖200+开源模型(Llama 4、DeepSeek-V3、Qwen、Mixtral等)。无需信用卡。
alpha-feedxAI Grok $25注册+每月$150数据贡献计划
xAI注册送$25额度,加入数据贡献计划可获每月$150免费额度,首月共$175。Grok-3 Mini仅$0.30/$0.50/M tokens。
alpha-feedGoogle Gemini 2.5 Flash-Lite GA上线 | 免费层30RPM
Gemini 2.5 Flash-Lite正式GA,免费层30RPM/1M TPM,比Flash更高RPM。Gemini 2.5 Pro免费层5RPM/100RPD。Flash免费层15RPM/1000RPD。
alpha-feed通义千问 新用户7000万免费tokens | 3个月有效
阿里云百炼Token Plan,新用户至高享7000万免费tokens,支持Qwen3、DeepSeek、Kimi系列。Qwen2.5-72B不限速。
alpha-feed百度千帆 Token福利包上线 | 积分计量体系
百度千帆推出统一AI使用额度产品Token福利包,兼容主流AI编程工具。积分计量体系,5万-80万积分/月,首购优惠¥45-800。支持17个模型各100万tokens。
alpha-feedMiniMax M3 发布 | Token Plan订阅制 | 1M上下文
MiniMax M3最新旗舰模型,原生多模态、1M上下文窗口,支持Agent推理/工具调用/代码。Token Plan订阅制可低价使用全模态模型。
alpha-feed🆓 Pollinations.AI - Image/Text/Video/Audio API: 完全免费无需注册
OpenAI兼容接口,支持图片/文本/视频/音频生成,无需API Key
alpha-feed🆓 Anthropic - Claude for Open Source: 6个月Claude Max 20x免费
开源项目维护者可申请,10000个名额,价值$1200
alpha-feed🆓 Google Gemini - Gemini 2.5 Flash-Lite: 免费层30RPM
Flash-Lite GA上线,免费层30RPM/1M TPM,比Flash更高RPM
alpha-feed🆓 Puter.js - Image Generation API: 完全免费无限制
User-Pays模式,前端免费调用DALL-E/Gemini/Flux/SD等,无需API Key
alpha-feed🆓 NVIDIA NIM - Dev Program Credits: 91模型免费试用
DeepSeek V3.2, Devstral-2-123B等91模型,40 RPM,需注册Dev Program
alpha-feed🆓 OpenAI - API Credits: $5新用户额度
3个月过期。⚠️ DALL-E 2/3 API已于2026年5月12日关闭,替代品gpt-image-1非免费
alpha-feed🆓 Google Gemini - Free Tier: Flash免费层1500RDP
Flash免费层1500RDP/10RPM,Flash-Lite免费层30RPM,Pro已移除
alpha-feedVR Exercise Platform Supernatural Becomes Independent After Meta Spinoff
VR健身平台Supernatural从Meta独立,成为独立运营公司。Meta继续剥离非核心VR业务,集中资源于AI和元宇宙核心技术。
EU Reveals Details of Its Tech Sovereignty Package
欧盟公布技术主权方案细节,旨在减少对美国科技巨头的依赖。涵盖芯片、云服务和AI基础设施,欧洲正加速构建自主技术生态。
Apple Scales Back Vision Products Roadmap Under John Ternus
John Ternus主导下Apple缩减Vision产品路线图,Vision Pro系列战略调整。苹果在空间计算领域正从激进扩张转向务实聚焦。
Florida Sues OpenAI and Sam Altman Over Alleged 'Exploitation of Users'
佛罗里达州对OpenAI及其CEO Sam Altman提起诉讼,指控其涉嫌'剥削用户'。这是美国州级政府对AI公司最大胆的法律行动之一,AI监管风暴正在升级。
Mark Zuckerberg Wants Meta AI Agents to 'Run Your Whole Business'
扎克伯格公开表示Meta的AI代理将能运营整个企业业务,显示Meta在企业AI领域的雄心。从社交广告到AI驱动的全面业务自动化,Meta正重塑其商业版图。
Cisco Announces Record Revenue and 4,000 Layoffs in the Same Day
思科同日宣布创纪录营收和4000人大规模裁员,反映科技行业利润优先+AI驱动效率的结构性转变。传统IT巨头正加速向AI和云服务转型。
Anthropic Raises Claude Code Usage Limits, Credits New Deal with SpaceX
Anthropic大幅提升Claude Code使用限额,并披露与SpaceX达成新合作协议。此举表明AI编程工具竞争白热化,Anthropic正通过战略合作扩大企业级市场。
US Government Takes $2B Equity Stake in Nine Quantum Computing Firms
美国政府宣布向九家量子计算企业注资20亿美元,获取股权。这是美国在量子计算领域最大规模的国家投资,标志着量子技术从研究阶段迈入产业化关键期。
Google Gemini Free Tier更新: Flash 1500RDP + Flash-Lite 30RPM
Google Gemini免费层更新:Flash 1500请求/天/10RPM,Flash-Lite 30RPM/1M TPM,Pro已从免费层移除。仍为最慷慨的免费LLM API。
alpha-feedDeepSeek V3 API: 每日50次免费调用
DeepSeek V3模型提供每日50次免费API调用。V4系列(V4-Pro/V4-Flash)已上线预览版,1M超长上下文。
alpha-feedGoogle Gemini 2.5 Flash-Lite GA: 免费层30RPM/1M TPM
Gemini 2.5 Flash-Lite正式GA上线,免费层30RPM/1M TPM,比Flash的10RPM更高。Flash免费层1500RDP/10RPM不变。无需信用卡。
alpha-feedAnthropic Claude for Open Source: 开源维护者6个月Claude Max 20x免费
Anthropic推出Claude for Open Source计划,开源项目维护者可申请6个月Claude Max 20x免费使用(价值$1200),共10000个名额。需要验证开源项目维护者身份。
alpha-feed🆓 Puter.js 图像生成API: 完全免费无限制
Puter.js通过User-Pays模式提供免费无限制图像生成,支持DALL-E/Gemini/Flux/SD等模型,前端直接调用,无需API Key。
alpha-feed🆓 NVIDIA NIM Dev Program: 91模型免费试用
NVIDIA NIM Dev Program提供91个模型免费试用,包括DeepSeek V3.2、Devstral-2-123B等。40 RPM,需注册Dev Program。
alpha-feedNx Console & Daemon Tools Lite 供应链投毒 — CISA收录恶意代码嵌入事件
CISA于2026-05-27同时收录Nx Console(CVE-2026-48027)和Daemon Tools Lite(CVE-2026-8398)的恶意代码嵌入漏洞,表明供应链投毒攻击正针对开发工具和系统实用软件同步展开。开发者应立即检查所用工具版本完整性。
CISA KEV2026重大数据泄露汇总 — FBI遭入侵、10亿Android设备受影响、2.7亿记录曝光
2026年上半年数据泄露形势严峻:FBI内部系统遭入侵,约10亿Android设备面临安全风险,超过2.7亿条用户记录在暗网曝光。多起事件涉及国家级APT组织,暴露了关键基础设施和消费电子领域的系统性安全短板。
安全资讯AI生成零日漏洞利用 — Google首次拦截AI自动漏洞攻击
2026年5月报告指出,攻击者利用AI辅助工具发现并构造零日漏洞利用代码,Google安全团队首次成功拦截了一起AI自动生成的零日漏洞攻击尝试。安全研究机构警告,AI赋能的漏洞挖掘能力正在改变攻防格局,防御方需加速部署AI驱动的检测系统。
安全资讯Microsoft Exchange Server XSS漏洞 — 企业邮件系统面临欺骗攻击
Microsoft Exchange Server存在跨站脚本(XSS)漏洞,未授权攻击者可通过网络执行欺骗攻击。该漏洞于2026-05-15被CISA纳入KEV目录,影响企业广泛部署的邮件服务器环境,需立即打补丁。
NVD / CISA KEVBerriAI LiteLLM SQL注入漏洞 — AI网关基础设施高危
BerriAI LiteLLM(AI模型代理网关)在1.81.16至1.83.7版本中存在SQL注入漏洞,数据库查询将调用方提供的API密钥值直接拼接进查询文本而非参数化。未认证攻击者可利用此漏洞访问或篡改AI代理的API密钥数据库。CISA已于2026-05-08收录。
NVD / CISA KEVBitwarden CLI 供应链攻击 — npm包植入恶意代码
Bitwarden CLI 2026.4.0版本(2026-04-22 21:57Z至23:30Z期间从npm获取)被发现内嵌恶意代码,与Checkmarx供应链事件相关。该时间窗口内下载的CLI工具可能被注入后门,影响密码管理器的命令行操作安全。