我们在做什么
Stripe 之于支付,Twilio 之于通信,Anysite 站的是同一个位置。把底层原语做成可编程的,开发者才好专心做自己的东西。
这个原语就是网页数据。Anysite 是 AI 智能体与网页之间的基础设施层,把任何网站变成带类型、可查询的数据,规模上能直接扛生产。
2024 年成立,起点是个很朴素的观察:AI 智能体在数据上有个根子上的问题。网页吐出来的 HTML 是给人眼看的,不是给机器吃的。
到 2030 年,这个市场预计有 $52B 规模,里面每个智能体都得读网页——价格、资料、讨论、公开披露文件——而这些数据默认没有一份是机器可直接用的。
自己在内部搭提取层的团队都会发现,维护成本涨得比价值快。我们的答案是把每个网站都当成 API:会自愈、结构一致、能上生产。
我们怎么做事
会自愈的基础设施
会坏的基础设施算不上基础设施。提取引擎能发现结构变化并自己适配;实在适配不了就大声报错,不会留下悄无声息的数据缺口。
开发者优先
一个 YAML 文件就能描述整条生产管道:提取、转换、存储、调度。CLI 用 MIT 协议开源——基础设施就该看得见,也该能自己 fork 一份。
默认保护隐私
提取到的数据我们不留存。全程 HTTPS 和 TLS 1.3,API key 按凭据划定权限。你采到的数据归你。
团队

Andrew Kulikov
联合创始人兼 CEO
荷兰阿姆斯特丹

Dmitry Kononov
联合创始人兼 CTO
日本东京
一路怎么走来
成立
从商业数据提取和 n8n 集成节点起步。从一开始就认定:拿网页数据是基础设施问题,不是工具问题。
接入 Instagram,定下统一的 API 结构:各平台的 JSON 结构保持一致。
MCP 服务器与写操作
上线面向 AI 智能体的 MCP 服务器,2024 年就原生支持 Model Context Protocol,同时为职业社交平台补上写操作。
DuckDuckGo、Reddit 与规模
DuckDuckGo 搜索和 Reddit 集成上线。平台的 API 日调用量达到数千次。
Twitter/X 与 credits 计价
Twitter/X 集成上线。改成按 credits 计价:按请求付费,不按月付费。
更名为 Anysite
从 Horizon Data Wave 改名 Anysite。通用网页解析上线:任意 URL 都能用 AI 提取,不再只限于事先做好的平台集成。
MCP Unlimited 与价格体系调整
MCP Unlimited 上线,固定月费 $30,价格体系同期整体调整。
CLI、智能体协议与 Crunchbase
CLI 上线,支持 YAML 定义管道、对接数据库(SQLite、PostgreSQL、ClickHouse),并提供面向智能体的协议。新增 Crunchbase 接口,免费档下线。
MCP 服务器 v2 与平台扩展
MCP 服务器 v2:五个元工具、服务端缓存、动态接口发现。YouTube、SEC EDGAR、Crunchbase 等覆盖范围扩大,并接入更多智能体平台。