tracking-startup-founders-on-twitter

Compare original and translation side by side

🇺🇸

Original

English
🇨🇳

Translation

Chinese

Tracking Startup Founders On Twitter

追踪Twitter上的创业公司创始人

Executes tracking startup founders on twitter using apidojo scrapers. Part of the apidojo intelligence skills library.
借助apidojo爬虫实现对Twitter上创业公司创始人的追踪。属于apidojo智能技能库的一部分。

Prerequisites

前置条件

  • APIFY_TOKEN
    environment variable set
  • Optional: Apify MCP server installed
  • 设置
    APIFY_TOKEN
    环境变量
  • 可选:安装Apify MCP服务器

Inputs

输入参数

ParameterTypeRequiredDefaultNotes
startUrls
arrayOptional
[]
Twitter profile or tweet URLs
twitterHandles
arrayOptional
[]
Twitter usernames (without @)
twitterUserIds
arrayOptional
[]
Twitter user IDs
getFollowers
booleanOptional
false
Extract follower lists
getFollowing
booleanOptional
false
Extract following lists
getRetweeters
booleanOptional
false
Extract retweeters of a tweet URL
includeUnavailableUsers
booleanOptional
false
Include unavailable/suspended users
maxItems
numberOptionalUnlimitedMaximum users to return
customMapFunction
stringOptionalJavaScript function to transform each output object
参数类型是否必填默认值说明
startUrls
数组可选
[]
Twitter个人主页或推文URL
twitterHandles
数组可选
[]
Twitter用户名(不含@)
twitterUserIds
数组可选
[]
Twitter用户ID
getFollowers
布尔值可选
false
提取粉丝列表
getFollowing
布尔值可选
false
提取关注列表
getRetweeters
布尔值可选
false
提取推文的转发者列表
includeUnavailableUsers
布尔值可选
false
包含不可用/被封禁的用户
maxItems
数字可选无限制返回的最大用户数量
customMapFunction
字符串可选用于转换每个输出对象的JavaScript函数

Workflow

工作流程

Progress:
- [ ] Step 1: Define parameters
- [ ] Step 2: Run twitter-user-scraper
- [ ] Step 3: Filter and classify results
- [ ] Step 4: Score by quality and relevance
- [ ] Step 5: Deliver output
进度:
- [ ] 步骤1:定义参数
- [ ] 步骤2:运行twitter-user-scraper
- [ ] 步骤3:筛选并分类结果
- [ ] 步骤4:按质量和相关性评分
- [ ] 步骤5:交付输出结果

Step 2: Run the Actor

步骤2:运行Actor

Recommended — run_actor.js (handles waiting, output, and file saving automatically):
bash
undefined
推荐方式 — run_actor.js(自动处理等待、输出和文件保存):
bash
undefined

Quick answer (prints table to chat)

快速返回结果(在聊天中打印表格)

node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'
node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'

Save as CSV

保存为CSV格式

node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'
--output YYYY-MM-DD_results.csv --format csv
node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'
--output YYYY-MM-DD_results.csv --format csv

Save as JSON

保存为JSON格式

node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'
--output YYYY-MM-DD_results.json --format json
> `APIFY_TOKEN` must be set in environment or `.env` file.

**If Apify MCP is available:**
Tool: apify:run-actor Actor: "apidojo~twitter-user-scraper" Input: { "searchTerms": ["founder [SECTOR]", "building [SECTOR] startup", "CEO [SECTOR]", "#buildinpublic [SECTOR]"], "maxItems": 100 }

**REST API fallback:**
```bash
curl -X POST \
  "https://api.apify.com/v2/acts/apidojo~twitter-user-scraper/runs?token=$APIFY_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"searchTerms": ["founder [SECTOR]", "building [SECTOR] startup", "CEO [SECTOR]", "#buildinpublic [SECTOR]"], "maxItems": 100}'
Wait for
SUCCEEDED
. Fetch dataset:
bash
curl "https://api.apify.com/v2/actor-runs/$RUN_ID/dataset/items?token=$APIFY_TOKEN"
node scripts/run_actor.js
--actor "apidojo~twitter-user-scraper"
--input '{"param": "value"}'
--output YYYY-MM-DD_results.json --format json
> `APIFY_TOKEN`必须在环境变量或`.env`文件中配置。

**若Apify MCP可用:**
工具: apify:run-actor Actor: "apidojo~twitter-user-scraper" 输入: { "searchTerms": ["founder [SECTOR]", "building [SECTOR] startup", "CEO [SECTOR]", "#buildinpublic [SECTOR]"], "maxItems": 100 }

**REST API备选方案:**
```bash
curl -X POST \
  "https://api.apify.com/v2/acts/apidojo~twitter-user-scraper/runs?token=$APIFY_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"searchTerms": ["founder [SECTOR]", "building [SECTOR] startup", "CEO [SECTOR]", "#buildinpublic [SECTOR]"], "maxItems": 100}'
等待运行状态变为
SUCCEEDED
。获取数据集:
bash
curl "https://api.apify.com/v2/actor-runs/$RUN_ID/dataset/items?token=$APIFY_TOKEN"

Step 3: Classify Results

步骤3:分类结果

classification: EARLY_STAGE (< 1K followers, building in public) | SEED_STAGE (1K-10K, active fundraising signals) | GROWTH_STAGE (> 10K, scaling)
分类标准: EARLY_STAGE(粉丝数<1K,公开创业)| SEED_STAGE(粉丝数1K-10K,有活跃融资信号)| GROWTH_STAGE(粉丝数>10K,处于扩张阶段)

Step 4: Score Each Result

步骤4:为每个结果评分

score = founder_signal_score = (bio_contains_founder_title ? 1 : 0) * 0.35 + (recent_product_tweet ? 1 : 0) * 0.35 + min(followerCount/10000, 1) * 0.30
score = founder_signal_score = (个人简介包含创始人头衔 ? 1 : 0) * 0.35 + (近期发布产品相关推文 ? 1 : 0) * 0.35 + min(followerCount/10000, 1) * 0.30

Step 5: Edge Cases

步骤5:边缘情况处理

  • Many 'founder' accounts are actually solopreneurs or side-project builders — not venture-backed; verify by looking for funding mentions or accelerator affiliations in bio
Additional fallbacks:
  • < 20 results: Broaden search terms; remove secondary filters
  • No results: Verify the search terms are correct; try alternate phrasings
  • Data quality issues: Remove entries with missing key fields; note count in output
  • 许多标注为“创始人”的账号实际上是个体创业者或副业项目开发者,并非风险投资支持的创业公司;可通过查看个人简介中的融资提及或加速器合作信息来验证
其他备选方案:
  • 结果不足20条:扩大搜索词范围;移除次要筛选条件
  • 无结果返回:验证搜索词是否正确;尝试其他表述方式
  • 数据质量问题:移除关键字段缺失的条目;在输出中注明缺失数量

Output Format

输出格式

undefined
undefined

Tracking Startup Founders On Twitter

追踪Twitter上的创业公司创始人

Results: [N] | Date: [DATE]
#[Key Field][Metric 1][Metric 2][Classification][Score]
1[value][value][value][type][0.XX]
结果数量: [N] | 日期: [DATE]
序号[关键字段][指标1][指标2][分类][评分]
1[值][值][值][类型][0.XX]

Summary

总结

Top result: [description] Key finding: [insight]
undefined
排名第一的结果: [描述] 关键发现: [洞察]
undefined

Troubleshooting

故障排除

Too few results: Broaden the primary search term; remove restrictive filters. Low quality results: Apply minimum score threshold (≥ 0.50) to filter noise. Actor fails to run: Verify API key; check actor status at apify.com/apidojo.
结果数量过少:扩大核心搜索词范围;移除限制性筛选条件。 结果质量较低:应用最低评分阈值(≥0.50)过滤无效数据。 Actor运行失败:验证API密钥;查看apidojo.com上的Actor状态。