ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

从 kea 档案看 remote-in-tech 远程职位目录:公司档案结构、数据建模与渲染链路解析

2026/10/3 8:41:10 拓冰建站 浏览量
从 kea 档案看 remote-in-tech 远程职位目录:公司档案结构、数据建模与渲染链路解析 数据集【免费下载链接】remote-jobsSource for remoteintech.company — a community-maintained directory of remote-friendly tech companies项目地址https://gitcode.com/GitHub_Trending/re/remote-jobs点击查看免费下载导读kea 是 remote-in-tech 远程友好型科技公司目录中收录的一家餐饮行业对话式 AI 公司其档案位于 kea.md。本文以该档案为完整样本逐字段拆解这份远程职位目录中公司档案的 frontmatter 数据模型与 Markdown 正文规范并结合仓库中的标签体系、集合collection构建与页面布局源码还原「一条公司数据从 Markdown 档案到可浏览的远程职位页」的完整链路。读完本文你将掌握本目录的字段取值规则、标签分类逻辑以及如何按规范为一家远程公司新建档案。档案本体kea 的完整数据快照kea 的档案由两部分构成以---包裹的 YAML frontmatter机器可读的结构化元数据和其后的 Markdown 正文面向读者的自然语言信息。二者共同决定了该档案在站点上的呈现方式与在浏览、检索系统中的归属。Frontmatter 字段与取值以下是 kea 档案 frontmatter 的原始内容--- title: kea slug: kea website: https://kea.ai careers_url: https://careers.kea.ai region: americas remote_policy: remote-friendly company_size: small technologies: - javascript addedAt: 2022-04-26 updatedAt: 2022-04-26 ---逐字段解读如下字段kea 的取值含义与作用titlekea公司展示名称用于页面标题与按字母排序见 collections.js 中getAllCompanies的localeCompare排序slugkea档案唯一标识必须与文件名一致src/companies/kea.mdURL 路由与链接生成都依赖它websitehttps://kea.ai公司官网当未提供careers_url时页面主按钮会退化为「Visit Website」careers_urlhttps://careers.kea.ai招聘页地址渲染时优先于website显示「Apply Now」按钮regionamericas招聘区域取值受region白名单约束见下文标签体系remote_policyremote-friendly远程政策类型取值受remote_policy白名单约束company_sizesmall公司规模分类kea 属于 11-50 人档technologies[javascript]技术标签数组决定该档案出现在哪些「按技术浏览」页面addedAt/updatedAt2022-04-26由维护者管理的日期字段驱动「最近添加」集合与「Last updated」展示值得注意的是kea 正文中的「Company technologies」一节列出了JavaScript / AWS / PostgreSQL / Mocha / Python / Cypress / Chai / Twilio / Docker共 9 项技术栈而 frontmatter 的technologies数组只收录了javascript。这是本目录数据模型的一个关键设计只有进入受控白名单的技术标签才会被纳入索引与浏览体系正文中的长列表用于展示完整栈信息白名单标签用于结构化归类。Markdown 正文的必需章节kea 的正文完整覆盖了 CONTRIBUTING.md 规定的三个必需章节Company blurb——kea builds conversational AI for restaurants.一句话业务定位同时被自动抽取为页面的 meta descriptionRemote status——Fully-remote. Must be in North or Latin America.远程实践方式与地域限制How to apply——指向招聘页的申请入口。此外还包含了可选的Company size20-50、RegionNorth and Latin America、Company technologies与Office locationsCalifornia, USA章节。kea 的案例说明了一个典型规律即便公司在欧美均设有实体办公地点其招聘仍可在全远程模式下进行但地域范围受限仅北美与拉美——这正是remote_policy: remote-friendly与region: americas两字段的组合语义。字段合法性标签白名单与数据契约frontmatter 中的region、remote_policy、company_size、technologies并非自由文本而是受控枚举。仓库中的 labels.js 是这套标签体系的唯一事实来源定义如下region: { worldwide, americas, europe, americas-europe, asia-pacific, other } remotePolicy: { fully-remote, remote-first, hybrid, remote-friendly } companySize: { tiny(1-10), small(11-50), medium(51-200), large(201-1000), enterprise(1000) } tech: { javascript, typescript, react, nodejs, python, ruby, go, java, php, rust, dotnet, elixir, scala, swift, cloud, devops, docker, kubernetes, mobile, data, ml, sql, postgres, nosql, search }这套白名单同时被两处消费Nunjucks 模板通过全局数据级联以labels.*形式读取JavaScript 侧则通过 companyHelpers.js 重新导出后供 collections.js 使用。kea 的取值全部命中白名单region: americas、remote_policy: remote-friendly、company_size: small、technologies: [javascript]属于完全合规的档案。从源码结构看白名单之所以如此设计是因为它支撑了三个核心浏览维度的稳定分页与计数count统计自由文本会破坏分组聚合的确定性。这也是为什么正文中出现的 PostgreSQL、Mocha、Twilio 等未收录技术不会进入technologies数组——它们没有被定义标签。渲染链路一条档案如何变成可浏览的页面布局与页面组装companies.json声明了所有公司档案统一使用company布局对应 company.njk。该模板的核心逻辑优先显示careers_url对应的「Apply Now」按钮否则退化为website的「Visit Website」根据region、remote_policy渲染可点击的标签分别链接到/browse/{region}/与/browse/{remote_policy}/浏览页遍历technologies数组渲染 Tech Stack 标签链接到/browse/{tech}/依据updatedAt展示「Last updated」日期经formatDate过滤器格式化为MMMM D, YYYY。以 kea 为例页面上会呈现「Americas」区域标签、「Remote Friendly」政策标签以及「JavaScript」技术标签三个浏览入口配一个指向careers.kea.ai的「Apply Now」主按钮。meta description 的自动生成companies.11tydata.js 是公司档案的共享计算数据层。它为所有未显式设置description的档案自动生成 SEO meta 描述用正则定位## Company blurb标题抽取其后的正文段落清洗掉 Markdown 链接、强调符号与多余空白再截断至约 155 字符优先在句号处截断。kea 的 blurb 较短会被完整保留为页面描述这就是机器可读数据与正文自然语言衔接的自动化环节。集合聚合与浏览页eleventy.config.js 注册了companies、featuredCompanies、recentCompanies、companiesByRegion、companiesByTech、companyTags等集合。其中getCompaniesByRegion以region字段为键将全部约 800 家档案分组——kea 会落入americas组getCompaniesByTech以technologies数组为键分组——kea 会因javascript标签出现在 JavaScript 技术浏览页getCompanyTags则汇总全部档案生成带count统计的标签清单并按数量降序排列。由此可以推断remote_policy: remote-friendly让 kea 出现在「Remote Friendly」政策浏览页company_size: small供按规模筛选当前主要由标签体系支撑展示。一条档案的字段值决定了它在多个浏览维度中的可见位置。实操按规范为远程公司新增档案若要将一家类似 kea 的公司加入目录按 CONTRIBUTING.md 的流程操作在src/companies/下创建{slug}.md文件名必须与 frontmatter 的slug一致按模板填写 frontmatter并补齐## Company blurb、## Remote status、## How to apply三个必需正文章节运行npm run build验证构建该命令会先清理dist、src/_includes/css、src/_includes/scripts再执行 Eleventy 生产构建最后用 pagefind 生成站内搜索索引详见 package.json提交 Pull Request由「Validate Company Profiles」自动化校验机器人审查字段合法性与内容完整性。校验要点包括region、remote_policy、company_size、technologies必须命中 CONTRIBUTING.md 表格中的合法值careers_url必须指向公司自己的招聘页而非销售页档案需具备有意义的内容。addedAt/updatedAt由维护者管理贡献者不应在 PR 中填写。总结以 kea 档案为窗口可以看到remote-in-tech 目录的每条公司数据都遵循「受控枚举的 frontmatter 结构化正文」双重契约白名单字段region / remote_policy / company_size / technologies驱动标签聚合与浏览分页正文章节驱动页面展示与 SEO 描述自动生成最终由 company.njk 布局与各集合统一渲染输出。理解这套模型既能快速读懂目录中的任意一家公司档案也能按照同一套规范贡献新的远程公司条目。赞分享数据集【免费下载链接】remote-jobsSource for remoteintech.company — a community-maintained directory of remote-friendly tech companies项目地址https://gitcode.com/GitHub_Trending/re/remote-jobs点击查看免费下载相关推荐从 CloudApp 档案看 Remote In Tech 远程公司目录混合办公公司的数据建模与档案消费链路从 CloudApp 档案看 Remote In Tech 远程公司目录混合办公公司的数据建模与档案消费链路 Remote In Techremoteint数据集从 Functionize 档案看 fully-remote 公司数据模型Remote In Tech 目录公司档案的结构与解析从 Functionize 档案看 fully remote 公司数据模型Remote In Tech 目录公司档案的结构与解析 导读 本篇以开源仓库 rem数据集从 Clootrack 档案解析 Remote In Tech 远程公司目录的数据模型与构建链路从 Clootrack 档案解析 Remote In Tech 远程公司目录的数据模型与构建链路 本指南以 clootrack.md https://link.数据集上一篇MicroPython ESP8266 移植指南板卡兼容性、硬件规格与已知问题全解析下一篇grok-build 0.2.86 版本解读语音 STT 语言、Tab 自动补全与媒体预算升级全解析创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考