Сборщик
Скрапер LinkedIn Company Posts
Свежие посты с любой публичной страницы компании в LinkedIn: полный текст, заголовок, время публикации и собственный адрес поста, по строке на пост. Читателю без входа LinkedIn встраивает от семи до десяти таких постов, а остальное закрывает стеной, — их карточка и собирает.
Содержание
Что он собирает
Свежие посты с любой публичной страницы компании в LinkedIn: полный текст, заголовок, время публикации и собственный адрес поста, по строке на пост. Читателю без входа LinkedIn встраивает от семи до десяти таких постов, а остальное закрывает стеной, — их карточка и собирает. Это скрапер, а значит весь договор такой: заполните форму — и вернётся одна таблица. Окно браузера не открывается, слоты автоматизаций вашего тарифа не тратятся, а запросы уходят по обычному HTTP с TLS-отпечатком настоящего браузера.
Он прекрасно работает и с вашего собственного адреса: прокси можно выбрать при запуске, но этому источнику он не нужен. Как бы ни ушёл запрос, каждая строка это фиксирует — см. служебные колонки ниже.
Что вы даёте — 4
Форма, которую рисует приложение, прочитанная из самой карточки. Каждая подсказка ниже — та же, что стоит рядом с этим полем в диалоге запуска, так что здесь нет описания продукта, написанного отдельно от него.
Один ответ, без которого запуск не начнётся
- companies
- Companies · list · обязательное
One company per line — the company page URL, a country subdomain, or the bare slug. The same input LinkedIn Companies takes, so the two cards can be run over one list and joined afterwards.
Всё остальное — по желанию
- maxPostsPerCompany
- Most recent, per company · number
- keywords
- Post contains · list
- postedWithinDays
- Posted in the last (days) · number
Keeps the newest few from each company rather than everything on the page. It saves no requests — the posts all arrive in one reply, so this only decides how many reach the table.
Keeps a post only when its body contains one of these.
Counted from the moment the run starts, so a schedule keeps meaning the same window. A post with no readable date fails this rather than passing.
Что вернётся — колонок: 11
Один датасет на запуск — типизированная таблица, которая принадлежит вашему рабочему пространству: её можно сортировать, фильтровать, править прямо в сетке, выгружать целиком или читать через локальный API. Вот колонки, с которыми она создаётся.
Одна колонка помечена как может быть пустой. Это факт о самой записи, а не о сборщике — пост без отметки места, аккаунт без категории бизнеса, — и об этом сказано вслух, чтобы пустая ячейка не читалась как сломанный скрапер. Колонку, которой в ответе не бывает вовсе, удаляют на стороне каталога, а не поставляют пустой, так что здесь нет ничего декоративного.
Из LinkedIn Company Posts — колонок: 7
| Ключ | Колонка | Тип |
|---|---|---|
| text | Post | longText |
| headline | Headlineможет быть пустой | text |
| postedAt | Posted | datetime |
| authorName | Company | text |
| authorUrl | Company page | url |
| url | Post URL | url |
| searchTerm | Found via | text |
Пишет каждый скрапер — колонок: 4
Одни и те же четыре на каждой карточке, чтобы таблица и через несколько месяцев могла ответить, откуда взялись её строки: из какого сервиса, когда, с личностью какого профиля уходили запросы и был ли выполнен вход.
| Ключ | Колонка | Тип |
|---|---|---|
| platform | Platform | text |
| collected_at | Collected at | datetime |
| profile | Collected by | profile |
| logged_in | Signed in | select |
Четыре способа запустить
Вкладка «Скраперы». Выберите карточку, заполните форму, нажмите «Старт». Каждый запуск отсюда создаёт новую таблицу, названную по тому, что вы искали, и по времени запуска. Хотите — сначала проверьте: скрапер соберёт одну страницу, ничего не запишет и покажет, какие колонки вернулись заполненными.
Попросите ассистента. У него есть весь каталог, поэтому эта карточка — фраза, а не форма. Он заполнит параметры выше из того, что вы сказали, и покажет их вам до запуска.
Через MCP или локальный API. Та же карточка, но из кодового агента: argus_run_scraper на MCP-сервере или POST http://127.0.0.1:39219/v1/scrapers/run в локальном API. Рядом лежит пример вызова, который ничего не записывает.
{
"kind": "linkedin_company_posts",
"inputs": {
"companies": [
"…"
]
}
}Шагом внутри сценария. Шаг Run scraper ставит этот сборщик в середину автоматизации — собрать, отфильтровать, разослать — и дерево всё так же не открывает при этом ни одного окна. Это ещё и единственный вызывающий, который может отменить правило «таблица на запуск»: если указать ему таблицу по имени, он создаст её с колонками выше, когда её нет, и дальше будет складывать туда каждый запуск — дописывая строки или обновляя их на месте по колонке, которую вы выбрали для сопоставления. Следующему шагу он передаёт имя таблицы, её идентификатор и число строк.
Где он останавливается
Строк на одну цель — примерно 7, и это весь ответ. Это все посты, которые LinkedIn встраивает для читателя без входа: полный архив компании закрыт стеной входа, и запрашивать дальше просто нечего.
Управлять страницей он не станет. Всё, чему нужен настоящий браузер — сайт без списочной точки под капотом или любая работа с вашим собственным аккаунтом, — это автоматизация, и это другой инструмент, а не худшая версия этого.
Он никуда не входит. Чтение публичной страницы без входа — устоявшаяся позиция: Bright Data собирала данные Meta без входа и выиграла, hiQ собирала LinkedIn со входом и проиграла. Поэтому эта карточка не просит аккаунта и не держит его.
Остальные карточки LinkedIn
Карточка на задачу, а не на сервис: профили, посты и люди вокруг них — три коллекции с тремя схемами.