fornews.ai

← L'extracteur de fornews.ai

Notre robot, à l'attention des éditeurs

Vous avez trouvé notre adresse dans vos journaux de serveur

fornews.ai est un lecteur d'actualité pour iPhone, iPad, Mac, Apple Watch et Apple TV. Chaque personne qui l'utilise y ajoute elle-même les sources qu'elle veut suivre. Il n'y a aucun serveur fornews entre votre site et elle : les requêtes partent de ses propres appareils. Cette page dit exactement ce qu'ils récupèrent, quand, avec quel agent utilisateur, et ce que l'app en fait.

Récupération automatique, et ajout d'une source

Mozilla/5.0 (compatible; fornews.ai/1.0; RSS reader; +https://fornews.ai/)

Lecture à la demande d'un utilisateur

Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/605.1.15 (KHTML, like Gecko) Version/17.0 Safari/605.1.15
Jeton de produitfornews.ai, dans le premier agent utilisateur
Origineles appareils des utilisateurs, jamais un serveur central
Appareil qui récupèrecelui que la personne a désigné pour le faire, en général un Mac ; ses autres appareils lisent la copie synchronisée par iCloud et n'interrogent pas votre site
Contactpatrick@ok-ia.ch

Ce que nous récupérons

Automatiquement, à chaque rafraîchissement

  • Votre flux RSS, Atom ou JSON Feed, à l'intervalle réglé pour la source : une heure par défaut.
  • La page de chaque article annoncé par ce flux, pour en lire le corps et l'adresse de l'image d'en-tête. Si la page n'arrive pas ou arrive tronquée, l'app réessaie, trois fois au plus.
  • Pour un message Mastodon ou Bluesky qui renvoie vers une page, la page liée.
  • Pour une source sans flux, la page indiquée par l'utilisateur, et elle seule.

Au moment où une personne ajoute votre site

  • La détection du flux : votre page d'accueil, quelques chemins usuels (/feed, /rss, /atom.xml…) et les sitemaps déclarés dans votre robots.txt. Chaque candidat est vérifié en le téléchargeant.
  • Votre logo, lu sur votre page d'accueil.

Sur un geste explicite d'un lecteur

  • Quand il ouvre un article dont le texte récupéré est trop court, l'app charge la page dans le moteur de Safari, avec l'agent utilisateur de Safari, pour obtenir ce qu'un visiteur verrait. Un article à la fois, jamais en tâche de fond. Sur un site à compteur, cette lecture compte comme celle d'un navigateur.
  • Quand il ouvre la page d'origine dans l'app pour Mac, qui l'affiche comme un navigateur.
  • Quand il cherche des compléments pour un dossier, une recherche passe par DuckDuckGo avec ses seuls termes.

Nous n'explorons pas votre site. L'app ne parcourt pas les liens de vos pages et ne se sert de vos sitemaps que pour repérer un flux, au moment de l'ajout.

Ce que l'app en fait, et ce qu'elle n'en fait pas

Oui

  • Un résumé et une détection des personnes, organisations et lieux, par l'IA d'Apple sur les appareils de la personne.
  • Le corps de l'article est effacé à la fin de ce traitement. Il n'est conservé que le temps de le mener, ou jusqu'au prochain essai s'il a échoué.
  • Quand une page est réécrite, un extrait de 200 caractères et une empreinte par version, pour repérer la modification.
  • Le titre et le résumé traduits dans la langue du lecteur.
  • Le nom de la source et le lien vers l'article d'origine, dans la liste et dans la lecture.

Non

  • Aucune republication par l'application.
  • Aucun entraînement de modèle de notre part.
  • Aucune revente de votre texte, et aucune publicité dans l'app.
  • Aucun contournement de mur payant : l'app ne lit que ce que la page livre à un visiteur.
Les images. Le corpus enregistre l'adresse de votre image, pas l'image. Pour l'afficher, l'appareil la télécharge depuis vos serveurs et la garde en cache sept jours au plus. Elle n'est ni synchronisée, ni incluse dans une exportation.
Ce que la personne peut faire de son côté. Exporter son corpus, et l'interroger depuis un assistant de son choix. Ce corpus contient les titres, les résumés, les entités et les liens. Le texte intégral des articles traités n'en fait pas partie, puisqu'il est effacé.

Ce que fornews ajoute, et qui n'est pas sur votre site

L'essentiel de ce que l'app montre ne vient pas de votre article. Il vient de ce qu'elle y ajoute, en croisant votre texte avec celui d'autres médias et avec des bases de connaissances ouvertes.

  • Les personnes, organisations et lieux identifiés. Chaque nom est rattaché à Wikidata : identifiant, libellé exact, type, et départage des homonymes. La photo et la description viennent de Wikipédia.
  • Les coordonnées géographiques des lieux et des pays, tirées de Wikidata, qui placent les articles sur une carte.
  • Les histoires. L'app regroupe les articles de plusieurs médias qui traitent du même sujet, et la personne peut y ajouter ses propres liens, documents et notes.
  • Les synthèses. Un éditorial du jour et des rapports, rédigés sur l'appareil à partir de nombreux articles de médias différents.
  • Les mesures sur le corpus. Le suivi des entités dans le temps, le décompte des mots-clés, le repérage d'une même information chez plusieurs médias.
  • La musique. Les artistes, albums et bandes originales cités sont retrouvés dans Apple Music.
Un contenu qui n'existe nulle part ailleurs. Une histoire ou une synthèse tire sa matière de la relation entre plusieurs médias. Aucune source, lue seule, ne permet de la retrouver, et chacune y figure nommée, avec le lien vers son article.
Ce qui quitte l'appareil pour cet enrichissement. Des noms d'entités, envoyés à Wikidata et à Wikipédia pour les identifier. Jamais le texte de votre article.

Comment nous bloquer aujourd'hui

Filtrez le jeton fornews.ai dans l'agent utilisateur, sur votre serveur ou votre CDN, et répondez par un refus. La récupération échoue, et l'app abandonne un article après trois essais.

Bloquer une adresse IP ne sert à rien : les requêtes viennent des appareils de nos utilisateurs, et leurs adresses changent.

Ce que ce filtre ne couvre pas. La lecture à la demande utilise l'agent utilisateur de Safari et ne porte pas notre jeton : elle se comporte comme la visite d'un lecteur, un article à la fois.
Et votre robots.txt ? Aujourd'hui, l'app ne le lit que pour y repérer un flux au moment de l'ajout. Elle n'y applique pas encore les directives d'interdiction ni de délai : c'est prévu dans la version 1.8, qui lira un groupe User-agent: fornews.ai avant le groupe générique.
Écrivez-nous. À patrick@ok-ia.ch, pour une question technique, une extraction qui abîme votre mise en page, ou une demande d'exclusion de votre domaine. Rien ne passant par un serveur, une exclusion voyage avec une mise à jour de l'app ; le mécanisme arrive avec la version 1.8.

fornews.ai

← The fornews.ai extractor

Our fetcher, for publishers

You found our address in your server logs

fornews.ai is a news reader for iPhone, iPad, Mac, Apple Watch and Apple TV. Every person using it adds the sources they want to follow themselves. There is no fornews server between your site and them: requests leave from their own devices. This page states exactly what those devices fetch, when, with which user agent, and what the app does with it.

Automatic fetching, and adding a source

Mozilla/5.0 (compatible; fornews.ai/1.0; RSS reader; +https://fornews.ai/)

Reading on a user's request

Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/605.1.15 (KHTML, like Gecko) Version/17.0 Safari/605.1.15
Product tokenfornews.ai, in the first user agent
Originthe users' own devices, never a central server
Fetching devicethe one the person chose for it, usually a Mac; their other devices read the copy synced through iCloud and never contact your site
Contactpatrick@ok-ia.ch

What we fetch

Automatically, on every refresh

  • Your feed, RSS, Atom or JSON Feed, at the interval set for the source: one hour by default.
  • The page of each article your feed announces, to read its body and the address of its header image. If the page fails or arrives truncated, the app retries, three times at most.
  • For a Mastodon or Bluesky post linking to a page, the linked page.
  • For a source without a feed, the page the user entered, and that page only.

When someone adds your site

  • Feed detection: your home page, a few usual paths (/feed, /rss, /atom.xml…) and the sitemaps declared in your robots.txt. Each candidate is checked by downloading it.
  • Your logo, read from your home page.

On an explicit reader action

  • When they open an article whose fetched text is too short, the app loads the page in Safari's engine, with Safari's user agent, to get what a visitor would see. One article at a time, never in the background. On a metered site, this read counts like a browser's.
  • When they open the original page in the Mac app, which shows it like a browser.
  • When they look for more material for a dossier, a search goes through DuckDuckGo with their own terms only.

We do not crawl your site. The app does not follow the links in your pages, and uses your sitemaps only to locate a feed, when the source is added.

What the app does with it, and what it doesn't

Yes

  • A summary and detection of people, organisations and places, by Apple's AI on the person's own devices.
  • The article body is deleted once that processing ends. It is kept only while processing runs, or until the next attempt if it failed.
  • When a page is rewritten, a 200-character excerpt and a fingerprint per version, to spot the change.
  • The title and summary translated into the reader's language.
  • The source name and the link to the original article, in the list and in the reading view.

No

  • No republication by the application.
  • No model training on our part.
  • No resale of your text, and no advertising in the app.
  • No bypassing of a paywall: the app reads only what the page delivers to a visitor.
Images. The corpus stores the address of your image, not the image. To display it, the device downloads it from your servers and caches it for seven days at most. It is neither synced nor included in any export.
What the person can do on their side. Export their corpus, and query it from an assistant of their choice. That corpus holds titles, summaries, entities and links. The full text of processed articles is not part of it, since it has been deleted.

What fornews adds, and what is not on your site

Most of what the app shows does not come from your article. It comes from what the app adds to it, by cross-referencing your text with other outlets and with open knowledge bases.

  • Identified people, organisations and places. Each name is linked to Wikidata: identifier, exact label, type, and disambiguation between namesakes. The photo and the description come from Wikipedia.
  • Geographic coordinates of places and countries, taken from Wikidata, which put articles on a map.
  • Stories. The app groups articles from several outlets covering the same subject, and the person can add their own links, documents and notes.
  • Syntheses. A daily editorial and reports, written on the device from many articles by different outlets.
  • Measurements across the corpus. Tracking entities over time, counting keywords, spotting the same information across several outlets.
  • Music. Artists, albums and soundtracks mentioned are found in Apple Music.
Content that exists nowhere else. A story or a synthesis draws its substance from the relationship between several outlets. No single source, read on its own, leads back to it, and each one appears in it by name, with the link to its article.
What leaves the device for this enrichment. Entity names, sent to Wikidata and Wikipedia to identify them. Never the text of your article.

How to block us today

Filter the fornews.ai token in the user agent, on your server or your CDN, and refuse the request. Fetching fails, and the app gives up on an article after three attempts.

Blocking an IP address does not help: requests come from our users' devices, and their addresses change.

What this filter does not cover. Reading on request uses Safari's user agent and carries no token of ours: it behaves like a reader's visit, one article at a time.
And your robots.txt? Today the app reads it only to locate a feed when the source is added. It does not yet apply its disallow or delay directives: that is planned for version 1.8, which will read a User-agent: fornews.ai group before the generic one.
Write to us. At patrick@ok-ia.ch, for a technical question, an extraction that mangles your layout, or a request to exclude your domain. Since nothing goes through a server, an exclusion travels with an app update; the mechanism arrives with version 1.8.