Aller au menu du forum Aller au contenu du forum Aller à la recherche dans le forum
Logo Khaganat
Menu principal
Menu

Voir les contributions

Cette section vous permet de consulter les contributions (messages, sujets et fichiers joints) d'un utilisateur. Vous ne pourrez voir que les contributions des zones auxquelles vous avez accès.

Voir les contributions Menu

Messages - pulkomandy

30 Juin 2026 à 09:52:35
Cliquez pour afficher le message
Salut!

Je peux donner quelques infos sur ce que je fais chez moi.

0. Les bases

- Pour Google, Bing et les moteurs de recherche classique: j'ai configuré un "Crawl-Delay" dans le fichier robots.txt. Cela leur demande de ne pas faire plus d'une requête toutes les quelques secondes (on choisit combien) et réduit leur traffic de façon acceptable. C'est bien respecté par les crawlers des moteurs de recherche.
- Pour les scrappers "honnêtes" (bot SEO par exemple, mais certains trucs de LLM aussi): blocage par une liste d'identifiants de bots dans le robots.txt avec une règle "Disallow /"

Là on a les bases pour les trucs implémentés correctement. Ensuite il faut lutter contre les trucs malveillants et/ou mal fichus.

1. Blocage des bots ne respectant pas le robots.txt

Dans mon robots.txt j'ai mis un Disallow /url-interdite.
L'URL en question est également présente dans les en-têtes ou en bas de page de mon site, avec un texte disant "si vous êtes un humain, ne cliquez pas ici vous allez vous faire bannir". Le lien est également en nofollow.

Si un bot accède à cette URL, c'est blocage direct.

Pour implémenter le blocage: règle spécifique dans le serveur web, qui retourne une erreur spécifique (j'ai choisi le code HTTP 429). J'ai ensuite une règle fail2ban qui scanne les logs de mon serveur HTTP pour trouver ces erreurs 429 et bloquer les IP correspondantes au niveau du pare-feu. Le même principe est utilisé dans les sections suivantes.

On peut aussi faire la même chose pour plein d'URLs "classiques" utilisés par des scanners de vulérabilités qui cherchent des wordpress, phpmyadmin, et autres nids à failles connus.

2. Filtrage par user agent

Pour certains bots ne respectant pas le robots.txt (typiquement, ne respectant pas le crawl-delay), mais qui s'identifient avec un user agent unique, filtrage des user agents "interdits" au niveau du serveur web.

3. Les bots "cachés"

Comme je ne suis pas le seul à mettre en place ce genre de mesures, il y a maintenant des bots qui se déclarent avec un user agent "classique" (typiquement une version de Chrome, mais il commence à y avoir aussi du Firefox). On peut tenter de bloquer les IPs "non résidentielles" quand on repère une plage d'IP (il y a eu Tencent et Alibaba il me semble, mais il y en a de nouvelles régulièrement).

Là, on peut au choix bannir ces IPs "préventivement" de façon statique dans le pare-feu, ou bien attendre la première requête sur le serveur web pour réagir.

4. Les proxys résidentiels

C'est la dernière nouveauté. Comme les IPs de datacenters sont de plus en plus mal vues par les sites internets, les robots utilisent maintenant des relais déployés via des applications sur des téléphones ou des télés connectées chez plein de gens.

J'ai lu un blog de quelqu'un indiquant que son site avait reçu des requêtes venant de un quart de l'espace d'addresage IP. En gros, quasiment toutes les IP possibles vont être utilisées, et ça devient très difficile de faire un blocage par IP (même les pare-feus ne suivent plus: il y a tellement d'IPs qu'il faut plusieurs Go de mémoire juste pour stocker la liste des IP bloquées...). Et chaque IP ne va typiquement faire qu'une seule requête, donc le blocage est peu efficace si on attend d'avoir plusieurs requêtes avant de bloquer.

Le blocage géographique peut être une solution (si vous acceptez de restreindre l'accès pour certains pays, mais il risque d'y en avoir de plus en plus tant qu'il n'y aura pas de législation pour interdire ces pratiques).

Chez moi, j'ai fini par bloquer toutes les versions un peu anciennes de Chrome et Firefox pour Windows. Comme ces robots ont tendance à utiliser des user agents ne correspondant pas à la toute dernière version, ça limite assez les problèmes. Et les gens utilisant un autre OS ou un autre navigateur ne sont pas impactés.

5. Pourquoi ces attaques?

Ce que j'observe, c'est que les interfaces web de dépôts git comportent une quasi infinité de liens (historique des versions, puis affichage de chaque fichier dans chaque version, etc). C'est le "tarpit" parfait pour un robot scrapper d'entraînement LLM, tout plein de contenu à lire!

Je pense qu'avec un site comportant moins de liens, il y a moins de problèmes, le robot va rapidement en faire le tour et aller voir ailleurs.

Dans certains cas j'ai fini par mettre mon interface web de dépôt Git accessible uniquement après login.

6. Conclusion

Je vous donne volontairement peu de détails spécifiques sur ma configuration.

Le déploiement de solutions "universelles" (Anubis, iocaine, ou de façon générale une config standardisée avec une liste de user agent connue) pousse les développeurs de bots à trouver un contournement spécifique pour la solution la plus populaire. Le seul moyen de leur rendre la vie impossible, c'est que chaque site web aie ses propres règles. Donc, adapter votre configuration à ce que vous observez est la bonne démarche. Et aussi choisir vos propres durées de ban, pour pas que tout le monde aie la même.

J'arrive à garder le traffic à un niveau acceptable chez moi (pour un serveur auto hébergé sur ma connexion fibre à la maison, sans que ça pénalise les autres utilisations du serveur et de la connexion internet), mais régulièrement (tous les quelques mois) je dois mettre à jour ma liste de bans suite à un nouvel user agent ou une nouvelle forme d'attaque. Donc il faut garder un oeuil sur les accès au serveur web, c'est pas vraiment un truc qu'on peut configurer une fois et laisser tourner tout seul :(

7. Bonus: le monitoring.

J'utilisais awstats pour surveiller le traffic sur mon site. ça marchait bien pour repérer les pics de traffic et autres trucs louches. Mais awstats sur mon serveur n'arrive plus à suivre quand il y a des millions de requêtes à scanner dans les logs.

Je l'ai remplacé par goaccess, il est moins bien, mais plus rapide.

Bon courage!
04 Juin 2026 à 22:43:20
Cliquez pour afficher le message
Bon c'était pas assez long, j'en rajoute...

Je relis le pad.

Les trucs qui m'embêtent sont dans la première partie 'Charte "(non)-usage de l'IA"' dont je ne sais pas ce qu'elle va devenir (à jeter? article de blog explicatif pour la charte?). Dans la deuxième version "Rapport aux LLM et à l'IA au sein de Khaganat" je pense que ces remarques sont déjà prises en compte.

CitationLes LLM favorisent la productivité

D'une part, la productivité ce n'est pas forcément un but. D'autre part, l'augmentation de la productivité effective par les LLMs, ça reste à prouver. Dans le développement de code, il semble pour l'instant que ça permet d'écrire et de modifier beaucoup plus de lignes de code beaucoup plus vite, mais finalement pas de créer plus rapidement des nouvelles fonctionnalités. Ce qu'on gagne en temps de développement initial, on le perd en relecture de code ou en debogage des problèmes qui surviennent par la suite.

CitationMalheureusement, pour beaucoup ces alternatives n'existent pas vraiment (noyau Linux, Blender, etc.), il nous faudra donc exprimer pourquoi nous déplorons leur positionnement éthique.

Je suis OK sur le principe mais très embêté par l'affirmation non etayée qu'il n'y a pas d'alternative à Linux et à Blender. Je dirais qu'on peut simplement enlever cette parenthèse de la phrase, et qu'il faudra faire un document séparé pour l'analyse des alternatives existantes et de pourquoi elles ne sont pas satisfaisantes.

04 Juin 2026 à 22:28:59
Cliquez pour afficher le message
Bon je vais essayer de faire court (euh... c'est raté...). Je ne participe pas beaucoup à Khaganat par ailleurs, donc ça m'embête un peu de prendre plus que ma part dans cette discussion. La décision à la fin reviendra aux gens qui font vraiment des trucs, et pas à moi qui ne suit que visiteur, en gros. Du coup, je suis OK si tout le monde n'a pas envie de prendre le temps de me lire.


Je précise un peu les choses sur les chapitres 3.1 et 3.2. J'ai pris l'exemple de Haiku pour le 3.1 parce que ça me concerne un peu personellement. Mais c'était juste un exemple et effectivement Haiku n'est probablement pas prêt pour Khaganat (pas d'accélération 3D, drivers son pas tout à fait au point, et plein d'autres problèmes qui finissent par transformer n'importe qui qui essaie d'utiliser Haiku en développeur de système d'exploitation).

Le point était juste que Haiku (ou les systèmes BSD, ou d'autres) n'ont même pas été envisagés sérieusement, même si c'est pour les rejeter.

Vu tous les problèmes (principalement écologiques pour moi, mais chacune peut prendre les problèmes qui l'embêtent le plus) avec les LLM, je pense que ces deux règles devraient avoir une contrainte de justification. C'est à dire, chaque fois qu'il y a utilisation d'un projet qui utilise des LLM, il faudrait une page de wiki expliquant pourquoi les alternatives ne sont pas adaptées (pour le 3.1) ou ont échoué (pour le 3.2). Ça force au moins à vraiment se poser la question.

Bon, c'est du travail en plus. Mais ça permettrait au moins de savoir où on en est, et pour les gens qui tiennent absolument à rendre possible un monde sans LLM, de savoir à quels projets s'attaquer en priorité pour construire des alternatives acceptables.


Deuxième point, je vois deux choses un peu différentes: l'utilisation de LLM par les contributeurs du projet, et par des contributeurs externes (par exemple quelqu'un qui sortirait de nulle part avec une liste de failles de sécurité). Dans ce deuxième cas, il y a effectivement un risque de "flood" et d'être submergé par des propositions de mauvaise qualité.
Ça demande de mettre en place de quoi pouvoir dire non à ces contributions, même si c'est appliqué sélectivement (de ce point de vue là, ça n'empêcherait pas d'accepter les contributions de qualités mais faites avec l'aide d'un LLM).

Il y a en fait deux questions là dedans: mettre en place des protections pour ne pas se faire submerger, c'est la moindre des choses. Mais il y a l'autre question qui est de savoir si on veut rejeter en bloc les LLM, par principe, et même si les contributions sont de bonne qualité (pour des raisons écologiques, sociétales, et tout ce qui concerne surtout l'impact des LLMs en dehors du contenu qu'ils génèrent, plutôt que pour le contenu généré en lui-même). Là c'est un vrai choix qui est beaucoup plus sujet à débat. Surtout que on sait très bien que une telle interdiction serait essentiellement symbolique (c'est pas Khaganat qui va utiliser des milliards de tokens d'IA et justifier à lui tout seul la construction de nouveaux datacenters).

CitationCe serait aussi peut-être une solution pour briser l'isolement de certaines contributrices. Si je vous dit que j'utilise un LLM ces temps pour avancer sur ce foutu transfert de serveur mail, non pas tant pour les aspects techniques, mais pour juste me sentir moins seule face à la montagne, est-ce que vous allez me faire des pamjais sur krypte et me dire que la personnalisation du footer de postfixadmin est sans intérêt ? Parce que je trouverais ça tellement plus satisfaisant.

Dans ce cas je crois qu'on peut dire que l'utilisation de LLM n'est pas le problème, et qu'il y a un échec collectif qui remonte bien avant pour en arriver là.

Je connecte ça à autre chose d'un peu similaire: il y a des gens qui passent un temps conséquent sur les réseaux sociaux addictifs (TikTok, Instagram, Youtube, ou devant la télé). Cela empêche l'ennui, qui n'est pas un truc agréable, mais qui normalement pousse les gens à se bouger et à faire quelque chose de leur temps. Sans l'ennui, on resterait tous dans notre lit toute la journée à regarder le plafond.

Donc, l'utilisation de LLM contourne la solitude un peu comme les réseaux sociaux contournent l'ennui. Mais ça règle pas le problème et ça peut empirer les choses. Ça rejoint ce que je disais plus tôt sur mes craintes que les LLMs mettent un peu fin aux interactions entre les gens. Plus besoin pour un introverti comme moi d'aller parler aux gens si je peux avoir une réponse d'un LLM. Donc oui, individuellement, ça permet de fonctionner, mais clairement ça ne règle pas le problème... Cela dit, c'est vrai aussi que dans cette réflexion j'envisage aussi d'autres usages des LLMs qui n'ont rien à voir avec Khaganat (par exemple, Google qui prévoit de ne plus mettre de liens vers des sites web dans ses résultats de recherche).


Je lance aussi un autre sujet maintenant que je suis là. Sur le forum de Haiku nous avons fait le choix d'autoriser les gens faisant du "vibe coding" à parler de ce qu'ils font. Je recommande pas: ça donne des sujets de forum avec des avancées très rapides pour le développement d'applications, souvent pour des trucs qui existent déjà par ailleurs, et qui vont très probablement finir par être abandonnés. Faire les choses à la main, c'est plus long et plus difficile, mais ça encourage à suivre les projets sur la durée. Parfois ça me donne l'impression qu'on compare mon petit potager avec quelques légumes et un grand étal de supermarché avec énormément de choix de légumes sans goût et plein de pesticides. Et, forcément, d'un certain point de vue, je peux pas lutter. Dans ces conditions il faut vraiment être prêt à assumer la décroissance...
27 Mai 2026 à 08:54:00
Cliquez pour afficher le message
CitationJe clos ces sujets, pour ma part, et je me recentre sur l'IA.

À mon avis, c'est une erreur.

Soit il y a des solutions à ces problèmes, c'est-à-dire qu'il existe un LLM ne dépendant pas d'un grand groupe américain, et qui fait une utilisation raisonnable des resources (eau, électricité, etc). Auquel cas on peut discuter des aspects techniques. Soit il n'y a pas, et il faut, pour moi, d'abord régler ce problème avant de discuter des autres.

CitationEtant donnée, que la base pour entraîner provient de tout le monde (avec ou sans consentement ...), pour un projet OpenSource, cela me semble pertinent de l'utiliser.

En temps que développeur de logiciel open source, je ne partage pas mon code sans consentement. Il y a une license qui demande de citer le nom de l'auteur. Je m'attends aussi à ce que les visiteurs de mon site web (humains ou robots, peu importe) en fasse une utilisation raisonable et efficace. C'est indiqué sur mon site par exemple de ne pas faire de mirroir complet par HTTP pour les parties comportant beaucoup de fichiers, et de me contacter pour avoir une solution plus efficace (mirroir rsync par exemple). Ce que les humains font en général, mais que les LLM ne font pas, saturant ainsi mon serveur.

Certes, pour le logiciel que j'écrit, je ne demande pas grand chose en retour. C'est souvent sous license MIT, et donc, le seul truc, c'est de m'attribuer la paternité du code et de garder la license qui autorise à repartager ce code. Avec un LLM qui serait entraîné sur du code que j'ai écrit et qui en régurgite une partie, ça ne sera pas le cas. Et même si c'est plus indirect, que le code ne ressemble pas tout à fait au mien, peu importe. Un des trucs qui me fait plaisir c'est de recevoir de temps en temps sur mon site web des messages de gens que j'ai pu dépanner grâce à un de mes articles (par exemple sur un composant électronique relativement obscur). Si ils ont obtenu leur réponse à travers un LLM? Fini, on peut oublier ce genre d'interaction.

Citationmais on ne peut pas arrêter les avancées. Doit-on refuser sous peine d'être dépassé par celle-ci et par ceux qui les utilises ?

Oui.

Et c'est justement maintenant qu'il faut le faire, avant que tout le monde soit effectivement devenu dépendant. Comme on peut l'être au fait de se déplacer en voiture par exemple, alors qu'on aurait très bien pu faire d'autres choix, mais pour ça il aurait fallu réagir il y a 50 ans, maintenant ça va prendre 50 ans de plus à déconstruire.

Et oui, je pense aussi qu'avoir des enfants n'est pas écologique. Avez-vous entendu parler du mouvement pour l'extinction volontaire de l'humanité? Par contre, dans ce cas là je ne suis pas aussi directement impacté, et donc, je ne vais pas vous dire quoi faire avec vos choix de vie respectifs!
22 Mai 2026 à 20:08:48
Cliquez pour afficher le message
Tiens par exemple: personne ne conteste le point 3.1 de la proposition, comme quoi il y aurait des outils (le noyau Linux par exemple) qui seraient irremplaçables malgré que leurs développeurs choisissent d'utiliser des LLM de façon plus ou moins importante.

Chacune met ses limites où elle veut et parfois où elle peut. Parce que si on décide que la première étape de Khaganat c'est de remplacer Linux (mettons par un système BSD pour les serveurs), de remplacer Blender, de remplacer les binutils qui sont nécessaires pour compiler pas mal de trucs et ben... c'est plus du tout le même projet.

(Je mentionne pour ceux qui ne savent pas, que je contribue beaucoup à Haiku, qui pourrait se positionner comme un concurrent de Linux entre autres choses, et n'a pas recours aux LLM. Je comprend tout à fait que Haiku ne soit pas considéré suffisament mûr pour les besoins de Khaganat pour la partie client où il serait éventuellement utilisable, mais ça me chagrine un peu que ce soit balayé de façon assez expéditive comme un "pas d'alternative" sans avoir creusé la question plus que ça. Mais là je fais du lobbying pour mes propres intérêts et je comprend tout à fait que ça n'emballe pas tout le monde de se lancer là dedans.)

Du coup, l'argument "il y a une exception limitée à l'utilisation des LLMs, et donc autant tout autoriser" ne tient pas vraiment. Il y a forcément un compromis à faire, le tout est de choisir où on place la limite. Et même si l'objectif est "le plus loin possible", ça ne sera de toutes façons jamais parfait (enfin, à moins de tout abandonner, ce qui n'est pas vraiment une solution intéressante pour l'instant, je pense).
22 Mai 2026 à 10:07:03
Cliquez pour afficher le message
Zatalyz a mentionné ça dans le chat il me semble: l'exemple était l'utilisation d'un LLM pour répondre à des questions techniques (sur de la configuration de serveur de mail par exemple), là ou aucun humain n'est disponible ou n'a les compétences ou le temps de répondre.
Cliquez pour afficher le message
Le contrat d'engagement républicain n'est pas nécessaire pour être une association d'intérêt général. Cela concerne plutôt les associations cherchant à obtenir un agrément (https://associations.gouv.fr/agrements): jeunesse, sports, éducation populaire, défense des consommateurs, etc. Cela est surtout intéressant pour certaines demandes de subventions, mais pas pour la défiscalisation des dons.  Et je ne suis pas certain que Khaganat corresponde à une des catégories d'agréments existantes.

Il existe également encore un autre statut "reconnu d'utilité publique" qui a encore d'autres contraintes et une vraie vérification par l'administration publique, mais là aussi ça ne semble pas nécessaire de se lancer là dedans. Les trois trucs (intérêt général, agrément et reconnaissance d'utilité publique) sont souvent un peu confondus par les gens (y compris dans le titre de ce fil de forum: "reconnu d'intérêt général", ça n'existe pas, c'est "association d'intérèt général" tout court car il n'y a pas besoin d'un processus de reconnaissance/vérification). Mais peut-être c'est pas le point le plus important de la discussion  :smiley2:
30 Avril 2026 à 15:12:37
Cliquez pour afficher le message
Pour les aspects "WIP" ou exploratoires:

ça dépend quelles sont les raisons qui font que on est contre l'IA.

Si c'est pour des raisons écologiques (la consommation électrique et en eau de tous les datacenters), par exemple, l'usage final ou exploratoire ne change rien du tout. Si c'est pour des raisons politiques, je crois que c'est pareil.

Si par contre c'est un débat sur la qualité des trucs générés, la discussion est différente. Mais comme je l'indiquais dans mon message, pour moi (c'est mon opinion personnelle, là) le débat ne devrait même pas arriver jusque là. ça remet les choses dans un cadre de type "c'est juste un outil comme un autre" et ça évacue donc les questions qui me semblent les plus importantes (pour moi: la consommation d'eau et d'électricité/émission de CO2 en premier, et la centralisation des LLM autout de quelques modèles fermés avec le projet politique qui va derrière).


Ensuite tu évoques un deuxième aspect qui est qu'une interdiction n'est pas forcément facile à mettre en place. Je pense que personne n'a envie de faire la police là dessus. J'ai un peu d'expérience là-dessus chez Haiku ou nous avons interdit le code généré par LLM (pour des raisons uniquement de droit d'auteur, car c'était la raison la plus facile pour avoir un concensus de l'équipe décisionnaire là-bas). Ça a l'air de fonctionner: il y a de gens qui ne se cachent pas d'utiliser des LLM, qui corrigent des bugs dans leur coin, mais qui ne nous ont pas envoyé leurs contributions pour qu'on les intègre. Le fait d'envoyer un message clair sur notre position fait déjà beaucoup et fait que les gens savent à quoi s'en tenir. Finalement, même si la règle ne peut jamais être appliquée strictement, c'est déjà très bien. On a  le même problème avec la gestion des licences, il arrive parfois que des gens intègre du code sous license GPL par erreur. Nous avons toujours pu trouver des solutions, soit en demandant des exceptions de licence aux développeurs concernés, soit en remplaçant le code lorsque les problèmes sont identifiés.

Là je parle surtout de code, c'est le domaine que je connaît mieux.

Ici aussi les compromis sont différents selon les raisons qui poussent à rejeter les contributions par LLM. Si c'est pour des craintes sur le droit d'auteur, il faut une application assez stricte. Si c'est la peur d'être innondées de contributions générées mal fichues, il suffit probablement de traiter les cas les plus évidents ou aucun effort humain n'a été fait. Si c'est pour des raison politiques, il faut accepter que le projet affiche une orientation politique à ce sujet et soit prêt à la défendre (dans la mesure de ses moyens). Et cette orientation peut aussi être extrême ou nuancée.


Enfin pour le scrapping: j'ai pris cet exemple parce que c'est ce qui m'impacte le plus directement. Mais en fait le propos est beaucoup plus général. Pour chaque prompt envoyé à un LLM, derrière il y a non seulement des ressources matérielles (électricité, eau, on en a déjà parlé) mais en fait il y a aussi des gens qui travaillent. Que ce soit pour garder l'internet en état de marche et les sites accessibles, mais aussi pour produire des données d'entraînement de qualité, et encore derrière des gens qui font de la classification de données, de l'entraînement de modèles, etc. Une grande partie de tout ça est très peu ou pas du tout valorisée, et le LLM permet d'oublier et d'invisibiliser toutes ces personnes. C'est une forme d'exploitation d'humains, rendue acceptable par une jolie interface facile à utiliser. On retrouve là un motif de la vente en ligne façon Amazon, des Uber et autres. On te fait coire que c'est de la technologie qui travaille pour toi, mais en fait il y a des humains derrière. On fait en sorte que tu ne communiques pas avec eux comme ça ils peuvent pas se plaindre. Je n'ai pas envie que mes contributions et le temps que je passe à faire des trucs avec des ordinateurs serve à ça. Même dans le cas bizarre où au final, l'humain à l'autre bout du truc, c'est moi qui essaie de régler les problèmes de scrapping sur mon serveur.

Ceci étant dit, difficile d'échapper à tout ça sans faire des compromis difficiles comme abandonner certains logiciels. Finalement, le choix est là. Effectivement, parfois ce sera la réponse réaliste mais difficile à avaler. Parfois ce sera la position militante, active ou juste de principe. Parfois on a juste pas les moyens de lutter face à un truc aussi gros. Je sais déjà que je n'ai pas envie de contribuer à des projets utilisant ces outils. Je suis embêté quand il s'agit de choses dans lesquelles j'ai investi beaucoup de temps (dans mon cas le plus gros exemple c'est WebKit, dont je maintiens une version pour Haiku depuis plus de 10 ans). Je ne suis pas sûr de vouloir prendre une position plus extrême ou je refuse même d'utiliser des logiciels développés avec l'aide de LLM (de la même façon que j'utilise des logiciels non libres et qu'il m'arrive même d'en écrire aussi).

Et donc, n'ayant pas de position pour moi-même sur ce point, je me garderais bien de donner un avis précis sur les limites à mettre au sein de Khaganat. Je crois que pour moi ce qui est important, c'est que la question soit débattue sous cet angle là, plutôt que sur, par exemple, la qualité du travail produit par les LLM ou avec leur aide.
30 Avril 2026 à 10:58:13
Cliquez pour afficher le message
Bonjour,

Je ne suis le projet que de loin, donc mon avis personnel vaut ce qu'il vaut.

Je vois qu'il y a 2 problématiques qui se dégagent:

- D'un côté l'utilisation de LLM dans le projet (que ce soit pour générer des images, du code, ou quoi que ce soit d'autre): Inkscape fait en effet un assez bon résumé de la situation. C'est néfaste éthiquement et politiquement, c'est généralement mauvais à moyen techniquement, et je peux ajouter que accepter les contributions générées par des LLM, c'est s'exposer à une grande quantité de contributions mal fichues qui vont demander plus de travail pour mettre les choses "au propre" que de faire directement les choses soi-même. Mais en fait le débat sur cette dernière question me semble un peu inutile: les raisons éthiques et politiques sont, comme vv l'a indiqué, largement suffisantes pour rejeter le truc, pas la peine d'aller plus loin, même si ça donnait de bons résultats ce serait quand même une mauvaise idée.

- D'un autre côté, il y a les dépendances à d'autres projets. Et là, on est déjà dans une situation plus difficile. Blender et Linux ont été mentionnés, mais il y a tout un ensemble d'autres outils, pas tous facilement remplaçables (à moins de rester bloqué sur des anciennes versions?). C'est là que il y a un vrai problème à résoudre: soit accepter la situation de façon générale et continuer à autoriser ces outils, soit seulement certains après avoir confirmé qu'il n'y a pas d'alternative, soit aucun quitte à mettre beaucoup d'énergie pour trouver ou construire un remplacement. C'est une question qui se pose aussi quand il s'agit de choisir un logiciel libre vs un propriétaire, ou un protocole ouvert vs un qui est maintenu par une seule entreprise.

Et c'est là que je ne m'estime pas pertinent pour intervenir puisque je n'ai pas les mains dans les projets correspondants. Peut-on remplacer Blender ou Godot par autre chose? Aucune idée. Est-ce que Linux doit rester parmi les systèmes d'exploitation sur lesquels le client peut fonctionner? Même question pour Windows? Quel compromis êtes-vous prêts à faire?

Personnellement, j'échappe à peu près à ces problèmes pour l'instant. Je suis cependant exposé (pour l'hébergement de ma forge logicielle personelle) à un traffic très important de bots qui scannent tout n'importe comment et qui sont au moins en partie lié à l'entraînement et l'utilisation de LLM. Cela me consomme un peu de temps et d'énergie pour maintenir ce serveur en ligne. Je dois également questionner certains des logiciels que j'utilise et auxquels je contribue, et peut-être jeter des dizaines d'année de travail (par exemple sur le moteur de rendu web WebKit, dans lequel l'utilisation de code généré par LLM semble admise maintenant). Je ne sais pas encore ce que je vais faire. Je suis intéressé de lire une discussion sur ce sujet, en tout cas.
17 Janvier 2022 à 12:02:43
Cliquez pour afficher le message
Bonjour,

Je me permet de déterrer ce sujet car j'ai découvert l'existence de https://weeksauce.io/ qui semble correspondre à au moins une partie des critères: il s'agit d'un gamejam où on ne s'attend pas à ce que les genssoient disponible de façon continue pendant 72h.

Ça semble donc possiblement intéressant!
05 Octobre 2020 à 15:37:51
Cliquez pour afficher le message
Bonjour,

Je peux apporter mon avis sur quelques points.

Déjà sur le montant du salaire. 2600€ net, c'est à peu près mon salaire actuel. Je pense que c'est beaucoup trop. Bon, peut être que je suis assez minimaliste dans mon style de vie, mais en tout cas, c'est plus que largement suffisant pour mes besoins. Après, ça dépend de l'objectif: s'agit-il de débaucher des gens ayant un emploi "normal" actuellement en leur permettant de conserver leur niveau de vie, quel qu'il soit, ou bien de juste permettre aux gens de passer du temps sur Khaganat dans de bonnes conditions? Est-ce que en plus du salaire, il faut fournir du matériel (informatique, logiciels, ...) ou bien on considère que c'est inclus dans la rémunération, et aux gens de se débrouiller avec pour acheter ce dont ils ont besoin?

Sur le statut, ensuite. Je ne comprend pas pourquoi il faudrait remettre en question le statut actuel. Une association avec des salariées, ça existe et ça ne pose pas problème, a priori. Le seul truc auquel il faut faire attention, c'est le fameux "but non lucratif", mais je ne pense pas que ça soit si contraignant que ça. Par exemple, j'ai été quelque temps dans le bureau d'une association gérant une école de musique et de danse, avec 10 salariées (des profs) et qui vendait des heures de cours (de musique ou de danse, donc) à ses adhérents. Le "but non lucratif", ça veut juste dire que le budget doit être voté à l'équilibre chaque année (cet équilibre pouvant comprendre une partie "on met des sous de côté pour plus tard") et que les bénéfices ne peuvent pas être reversés aux adhérents (contrairement aux associés d'une société ou aux sociétaires d'une coopérative). Ça me semble assez en ligne avec l'objectif. Bref, tout ça pour dire que c'est un sujet qui me semble assez indépendant: on peut mettre en place une rémunération sans changer de statut juridique. De plus, les démarches pour les associations sont pas mal simplifiées et on peut se passer d'un expert comptable, en particulier avec le Chèque Emploi Associatif qui facilite la rédaction des bulletins de paie (même si ça reste relativement pénible à faire).

Enfin, en tant que personne qui ai été rémunérée à plein temps pour travailler sur un projet de logiciel libre (c'était pour Haiku en 2014). Je peux exposer ce qui était fait chez Haiku, pas nécessairement comme un exemple à suivre, mais pour avoir une idée d'une façon de faire. Qui a ses avantages, ses inconvénients, et peut très bien ne pas vous convenir.

Donc, chez Haiku, le modèle choisi est plutôt celui d'un taux horaire. Il était fixé à 12.5€/heure, brut, soit environ 2000€ par mois (histoire de pas compter les minutes, on fait des mois de 4 semaines et des semaines de 40 heures, même si le temps effectivement passé en pratique peut être en dessous ou parfois au-dessus). Dit autrement, 100€ par jour en travaillant 5 jours par semaine. À vous de décider si c'est suffisant ou pas (je pense que c'est un peu bas, mais il faut voir, s'il y a des congés payés par exemple ça joue pas mal sur le résultat puisque ça fait plus de 10% du temps payé pour ne pas travailler).

Dans mon cas, j'étais en auto-entreprise, principalement pour la raison que Haiku est une association américaine et que c'était plus simple de leur facturer les choses en tant qu'entreprise, plutôt que d'être salarié. Ça me permettait de cotiser pour la sécurité sociale en France, tout ça. Je pense que vous n'aurez pas trop ce problème, donc un contrat de travail classique est envisageable.

La rémunération au nombre d'heures passé (ou, disons à la demi journée près) m'a permis de cumuler mon travail chez Haiku avec d'autres choses. Et donc certains mois Haiku ne payait que la moitié de mon revenu, le reste provenant d'autres missions. Ce qui a permis de faire durer le contrat pendant un an malgré des finances un peu limitées et pas suffisantes pour me payer à plein temps. C'est donc au moins un bon compromis pour démarrer les choses en attendant d'être en mesure de faire un plein temps (après il faut que ça soit pour quelqu'un qui aie envie de travailler sur plusieurs projets à la fois, ça ne convient pas à tout le monde). Un avantage et que si ça ne marche pas trop, l'autre demi-emploi fait qu'on ne se retrouve pas complètement sans revenu.

Personnellement, dans ma situation actuelle ou j'ai un travail à plein temps, le truc principal qui me freine pour me lancer dans ce genre de chose, c'est l'incertitude. Je préfère un revenu un peu plus faible (mais suffisant pour me permettre d'avoir un logement et de quoi manger, quand même) si je suis certain qu'il sera stable sur la durée (genre plusieurs années). Ceci parce que je n'aime pas enchaîner les recherches d'emploi et que j'aime bien les choses qui ne changent pas.

Enfin, il faut effectivement se poser la question de la nature du contrat (CDD, CDI?) et des droits des salariés (il va falloir se rattacher à une convention collective en fonction de l'activité de l'association) ce qui va aussi donner des limites (hautes et basses) aux salaires qu'on peut proposer, en fonction du poste occupé par les employés. Les conventions sont plus ou moins contraignantes sur tout un tas de points. Par exemple dans le cas de l'école de musique et danse mentionnée précédemment, il s'agit de la convention "animation", qui arrange les choses pour que les profs de musique ne travaillent pas pendant les vacances scolaires, fixe le préavis de licenciement/démission à 2 mois, définit le montant des primes de fin de contrat (licenciement, retraite, démission, ...), oblige à avoir une augmentation du salaire en fonction de l'ancienneté dans l'entreprise et dans la "branche" (donc une partie de l'ancienneté est conservée lors d'un changement d'employeur). Ça limite les possibilités pour éclater le système de classes, malheureusement! Il faudra donc se renseigner sur la convention collective appropriée pour ce qu'on souhaite faire. Après, en pratique, les entreprises et les salariés n'hésitent pas à ignorer les parties des conventions collectives qui ne leur conviennent pas, c'est envisageable (quoi que probablement illégal) si il y a confiance mutuelle entre l'employeur et l'employé pour ne pas porter plainte l'un contre l'autre à ce sujet.
Cliquez pour afficher le message
Pour les flux rss, c'est clairement mort maintenant que tous les navigateurs web ont viré leur support. À une époque ça marchait vraiment pas mal, l'icône était visible et en deux clics tu pouvait t'abonner. On a perdu cette intégration et malheureusement on ne peut pas y faire grand chose.


Pour le choix des canaux, ça a l'air de bien fonctionner actuellement. Avoir des règles floues pour savoir quel canal utiliser à quel moment est plutôt un bon point, parce que comme ça on peut jamais vraiment se tromper. Le canal Kom est prévu pour les trucs clairement hors sujet, le problème étant que le canal principal était certes très actif, mais si c'est pour avoir que des discussions hors sujet et éventuellement par des gens qui ne contribuent pas par ailleurs au orojet, c'est bien mais... on est pas non plus là pour monter un réseau social. D'où l'idée de faire un canal d'accueil qui soit quand même un endroit ou on parle de choses plus ou moins liée à khaganat, et un canal à côté pour le reste.


Et après, ben on se connaît tous un peu et on sait à peu près dans quel canal mettre un truc pour atteindre les gens concernées. Et on peut toujours rediriger ou découper un canal en deux si on voit qu'il est occupé par une autre discussion (parce que suivre deux trucs à la fois c'est juste pas possible)
Cliquez pour afficher le message
Il y a un lien "wap2" en bas de page. C'est très "web 1.0" mais ça marche! Ça serait même utilisable sur un Minitel, je crois...
Cliquez pour afficher le message
Hello!

Il y a fort longtemps j'ai mis les pieds dans une communauté très active et qui utilisait principalement un forum. Un truc avec des douzaines de messages par jour, plein de discussions intéressantes, et que des gens sympa et civilisés au point que y'avait quasiment pas besoin d'équipe de modération.

Je pense qu'il y avait un peu le problème inverse: un forum très actif sur lequel ce n'était pas possible de lire tous les messages. Pour les habitués, mais surtout pour les nouveaux arrivants, qui du coup relançaient souvent des discussions qui avaient déjà été abordées précédement. Je ne suis pas certain qu'un forum vivant de cette façon soit beaucoup plus efficace qu'un canal xmpp pour l'archivage à long terme des discussions.

Ce qui fait que le forum marche bien pour ça maintenant, c'est que les discussions ont lieu en direct sur le canal xmpp et qu'on peut en avoir sur le forum un résumé, condensé, plus facile à aborder. Mais ça ne marche que parce que les questions ont été réglées ailleurs en grande partie. Par exemple si on prend le journal de bord de Mopi: sur le canal xmpp tu as posé plein de questions, les réponses sont arrivées avec un décalage et dans le désordre, peut être il y a eu quelques fausses pistes avant d'arriver au bon résultat. Clairement c'est pas le meilleur endroit pour retrouver les infos. Mais c'est ce qui permet d'aboutir à un journal de bord clair et concis sur le forum. Pour moi c'est l'approche la plus efficace, la spontanéité de xmpp permet d'avoir des échanges très rapides, et la consolidation sur le forum permet d'avoir les infos importantes stockées sur le long terme.

Et donc, où est le problème? Ben le problème c'est qu'il faut faire le travail de remonter les infos sur le forum. Mais ça serait pareil quels que soient les outils choisis: si y'avait que xmpp, on aurait sûrement un genre d'index avec des liens vers les morceaux importants des logs. Si on avait qu'un forum, ça serait à coup de posts épinglés, de posts vides préparés à l'avance pour pouvoir rajouter des infos dedans (oui oui c'est une pratique existante, par exemple sur xda-developers avec ses topics qui font des centaines de pages avec l'info que tu cherche perdue dans une note de bas de page d'un post de la page 73).

Je connaît au moins un outil qui essaie de faire les deux à la fois, c'est Zulip, une application de messagerie instantanée avec des "topics" qui foncionne un peu comme le tri des mails par objet dans certains clients mail. Mais je trouve leur interface complètement incompréhensible.

Je suis donc d'accord: il ne s'agit pas vraiment d'un problème d'outils. Il s'agit d'un problème de discipline et de prendre l'habitude de mettre les infos importantes sur le forum. Comme ça tout le monde saura qu'il n'y a rien d'important qui sera oublié dans les logs xmpp  :))
26 Avril 2020 à 12:40:58
Cliquez pour afficher le message
Bien sûr quand je parlais de tirage au sort, c'est parmis les gens consentants, ça me semblait évident que ça n'a aucun intérêt de forcer quelqu'un à faire une conférence.

En fait il y a deux aspects: d'un côté, la communication externe, et là, effectivement, avoir un avatar quireprésente tout le projet est intéressant. Mais ça laisse de côté un autre problème dans la communication interne. La "starification" existe probablement de ce côté là aussi, avec des gens qui vont (volontairement ou pas) avoir plus de poids dans les décisions ou au moins dans les discussions, par leur ancienneté, leur implication plus ou moins importante, ou tout simplement le fait de donner leur avis sur tout alors qu'on leur a rien demandé (je précise que je ne vise personne en particulier).

Dans mon cas chez Haiku (oui je suis encore hors sujet!), c'est ce côté interne qui m'inquiète le plus. Justement parce que dans la communication externe, il est déjà relativement facile de trouver des contournements: tu as mentionné la communication en ligne, mais ça peut aussi être des communiqués de presse, une vidéo dans laquelle on choisit (collectivement) ce qu'on veut montrer, etc. Même quand on tient un stand, assez intuitivement onconstruit un discours commun pour présenter un projet (il suffit d'écouter la présentation des autres gens qui sont sur le stand, et de garder les bonnes idées en ajoutant quelques trucs).

Quand il s'agit de conférences, c'est déjà un peu plus compliqué. J'imagine que ça peut fonctionner pour un sujet du type "quoi de neuf depuis l'an dernier?", par exemple, et donc ce serait en supplément à d'autres sujets plus "personnels" qui sont au moins autant intéressants. Mais dans ce contexte, j'aurai plutôt pris la solution de faire une conférence avec plusieurs orateurs, permettant à chacune de s'exprimer sur le sujet qui lui importe le plus parmi tout ce qu'il y a à dire. Ce qui permettrait de mettre en valeur qu'il n'y a pas Une Voix du Khan, mais plusieurs. Cela dit, je ne sais pas à quel point ça correspond à l'organisation ici. Je sais que chez Haiku il y a relativement peu de choses sur lesquelles toute la communauté est d'accord, et c'est justement ça qui permet aux choses d'avancer. Personellement, je ne voudrais pas être la voix de Haiku, parce que ça aurait l'effet inverse: brouiller encore plus la confusion entre ma vision personnelle, et la vision globale du projet dont j'espère qu'elle est plus complexe et plus riche que ce qu'il y a juste dans ma tête.

Je ne suis donc pas convaincu qu'un avatar unique soit une solution pour montrer qu'une communication vient justement d'une entité collective. Ceci dit, je ne veux décourager personne, montrez-moi que j'ai tort!  :))
Licences Mentions légales Accueil du site Contact Inclusion