Déploiement local d'un système RAG avec LangChain et DeepSeek

Installation de Conda Conda est un système de gestion de paquets et d'environnements open-source, principalement utilisé pour instaler et gérer différentes versions de logiciels et leurs dépendances. Téléchargez le package d'installation correspondant depuis le site officiel de Conda et installez-le en double-cliquant. Nous recommandons Minico ...

Publié le 26 septembre à 08h23

Déploiement local de modèles de langage sur Windows avec Ollama v0.32.5

Ollama est un outil open source conçu pour exécuter localement des modèles de langage de grande taille (LLM) sans dépendances complexes. Il simplifie radicalement le déploiement de modèles comme Qwen, Llama, Mistral ou Gemma sur ordinateur personnel, en particulier sous Windows. Fonctionnalités clés Exécution simplifiée : aucun besoin de gérer ...

Publié le 21 septembre à 07h45

Déploiement et service API de Qwen2.5-VL-7B-Instruct avec Docker Compose et Ollama

Introduction au modèle multimodal Qwen2.5-VL-7B-Instruct Ce guide explique comment déployer efficacement le modèle multimodal Qwen2.5-VL-7B-Instruct en utilisant Docker Compose. Le modèle est ensuite exposé via une API RESTful grâce à Ollama, simplifiant ainsi le développement d'applications d'intelligence artificielle visuelle et linguistique. ...

Publié le 14 septembre à 23h45

Mise en œuvre de ChatGLM3-6B-128K sous Ollama pour l'analyse décisionnelle (BI)

Optimisation de la Business Intelligence avec les LLM à contexte étendu L'analyse décisionnelle (BI) en entreprise se heurte souvent à la complexité des structures de données et à la nécessité de maîtriser des langages de requête comme le SQL. Traditionnellement, un utilisateur métier doit soit manipuler des tableaux de bord rigides, soit solli ...

Publié le 3 septembre à 19h44

Fabrication de Lunettes Connectées : Intégration de l'IA avec OpenGlass et ESP32-S3

Architecture Matérielle et Composants La transformation de montures optiques standard en dispositifs de vision assistée par intelligence artificielle repose sur l'intégration de microcontrôleurs compacts. Le projet OpenGlass utilise une archietcture matérielle minimaliste mais performante pour capturer et analyser le flux visuel en temps réel. ...

Publié le 16 juillet à 23h44

Déploiement de modèles de langage locaux avec Ollama | DeepSeek-R1-Distill-Qwen-7B pour la création de contenu scientifique sur le calcul quantique

Présentation des modèles : Avancées techniques de la série DeepSeek-R1 La série DeepSeek-R1 représente une avancée significative dans le domaine des modèles de raisonnement. Cette série comprend deux versions principales : DeepSeek-R1-Zero et DeepSeek-R1. DeepSeek-R1-Zero utilise une méthode d'entraînement innovante - un apprentissage direct ...

Publié le 10 juillet à 06h52

Transformer du texte brut en graphes de connaissances avec l'IA locale

Concepts fondamentaux des graphes de connaissances Face à des documents volumineux — rapports scientifiques,文档 administratifs, littérature technique — la lecture séquentielle devient inefficace. Les graphes de connaissances offrent une alternative structurée : ils représentent l'information sous forme de réseau où les antités et leurs relatio ...

Publié le 4 juillet à 07h59

Déploiement et utilisation du modèle nomic-embed-text-v2-moe pour la recherche multilingue

Présentation technique et avantages clés Architectrue du modèle nomic-embed-text-v2-moe est un modèle d'incorporation textuelle multilingue utilisant une architecture Mixture of Experts (MoE). Il traite environ 100 langues avec un dimensionnement d'embedding adaptatif, permettant de réduire l'espace de stockage sans compromettre significativeme ...

Publié le 2 juillet à 17h36

Configuration locale de DeepSeek (installation hors ligne) et intégration avec Page AI pour le dialogue dans le navigateur

Contexte DeepSeek étant actuellement très populaire, notre entreprise a besoin de déployer localement ce modèle et de l'intégrer avec l'extension Page AI pour Google Chrome, permettant ainsi des conversations directemant dans le navigateur. Cependant, en raison des restrictions du pare-feu d'entreprise, une installation en ligne du modèle n'est ...

Publié le 2 juillet à 02h50

Déploiement local de TranslateGemma-12B-IT via Ollama pour la traduction multimodale

Prérequis matériels et configuration de l'environnement Le modèle translategemma-12b-it, fort de ses 12 milliards de paramètres, nécessite des ressources spécifiques pour fonctionner de manière optimale : Configuration minimale : 24 Go de RAM et un processeur à 8 cœurs (l'inférence purement CPU sera notablement ralentei). Configuraton recomman ...

Publié le 25 juin à 18h55