Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
11 changes: 7 additions & 4 deletions README.fr.md
Original file line number Diff line number Diff line change
Expand Up @@ -90,8 +90,11 @@ vllm serve your-model --port 8000 # vLLM → :8000/v1
python -m sglang.launch_server --model-path your-model --port 30000
```

LM Studio (`:1234/v1`), Jan (`:1337/v1`) et LocalAI (`:8080/v1`) fonctionnent de
la même manière. Chargez un modèle avec **au moins une fenêtre de contexte de
LM Studio (`:1234/v1`), Jan (`:1337/v1`), LocalAI (`:8080/v1`) et GPT4All
(`:4891/v1`) fonctionnent de la même manière. Une carte générique **Proxy local
compatible OpenAI** accepte aussi les passerelles de boucle locale authentifiées
comme CLIProxyAPI ; consultez la [configuration sécurisée du proxy](docs/fr/providers-and-models.md#exemple-de-proxy-dabonnement-cliproxyapi).
Chargez un modèle avec **au moins une fenêtre de contexte de
16k jetons** — 8k ne fonctionne qu'avec le niveau Compact, et 4k est trop petit
pour le prompt système et les schémas d'outils. WebBrain détecte
automatiquement la fenêtre réelle pour llama.cpp, Ollama et LM Studio, et
Expand All @@ -102,7 +105,7 @@ compacte la conversation à mesure qu'elle se remplit. Il existe aussi un relais
**API cloud** — OpenAI, Anthropic Claude, Google Gemini, Azure OpenAI, AWS
Bedrock, Mistral, DeepSeek, xAI Grok, MiniMax, Kimi, Qwen, z.ai GLM, Groq,
Together, Cloudflare, Nvidia NIM, Hugging Face, Fireworks, OpenRouter et
d'autres. Les Paramètres embarquent **104 cartes de fournisseurs** avec URL de
d'autres. Les Paramètres embarquent **105 cartes de fournisseurs** avec URL de
base et modèle par défaut préremplis — voir le
[catalogue complet](docs/fr/providers-and-models.md#catalogue-étendu-de-fournisseurs).

Expand Down Expand Up @@ -195,7 +198,7 @@ WebBrain a le focus.
| [Architecture](docs/fr/architecture.md) | Vue d'ensemble, flux d'un tour, sous-systèmes |
| [Outils de l'agent](docs/fr/agent-tools.md) | Niveaux, modes et matrice complète |
| [Commandes slash](docs/fr/slash-commands.md) | Toutes les commandes et options |
| [Fournisseurs et modèles](docs/fr/providers-and-models.md) | Les 104 cartes, configuration locale, niveaux |
| [Fournisseurs et modèles](docs/fr/providers-and-models.md) | Les 105 cartes, configuration locale, niveaux |
| [Compétences](docs/fr/skills.md) | Compétences intégrées, import, outils de compétence |
| [Modèle de sécurité](docs/fr/security-model.md) | Permissions, identifiants, frontières de confiance |
| [Défense contre l'injection de prompt](docs/fr/prompt-injection-defense.md) | Couches de défense et limites connues |
Expand Down
11 changes: 7 additions & 4 deletions README.md
Original file line number Diff line number Diff line change
Expand Up @@ -86,8 +86,11 @@ vllm serve your-model --port 8000 # vLLM → :8000/v1
python -m sglang.launch_server --model-path your-model --port 30000
```

LM Studio (`:1234/v1`), Jan (`:1337/v1`), and LocalAI (`:8080/v1`) work the same
way. Load a model with **at least a 16k-token context window** — 8k works only
LM Studio (`:1234/v1`), Jan (`:1337/v1`), LocalAI (`:8080/v1`), and GPT4All
(`:4891/v1`) work the same way. A generic **Local OpenAI-compatible Proxy** card
also supports authenticated loopback gateways such as CLIProxyAPI; see the
[secure subscription proxy setup](docs/providers-and-models.md#subscription-proxy-example-cliproxyapi).
Load a model with **at least a 16k-token context window** — 8k works only
with the Compact tier, and 4k is too small for the system prompt plus tool
schemas. WebBrain auto-detects the real window for llama.cpp, Ollama, and LM
Studio, and auto-compacts the conversation as it fills up. For Ollama,
Expand All @@ -101,7 +104,7 @@ preview `ollama launch webbrain --model <model>` handoff. Details:
**Cloud APIs** — OpenAI, Anthropic Claude, Google Gemini, Azure OpenAI, AWS
Bedrock, Mistral, DeepSeek, xAI Grok, MiniMax, Kimi, Qwen, z.ai GLM, Groq,
Together, Cloudflare, Nvidia NIM, Hugging Face, Fireworks, OpenRouter, and more.
Settings ships **104 built-in provider cards** with base URLs and default models
Settings ships **105 built-in provider cards** with base URLs and default models
pre-filled — see the [full catalog](docs/providers-and-models.md#extended-provider-catalog).

## Features
Expand Down Expand Up @@ -185,7 +188,7 @@ Chrome side panel shortcuts work when the WebBrain side panel has focus.
| [Architecture](docs/architecture.md) | System overview, turn flow, subsystems |
| [Agent tools](docs/agent-tools.md) | Tiers, modes, and the full tool matrix |
| [Slash commands](docs/slash-commands.md) | Every command and flag |
| [Providers and models](docs/providers-and-models.md) | All 104 provider cards, local setup, tiers |
| [Providers and models](docs/providers-and-models.md) | All 105 provider cards, local setup, tiers |
| [Skills](docs/skills.md) | Bundled skills, importing, skill tools |
| [Security model](docs/security-model.md) | Permissions, credentials, trust boundaries |
| [Prompt-injection defense](docs/prompt-injection-defense.md) | Defense layers and known gaps |
Expand Down
8 changes: 5 additions & 3 deletions README.zh-CN.md
Original file line number Diff line number Diff line change
Expand Up @@ -82,7 +82,9 @@ vllm serve your-model --port 8000 # vLLM → :8000/v1
python -m sglang.launch_server --model-path your-model --port 30000
```

LM Studio(`:1234/v1`)、Jan(`:1337/v1`)和 LocalAI(`:8080/v1`)用法相同。请加载
LM Studio(`:1234/v1`)、Jan(`:1337/v1`)、LocalAI(`:8080/v1`)和 GPT4All
(`:4891/v1`)用法相同。通用的**本地 OpenAI 兼容代理**卡片也支持 CLIProxyAPI
等带认证的回环网关;请参阅[安全代理配置](docs/zh-CN/providers-and-models.md#订阅代理示例cliproxyapi)。请加载
**至少具有 16k 令牌上下文窗口**的模型 —— 8k 仅在 Compact 层级下可用,4k 无法容纳
系统提示加工具 schema。WebBrain 会为 llama.cpp、Ollama 和 LM Studio 自动检测真实窗口,
并在对话接近上限时自动压缩。此外还有预览版的
Expand All @@ -92,7 +94,7 @@ LM Studio(`:1234/v1`)、Jan(`:1337/v1`)和 LocalAI(`:8080/v1`)用法
**云端 API** —— OpenAI、Anthropic Claude、Google Gemini、Azure OpenAI、AWS Bedrock、
Mistral、DeepSeek、xAI Grok、MiniMax、Kimi、通义千问、z.ai GLM、Groq、Together、
Cloudflare、Nvidia NIM、Hugging Face、Fireworks、OpenRouter 等。设置中内置
**104 张提供商卡片**,已预填 base URL 和默认模型 —— 参见
**105 张提供商卡片**,已预填 base URL 和默认模型 —— 参见
[完整目录](docs/zh-CN/providers-and-models.md#扩展提供商目录)。

## 功能特性
Expand Down Expand Up @@ -168,7 +170,7 @@ Chrome 侧边面板快捷键在 WebBrain 侧边面板获得焦点时生效。
| [架构](docs/zh-CN/architecture.md) | 系统概览、轮次流程、子系统 |
| [智能体工具](docs/zh-CN/agent-tools.md) | 层级、模式与完整工具矩阵 |
| [斜杠命令](docs/zh-CN/slash-commands.md) | 所有命令与参数 |
| [提供商与模型](docs/zh-CN/providers-and-models.md) | 全部 104 张提供商卡片、本地配置、层级 |
| [提供商与模型](docs/zh-CN/providers-and-models.md) | 全部 105 张提供商卡片、本地配置、层级 |
| [技能](docs/zh-CN/skills.md) | 内置技能、导入、技能工具 |
| [安全模型](docs/zh-CN/security-model.md) | 权限、凭证、信任边界 |
| [提示注入防御](docs/zh-CN/prompt-injection-defense.md) | 防御层级与已知缺口 |
Expand Down
2 changes: 1 addition & 1 deletion docs/THREAT-MODEL.md
Original file line number Diff line number Diff line change
Expand Up @@ -63,7 +63,7 @@ The defensible claim is *not* "we're more secure than everyone." It's that the s

1. Is page-derived content structurally isolated from the instruction path? (We do this and test it.)
2. Is the action/automation surface bounded, or does the agent inherit full ambient authority? (Our gap G1/G2/G4 — being closed.)
3. Where does inference run, and what leaves the device? (The selected provider determines this: WebBrain Cloud and bring-your-own cloud providers receive the request context, while local providers keep inference requests on the machine.)
3. Where does inference run, and what leaves the device? (The selected provider determines this: WebBrain Cloud and bring-your-own cloud providers receive the request context; local model runtimes keep inference on the machine, while a local gateway may forward it upstream.)
4. Is there evidence, or just assertions? (Adversarial corpus + ablation, in-repo.)

Before making any *comparative* claim about a specific competitor (Edge's AI, OpenAI's browser, the Claude browser, etc.), verify their actual behaviour — don't assert it. The strong, honest line is "here are the dimensions; here's exactly where we stand on each, with tests" and let the comparison speak for itself.
Expand Down
2 changes: 1 addition & 1 deletion docs/fr/THREAT-MODEL.md
Original file line number Diff line number Diff line change
Expand Up @@ -63,7 +63,7 @@ L'affirmation défendable n'est *pas* "nous sommes plus sécurisés que tout le

1. Le contenu provenant de la page est-il structurellement isolé du chemin d'instruction ? (Nous le faisons et le testons.)
2. La surface d'action/automatisation est-elle limitée, ou l'agent hérite-t-il de toute l'autorité ambiante ? (Notre lacune G1/G2/G4 — en cours de comblement.)
3. Où l'inférence s'exécute-t-elle, et qu'est-ce qui quitte l'appareil ? (Le fournisseur sélectionné le détermine : WebBrain Cloud et les fournisseurs cloud configurés par l'utilisateur reçoivent le contexte de la requête, tandis que les fournisseurs locaux conservent les requêtes d'inférence sur la machine.)
3. Où l'inférence s'exécute-t-elle, et qu'est-ce qui quitte l'appareil ? (Le fournisseur sélectionné le détermine : WebBrain Cloud et les fournisseurs cloud configurés par l'utilisateur reçoivent le contexte de la requête ; les moteurs de modèles locaux gardent l'inférence sur la machine, tandis qu'une passerelle locale peut la transmettre en amont.)
4. Y a-t-il des preuves, ou juste des affirmations ? (Corpus adversarial + ablation, dans le dépôt.)

Avant de faire une affirmation *comparative* sur un concurrent spécifique (Edge AI, navigateur OpenAI, navigateur Claude, etc.), vérifiez leur comportement réel — ne l'affirmez pas. La ligne forte et honnête est "voici les dimensions ; voici exactement où nous en sommes sur chacune, avec des tests" et laissez la comparaison parler d'elle-même.
Expand Down
10 changes: 7 additions & 3 deletions docs/fr/privacy-and-data-flow.md
Original file line number Diff line number Diff line change
Expand Up @@ -43,9 +43,13 @@ L'utilisateur choisit son fournisseur dans les Paramètres. Les options incluent
Google Gemini, Mistral, DeepSeek, xAI, Groq, OpenRouter, etc. — les requêtes
sont envoyées directement au fournisseur avec les identifiants de l'utilisateur
et ne sont jamais collectées par WebBrain
- **Fournisseurs locaux** : llama.cpp, Ollama, LM Studio, Jan, vLLM, SGLang,
LocalAI —
les données restent sur la machine de l'utilisateur
- **Moteurs de modèles locaux** : llama.cpp, Ollama, LM Studio, Jan, vLLM,
SGLang, LocalAI et GPT4All — les requêtes d'inférence restent sur la machine
de l'utilisateur
- **Proxy local compatible OpenAI** : WebBrain contacte seulement la passerelle
locale configurée, mais celle-ci peut transmettre le contexte à un compte en
amont. Sa configuration et sa politique de confidentialité déterminent le
trajet des données.

Les requêtes vers un modèle local ou une API configurée par l'utilisateur ne
sont jamais collectées par WebBrain. Les requêtes WebBrain Cloud sont traitées
Expand Down
38 changes: 34 additions & 4 deletions docs/fr/providers-and-models.md
Original file line number Diff line number Diff line change
Expand Up @@ -45,6 +45,7 @@ class BaseLLMProvider {
| `sglang` | `openai` | local | (modèle chargé) | Oui (activé par défaut) |
| `localai` | `openai` | local | (modèle chargé) | Métadonnées auto / surcharge |
| `gpt4all` | `openai` | local | (modèle chargé) | Oui (activé par défaut) |
| `local_openai_proxy` | `openai` | local | (requis) | Désactivée / bascule manuelle |
| `azure_openai` | `azure_openai` | cloud | (déploiement) | Bascule manuelle |
| `aws_bedrock` | `aws_bedrock` | cloud | (ID de modèle) | Non |
| `openai` | `openai` | cloud | `gpt-5.6-terra` | Regex nom de modèle |
Expand All @@ -69,8 +70,8 @@ class BaseLLMProvider {

WebBrain ajoute 76 cartes désactivées par défaut depuis l’instantané du
catalogue OpenCode au commit
`62e4641235d7847dadc60da37cca8a023dd54fc1`. Avec les 28 cartes existantes,
les Paramètres proposent **104 fournisseurs intégrés**. La liste exacte des
`62e4641235d7847dadc60da37cca8a023dd54fc1`. Avec les 29 cartes existantes,
les Paramètres proposent **105 fournisseurs intégrés**. La liste exacte des
identifiants est :

`302ai`, `abacus`, `aihubmix`, `alibaba-coding-plan`,
Expand Down Expand Up @@ -114,8 +115,9 @@ Entrées volontairement exclues : `github-models` (retrait de GitHub Models le

### Fournisseurs Locaux

Sept fournisseurs locaux sont activés par défaut sans clé API requise sauf si le
serveur local a été démarré avec authentification :
Neuf fournisseurs à terminaison locale sont activés par défaut. Les moteurs de
modèles n'exigent pas de clé sauf si le serveur utilise l'authentification ; la
carte proxy générique exige une clé client :

- **llama.cpp** : `http://localhost:8080` — exécutez `llama-server -m model.gguf`
- **Ollama** : `http://localhost:11434/v1` — `ollama serve`, ou `ollama launch webbrain --model <model>`
Expand All @@ -124,6 +126,34 @@ serveur local a été démarré avec authentification :
- **vLLM** : `http://localhost:8000/v1` — le serveur compatible OpenAI de vLLM
- **SGLang** : `http://localhost:30000/v1` — le serveur compatible OpenAI de SGLang
- **LocalAI** : `http://localhost:8080/v1` — le serveur compatible OpenAI de LocalAI
- **GPT4All** : `http://localhost:4891/v1` — le serveur API local de GPT4All
- **Proxy local compatible OpenAI** : `http://127.0.0.1:8317/v1` — passerelle
locale générique authentifiée ; le modèle et la clé API client sont requis

#### Exemple de proxy d'abonnement (CLIProxyAPI)

La carte **Proxy local compatible OpenAI** peut joindre une instance
[CLIProxyAPI](https://github.com/router-for-me/CLIProxyAPI) gérée séparément.
Installez-le via le [guide de démarrage officiel](https://help.router-for.me/introduction/quick-start)
ou compilez-le (`go build -o cli-proxy-api ./cmd/server`), copiez
`config.example.yaml` vers `config.yaml`, puis configurez `host: "127.0.0.1"`,
`port: 8317` et une valeur forte et aléatoire dans `api-keys`. Authentifiez le
compte avec `./cli-proxy-api --config ./config.yaml --codex-login` ou
`--claude-login`. Gemini CLI nécessite le
[plugin officiel](https://github.com/router-for-me/cpa-plugin-gemini-cli) :
activez les plugins de confiance, installez `gemini-cli` depuis le Plugin Store
officiel, redémarrez le proxy, puis utilisez `--geminicli-login` (voir le
[guide de gestion](https://help.router-for.me/management/api#plugins)). Démarrez enfin avec
`./cli-proxy-api --config ./config.yaml`. Dans WebBrain, conservez l'URL
`http://127.0.0.1:8317/v1`, saisissez la même clé, chargez les modèles,
sélectionnez-en un puis testez la connexion.

Ne publiez pas ce proxy sur le réseau local ou Internet : l'hôte vide par
défaut écoute toutes les interfaces, TLS est désactivé par défaut et une liste
`api-keys` vide autorise les requêtes sans authentification. Ce chemin est
expérimental et communautaire. Le processus est local, mais il peut transmettre
le contexte à un compte en amont ; les identifiants OAuth amont restent dans
CLIProxyAPI.

Ollama, llama.cpp, LM Studio et LocalAI utilisent `visionMode: auto` par défaut.
WebBrain lit les métadonnées natives du modèle sélectionné avant l'enrichissement et
Expand Down
6 changes: 5 additions & 1 deletion docs/privacy-and-data-flow.md
Original file line number Diff line number Diff line change
Expand Up @@ -41,7 +41,11 @@ The user chooses their provider in Settings. Options include:

- **WebBrain Cloud**: requests go through `api.webbrain.one`; selected interactions may be retained and used for evaluation, improvement, fine-tuning, and training while Help Improve WebBrain is enabled
- **Bring-your-own cloud providers**: OpenAI, Anthropic, Google Gemini, Mistral, DeepSeek, xAI, Groq, OpenRouter, etc. — requests go directly to the provider using the user's credentials and are never collected by WebBrain
- **Local providers**: llama.cpp, Ollama, LM Studio, Jan, vLLM, SGLang, LocalAI — data stays on the user's machine
- **Local model runtimes**: llama.cpp, Ollama, LM Studio, Jan, vLLM, SGLang,
LocalAI, and GPT4All — inference requests stay on the user's machine
- **Local OpenAI-compatible Proxy**: WebBrain connects only to the configured
local gateway, but the gateway may forward the request context to an upstream
account. Its configuration and privacy policy determine where data goes.

Local-model and bring-your-own API requests are never collected by WebBrain. WebBrain Cloud requests are processed and may be retained as described below.

Expand Down
Loading
Loading