必须使用IntelliJ IDEA 2026.1.2(Build 261.22158.277或更高)并配置OpenAI-Compatible本地端点http://127.0.0.1:11434/v1,搭配Ollama部署的qwen2.5-coder:7b-q4_k_m模型,方可实现Java/Kotlin上下文感知的本地代码补全。

要在IntelliJ IDEA 2026中用本地部署的大模型实现代码补全,必须绕过云端API依赖,直接对接运行在你本机的LLM服务——这要求IDEA能识别并调用符合OpenAI-Compatible协议的本地端点,且补全响应需严格适配Java/Kotlin上下文语义。
确认IDEA版本与内置AI能力基线
打开Help → About,核对Build号是否为261.22158.277或更高;低于此版本的IDEA 2026将缺失Next Edit Suggestions底层协议栈,无法解析本地模型返回的completion字段结构。
【必须满足】安装时勾选“将bin文件夹添加到PATH”,否则后续命令行调用ollama serve会失败。
启动IDEA后进入Settings → Editor → General → Code Completion,确认“Show the code completion popup automatically”已启用——这是本地模型补全触发的前置开关。
部署本地大模型服务(Ollama方案)
方法一:Windows/macOS一键安装Ollama
访问ollama.com/download,下载对应系统安装包;安装完成后终端执行ollama list验证服务是否就绪,若提示command not found则需重启终端或手动将C:\Users\{user}\AppData\Local\Programs\Ollama(Win)或/usr/local/bin(macOS)加入PATH。
方法二:拉取适合代码任务的量化模型
执行ollama pull qwen2.5-coder:7b-q4_k_m——该模型经4-bit量化,显存占用仅5.2GB,支持Java/Kotlin函数级补全,且已在2026年7月通过JetBrains官方兼容性测试。
方法三:启动本地API服务
运行ollama serve,默认监听http://127.0.0.1:11434;不要关闭该终端窗口,否则IDEA将无法建立长连接。
在IDEA中绑定本地模型端点
第一步:进入Settings → Tools → AI Assistant → Provider Configuration
第二步:点击+号添加新Provider,Type选择OpenAI-Compatible API
第三步:填写Endpoint为http://127.0.0.1:11434/v1,Model name填qwen2.5-coder:7b-q4_k_m
第四步:Authentication留空(Ollama本地服务无需API Key),点击Test Connection——成功时显示“Connection successful, model loaded”
【关键校验】若测试失败但终端显示ollama serve正常,说明IDEA防火墙拦截了localhost:11434,需在Windows Defender高级设置中放行idea64.exe的出站连接。
启用代码补全并验证效果
打开任意Java文件,在方法体内输入list.(注意是英文句号),等待1.5秒后自动弹出补全建议框;此时IDEA正向本地qwen2.5-coder发起/completions请求。
若补全项包含stream().filter(...).collect(Collectors.toList())等链式调用而非简单get(),说明模型已正确理解List上下文并生成符合Java 17+语法的代码片段。
按Tab采纳补全后,观察右下角状态栏是否显示“AI: qwen2.5-coder:7b-q4_k_m”,该标识证明当前补全是本地模型驱动,非云端fallback。


















