NewYour coding agent can read the release notes before it upgrades.Set up the MCP server →
PyPI · #5334 most downloaded on PyPI
An integration package connecting NVIDIA AI Endpoints and LangChain
Last release 3 months ago
02 Jul 2026
Release timing varies
gaps range from 8 days to 2 months
Nearly every release is documented
notes for 60 of the last 60 stable releases
Nothing withdrawn
no release was ever pulled
3 years old
66 releases · first in 2023
docs(ai-endpoints): replace deprecated max_tokens with max_completion_tokens in README example by @GSCSD1 in https://github.com/langchain-ai/langchain…
max_tokens with max_completion_tokens in README example by @GSCSD1 in https://github.com/langchain-ai/langchain-nvidia/pull/333Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/openshell/v0.1.0...libs/ai-endpoints/v1.4.3
One column per month.
chore(deps): bump aiohttp from 3.13.4 to 3.14.0 in /libs/ai-endpoints in the pip group across 1 directory by @dependabot[bot] in https://github.com/la
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.4.1...libs/ai-endpoints/v1.4.2
add tool support for qwen3.5-122b-a10b by @vidushig-nv in https://github.com/langchain-ai/langchain-nvidia/pull/312
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.4.0...libs/ai-endpoints/v1.4.1
chore(deps): bump the pip group across 3 directories with 2 updates by @dependabot[bot] in https://github.com/langchain-ai/langchain-nvidia/pull/302
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.3.0...libs/ai-endpoints/v1.4.0
chore: add deprecation warnings for deprecated models by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/291
qwen/qwen3.5-122b-a10b and mistralai/mistral-small-4-119b-2603 by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/285deepseek-ai/deepseek-v4-pro and deepseek-ai/deepseek-v4-flash by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/294_NVIDIAClient into sync and async clients by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/293Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.2.1...libs/ai-endpoints/v1.3.0
chore: Support nvidia/nemotron-3-super-120b-a12b by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/271
nvidia/nemotron-3-super-120b-a12b by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/271ChatNVIDIA by @mdrxy in https://github.com/langchain-ai/langchain-nvidia/pull/261Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.2.0...libs/ai-endpoints/v1.2.1
ci: add minimum workflow permissions by @jkennedyvz in https://github.com/langchain-ai/langchain-nvidia/pull/253
langchain-nvidia-langgraph with optimized execution strategies by @mpenn in https://github.com/langchain-ai/langchain-nvidia/pull/255nvidia/llama-nemotron-rerank-1b-v2 by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/267nvidia/llama-nemotron-embed-1b-v2 by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/268Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.1.0...libs/ai-endpoints/v1.2.0
Add ChatNVIDIADynamo with Dynamo Agent Hints by @dnandakumar-nv in https://github.com/langchain-ai/langchain-nvidia/pull/245
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.0.4...libs/ai-endpoints/v1.1.0
chore: Support `stepfun-ai/step-3.5-flash` by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/240
stepfun-ai/step-3.5-flash by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/240Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.0.3...libs/ai-endpoints/v1.0.4
feat: Support both direct and nvext format for structured output generation by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.0.2...libs/ai-endpoints/v1.0.3
fix: Make thinking tag parsing backward compatible with deprecation warning by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull…
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.0.1...libs/ai-endpoints/v1.0.2
chore: Remove deprecated model, update test models, bump version by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/229
moonshotai/kimi-k2-thinking and nvidia/llama-3.2-nemoretriever-300m-embed-v2 by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/222nvidia/nemotron-3-nano-30b-a3b by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/223deepseek-ai/deepseek-v3.2 by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/226Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.0.0...libs/ai-endpoints/v1.0.1
docs: Edit pass by @nkmcalli in https://github.com/langchain-ai/langchain-nvidia/pull/203
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.19...libs/ai-endpoints/v1.0.0
chore: Support more chat models by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/193
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.18...libs/ai-endpoints/v0.3.19
feat: Support `min_tokens and ignore_eos` parameters by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/190
min_tokens and ignore_eos parameters by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/190Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.17...libs/ai-endpoints/v0.3.18
remove models from list by @dglogo in https://github.com/langchain-ai/langchain-nvidia/pull/182
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.16...libs/ai-endpoints/v0.3.17
adding parsing for reasoning_content in additional_kwargs with integr… by @soumilinandi in https://github.com/langchain-ai/langchain-nvidia/pull/180
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.15...libs/ai-endpoints/v0.3.16
feat: support openai/gpt-oss-20b and openai/gpt-oss-120b by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/177
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.14...libs/ai-endpoints/v0.3.15
Feature/add-option-to-disable-ssl by @soumilinandi in https://github.com/langchain-ai/langchain-nvidia/pull/170
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.13...libs/ai-endpoints/v0.3.14
feat: add support for kimi-k2-instruct by @jiayin-nvidia in https://github.com/langchain-ai/langchain-nvidia/pull/169
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.12...libs/ai-endpoints/v0.3.13
relax nemotron thinking warning for nvdev models by @soumilinandi in https://github.com/langchain-ai/langchain-nvidia/pull/166
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.11...libs/ai-endpoints/v0.3.12
Relaxed model checks by @rmkraus in https://github.com/langchain-ai/langchain-nvidia/pull/154
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.10...libs/ai-endpoints/v0.3.11
update the standard test model from llama 3.1 8b to 3.3 70b by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/135
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.9...libs/ai-endpoints/v0.3.10
add deepseek-r1 model by @raspawar in https://github.com/langchain-ai/langchain-nvidia/pull/134
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.8...libs/ai-endpoints/v0.3.9
added NVIDIA edits by @adi0106 in https://github.com/langchain-ai/langchain-nvidia/pull/127
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.7...libs/ai-endpoints/v0.3.8
add support for nvidia/llama-3.2-nv-embedqa-1b-v2 and nvidia/llama-3.2-nv-rerankqa-1b-v2 by @mattf in https://github.com/langchain-ai/langchain-nvidia
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.6...libs/ai-endpoints/v0.3.7
langchain-standard-tests -> langchain-tests by @efriis in https://github.com/langchain-ai/langchain-nvidia/pull/117
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.5...libs/ai-endpoints/v0.3.6
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.4...libs/ai-endpoints/v0.3.5
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.4...libs/ai-endpoints/v0.3.5
add NVIDIARerank example to README by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/114
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.3...libs/ai-endpoints/v0.3.4
add new retriever models: nvidia/llama-3.2-nv-embedqa-1b-v1 and nvidia/llama-3.2-nv-rerankqa-1b-v1 by @mattf in https://github.com/langchain-ai/langch
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.2...libs/ai-endpoints/v0.3.3
allow base_url to work with proxies, e.g. http://host/proxy/path/v1 by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/112
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.1...libs/ai-endpoints/v0.3.2
update v0.2 to latest docs links by @efriis in https://github.com/langchain-ai/langchain-nvidia/pull/106
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.3.0...libs/ai-endpoints/v0.3.1
remove deprecated model_type param (embedding) by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/102
import langchain_nvidia by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/105Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.2.2...libs/ai-endpoints/v0.3.0
Quick improvement to langgraph example by @haydeniw in https://github.com/langchain-ai/langchain-nvidia/pull/87
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.2.1...libs/ai-endpoints/v0.2.2
Added tool calling notebook by @haydeniw in https://github.com/langchain-ai/langchain-nvidia/pull/77
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.2.0...libs/ai-endpoints/v0.2.1
add chat tool calling by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/74
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.7...libs/ai-endpoints/v0.2.0
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.6...libs/ai-endpoints/v0.1.7
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.6...libs/ai-endpoints/v0.1.7
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.5...libs/ai-endpoints/v0.1.6
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.5...libs/ai-endpoints/v0.1.6
update default chat model to meta/llama3-8b-instruct (most features & deployment options) by @mattf in https://github.com/langchain-ai/langchain-nvidi
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.4...libs/ai-endpoints/v0.1.5
skip nvolveqa_40k compat test when run against local nim by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/70
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.3...libs/ai-endpoints/v0.1.4
make stop property functional by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/52
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.2...libs/ai-endpoints/v0.1.3
Fix for NVIDIAClient output to redact the api_key by @raspawar in https://github.com/langchain-ai/langchain-nvidia/pull/50
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.1...libs/ai-endpoints/v0.1.2
make connectors use user provided base_url when the provided model is also hosted by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/4
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.1.0...libs/ai-endpoints/v0.1.1
chore(deps): bump the pip group across 3 directories with 3 updates by @dependabot[bot] in https://github.com/langchain-ai/langchain-nvidia/pull/322
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v1.4.2...libs/openshell/v0.1.0
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.20...libs/ai-endpoints/v0.1.0
this is version 0.1.0 of the connectors with two primary changes -
all playground_* model endpoints have been decommissioned.
functionality removed -
functionality deprecated -
migration guide -
ChatNVIDIA().mode("nim", base_url="http://...") must use ChatNVIDIA(base_url="http://...")NVIDIAEmbeddings().mode("nim", base_url="http://...") must use NVIDIAEmbeddings(base_url="http://...")NVIDIARerank().mode("nim", base_url="http://...") must use NVIDIARerank(base_url="http://...")model migration, the following models will raise a warning and use an alternative (model changes in italics) -
| model | alternative |
|---|---|
| playground_llama2_13b | meta/llama2-70b |
| playground_llama2_code_13b | meta/codellama-70b |
| playground_llama2_code_34b | meta/codellama-70b |
| playground_nv_llama2_rlhf_70b | meta/llama2-70b |
| playground_phi2 | microsoft/phi-3-mini-4k-instruct |
| playground_llama2_code_70b | meta/codellama-70b |
| playground_gemma_2b | google/gemma-2b |
| playground_gemma_7b | google/gemma-7b |
| playground_llama2_70b | meta/llama2-70b |
| playground_mistral_7b | mistralai/mistral-7b-instruct-v0.2 |
| playground_mixtral_8x7b | mistralai/mixtral-8x7b-instruct-v0.1 |
| playground_deplot | google/deplot |
| playground_fuyu_8b | adept/fuyu-8b |
| playground_kosmos_2 | microsoft/kosmos-2 |
| playground_neva_22b | nvidia/neva-22b |
| playground_nvolveqa_40k | NV-Embed-QA |
fix pypi links by @efriis in https://github.com/langchain-ai/langchain-nvidia/pull/45
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.19...libs/ai-endpoints/v0.0.20
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.18...libs/ai-endpoints/v0.0.19
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.18...libs/ai-endpoints/v0.0.19
Deprecate mode() in favor of __init__(base_url=...) by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/43
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.17...libs/ai-endpoints/v0.0.18
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.16...libs/ai-endpoints/v0.0.17
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.16...libs/ai-endpoints/v0.0.17
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.15...libs/ai-endpoints/v0.0.16
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.15...libs/ai-endpoints/v0.0.16
available_models must only return known models by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/39
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.14...libs/ai-endpoints/v0.0.15
vanity model name support by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/35
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.13...libs/ai-endpoints/v0.0.14
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.12...libs/ai-endpoints/v0.0.13
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.12...libs/ai-endpoints/v0.0.13
add NVIDIARerank support for a local NIM by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/23
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.11...libs/ai-endpoints/v0.0.12
ai-llama3-8b: meta/llama3-8b -> meta/llama3-8b-instruct
Server-side model changes:
If you are using any of these models you do not need to change your code, but you must upgrade.
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.9...libs/ai-endpoints/v0.0.10
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.9...libs/ai-endpoints/v0.0.10
add truncate parameter for shortening inputs to match model token length limits by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/22
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.8...libs/ai-endpoints/v0.0.9
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.7...libs/ai-endpoints/v0.0.8
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.7...libs/ai-endpoints/v0.0.8
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.6...libs/ai-endpoints/v0.0.7
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.6...libs/ai-endpoints/v0.0.7
ci: add master core install for lint/test/dev by @efriis in https://github.com/langchain-ai/langchain-nvidia/pull/17
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.5...libs/ai-endpoints/v0.0.6
add tests for NVIDIAEmbeddings().mode("nim", base_url="http://.../v1") support by @mattf in https://github.com/langchain-ai/langchain-nvidia/pull/16
Full Changelog: https://github.com/langchain-ai/langchain-nvidia/compare/libs/ai-endpoints/v0.0.5-rc0...libs/ai-endpoints/v0.0.5
Your coding agent can read these notes before it upgrades. Set up the MCP server →