DeepSeek के API में बिल्ट-इन वेब सर्च — Responses API से आधिकारिक सर्च मुफ़्त में पाएँ
DeepSeek ने API में ही वेब सर्च बना दिया है: Responses इंटरफ़ेस से deepseek-v4-flash को कॉल करें और web_search टूल घोषित कर दें। न थर्ड-पार्टी सर्च इंजन जोड़ना पड़ता है, न अलग सर्च API की चाबी चाहिए।
Chen Dahuang
इंडी डेवलपर

मूल रूप से X पर प्रकाशित। यह पोस्ट खूब चली — 2.3 लाख से ज़्यादा व्यूज़, 1000+ लाइक्स। यहाँ मैं बारीकियाँ पूरी तरह खोलकर समझाऊँगा।
एक बढ़िया चीज़ मिली है: DeepSeek ने अपने API के अंदर ही वेब सर्च शिप कर दी है।
एक वाक्य में
Responses इंटरफ़ेस के ज़रिए deepseek-v4-flash मॉडल को कॉल करें। बस रिक्वेस्ट के पैरामीटर्स में web_search टूल घोषित कर दीजिए, और DeepSeek की सर्वर-साइड सर्च क्षमता सीधे मिल जाती है।
न तो थर्ड-पार्टी सर्च इंजन जोड़ना पड़ता है, न अलग से सर्च API की चाबी माँगनी पड़ती है — पूरी सर्च पाइपलाइन DeepSeek की तरफ़ से होस्ट की जाती है।
कैसे इस्तेमाल करें
आधिकारिक दस्तावेज़: https://api-docs.deepseek.com/zh-cn/guides/responses_api
असल काम सिर्फ़ इतना है कि टूल घोषित कर दिया जाए:
const response = await fetch('https://api.deepseek.com/responses', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': `Bearer ${process.env.DEEPSEEK_API_KEY}`
},
body: JSON.stringify({
model: 'deepseek-v4-flash',
tools: [{ type: 'web_search' }],
input: 'What major things happened in the AI industry in August 2026?'
})
})
बस इतना ही। बाकी का सर्च, फ़ेचिंग, पार्सिंग और सिटेशन — सारा काम DeepSeek सर्वर पर होता है।
यह मायने क्यों रखता है
पहले AI को रीयल-टाइम जानकारी देने के लिए पूरी पाइपलाइन खुद बनानी पड़ती थी: सर्च इंजन चुनो (SerpAPI, Bing Search, वगैरह) → API की चाबी लो → फ़ेच और पार्स करने का कोड लिखो → नतीजों को कॉन्टेक्स्ट में डालो → और बजट पर भी नज़र रखो।
इसमें कम से कम एक-दो दिन लग जाते हैं, रुकावटें आएँ तो शायद पूरा हफ़्ता, और हर कदम पर पैसा खर्च होता है: सर्च API हर रिक्वेस्ट पर बिल करते हैं, और स्क्रेपिंग का मतलब है एंटी-बॉट उपायों से जूझना।
अब DeepSeek ने यह सब सीधे बिल्ट-इन कर दिया है, और वह भी बेतहाशा सस्ते deepseek-v4-flash मॉडल के साथ। सर्च और जनरेशन एक ही पाइपलाइन में, इतना सस्ता कि नल के पानी की तरह इस्तेमाल हो सकता है।
अच्छे उपयोग-मामले
- समय-संवेदनशील सामग्री लिखना (इंडस्ट्री की ख़बरें, प्रोडक्ट तुलनाएँ, नीतियों की व्याख्या)
- एजेंट बनाना: फ़ैसले लेने से पहले जानकारी खोजने वाले कदम
- कस्टमर सपोर्ट / सवाल-जवाब सिस्टम: जवाब देने से पहले ताज़ा जानकारी सर्च करना
- हर वह परिदृश्य जहाँ मॉडल की ज्ञान-कटऑफ़ तारीख़ आड़े आती है
नोट्स
- Responses इंटरफ़ेस ही इस्तेमाल करें, पुराने Chat Completions इंटरफ़ेस का नहीं। पुराने इंटरफ़ेस में यह टूल है ही नहीं।
- वेब सर्च की बारीकियाँ और सिटेशन का फ़ॉर्मैट आधिकारिक दस्तावेज़ों में दिया हुआ है — एक बार चलाकर रिस्पॉन्स की संरचना ज़रूर देख लें।
- कैश डिस्काउंट का तंत्र है — लंबे कॉन्टेक्स्ट वाले हालात में इसका फ़ायदा उठाएँ, काफ़ी बचत होगी।
यह सच में मुफ़्त का तोहफ़ा है: आधिकारिक टीम ने सर्च इन्फ्रास्ट्रक्चर का सबसे कष्टदायक हिस्सा मुफ़्त में दे दिया है। जिसे ज़रूरत हो, वह सीधे होमवर्क कॉपी कर ले।
संबंधित: DeepSeek V4 Flash — स्थिर रिलीज़ की हैंड्स-ऑन समीक्षा
संबंधित लेख
05.08.2026 · 7 मिनट
DeepSeek V4 Flash स्थिर रिलीज़, हैंड्स-ऑन अनुभव: सस्ता, तेज़, 1M कॉन्टेक्स्ट, बिल्ट-इन सर्च
स्थिर DeepSeek V4 Flash रिलीज़ में कुछ दिनों की गहरी पड़ताल: बेतहाशा सस्ता, बिजली की रफ़्तार, 1M कॉन्टेक्स्ट, आधिकारिक बिल्ट-इन वेब सर्च और पूरी तरह ओपन-सोर्स। इकलौती कमज़ोरी है मल्टीमॉडल क्षमता — लेकिन दूसरे मॉडलों के साथ जोड़कर इसे पूरा किया जा सकता है।
06.08.2026 · 5 मिनट
DeepSeek को मल्टीमॉडल बनाना: Qwen-3.7-Flash विज़न तरीका
DeepSeek V4 Flash में मल्टीमॉडल क्षमता नहीं है — इमेज समझने के लिए क्या करें? बाज़ार का सर्वे करने के बाद फ़िलहाल सबसे किफ़ायती विकल्प Qwen-3.7-Flash है: एक इमेज पहचानने की लागत लगभग न के बराबर, और इसे V4 Flash के साथ जोड़कर कमी पूरी हो जाती है।