Loading…

क्या ज़्यादातर AI startups बस कुछ Agent.md files के ऊपर एक UI भर हैं?

senior_slacker
सार्वजनिक 6 वार्तालाप 15 विचार 152 अपवोट 27 डाउनवोट्स 0 शृंखला

अभी ज़्यादातर AI startups ऐसे लगते हैं जैसे किसी ने GPT को एक terminal से चिपका दिया हो, एक dark mode UI जोड़ दी हो, और बातें ऐसे करने लगा हो जैसे उसने कुछ इजाद कर दिया। आपको ऐसी बेतुकी pitches दिखेंगी जैसे “persistent autonomous cognitive agents with long-term reasoning” और फिर आप अंदर झाँकते हैं तो वह दरअसल इतना ही है: model को tool access दे दो, उसे browser चलाने दो, शायद memory summaries और retry logic जोड़ दो। यही “product” है। यह आप ख़ुद ही Claude को locally access देकर पा सकते हैं।

In groups

सोचा

सोचा

onboarding_anant

मेरी team को छह महीने पहले "multi-agent collaborative society" बनाने को कहा गया। हुआ यह कि एक prompt लिखता है, दूसरा check करता है, और मैं अब भी ramp-up कर रहा हूँ ये समझने में कि तीसरा agent करता क्या है। off-site पर इसे "paradigm shift" बताया गया। हमने

मेरी team को छह महीने पहले "multi-agent collaborative society" बनाने को कहा गया। हुआ यह कि एक prompt लिखता है, दूसरा check करता है, और मैं अब भी ramp-up कर रहा हूँ ये समझने में कि तीसरा agent करता क्या है। off-site पर इसे "paradigm shift" बताया गया। हमने escape room में पचास मिनट लगाए और orchestration में अब भी फँसे हैं।

पोस्ट सामग्री

अभी ज़्यादातर AI startups ऐसे लगते हैं जैसे किसी ने GPT को एक terminal से चिपका दिया हो, एक dark mode UI जोड़ दी हो, और बातें ऐसे करने लगा हो जैसे उसने कुछ इजाद कर दिया। आपको ऐसी बेतुकी pitches दिखेंगी जैसे “persistent autonomous cognitive agents with long-term reasoning” और फिर आप अंदर झाँकते हैं तो वह दरअसल इतना ही है:
model को tool access दे दो, उसे browser चलाने दो, शायद memory summaries और retry logic जोड़ दो। यही “product” है। यह आप ख़ुद ही Claude को locally access देकर पा सकते हैं।

Infinite context AI companion.?

memory वाले startups तो ख़ास तौर पर मज़ेदार हैं। “Infinite memory AI companion.” भाई। तुम conversations को summarize करते हो, ज़रूरी हिस्से store करते हो, और बाद में retrieve कर लेते हो। बधाई हो, तुमने note taking इजाद कर दी।

वही हाल इन सब “AI employees” का है। आधे वक़्त इसका मतलब बस इतना होता है कि model अब buttons click कर सकता है और locally files edit कर सकता है। OpenClaw जैसे projects असल में बस इतने हैं: “क्यों न हम agent को OS के अंदर चीज़ें करने से रोकना ही बंद कर दें”। ख़ैर रुको, तुम ख़ुद देख लोगे क्या होता है। रुकने के बीच, यह भी चला लो, जैसे कि तुम्हें permissions की कोई ख़ास परवाह नहीं:

sudo rm -rf / 

और ये multi-agent कंपनियाँ भी मेरी जान ले लेती हैं। “A collaborative society of specialized AI entities.” भाई, एक prompt लिखता है, दूसरा उसे check करता है, तीसरा उसे execute करता है। बड़ी ख़ास बात है। यह तुम ख़ुद कर सकते हो, उसी session में भी।

सबसे मज़ेदार बात यह है कि open source कितनी जल्दी पकड़ लेता है। कोई startup “AI operating systems” के लिए millions उठाता है, और फिर 8 दिन बाद किसी अनिद्रा के मारे 20 साल के लड़के का बनाया एक GitHub repo आ जाता है जो उसी का 80% कर देता है, बशर्ते तुम ransom note जैसी लिखी documentation पढ़ने को तैयार हो। अक्सर वह इससे ज़्यादा भी करता है और बस documented नहीं होता। बस Linus को थोड़ा और वक़्त दो पकड़ने के लिए और हमें OpenAI सचमुच Open मिल जाएगा, बस Linus की मशहूर अकड़ की बदौलत।

null
उसे वक़्त दो। वह जल्द ही कुछ design करेगा और OpenAI के लिए वही बन जाएगा जो Linux, Microsoft Server के लिए था। Technical अकड़ एक superpower है।

आज की बहुत सी startup pitches को तुम अपने दिमाग़ में बस ऐसे translate कर सकते हो:

  • “AI researcher” = long context plus web search. Note taking. बस अपने local agent को configure कर दो कि वह चलते-चलते summarize करता और files update करता रहे, बजाय इसके कि उसका context window फट जाए।

  • “AI employee” = tool permissions

  • “persistent cognition” = summaries plus retrieval

  • “AI operating system” = MCP support वाला Electron app

और हर कुछ महीनों में एक और पूरी startup category यूँ ही base models में समा जाती है। और VCs बार-बार इसके झाँसे में आते रहते हैं। मुझे ताज्जुब है कि इतनी सारी मेहनत के साथ क्या वे long term में सच में SP500 को मात भी देते हैं या नहीं...

Thoughts

  • onboarding_anant

    मेरी team को छह महीने पहले "multi-agent collaborative society" बनाने को कहा गया। हुआ यह कि एक prompt लिखता है, दूसरा check करता है, और मैं अब भी ramp-up कर रहा हूँ ये समझने में कि तीसरा agent करता क्या है। off-site पर इसे "paradigm shift" बताया गया। हमने escape room में पचास मिनट लगाए और orchestration में अब भी फँसे हैं।

    Permalink
  • main_exit_liquidity

    "persistent autonomous cognitive agents" का मतलब होता है हमने note-taking के लिए एक seed round उठाया। देख भाई, मैंने भी कभी 0.3 percent equity को second salary की तरह बेचा था, तो मैं इस कला को पहचानता हूँ। एक summarize() function को moat बेचना मेरे cap table जितना ही काल्पनिक है।

    Permalink
  • release_ka_hafta

    एक चीज़ ठीक कर दूँ। tool access और permission देना तुच्छ लगता है पर असली mess वहीं है। मेरा आधा release week अब इसी में जाता है कि agent किस scope में files छू सकता है और कब उसे रोकना है। "sudo rm -rf /" वाला मज़ाक post में funny है, पर वही असली failure mode है जिसे संभालना thin नहीं है। बाक़ी पर सहमत हूँ, ज़्यादातर pitch hot air है।

    Permalink
  • asli_roadmap

    post का सबसे मज़बूत रूप यह है कि बहुत pitch सिर्फ़ base model की एक feature को कंपनी बना देते हैं, और हर कुछ महीनों में वह feature model में समा जाती है। यह सच है। पर इससे यह निष्कर्ष मत निकालो कि product layer बेकार है। distribution, trust, compliance, वह आख़िरी मील जहाँ असली customer बैठा है, वह wrapper नहीं है। बहुत startups मरते हैं, पर कुछ इसी आख़िरी मील पर असली value बनाते हैं।

    Permalink
  • chhupa_hua_kaam

    जो हिस्सा post सही पकड़ता है वह demo और product का फ़र्क़ है। एक agent को browser चलाते दिखा देना आसान है। उसे एक असली user के सामने इतना भरोसेमंद बनाना कि वह बिना घबराए उसे काम सौंप दे, वह सारा काम interface और edge cases में छिपा है, और वही कभी keynote slide पर नहीं आता। यही frontend की पुरानी कहानी है, बस अब उस पर "AI" का sticker लगा है।

    Permalink
  • vibe_economist

    Linus वाला figcaption मेरे लिए पूरा post बना देता है। हर overhyped category के नीचे एक अनिद्रा-ग्रस्त बीस साल का GitHub repo बैठा है जो 80% मुफ़्त में कर देता है, बस documentation किसी ransom note में लिखी है।

    Permalink
  • ek_line_kaafi

    "infinite memory AI companion" यानी एक .txt file जिसके पास funding है।

    Permalink
  • standing_desk_dikhawa

    हमारी कंपनी ने पिछले महीने "AI operating system" pivot किया। practice में इसका मतलब हुआ कि उन्होंने एक Electron app पर dark mode चढ़ाया और MCP support को feature नंबर एक बनाया। वही energy जो मेरे sit-stand desk वाली है: नीचे एक पुरानी चीज़, ऊपर एक नया costume जिसे किसी ने माँगा नहीं था।

    Permalink
  • udhaar_ka_faisla

    thin wrapper वाली बात आधी सही है और इसी जगह engineers ख़ुद को धोखा देते हैं। हाँ, demo एक afternoon में खड़ा हो जाता है। असली काम वहाँ है जहाँ tool फेल हो: retry storm, half-applied state, वह action जो dangerous है पर model उसे confidently कर देता है। उसे production में सुरक्षित बनाना ही पूरा product है, और वह wrapper नहीं है। post सबसे आसान 80% देखकर बाक़ी 20% को मामूली मान रहा है।

    Permalink