Agentische AI
Assistenten die gereedschap gebruiken en echte acties uitvoeren, antwoorden verankerd in uw eigen inhoud, en evaluatie die aantoont dat het standhoudt. Op Claude, Gemini of GPT, of op open-weight modellen op hardware die u beheert.
Agentische AI, productengineering en de infrastructuur om beide te draaien.
digitalcosmos.io is een engineeringpraktijk in Haarlem die serieuze software bouwt en die daarna draaiende houdt. AI-systemen die gereedschap gebruiken en handelen in plaats van alleen praten, verankerd in uw eigen data en gemeten voordat een klant het voor u doet. Daaronder: multi-tenant platformen, cloudomgevingen die volledig als code zijn vastgelegd, en al het weinig glamoureuze beheerwerk dat bepaalt of het maandagochtend nog overeind staat.
Een engineeringpartner beoordeelt u het scherpst aan iets dat volledig van hem is. Niet een onderdeel waaraan hij meewerkte, maar een levend systeem dat hij heeft ontworpen, gebouwd en uitgeleverd, en waarvoor hij om drie uur ’s nachts nog altijd verantwoordelijk is. Naast klantwerk draaien wij precies dat: een eigen multi-tenant platform, met een webapplicatie, native mobiele apps, AI-diensten, vier productiedatabases en de cloudomgeving daaronder.
Vrijwel alles wat hier beschreven staat, is daar eerst bewezen. De AI is verankerd en gemeten omdat de onze echte klanten moest overleven. Tenantscheiding wordt door de database afgedwongen omdat controles in de applicatielaag niet volstonden. Uitrollen is saai omdat wij degenen zijn die anders gebeld worden. Niets hiervan is theorie die we ergens gelezen hebben.
Klantwerk blijft vertrouwelijk. Dit platform is van ons, en daarom kunnen we het zo gedetailleerd beschrijven.
De meeste AI-projecten stranden niet op het model. Ze stranden op de retrieval, het datamodel, de rechten, de kosten, of op het feit dat niemand er om drie uur ’s nachts eigenaar van is. Wij bouwen zowel de intelligentie als het leidingwerk eronder, zodat er niets tussen wal en schip valt.
Assistenten die gereedschap gebruiken en echte acties uitvoeren, antwoorden verankerd in uw eigen inhoud, en evaluatie die aantoont dat het standhoudt. Op Claude, Gemini of GPT, of op open-weight modellen op hardware die u beheert.
Zoeken dat werkelijk vindt: hybride vector- en trefwoordzoeken, rangfusie, per taal gescheiden indexen en attributie op chunkniveau, zodat elk antwoord naar zijn bron te herleiden is.
Webplatformen en interne tools gebouwd als langlevende producten: getypeerd van database tot interface, getest waar het ertoe doet, en zo opgezet dat de tiende functie net zo goedkoop is als de eerste.
Native Android- en iOS-apps vanuit één gedeelde codebase, naast de webapplicatie, met platforminloggen, pushmeldingen, camera- en bestandstoegang en storereleases als onderdeel van de gewone uitleverstraat.
Reproduceerbare omgevingen als code, containerpipelines, blue-green releases en terugrolacties die met opzet saai zijn. Uitrollen houdt op een gebeurtenis te zijn.
Schemas die op schaal begrijpelijk blijven, strikte tenantscheiding, vectoropslag afgestemd op het embeddingmodel, migraties die nooit een productietabel blokkeren, en back-ups die daadwerkelijk zijn teruggezet.
Single sign-on, fijnmazige toegangscontrole en onveranderlijke audittrails, doorgetrokken naar de agent: gereedschappen ontlenen hun identiteit aan de geverifieerde sessie, niet aan wat het model schreef.
Websockets, berichtenwachtrijen, event-pipelines, betaal- en facturatiestromen, transactionele e-mail en externe APIs zo verbonden dat storingen afzwakken in plaats van doorslaan.
Grote taalmodellen zijn makkelijk te demonstreren en moeilijk te beheren. Het interessante werk zit rondom het model: antwoorden verankeren in uw echte data, de agent gereedschap geven dat hij veilig kan gebruiken, kiezen wat op een gehoste API draait en wat op eigen hardware, en kwaliteit meten voordat een klant dat voor u doet.
Betrouwbaarheid is hier een architectuurvraagstuk, geen promptvraagstuk. Dit werk hebben wij al opgeleverd en draaien wij in productie, met echte kosten- en latentiedoelen in plaats van op een slide.
Gebouwd op Anthropic Claude, Google Gemini en OpenAI GPT, plus zelf gehoste open-weight modellen
U spreekt met de persoon die de code schrijft. Er is geen accountlaag waar vragen doorheen moeten en geen ceremonie die alleen bestaat om over te rapporteren.
We beginnen bij de beperking die echt pijn doet: de deadline, de kosten, de audit, het proces waarvan niemand wil toegeven dat het handwerk is. Technologiekeuzes komen daarna, nooit ervoor.
Een architectuur die te lezen is: datamodel, grenzen, hosting, faalscenarios en een realistische raming, opgeschreven voordat iemand een editor opent.
Korte iteraties met aan het eind steeds iets toonbaars. Continue integratie vanaf dag één, zodat de uitrolbare toestand altijd de huidige toestand is.
Monitoring, back-ups, patches en een gedocumenteerd herstelpad. Software is niet af als ze live gaat, maar als ze onbewaakt draait.
Functies toevoegen kan iedereen. De waarde zit in weten welke u de komende vijf jaar geld gaan kosten.
Heldere grenzen, getypeerde interfaces, zinvolle tests en documentatie geschreven voor wie het overneemt. Ook als dat niet wij zijn.
Wij beheren wat wij bouwen. Dat ene feit verandert elke ontwerpbeslissing, want er is niemand anders om de gevolgen aan door te geven.
U hoort het als een eenvoudiger optie beter is, als een functie haar complexiteit niet waard is, en als het antwoord een procesverandering is in plaats van code.
Geen verkoopquota en geen voorkeursleverancier. Adviezen volgen uit wat bij uw budget en uw team past, en alles wat wij maken is van u.
Stuur een paar alinea’s over het probleem. U krijgt een eerlijk antwoord of het past, een globale vorm van de oplossing en een reële raming, geheel vrijblijvend.
Doorgaans antwoord binnen één werkdag.