LLM/Foundation Model Service

ArchiMate-element LLM/Foundation Model Service
ArchiMate_Component.png
Elementtype  : ApplicationComponent
Element-id  : Id-48c879ce-e72f-9d08-fb7d-a744967d8d6c
ArchiMate-model  : AI-BOK Referentiearchitectuur
Label  : LLM/Foundation Model Service
Documentatie  : Inferentie-endpoint voor taalmodellen. Biedt tekst-, beeld- en codegeneratie via foundation models.
Lifecycle-phase  : Current
Plane  : Cognition Plane
Vendor-dependency  : Commercial
Deployment-model  : SaaS / On-premise
Integration-protocol  : REST API / OpenAI-compatible
Availability-sla  : 99,9% (business hours)
Data-sensitivity  : Hoog (prompts kunnen persoonsgegevens bevatten)
Dct_source  : AI-BOK v1.0, Module 3, sectie 3.6.5a, p.163
ArchiMate-views  : 
Relaties  : 
Contextdiagram
Inferentie-endpoint voor taalmodellen. Biedt tekst-, beeld- en codegeneratie via foundation models. (ApplicationComponent) LLM/Foundati- on Model Service Node AWS Bedrock Modelselectie, versiebeheer en model card raadpleging. (ApplicationService) Model Management Service Node Google Gemini Tekstgeneratie, classificatie, embedding via foundation models. (ApplicationService) AI Inferentie Service Node Meta LLaMA Node Cohere Node Anthropic Claude Node vLLM Node Azure OpenAI Service Een geavanceerde vorm van AI die complexe patronen in data herkent via gelaagde neurale netwerken, nuttig voor beeldherkenning, spraakverwerking en taalbegrip. (Meaning) Neurale Netwerken Een type neuraal netwerk, vooraf getraind op veel tekstdata, dat duidelijke en relevante tekst genereert op basis van prompts (Meaning) GPT Input/output-filtering, content moderation, prompt injection detectie en veiligheidscontroles. (ApplicationComponent) Guardrails Engine Retrieval-Augmented Generation: haalt relevante context op uit kennisbronnen en voedt deze aan het LLM. (ApplicationComponent) RAG Pipeline Registratie, validatie en versiebeheer van AI-modellen. (BusinessFunction) AI Modelbeheer Redenering, interpretatie, besluitvorming door AI. (Grouping) Cognition Plane Node TorchServe Node OpenAI GPT- 4o Gecontroleerde toegang tot AI-endpoints met rate limiting en routing. (ApplicationService) API Access Service Node TensorFlow Serving Continue monitoring van prestaties, drift, kosten en anomalieën. (ApplicationService) Monitoring & Observability Service Een gespecialiseerd type generatief AI-model dat getraind is op grote hoeveelheden tekst om bestaande content te begrijpen en tekstuele content te generen. (Meaning) Large Language Model Node Triton Inference Server Een vorm van artificiële intelligentie die content (tekst, afbeeldingen en/of gevarieerde inhoud zoals muziek) kan produceren (genereren) op basis van de gegevens waarop het wordt getraind. (Meaning) Generatieve AI On-demand serving van ML-features voor training en inferentie. (ApplicationService) Feature Serving Service De manier waarop computers nieuwe dingen leren zonder expliciete programmering, door te leren van gelabelde data om voorspellingen te doen. (Meaning) Natuurlijke Taalverwerking Open Neural Network Exchange formaat. (Constraint) ONNX RealizationRelationship ServingRelationship RealizationRelationship RealizationRelationship RealizationRelationship RealizationRelationship RealizationRelationship RealizationRelationship RealizationRelationship AssociationRelationship AssociationRelationship ServingRelationship ServingRelationship ServingRelationship CompositionRelationship RealizationRelationship RealizationRelationship ServingRelationship RealizationRelationship ServingRelationship AssociationRelationship RealizationRelationship AssociationRelationship ServingRelationship AssociationRelationship AssociationRelationship van toepassing op Deze svg is op 07-04-2026 16:31:23 CEST gegenereerd door ArchiMedes™ © 2016-2026 ArchiXL. ArchiMedes 07-04-2026 16:31:23 CEST