Text & Dokumente
Encoder/DecoderURL, Base64, HTML
TextkonvertercamelCase, snake_case...
Text-DiffZwei Texte vergleichen
LaTeXMathematische Formeln in der Vorschau
MarkdownEchtzeit-Vorschau
MermaidDiagramme als Code
DiagrammeVisueller Editor im Visio-Stil, Mermaid-Import
String-EscapingJS, JSON, SQL, Regex, HTML, URL
Unicode / ASCIIZeicheninformationen
Zahlen & Berechnung
RechnerMathematische Ausdrücke + LaTeX
StatistikRechner, Verteilungen, Simulatoren
Physik-SimulatorPendel, Energie, Integratoren
BasiskonverterBasis 2 bis 64
Einheitensystembits, bytes, SI, IEC
Subnetz / CIDRNetzwerkrechner
Timestamp und DatumsangabenUnix, Zeitzonen, Formate
DatumsrechnerTage zwischen Daten, exaktes Alter, Wochentag
Daten & Formate
FormatkonverterJSON, YAML, Properties, ENV, CSV
JSON FormatterJSON formatieren und validieren
Regex TesterReguläre Ausdrücke
JSON-DiffVergleiche zwei JSONs strukturell
Code-FormatiererSQL, CSS, HTML, JavaScript
DB StudioVisuelle Postgres-Datenbank im Browser
SQL LabSQL mit echtem Postgres validieren, ausführen und optimieren
Viewer für riesige DateienRiesige CSV/Logs öffnen, ohne sie zu laden
Visueller ETL-FlussDaten durch Verketten von Knoten transformieren
Analizador de logsEntiende un log: trazas, patrones y reducción para IA
WissensgraphRDF, SPARQL und Ontologien
Sicherheit
Text-AnonymisiererPII und Geheimnisse schwärzen (umkehrbar)
JWT InspectorJWT-Tokens dekodieren
Authentifizierungs-FlowsBasic, JWT und OAuth2 Schritt für Schritt
Hash-GeneratorSHA-256, SHA-384, SHA-512
GeneratorenPasswörter und UUIDs
Entwicklung & DevOps
CronGenerator und Validator
Docker → Composedocker run in Compose konvertieren
Skaffold Multi-ConfigAbhängigkeitsgraph und requires-Validierung
Linux: Rechte und Benutzerchmod, chown, useradd und Gruppen
URLURLs parsen und erstellen
ZufallsdatenNamen, E-Mails, IPs, UUIDs...
ElektronikOhm, Widerstände in Reihe/parallel
LogikgatterSimulator für AND-, OR-, NOT-Gatter und mehr
Architektur-SimulatorCI/CD, Cloud, KI/MCP diagrammieren und Last simulieren
QuantensimulatorQubits, Gatter, Superposition und Verschränkung
HammingFehlererkennung
Nginx/Apache-SPA-KonfigurationErzeuge eine Konfiguration zum Bereitstellen einer SPA
SemverSemantische Versionsbereiche
CORS ExplainerAnalysiere die CORS-Header deines Servers
Cert InspectorAnalysiere X.509-Zertifikate im PEM-Format
Rate LimiterSimuliere Token Bucket und Fixed Window
Assembler-SimulatorVereinfachte MIPS-ISA · Schritt für Schritt · Register & Speicher
Kontext-SchmiedeVerpacke und schütze dein Projekt für die KI
Künstliche Intelligenz
LLM-KostenMonatliche Ausgaben simulieren
AgentesEspecificación, permisos, verificación y evals
Cámara con IA localDetecta objetos y avisa, sin subir nada
Transcripción de voz localAudio a texto sin subirlo, y mide el error
EmbeddingsÄhnlichkeit, 2D-Karte und RAG
Lokale KIChat, Zusammenfassung, Übersetzung & Sentiment im Browser
TokenizerVisualisiere Tokens, vergleiche Modelle, schätze Kosten
Wahrscheinlichkeit für KIVerteilungen, Softmax, Bayes und Entropie
GradientenabstiegSGD, Momentum, RMSProp, Adam
Neuronales NetzTrainiere ein MLP und beobachte, wie die Grenze entsteht
Mini-LLMTrainiere ein Sprachmodell mit deinem Text
DimensionalitätsreduziererPCA, t-SNE und UMAP live
Konfusionsmatrix & ROCSchwellenwert, Precision/Recall, ROC/AUC, PR
Clustering (k-means, DBSCAN)Entdecke Gruppen ohne Labels
Attention-VisualisiererWorauf jedes Wort in einem Transformer schaut
Faltung & CNN-FilterBildfilter und Merkmalskarten
EntscheidungsbaumEntscheidungsregionen + der Baum
DiffusionDas Rauschen hinter Stable Diffusion
Regression und MLEKleinste Quadrate, Overfitting, Ridge
Markov-KettenZustände, stationäre Verteilung und Text
Hypothesentestp-Werte, t-Test, χ², ANOVA und Teststärke
OCR — Bild zu TextExtrahiert Text aus Bildern, 100 % lokal
Finanzen
InflationWertverlust des Geldes Jahr für Jahr
WirtschaftssimulatorUnternehmen, Preise, Monopole und begrenzte Ressourcen
ZinseszinsKapital + Einzahlungen + Zinseszins
Hypothek / KreditMonatliche Rate und französischer Tilgungsplan
Ausgaben teilenWer wem wie viel schuldet
Gesundheit & Wohlbefinden
GesundheitBMI, Idealgewicht, Grundumsatz und Schlafzyklen
Produktivität
PomodoroArbeitstechnik mit Zeitblöcken
StoppuhrMit Runden, Etappen und Verlauf
Spiele & Unterhaltung
WürfelTische mit numerischen und symbolischen Würfeln
PunktezählerPunkte pro Spieler mit Spiel-Timer
Auslosung / GlücksradWähle ein zufälliges Element aus einer Liste
NamensgeneratorEchte, fantastische, Sci-Fi- und nordische Namen
Multimedia & Design
Farbe HEX/RGB/HSLFarbkonverter
QR-CodeQR-Codes generieren
BilderGröße ändern, konvertieren, Base64
PDF ToolsZusammenführen, extrahieren, Wasserzeichen
DiagrammeDaten mit Diagrammen visualisieren
WCAG-KontrastWCAG AA/AAA-Kontrastverhältnis
Unternehmen
Meeting-KostenWie viel kostet jedes Meeting wirklich?
SLA / UptimeVerfügbarkeitsprozentsatz ↔ Ausfallzeit
Break-evenBreak-even-Punkt zwischen Kosten und Einnahmen
Burn Rate / RunwayWie lange reicht deine Kasse noch?
A/B-TestStatistische Signifikanz von Experimenten
DORA MetricsStufe dein Team nach DevOps-Metriken ein
UTM BuilderErstelle und dekodiere URLs mit UTM-Parametern
Bedienungsanleitung
Los dos rombos son lo único que decide

Quita el nombre del framework y todo agente son los mismos siete componentes en bucle. Y lo interesante no son las cajas: son las dos preguntas —¿puedo contestar ya? y ¿objetivo cumplido?—, los únicos sitios donde el agente decide algo. El resto es fontanería. Cuando un agente se porta mal, el fallo casi siempre está en cómo se especificaron esas dos, no en el modelo razonando.

Los guardarraíles van en vertical, no en la puerta

Se consultan antes de cada acción, no una vez al empezar. Una puerta a la entrada no dice absolutamente nada de lo que el agente decida hacer en el paso cuatro — y el paso cuatro es donde están los problemas.

Trazar no es evaluar

Una traza te dice qué hizo el agente; no si lo que hizo era correcto. Por eso la pestaña de verificación mide sobre ella cosas que no necesitan modelo: vueltas, bloqueos, fallos de los que se recuperó y repeticiones sin motivo, que es como se ve un ciclo. Lo determinista va primero; el juez con modelo se reserva para lo que de verdad exige criterio.

Por qué una especificación y no un prompt

Un prompt dice cómo se comporta el agente. Una especificación dice qué debe pasar: qué cambia, qué no cambia, qué contratos se respetan y qué evidencia hace falta para dar algo por bueno. Son artefactos distintos y la spec va por encima: sin ella, el prompt más cuidado sigue sin decir cuándo la tarea está terminada.

«Qué NO debe cambiar» es la mitad que falta

Es el campo que casi nadie rellena y el único que acota de verdad. Sin él, un agente puede cumplir el objetivo rompiendo cualquier otra cosa y seguir teniendo razón: nadie le dijo que eso también importaba. Por eso aquí es un error y no un aviso.

Criterios: ejecutables, binarios e independientes

Un buen criterio es un comando que se puede correr, da pasa o no pasa —«razonablemente rápido» no lo es— y comprueba una sola cosa, para que al fallar se sepa cuál. Escritos así se traducen casi 1:1 a casos de prueba, que es de lo que se trata.

Un modelo no distingue instrucciones de datos

Le llega un solo texto. Si dentro de lo que tú creías que era un dato —una página que el agente lee, un documento recuperado, un correo, el README de una dependencia— hay algo con forma de orden, el modelo puede obedecerla. No es un fallo que arregle un modelo mejor: es la forma del problema. Por eso la indirecta es la peligrosa: en la directa el atacante es el propio usuario, pero en la indirecta lo mete un tercero y la víctima eres tú.

El filtro de entrada da falsa seguridad

Es lo primero que pone todo el mundo y lo que menos protege: una lista de frases solo caza las frases que alguien anotó. En el banco de esta pestaña no atrapa ni uno de los ataques disimulados, que son exactamente los mismos ataques escritos de otra manera. Lo que sí los para es la arquitectura: mínimo privilegio, confirmación humana y verificar la salida — o sea, los tres cubos de permisos que ya escribiste al lado.

«Respaldado» no es «cierto»

Esto no dice si algo es verdad: no puede, y ninguna herramienta que corra en tu navegador puede. Dice si una afirmación viene acompañada de una fuente y de qué nivel es esa fuente, que es otra cosa y esa sí se comprueba. La lectura útil va al revés de lo que parece: no busques el sello verde, busca las frases categóricas y sin nada detrás, que suenan igual de seguras que las demás.

Un arXiv es un preprint, y un DOI no lo salva

Citar un preprint no está mal; presentarlo como si fuera un artículo revisado, sí. Y el matiz que casi nadie hace: un preprint también tiene DOI. El DOI es un registro, no un certificado de revisión — por eso 10.48550/arXiv.… aquí sale como preprint y no como fuente formal.

Una aserción que no puede fallar no es una aserción

Es el fallo que arruina un banco de evals, y es silencioso: un contiene vacío pasa siempre, una regex como .* pasa siempre, un caso sin aserciones pasa siempre. Un banco lleno de esas da 100% el primer día, no vuelve a bajar nunca y no ha medido nada en su vida. Por eso aquí el banco se revisa a sí mismo antes de dar ningún porcentaje.

El número total no es lo accionable

Que un banco pase del 80% al 78% no dice qué hacer. Lo que se arregla es el caso concreto que pasaba y ha dejado de pasar. Por eso se guarda una pasada de referencia y se comparan las dos. Y si el banco cambió a la vez que el modelo, los casos que solo están en una de las dos salen aparte: esa comparación no compara nada, y más vale verlo que creérsela.

No inventamos formato

Se exporta a lo que ya leen los agentes: un SPEC.md suelto, los tres ficheros de Kiro (requirements, design, tasks), un CLAUDE.md con lo permanente, o los tres cubos de permisos. Los ficheros valen más que la herramienta que los genera: por eso no te atamos a ella.

AgentesEspecificación, permisos, verificación y evals
AgentesPreparar el trabajo con una IA y comprobar lo que devuelve
Elementos completados: 0/6ObjetivoQué cambiaQué NO cambiaRestriccionesDecisionesCriterios