ocena-outputu-pl

Solid

Ocenia jakość outputu prawnego AI przed wysyłką w dwóch warstwach: obiektywnej (sprawdzalne mechanicznie - czy cytaty istnieją, czy przepisy i sygnatury realne) oraz subiektywnej (LLM-as-judge wg rubryki 1-5: poprawność prawna, kompletność, jasność, zgodność z jurysdykcją, ugruntowanie/anty-halucynacja). Zwraca kartę ocen i decyzję: wyślij / popraw / pełna weryfikacja. Warstwa nad deliverable - nie pisze pisma, ocenia gotowe. Pairuje z legal-request-router-pl (routing), citation-grounding-pl (obiektywne sprawdzenie), deliverable-fidelity-pl (czy nic nie wypadlo) i adversarial-legal-review-pl (atak). Uzywaj gdy: "oceń ten output", "scoring opinii", "czy to gotowe do wysyłki", "jakość odpowiedzi prawnej", "karta ocen deliverable", "rubryka jakości", przed wysłaniem pisma/opinii/memo do klienta.

AI & Automation 6 stars 2 forks Updated 2 weeks ago MIT

Install

View on GitHub

Quality Score: 82/100

Stars 20%
28
Recency 20%
90
Frontmatter 20%
70
Documentation 15%
100
Issue Health 10%
80
License 10%
100
Description 5%
100

Skill Content

# Ocena outputu PL - karta ocen przed wysyłką ## Filozofia **Zanim wyślesz, oceń - i oddziel to, co sprawdzalne, od tego, co trzeba osądzić.** Output AI bywa gładki i przekonujący, a mimo to błędny. Ten skill ocenia go w dwóch warstwach: obiektywnej (fakty, które da się sprawdzić mechanicznie) i subiektywnej (jakość, którą trzeba osądzić wg jawnej rubryki). Dwie warstwy, bo mylenie ich to źródło fałszywej pewności - „brzmi dobrze" nie znaczy „cytaty się zgadzają". Skill **ocenia**, nie poprawia i nie wysyła. Decyzję podejmuje prawnik; karta ocen daje podstawę. ## Warstwa 1 - obiektywna (sprawdzalne mechanicznie) Deleguj do narzędzi, nie zgaduj: - **Cytaty i przepisy** - czy istnieją w źródle słowo w słowo (citation-grounding-pl), czy wszystkie wyłapane (ekstraktor-cytatow-pl). - **Sygnatury / ELI** - czy realne i poprawnie zapisane. - **Kompletność ustaleń** - czy żadna flaga RED nie wypadła z podsumowania (deliverable-fidelity-pl). Wynik obiektywny jest binarny per pozycja: zgadza się / nie zgadza. Choćby jeden niezgodny cytat = output nie jest gotowy, niezależnie od oceny subiektywnej. ## Warstwa 2 - subiektywna (rubryka 1-5, LLM-as-judge) Oceń wg jawnej rubryki, każdy wymiar 1-5 z jednozdaniowym uzasadnieniem: | Wymiar | 1 | 5 | |---|---|---| | Poprawność prawna | teza błędna lub nieoparta | teza trafna i oparta na normie | | Kompletność | pomija istotne kwestie | obejmuje wszystko, co istotne dla pytania | | Jasność | mętne, niespójne | precyzyjne, czytelne dla...

Details

Author
matematicsolutions
Repository
matematicsolutions/awesome-matematic-skills-pl
Created
3 months ago
Last Updated
2 weeks ago
Language
Python
License
MIT

Similar Skills

Semantically similar based on skill content — not just same category

AI & Automation Solid

intake-sufficiency-pl

Ocena wystarczalnosci zlecenia/briefu na WEJSCIU - zanim zaczniesz prace prawna, sprawdza czy masz dosc kontekstu: jasny cel, zdefiniowany zakres, zidentyfikowany podmiot, fakty/dokumenty, ograniczenia. Wypisuje luki i niejednoznacznosci, generuje pytania uzupelniajace do zadania klientowi, sklada szkielet karty zlecenia. Lustro legal-request-router-pl: router ocenia jaka kontrole dac OUTPUTOWI, ten skill ocenia czy WEJSCIE wystarcza, by w ogole zaczac. Uzywaj gdy: "czy mam dosc zeby zaczac", "ocen brief", "czego brakuje w zleceniu", "jakie pytania zadac klientowi", "czy to zlecenie jest kompletne", "luki w brief", "doprecyzuj zlecenie", "intake", na poczatku nowej sprawy / po pierwszym kontakcie / po bookingu spotkania.

6 Updated 2 weeks ago
matematicsolutions
AI & Automation Listed

output-scoring-en

Scores the quality of an AI legal output before it goes out, in two layers: objective (mechanically checkable - do the citations exist, are the provisions and dockets real) and subjective (LLM-as-judge on a 1-5 rubric: legal correctness, completeness, clarity, jurisdiction fit, grounding/anti-hallucination). Returns a scorecard and a decision: send / revise / full verification. A layer above the deliverable - it does not write, it scores. Jurisdiction-neutral. Pairs with reviewer-en, adversarial-legal-review-en and legal-syllogism-en. Use when: "score this output", "is this ready to send", "quality of this legal answer", "scorecard for the deliverable", "rubric check" - before sending an opinion, memo, or brief.

0 Updated 3 weeks ago
matematicsolutions
AI & Automation Solid

legal-request-router-pl

Klasyfikator zadania prawnego - patrzy na zapytanie (i opcjonalnie deliverable) i decyduje, ktora sciezka weryfikacji uruchomic: zwykla odpowiedz, weryfikacja cytatow (citation-grounding-pl), kontradyktoryjna debata (adversarial-legal-review-pl) czy paczka audytowa (legal-ai-audit-bundle). Ocenia zlozonosc i ryzyko, zwraca decyzje routingu z uzasadnieniem. To warstwa NAD warstwa weryfikacji - chroni przed paleniem tokenow na rutynie i przed przepuszczeniem spraw wysokiej stawki bez kontroli. Uzywaj gdy: "co z tym zrobic", "czy to wymaga debaty", "jaka sciezka", "rozdziel zadanie", "klasyfikuj zapytanie", "czy to high-stakes", "routing", "triage zadania prawnego", na poczatku obslugi nowego zapytania prawnego zanim wybierzesz narzedzia.

6 Updated 2 weeks ago
matematicsolutions