fix(pipeline): eliminar numeración de figuras y hacer quality gate no-bloqueante - #9
Merged
Conversation
…-bloqueante Raíz del problema: el FigureRegistry asignaba números 1-N a todos los slots registrados, pero algunos tokens nunca llegaban al texto final del documento (slots registrados pero no escritos). Resultado: el documento tenía figuras [1, 2, 4, 6] en lugar de [1, 2, 3, 4], disparando figure_numbering_out_of_order (severity=blocked) y cancelando el documento completo. Cambios: - FigureRegistry: replace_tokens_in_text() ahora emite "Figura" sin número secuencial. Sin numeración, no puede haber huecos que detectar. - QualityGateStep: elimina _audit_figure_sequence() y toda validación de secuencia de figuras/tablas. Los documentos ya no se bloquean por gaps. - QualityGateStep: citation_accepted_but_not_rendered y references_count_mismatch bajan de blocked a requires_attention — el documento se entrega con warnings. - QualityGateStep: chart_empirical_without_source baja de blocked a requires_attention por la misma razón. - config.py: quality_gate_block_on_p0 pasa a False por defecto. El quality gate es ahora advisory — detecta y registra problemas pero nunca cancela un documento. Los residuos técnicos (mermaid crudo, markdown sin renderizar, etc.) se siguen detectando pero se reportan como requires_attention, no como fallo. - AssemblyStep: _renumber_caption_label() ya no renumera — elimina el número del LLM y deja "Tabla." / "Figura." limpias. _looks_like_figure_caption() acepta "Figura:" sin número para detectar captions huérfanos correctamente. - Tests actualizados para reflejar el nuevo comportamiento. https://claude.ai/code/session_012p3P3J9NyFWzBDZYGZq68m
This file contains hidden or bidirectional Unicode text that may be interpreted or compiled differently than what appears below. To review, open the file in an editor that reveals hidden Unicode characters.
Learn more about bidirectional Unicode characters
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Add this suggestion to a batch that can be applied as a single commit.This suggestion is invalid because no changes were made to the code.Suggestions cannot be applied while the pull request is closed.Suggestions cannot be applied while viewing a subset of changes.Only one suggestion per line can be applied in a batch.Add this suggestion to a batch that can be applied as a single commit.Applying suggestions on deleted lines is not supported.You must change the existing code in this line in order to create a valid suggestion.Outdated suggestions cannot be applied.This suggestion has been applied or marked resolved.Suggestions cannot be applied from pending reviews.Suggestions cannot be applied on multi-line comments.Suggestions cannot be applied while the pull request is queued to merge.Suggestion cannot be applied right now. Please check back later.
Raíz del problema: el FigureRegistry asignaba números 1-N a todos los slots
registrados, pero algunos tokens nunca llegaban al texto final del documento
(slots registrados pero no escritos). Resultado: el documento tenía figuras
[1, 2, 4, 6] en lugar de [1, 2, 3, 4], disparando figure_numbering_out_of_order
(severity=blocked) y cancelando el documento completo.
Cambios:
secuencial. Sin numeración, no puede haber huecos que detectar.
secuencia de figuras/tablas. Los documentos ya no se bloquean por gaps.
bajan de blocked a requires_attention — el documento se entrega con warnings.
requires_attention por la misma razón.
es ahora advisory — detecta y registra problemas pero nunca cancela un
documento. Los residuos técnicos (mermaid crudo, markdown sin renderizar, etc.)
se siguen detectando pero se reportan como requires_attention, no como fallo.
del LLM y deja "Tabla." / "Figura." limpias. _looks_like_figure_caption()
acepta "Figura:" sin número para detectar captions huérfanos correctamente.
https://claude.ai/code/session_012p3P3J9NyFWzBDZYGZq68m