{"evidence_id":"dfe0018d-078c-4933-9064-7acc27cf27a1","entry_version_id":"08a80797-1ceb-4a93-936c-7420597cb2bb","catalog_entry_id":"z-ai/glm-4.5v","observation_id":"4ad52351-1a20-4a30-a2f2-6e29f8836a6c","observation_time":"2026-08-27T01:08:48.990790Z","integrity_digest":"bf6b18a607404691cdf00319239f6124127a16dffff6cbd55bb691b8f69828ae","prior_payload":null,"current_payload":{"id":"z-ai/glm-4.5v","name":"Z.ai: GLM 4.5V","links":{"details":"/api/v1/models/z-ai/glm-4.5v/endpoints"},"created":1754922288,"pricing":{"prompt":"0.0000006","completion":"0.0000018","input_cache_read":"0.00000011"},"reasoning":{"mandatory":false},"description":"GLM-4.5V is a vision-language foundation model for multimodal agent applications. Built on a Mixture-of-Experts (MoE) architecture with 106B parameters and 12B activated parameters, it achieves state-of-the-art results in video understanding,...","architecture":{"modality":"text+image->text","tokenizer":"Other","instruct_type":null,"input_modalities":["text","image"],"output_modalities":["text"]},"top_provider":{"is_moderated":false,"context_length":65536,"max_completion_tokens":16384},"canonical_slug":"z-ai/glm-4.5v","context_length":65536,"expiration_date":"2026-12-31","hugging_face_id":"zai-org/GLM-4.5V","knowledge_cutoff":"2024-12-31","supported_voices":null,"default_parameters":{"top_p":null,"temperature":0.75,"frequency_penalty":null},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","max_tokens","presence_penalty","reasoning","repetition_penalty","response_format","seed","stop","temperature","tool_choice","tools","top_k","top_p"]},"identity_classification":"review_candidate","identity_evidence":{"signals":{"unfamiliar_namespace":false,"missing_hugging_face_id":false,"experimental_stage_words":false,"absent_provider_attribution":true},"strong_signal":null,"review_priority":3,"namespace_segment":"z-ai","provider_attribution":null,"weak_review_priority":3,"provider_and_product_disclosed":false}}